公众号 · AGENTALPHA

公众号文章合集,
一篇不落。

面试长文、工程拆解、社区动态与学员案例,全部收录在这里,点击直达微信原文。每周同步一次。

2026-09

2026-08

恭喜学弟拿下小红书offer2026-08-30

我记得 2 月份刚加入社区还是基础比较薄弱,基本没咋看过论文更别说跑过项目了,直接参与auto research项目,练中学进步很快,后面实习也都很顺利,面试前还约着开了个会突袭了下,没想到都用上了,自进化目前阶段还是很吃香的哈哈,最后放张去年的薪资爆料,一浪更比一浪高啊 #ag

阿里面试官追问:Code Agent 跑到一半挂了,怎么恢复而且不重复执行?2026-08-23

恢复不是把聊天记录接着播一遍。要靠持久化状态、操作幂等键和未知结果对账,把重复副作用关在边界内。

拿了一圈大厂offer的学弟最后竟然选了…2026-08-22

哈哈哈选了qwen,其他龙猫和混元也不错啦,seed没面也确实有些可惜,不过老弟的self-envoling agent项目确实贼到位,投的十几个大厂全都很顺利,基本面的都逮着这个在聊,所以如果项目简历到位,面经就不用担心了~(¯▽¯~)~ 之前给老弟推荐了qwen ,不管是方向

阿里一面:“Agent 已经会 ReAct 了,为什么还要做 Agentic RL?拿成功轨迹做 SFT 不就行了?”2026-08-20

ReAct 让 Agent 能做多步任务,Agentic RL 让它学会在复杂环境里做更好的决策;真正的难点在动作与观察隔离、信用分配和异步 Rollout。

阿里面试官追问:Code Agent 为什么不能直接给它 root 权限?2026-08-16

Code Agent 的权限不是一个开关,而是一套可验证的执行边界:文件、网络、进程、身份和审批都要分别设计。

面试官疑惑:你的 Agent 跑了二十轮对话,上下文爆了怎么办?2026-08-09

截断会丢硬约束,粗暴摘要会精度坍缩;上下文管理是三层蒸馏+四策略叠用。

面试官反问:Agent 为什么必须学会遗忘? 你回答不上来2026-08-07

面试官问这道题,真正想听到的不是你会不会背"时间衰减、访问频率、重要性评分"这些词。 他想知道你有没有意识到: 记忆是带状态、带时效、带来源、带适用条件的。 长期记忆不是越多越好,检索也不是越相似越好。

看下还有没有想拼团大模型agent课程的友友,一起优惠下2026-08-06

看下还有没有想拼团大模型agent课程的友友,一起优惠下

社区学员刚面完:长期记忆全塞向量库?2026-08-01

社区学员面试题复盘:用一条报销政策讲透长期记忆的分层存储、版本冲突、双时间与后台整理。

2026-07

问的最多的大模型 Agent 算法面试题:设计Agent 记忆系统?2026-07-30

社区学员遇到的字节 Agent 二面题拆解: 你是怎么设计 Agent 的记忆系统?

字节招实习生2026-07-29

帮朋友发下招实习生 职位描述 ByteIntern:面向2027届毕业生(2026年9月-2027年8月期间毕业),为符合岗位要求的同学提供转正机会。 团队介绍:AI数据与安全团队为Seed基座模型及AI原生应用提供跨模态数据服务,覆盖数据生产全流程,包含模型评估标准的制定、数据

字节二面面经:用户反馈怎么被 Agent“吃掉”?2026-07-28

写进 Memory 就算学会了吗?这道公开面经原题,真正追问的是一次反馈如何变成可验证、可回滚的下一版能力。

阿里 Agent 岗二面:Agentic RL 到底在训什么?2026-07-26

Agentic RL 不是训练模型更会调用工具,而是训练模型在环境里进行多步决策,并最终对任务结果负责。

字节 Agent 岗二面:RAG 的 Top-K 是不是越大越好?2026-07-25

Top-K 不是越大越好,而是要根据问题类型、检索质量、Rerank 分数和上下文预算动态决定。

一周学会Agent Memory,实现自动科研助手项目2026-07-24

Agent训练营 一周掌握Memory系统

面试官问:什么时候工作流就够了,什么时候才该上 Agent?2026-07-22

最近在大模型工程岗面试里,一个让人很难答漂亮的题目出现了:

面试官:CoT和Planning 这俩有啥区别?不都是让模型先想步骤再执行吗2026-07-21

100 道高频大模型 agent 面试题精讲系列

2026-05

2026-04

2026-03

2026-01

2025-12

高中生也能看懂:AI Agent 的“灵魂”觉醒——从 RAG 到自主意识的进化实录2025-12-28

现在的 AI 圈子很浮躁。 昨天流行 RAG(检索增强),今天吹爆 Agent(智能体),明天又是 Multi-Agent(多智能体)。

大模型agent圆桌会,讲讲百万年薪2025-12-26

联合offershow一起做圆桌会➕答疑会,欢迎感兴趣的报名,主题:大模型agent求职规划,code agent,AI coding,顶会发表等 普通人如何抓住agent风口,打造技术护城河 时间:12.28 19:00

大模型agent答疑会 RAG专题2025-12-20

第一次答疑会的精华总结一部分,完整版可以留dd

Agent memory 来打造钢铁侠管家“贾维斯”:讲故事让你学懂智能体记忆机制2025-12-12

AI架构师的视角,用“全知管家贾维斯”的故事线讲清楚25年最火的Agent Memory

大模型agent学习第三模块2025-12-09

AI Agent 学习笔记涵盖其本质、架构组件、工具调用、记忆系统、框架应用、自我反思能力构建及多 Agent 协作等内容,并给出了相应代码实践。关键要点包括: 1. Agent 本质:Agent 是能自主完成任务的智能系统,通过「思考 - 行动 - 观察」(T - A - O)

大厂面试RLHF:从PPO,DPO,GRPO…2025-12-05

大模型RLHF面试,一篇笔记帮你搞定 大模型RLHF面试,一文梳理强化学习RLHF全家桶: PPO:经典基石 核心:四模型协同(策略 + 参考 + 奖励 + 价值)+ clip 安全绳特点:通过概率比限制策略更新幅度,保证训练稳定适用:通用场景,资源充足时首选复杂度:⭐⭐⭐⭐ D

一周学会Agent Memory,实现自动科研助手项目2025-12-04

Agent训练营 一周掌握Memory系统

高中生也能看懂:Agent Memory ——为何超越 RAG ?2025-12-03

agent memory和 RAG(检索增强生成)到底有什么区别?

2025-11

2025-10

2025-09

2024-12

更早

网页版auto resesrch在路上了!

idea2Paper经历了 3 个月的蛰伏,现在全链路真正打通了,测试效果也不错,EMNLP三中一(这次录用率确实太低) 每个模块基本上都精心打磨后从调研到idea的产出都花了一个多月的时间来优化,然后自动跑实验就比较简单了,从idea树里挑出几个好的根据时间段和其他指标loop

大厂面试,自进化 agent 正在成为主流!

自进化 agent 已成为大厂最注重的研究方向。现在的面试官,看的是你能不能解决复杂工程问题,能不能让Agent具备“自我进化”的能力。

英伟达创始人黄仁勋第一帖支持 kimi!开源万岁

英伟达创始人黄仁勋第一帖支持 kimi!

蚂蚁二面:Agent 记忆的写入流程要做哪些处理?直接存对话不行吗?

蚂蚁二面面试题:Agent 记忆写入流程怎么做?从降噪清洗到元数据标注完整拆解。

字节 Agent 三面:讲讲 Agent 的记忆系统怎么设计?

字节 Agent 岗三面面试题:Agent 的记忆系统怎么设计?从分层架构到工程落地完整拆解。

如何学习Claude Code——从小白到高手的 Agent Harness 学习之路

学 Claude Code,真正要学什么?

企业 Agent 落地,这些错误是大忌!

企业 Agent 第一版不要做聊天框,要先补齐输入、知识、工具、日志、评估、人工接管和回滚。

强化学习跌落神坛?清华NeurIPS最佳论文:大模型推理能力早被基座"锁死"!

清华NeurIPS最佳论文:重新审视强化学习,你应该试试蒸馏了!

SVD让AI模型合并不再"翻车",中科院北大提出无需额外训练和数据的RobustMerge!

RobustMerge:SVD让AI模型合并不再"翻车"!

12.6K Star!Docling:AI 开发者的文档解析利器

在信息爆炸的时代,海量文档资料如潮水般涌来,你是否常深陷其中,为难以迅速精准获取关键信息、将复杂文档转化为易用格式而烦恼?别担心,Docling 这款 AI 驱动的开源文档解析神器将为你排忧解难。 一、Docling 的崛起 Docling 在 GitHub 开源社区大放异彩,短

△ AgentAlpha 公众号

长文首发在公众号,题库沉淀在站内。

去刷面试题