先这样答
结论是:我会让 Agent 通过结构化 API 完成发帖流程,而不是模拟用户操作 UI。这样可以让外部系统适应 Agent 的调用方式,也更方便控制每一步的输入和输出。
第一步做意图理解,识别用户想发什么内容。第二步做内容生成,产出文案和图片。第三步推荐标签,并让 Agent 说明推荐结果。第四步执行发布,调用对应 API 完成发帖。第五步跟踪发布效果,把结果返回给用户。
每一步都要设置校验和人工确认节点。意图不清时,先让用户补充信息。文案、图片和标签生成后,先让用户确认。发布前再做一次内容检查,并确认用户确实要发布。发布完成后,Agent 继续读取效果数据并反馈。这个设计考察的重点不是怎么自动点击页面,而是能否看出 Agent 应该通过结构化接口完成任务。
面试官会怎么追问
-
「为什么不直接用浏览器自动化模拟发帖?」
浏览器自动化依赖页面结构和交互流程,页面变化后容易失效。结构化 API 能直接表达内容、图片、标签和发布动作。Agent 可以围绕明确的数据和动作做校验,也更容易插入人工确认。 -
「哪些步骤必须让人确认?」
意图理解出现歧义时,需要让用户确认目标。文案、图片和标签生成后,需要让用户检查内容是否符合预期。正式发布前还要再次确认,因为发布动作会直接影响最终结果。 -
「如果发布效果不好,你会怎么处理?」
先跟踪发布后的效果,并把结果反馈给用户。Agent 可以根据用户的新指令继续调整内容或标签。每次调整仍然经过生成、校验和确认,再决定是否发布。
回答的坑
- 把重点放在模拟点击、填写表单和绕过页面限制上,会偏离这道题考察的 Agent 设计方向。
- 只描述生成文案和图片,却没有意图校验、人工确认和效果跟踪,流程就不完整。
同系列的题
这家公司的面经实录
—— 本题完 ——