先这样答
长期记忆只应写入跨会话可复用、状态稳定且来源确凿的信息。系统必须坚持宁缺勿滥原则——写错比不写危害大。错误记忆会持续污染后续生成。
写入信息需要严格满足三个准则。第一是可复用。信息必须在跨会话场景中具备持续价值。第二是稳定。系统拒绝写入一次性上下文。第三是有明确来源。系统只记录用户直接表述的内容。工具明确确认的执行结果也可以作为来源。系统必须舍弃缺乏来源支撑的临时对话片段。
防幻觉的核心是来源校验与分级存储。系统在写入长期记忆前必须校验信息来源。系统将模型生成的推断与客观事实分开存储。系统强制给推断类信息打上低置信度标记。系统还要定期利用新交互校验旧记忆。用户的新输入提供验证已有记忆准确性的依据。系统发现旧记忆与新交互冲突时及时修正旧记忆。
面试官会怎么追问
- 「事实和模型生成的推断具体怎么分开存?」 系统在抽取记忆时设置独立的数据字段。事实字段只存用户原话或工具确认的结果。推断字段专门存放模型生成的结论。系统给推断字段的内容附加低置信度标记。
- 「定期用新交互校验旧记忆的具体动作是什么?」 系统在获取用户新输入时提取最新信息。模型将新信息与数据库中的旧记忆进行一致性比对。系统发现矛盾时利用新交互更新旧记忆。
- 「为什么强调写错比不写危害大?」 系统会将错误记忆作为固定背景知识带入后续对话。模型基于错误前提产生严重的级联幻觉。坚持宁缺勿滥原则切断幻觉的永久保存路径。
回答的坑
把一次性的临时上下文当作稳定信息写入长期记忆。 系统没有给模型推断打低置信标记导致推断被当成事实复用。
同系列的题
—— 本题完 ——