五厂面经真题集腾讯面经高频CoT提示工程推理速答 · 约 5 分钟更新 2026-09-28

CoT 为什么有效?它有什么缺点或局限?

一句话结论

模型逐 token 生成没有回头修改的机会,CoT 把中间步骤外置到上下文里当草稿纸,后续生成能利用已写下的推理;代价是 token 和延迟成倍涨,且推理链出错会向下传导。

先这样答

CoT 的有效要讲机制而不是「让模型一步步想」。模型是一个 token 一个 token 生成的,生成过程中没有回头修改的机会,多步问题直接跳答案,中间结果全靠在「脑子里」一次性保持。CoT 让模型先写出中间步骤,等于把推理过程外置到上下文里:后面的生成能直接利用前面已写下的内容,每一步都可验证,错误自然减少。这不是模型在沉思,是草稿纸的作用。

局限必须主动讲全,这是这题的得分点。第一,成本:token 消耗和延迟成倍上涨,简单问题用 CoT 是纯浪费。第二,错误传导:推理链本身会出错,前面错一步后面全错,而且链越长错的机会越多。第三,表达层风险:对外产品不一定适合展示完整推理,通常展示简要理由或核查步骤。

使用判断一句话:多步计算、逻辑推导、因果链任务用 CoT;事实型简单问题直接回答。能说出「什么时候不用」,比只会说「它很好」高一档。和 Few-shot 的组合也常被追问:示例里带上推理过程,模型跟着学分步表达,两者是配合关系。

面试官会怎么追问

  • 「零样本 CoT 和少样本 CoT 区别?」 零样本只加一句「一步一步思考」,效果提升有限且不稳定;少样本给带推理过程的示例,格式和思路都有示范,效果通常更好。
  • 「推理链错了怎么兜底?」 关键步骤加自检:让模型验算中间结果、或者用另一个模型核对;对高准确率要求的场景把 CoT 和工具计算结合,算术交给代码。
  • 「推理模型和手写 CoT 什么关系?」 推理模型把这类思维链训练进了模型行为,按需生成内部推理,用户不用再手写提示;但成本和错误传导的代价同样存在。

回答的坑

只答「一步步思考效果更好」,说不出逐 token 生成这个机制层的原因,会被判定背结论。

全篇没有一个字的代价分析,是这题最常见的挂法。

—— 本题完 ——