五厂面经真题集网易面经高频高频考点游戏AI对话系统速答 · 约 6 分钟更新 2026-09-30

游戏里给 NPC 加大模型驱动的智能对话,技术上怎么设计?要注意什么坑?

一句话结论

架构是设定库加大模型加安全层:角色卡固化人设、世界观知识库约束事实边界、状态机管理剧情进度;坑在延迟破坏沉浸、成本随玩家数爆炸、角色出戏和内容安全。

游戏里给 NPC 加大模型驱动的智能对话,技术上怎么设计?要注意什么坑?

先这样答

架构分四层。角色卡层:每个 NPC 的性格、背景、说话风格、口头禅写成结构化设定,作为系统提示词注入,这是人设一致性的锚。世界观层:游戏的剧情设定、地理、阵营关系做成知识库,对话时检索相关条目注入,防止 NPC 说出世界观之外的话,比如把现代词汇带进古代场景。状态层:任务进度、好感度、剧情分支这些游戏内状态实时传给模型,NPC 的回应要和剧情阶段吻合。安全层:输出过滤违规内容,玩家诱导攻击的拦截。

坑有四个。延迟:对话游戏的体验窗口在几百毫秒到一秒,大模型推理要按这个预算做流式输出加端侧预测兜底,超时的卡顿比模板对话更伤沉浸。成本:开放世界几百万玩家和 NPC 高频对话,调用成本随玩家数线性爆炸,方案是分流——主线剧情 NPC 用高质量模型加缓存(热门问题的回答可复用),边缘 NPC 用轻量模型,环境氛围类交互(路人闲聊)用规则加文本池。出戏:玩家会刻意试探 NPC 的边界,问模型知道但角色不该知道的事(剧透、穿越设定),要在提示词里明确知识边界并做输出校验。一致性:同一 NPC 被成千上万玩家对话,各自的剧情状态要隔离,多人共见的 NPC 言行要可复述,这是状态管理的复杂度来源。

面试官会怎么追问

  • 「怎么防止 NPC 说出不该说的剧透?」 知识边界显式化:角色卡里写清「该角色知道什么、不知道什么」,检索层按剧情进度过滤知识条目,输出层做剧透关键词拦截。三层都要有,单靠提示词不够。
  • 「成本分流具体怎么切?」 按 NPC 重要性分层:剧情关键 NPC 走旗舰模型加状态缓存,功能性 NPC(商人、向导)走小模型加意图识别预处理,路人 NPC 走无模型的文本池。用对话深度做二次控制,超过 N 轮自动收敛回剧情轨道。
  • 「多人同时和一个 NPC 对话怎么办?」 按玩家隔离状态,每人一条剧情线;NPC 的公共言行(广播、任务发布)走预生成或缓存,保证所有玩家看到一致内容。

回答的坑

  • 只谈对话效果不谈延迟和成本。游戏是强工程约束场景,这两个是落地的第一道门。
  • 忽略世界观约束。NPC 知识边界管理是游戏场景和通用聊天的最大差异。
—— 本题完 ——