开发日志 007:用时序事实与翻盘策略加固 AI 狼人杀

从“能模拟”到“不能说出不可能的话”

上一阶段已经建立了种子化模拟、置信矩阵和策略复盘,但一局 9 人局的真实回放暴露了更基础的问题:内部策略曾被误当成已经公开的身份宣称,AI 会向已死亡玩家提问,把警长与预言家的能力混为一谈;部分关键身份还会在掌握高价值信息时长期使用空泛的安全句过麦。

这些问题不能仅靠补一条提示词解决。本轮把边界重新划分为“确定性的事实层 + 建议式战略层 + LLM 最终选择”:程序负责识别公开事实、存活状态、能力前提和时间顺序,策略模块负责提出有代价的候选路线,模型仍决定相信谁、公开多少信息以及最终采取哪一个合法行动。

公开记忆必须由公开行动产生

系统将计划采用的身份口径、已公开的角色宣称和警长等公开职位拆开保存。只有发言成功写入公开日志后,身份表态和公开承诺才会进入其他玩家可见的记忆;私有策略、夜间动作或失效候选不会再被伪装成已经发生的公开事实。

分析器同时维护角色能力账本和存活目标集合。只有已经公开跳预言家的玩家才可以被要求提供查验方向;警长可以归票、安排发言和处理警徽,但不会被赋予查验能力。对死亡玩家提出回答要求、把旧死亡对象当作当前夜间选择,或要求不具备能力的玩家执行动作,都会在事实修复与最终校验中被拦截。

关键节点给建议,而不是替玩家下结论

本轮将未公开查验、查杀数量、身份对跳、神职压力、连续弃票和重复查验等状态结构化。当预言家持续压住高价值信息、神职成为全桌焦点却只选择过麦,或一轮轮弃票不断给狼人增加夜间收益时,风险层会触发二次比较。

比较不会强制 AI “必须跳身份”或“必须投某人”,而是并列展示继续隐藏、有限披露、完整公开、形成票型或改变目标的收益与代价。狼队夜间选择也从座位远近等无规则价值的解释,转向身份威胁、信息影响、保护风险、票型收益和公开关联。系统保留博弈中的欺骗和误判,但让每一步偏离都能回溯到具体局势。

顺序发言与遗言也有不可跨越的时间边界

狼人杀白天不是即时聊天室。系统新增本轮座位顺序、已发言者、未发言者和当前发言位置的账本:面对前置位应总结或评价其既有发言,面对后置位才可以追问和施压,末置位应收束自己的判断。AI 不再等待本轮已经发言的玩家“马上回应”。

遗言场景同样被视为终局表达。死亡玩家可以留下身份、信息链、矛盾与给幸存者的建议,却不能再说“继续观察”“等下一轮信息”或安排自己后续参与。上下文注入则完整保留当前轮原话、公开身份、查验、遗言、死亡、警长变化和票型;被压缩的只是不再影响决策的旧闲聊。

质量层进一步检测原句复制和同一命题的换词复读,低信息回合允许自然简短表达,但关键身份或高压票型下不能再以固定安全句逃避判断。新增指标也把公开记忆可信度、高价值信息响应、死亡目标正确率、能力一致性、重复查验和弃票复盘纳入赛后分析。

阶段结果

这轮更新让狼人杀 AI 的“合法”从动作格式扩展到对局事实和时间语义:它知道哪些信息已经公开、谁仍能回应、哪些能力可以被要求、遗言还能留下什么,也能在关键局势下看到不同行动路线的后果。

下一步将继续用完整回放验证这些规则在不同人数与角色组合中的稳定性,重点观察修复是否降低不可能发言,同时不把多智能体博弈重新压缩成单一脚本答案。

所属项目AI 桌游对战平台 · 进度 40%