AI 模型与游戏体验
用 Claude Sonnet 5.5 驱动 AI RPG:更快的回合,持续的后果
探索 Claude Sonnet 5.5 如何用于 AI RPG:自然的 NPC 互动、持久的战役记忆、可靠的规则,以及可复现的角色扮演测试。

Sonnet 5.5 能为冒险带来什么
AI RPG 的节奏,藏在你做出选择与世界回应之间。你引开守卫、询问证人,或走上一条危险的捷径。下一回合应当在灵感还鲜活时到来,也应尊重你真正做出的选择。因此,Claude Sonnet 5.5 值得作为 RPG 引擎的叙事层候选来评估。
Anthropic 于 2026 年 9 月 28 日发布 Sonnet 5.5,并称其输出生成速度比 Sonnet 5 快 30% 以上。这是模型提供方的说法,不是 Playworlds 的实测游戏数据。下文讨论的是我们会如何评估它的角色扮演能力,并不表示 Playworlds 已提供 Sonnet 5.5 引擎。
让 NPC 做出反应,把选择留给玩家
想象一位藏起走私账本的港口文书。你的角色承诺保护他,以换取一个名字。合格的主持人可以让文书犹豫、讨价还价或撒谎,同时把下一步留给你。除非你自己决定,它不应替你的角色接受交易、花掉金币或坦白秘密。
这是一段用于说明的场景,不是 Sonnet 5.5 的实际输出。测试时,向模型提供文书的动机、已经揭示的事实和玩家的原始行动。要求它用简短回应推动局势,并停在下一个有意义的决策点。观察人物是否可信,以及你的自主权是否得到保留。
让战役拥有对话之外的记忆
叙述再流畅,也可能忘记钥匙已经消耗,或队友已经离队。持久运行的 RPG 应当把物品、位置、关系、已发现的线索和未兑现的承诺记录在存档状态中。每回合提供相关事实和精简的近期事件,而不是指望叙事文本独自保存整个战役。
在采用 Sonnet 的设计中,模型可以提出后果,游戏则验证并记录真正发生的变化。明天回来时,文书仍记得那笔交易,应当是因为它已写入世界存档。更长的上下文窗口可能有助于对话,但不能代替存档。
让骰子、规则与后果保持一致
如果你试图偷走账本,引擎需要判断是否要检定、使用哪个修正值,以及失败意味着什么。叙述者可以描写颤抖的手和吱呀作响的地板。规则层则应负责结算掷骰、核对允许的状态变化,并防止重试重复发放同一件物品。
这种分工是评估 Sonnet 5.5 的架构建议,不是它能遵守所有桌游规则的证明。请测试一次失败的掷骰、一次不可能的行动和一次重复请求。好的叙事应让挫折仍然可玩,而不是悄悄改写结果,或虚构规则没有允许的成功。
衡量完整回合,而不只是 token 速度
截至本文发布,Anthropic 列出的 Sonnet 5.5 API 价格为每百万输入 token 2 美元、每百万输出 token 10 美元。这是模型 API 费率,不是 Playworlds 的玩家定价。战役成本还取决于重复发送的历史长度、回复长度、重试次数及其他服务。
评估 RPG 时,应同时测量有用叙事开始前的等待时间,以及行动完全结算所需的时间。把状态读取、模型调用、规则检查和使用时的语音播放都计入。用同一场景和相同输出长度比较不同设置。保留真实选择的简短回应,可能比更快输出一大段多余描写更适合游戏。
先尝试短战役,再信任长旅程
把港口场景设计成五回合测试:先见到文书,再揭示线索、尝试危险行动、离开港口,最后回来。检查模型是否沿用相同名字、记得交易、尊重掷骰结果,并让你决定如何回应。多跑几次:一段惊艳的文字不能证明战役行为可靠。
你可以在 Playworlds 的预设冒险中体验这类选择,也可以从自定义世界页面开始,提出自己的故事设定。模型是否可用,以游戏实际提供的选项为准。本文依据截至 2026 年 9 月 29 日核查的官方资料提出设计分析;我们尚未发布 Sonnet 5.5 的 RPG 基准测试。目标是一个你能行动、能重返的世界,让后果在下一次回复之后依然存在。