跳转到正文

AI 模型与游戏体验

用 GPT-6.1 Sol 驱动 AI 主持人:Playworlds 设计蓝图

探索 GPT-6.1 Sol 主持人设计:有意义的 NPC 选择、持久战役状态、经验证的规则,以及成本与回合质量的实用测试。

作者 Playworlds · Elser.AI ·

披着斗篷的冒险者沿石径走向雾山间发光的传送门。

更强的主持人,究竟应该做好什么?

你向城门守卫展示一枚偷来的印戒。她认出了它,而戒指所属的贵族正是她的兄长。出色的主持人要兼顾她的职责、亲情,以及你已经透露的信息。最好的回应会创造新的选择,而不会替角色决定下一步。

OpenAI 于 2026 年 9 月 29 日发布 GPT-6.1 Sol。它值得在这样的场景中评估。下文说明它可以如何驱动 Playworlds 这类游戏的主持人,并不宣布 Playworlds 已提供这一模型,也不声称已在真实战役中完成基准测试。

给 Sol 场景、利害关系和停下的位置

在这一主持人方案中,向模型提供玩家的原始行动、相关角色能力、当前位置、已确立的 NPC 动机和未解决的后果。明确任务:对印戒做出反应,只透露守卫愿意透露的内容,并在玩家需要做出有意义的决定时停下。

示例指令:“守卫既看重誓言,也关心兄长。她看到了印戒,但不知道玩家如何得到它。回应玩家明确提出的行动,不替玩家决定情绪,也不替玩家接受交易。留出谈判、撤退或尝试其他方法的空间。”这是用于说明的提示词,并非观察到的 Sol 输出。

让模型叙述,让游戏验证

GPT-6.1 Sol 支持流式响应和结构化输出。在拟议的引擎中,这些能力可以同时提供可读叙事与机器可读请求。即便模型请求转交印戒,游戏仍需确认归属与操作是否合法,才能更新存档。

骰子结果、物品变更和已完成任务都应记录在权威游戏状态中。连接中断后重试请求,不能重复发放同一枚印戒。将已确认的结果交回叙述者,使描写与玩家下一步实际可做的事情一致。格式有效,并不代表规则裁定正确。

围绕回合选择推理设置

需要工具调用时使用 Responses API。Sol 6.1 支持 low、medium、high、xhigh 和 max 推理,不支持 none 与 minimal。如果旧接入依赖不受支持的设置或 Chat Completions 工具调用,迁移就不只是替换模型名称。

评估主持人时,可先用 medium,再以相同场景对比 low 的日常对话表现。复杂谈判或任务条件冲突时测试更高档位。测量出现有用叙事的时间和整个行动结算完成的时间,再选择达到质量要求的设置。这些是评估建议,并非特定提速承诺。

为整场战役做预算,而非一段惊艳回复

对于输入不超过 272K token 的提示,标准 API 费率为每百万输入 token 2 美元、每百万输出 token 10 美元。这是供应商费率,不是 Playworlds 点数或玩家订阅价格。缓存、更长提示及其他处理选项应以最新价目表为准。

举例来说,8,000 个未缓存输入 token 与 800 个计费输出 token 按上述费率共计 0.024 美元。这只是计算示例,不是 Playworlds 的实测回合成本。应统计包括推理在内的全部计费输出,并加入额外调用、重试和服务成本。持久世界状态应保存在提示之外,每次只传入当前场景所需事实,不要反复发送整段战役。

测试后果能否延续到下一次回访

在候选设置间使用同一场短冒险:遇见守卫、展示印戒、一次冒险行动失败、离开、再返回。检查她的动机是否一致、失败是否仍有影响、物品是否与存档相符,以及玩家是否保有控制权。重复测试,既记录精彩对话,也记录错误。

还要使用玩家的语言重玩:姓名、已揭示线索和规则结果应在翻译后保持一致。本文的七个语言版本是编辑翻译,不能证明模型在各语言中表现相同。资料核对于 2026 年 10 月 1 日。你可以使用 Playworlds 当前提供的选项开始冒险,再用这份蓝图判断未来采用 Sol 的主持人应通过测试证明哪些能力。