AI 遊戲主持人研究
Claude Haiku 5.5:如何設計超快回應的 AI 遊戲主持人
探索 Claude Haiku 5.5 如何用於快速 NPC 對話與流暢的 RPG 回合,了解推理設定、提示長度定價,以及 Playworlds 的設計思路。
閱讀約 5 分鐘
本篇內容
讓冒險持續向前
你剛走到機關城門前,警報就響了。一名信使遞來偷走的通行證,守衛朝你的藏身處轉過頭。你想趁腦中的畫面仍然鮮活時立刻行動。超快的 AI 遊戲主持人應該給出足夠的資訊供你選擇,然後把行動權交還給你。
Anthropic 於 2026 年 10 月 7 日發布 Claude Haiku 5.5,並稱它是標準速度下最快的自家模型,同時說明 Fast Mode 下的 Opus 更快。這使 Haiku 值得用於探索反應靈敏的角色扮演。本文於 10 月 10 日完成資料查核,是 Playworlds 的遊戲設計提案;我們尚未在 Playworlds 中測量 Haiku 5.5,也未宣布整合。
更快到達下一個有意義的選擇
Anthropic 文件列出了自適應思考、預設 medium 推理投入、一百萬 token 上下文視窗,以及標準模式最高 128,000 token 輸出。對遊戲主持人來說,值得關注的是推理投入:一句問候和牽涉三個敵對陣營的談判,未必需要相同的推理預算。
我們構想的快速回合很精簡:回應行動,描述一個相關變化,再留出玩家選擇的空間。你出示通行證後,守衛可以檢查印章,並詢問它的來歷。敘事者應在這裡停下,而不是替你決定坦白或逃跑。簡短的輸出可以保留緊張感,也不必讓世界顯得空洞。
把目前場景需要的記憶帶進來
如果回覆忘了通行證是偷來的,再快也沒有多少幫助。我們會為敘事者提供精簡的目前地點、各角色已知的資訊、上一個已結算行動,以及相關角色資源。背包、生命值和任務進度仍以底層存檔為準。
長上下文是容量,並不意味著每回合都要重新傳送整個戰役。提取此刻重要的事實,並持久保存其餘紀錄。摘要可以輔助這個過程,但應保留未兌現的承諾和不確定性。壓縮內容時,懷疑不能悄悄變成已確認的事實。
讓快速敘述與深入規劃協作
一種值得測試的設計是,讓 Haiku 負責範圍明確的場景回應,在困難的轉折點請能力更強的模型參與判斷。交接內容應包含經過驗證的遊戲事實與玩家尚未做出的選擇。如果每次行動都增加一次模型呼叫,速度收益可能被抵銷,所以這是有選擇的設計方案,而非提速承諾。
Anthropic 的遷移指南也值得注意:Haiku 5.5 使用新的分詞器,同一段文字的 token 數量比 Haiku 4.5 約多 30%,思考設定和可接受的請求參數也有變化。只替換模型名稱並不算完成遷移。比較效能前,應重新計算實際提示的 token 數,並驗證回應解析邏輯。
token 單價低,仍要計算整場遊玩的預算
截至 10 月 10 日,提示不超過 100,000 token 時,Claude API 標準價格為每百萬輸入 token 0.10 美元、每百萬輸出 token 0.50 美元。提示超過該門檻後,分別為 0.50 美元和 2.50 美元。快取讀取與寫入另有定價;上下文容量大,並不意味著所有請求都適用最低單價。
舉例來說,在較低費率下,一次未使用快取、包含 8,000 個輸入 token 和總計 1,000 個計費輸出 token 的呼叫,費用為 0.0013 美元。計算假定輸出總量已包含所有計費思考,並未包含重試、額外呼叫、語音、影像或基礎設施。這不是實測的單次遊玩成本,也不是 Playworlds 點數價格。預算應涵蓋完成整次遭遇的過程,包括修正。
測量玩家真正經歷的等待
我們會用相近預算比較相同的短場景:詢問信使、冒險穿過城門,以及重新載入後返回。分別記錄首次顯示文字與完整可用回合的耗時,同時核對存檔狀態是否符合敘述結果,並統計為了修正錯誤而消耗的回應。
在多次遊玩中重複練習,觀察常見耗時與較慢回合,而不是只展示最快的一次。模型生成只是等待的一部分:佇列、狀態讀取、工具結算、儲存和選用語音也會影響體驗。有價值的提速,應讓玩家更快取得清楚的選擇,同時保持世界一致。
嘗試一場節奏清楚的短冒險
可以設計一座機關鐘響起便關閉城門的城市。你的角色帶著偷來的通行證,還欠信使一個人情。先問一個問題,再嘗試一個有風險的行動,然後核對發生了什麼變化。這是原創試玩設定;除非遊戲明確支援即時倒數,否則鐘聲應是故事中的壓力。
今天就可以透過 Playworlds 的世界庫、自訂世界、角色、骰子與冒險存檔,探索這種單人遊玩方式。Haiku 5.5 是未來用途的評估候選,本文並未證實它已可在 Playworlds 中選擇。挑一個世界,給角色一個眼前的目標,再看每一回合是否自然地引出你的下一步行動。