KI-Spielleiter-Design
Wenn ein KI-RPG scheitert: Ist der Prompt wirklich das Problem?
Nutze die API- und Agentenhinweise zu GPT-6 Astra und Claude Opus 5.5, um Kontext, Ausführung und Spielstand vor Prompt-Änderungen zu prüfen.

Beginne mit dem Spielzug, der tatsächlich gescheitert ist
Ein besserer Prompt repariert nicht jeden kaputten Spielzug in einem KI-Rollenspiel. Stell dir diese Beispielszene vor: Dein Ranger versucht, eine morsche Brücke zu überqueren. Das Spiel verlangt einen Wurf, und der sichtbare Würfel zeigt 9 plus 3 gegen ein Ziel von 15. Die Summe ist 12, doch der nächste Absatz sagt, der Ranger sei sicher über die Brücke gekommen. Bevor du eine nachdrücklichere Anweisung hinzufügst, identifiziere, wo der Widerspruch in den Spielzug eingetreten ist. Dies ist ein diagnostisches Beispiel und kein dokumentierter Playworlds-Fehler.
Notiere dir die Spieleraktion, den verlangten Wurf, das protokollierte Ergebnis, die erwartete Konsequenz, die geschilderte Konsequenz und den Zustand nach einem Neuladen. Diese Beobachtungen machen das Problem reproduzierbar. Ein Spieler kann die Szene mit dem sichtbaren Würfelergebnis und der Charakterbogen vergleichen und einen Widerspruch klar beschreiben, wenn er die nächste Wahl beeinflusst.
Trenne Aufgabenformulierung von fehlendem Kontext
Die Formulierungsebene fragt, ob das Modell eine klare Aufgabe erhalten hat. Sollte es ein bereits entschiedenes Scheitern schildern oder selbst entscheiden, ob die Überquerung gelang? Hat sie gesagt, wo es aufhören und was dem Spieler überlassen soll? Wenn diese Grenzen unklar waren, formuliere die Aufgabe, das benötigte Ausgabeformat und die Fakten, die beachtet werden müssen.
Die Kontextebene fragt, welche Fakten bereitgestellt wurden. Ein Erzähler, der nie die Summe 12, das Ziel von 15 oder den Zustand der Brücke erhalten hat, kann sie nicht treu berücksichtigen. Prüfe die tatsächliche Anfrage oder den Trace. Sie sollte den Ort, die relevante Fähigkeit, den entschiedenen Wurf und die festgelegten Konsequenzen enthalten. Wenn der Input veraltet ist, korrigiere seine Zusammenstellung, bevor du den Text bewertest.
Prüfe Einstellungen und API-Pfad
Ein Modell-Upgrade kann unterstützte Steuerungen und das Tool-Verhalten ändern, während der Prompt identisch bleibt. Prüfe Modell, Endpoint, Reasoning-Einstellung, Ausgabe-Limit, Schema und Tools gegen die aktuelle Dokumentation. Die GPT-6-Anleitung von OpenAI besagt beispielsweise, dass Astra-Tool-Aufrufe die Responses API erfordern. Ein Chat-Completions-Tool-Workflow in dieses Setup zu kopieren, ist ein Integrationsproblem. Dies kündigt Astra nicht als Playworlds-Spielleiter-Option an.
Suche nach einem Fehler, einer abgeschnittenen Antwort, einem unvollständigen Tool-Aufruf oder einer Parser-Verwerfung, bevor du Anweisungen bearbeitest. Teste eine minimale unterstützte Anfrage mit demselben Modell und Endpoint. Wenn diese erfolgreich ist und der vollständige Spielzug scheitert, vergleiche die Payloads. Wenn sie ebenfalls fehlschlägt, behebe zuerst Kompatibilität oder Konfiguration.
Verfolge die Ausführung, bevor du den Erzähler beschuldigst
Ein Rollenspiel-Spielzug kann einen verlangten Wurf, ein Tool-Ergebnis, eine Erzählung und ein Speichern umfassen. Frage dich, welche dieser Schritte tatsächlich abgeschlossen wurden. Hat der Wurf ein Ergebnis erzeugt und wurde dieses dem Erzähler übergeben? Ist die Erzählung vor der Auflösung des Wurfs eingetroffen? Wurde ein fehlgeschlagenes Speichern später für einen abgeschlossenen Spielzug gehalten? Ein flüssiger Satz ist ein Beweis dafür, dass Text generiert wurde; er ist kein Beweis dafür, dass das Spiel den beabsichtigten Zustand aufgezeichnet hat.
Diese Unterscheidung gilt auch für unbeaufsichtigte Agenten. Die Opus-5.5-Anleitung von Anthropic warnt, dass ein rein textbasiertes Ende eines Agenten-Durchlaufs ein Fortschrittsbericht sein kann und kein Beweis dafür, dass eine mehrstufige Aufgabe abgeschlossen ist. Definiere den Abschluss eines RPG-Spielzugs über Anwendungsevents: einen entschiedenen Wurf, eine akzeptierte Konsequenz und ein dauerhaftes Speichern. Schließe nicht aus den Abschlussworten des Modells auf alle drei.
Prüfe den Zustand und verifiziere das Ergebnis
Angenommen, die erste Antwort sagt, der Ranger rutscht aus und fängt sich an einem Seil, aber beim Neuladen befindet er sich auf der anderen Seite der Brücke. Das deutet auf ein Zustands- oder Speicherproblem hin. Vergleiche das akzeptierte Würfelergebnis und die erlaubte Zustandsänderung mit dem gespeicherten Abenteuer, öffne es dann in einer neuen Sitzung. Wenn der gespeicherte Zustand richtig ist, aber der Text falsch, prüfe die Erzählung. Wenn der Text richtig ist, aber das Speichern falsch, prüfe den Commit-Pfad.
Die Verifizierung sollte eine beobachtbare Bedingung verwenden. In diesem Beispiel bedeutet Erfolg, dass die angezeigte 12 unter der gewählten Regel weiterhin ein fehlgeschlagener Wurf bleibt, die Erzählung eine spielbare Konsequenz beschreibt, ohne Erfolg zu erfinden, und das erneute Öffnen des Abenteuers denselben Ort und dasselbe Ergebnis beibehält. Eine einzelne gut aussehende Antwort reicht nicht, wenn ein erneuter Versuch oder Neuladen das Ergebnis ändert. Führe nach einer Änderung dasselbe kleine Szenario aus und protokolliere sowohl den erwarteten als auch den beobachteten Zustand.
Eine sechsstufige Checkliste für die nächste Abweichung
Verwende diese Reihenfolge, wenn eine Antwort des Spielleiters falsch erscheint: (1) Aufgabenformulierung – wurde der Erzähler gebeten, ein entschiedenes Ergebnis zu beschreiben oder eines zu entscheiden? (2) Kontext – hat er den relevanten Wurf und die Szenenfakten erhalten? (3) Einstellungen – wurden Modellsteuerungen und Limits unterstützt? (4) API – passten Endpoint und Tool-Protokoll zum Modell? (5) Ausführung und Zustand – wurden alle Schritte abgeschlossen und gespeichert? (6) Verifizierung – bleibt das Ergebnis nach Neuladen und erneutem Test konsistent? Halte bei dem ersten nachgewiesenen Fehler an, behebe ihn und teste den Spielzug erneut.
Überarbeite den Prompt, wenn die Aufgabe oder die gewünschte Antwort nach diesen Prüfungen weiterhin unklar ist. Playworlds vereint Würfel, Charakterinformationen und laufende Abenteuer in einem Browser-Spiel; diese sichtbaren Bausteine geben Spielern Fakten zum Vergleich, wenn die Erzählung seltsam wirkt. Übe das Schreiben einer klaren Aktion mit unserem Leitfaden und wähle dann eine Welt zum Erkunden.