OpenAI: Neuer GPT-5.6-Prompting-Leitfaden senkt Token-Verbrauch um 66 %

The ChatGPT developer may wait until 2027 to go public at a $1 trillion valuation while Anthropic prepares an earlier Nasdaq debut. (Image: Shutterstock)
The ChatGPT developer may wait until 2027 to go public at a $1 trillion valuation while Anthropic prepares an earlier Nasdaq debut. (Image: Shutterstock)

OpenAI empfiehlt Entwicklern inzwischen, wiederholte Regeln aus System-Prompts zu streichen – und meldet in internen Coding-Tests bis zu 15 % bessere Bewertungen bei gleichzeitig bis zu 66 % weniger verbrauchten Tokens.

Zentrale Punkte:

  • Der GPT‑5.6-Prompting-Leitfaden fordert Entwickler auf, Ziel und Abbruchkriterien zu definieren – den Weg dorthin soll das Modell selbst wählen.
  • Interne Runs mit Coding-Agenten zeigen: Schlankere System-Prompts verbessern die Scores um 10 % bis 15 %, senken den Token-Verbrauch um 41 % bis 66 % und die Kosten um 33 % bis 67 %.
  • Neu hinzugekommen sind Abschnitte zu „Programmatic Tool Calling“ und einer Einstellung text.verbosity; beides fehlte im älteren GPT‑5-Playbook.

OpenAI schreibt das Prompting-Playbook für GPT‑5 neu

OpenAI hat den neuen Leitfaden zusammen mit der GPT‑5.6-Modellfamilie veröffentlicht. Die Modelle sind seit dem 9. Juli allgemein verfügbar und richten sich vor allem an API-Entwickler und Teams, die automatisierte Agenten im Einsatz haben.

Der Leitfaden rät Ingenieuren, das für Nutzer sichtbare Ergebnis, die Randbedingungen, die verfügbaren Fakten und die Qualitätsanforderung („completion bar“) klar zu formulieren – und dem Modell dann Freiraum zu lassen, eigenständig einen effizienten Lösungsweg zu wählen. OpenAI nennt diesen Ansatz „Outcome-first Prompting“.

Damit distanziert sich das Unternehmen deutlich vom GPT‑5-Leitfaden aus August 2025, der auf XML-Persistenzblöcke, detaillierte Kontext-Sammel-Templates und ausformulierte Tool-Preambels setzte, die jeden Schritt kommentierten. Solche Leitplanken gelten nun eher als Störgeräusch.

OpenAI warnt zudem vor absoluten Formulierungen wie „immer“ und „nie“, außer bei echten Invarianten wie Sicherheitsgrenzen, Pflichtfeldern oder Aktionen, die unter keinen Umständen auftreten dürfen. Wiederholte Anweisungen wie „erst nachfragen“ oder „auf Freigabe warten“ können laut Leitfaden unnötige Rückfragen auslösen – selbst bei erwartbaren, ungefährlichen Aktionen. Widersprüchliche Regeln schaffen mehr Instabilität als fehlende Detailtiefe.

Auch interessant: Dodgers-Wetten klettern auf 68 Mio. $ – Polymarket und Kalshi setzen auf den MLB-Playoff-Kampf

Simon Willison über Tool Calling in GPT‑5.6

Der unabhängige Entwickler Simon Willison hat in einem Blogeintrag vor allem „Programmatic Tool Calling“ und die Multi-Agent-Unterstützung als spannendste Neuerungen hervorgehoben. Die Funktion erlaubt es Modellen, JavaScript zu komponieren und auszuführen, das Tool-Aufrufe orchestriert.

Willison attestiert dem Modell Sol solide Performance, ohne dass es Anthropics Claude Fable 5 bei den komplexen Coding-Aufgaben, die er testet, klar aussticht.

Kosten sind der zweite Grund, warum der Leitfaden für viele Teams relevant ist. In den internen Runs sank der Token-Verbrauch um 41 % bis 66 %, die Ausgaben um 33 % bis 67 %. Diese Spannen verändern die Wirtschaftlichkeit für jedes Team, das Agenten im größeren Stil betreibt.

OpenAI betont allerdings, dass die Ergebnisse stark vom jeweiligen Use Case abhängen, versteht die Spannen als grobe Orientierung und fordert Entwickler auf, Effekte an repräsentativen Aufgaben aus ihrem eigenen Anwendungsspektrum zu messen.

GPT‑5.6-Familie folgt hohem Release-Tempo

GPT‑5.6 ist in drei Größen verfügbar: Luna, Terra und Sol. Die Input-Preise liegen bei 1 $, 2,50 $ und 5 $ pro Million Tokens, die Output-Preise bei 6 $, 15 $ und 30 $ pro Million Tokens. Neu ist zudem eine Einstellung text.verbosity, mit der sich die Antwortlänge steuern lässt.

Die nun erfolgte Kehrtwende fügt sich in ein Muster: Schon die GPT‑5.5-Empfehlungen aus dem April rieten Teams, Prompts neu aufzusetzen statt alte Vorlagen einfach fortzuschreiben. Der GPT‑5-Leitfaden von August 2025 verfolgte noch den gegenteiligen Ansatz und plädierte für enge Leitplanken gegen „Über-Eifer“. Jede Iteration hat Entwickler ein Stück weit ermutigt, weniger vorzuschreiben und dem Modell mehr Verantwortung für den Lösungsweg zu geben.

Weiterlesen: Ethereum holt gegenüber Bitcoin auf und testet Tom Lees Bullen-Szenario für 2026

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev ist Head of Content bei Yellow.com und berichtet seit 10 Jahren über Krypto. Er ist auf tiefgehende Research- und Learn-Artikel spezialisiert, mit Schwerpunkt auf analytischer Berichterstattung, Branchenkontext und den größeren Kräften, die den Kryptomarkt prägen – von der KI-Ära und Sicherheitstechnologien bis hin zu Innovationen im Fintech-Bereich. Er ist überzeugt, dass alles Digitale in naher Zukunft alles Analoge überholen wird, und arbeitet intensiv daran, dies Wirklichkeit werden zu lassen.

Haftungsausschluss und Risikowarnung: Die in diesem Artikel bereitgestellten Informationen dienen nur Bildungs- und Informationszwecken und basieren auf der Meinung des Autors. Sie stellen keine Finanz-, Anlage-, Rechts- oder Steuerberatung dar. Kryptowährungsassets sind hochvolatil und unterliegen hohen Risiken, einschließlich des Risikos, Ihre gesamte oder einen erheblichen Teil Ihrer Investition zu verlieren. Der Handel oder das Halten von Krypto-Assets ist möglicherweise nicht für alle Anleger geeignet. Die in diesem Artikel geäußerten Ansichten sind ausschließlich die des Autors/der Autoren und repräsentieren nicht die offizielle Politik oder Position von Yellow, seinen Gründern oder seinen Führungskräften. Führen Sie immer Ihre eigenen gründlichen Recherchen (D.Y.O.R.) durch und konsultieren Sie einen lizenzierten Finanzprofi, bevor Sie eine Anlageentscheidung treffen.