GPT-6.1 Sol kostet in der OpenAI-API genauso viel wie der Vorgänger GPT-6 Sol: 1,74 € je Million Eingabetoken und 8,70 € je Million Ausgabetoken. Billiger wird allein das Lesen aus dem Zwischenspeicher, das mit knapp 0,09 € je Million Token nur noch halb so viel kostet.[1] OpenAI stellte das Modell am 29. September auf der Entwicklerkonferenz DevDay vor.

drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügen

In OpenAIs eigenen Tests kommt GPT-6.1 Sol nahe an das Spitzenmodell GPT-6 Astra heran, dessen Tokenpreis fünfmal so hoch liegt. Für Unternehmen mit KI-Agenten zählt der neue Cache-Preis allerdings mehr als jeder Benchmark.

Das Wichtigste in Kürze

  • GPT-6.1 Sol kostet 1,74 € (Eingabe) und 8,70 € (Ausgabe) je Million Token, zwischengespeicherte Eingaben knapp 0,09 €.
  • Beim Programmieren und bei der Computerbedienung nähert sich das Modell in OpenAIs Tests GPT-6 Astra an, Astra bleibt bei Computerbedienung und Forschungsaufgaben vorn.
  • Über 272.000 Eingabetoken verdoppelt sich der Eingabepreis für die gesamte Anfrage.
  • EU-Datenresidenz ist möglich, kostet aber 10 % Aufschlag und schließt den Fast-Modus aus.

Warum senkt OpenAI ausgerechnet den Cache-Preis?

Mattblaues Kelchglas mit Anhänger „Ein Fünftel“ und silberner Pokal auf weiß
KI-Agenten nutzen Prompt-Caching: Wiederholte Token-Sequenzen werden bei GPT-4o zu 10% und bei GPT-4.5 Sol zu 5% des normalen Preises abgerechnet

KI-Agenten schicken bei jedem Arbeitsschritt den bisherigen Verlauf erneut an das Modell, samt Systemanweisung, Werkzeugbeschreibungen und gelesenen Dateien. Erkennt die OpenAI-API einen bereits verarbeiteten Anfang der Anfrage wieder, rechnet die Schnittstelle diese Token als zwischengespeicherte Eingabe ab, bei GPT-6.1 Sol zu 5 % des normalen Eingabepreises.[2] Das erstmalige Schreiben in den Cache kostet dagegen das 1,25-Fache, also 2,18 € je Million Token.

Ein Rechenbeispiel: Angenommen, ein Coding-Agent arbeitet 40 Schritte lang mit je 100.000 Token Kontext, von denen 95.000 aus dem Cache kämen, und erzeugt pro Schritt 2.000 Token Ausgabe. Mit GPT-6.1 Sol würde dieser Lauf rund 1,37 € kosten, mit GPT-6 Sol 1,71 € und mit GPT-6 Astra 8,53 €, jeweils ohne das erste Befüllen des Caches. Der Tokenpreis pro Million führt deshalb in die Irre, sobald Agenten den Großteil ihrer Eingaben wiederverwenden.

Wie nah kommt GPT-6.1 Sol an GPT-6 Astra heran?

Im Programmiertest DeepSWE v1.1 erreicht GPT-6.1 Sol nach OpenAIs Messung das Ergebnis von Astra zu rund einem Fünftel der Kosten und übertrifft den Bestwert von GPT-6 Sol um 6,4 Prozentpunkte.[1] Bei der Computerbedienung im Test OSWorld 2.0 liegt das Modell 2,1 Prozentpunkte hinter Astra, bei etwa einem Siebtel der Kosten pro Aufgabe. Eine wissenschaftliche Aufgabe im Terminal-Bench Science kostet mit GPT-6.1 Sol auf höchster Denkstufe im Schnitt 4,76 €, mit Claude Opus 5.5 dagegen 20,19 € und mit Astra 20,71 €. Den Bestwert hält dort weiterhin Astra mit 68,1 %.

Die Vergleiche mit Anthropic stehen auf wackligen Beinen. Zum Test AutomationBench vermerkt OpenAI selbst, dass der Kostenwert für Claude Fable 5.1 zu niedrig ausfällt: Die Kosten der Ersatzmodelle, die bei rund 40 % der Aufgaben einsprangen, fehlen in der Rechnung.[1] Unabhängige Messungen stehen noch aus. Beim Listenpreis liegt GPT-6.1 Sol gleichauf mit Claude Sonnet 5.5, beim Lesen aus dem Cache kostet das OpenAI-Modell die Hälfte.

GPT-6.1 Sol: Der Cache macht den Preisunterschied
Preise je Million Token und ein Rechenbeispiel für einen Coding-Agenten
0,09 €
kostet eine Million zwischengespeicherter Eingabetoken, halb so viel wie bei GPT-6 Sol
5 ×
so hoch liegt der Tokenpreis des Spitzenmodells GPT-6 Astra
4,76 €
kostet eine Aufgabe im Terminal-Bench Science, mit Astra 20,71 €
+10 %
Aufschlag verlangt OpenAI für die Verarbeitung mit EU-Datenresidenz

Preise je Million Token im Vergleich

PostenGPT-6.1 SolGPT-6 SolGPT-6 AstraClaude Sonnet 5.5
Eingabe1,74 €1,74 €8,70 €1,74 €
Eingabe aus dem Cache0,09 €0,17 €0,87 €0,17 €
Ausgabe8,70 €8,70 €43,50 €8,70 €
Rechenbeispiel: 40 Agentenschritte mit 95 % Cache-Anteil1,37 €1,71 €8,53 €1,71 €

Was bedeutet der Preiskampf für Unternehmen in der EU?

GPT-6.1 Sol reiht sich in eine Serie von Preissenkungen ein. Im Juli senkte OpenAI den Preis für Luna um 80 %, am 22. September halbierte der Anbieter die Tarife von Sol und Luna gegenüber der Generation GPT-5.6.[3] Beim Spitzenmodell hält OpenAI dagegen den Preis: Astra kostet weiter 8,70 € je Million Eingabetoken, und den Nachfolger GPT-6.1 Astra stoppte OpenAI nach gescheiterten Sicherheitstests. In OpenAIs Alignment-Tests schneidet GPT-6.1 Sol besser ab als der Vorgänger: Auf ein defektes Suchwerkzeug weist das Modell in 2,1 % der Fälle nicht hin, GPT-6 Sol in 4,9 %.[1]

Mit GPT-6.1 Sol verlagert OpenAI den Preiskampf vom Listenpreis in den Zwischenspeicher. Einkäufer, die nur Tokenpreise vergleichen, übersehen genau den Posten, der bei Agenten mit jedem Arbeitsschritt wächst.

— Markus Seyfferth, Chefredakteur Dr. Web

Für den Einsatz in Europa nennt die Modellseite mehrere Haken.[2] GPT-6.1 Sol lässt sich mit EU-Datenresidenz betreiben, die regionale Verarbeitung kostet aber 10 % Aufschlag, und der schnellere Fast-Modus steht dann nicht zur Verfügung. Anfragen mit mehr als 272.000 Eingabetoken rechnet OpenAI komplett zum doppelten Eingabe- und 1,5-fachen Ausgabepreis ab, obwohl das Kontextfenster 1,05 Millionen Token fasst. In ChatGPT Work und Codex bleibt die Ultrafast-Variante der neuen Pro-Stufe für umgerechnet 435 € im Monat vorbehalten.

Vor einem Wechsel empfehlen sich vier Schritte:

  • Messen Sie die Kosten pro erledigter Aufgabe an eigenen Agentenläufen, nicht den Preis pro Million Token.
  • Prüfen Sie im Nutzungsprotokoll, welcher Anteil Ihrer Eingaben aus dem Cache kommt. Nur bei einem hohen Anteil spart der halbierte Cache-Preis spürbar.
  • Halten Sie Anfragen unter 272.000 Eingabetoken, etwa indem Sie ältere Arbeitsschritte zusammenfassen lassen.
  • Planen Sie für EU-Datenresidenz 10 % Aufschlag ein und verzichten Sie dort auf den Fast-Modus.

Wie sich die Rechnung von Agenten zusätzlich drücken lässt, zeigt unser Beitrag zu unnötig teuren autonomen KI-Agenten. Weitere Modelle im Vergleich finden Sie in der KI-Rubrik von Dr. Web.

Quellen

[1] OpenAI: „Introducing GPT-6.1 Sol“, 29. September 2026

[2] OpenAI API Docs: „GPT-6.1 Sol“, Modellseite mit Preisen und Datenresidenz

[3] OpenAI: „Introducing GPT-6 Sol and Luna“, 22. September 2026

Mehr Newshunger?

4,4 19 Bewertungen

Wie hat Ihnen dieser Artikel gefallen?