GPT-6.1 Sol kostet in der OpenAI-API genauso viel wie der Vorgänger GPT-6 Sol: 1,74 € je Million Eingabetoken und 8,70 € je Million Ausgabetoken. Billiger wird allein das Lesen aus dem Zwischenspeicher, das mit knapp 0,09 € je Million Token nur noch halb so viel kostet.[1] OpenAI stellte das Modell am 29. September auf der Entwicklerkonferenz DevDay vor.
drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügenIn OpenAIs eigenen Tests kommt GPT-6.1 Sol nahe an das Spitzenmodell GPT-6 Astra heran, dessen Tokenpreis fünfmal so hoch liegt. Für Unternehmen mit KI-Agenten zählt der neue Cache-Preis allerdings mehr als jeder Benchmark.
Das Wichtigste in Kürze
- GPT-6.1 Sol kostet 1,74 € (Eingabe) und 8,70 € (Ausgabe) je Million Token, zwischengespeicherte Eingaben knapp 0,09 €.
- Beim Programmieren und bei der Computerbedienung nähert sich das Modell in OpenAIs Tests GPT-6 Astra an, Astra bleibt bei Computerbedienung und Forschungsaufgaben vorn.
- Über 272.000 Eingabetoken verdoppelt sich der Eingabepreis für die gesamte Anfrage.
- EU-Datenresidenz ist möglich, kostet aber 10 % Aufschlag und schließt den Fast-Modus aus.
Warum senkt OpenAI ausgerechnet den Cache-Preis?

KI-Agenten schicken bei jedem Arbeitsschritt den bisherigen Verlauf erneut an das Modell, samt Systemanweisung, Werkzeugbeschreibungen und gelesenen Dateien. Erkennt die OpenAI-API einen bereits verarbeiteten Anfang der Anfrage wieder, rechnet die Schnittstelle diese Token als zwischengespeicherte Eingabe ab, bei GPT-6.1 Sol zu 5 % des normalen Eingabepreises.[2] Das erstmalige Schreiben in den Cache kostet dagegen das 1,25-Fache, also 2,18 € je Million Token.
Ein Rechenbeispiel: Angenommen, ein Coding-Agent arbeitet 40 Schritte lang mit je 100.000 Token Kontext, von denen 95.000 aus dem Cache kämen, und erzeugt pro Schritt 2.000 Token Ausgabe. Mit GPT-6.1 Sol würde dieser Lauf rund 1,37 € kosten, mit GPT-6 Sol 1,71 € und mit GPT-6 Astra 8,53 €, jeweils ohne das erste Befüllen des Caches. Der Tokenpreis pro Million führt deshalb in die Irre, sobald Agenten den Großteil ihrer Eingaben wiederverwenden.
Wie nah kommt GPT-6.1 Sol an GPT-6 Astra heran?
Im Programmiertest DeepSWE v1.1 erreicht GPT-6.1 Sol nach OpenAIs Messung das Ergebnis von Astra zu rund einem Fünftel der Kosten und übertrifft den Bestwert von GPT-6 Sol um 6,4 Prozentpunkte.[1] Bei der Computerbedienung im Test OSWorld 2.0 liegt das Modell 2,1 Prozentpunkte hinter Astra, bei etwa einem Siebtel der Kosten pro Aufgabe. Eine wissenschaftliche Aufgabe im Terminal-Bench Science kostet mit GPT-6.1 Sol auf höchster Denkstufe im Schnitt 4,76 €, mit Claude Opus 5.5 dagegen 20,19 € und mit Astra 20,71 €. Den Bestwert hält dort weiterhin Astra mit 68,1 %.
Die Vergleiche mit Anthropic stehen auf wackligen Beinen. Zum Test AutomationBench vermerkt OpenAI selbst, dass der Kostenwert für Claude Fable 5.1 zu niedrig ausfällt: Die Kosten der Ersatzmodelle, die bei rund 40 % der Aufgaben einsprangen, fehlen in der Rechnung.[1] Unabhängige Messungen stehen noch aus. Beim Listenpreis liegt GPT-6.1 Sol gleichauf mit Claude Sonnet 5.5, beim Lesen aus dem Cache kostet das OpenAI-Modell die Hälfte.
Preise je Million Token im Vergleich
| Posten | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | Claude Sonnet 5.5 |
|---|---|---|---|---|
| Eingabe | 1,74 € | 1,74 € | 8,70 € | 1,74 € |
| Eingabe aus dem Cache | 0,09 € | 0,17 € | 0,87 € | 0,17 € |
| Ausgabe | 8,70 € | 8,70 € | 43,50 € | 8,70 € |
| Rechenbeispiel: 40 Agentenschritte mit 95 % Cache-Anteil | 1,37 € | 1,71 € | 8,53 € | 1,71 € |
Was bedeutet der Preiskampf für Unternehmen in der EU?
GPT-6.1 Sol reiht sich in eine Serie von Preissenkungen ein. Im Juli senkte OpenAI den Preis für Luna um 80 %, am 22. September halbierte der Anbieter die Tarife von Sol und Luna gegenüber der Generation GPT-5.6.[3] Beim Spitzenmodell hält OpenAI dagegen den Preis: Astra kostet weiter 8,70 € je Million Eingabetoken, und den Nachfolger GPT-6.1 Astra stoppte OpenAI nach gescheiterten Sicherheitstests. In OpenAIs Alignment-Tests schneidet GPT-6.1 Sol besser ab als der Vorgänger: Auf ein defektes Suchwerkzeug weist das Modell in 2,1 % der Fälle nicht hin, GPT-6 Sol in 4,9 %.[1]
Mit GPT-6.1 Sol verlagert OpenAI den Preiskampf vom Listenpreis in den Zwischenspeicher. Einkäufer, die nur Tokenpreise vergleichen, übersehen genau den Posten, der bei Agenten mit jedem Arbeitsschritt wächst.
— Markus Seyfferth, Chefredakteur Dr. Web
Für den Einsatz in Europa nennt die Modellseite mehrere Haken.[2] GPT-6.1 Sol lässt sich mit EU-Datenresidenz betreiben, die regionale Verarbeitung kostet aber 10 % Aufschlag, und der schnellere Fast-Modus steht dann nicht zur Verfügung. Anfragen mit mehr als 272.000 Eingabetoken rechnet OpenAI komplett zum doppelten Eingabe- und 1,5-fachen Ausgabepreis ab, obwohl das Kontextfenster 1,05 Millionen Token fasst. In ChatGPT Work und Codex bleibt die Ultrafast-Variante der neuen Pro-Stufe für umgerechnet 435 € im Monat vorbehalten.
Vor einem Wechsel empfehlen sich vier Schritte:
- Messen Sie die Kosten pro erledigter Aufgabe an eigenen Agentenläufen, nicht den Preis pro Million Token.
- Prüfen Sie im Nutzungsprotokoll, welcher Anteil Ihrer Eingaben aus dem Cache kommt. Nur bei einem hohen Anteil spart der halbierte Cache-Preis spürbar.
- Halten Sie Anfragen unter 272.000 Eingabetoken, etwa indem Sie ältere Arbeitsschritte zusammenfassen lassen.
- Planen Sie für EU-Datenresidenz 10 % Aufschlag ein und verzichten Sie dort auf den Fast-Modus.
Wie sich die Rechnung von Agenten zusätzlich drücken lässt, zeigt unser Beitrag zu unnötig teuren autonomen KI-Agenten. Weitere Modelle im Vergleich finden Sie in der KI-Rubrik von Dr. Web.
Quellen
[1] OpenAI: „Introducing GPT-6.1 Sol“, 29. September 2026
[2] OpenAI API Docs: „GPT-6.1 Sol“, Modellseite mit Preisen und Datenresidenz
[3] OpenAI: „Introducing GPT-6 Sol and Luna“, 22. September 2026
Mehr Newshunger?
- Looped Transformer bei GPT-6 Astra: Verbirgt die neue KI-Architektur ihr Denken?
- Ultrafast Mode: OpenAI erreicht mit Cerebras-Chips 750 Token pro Sekunde
- OpenAI verkleinert das Kontextfenster von Codex von 372.000 auf 272.000 Token
- KI-Agenten sprengen das Budget: Warum feste Rollen mehr bringen als mehr Rechenleistung
- Cognition bringt SWE-2: ein KI-Coding-Modell mit Fokus auf die Kosten
- US-Konzerne setzen zunehmend auf Open-Source-KI statt auf OpenAI und Anthropic