Claude Sonnet 5.5 kostet pro Million Token genauso viel wie der Vorgänger Claude Sonnet 5: 1,74 € für Eingabe- und 8,70 € für Ausgabetoken. Anthropic stellte das Modell am 28. September vor und nennt trotzdem bis zu 30 % geringere Kosten pro Aufgabe.[1] Die Ersparnis stammt aus dem sparsameren Tokenverbrauch.
drweb.de als bevorzugte Quelle auf Google hinzufügenQualitätsgeprüfte Inhalte direkt in Google News & DiscoverJetzt hinzufügenFür Unternehmen zählt deshalb, was eine erledigte Aufgabe kostet. In mehreren Tests liegt Sonnet 5.5 dabei nur wenige Punkte hinter dem doppelt so teuren Opus 5.5.
Das Wichtigste in Kürze
- Der Listenpreis bleibt bei 1,74 € (Eingabe) und 8,70 € (Ausgabe) je Million Token.
- Sonnet 5.5 braucht für dieselbe Arbeit weniger Token und antwortet über 30 % schneller als Sonnet 5.
- Der Vorsprung vor Opus 5.5 im Terminal-Bench ist knapp: Die Fehlerspannen beider Werte überschneiden sich.
- Anfragen mit Temperatur-Einstellung oder vorausgefüllten Antworten scheitern bei Sonnet 5.5 mit einer Fehlermeldung.
Wie sinken die Kosten, wenn der Tokenpreis gleich bleibt?

Anthropic rechnet jedes Token einzeln ab, deshalb zählt der Verbrauch. Der Nachfolger kommt mit weniger Arbeitsschritten aus als Sonnet 5 und bündelt Werkzeugaufrufe, statt sie einzeln abzusetzen.[1] Joe Poirier, Senior AI Engineer beim Hedgefonds Balyasny Asset Management, beziffert den Effekt: „Auf unserer eigenen Sammlung von 2.441 Finanzaufgaben aus Fragen und Antworten, Datenextraktion, Analyse und Prognose schnitt Claude Sonnet 5.5 besser ab als Sonnet 5 und verbrauchte rund 121.000 Token pro Antwort, Sonnet 5 dagegen 497.000.“
Ein Vergleich allein nach dem Preis pro Million Token führt deshalb in die Irre: Die beliebteste KI-Kostenkennzahl blendet den Verbrauch aus.
Schlägt Sonnet 5.5 tatsächlich Opus 5.5?
Im Programmiertest Terminal-Bench 4.0 erreicht Sonnet 5.5 70,6 %, das Spitzenmodell Claude Opus 5.5 nur 66,4 %.[1] Anthropics eigene System Card relativiert den Abstand aus zwei Gründen.[2] Der Standardfehler liegt bei ±2,5 beziehungsweise ±2,6 Punkten. Zudem griffen bei Opus 5.5 die Sicherheitsfilter in 10 % der Testläufe ein und reichten einzelne Anfragen an ein Ersatzmodell weiter, bei Sonnet 5.5 nur in 1,5 %.
Anthropic selbst stuft Opus 5.5 bei komplexer, offener Arbeit mit anhaltendem Urteilsvermögen als klar stärker ein.[1] Im Wissensarbeit-Test GDPval-AA, der Aufgaben aus 44 Berufen abbildet, liegt Sonnet 5.5 mit 1.844 Punkten dennoch fast gleichauf mit Opus 5.5 (1.846). Sonnet 5 erreicht 1.449 Punkte.
Testergebnisse und Preise
| Test | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 (Programmieren im Terminal) | 70,6 % | 10,3 % | 66,4 % |
| CursorBench 4.0 (Programmieren im Editor) | 55,5 % | 34,1 % | 57,8 % |
| OSWorld 2.1 (Computerbedienung) | 80,1 % | 57,0 % | 81,8 % |
| GDPval-AA v2.1 (Wissensarbeit, Punkte) | 1.844 | 1.449 | 1.846 |
| Preis je Million Token (Eingabe/Ausgabe) | 1,74/8,70 € | 1,74/8,70 € | 3,48/17,40 € |
Wann lohnt sich Sonnet 5.5 statt Opus 5.5?
Anthropics Kostenkurven verorten den Einsatzbereich auf den unteren Denkstufen: Dort übertrifft Sonnet 5.5 in mehreren Tests die Bestwerte von Sonnet 5 für etwa ein Zehntel der Kosten pro Aufgabe. Anthropic räumt ein, dass das Modell auf hohen Stufen ähnlich gut wie Opus 5.5 arbeitet, aber auch ähnlich viel kostet.[1]
Bei Coding-Agenten schrumpft der Preisabstand zusätzlich durch ein Detail der Preisliste: Gelesene Cache-Token kosten bei beiden Modellen 0,17 € je Million. Agenten schicken bei jedem Schritt den bisherigen Kontext erneut mit, etwa die 33.000 Token, die Claude Code vor dem ersten Prompt sendet. Je größer der Cache-Anteil an der Rechnung, desto näher rücken Sonnet und Opus beim Preis zusammen.
Sonnet 5.5 lohnt sich vor allem für Routinearbeit auf niedriger Denkstufe. Bei schwierigen Aufgaben kostet Opus 5.5 ähnlich viel und liefert das bessere Ergebnis.
— Markus Seyfferth, Chefredakteur Dr. Web
Was müssen Unternehmen vor dem Umstieg anpassen?
Eine neue Modell-ID allein reicht nicht. Anthropics Migrationsleitfaden nennt fünf Einstellungen, an denen Anfragen an Sonnet 5.5 mit dem Fehler 400 scheitern: feste Denkbudgets, Sampling-Parameter wie die Temperatur, vorausgefüllte Assistenten-Antworten (Prefill), erzwungene Werkzeugwahl und abgeschaltetes Denken.[3] An die Stelle des abgeschalteten Denkens tritt die neue Einstellung between_tools.
Anbieterin im Europäischen Wirtschaftsraum ist die Anthropic Ireland Limited. Die Pflichten aus dem EU AI Act für KI-Modelle mit allgemeinem Verwendungszweck deckt Anthropic nach der System Card über ein eigenes Rahmenwerk zum General-Purpose AI Code of Practice ab.[2] Für den Wechsel empfehlen sich vier Schritte:
- Durchsuchen Sie Ihren API-Code nach Temperatur, top_p, Prefill und festen Denkbudgets, bevor Sie auf claude-sonnet-5-5 umstellen.
- Messen Sie die Kosten pro erledigter Aufgabe an einem eigenen Testsatz.
- Testen Sie schwierige Aufgaben zusätzlich mit Opus 5.5, weil Sonnet 5.5 auf hoher Denkstufe ähnlich viel kostet.
- Aktivieren Sie im API den automatischen Rückgriff auf Sonnet 5, falls Ihre Teams Sicherheitscode prüfen. Die Claude-Apps leiten gesperrte Cyber-Anfragen selbst weiter, das API nur nach Freigabe.[2]
Weitere Modelle und Werkzeuge im Vergleich finden Sie in der KI-Rubrik von Dr. Web.
FAQ: Claude Sonnet 5.5
Was kostet Claude Sonnet 5.5?
Claude Sonnet 5.5 kostet im API umgerechnet 1,74 € je Million Eingabetoken und 8,70 € je Million Ausgabetoken. Gelesene Cache-Token kosten 0,17 €, geschriebene 2,18 € je Million. Die Preise entsprechen denen von Sonnet 5, Opus 5.5 kostet pro Token doppelt so viel.
Wo ist Claude Sonnet 5.5 verfügbar?
Claude Sonnet 5.5 steht in den Claude-Apps, in Claude Code und im API der Claude Platform unter der Kennung claude-sonnet-5-5 bereit. Zusätzlich bieten Amazon Web Services, Google Cloud und Microsoft Azure das Modell an.
Was bedeutet die Denkstufe (Effort) bei Claude?
Die Denkstufe legt fest, wie lange Claude an einer Antwort arbeitet und das Ergebnis prüft. Zur Wahl stehen Low, Medium, High, Xhigh und Max. In den Claude-Apps und in Claude Code ist Medium voreingestellt, auf der Claude Platform High. Höhere Stufen verbrauchen mehr Token.
Kann ich Claude Sonnet 5.5 ohne Datenspeicherung nutzen?
Ja. Anthropic bietet Sonnet 5.5 wie Opus 5.5 und Sonnet 5 mit Zero Data Retention an. Bei dieser Option bewahrt Anthropic Ein- und Ausgaben nicht über die Verarbeitung hinaus auf.
Warum lehnt Claude Sonnet 5.5 manche Sicherheitsanfragen ab?
Sonnet 5.5 ist das erste Sonnet-Modell mit Cyber-Schutzfiltern wie bei Opus 5.5. Riskante Anfragen beantwortet in den Claude-Apps automatisch Sonnet 5, die Fehlersuche im eigenen Quellcode bleibt erlaubt. Sicherheitsfachleute sollen sich bald für ein erweitertes Cyber Verification Program bewerben können.
Was ändert Preserved Thinking bei Claude Sonnet 5.5?
Die Denkblöcke von Sonnet 5.5 bleiben an das Konto gebunden, das sie erzeugt hat. Anthropic will so verhindern, dass Dritte die Denkwege massenhaft abgreifen und damit eigene Modelle trainieren. Integrationen, die Gespräche zwischen Konten verschieben, brauchen eine Anpassung.
Quellen
[1] Anthropic: „Introducing Claude Sonnet 5.5“, 28. September 2026
[2] Anthropic: „Claude Sonnet 5.5 System Card“, Abschnitte 1.3, 1.5 und 8.5
[3] Claude Platform Docs: „Migrating to Claude Sonnet 5.5“
Mehr Newshunger?
- Claude Opus 5.5 ist da und erledigt in Projects mehrere Aufgaben parallel
- Claude Opus 5: Anthropic setzt auf Kosten statt Benchmark-Krone
- Ember-1: Fireworks trainiert Kimi K3 auf kürzere Denkketten und spart rund 40 Prozent Token
- Cursor entfernt die Kostenanzeige aus Nutzungsseite und CSV-Export
- Amazon beendet Nova Premier: Warum AWS lieber Claude verkauft
- KI-Coding-Agenten im Dauereinsatz: Warum die Trefferquote nach fünf Runden einbricht
- Kimi K3: Chinas offenes KI-Modell erreicht die Weltspitze zu einem Bruchteil der Kosten