Claude Sonnet 5.5 im Test
Ein schnelleres Arbeitsmodell, dessen API-Änderungen wichtiger sind als die Versionsnummer.
Claude Sonnet 5.5 ist das praktische Upgrade für den Alltag in Anthropics Claude-5.5-Familie. Das Modell wurde am 28. September 2026 veröffentlicht. Die Standardpreise pro Token bleiben gegenüber Sonnet 5 gleich, Anthropic meldet aber eine um mindestens 30% höhere Ausgabegeschwindigkeit und bis zu 30% weniger Kosten pro Aufgabe, weil das Modell weniger Tokens benötigt. Die veröffentlichten Ergebnisse bei Coding und Wissensarbeit liegen außerdem näher an Opus 5.5.
Damit ersetzt Sonnet 5.5 Opus nicht grundsätzlich. Seine Stärke liegt bei klar abgegrenzten Features, reproduzierbaren Fehlern, Dokumenten, Tabellen und schnellen Agenten-Schleifen. Für Entwickler ist der API-Vertrag entscheidend: Wer bei Sonnet 5 Thinking deaktiviert, Tools erzwingt, das alte Computer-Use-Tool nutzt oder nur content[0] auswertet, sollte vor dem Wechsel eine Kompatibilitätsprüfung durchführen.
Stand: 29. September 2026. Diese Analyse nutzt Anthropics Ankündigung und die aktuelle Claude-Platform-Dokumentation. Benchmarks, Geschwindigkeits- und Kostenaussagen stammen von Anthropic; wir haben keinen unabhängigen kostenpflichtigen Benchmark oder Latenztest ausgeführt. Kostenbeispiele verwenden die direkte globale API und halten die Tokenmenge konstant.
Claude Sonnet 5.5 im Überblick
| Merkmal | Claude Sonnet 5.5 |
|---|---|
| Veröffentlichung | 28. September 2026 |
| Claude-API-Modell-ID | claude-sonnet-5-5 |
| Kontextfenster | 1M Tokens |
| Maximale Standardausgabe | 128K Tokens |
| Ein- / Ausgabe | $2 / $10 je Million Tokens |
| Cache schreiben / lesen | $2.50 / $0.20 je Million Tokens |
| Thinking | Standard: Adaptive |
| Standard-Effort | high |
| Vergleichbare Latenz | Fast |
| Verlässlicher Wissensstand | Juni 2026 |
| Ein- und Ausgabe | Text und Bilder → Text |
Das Modell ist über Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS verfügbar. Plattformen können unterschiedliche IDs verwenden; vor einer Produktionsumstellung zählt die jeweilige Verfügbarkeitstabelle. Die synchrone Messages API führt 1M Kontext und 128K Ausgabe, während die Batch API mit ihrem Beta-Header bis zu 300K Ausgabe unterstützt.
Was hat sich gegenüber Sonnet 5 verbessert?
Anthropic nennt mehr als 30% höhere Generierungsgeschwindigkeit und bis zu 30% weniger Kosten je Aufgabe. Der Tokenpreis wurde nicht gesenkt. Die Einsparung entsteht durch weniger Ausgabe-Tokens und weniger Werkzeugschritte.
Die Ankündigung nennt diese Werte im Vergleich zu Sonnet 5:
| Evaluation | Sonnet 5.5 | Sonnet 5 | Messgröße |
|---|---|---|---|
| Terminal-Bench 4.0 | 70,6% | 10,3% | Mehrstufiges Terminal-Coding |
| CursorBench 4.0 | 55,5% | 34,1% | Mehrdeutige Coding-Agent-Aufgaben |
| GDPval-AA v2.1 | 1844 | 1449 | Wissensarbeit in vielen Berufen |
| AA-Briefcase v1.1 | 1811 | 1359 | Lang laufende Wissensarbeit |
| Humanity’s Last Exam | 64,5% | 54,9% | Multidisziplinäres Denken mit Tools |
| OSWorld 2.1 | 80,1% partial | 57,0% partial | Computer use |
| Chartography | 61,6% | 15,6% | Visuelle Diagrammerkennung |
Das sind Signale aus den veröffentlichten Bedingungen, keine Erfolgsquote für dein Repository. CursorBench liegt nahe an Opus 5.5 mit 57,8%, GDPval nahe an 1846. Anthropic beschreibt Opus bei offener Arbeit mit dauerhaftem Urteil trotzdem als klar stärker. Sonnet 5.5 verkleinert die Lücke bei wiederholbaren Aufgaben; es beseitigt nicht die Rolle eines Eskalationsmodells.
Anthropics Kostenkurven enthalten Effort, Tools und die gesamte Task-Menge. Halte Prompt, Berechtigungen, Commit, Tools und Abnahmetest konstant, wenn du mit der Opus-5.5-Modellseite oder deiner Sonnet-Route vergleichst.
API-Preise: keine neue Preiskarte
Sonnet 5.5 übernimmt die direkte Sonnet-5-Preisliste:
| Abrechnung | Preis |
|---|---|
| Nicht gecachter Input | $2 / MTok |
| Output einschließlich berechneter Thinking-Tokens | $10 / MTok |
| Cache schreiben, 5 Minuten | $2.50 / MTok |
| Cache schreiben, 1 Stunde | $4 / MTok |
| Cache lesen | $0.20 / MTok |
| Batch API | 50% Rabatt auf Ein- und Ausgabe |
Eine ungecachte Aufgabe mit 100K Input- und 20K Output-Tokens kostet 0.1 × $2 + 0.02 × $10 = $0.40. Bei 80K Cache-Treffern im Input kostet dieselbe Tokenmenge 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, ohne den ersten Schreibvorgang. Thinking, Tools, Retries und die Zahl der Turns ändern die echte Rechnung.
„Bis zu 30% weniger pro Aufgabe“ bedeutet deshalb keine pauschale Rechnungskürzung. Miss den Gesamtpreis pro akzeptierter Änderung und teile ihn durch Tests oder Review-Ergebnisse. Der OmniaKey-Gatewaypreis ist eine eigene Route; vor der Planung das aktuelle Modellverzeichnis prüfen.
Sechs Migrationspunkte für bestehende Clients
Die neue ID lautet claude-sonnet-5-5, aber die Sonnet-5-Einstellungen sind nicht komplett übertragbar.
- Thinking ist standardmäßig Adaptive. Lass
thinkingweg oder sende{"type":"adaptive"}. Für kein vorgelagertes Denken nutzethinking: {"type":"between_tools"}.{"type":"disabled"}und manuellebudget_tokensführen zu 400. - Erzwungene Tool-Nutzung wird abgelehnt.
tool_choicemitanyodertoolführt zu 400. Nutzeautoodernone; für Schemas eignen sich strict tools oder structured outputs. - Thinking-Blöcke sind an Modell und Gespräch gebunden. Sonnet 5.5 kann Blöcke von Sonnet 5 lesen, Opus 5 und Opus 5.5 jedoch keine von Sonnet 5.5. Ein Modellwechsel in der Mitte verändert also den sichtbaren Verlauf.
- Verändere alte Nachrichten nicht blind. Wird ein früheres System, Tool oder eine Nachricht geändert und der Thinking-Block erneut gesendet, kann die neue Bindungsprüfung 400 liefern. Ergänze Anweisungen oder nutze die dokumentierte Binding-Steuerung.
- Computer use hängt von der Plattform ab. Claude API und Google Cloud verlangen
computer_toolset_20260801; Bedrock akzeptiert weiterhincomputer_20251124. - Antworten nach Blocktyp lesen. Fortschritt zwischen Tool-Aufrufen kann als
thinkingzurückkommen. Ein Parser, der nurtextanzeigt, wirkt dann fälschlich still.
Ein minimales adaptives Beispiel:
{
"model": "claude-sonnet-5-5",
"max_tokens": 4096,
"output_config": {"effort": "high"},
"messages": [
{"role": "user", "content": "Prüfe diese Migration und nenne die drei größten Risiken."}
]
}
Nicht-standardmäßige Werte für temperature, top_p oder top_k müssen ebenfalls neu geprüft werden; der aktuelle Endpoint weist sie zurück. max_tokens muss Platz für Thinking und sichtbare Antwort lassen.
Einordnung im Arbeitsablauf
Starte mit Sonnet 5.5 bei einem klaren Feature, einem reproduzierten Bug, Tests für eine bekannte Schnittstelle, einem begrenzten Review, einem Dokumententwurf oder häufigen Agentenschritten. Tests, Typecheck, Build und Screenshots machen schnell sichtbar, ob das günstigere Modell ausreicht.
Erhöhe Effort oder wechsle zu einem stärkeren Modell, wenn mehrere Services betroffen sind, eine Architekturentscheidung schwer umkehrbar ist oder wichtige Informationen fehlen. Hat Sonnet die richtigen Dateien und Tools und findet die Ursache trotzdem nicht, spricht das für eine Fähigkeitsgrenze. Fehlt nur der Kontext, sollte zuerst der Kontext verbessert werden.
In Claude Code vergleiche neue Sitzungen mit identischem Commit, Prompt, Berechtigungen und Abnahmetest. Notiere Zeit bis zum ersten brauchbaren Ergebnis, Gesamtdauer, Tokens, Retries, fehlgeschlagene Tools und menschliche Reparaturzeit. Schnelleres Token-Streaming kann durch eine zusätzliche Review-Schleife wieder verloren gehen.
Urteil
Claude Sonnet 5.5 ist ein sinnvoller erster Standardtest für tägliches Coding und Wissensarbeit. Der Preis bleibt gleich, die Geschwindigkeit und die veröffentlichten Ergebnisse steigen, und klar begrenzte Aufgaben können plausibel von Sonnet 5 wechseln.
Tausche trotzdem nicht nur eine Zeichenkette aus. Prüfe Thinking, Tool Choice, Block-Parser und Computer use. Für mehrdeutige Architektur, schwieriges Debugging und Entscheidungen mit hohen Folgen bleibt Opus 5.5 die Eskalationsstufe. Bei der Auswahl innerhalb der Familie hilft der Vergleich Opus 5.5 gegen Sonnet 5.
Häufige Fragen
Wann erschien Claude Sonnet 5.5?
Am 28. September 2026. Die direkte Claude-API-ID lautet claude-sonnet-5-5.
Ist Sonnet 5.5 billiger als Sonnet 5?
Die Tokenpreise sind gleich: $2 Input, $10 Output und $0.20 Cache-Lesen je Million Tokens. Anthropic meldet bis zu 30% weniger Kosten pro Aufgabe durch geringeren Verbrauch.
Ist Sonnet 5.5 besser als Opus 5.5?
Für klar umrissene Arbeit ist Sonnet schneller und günstiger; Opus bleibt bei schwieriger, offener Beurteilung stärker. Vergleiche akzeptierte Ergebnisse, Gesamtkosten und Korrekturzeit.
Kann man Thinking ausschalten?
thinking: {"type":"disabled"} ist nicht gültig. Nutze Adaptive oder thinking: {"type":"between_tools"} bei einem unterstützten Effort-Level.
Hat Sonnet 5.5 1M Kontext?
Ja, mit 128K standardmäßiger maximaler Ausgabe. Das sind Kapazitätsgrenzen, keine kostenlosen oder unbegrenzten Credits.