GPT-6 Sol & Claude Opus 5.5 sind daGPT-6 Sol zum halben Preis von 5.6 Sol
Blog
Leitfaden

Claude Sonnet 5.5 im Test

Ein schnelleres Arbeitsmodell, dessen API-Änderungen wichtiger sind als die Versionsnummer.

12 Min. LesezeitOmniaKey
Claude Sonnet 5.5ModelltestAPI-PreiseClaude CodeMigration

Claude Sonnet 5.5 ist das praktische Upgrade für den Alltag in Anthropics Claude-5.5-Familie. Das Modell wurde am 28. September 2026 veröffentlicht. Die Standardpreise pro Token bleiben gegenüber Sonnet 5 gleich, Anthropic meldet aber eine um mindestens 30% höhere Ausgabegeschwindigkeit und bis zu 30% weniger Kosten pro Aufgabe, weil das Modell weniger Tokens benötigt. Die veröffentlichten Ergebnisse bei Coding und Wissensarbeit liegen außerdem näher an Opus 5.5.

Damit ersetzt Sonnet 5.5 Opus nicht grundsätzlich. Seine Stärke liegt bei klar abgegrenzten Features, reproduzierbaren Fehlern, Dokumenten, Tabellen und schnellen Agenten-Schleifen. Für Entwickler ist der API-Vertrag entscheidend: Wer bei Sonnet 5 Thinking deaktiviert, Tools erzwingt, das alte Computer-Use-Tool nutzt oder nur content[0] auswertet, sollte vor dem Wechsel eine Kompatibilitätsprüfung durchführen.

Stand: 29. September 2026. Diese Analyse nutzt Anthropics Ankündigung und die aktuelle Claude-Platform-Dokumentation. Benchmarks, Geschwindigkeits- und Kostenaussagen stammen von Anthropic; wir haben keinen unabhängigen kostenpflichtigen Benchmark oder Latenztest ausgeführt. Kostenbeispiele verwenden die direkte globale API und halten die Tokenmenge konstant.

Claude Sonnet 5.5 im Überblick

MerkmalClaude Sonnet 5.5
Veröffentlichung28. September 2026
Claude-API-Modell-IDclaude-sonnet-5-5
Kontextfenster1M Tokens
Maximale Standardausgabe128K Tokens
Ein- / Ausgabe$2 / $10 je Million Tokens
Cache schreiben / lesen$2.50 / $0.20 je Million Tokens
ThinkingStandard: Adaptive
Standard-Efforthigh
Vergleichbare LatenzFast
Verlässlicher WissensstandJuni 2026
Ein- und AusgabeText und Bilder → Text

Das Modell ist über Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS verfügbar. Plattformen können unterschiedliche IDs verwenden; vor einer Produktionsumstellung zählt die jeweilige Verfügbarkeitstabelle. Die synchrone Messages API führt 1M Kontext und 128K Ausgabe, während die Batch API mit ihrem Beta-Header bis zu 300K Ausgabe unterstützt.

Was hat sich gegenüber Sonnet 5 verbessert?

Anthropic nennt mehr als 30% höhere Generierungsgeschwindigkeit und bis zu 30% weniger Kosten je Aufgabe. Der Tokenpreis wurde nicht gesenkt. Die Einsparung entsteht durch weniger Ausgabe-Tokens und weniger Werkzeugschritte.

Die Ankündigung nennt diese Werte im Vergleich zu Sonnet 5:

EvaluationSonnet 5.5Sonnet 5Messgröße
Terminal-Bench 4.070,6%10,3%Mehrstufiges Terminal-Coding
CursorBench 4.055,5%34,1%Mehrdeutige Coding-Agent-Aufgaben
GDPval-AA v2.118441449Wissensarbeit in vielen Berufen
AA-Briefcase v1.118111359Lang laufende Wissensarbeit
Humanity’s Last Exam64,5%54,9%Multidisziplinäres Denken mit Tools
OSWorld 2.180,1% partial57,0% partialComputer use
Chartography61,6%15,6%Visuelle Diagrammerkennung

Das sind Signale aus den veröffentlichten Bedingungen, keine Erfolgsquote für dein Repository. CursorBench liegt nahe an Opus 5.5 mit 57,8%, GDPval nahe an 1846. Anthropic beschreibt Opus bei offener Arbeit mit dauerhaftem Urteil trotzdem als klar stärker. Sonnet 5.5 verkleinert die Lücke bei wiederholbaren Aufgaben; es beseitigt nicht die Rolle eines Eskalationsmodells.

Anthropics Kostenkurven enthalten Effort, Tools und die gesamte Task-Menge. Halte Prompt, Berechtigungen, Commit, Tools und Abnahmetest konstant, wenn du mit der Opus-5.5-Modellseite oder deiner Sonnet-Route vergleichst.

API-Preise: keine neue Preiskarte

Sonnet 5.5 übernimmt die direkte Sonnet-5-Preisliste:

AbrechnungPreis
Nicht gecachter Input$2 / MTok
Output einschließlich berechneter Thinking-Tokens$10 / MTok
Cache schreiben, 5 Minuten$2.50 / MTok
Cache schreiben, 1 Stunde$4 / MTok
Cache lesen$0.20 / MTok
Batch API50% Rabatt auf Ein- und Ausgabe

Eine ungecachte Aufgabe mit 100K Input- und 20K Output-Tokens kostet 0.1 × $2 + 0.02 × $10 = $0.40. Bei 80K Cache-Treffern im Input kostet dieselbe Tokenmenge 0.02 × $2 + 0.08 × $0.20 + 0.02 × $10 = $0.376, ohne den ersten Schreibvorgang. Thinking, Tools, Retries und die Zahl der Turns ändern die echte Rechnung.

„Bis zu 30% weniger pro Aufgabe“ bedeutet deshalb keine pauschale Rechnungskürzung. Miss den Gesamtpreis pro akzeptierter Änderung und teile ihn durch Tests oder Review-Ergebnisse. Der OmniaKey-Gatewaypreis ist eine eigene Route; vor der Planung das aktuelle Modellverzeichnis prüfen.

Sechs Migrationspunkte für bestehende Clients

Die neue ID lautet claude-sonnet-5-5, aber die Sonnet-5-Einstellungen sind nicht komplett übertragbar.

  1. Thinking ist standardmäßig Adaptive. Lass thinking weg oder sende {"type":"adaptive"}. Für kein vorgelagertes Denken nutze thinking: {"type":"between_tools"}. {"type":"disabled"} und manuelle budget_tokens führen zu 400.
  2. Erzwungene Tool-Nutzung wird abgelehnt. tool_choice mit any oder tool führt zu 400. Nutze auto oder none; für Schemas eignen sich strict tools oder structured outputs.
  3. Thinking-Blöcke sind an Modell und Gespräch gebunden. Sonnet 5.5 kann Blöcke von Sonnet 5 lesen, Opus 5 und Opus 5.5 jedoch keine von Sonnet 5.5. Ein Modellwechsel in der Mitte verändert also den sichtbaren Verlauf.
  4. Verändere alte Nachrichten nicht blind. Wird ein früheres System, Tool oder eine Nachricht geändert und der Thinking-Block erneut gesendet, kann die neue Bindungsprüfung 400 liefern. Ergänze Anweisungen oder nutze die dokumentierte Binding-Steuerung.
  5. Computer use hängt von der Plattform ab. Claude API und Google Cloud verlangen computer_toolset_20260801; Bedrock akzeptiert weiterhin computer_20251124.
  6. Antworten nach Blocktyp lesen. Fortschritt zwischen Tool-Aufrufen kann als thinking zurückkommen. Ein Parser, der nur text anzeigt, wirkt dann fälschlich still.

Ein minimales adaptives Beispiel:

json
{
  "model": "claude-sonnet-5-5",
  "max_tokens": 4096,
  "output_config": {"effort": "high"},
  "messages": [
    {"role": "user", "content": "Prüfe diese Migration und nenne die drei größten Risiken."}
  ]
}

Nicht-standardmäßige Werte für temperature, top_p oder top_k müssen ebenfalls neu geprüft werden; der aktuelle Endpoint weist sie zurück. max_tokens muss Platz für Thinking und sichtbare Antwort lassen.

Einordnung im Arbeitsablauf

Starte mit Sonnet 5.5 bei einem klaren Feature, einem reproduzierten Bug, Tests für eine bekannte Schnittstelle, einem begrenzten Review, einem Dokumententwurf oder häufigen Agentenschritten. Tests, Typecheck, Build und Screenshots machen schnell sichtbar, ob das günstigere Modell ausreicht.

Erhöhe Effort oder wechsle zu einem stärkeren Modell, wenn mehrere Services betroffen sind, eine Architekturentscheidung schwer umkehrbar ist oder wichtige Informationen fehlen. Hat Sonnet die richtigen Dateien und Tools und findet die Ursache trotzdem nicht, spricht das für eine Fähigkeitsgrenze. Fehlt nur der Kontext, sollte zuerst der Kontext verbessert werden.

In Claude Code vergleiche neue Sitzungen mit identischem Commit, Prompt, Berechtigungen und Abnahmetest. Notiere Zeit bis zum ersten brauchbaren Ergebnis, Gesamtdauer, Tokens, Retries, fehlgeschlagene Tools und menschliche Reparaturzeit. Schnelleres Token-Streaming kann durch eine zusätzliche Review-Schleife wieder verloren gehen.

Urteil

Claude Sonnet 5.5 ist ein sinnvoller erster Standardtest für tägliches Coding und Wissensarbeit. Der Preis bleibt gleich, die Geschwindigkeit und die veröffentlichten Ergebnisse steigen, und klar begrenzte Aufgaben können plausibel von Sonnet 5 wechseln.

Tausche trotzdem nicht nur eine Zeichenkette aus. Prüfe Thinking, Tool Choice, Block-Parser und Computer use. Für mehrdeutige Architektur, schwieriges Debugging und Entscheidungen mit hohen Folgen bleibt Opus 5.5 die Eskalationsstufe. Bei der Auswahl innerhalb der Familie hilft der Vergleich Opus 5.5 gegen Sonnet 5.

Häufige Fragen

Wann erschien Claude Sonnet 5.5?

Am 28. September 2026. Die direkte Claude-API-ID lautet claude-sonnet-5-5.

Ist Sonnet 5.5 billiger als Sonnet 5?

Die Tokenpreise sind gleich: $2 Input, $10 Output und $0.20 Cache-Lesen je Million Tokens. Anthropic meldet bis zu 30% weniger Kosten pro Aufgabe durch geringeren Verbrauch.

Ist Sonnet 5.5 besser als Opus 5.5?

Für klar umrissene Arbeit ist Sonnet schneller und günstiger; Opus bleibt bei schwieriger, offener Beurteilung stärker. Vergleiche akzeptierte Ergebnisse, Gesamtkosten und Korrekturzeit.

Kann man Thinking ausschalten?

thinking: {"type":"disabled"} ist nicht gültig. Nutze Adaptive oder thinking: {"type":"between_tools"} bei einem unterstützten Effort-Level.

Hat Sonnet 5.5 1M Kontext?

Ja, mit 128K standardmäßiger maximaler Ausgabe. Das sind Kapazitätsgrenzen, keine kostenlosen oder unbegrenzten Credits.

Geprüfte Quellen