Das Jev-Modell ist jetzt integriert und live · Grok 4.7 ist verfügbar
Blog
Leitfaden

Claude Opus 5.5 im Überblick

Niedrigere Preise machen den Umstieg interessant; die API-Änderungen verlangen einen sorgfältigen Test.

11 Min. LesezeitOmniaKey
Claude Opus 5.5API-PreiseOpus-5-VergleichClaude CodeMigration

Claude Opus 5.5 ist ein aussichtsreicher Kandidat für lange Programmieraufgaben und Wissensarbeit. Anthropic veröffentlichte das Modell am 22. September 2026. Die Standard-API kostet 4 USD je Million Eingabetokens und 20 USD je Million Ausgabetokens. Gleichzeitig steigen die veröffentlichten Ergebnisse gegenüber Opus 5.

Ein bloßer Austausch der Modell-ID reicht jedoch nicht immer aus. Bisher gültige Anfragen können mit HTTP 400 scheitern, und Fortschrittsmeldungen zwischen Werkzeugaufrufen können verschwinden. Beginnen Sie mit dem neuen Standard medium und vergleichen Sie abgeschlossene Aufgaben, Gesamtkosten und menschliche Nacharbeit.

Geprüft am 23. September 2026. Grundlage sind Anthropics Ankündigung, Modellspezifikation und Migrationsdokumentation. Wir haben keinen eigenen Benchmark oder kostenpflichtigen Latenztest durchgeführt. Leistungswerte werden ihrer Quelle zugeordnet; Kostenbeispiele sind Berechnungen zum direkten API-Listenpreis.

Was ist neu an Opus 5.5?

Das erste Modell der Claude-5.5-Familie zielt auf umfangreiche Codemigrationen, schwierige Fehlersuche und mehrstufige Dokumentenarbeit. Anthropic berichtet außerdem über verständlichere Texte, bessere Diagrammerkennung und weniger Arbeitsschritte. Frühe Kundenbeispiele helfen bei der Auswahl eigener Tests, sind aber keine Zusage für Ihr Repository.

MerkmalOpus 5.5
Veröffentlichung22. September 2026
API-IDclaude-opus-5-5
Kontext / reguläre maximale Ausgabe1M / 128K Tokens
Eingabe → AusgabeText und Bilder → Text
Verlässlicher WissensstandJuni 2026
Denken / StandardaufwandImmer adaptiv / medium
Mindestlänge für Cache512 Tokens

Kontext und reguläre Ausgabegrenze bleiben gegenüber Opus 5 unverändert. Die dokumentierten 300K Ausgabetokens der Batch API gehören zu einer separaten Beta. Sie sind keine Grenze für synchrone Anfragen. Bildverständnis und das Schreiben von Grafikcode machen das Modell auch nicht zu einem nativen Bild- oder Videogenerator.

Opus 5.5 oder Opus 5: die wesentlichen Unterschiede

Eingabe und Ausgabe werden 20% günstiger, Cache-Lesezugriffe 60%. Für Agenten, die einen stabilen Repository-Kontext wiederholt lesen, kann die Cache-Nutzung den Ausschlag geben.

Der Standardaufwand sinkt von high auf medium. Bei derselben benannten Stufe kann Opus 5.5 pro Runde trotzdem mehr nachdenken als Opus 5, besonders bei xhigh und max. Ein unveränderter Parameter hält den Rechenaufwand nicht konstant.

Die Schnittstelle ändert sich. Denken lässt sich nicht abschalten, erzwungene Werkzeugwahl wird abgelehnt und frühere Nachrichten dürfen nicht beliebig verändert werden. Hintergrund bietet der Opus-5-Überblick; der Modellratgeber für Claude Code behandelt die Verteilung alltäglicher Aufgaben.

Benchmarks im Vergleich

Die Tabelle stammt aus Anthropics Veröffentlichung. Sie ist weder ein OmniaKey-Testlauf noch eine neu erhobene unabhängige Rangliste.

EvaluationOpus 5.5Opus 5Fable 5.1
Terminal-Bench 4.066.4%52.3%55.8%
FrontierCode v1.1 Main54.4%48.0%50.3%
CursorBench 4.057.8%46.6%51.8%
GDPval-AA v2.1184617081735

Opus 5.5 läuft grundsätzlich mit max, bei Terminal-Bench mit xhigh. Für diesen Wert nennt Anthropic einen Standardfehler von ±2,6 Punkten. Produktionsschutzmaßnahmen waren aktiv; einzelne Aufgaben aus Cybersicherheit, Biologie und der Entwicklung fortgeschrittener Modelle wurden an Ersatzmodelle übergeben. Die Tabelle beschreibt daher keine identischen, uneingeschränkten Bedingungen.

Bei der Standardstufe medium meldet Anthropic 54,6% in FrontierCode und 52,5% in CursorBench. Der erste Wert liegt leicht über dem max-Ergebnis der Tabelle: Mehr Aufwand garantiert nicht in jeder Messung eine bessere Punktzahl. GDPval-AA v2.1 sollte zudem nicht direkt mit älteren v2-Werten verglichen werden.

Die Ergebnisse sprechen für einen Versuch bei anspruchsvollen Aufgaben. Die eigene Fehlerrate, Latenz und Kosten pro akzeptierter Änderung lassen sich daraus nicht ablesen.

API-Preise und konkrete Kosten

Alle Angaben sind USD je Million Tokens für die globale Standard-API von Anthropic. Werkzeuge, Steuern, Datenresidenz und Gebühren anderer Anbieter kommen gegebenenfalls hinzu.

AbrechnungskategorieOpus 5.5Opus 5Preissenkung
Ungecachte Eingabe$4$520%
Ausgabe einschließlich abrechenbarer Denktokens$20$2520%
Cache lesen$0.20$0.5060%
Cache schreiben, 5 Minuten$5$6.2520%
Cache schreiben, 1 Stunde$8$1020%

Die folgenden Ausgabemengen enthalten auch abrechenbare Denktokens.

Gleiche TokenmengeBerechnung für 5.5Opus 5.5Opus 5
100K Eingabe + 10K Ausgabe0.1 × $4 + 0.01 × $20$0.60$0.75
100K Eingabe + 900K Cache-Treffer + 10K Ausgabe0.1 × $4 + 0.9 × $0.20 + 0.01 × $20$0.78$1.20

Das Cache-Beispiel spart 35%, berücksichtigt aber nicht den vorherigen Schreibvorgang. Ob ein Cache-Treffer vorliegt, zeigt die Nutzungsabrechnung des Anbieters. Derselbe erneut gesendete Text allein ist kein Nachweis.

Anthropics Aussage 40% niedrigere typische Aufgabenkosten kombiniert Preise und Verbrauch bei Standardeinstellungen. Sie ist kein pauschaler Rabatt. Auch mehr als 30% schnellere Ausgabe bedeutet nicht automatisch entsprechend kürzere Gesamtlaufzeiten.

Fast mode ist eine Forschungsvorschau mit $8/$40 für Eingabe/Ausgabe und beworbenen bis zu 2,5× Geschwindigkeit. Die API-Option gibt es nur auf Anthropics eigener Plattform. Asynchrones Batch kostet $2/$10. Claude-Abonnement und API-Abrechnung sind getrennt; Details erläutert der Claude-Code-Preisratgeber.

API nutzen: sechs Punkte für die Migration

  1. Thinking-Parameter bereinigen. thinking.type: "disabled" und "enabled" mit budget_tokens führen zu 400. Lassen Sie thinking weg oder verwenden Sie adaptive; steuern Sie den Aufwand über output_config.effort.
  2. Erzwungene Werkzeuge ersetzen. tool_choice unterstützt any und tool nicht. Nutzen Sie auto oder none. strict: true prüft Argumente, erzwingt aber keinen Aufruf. Für JSON nach Schema sind strukturierte Ausgaben eine Alternative.
  3. Den Verlauf erhalten. Bei seit dem 31. August 2026, 00:00 UTC erstellten Konten kann das erneute Senden eines Denkblocks nach Änderungen an vorangehendem system, tools oder Nachrichten zu 400 führen. Ergänzen Sie den Verlauf möglichst nur; notwendige Änderungen müssen den Regeln für preserved thinking folgen.
  4. Blöcke nach type auswerten. Fortschritt zwischen Werkzeugen erscheint in thinking. Bei display: "omitted" bleibt der Text leer. Die Anleitung beschreibt "summarized" und die Beta "updates". Denkblöcke in Werkzeugschleifen unverändert zurückgeben.
  5. Computer use je Plattform prüfen. Claude API und Google Cloud verlangen computer_toolset_20260801. Das ältere computer_20251124 funktioniert weiterhin auf Amazon Bedrock.
  6. Ablehnungen und Modellwechsel behandeln. HTTP 200 mit stop_reason: "refusal" ist kein erfolgreicher Abschluss. Opus 5 kann beim Zurückwechseln die Denkblöcke von 5.5 nicht lesen; Fable 5.1 und Mythos 5.1 auf der Claude API sind die dokumentierten Ausnahmen.

Dieses Minimalbeispiel nutzt die direkte Anthropic API und benötigt einen Anthropic-Schlüssel. Es ist keine OmniaKey-Konfiguration; wir haben den kostenpflichtigen Aufruf nicht ausgeführt.

bash
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "max_tokens": 4096,
    "output_config": {"effort": "medium"},
    "messages": [{"role": "user", "content": "Prüfe diesen Migrationsplan und nenne die drei wichtigsten Risiken."}]
  }'

max_tokens muss Platz für Denken und sichtbare Antwort lassen. Lesen Sie text-Blöcke aus, statt die Antwort an Position content[0] zu erwarten.

Für wen lohnt sich der Wechsel?

Opus-5-Nutzer sollten große Refactorings, schwierige Fehler und teure Fehlschläge zuerst testen. Werkzeuge, Rechte und Abnahmekriterien bleiben dabei gleich. Vergleichen Sie medium und high anhand von Erfolg, Wiederholungen, Tokens, Laufzeit und Nacharbeit. Neue Gespräche erleichtern einen sauberen Modellvergleich.

Für kurze Änderungen oder Extraktion kann Sonnet günstiger bleiben. Fable-Nutzer können prüfen, ob 5.5 die benötigte Qualität zum niedrigeren Preis erreicht. Anthropic nennt Claude, Claude Code, Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry als Zugänge. Kontingente und regionale Bedingungen legt die jeweilige Plattform fest.

Dieser Artikel bestätigt keine aktive Opus-5.5-Route bei OmniaKey. Prüfen Sie vor der Gateway-Konfiguration die genaue ID und den Preis im aktuellen Modellkatalog.

Häufige Fragen

Wann erschien Claude Opus 5.5?

Am 22. September 2026. Das Modell ist offiziell veröffentlicht; die API-ID lautet claude-opus-5-5.

Ist Opus 5.5 beim Programmieren besser als Opus 5?

Anthropics veröffentlichte Tests fallen besser aus, die Tokenpreise sind niedriger. Eigene Werkzeugschleifen und Abnahmetests bleiben vor einer Produktionsmigration erforderlich.

Kann man Thinking abschalten?

Nein. Adaptive thinking bleibt aktiv. Senken Sie bei Kosten- oder Latenzproblemen effort und prüfen Sie die Qualität erneut.

Bedeutet 1M Kontext unbegrenzte Nutzung?

Nein. Es ist eine Kapazitätsgrenze, kein Gratisbudget. Token-, Cache- und Werkzeugkosten sowie Kontolimits gelten weiterhin.

Quellen