AIREITER

Claude Opus 5.5 im Test: Preise, API-Fallstricke und ein erstes Fazit

Zuletzt aktualisiert: 2026-09-22 18:53:59

Claude Opus 5.5 ist kein durchgesickertes Modell, sondern ein offizieller Release: Anthropic hat es am 22. September 2026 vorgestellt. Der API-Preis liegt bei 4 bzw. 20 US-Dollar pro einer Million Tokens, das Kontextfenster umfasst 1 Million Tokens. Der entscheidende Vorbehalt: Der niedrigere Preis pro Token macht nicht automatisch jede abgeschlossene Aufgabe günstiger – vor allem dann nicht, wenn das Modell mit maximalem Aufwand arbeitet.

Claude Opus 5.5 im Überblick: Die wichtigsten Entscheidungen auf einen Blick

FrageAntwort
Ist Claude Opus 5.5 offiziell veröffentlicht?Ja. Anthropic hat das Modell am 22. September 2026 angekündigt.
API-Modell-IDclaude-opus-5-5
Standardpreis der API4 US-Dollar pro einer Million Input-Tokens; 20 US-Dollar pro einer Million Output-Tokens
Kontextfenster1 Million Tokens
Maximale Ausgabe128.000 Tokens
Geeignet fürLange Coding-Aufgaben, agentische Workflows, Recherche und anspruchsvolles Schreiben
Wichtigster VorbehaltThinking ist dauerhaft aktiv, und Läufe mit maximalem Aufwand können deutlich mehr Output-Tokens verbrauchen

Anthropic zufolge erreicht Opus 5.5 bei den meisten Aufgaben das Leistungsniveau von Claude Fable 5.1, kostet bei typischen Workloads 40 % weniger als Opus 5 und erzeugt Ausgaben um mehr als 30 % schneller. Das sind offizielle Einordnungen – kein Ersatz für einen Test mit den eigenen Workloads. Laut den Launch-Materialien ist der Release über Claude, Claude Code, die API und die großen Cloud-Plattformen verfügbar.

Die API-Kosten: 4/20 US-Dollar bedeuten nicht automatisch niedrigere Kosten pro Aufgabe

Der offizielle Tarif von Claude Opus 5.5 ist attraktiv, wenn deine Nutzung inputlastig ist oder von Prompt-Caching profitiert. Gegenüber Opus 5 mit 5/25 US-Dollar entspricht das einer Senkung um 20 %. Die von Anthropic genannten Einsparungen bei typischen Workloads fallen größer aus, weil auch Cache-Lesezugriffe und das konkrete Aufgabenverhalten in die Gesamtkosten einfließen.

ModellInput / 1 Mio. TokensOutput / 1 Mio. TokensKontext
Claude Opus 5.54 US-Dollar20 US-Dollar1 Mio. Tokens
Claude Opus 55 US-Dollar25 US-Dollar1 Mio. Tokens
Claude Fable 5.110 US-Dollar50 US-Dollar1 Mio. Tokens

Ein einfacher, nicht gecachter Workload mit 200.000 Input-Tokens und 30.000 Output-Tokens kostet auf Opus 5.5 etwa 1,40 US-Dollar: 0,80 US-Dollar für den Input plus 0,60 US-Dollar für den Output. Mit denselben Tokenmengen kostet der Lauf auf Opus 5 etwa 1,75 US-Dollar. Gecachter Input wird mit 0,20 US-Dollar pro einer Million Tokens berechnet. Wiederkehrende Briefings können auf der Input-Seite daher deutlich günstiger werden.

Diese Rechnung setzt voraus, dass beide Modelle gleich viele Tokens verwenden. Erste unabhängige Einschätzungen sprechen dagegen. Artificial Analysis kam bei Aufgaben mit maximalem Aufwand auf rund 119.000 Output-Tokens pro Opus-5.5-Aufgabe – gegenüber etwa 73.000 bei Opus 5 und 27.000 bei GPT-6 Astra im selben Vergleich. Ein Modell kann pro Token also günstiger sein und trotzdem so viele zusätzliche Tokens verbrauchen, dass der Vorteil pro abgeschlossener Aufgabe schrumpft oder ganz verschwindet.

Für die meisten produktiven Workloads solltest du den hohen oder mittleren Aufwand wählen, sofern die Aufgabe nicht tatsächlich einen Lauf mit maximalem Aufwand erfordert. Die Einstellung ist nicht bloß ein Qualitätsregler: Sie verändert Latenz, Ausgabevolumen und Rechnung.

Was die ersten Daten zum Launch hergeben

Die am Tag des Releases verfügbaren Hinweise sprechen für ein starkes Modell bei schwierigen Aufgaben mit mehreren Schritten. Für eine endgültige Rangliste ist es allerdings noch zu früh. Auf seiner Launch-Seite berichtet Anthropic, dass Opus 5.5 bei den meisten Aufgaben mit Fable 5.1 gleichzieht, bei typischen Workloads 40 % weniger als Opus 5 kostet und mehr als 30 % schneller ist. Artificial Analysis meldete einen Intelligence-Index von 58 und hob besonders das große Ausgabebudget bei maximalem Aufwand hervor.

Beim Schreiben und bei der Coding-Ergonomie fällt das Feedback der ersten Tester konkreter aus. Der frühe Tester Theo Jaffee schrieb, Anthropic habe „das Schreiben wirklich verbessert“ und das Modell erzeuge geradlinigere, normalere Ausgaben als die jüngsten Claude-Releases (Beitrag auf X). Das ist für die Entscheidung zugunsten eines Schreibmodells ein nützlicher Hinweis – aber weiterhin nur die frühe Erfahrung eines einzelnen Nutzers.

„Mein wichtigstes Fazit war, dass sie das Schreiben wirklich verbessert haben.“ — @theojaffee, früher Opus-5.5-Tester (X)

Das Gegenindiz betrifft weniger den Stil als den Betrieb. Andere frühe Nutzer beschrieben Läufe mit maximalem Aufwand als ausgesprochen tokenhungrig. Ein Nutzer berichtete außerdem, Opus 5.5 in Claude Code „diskutiert einfach und bricht die Aufgabe ohne Grund ab“ (Beitrag auf X). Das ist keine gemessene Fehlerquote, zeigt aber genau, warum ein Umstieg im eigenen Agent-Harness getestet werden sollte – und nicht anhand einer Launch-Rangliste.

Das vorläufige Fazit fällt daher bewusst eng aus: Opus 5.5 wirkt vielversprechend für lange Coding- und Schreib-Workflows, während unabhängige, reproduzierbare Kopf-an-Kopf-Tests noch rar sind. Die Stimmung zum Launch ist kein Beleg für dauerhafte Stabilität.

Opus 5.5 nach Workload auswählen – nicht nach dem Leaderboard

Opus 5.5 für lange Coding- und Agentenaufgaben einsetzen

Opus 5.5 ist besonders interessant, wenn sich eine Aufgabe über viele Dateien, Tool-Aufrufe oder Denkschritte erstreckt. Der Mehrwert besteht nicht nur darin, eine schwierige Frage zu beantworten, sondern eine unübersichtliche Aufgabe bis zum Ergebnis zu bringen. Tests, Diffs und erfolgreich abgeschlossene Tool-Aufrufe sollten dabei deine Abnahmekriterien sein.

Beim Schreiben und Recherchieren gezielt einsetzen

Das frühe Feedback zum Schreiben fällt ungewöhnlich positiv aus, insbesondere wegen der weniger „Claudigen“ Antworten. Für hochwertige Briefings, die Synthese von Recherche und redaktionelle Überarbeitung kann Opus 5.5 sinnvoll sein, wenn ein besserer erster Entwurf die Prüfzeit verkürzt. Für einfache Umformulierungen, die auch ein günstigeres Modell erledigt, ist die Kostenstruktur dagegen wenig attraktiv.

Für Routineaufgaben bei günstigeren Modellen bleiben

Kurze Klassifizierungen, FAQ-Entwürfe, Extraktion und Boilerplate-Code rechtfertigen den Opus-Preis nur selten. Solche Aufgaben gehören in eine günstigere Modellklasse. Opus 5.5 solltest du für Fälle reservieren, in denen weniger Wiederholungen oder bessere Entscheidungen das Ergebnis tatsächlich verändern können.

Nicht automatisch von Vorteilen in Wissenschaft und Automatisierung ausgehen

In der Diskussion zum Launch wurden bessere Ergebnisse bei Coding und Schreiben, aber eine schwächere Positionierung bei einigen Wissenschafts- und Automatisierungs-Evaluierungen genannt. Anthropics Aussage „bei den meisten Aufgaben“ bedeutet nicht „bei jeder Aufgabe“. Wenn dein Workload wissenschaftliche Analysen, Browser-Automatisierung oder strukturierte Tool-Nutzung umfasst, solltest du diese Szenarien separat testen.

Hochrisikobereiche separat bewerten

Anthropic zufolge nutzt Opus 5.5 bei Biologie und Cybersicherheit Schutzmechanismen nahe dem Niveau von Fable 5.1; einige Anfragen können an ein anderes Modell weitergereicht werden. Ein allgemeines Leistungsplus bedeutet daher weder weniger Ablehnungen noch dasselbe Routing-Verhalten wie bei Opus 5.

Diese Migrationsdetails können API- und Claude-Code-Workflows ausbremsen

  1. Die Modell-ID bewusst ändern. Verwende claude-opus-5-5 und verlasse dich beim Fixieren produktiver Traffic-Ströme nicht auf den Anzeigenamen eines Providers.
  2. Tool-Aufrufe erneut testen. Frühe API-Nutzer berichteten, dass tool_choice-Werte wie any oder tool nicht auf dieselbe Weise unterstützt wurden. none konnte in einigen Fällen leere Inhalte erzeugen. Prüfe das Verhalten mit deiner SDK-Version.
  3. Dauerhaft aktiviertes Thinking einplanen. Community-Berichten zufolge lässt sich Thinking bei Opus 5.5 nicht deaktivieren. Prüfe, wie deine Integration Thinking-Blöcke speichert und Output-Tokens abrechnet.
  4. Standardeinstellungen für den Aufwand testen. Frühe Berichte beschrieben den Standardaufwand als mittel statt hoch. Fixiere die Einstellung, wenn Ausgabevolumen oder Latenz für deine Anwendung relevant sind.
  5. Kontingent und Reset-Verhalten überprüfen. Anthropic hat für Pro-, Max- und Team-Tarife höhere Fünf-Stunden-Limits sowie einen speicherbaren Rate-Limit-Reset angekündigt. Nutzer berichteten in den ersten Stunden außerdem von einer uneinheitlichen Anzeige der Resets. Prüfe daher den tatsächlichen Kontostatus, bevor du einem Team Kapazitäten zusagst.
  6. Eine Schattenmigration durchführen. Schicke 20–50 repräsentative Prompts an Opus 5.5 und das bisherige Modell. Vergleiche Erfolgsquote, Output-Tokens, Latenz, abgeschlossene Tool-Aufrufe, Ablehnungen und den Zeitaufwand für die menschliche Prüfung.

Für API-Projekte ist die Claude-API-Seite die passende AIReiter-Anlaufstelle, um den Zugriff auf die Claude-Familie zu testen, ohne die Anwendung auf einen einzigen Anbieter zuzuschneiden.

Claude Opus 5.5: Häufige Fragen

Ist Claude Opus 5.5 offiziell veröffentlicht?

Ja. Anthropic hat Claude Opus 5.5 am 22. September 2026 angekündigt. Die offizielle Release-Seite ist Anthropics Ankündigung zu Claude Opus 5.5.

Was kostet die Claude-Opus-5.5-API?

Der offizielle Standardpreis liegt bei 4 US-Dollar pro einer Million Input-Tokens und 20 US-Dollar pro einer Million Output-Tokens. Gecachter Input wird in den Preisangaben zum Launch-Tag mit 0,20 US-Dollar pro einer Million Tokens angegeben.

Ist Opus 5.5 günstiger als Opus 5?

Pro Token ja: Opus 5.5 kostet laut Preisliste 4/20 US-Dollar, Opus 5 dagegen 5/25 US-Dollar. Pro abgeschlossener Aufgabe solltest du jedoch den tatsächlichen Tokenverbrauch messen, weil Läufe von Opus 5.5 mit maximalem Aufwand deutlich mehr Output erzeugen können.

Ist Claude Opus 5.5 besser als Fable 5.1?

Anthropic zufolge erreicht Opus 5.5 bei den meisten Aufgaben das Leistungsniveau von Fable 5.1 und kostet deutlich weniger. Erste Nutzerberichte sprechen für Opus 5.5 beim Coding und Schreiben. Für Wissenschaft, Automatisierung oder sicherheitsrelevante Aufgaben gilt das jedoch nicht pauschal.

Kann man Thinking in Opus 5.5 deaktivieren?

Frühe API-Berichte besagen, dass Thinking dauerhaft aktiviert ist. Behandle das als Integrationsvorgabe und prüfe die aktuelle Entwicklerdokumentation, bevor du einen Workflow mit strengem Tokenbudget darauf aufbaust.

Erzeugt Opus 5.5 Bilder oder Videos?

Nein. Opus 5.5 ist ein Textmodell für Schlussfolgerungen mit Bildverständnis, aber kein Modell zur Bild- oder Videogenerierung.

Sollte ich sofort von Opus 5 wechseln?

Nein. Starte mit einem begrenzten Schatten-Test. Wechsle erst, wenn Opus 5.5 nach Berücksichtigung von Tokenvolumen, Latenz, Tool-Verhalten und Prüfzeit die Kosten oder Qualität deiner abgeschlossenen Aufgaben verbessert.

Die Entscheidung: Vor dem Wechsel im Produktivbetrieb einen begrenzten Piloten durchführen

Claude Opus 5.5 ist bereits einen Pilotversuch wert, wenn dein Workload lange Coding-Sitzungen, mehrstufige Recherche oder Texte umfasst, bei denen bessere Ausgaben die Prüfzeit reduzieren. Der Preis von 4/20 US-Dollar ist gegenüber dem Listenpreis von Opus 5 eine spürbare Verbesserung. Offen bleibt jedoch der Zielkonflikt: niedrigerer Preis pro Token gegenüber möglicherweise höherem Tokenverbrauch bei maximalem Aufwand.

Lass dieselben 20–50 realen Aufgaben durch beide Modelle laufen, lege die Aufwandseinstellung ausdrücklich fest und vergleiche die Kosten pro erfolgreichem Abschluss – nicht die Kosten pro einer Million Tokens. Genau diese Kennzahl zeigt, ob Claude Opus 5.5 für dein System tatsächlich günstiger ist.