AIREITER
AnthropicText Chat

Claude Sonnet 5.5

Claude Sonnet 5.5 API zum halben Anthropic-Listenpreis: 1 $ Input, 5 $ Output pro 1 Mio. Tokens. Neuerungen gegenüber Sonnet 5, Benchmarks, Breaking Changes und funktionierender Code.

EingabeOffiziell $2.00 pro 1 Mio. TokensAIReiter $1.00 pro 1 Mio. TokensAusgabeOffiziell $10.00 pro 1 Mio. TokensAIReiter $5.00 pro 1 Mio. TokensCache-LesenOffiziell $0.20 pro 1 Mio. TokensAIReiter $0.10 pro 1 Mio. TokensCache-ErstellungOffiziell $2.50 pro 1 Mio. TokensAIReiter $1.25 pro 1 Mio. Tokens
Mit API ausführen

EINGABE

AUSGABE

Example
Generated in
42.7 seconds
Eingabe-Token
134
Ausgabe-Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Modelldetails

Verwenden Sie denselben Modellschlüssel im Playground, in API-Anfragen und in internen Workflows.

Modell-ID
claude-sonnet-5-5
Anbieter
Anthropic
Protokoll
Anthropic Messages
Kontextfenster
1,000,000 Token
Maximale Ausgabe
128,000 Token
Eingabe-Token
100 Credits / 1 Mio. Token
Ausgabe-Token
500 Credits / 1 Mio. Token
Cache-Lesen
10 Credits / 1 Mio. Token
Cache-Schreiben
125 Credits / 1 Mio. Token

Was ist neu in Claude Sonnet 5.5

Anthropic hat Claude Sonnet 5.5 am 28. September 2026 als direktes Upgrade zu Sonnet 5 veröffentlicht. Der Listenpreis hat sich nicht geändert – die Leistungsfähigkeit und die dafür benötigte Token-Anzahl hingegen schon.

Nahe an Opus 5.5 bei Wissensarbeit

Anthropic berichtet von einem GDPval-AA-Score von 1844 für Sonnet 5.5, zwei Punkte hinter Opus 5.5 (1846) und etwa 400 Punkte vor Sonnet 5 (1449). Anthropic gibt außerdem an, dass Opus 5.5 bei offenen Aufgaben, die anhaltendes Urteilsvermögen erfordern, weiterhin deutlich stärker ist.

Ein großer Fortschritt beim Coding

Bei CursorBench 4.0 berichtet Anthropic von 55,5 % für Sonnet 5.5, gegenüber 34,1 % bei Sonnet 5 und 57,8 % bei Opus 5.5. Anthropic positioniert es für klar umrissene Alltagsaufgaben: Entwickeln von Features, Beheben von Bugs und Erstellen von Dokumenten, Präsentationen und Tabellenkalkulationen.

Weniger Tokens für dieselbe Aufgabe

Erste Kunden berichteten von Einsparungen bei ihren eigenen Workloads: Slack verzeichnete ohne Prompt-Änderungen etwa 14 % weniger Output-Tokens, und Balyasny Asset Management maß über 2.441 Finanzaufgaben hinweg rund 121.000 Tokens pro Antwort gegenüber 497.000 bei Sonnet 5.

Schnellere Ausgabe, gleicher Tokenizer

Laut Anthropic ist die Ausgabe mehr als 30 % schneller als bei Sonnet 5; Artificial Analysis maß etwa 139 Output-Tokens pro Sekunde. Der Tokenizer ist unverändert, sodass derselbe Text bei beiden Modellen als dieselbe Anzahl an Tokens zählt.

Claude Sonnet 5.5 vs. Sonnet 5 vs. Opus 5.5

Alle drei laufen über denselben AIReiter-Schlüssel. Kurz gesagt: Wechseln Sie von Sonnet 5 weg, sobald Ihre Anfragen die unten stehenden Migrationsprüfungen bestehen, und behalten Sie Opus 5.5 für die anspruchsvollsten offenen Aufgaben bei.

Sonnet 5.5 vs. Sonnet 5: gleicher Preis, mehr Leistung

Beide sind mit 2 $ Input und 10 $ Output pro Million Tokens gelistet. Sonnet 5.5 schneidet bei den obigen Coding- und Wissensarbeits-Benchmarks besser ab und benötigt in der Regel weniger Tokens, sodass dieselbe Aufgabe tendenziell weniger kostet.

Sonnet 5.5 vs. Opus 5.5: halber Preis

Hier liegt Sonnet 5.5 bei 1,00 $ Input und 5,00 $ Output pro Million Tokens; Opus 5.5 bei 2,00 $ und 10,00 $. Beide verfügen über ein Kontextfenster von 1 Mio. Tokens und max. 128K Output, sodass der Wechsel lediglich eine Änderung des model-Felds erfordert.

Wann sich Opus 5.5 weiterhin lohnt

Lange, mehrdeutige Aufgaben, bei denen das Modell planen, eigene Fehler erkennen und fortfahren muss. Base44 berichtete von 3,6 Iterationen pro App-Build auf Sonnet 5.5 gegenüber 7,7 auf Opus 5 – probieren Sie also zuerst Sonnet 5.5 aus und eskalieren Sie nur die Aufgaben, die fehlschlagen.

Wann Sie vorerst bei Sonnet 5 bleiben sollten

Wenn Ihr Code Thinking deaktiviert, ein bestimmtes Tool erzwingt oder die Temperature setzt, schlagen diese Anfragen auf Sonnet 5.5 fehl, bis Sie sie anpassen. Sicherheitstools verzeichnen möglicherweise auch mehr Ablehnungen. Beheben Sie diese Punkte zuerst und wechseln Sie dann.

Migration von Sonnet 5: Was jetzt einen Fehler zurückgibt

Das Ändern des Modell-Strings auf claude-sonnet-5-5 reicht nicht immer aus. Diese Request-Strukturen funktionierten bei Sonnet 5, werden aber von Sonnet 5.5 abgelehnt.

thinking: disabled gibt 400 zurück

Adaptives Thinking ist immer aktiviert. Ersetzen Sie {"type": "disabled"} durch {"type": "between_tools"}, die niedrigste Einstellung, die das Thinking vor der ersten Antwort überspringt. between_tools funktioniert nur bei den effort-Stufen low, medium oder high; für xhigh oder max lassen Sie thinking weg oder senden Sie {"type": "adaptive"}.

Manuelle Thinking-Budgets geben 400 zurück

thinking: {"type": "enabled", "budget_tokens": N} wird abgelehnt. Steuern Sie die Tiefe stattdessen über das effort-Level. Thinking-Tokens werden weiterhin vom max_tokens-Kontingent abgezogen und als Output abgerechnet; erhöhen Sie also max_tokens, falls Antworten abgeschnitten werden.

Erzwungene Tool-Auswahl wird abgelehnt

Ein tool_choice, das ein bestimmtes Tool erzwingt, führt nun zu einem Fehler. Nutzen Sie die automatische Tool-Auswahl mit präzisen Tool-Definitionen und überlassen Sie dem Modell die Entscheidung, wann es aufgerufen wird.

Benutzerdefinierte temperature, top_p und top_k geben 400 zurück

Es wird nur das Standard-Sampling akzeptiert. Entfernen Sie diese Felder aus der Anfrage, anstatt sie auf feste Werte zu setzen. Eine Änderung kommt Ihnen zugute: Der minimale cachebare Prompt sinkt von 1.024 auf 512 Tokens.

Wählen Sie das Effort-Level vor dem Rollout

Effort ist jetzt der wichtigste Stellhebel für Kosten und Latenz. Es gibt fünf Stufen: low, medium, high, xhigh und max.

Der API-Standard ist high

Wenn Sie keinen Effort angeben, läuft die API standardmäßig auf high. Claude Code und die Claude-Apps nutzen standardmäßig medium. Setzen Sie output_config.effort explizit, damit Ihre Rechnung nicht von einem Standardwert abhängt.

max ist teuer

Bei max Effort ermittelte Artificial Analysis 7,60 $ pro Aufgabe zum Listenpreis und 410 Mio. Output-Token über den gesamten Index hinweg, verglichen mit einem Median von 88 Mio. Die Effizienzversprechen von Anthropic beziehen sich auf die niedrigeren Stufen, nicht auf max.

Mit medium starten, messen, dann anpassen

Führen Sie Ihre realen Aufgaben mit medium aus, prüfen Sie die Qualität und stufen Sie nur dort hoch, wo sie nicht ausreicht. Bei latenzkritischen Tool-Schleifen sorgt low oder medium mit between_tools Thinking für schnelle erste Antworten.

Claude Sonnet 5.5 API-Preise auf AIReiter

Jede Position wird mit 50 % des Anthropic-Listenpreises abgerechnet. Dasselbe Modell, dasselbe Messages-Protokoll.

50 % unter Listenpreis in jeder Zeile

Input 1,00 $ (Liste 2,00 $). Output 5,00 $ (Liste 10,00 $). Cache-Reads 0,10 $ (Liste 0,20 $). Cache-Writes 1,25 $ (Liste 2,50 $). Alle Angaben pro Million Token.

Ein realer API-Aufruf: 1,50 $ statt 3,00 $

Eine Million Input-Token plus einhunderttausend Output-Token kosten hier 1,50 $ und 3,00 $ nach Anthropic-Listenpreis. Derselbe Aufruf mit Opus 5.5 kostet hier 3,00 $.

Abrechnung nach tatsächlich genutzten Token

Zu Beginn des Aufrufs wird ein geschätzter Betrag reserviert und nach Abschluss der Antwort mit der tatsächlichen Token-Anzahl verrechnet; die Differenz wird erstattet. Der Preis ist vom ersten bis zum millionsten Token identisch; es gibt keine gesonderte Long-Context-Preisstufe.

So rufen Sie die Claude Sonnet 5.5 API auf

Der Endpunkt unterstützt das Anthropic Messages-Protokoll, sodass für einen bestehenden Claude-Client lediglich eine neue Base-URL und ein neuer Key erforderlich sind.

01

API-Key erstellen und Client auf AIReiter ausrichten

Erstellen Sie einen API-Key in Ihrem AIReiter-Dashboard. Setzen Sie in den offiziellen Anthropic-SDKs die Base-URL auf https://aireiter.com/api – das SDK fügt /v1/messages automatisch an.

02

Einen Request mit curl senden

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

Oder das Python-SDK verwenden

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

Claude Sonnet 5.5 API FAQ

/ 01

Wann wurde Claude Sonnet 5.5 veröffentlicht und wie lautet die Modell-ID?

Anthropic hat es am 28. September 2026 veröffentlicht. Die API-Modell-ID lautet claude-sonnet-5-5 und der Wissensstand reicht bis Juni 2026.

/ 02

Wie groß sind das Kontextfenster und die maximale Ausgabe?

Ein Kontextfenster von 1 Mio. Token und bis zu 128.000 Output-Token pro Request. Es akzeptiert Text- sowie Bildeingaben und gibt Text zurück.

/ 03

Wie viel kostet die Claude Sonnet 5.5 API?

Anthropic listet 2 $ für Input und 10 $ für Output pro Million Tokens – genauso wie bei Sonnet 5. AIReiter verlangt die Hälfte: 1 $ für Input, 5 $ für Output, 0,10 $ für Cache-Reads und 1,25 $ für Cache-Writes.

/ 04

Kann ich das Thinking deaktivieren?

Nicht vollständig. thinking disabled gibt einen 400-Fehler zurück. Die niedrigste Einstellung ist between_tools, was bei low, medium und high effort funktioniert.

/ 05

Ist Sonnet 5.5 besser als Sonnet 5?

Laut den von Anthropic veröffentlichten Benchmarks für Coding und Wissensarbeit: ja, mit deutlichem Abstand, und das zum selben Listenpreis. Prüfen Sie vor dem Wechsel die oben aufgeführten Migrationsänderungen, da einige Sonnet 5-Request-Formate jetzt fehlschlagen.

/ 06

Warum wurde meine Sicherheitsfrage abgelehnt oder von Sonnet 5 beantwortet?

Sonnet 5.5 ist das erste Sonnet-Modell, das mit den Cybersecurity-Schutzmaßnahmen ausgeliefert wird, die auch bei den leistungsfähigsten Modellen von Anthropic zum Einsatz kommen. Einige risikoreichere Anfragen fallen auf Sonnet 5 zurück, und bei harmlosen Sicherheitsaufgaben kann es zu mehr Ablehnungen kommen. Dies ist ein Upstream-Verhalten.

/ 07

Benötige ich ein Anthropic-Konto?

Nein. Ein AIReiter-Key funktioniert mit dem AIReiter-Endpunkt, und Sie können das Modell im Playground auf dieser Seite ausprobieren, bevor Sie Code schreiben.

/ 08

Welche APIs werden unterstützt?

Anthropic Messages unter /api/v1/messages ist die primäre Schnittstelle, inklusive Streaming. Chat Completions im OpenAI-Stil und die Responses API werden ebenfalls unterstützt, und /api/v1/models listet die für Ihren Key verfügbaren Modelle auf.