Was ist neu in Claude Sonnet 5.5
Anthropic hat Claude Sonnet 5.5 am 28. September 2026 als direktes Upgrade zu Sonnet 5 veröffentlicht. Der Listenpreis hat sich nicht geändert – die Leistungsfähigkeit und die dafür benötigte Token-Anzahl hingegen schon.
Nahe an Opus 5.5 bei Wissensarbeit
Anthropic berichtet von einem GDPval-AA-Score von 1844 für Sonnet 5.5, zwei Punkte hinter Opus 5.5 (1846) und etwa 400 Punkte vor Sonnet 5 (1449). Anthropic gibt außerdem an, dass Opus 5.5 bei offenen Aufgaben, die anhaltendes Urteilsvermögen erfordern, weiterhin deutlich stärker ist.
Ein großer Fortschritt beim Coding
Bei CursorBench 4.0 berichtet Anthropic von 55,5 % für Sonnet 5.5, gegenüber 34,1 % bei Sonnet 5 und 57,8 % bei Opus 5.5. Anthropic positioniert es für klar umrissene Alltagsaufgaben: Entwickeln von Features, Beheben von Bugs und Erstellen von Dokumenten, Präsentationen und Tabellenkalkulationen.
Weniger Tokens für dieselbe Aufgabe
Erste Kunden berichteten von Einsparungen bei ihren eigenen Workloads: Slack verzeichnete ohne Prompt-Änderungen etwa 14 % weniger Output-Tokens, und Balyasny Asset Management maß über 2.441 Finanzaufgaben hinweg rund 121.000 Tokens pro Antwort gegenüber 497.000 bei Sonnet 5.
Schnellere Ausgabe, gleicher Tokenizer
Laut Anthropic ist die Ausgabe mehr als 30 % schneller als bei Sonnet 5; Artificial Analysis maß etwa 139 Output-Tokens pro Sekunde. Der Tokenizer ist unverändert, sodass derselbe Text bei beiden Modellen als dieselbe Anzahl an Tokens zählt.
Claude Sonnet 5.5 vs. Sonnet 5 vs. Opus 5.5
Alle drei laufen über denselben AIReiter-Schlüssel. Kurz gesagt: Wechseln Sie von Sonnet 5 weg, sobald Ihre Anfragen die unten stehenden Migrationsprüfungen bestehen, und behalten Sie Opus 5.5 für die anspruchsvollsten offenen Aufgaben bei.
Sonnet 5.5 vs. Sonnet 5: gleicher Preis, mehr Leistung
Beide sind mit 2 $ Input und 10 $ Output pro Million Tokens gelistet. Sonnet 5.5 schneidet bei den obigen Coding- und Wissensarbeits-Benchmarks besser ab und benötigt in der Regel weniger Tokens, sodass dieselbe Aufgabe tendenziell weniger kostet.
Sonnet 5.5 vs. Opus 5.5: halber Preis
Hier liegt Sonnet 5.5 bei 1,00 $ Input und 5,00 $ Output pro Million Tokens; Opus 5.5 bei 2,00 $ und 10,00 $. Beide verfügen über ein Kontextfenster von 1 Mio. Tokens und max. 128K Output, sodass der Wechsel lediglich eine Änderung des model-Felds erfordert.
Wann sich Opus 5.5 weiterhin lohnt
Lange, mehrdeutige Aufgaben, bei denen das Modell planen, eigene Fehler erkennen und fortfahren muss. Base44 berichtete von 3,6 Iterationen pro App-Build auf Sonnet 5.5 gegenüber 7,7 auf Opus 5 – probieren Sie also zuerst Sonnet 5.5 aus und eskalieren Sie nur die Aufgaben, die fehlschlagen.
Wann Sie vorerst bei Sonnet 5 bleiben sollten
Wenn Ihr Code Thinking deaktiviert, ein bestimmtes Tool erzwingt oder die Temperature setzt, schlagen diese Anfragen auf Sonnet 5.5 fehl, bis Sie sie anpassen. Sicherheitstools verzeichnen möglicherweise auch mehr Ablehnungen. Beheben Sie diese Punkte zuerst und wechseln Sie dann.
Migration von Sonnet 5: Was jetzt einen Fehler zurückgibt
Das Ändern des Modell-Strings auf claude-sonnet-5-5 reicht nicht immer aus. Diese Request-Strukturen funktionierten bei Sonnet 5, werden aber von Sonnet 5.5 abgelehnt.
thinking: disabled gibt 400 zurück
Adaptives Thinking ist immer aktiviert. Ersetzen Sie {"type": "disabled"} durch {"type": "between_tools"}, die niedrigste Einstellung, die das Thinking vor der ersten Antwort überspringt. between_tools funktioniert nur bei den effort-Stufen low, medium oder high; für xhigh oder max lassen Sie thinking weg oder senden Sie {"type": "adaptive"}.
Manuelle Thinking-Budgets geben 400 zurück
thinking: {"type": "enabled", "budget_tokens": N} wird abgelehnt. Steuern Sie die Tiefe stattdessen über das effort-Level. Thinking-Tokens werden weiterhin vom max_tokens-Kontingent abgezogen und als Output abgerechnet; erhöhen Sie also max_tokens, falls Antworten abgeschnitten werden.
Erzwungene Tool-Auswahl wird abgelehnt
Ein tool_choice, das ein bestimmtes Tool erzwingt, führt nun zu einem Fehler. Nutzen Sie die automatische Tool-Auswahl mit präzisen Tool-Definitionen und überlassen Sie dem Modell die Entscheidung, wann es aufgerufen wird.
Benutzerdefinierte temperature, top_p und top_k geben 400 zurück
Es wird nur das Standard-Sampling akzeptiert. Entfernen Sie diese Felder aus der Anfrage, anstatt sie auf feste Werte zu setzen. Eine Änderung kommt Ihnen zugute: Der minimale cachebare Prompt sinkt von 1.024 auf 512 Tokens.
Wählen Sie das Effort-Level vor dem Rollout
Effort ist jetzt der wichtigste Stellhebel für Kosten und Latenz. Es gibt fünf Stufen: low, medium, high, xhigh und max.
Der API-Standard ist high
Wenn Sie keinen Effort angeben, läuft die API standardmäßig auf high. Claude Code und die Claude-Apps nutzen standardmäßig medium. Setzen Sie output_config.effort explizit, damit Ihre Rechnung nicht von einem Standardwert abhängt.
max ist teuer
Bei max Effort ermittelte Artificial Analysis 7,60 $ pro Aufgabe zum Listenpreis und 410 Mio. Output-Token über den gesamten Index hinweg, verglichen mit einem Median von 88 Mio. Die Effizienzversprechen von Anthropic beziehen sich auf die niedrigeren Stufen, nicht auf max.
Mit medium starten, messen, dann anpassen
Führen Sie Ihre realen Aufgaben mit medium aus, prüfen Sie die Qualität und stufen Sie nur dort hoch, wo sie nicht ausreicht. Bei latenzkritischen Tool-Schleifen sorgt low oder medium mit between_tools Thinking für schnelle erste Antworten.
Claude Sonnet 5.5 API-Preise auf AIReiter
Jede Position wird mit 50 % des Anthropic-Listenpreises abgerechnet. Dasselbe Modell, dasselbe Messages-Protokoll.
50 % unter Listenpreis in jeder Zeile
Input 1,00 $ (Liste 2,00 $). Output 5,00 $ (Liste 10,00 $). Cache-Reads 0,10 $ (Liste 0,20 $). Cache-Writes 1,25 $ (Liste 2,50 $). Alle Angaben pro Million Token.
Ein realer API-Aufruf: 1,50 $ statt 3,00 $
Eine Million Input-Token plus einhunderttausend Output-Token kosten hier 1,50 $ und 3,00 $ nach Anthropic-Listenpreis. Derselbe Aufruf mit Opus 5.5 kostet hier 3,00 $.
Abrechnung nach tatsächlich genutzten Token
Zu Beginn des Aufrufs wird ein geschätzter Betrag reserviert und nach Abschluss der Antwort mit der tatsächlichen Token-Anzahl verrechnet; die Differenz wird erstattet. Der Preis ist vom ersten bis zum millionsten Token identisch; es gibt keine gesonderte Long-Context-Preisstufe.
So rufen Sie die Claude Sonnet 5.5 API auf
Der Endpunkt unterstützt das Anthropic Messages-Protokoll, sodass für einen bestehenden Claude-Client lediglich eine neue Base-URL und ein neuer Key erforderlich sind.
API-Key erstellen und Client auf AIReiter ausrichten
Erstellen Sie einen API-Key in Ihrem AIReiter-Dashboard. Setzen Sie in den offiziellen Anthropic-SDKs die Base-URL auf https://aireiter.com/api – das SDK fügt /v1/messages automatisch an.
Einen Request mit curl senden
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'
Oder das Python-SDK verwenden
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)
Claude Sonnet 5.5 API FAQ
/ 01Wann wurde Claude Sonnet 5.5 veröffentlicht und wie lautet die Modell-ID?
Anthropic hat es am 28. September 2026 veröffentlicht. Die API-Modell-ID lautet claude-sonnet-5-5 und der Wissensstand reicht bis Juni 2026.
/ 02Wie groß sind das Kontextfenster und die maximale Ausgabe?
Ein Kontextfenster von 1 Mio. Token und bis zu 128.000 Output-Token pro Request. Es akzeptiert Text- sowie Bildeingaben und gibt Text zurück.
/ 03Wie viel kostet die Claude Sonnet 5.5 API?
Anthropic listet 2 $ für Input und 10 $ für Output pro Million Tokens – genauso wie bei Sonnet 5. AIReiter verlangt die Hälfte: 1 $ für Input, 5 $ für Output, 0,10 $ für Cache-Reads und 1,25 $ für Cache-Writes.
/ 04Kann ich das Thinking deaktivieren?
Nicht vollständig. thinking disabled gibt einen 400-Fehler zurück. Die niedrigste Einstellung ist between_tools, was bei low, medium und high effort funktioniert.
/ 05Ist Sonnet 5.5 besser als Sonnet 5?
Laut den von Anthropic veröffentlichten Benchmarks für Coding und Wissensarbeit: ja, mit deutlichem Abstand, und das zum selben Listenpreis. Prüfen Sie vor dem Wechsel die oben aufgeführten Migrationsänderungen, da einige Sonnet 5-Request-Formate jetzt fehlschlagen.
/ 06Warum wurde meine Sicherheitsfrage abgelehnt oder von Sonnet 5 beantwortet?
Sonnet 5.5 ist das erste Sonnet-Modell, das mit den Cybersecurity-Schutzmaßnahmen ausgeliefert wird, die auch bei den leistungsfähigsten Modellen von Anthropic zum Einsatz kommen. Einige risikoreichere Anfragen fallen auf Sonnet 5 zurück, und bei harmlosen Sicherheitsaufgaben kann es zu mehr Ablehnungen kommen. Dies ist ein Upstream-Verhalten.
/ 07Benötige ich ein Anthropic-Konto?
Nein. Ein AIReiter-Key funktioniert mit dem AIReiter-Endpunkt, und Sie können das Modell im Playground auf dieser Seite ausprobieren, bevor Sie Code schreiben.
/ 08Welche APIs werden unterstützt?
Anthropic Messages unter /api/v1/messages ist die primäre Schnittstelle, inklusive Streaming. Chat Completions im OpenAI-Stil und die Responses API werden ebenfalls unterstützt, und /api/v1/models listet die für Ihren Key verfügbaren Modelle auf.