Die zum 1. September 2026 angekündigte Preiserhöhung für Claude Sonnet 5 ist vom Tisch: Anthropic hat sie am 10. August zurückgenommen. Die $2 pro Million Input-Token und $10 pro Million Output-Token sind damit kein Einführungspreis mehr, sondern der dauerhafte Standardtarif. Wer sein API-Budget für Q4 noch mit den bei der Markteinführung kommunizierten $3/$15 kalkuliert hat, muss eine zentrale Annahme korrigieren. Und wer bei Sonnet 4.6 geblieben ist, um den vermeintlich „echten“ Preis abzuwarten, hat nun ebenfalls eine neue Ausgangslage.
Claude Sonnet 5: Die aktuelle Preisübersicht
Über Anthropics eigene API kostet Claude Sonnet 5 $2 pro Million Input-Token und $10 pro Million Output-Token. Sämtliche rabattierten Tarife leiten sich von diesen Basispreisen ab. Die am 16. August 2026 geprüfte Preisdokumentation der Claude Platform formuliert es eindeutig: „The previously scheduled increase ... will not occur.“
| Tarif | Preis pro 1 Mio. Token | Faktor gegenüber Basis-Input |
|---|---|---|
| Basis-Input | $2.00 | 1.0x |
| Basis-Output | $10.00 | 5x Input |
| Cache-Schreibvorgang, 5 Min. | $2.50 | 1.25x |
| Cache-Schreibvorgang, 1 Std. | $4.00 | 2x |
| Cache-Lesen (Treffer) | $0.20 | 0.1x |
| Batch-Input | $1.00 | 50 % Rabatt |
| Batch-Output | $5.00 | 50 % Rabatt |
Drei Punkte aus derselben Dokumentation gehen in der Schlagzeile leicht unter. Das vollständige Kontextfenster von 1 Mio. Token wird ohne Aufschlag pro Token abgerechnet: Eine Anfrage mit 900.000 Token kostet pro Token also genauso viel wie eine mit 9.000 Token. Wer die Inferenz mit inference_geo: "us" auf die USA festlegt, zahlt für Input, Output und Cache jeweils den Faktor 1.1x. Zudem berechnet die serverseitige Websuche zusätzlich zu den regulären Tokenkosten $10 pro 1.000 Suchanfragen.
Warum die Preiserhöhung zum 1. September ausblieb
Claude Sonnet 5 kam am 30. Juni 2026 mit ausdrücklich als Einführungspreis gekennzeichneten $2/$10 auf den Markt. Zum 1. September 2026 sollte der Tarif auf $3/$15 steigen – also auf das damalige Preisniveau von Sonnet 4.6. Genau diese Rückkehr zum höheren Preis steht noch in vielen Preistabellen, die Anfang Juli veröffentlicht wurden. Am 10. August 2026 erhielt das Changelog der Ankündigung zum Marktstart einen knappen Zusatz: Der Einführungspreis bleibt dauerhaft. Auch der Launch-Artikel von TechCrunch verweist inzwischen per Update auf den geltenden Tarif.
Tabellen, die den Sprung auf $3/$15 weiterhin als bevorstehend oder als Preis „nach dem 31. August“ aufführen, stammen folglich aus der Zeit vor dem 10. August. Sie setzen beide Standardpreise um 50 % zu hoch an. An der grundsätzlichen Einordnung hat sich nichts geändert: Mit $2/$10 liegt Sonnet 5 eine Preisstufe unter Sonnet 4.6 mit $3/$15 – beim Input entspricht das einer Senkung um 33 %.
Sonnet 5 statt Sonnet 4.6: Die Rechnung hat sich gedreht
Der wichtigste Grund zur Zurückhaltung war zunächst der Tokenizer. Sonnet 5 verwendet die mit Opus 4.7 eingeführte neue Tokenizer-Familie. Laut Anthropics Launch-Ankündigung liegt der Token-Multiplikator bei identischem Text je nach Inhalt zwischen 1.0x und 1.35x; die Platform-Dokumentation beziffert den typischen Anstieg auf rund 30 %. Mit dem ursprünglich geplanten Standardpreis von $3/$15 hätte ein gleichwertiger Prompt damit bis zu $4.05 pro Million Input-Token und $20.25 pro Million Output-Token gekostet – gegenüber $3/$15 bei Sonnet 4.6.
Mit den dauerhaft geltenden $2/$10 fällt selbst der ungünstigste Fall anders aus. Bei der maximalen Token-Inflation von 1.35x kosten gleichwertige Inhalte $2.70 pro Million Input-Token und $13.50 pro Million Output-Token. Das liegt in beiden Kategorien unter Sonnet 4.6. Hinzu kommt, dass Sonnet 5 in der Vergleichstabelle zum Launch bessere Werte erzielt: 63.2 % statt 58.1 % bei SWE-bench Pro, 80.4 % statt 67.0 % bei Terminal-Bench 2.1 und 81.2 % statt 78.5 % bei OSWorld-Verified.
Ein Einwand bleibt jedoch wichtig: Entscheidend sind nicht die Kosten pro Token, sondern die Kosten pro gelöstem Problem. Von eesel AI zitierte Tests von Artificial Analysis zeigen für Sonnet 5 im Intelligence Index ungefähr $2.29 pro Aufgabe. Ohne Aktionspreis könne das Modell pro Aufgabe sogar mehr kosten als Opus 4.8, weil aufwendige Durchläufe viele Thinking-Token erzeugen, die zum Output-Tarif abgerechnet werden. Die Reaktion aus der Community war entsprechend direkt:
„tl;dr: Sonnet 5 is cheaper per token, but more expensive per solved problem - and still lags behind Opus 4.8 in overall intelligence.“ - u/Chubby, r/accelerate
Der feste Tarif verändert die Eingangsgrößen dieser Rechnung, nicht aber ihre Kernaussage: Effort-Einstellung und Tokenverbrauch je Aufgabe bestimmen weiterhin die Rechnung. Die Leistungsfrage beim Wechsel behandelt unser Vergleich Sonnet 5 vs Sonnet 4.6.
Effort und Caching treiben die Rechnung stärker als der Listenpreis
Zwei Stellschrauben beeinflussen die Sonnet-5-Rechnung stärker als jede Preisankündigung. Erstens die Effort-Stufe: Sonnet 5 bietet low, medium, high, xhigh und max. Die Launch-Ankündigung verspricht eine deutlich höhere Kosteneffizienz bei mittlerem Effort. Laut Launch-Berichterstattung erreicht Sonnet 5 mit medium ungefähr das Niveau von Sonnet 4.6 mit high. Es lohnt sich also zu prüfen, ob eine Effort-Stufe weniger für den eigenen Workload die gewünschte Qualität beibehält. Zweitens das Prompt-Caching: Ein Cache-Schreibvorgang für 5 Minuten zu $2.50 amortisiert sich nach einem weiteren Lesezugriff, ein Eintrag für eine Stunde zu $4.00 nach zwei. Jeder Cache-Read kostet anschließend $0.20 – 90 % weniger als regulärer Input. Laut Platform-Dokumentation lassen sich Cache- und Batch-Multiplikatoren kombinieren.
Mit dem dauerhaft niedrigeren Basistarif wird Batch-Verarbeitung besonders interessant. Asynchrone Sonnet-5-Verarbeitung kostet mit $1/$5 pro Million Token und Ergebnissen innerhalb von 24 Stunden genauso viel wie Haiku 4.5 zum regulären On-Demand-Tarif – bei einem Modell, das 63.2 % bei SWE-bench Pro erreicht. Für unabhängige Evaluationen ohne Zeitdruck, Backfills und Dokumentenverarbeitung ist Batch meist der günstigste Weg.
Sonnet 5 bei verschiedenen Anbietern: Nicht jede Rechnung ist gleich
Der Sonnet-5-Tarif ist bei den sieben Anbietern nicht durchgehend identisch. Die Anbietertabelle von CloudPrice führt Anthropic direkt, Amazon Bedrock, Azure AI Foundry, Google Vertex AI, OpenRouter und Vercel AI Gateway jeweils mit $2.00/$10.00. Snowflake verlangt hingegen $2.40/$12.00, also 20 % Aufschlag. Laut Platform-Dokumentation gelten unabhängig vom Anbieter zwei weitere Zuschläge: Regionale oder Multi-Region-Endpoints bei Bedrock und Vertex kosten etwa 10 % mehr als globale Endpoints, und auf die USA beschränkte Inferenz erhält den 1.1x-Multiplikator.
| Anbieter | Input / 1 Mio. | Output / 1 Mio. | Hinweise |
|---|---|---|---|
| Anthropic API | $2.00 | $10.00 | Batch $1/$5, vollständige Cache-Tarife |
| Amazon Bedrock | $2.00 | $10.00 | Regionale Endpoints +10 % |
| Google Vertex AI | $2.00 | $10.00 | Regionale Endpoints +10 % |
| Azure AI Foundry | $2.00 | $10.00 | US Data Zone Deployment verfügbar |
| OpenRouter | $2.00 | $10.00 | Batch-Variante $1/$5 |
| Vercel AI Gateway | $2.00 | $10.00 | - |
| Snowflake | $2.40 | $12.00 | +20 % gegenüber Standardtarif |
Ein häufiger Fehler beim Vergleich von Verzeichnissen: Der für Sonnet 5 teils genannte Einstiegspreis von „ab $1.00/$5.00“ bezieht sich auf Batch-Verarbeitung, nicht auf On-Demand. Dasselbe Verzeichnis listet Sonnet 4.6 mit $1.50/$7.50 – exakt dessen Batch-Preis statt des Standardtarifs von $3/$15.
Was die dauerhaften $2/$10 für das API-Budget bedeuten
Die offenen Entscheidungen betreffen nun das Modell, nicht mehr einen Stichtag. Laut Launch-Ankündigung ist Sonnet 5 das Standardmodell in den Claude-Free- und Pro-Plänen sowie in Max, Team und Enterprise enthalten. Für Abonnenten sind diese API-Preise daher nicht relevant. Der Claude API Pricing Guide erläutert, ab wann sich ein Wechsel vom Abo zur API rechnet. Für API-Käufer gilt:
| Situation | Empfehlung |
|---|---|
| Produktive Agents mit Latenzanforderungen | Sonnet 5 zu $2/$10, 5-Minuten-Cache für System-Prompts |
| Nächtliche Backfills, Evaluierungen, Massenverarbeitung | Sonnet 5 Batch zu $1/$5 |
| Die schwierigsten Coding-Aufgaben (Opus 4.8: 69.2 % vs. 63.2 % bei SWE-bench Pro laut Anthropics Launch-Vergleichstabelle) | Opus 4.8 zu $5/$25 |
| Klassifikation, Routing, Zusammenfassungen | Haiku 4.5 zu $1/$5 |
| Sonnet 4.6 läuft noch produktiv | Migration zunächst pilotieren – selbst Anthropics dokumentierter Tokenizer-Bereich von 1.0–1.35x liegt pro gleichwertigem Token unter 4.6; Qualität und Token je Aufgabe zuerst mit echtem Traffic prüfen |
Bei xhigh und max lassen Thinking-Token zum Tarif von $10 pro Million die Rechnung weiterhin mit der Schwierigkeit des Problems wachsen. Artificial Analysis stellte bei den früheren $3/$15-Tarifen fest, dass ein Sonnet-5-Lauf mit hohem Effort pro Aufgabe teurer sein kann als Opus 4.8. Die dauerhafte Preissenkung reduziert diese Untergrenze um ein Drittel, beseitigt sie aber nicht. Bevor eine Quartalssumme fest eingeplant wird, sollten Sie Token pro Aufgabe messen. Leiten Sie eine Woche realen Traffic mit Ihrer produktiven Effort-Einstellung über den Claude API endpoint und kalkulieren Sie den tatsächlichen Workload – nicht nur den Preis pro Million Token.
Weiterführend: Claude Sonnet 5 vs Sonnet 4.6 - Claude API Pricing Guide 2026 - Claude Sonnet 5 Guide