AIREITER
API-DOKSPREISE
VORLAGEN
  • AIReiter
  • Blog
  • Fable 5.1 vs. 5: Kosten, Benchmarks und API-Änderungen

Fable 5.1 vs. 5: Kosten, Benchmarks und API-Änderungen

Zuletzt aktualisiert: 2026-09-02 02:41:27

Wer claude-fable-5 einfach durch claude-fable-5-1 ersetzt, erhält möglicherweise zunächst eine erfolgreiche Antwort – und stellt erst danach fest, dass der Tool-Router oder der veränderliche Gesprächsverlauf nicht mehr funktioniert. Fable 5.1 ist die bessere Standardwahl für lang laufende, cache-intensive Workloads. Ein völlig risikofreies Drop-in-Upgrade ist es aber nicht: Listenpreise und Limits bleiben unverändert, während sich drei API-Verhaltensweisen ändern.

Die Kurzfassung: Für gecachte Agenten upgraden, nicht automatisch für jede Anfrage

Claude Fable 5.1 ist der aktuelle Nachfolger von Claude Fable 5. Anthropic empfiehlt in der Dokumentation den Wechsel, um von der höheren Leistung zu profitieren. Besonders deutlich ist der Vorteil bei Agenten, die wiederholt einen großen Prompt-Präfix einlesen: Cache-Lesezugriffe kosten statt 1 US-Dollar nur noch 0,25 US-Dollar pro einer Million Tokens. Die regulären Preise für Ein- und Ausgabe bleiben dagegen bei 10 beziehungsweise 50 US-Dollar pro einer Million Tokens. (Überblick zu Fable 5.1 bei Anthropic)

Wenn dein Workload …Starte mit …Warum
einen langen System-Prompt, eine Codebasis oder einen Dokumentkontext wiederverwendetFable 5.1Cache-Lesezugriffe sind 75 Prozent günstiger, außerdem meldet Anthropic bessere Ergebnisse bei agentischen Aufgaben.
erzwungene Tool-Aufrufe wie tool_choice: {"type":"any"} verwendetFable 5.1 vor dem Wechsel testenFable 5.1 lehnt die erzwungene Tool-Auswahl mit einem 400-Fehler ab.
frühere Gesprächsrunden bearbeitet oder neu aufbautFable 5 behalten, bis die History-Schicht angepasst istFable 5.1 bindet Thinking-Blöcke an den vorangegangenen Prompt, die Tools und den Gesprächsverlauf.
den niedrigsten Standardpreis pro Token benötigtKeines der beiden Fable-ModelleBeide kosten 10 US-Dollar pro einer Million Input-Tokens und 50 US-Dollar pro einer Million Output-Tokens.
gewöhnliche, nicht gecachte Prompts mit einer stabilen Fable-5-Integration ausführtZuerst evaluierenDie Ersparnis beim Listenpreis kann gering ausfallen, und die Benchmark-Gewinne unterscheiden sich je nach Aufgabe.

Was sich von Fable 5 zu Fable 5.1 ändert

Claude Fable 5.1 übernimmt das zentrale Kapazitätsprofil von Claude Fable 5: ein Kontextfenster mit 1 Million Tokens, eine maximale Ausgabe von 128.000 Tokens und dauerhaft aktiviertes adaptives Thinking. Die dokumentierten Unterschiede betreffen den Lebenszyklus, einen Wissensstand bis Juni 2026 statt Januar 2026, günstigere Cache-Lesezugriffe sowie ein verändertes API-Verhalten bei Tools und Thinking-Blöcken. (Übersicht zum Legacy-Modell Fable 5; Modellübersicht zu Fable 5.1)

SpezifikationClaude Fable 5Claude Fable 5.1
API-Modell-IDclaude-fable-5claude-fable-5-1
LebenszyklusAktiv, LegacyAktiv, aktuelles Fable-Modell
Veröffentlichungsdatum9. Juni 20261. September 2026
Kontextfenster1 Mio. Tokens1 Mio. Tokens
Maximale Ausgabe128.000 Tokens128.000 Tokens
ThinkingAdaptiv, dauerhaft aktivAdaptiv, dauerhaft aktiv
StandardaufwandHighHigh
Zuverlässiger WissensstandJanuar 2026Juni 2026
Ein- / Ausgabepreis10 / 50 US-Dollar pro MTok10 / 50 US-Dollar pro MTok
Preis für Cache-Lesezugriffe1 US-Dollar / MTok0,25 US-Dollar / MTok

Fable 5.1 ist über die Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform on AWS verfügbar. Anthropic führt Fable 5 für dieselben Plattformfamilien als verfügbar auf; die Einstellung soll frühestens am 9. Juni 2027 erfolgen. Für Fable 5.1 ist keine Einstellung vor dem 1. September 2027 vorgesehen. (Verfügbarkeit und Lebenszyklus von Fable 5.1; Verfügbarkeit und Lebenszyklus von Fable 5)

Der Preisvorteil steckt in den Cache-Lesezugriffen, nicht in den Listenpreisen

Bei frischen Ein- und Ausgabetokens ist Fable 5.1 nicht günstiger. Das Modell berechnet wie Fable 5 jeweils 10 US-Dollar pro einer Million Input-Tokens und 50 US-Dollar pro einer Million Output-Tokens. Nur ein Cache-Lesezugriff wird günstiger: 0,25 statt 1 US-Dollar pro einer Million Tokens. (Preisdokumentation von Anthropic)

NutzungskategorieFable 5Fable 5.1Änderung
Frische Eingabe10 US-Dollar / MTok10 US-Dollar / MTokKeine
Ausgabe50 US-Dollar / MTok50 US-Dollar / MTokKeine
5-Minuten-Cache-Schreibzugriff12,50 US-Dollar / MTok12,50 US-Dollar / MTokKeine
1-Stunden-Cache-Schreibzugriff20 US-Dollar / MTok20 US-Dollar / MTokKeine
Cache-Lesezugriff1 US-Dollar / MTok0,25 US-Dollar / MTok75 Prozent günstiger
Batch-Ein- / Ausgabe50 Prozent Rabatt50 Prozent RabattGleicher angegebener Rabatt

Ein einfaches Beispiel: Ein Agent liest zehnmal einen gecachten Projektkontext mit 1 Million Tokens und erzeugt anschließend 200.000 Output-Tokens. Der Teil für die Cache-Lesezugriffe kostet bei Fable 5 dann 10 US-Dollar, bei Fable 5.1 nur 2,50 US-Dollar. Die Ausgabe schlägt bei beiden Modellen mit 10 US-Dollar zu Buche. Unter diesen engen Annahmen sinken die Tokenkosten von 20 auf 12,50 US-Dollar – also um 37,5 Prozent.

Wie viel tatsächlich gespart wird, hängt von Cache-Treffern, Schreibzugriffen, Ausgabelänge, Wiederholungen, Tool-Aufrufen und Fallback-Routing ab. Anthropic veranschlagt für typische Workloads rund 25 Prozent niedrigere Kosten und für stark agentische Workloads bis zu etwa 45 Prozent. (Fable-Produktseite von Anthropic)

Die Nutzung im Abo ist von der API-Kostenrechnung getrennt. Laut Anthropic Help Center gelten für Fable 5 und Fable 5.1 derzeit dieselben Planregeln: Max sowie Premium-Team- oder Legacy-Enterprise-Sitze können Fable-Modelle für bis zu 50 Prozent ihres wöchentlichen Nutzungslimits einsetzen. Pro- und Standard-Sitze verwenden dagegen Pay-as-you-go-Nutzungsguthaben. Die frühere Fable-5-Aktion endete am 19. Juli 2026; Fable 5.1 war nicht Teil dieser Aktion. (Planhinweise von Anthropic)

Die Benchmarks zeigen ein echtes, aber uneinheitliches Upgrade

Im veröffentlichten Vergleich liegt Fable 5.1 bei mehreren agentischen und Computer-Use-Benchmarks deutlich vor Fable 5. Die Abstände reichen allerdings von überschaubar bis sehr groß. Es handelt sich um von Anthropic gemeldete Ergebnisse aus abgesicherten, versionsspezifischen Tests. Die Werte sind daher vor allem als Orientierung zu verstehen – die eigenen Prompts sollten zusätzlich geprüft werden. (Benchmark-Tabelle von Anthropic)

BenchmarkFable 5.1Fable 5Differenz
Terminal-Bench-Science 0.152,6 %24,7 %+27,9 Punkte
Terminal-Bench 4.055,8 %42,0 %+13,8 Punkte
GDPval-AA v21.853 Elo1.723 Elo+130 Elo
OSWorld 2.0, partial77,9 %72,9 %+5,0 Punkte
OSWorld 2.0, strict41,7 %36,1 %+5,6 Punkte
Humanity’s Last Exam, ohne Tools60,9 %57,8 %+3,1 Punkte
Humanity’s Last Exam, mit Tools65,0 %63,8 %+1,2 Punkte
AutomationBench31,4 %17,1 %+14,3 Punkte
CursorBench 3.2.073,4 %70,5 %+2,9 Punkte
Offizieller Benchmark-Vergleich von Fable 5.1 und Fable 5

Der größte veröffentlichte Abstand zeigt sich bei Terminal-Bench-Science 0.1: Dort liegt der gemeldete Wert von Fable 5.1 mehr als doppelt so hoch wie der von Fable 5. Auch AutomationBench und Terminal-Bench 4.0 weisen deutliche Zuwächse aus. Die kleineren Unterschiede bei Humanity’s Last Exam und CursorBench führen zu einer nüchterneren Schlussfolgerung: Fable 5.1 ist nicht bei jeder Aufgabenart im gleichen Maß besser.

In Anthropics Tabelle steht für das öffentlich verfügbare Fable 5.1 ein Ergebnis von 55,8 Prozent bei Terminal-Bench 4.0. Mythos 5.1 wird separat mit 60,9 Prozent aufgeführt. Mythos 5.1 ist kein allgemein verfügbarer Ersatz für Fable 5.1. (Produktseite von Anthropic)

API-Migration: Diese drei Fable-5-Verhaltensweisen zuerst testen

Anthropic beschreibt die Migration auf Fable 5.1 als weitgehend unkompliziert. Drei Änderungen können jedoch zu Fehlern in Produktion führen oder das Verhalten eines Agenten unbemerkt verändern. Sie sollten getestet werden, bevor die Modell-ID in allen Umgebungen ausgetauscht wird. (Migrationsleitfaden für Fable 5.1)

1. Erzwungene Tool-Auswahl führt zu einem 400-Fehler

Fable 5.1 akzeptiert tool_choice: {"type":"auto"} und tool_choice: {"type":"none"}. {"type":"any"} sowie die Erzwingung eines bestimmten Tools werden dagegen mit einem 400-Fehler vom Typ invalid_request_error abgelehnt. Das gilt auch für die Messages API, die Message Batches API und den Endpoint zur Token-Zählung.

Benötigt die Anwendung valides JSON, sollten – sofern verfügbar – strukturierte Ausgaben verwendet werden. Alternativ bleibt die Tool-Auswahl auf auto, ergänzt um ein strenges Schema und eine klare Anweisung. Muss in einem bestimmten Turn ein konkretes Tool verwendet werden, dokumentiert Anthropic als Ersatzmuster eine angehängte, auf diesen Turn begrenzte Systemanweisung.

2. Thinking-Blöcke sind an das erzeugende Modell gebunden

Fable 5.1 kann aufbewahrte Thinking-Blöcke von Fable 5 und früheren kompatiblen Claude-Modellen lesen. Ältere Modelle können Thinking-Blöcke von Fable 5.1 nicht verarbeiten. Wird ein Gespräch im Fallback an ein älteres Modell weitergereicht, entfernt die API die nicht lesbaren Blöcke – der Fallback muss die Planung anschließend erneut durchführen.

Für die entfernten Blöcke werden keine Inputkosten berechnet. Der neue Planungsschritt kann nach einem Modellwechsel jedoch die Latenz und die Kosten des ersten Turns erhöhen. Für die Fehlersuche dokumentiert Anthropic den Beta-Header thinking-binding-controls-2026-08-01, der eine Transformation vom Typ model_binding_mismatch meldet.

3. Änderungen an der bisherigen History können die Anfrage ungültig machen

Bei neueren API-Konten prüft Fable 5.1, ob System-Prompt, Tools oder frühere Nachrichten vor einem gespeicherten Thinking-Block verändert wurden. Wird dieser Präfix bearbeitet, neu sortiert, gelöscht oder rekonstruiert, kann die API statt einer Antwort einen 400-Fehler wegen einer ungültigen Signatur zurückgeben.

Die sichere Grundeinstellung ist ein Verlauf, an den nur angehängt wird. Für Verdichtung oder Kontextänderungen sollte die serverseitige Komprimierung beziehungsweise Context Editing genutzt werden, anstatt eine Zusammenfassung mitten in ein Transkript einzusetzen. Dateien über mehrere Turns hinweg bleiben stabil, wenn eine Files-API-file_id oder byte-identische Inhalte verwendet werden. Bewahrt ein Client den exakten Präfix bereits auf, reicht möglicherweise die Änderung der Modell-ID. Baut er die Nachrichten bei jedem Turn neu auf, braucht er zuerst einen Adapter.

Ergänzende Änderungen, die sich lohnen können

Fable 5.1 bringt außerdem Steuerungsmöglichkeiten mit, die lang laufende Agenten ohne komplette Überarbeitung verbessern können:

  1. Aufwand pro Nachricht: low, medium, high, xhigh oder max kann in einem späteren Turn geändert werden, ohne den gecachten Präfix ungültig zu machen.
  2. Systemnachrichten für einzelne Turns: Eine Anweisung lässt sich auf einen Turn begrenzen, ohne Text aus dem früheren System-Prompt einzufügen und wieder zu löschen.
  3. Fortschrittsmeldungen: Mit den dokumentierten Anzeigeeinstellungen können zwischen Tool-Aufrufen lesbare Statusmeldungen angefordert werden.
  4. Niedrigere Preise für Cache-Lesezugriffe: Der wiederverwendete Präfix kann bestehen bleiben, die Cache-Trefferrate sollte nach der Migration aber neu gemessen werden.

Die Bezeichnung des Aufwands ist keine portable Arbeitseinheit. Der dokumentierte Standardwert high ist ein sinnvoller Ausgangspunkt. Anschließend sollten Qualität, Latenz und Token-Gesamtzahl bei medium und höheren Einstellungen anhand des tatsächlichen Aufgabensets verglichen werden.

Zugriff, Kontingente und Fallbacks beeinflussen das Ergebnis in der Praxis

Fable 5.1 ist in kostenpflichtigen Claude-Tarifen sowie über Anthropics API und die aufgeführten Cloud-Plattformen allgemein verfügbar. Der Zugriff im Tarif bedeutet jedoch nicht, dass die Nutzung unbegrenzt enthalten ist. Pro-Nutzer und Standard-Team-Sitze benötigen möglicherweise ab der ersten Anfrage Nutzungsguthaben. Max- und Premium-Sitze teilen sich dagegen einen Fable-spezifischen Anteil ihres Wochenkontingents. Für Claude Code ist Fable 5.1 ab Version 2.1.250 erforderlich; Fable 5 benötigt Version 2.1.170 oder höher. (Anthropics Leitfaden zu Tarifen und Zugriff)

Automatisches Umschalten kann außerdem dazu führen, dass ein Fable-Vergleich in der App anders ausfällt als in der API. Anthropic zufolge können sensible Anfragen aus den Bereichen Cybersicherheit und Biologie an Opus-Fallback-Modelle weitergeleitet werden. In den Claude-Oberflächen ist das automatische Umschalten standardmäßig aktiv. In der API müssen Entwickler Fallbacks selbst konfigurieren. Eine Ablehnung wird dabei als erfolgreiche HTTP-Antwort mit einem entsprechenden Refusal-Stop-Grund zurückgegeben, sofern keine Fallback-Behandlung ergänzt wurde. (Anthropics Hinweise zu Fallbacks)

Frühe Nutzerberichte sind nur anekdotisch, weisen aber auf zwei Kostenfaktoren hin, die ein Pilotprojekt messen sollte:

„5.1 scheint in Ordnung zu sein, aber es wirkt tatsächlich langsamer.“ — u/BeowulfShaeffer, Veröffentlichungsdiskussion auf r/ClaudeAI

„Ich bin bereits bei 100 Prozent Nutzung.“ — u/noeyb, Veröffentlichungsdiskussion auf r/ClaudeAI

Diese Kommentare belegen keine allgemeine Leistungskennzahl. Sie sprechen aber dafür, neben der Antwortqualität auch die tatsächliche Bearbeitungszeit und den Verbrauch des Kontingents zu protokollieren.

Entscheidungstabelle für Fable-5-Nutzer

SituationPraktische Entscheidung
Neuer Agent mit wiederholten Lesezugriffen auf KontextFable 5.1, von Anfang an mit Protokollierung von Cache-Treffern und Latenz
Bestehender Fable-5-Agent mit Verlauf im Append-only-Modus und automatischen ToolsFable 5.1 pilotieren, zunächst mit einem repräsentativen Aufgabenausschnitt
Bestehender Agent mit erzwungenen benannten ToolsTool-Auswahl zuerst anpassen, danach Fable 5.1 testen
Bestehender Client, der ältere Nachrichten oder System-Prompts neu schreibtFable 5 als Fallback behalten, während die History-Schicht überarbeitet wird
Überwiegend frische Prompts mit geringer Cache-WiederverwendungKosten pro abgeschlossener Aufgabe vergleichen, nicht nur Tokenpreise
Arbeit, bei der wahrscheinlich Cybersicherheits- oder Biologie-Schutzmechanismen greifenDen Fallback-Pfad modellieren und vor der Migration dessen Opus-Preise berücksichtigen
Niedrigere Standardpreise für Ein- und Ausgabe erforderlichEin anderes Anthropic-Modell vergleichen, denn Fable 5.1 und Fable 5 haben identische Listenpreise

Ein praxisnaher Migrationstest kann klein bleiben: 20 bis 50 repräsentative Aufgaben erneut ausführen, dieselben Tools und Prompts festsetzen und Erfolgsquote, Fehler bei erzwungenen Tools, Fallback-Anzahl, Cache-Read-Tokens, gesamte Ein- und Ausgabetokens, Latenz, Kontingentverbrauch und Kosten pro abgeschlossener Aufgabe erfassen. Fable 5.1 sollte erst dann ausgerollt werden, wenn die Qualitätsanforderungen erfüllt sind und keine unvertretbaren Kompatibilitäts- oder Kontingentprobleme entstehen.

Fragen, die Käufer weiterhin stellen

Warum hat Claude von Fable 5.1 weg gewechselt?

Ein Schutzklassifizierer kann bei bestimmten Anfragen zu Cybersicherheit, Biologie, Reasoning-Extraktion oder der Entwicklung von Frontier-Modellen automatisch einen Fallback auslösen. In den Claude-Apps wird die Anfrage möglicherweise erneut an ein Opus-Modell gesendet. In der API muss der Entwickler das Fallback-Verhalten konfigurieren. (Anthropics Hinweise zu Fallbacks)

Für einen neuen Agenten mit langfristigem Kontext und für Fable-5-Workloads mit umfangreicher Cache-Wiederverwendung ist Fable 5.1 das bessere Ziel. Bei einer Kompatibilitätsprüfung sollte Fable 5 jedoch beibehalten werden, wenn die Integration Tools erzwingt, den Nachrichtenverlauf verändert oder keine Unsicherheit bei Fallbacks und Kontingenten toleriert.

>_AIReiter Modellverzeichnis

Schneller API-Zugriff auf Modelle zu diesem Guide

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicAPI-Key erstellen >

Claude Fable 5

Chat

Ein Premium-Claude-Modell für tiefes Denken und komplexe Arbeiten über längere Formate.

AnthropicAPI-Key erstellen >

Claude Opus 4.8

Chat

Ein leistungsstarkes Claude-Modell für anspruchsvolles Denken und professionelle Arbeit.

AnthropicAPI-Key erstellen >

Claude Opus 5

Chat

Ein Premium-Model von Claude für komplexes Schlussfolgern, Programmierung und professionelle Arbeit mit langem Kontext.

AnthropicAPI-Key erstellen >

Claude Sonnet 5

Chat

Ein ausgewogenes Claude-Modell für fortgeschrittenes Reasoning, Coding und die tägliche Arbeit.

AnthropicAPI-Key erstellen >

Neueste Beiträge

GPT-6 Astra API im Test (2026): Für Agenten gebaut, kein Drop-in-Ersatz

2026-09-07

Kling API: Leitfaden für offizielle und Aggregator-Integration (2026)

2026-09-07

Suno-API-Key: So bekommen Sie einen und das kostet er (2026)

2026-09-07

GPT-6 Astra im Test: Lohnen sich $10/$50 API-Preise?

2026-09-06
AIREITER

Fragen? Kontaktieren Sie uns unter
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

KI-Video

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

KI-Bild

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Alle anzeigen →

Unternehmen

DatenschutzrichtlinieNutzungsbedingungenRückerstattungsrichtlinie

© 2026 AIReiter. Alle Rechte vorbehalten.