SSD Nodes Learn Hosting plans →
Anleitungen Matt ConnorVon Matt Connor · Aktualisiert 2026-09-06

Claude Fable 5: Preis und wann sich das Modell lohnt

Claude Fable 5 kostet $10 je Million Eingabetoken und $50 je Million Ausgabetoken. Erfahren Sie, was die Listenpreise für Ihre konkreten Aufgaben bedeuten.

Was kostet Claude Fable 5?

Claude Fable 5 kostet $10 pro Million Eingabetoken und $50 pro Million Ausgabetoken über die Claude API. Das sind die von Anthropic veröffentlichten Listenpreise, abgerufen am 3. August 2026 auf der Preisseite. Die API-Modell-ID lautet claude-fable-5. Das Modell wurde am 9. Juni 2026 allgemein verfügbar und ist über die Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry erhältlich.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Ordnen Sie die Preise als Staffelung ein. Fable 5 wird zum doppelten Preis von Claude Opus 5, zum fünffachen des aktuellen Preises von Claude Sonnet 5 und zum zehnfachen des Preises von Claude Haiku 4.5 angeboten. Das Verhältnis ist auf beiden Seiten der Abrechnung gleich, weil jedes Modell in dieser Übersicht Ausgabetoken zum exakt fünffachen eigenen Eingabetokenpreis abrechnet. Wenn Sie also die Aufteilung eines Auftrags in Eingabe- und Ausgabetoken kennen, können Sie einen Preis durch Multiplikation in jeden anderen umrechnen.

Ein Datum ändert die Berechnung. Für Sonnet 5 gelten bis zum 31. August 2026 Einführungspreise von $2 und $10 pro Million Token. Ab dem 1. September 2026 wird das Modell zu $3 und $15 angeboten. Der Preis von Fable 5 selbst ändert sich nicht. Dadurch verringert sich der Abstand an diesem Tag vom fünffachen auf etwas mehr als das Dreifache. Wenn Sie ein Budget für den Herbst erstellen, verwenden Sie die späteren Sonnet-Preise.

Die Rabatte und der eine Multiplikator in die andere Richtung

Prompt-Caching ist der größte Hebel. Ein Cache-Lesezugriff kostet ein Zehntel des Basistarifs. Auf Fable 5 sind das $1 pro 1 Million Token. Das Schreiben in den Cache kostet mehr als ein gewöhnlicher Eingabe-Token: Beim fünfminütigen Cache gilt der 1,25-fache Basistarif, beim einstündigen Cache der 2-fache Basistarif. Ein fünfminütiger Cache amortisiert sich nach einem einzigen Lesezugriff, ein einstündiger Cache nach zwei Lesezugriffen. Diese Rechnung ist das gesamte Argument dafür, zu ermitteln, ab wann sich Prompt-Caching amortisiert, bevor Sie es überall aktivieren.

Die Batch API reduziert beide Seiten um 50 %. Gebatchte Fable-5-Aufgaben kosten daher $5 für Eingabe-Token und $25 für Ausgabe-Token pro 1 Million Token. Batch-Anfragen werden asynchron verarbeitet. Das hilft daher nur bei Aufgaben, die nicht sofort eine Antwort benötigen. Die beiden Rabatte lassen sich kombinieren. Dadurch ist eine gecachte und gebatchte Aufgabe in beiden Kategorien günstig.

Das Kontextfenster mit 1M Token ist bei Claude 4.6 und späteren Modellen im Standardtarif enthalten. Es gibt keinen Aufpreis für lange Kontexte. Eine Anfrage mit 900k Token wird daher zum gleichen Token-Tarif abgerechnet wie eine Anfrage mit 9k Token.

Der Multiplikator, der die Rechnung erhöht, ist die Datenresidenz. Wenn Sie inference_geo: "us" so setzen, dass die Inferenz innerhalb der Vereinigten Staaten bleibt, gilt für jede Token-Kategorie, einschließlich Cache-Lese- und Cache-Schreibzugriffen, der 1,1-fache Multiplikator. Belassen Sie das standardmäßige globale Routing, sofern kein Vertrag etwas anderes verlangt.

Für dieses Modell gilt eine spezielle Abrechnungsregel. Fable 5 enthält ausgelieferte Sicherheitsklassifizierer, die eine Anfrage ablehnen können. In diesem Fall gibt die Messages API stop_reason: "refusal" als erfolgreiche HTTP-200-Antwort statt als Fehler zurück. Für eine Anfrage, die abgelehnt wird, bevor eine Ausgabe erzeugt wurde, werden Ihnen keine Kosten berechnet. Wenn Sie denselben Prompt mit einem anderen Claude-Modell erneut senden, erstattet das Fallback-Guthaben die Kosten für den Prompt-Cache dieses Wechsels. Sie zahlen daher nicht zweimal dafür, denselben Cache aufzuwärmen.

Welche Tarife enthalten Claude Fable 5?

Am 3. August 2026 gab Anthropics Claude-Fable-Seite an, dass das Modell für Pro-, Max-, Team- und Enterprise-Benutzer verfügbar ist. Der kostenlose Tarif wurde nicht genannt. Pro ist der günstigste Sitzplatz in dieser Liste. Daher bilden die Kosten für Pro und die dort geltenden Nutzungsgrenzen die Untergrenze für jeden Abonnementweg zu Fable. Wenn der Fable-Zugriff der Hauptgrund für ein Upgrade wäre, prüfen Sie zuerst ob sich ein Pro-Sitzplatz für Ihre eigene Nutzung lohnt. Ein knapp bemessenes Fable-Kontingent rechtfertigt das Abonnement allein nur selten. Für Entwickler ist Fable allgemein über die Claude API und über die oben aufgeführten Cloud-Marktplätze verfügbar. Auf diesem Weg gibt es keinen kostenlosen Tarif. Daher sind die kleinen Guthaben, die Anthropic bei der Anmeldung gewährt, alles, was Ihnen zur Verfügung steht, bevor die Abrechnung beginnt.

In einem Tarif verfügbar bedeutet nicht dasselbe wie ohne Limit enthalten. Auch ein Abonnement wird nicht so abgerechnet wie die API, weil für einen Pro-Sitz kein veröffentlichtes Token-Kontingent existiert und die Nutzung stattdessen in Nachrichten innerhalb eines rollierenden Zeitfensters gezählt wird. Daher lässt sich nichts aus einem Tarif direkt in die oben genannten Werte pro Million umrechnen. Die Tarifvergleichstabelle auf der Anthropic-Preisseite schränkt Fable bei einigen Sitzen über einen Anteil der wöchentlichen Nutzungslimits und bei anderen über Nutzungsguthaben ein. Diese Regelung wurde im Juli 2026 mehr als einmal geändert. In der eigenen Mitteilung von Anthropic zur erneuten Bereitstellung von Fable 5 wurde das Modell bis zum 7. Juli 2026 in Pro-, Max-, Team- und ausgewählten Enterprise-Tarifen für bis zu 50% der wöchentlichen Nutzungslimits eingeschlossen. Danach galten Nutzungsguthaben. Berichte im weiteren Verlauf des Juli beschrieben zusätzliche Verlängerungen und eine Aufteilung nach Sitztypen.

Daher wird auf dieser Seite kein Limit pro Tarif angegeben. Keine Zahl, die in diesem Monat veröffentlicht wurde, blieb zwei Wochen lang gültig. Eine veraltete Zahl wäre hier schlechter als keine Zahl. Öffnen Sie an dem Tag, an dem Sie sich entscheiden, die Zeile mit der Bezeichnung Fable in der Tarifvergleichstabelle. Behandeln Sie jede Zahl in einem Nachrichtenartikel als veraltet. Wenn Sie für den Fable-Zugriff einen Sitzplatz buchen und das Kontingent geringer ausfällt als in der Tabelle erwartet, können Sie vor der nächsten Verlängerung wieder auf einen niedrigeren Tarif wechseln. Der bereits bezahlte Monat bleibt davon unberührt.

Stabil ist der API-Tarif. Auf jedem Weg wird die weitere Nutzung von Fable 5 nach Ausschöpfung eines enthaltenen Kontingents zu den oben in der Tabelle genannten Preisen abgerechnet. Enterprise macht diese Struktur ausdrücklich sichtbar. Denn die Enterprise-Sitzgebühr ermöglicht den Zugriff, während die Tokens zusätzlich weiterhin zu API-Tarifen abgerechnet werden. Daher ist die Preisliste in beiden Fällen die maßgebliche Grundlage für die Planung. Zu demselben Ergebnis kommen Sie, wenn Sie die API-Abrechnung mit einem Abonnement für ein beliebiges anderes Claude-Modell vergleichen. Wenn Sie noch keine Tarifstufe ausgewählt haben, beginnen Sie mit der Frage, welcher Claude-Tarif zu Ihrer Nutzung passt. Wenn dieser Sitzplatz auch als alltäglicher Assistent und nicht nur als Zugang zu Fable dienen soll, sollten Sie vor der Entscheidung prüfen, wie sich die Preise der Claude-Tarife im Vergleich zu ChatGPT verhalten.

Warum Ihre Rechnung höher ausfällt, als das Preisverhältnis vermuten lässt

Zwei dokumentierte Mechanismen machen Fable 5 teurer, als ein direkter Preisvergleich vermuten lässt.

Der erste ist der Tokenizer. Fable 5 verwendet den mit Claude Opus 4.7 eingeführten Tokenizer. Im Vergleich zu Modellen, die vor Opus 4.7 veröffentlicht wurden, erzeugt derselbe Text ungefähr 30% mehr Tokens. Die genaue Zunahme hängt vom Inhalt ab. Haiku 4.5 verwendet noch den älteren Tokenizer. Deshalb beträgt der zehnfache Abstand in der Preisliste bei derselben Texteingabe für beide Modelle tatsächlich eher das Dreizehnfache. Sonnet 5 verwendet den neueren Tokenizer. Der Vergleich zwischen Fable und Sonnet ist daher pro Token fair. Der Vergleich zwischen Fable und Haiku ist es nicht.

Der zweite Mechanismus ist das Thinking. Adaptives Thinking ist bei Fable 5 immer aktiviert, und thinking: {"type": "disabled"} wird nicht unterstützt. Thinking-Tokens werden als Output-Tokens zum vollen Output-Tarif abgerechnet. Der eigentliche Chain of Thought wird bei diesem Modell nie zurückgegeben. Außerdem ist thinking.display standardmäßig auf "omitted" gesetzt. Dadurch kann eine kurze sichtbare Antwort eine große abgerechnete Output-Anzahl enthalten. Die Dokumentation von Anthropic formuliert es eindeutig: Die Anzahl der abgerechneten Output-Tokens entspricht nicht der sichtbaren Token-Anzahl in der Antwort.

Prüfen Sie die Aufschlüsselung, statt zu raten. Das Feld usage.output_tokens_details.thinking_tokens gibt an, wie viele der abgerechneten Output-Tokens für das Reasoning verwendet wurden:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

In diesem Beispiel aus der Thinking-Dokumentation von Anthropic waren 312 der 348 abgerechneten Output-Tokens Reasoning, das niemand zu sehen bekam. Beim Streaming wird diese Aufschlüsselung erst im abschließenden message_delta-Event übertragen. Ein Client, der nach dem letzten Text-Chunk nicht weiterliest, erfasst sie daher nicht.

Die Steuerung erfolgt über effort. Sie wird bei output_config.effort gesetzt und unterstützt die Stufen low, medium, high (die Standardeinstellung), xhigh und max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Anthropic empfiehlt für dieses Modell, mit high zu beginnen, nur bei besonders stark von den Fähigkeiten abhängigen Aufgaben auf xhigh zu erhöhen und für Routineaufgaben auf medium oder low zu reduzieren. Der Grund ist, dass ein geringerer Aufwand bei Fable 5 frühere Modelle bei xhigh oft übertrifft. Dabei gibt es zwei typische Fallen. Wenn Sie den Aufwand zwischen Anfragen ändern, wird der Prompt-Cache ungültig, weil der aufgelöste Aufwandswert in den Prompt eingefügt wird. Wählen Sie daher pro Workload eine Stufe und behalten Sie sie bei. Außerdem ist max_tokens eine harte Obergrenze für die gesamte Ausgabe, also für Thinking und Antworttext zusammen. Ein für eine Antwort ohne Thinking bemessenes Limit führt daher zu einer abgeschnittenen Antwort. stop_reason: "max_tokens" bedeutet, dass Sie entweder das Limit erhöhen oder den Aufwand reduzieren müssen.

Kosten pro abgeschlossener Aufgabe, nicht Kosten pro Token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Diese 3 Zeilen sind eine Rechenbeispiel, kein Benchmark. Die Preise sind veröffentlicht. Die Tokenmengen sind Annahmen, die Sie durch Werte aus Ihren eigenen Nutzungsdaten ersetzen sollten. Eine Programmiersitzung wie in der mittleren Zeile kostet mit Fable 5 $5.00, mit Sonnet 5 dagegen $1.00. Der lange Durchlauf kostet $40.00 gegenüber $8.00. Die Haiku-Spalte in der letzten Zeile ist nur eine Rechenangabe: Haiku 4.5 hat ein Kontextfenster von 200k Token und kann diesen Auftrag daher überhaupt nicht aufnehmen.

Kosten pro Token sind die falsche Einheit für eine Entscheidung. Kosten pro abgeschlossener Aufgabe ergeben sich aus den Kosten pro Versuch multipliziert mit der Anzahl der Versuche. Bei den heutigen Preisen kostet ein Versuch mit Fable 5 genauso viel wie fünf Versuche mit Sonnet 5. Die Anzahl der Wiederholungen allein rechtfertigt den Wechsel daher fast nie. Sonnet müsste in mehr als vier von fünf Fällen fehlschlagen, bevor der günstigere Weg bei den Tokenkosten schlechter abschneidet.

Entscheidend sind dagegen alle Faktoren, die in der Tokenrechnung fehlen. Der Abstand zwischen den beiden langen Durchläufen im Diagramm ist in den meisten Märkten kleiner als eine Stunde Arbeitszeit eines Engineers. Wenn das teurere Modell eine Stunde Überprüfung einspart oder eine fehlerhafte Migration verhindert, die Sie anschließend zurückbauen müssten, hat es sich bereits amortisiert. Diese Einsparung erscheint in keiner Rechnung. Vergleichen Sie die Kosten pro akzeptiertem Ergebnis und rechnen Sie Ihre eigene Arbeitszeit in die Gesamtkosten ein. Wie viel eine Million Token tatsächlich leisten macht diese Schätzung deutlich konkreter.

Drei Aufgaben, bei denen Claude Fable 5 seinen Preis rechtfertigt

Lang laufende Agentenprozesse, bei denen ein falscher Schritt teuer ist. Fable 5 ist für Aufgaben ausgelegt, deren Ausführung in Stunden gemessen wird: ein Kontextfenster mit 1M Tokens, bis zu 128k Ausgabetokens pro Anfrage und eine xhigh-Aufwandsstufe für Aufgaben, die länger als dreißig Minuten laufen und Token-Budgets im Millionenbereich benötigen. Vergleichen Sie die Kosten des Prozesses mit dem Aufwand für die Bereinigung, nachdem ein Agent bei Schritt 40 einen falschen Pfad eingeschlagen hat, den bis Schritt 300 niemand bemerkt.

Eine Migration oder ein Audit, das Sie einmalig für eine große Codebasis ausführen. Bei einmaligen Aufgaben gibt es kein Volumen, auf das sich die Kosten verteilen lassen. Der Aufpreis pro Token fällt daher auf einer einzigen Rechnung an. Außerdem kann die gesamte Aufgabe in ein einziges Kontextfenster passen. Wenn sie asynchron ausgeführt werden kann, halbiert die Batch API die Kosten auf $25 pro Million Ausgabetokens.

Die Aufgabe, an der ein günstigeres Modell bereits zweimal gescheitert ist. Zwei fehlgeschlagene Versuche plus Ihre Debugging-Zeit kosten bei den oben dargestellten Volumen mehr als ein Versuch mit Fable. Die Eskalation ist der günstigere Pfad. Genau dafür ist eine Modellhierarchie gedacht. Wenn Sie allgemein noch zwischen den Stufen wählen, beantwortet der Fähigkeitsvergleich zwischen den Claude-Modellstufen eine andere Frage als diese Seite.

Drei Aufgaben, bei denen Sonnet 5 oder Haiku 4.5 die ehrliche Antwort ist

Klassifizierung und Extraktion mit hohem Durchsatz. Diese Aufgaben werden anhand von Durchsatz und Stückkosten bewertet. Die Qualitätsgrenze ist niedrig genug, dass ein günstiges Modell sie erreicht. Wenn eine Aufgabe mit Haiku 4.5 für ein Zehntel des Preises korrekt erledigt wird, liefert Fable 5 keinen messbaren Mehrwert.

Interaktive Arbeit, bei der die Latenz entscheidend ist. In der Modellübersicht von Anthropic wird die vergleichbare Latenz von Fable 5 als höher angegeben. Das Nachdenken kann nicht deaktiviert werden. Ein Chatfeld oder eine Vervollständigung im Editor fühlt sich mit dem leistungsfähigeren Modell schlechter an, weil Benutzer die Wartezeit wahrnehmen, bevor sie die Qualitätssteigerung bemerken.

Alles, was von Ereignissen nach Januar 2026 abhängt. Der verlässliche Wissensstand von Fable 5 endet im Januar 2026. Bei Opus 5 endet er im Mai 2026. Das teurere Modell ist also weniger aktuell. Bei Fragen zur Aktualität zahlen Sie daher den doppelten Preis für älteres Wissen, sofern Sie ihm keine Such- oder Abrufwerkzeuge zur Verfügung stellen.

Eine Einschränkung betrifft ausschließlich die Kosten. Für Fable 5 gilt eine Datenaufbewahrung von 30 Tagen. Zero Data Retention wird nicht unterstützt, weil das Modell als Covered Model eingestuft ist. Wenn Ihre Vereinbarung eine Aufbewahrung von null Tagen erfordert, ist Fable 5 unabhängig vom Preis keine Option. Auch ein Rabatt ändert daran nichts.

Was die fable-method-Repositories zeigen und was nicht

Praktiker haben Repositories veröffentlicht, die herausarbeiten, wie sich Ansätze mit Fable 5 in Skills umsetzen lassen, denen ein günstigeres Modell folgen kann. Das fable-method-Repository beschreibt einen Denk-Skill, eine Orchestrierungsschleife und einen adversarialen Verifizierer, der jede behauptete Prüfung erneut ausführt, statt den eigenen Bericht des Agenten zu lesen. In der README steht dies ausdrücklich: „Dies ist eine gemeinschaftliche Aufbereitung und kein Artefakt von Anthropic.“

Behandeln Sie es genau so. Es ist ein Beleg dafür, wie Menschen das Modell steuern, und keine Dokumentation seiner Funktionsweise. Nichts darin wurde von Anthropic validiert. Außerdem existieren mehrere nahezu identische Forks mit unterschiedlicher Formulierung. Das ist eher bei überlieferten Vorgehensweisen als bei einer Spezifikation zu erwarten.

Für eine Kostenentscheidung ist vor allem relevant, dass die nachahmenswerten Teile prozedural sind. Klassifizieren Sie die Aufgabe. Benennen Sie die Prüfung, die ihre Erledigung nachweist. Sammeln Sie vor der Entscheidung Belege. Überprüfen Sie das Ergebnis anschließend durch Beobachtung statt durch das Lesen einer Zusammenfassung. Ein günstigeres Modell schließt einen Teil der Lücke, wenn Sie ihm eine explizite Checkliste und einen Verifizierungsschritt vorgeben. Führen Sie dieses Experiment daher mit Ihrem eigenen Evaluierungssatz durch, bevor Sie das teurere Modell standardisieren. Das Ergebnis hängt von Ihren Aufgaben ab. Deshalb ist die Kennzahl einer anderen Person für Sie kaum aussagekräftig.

Prüfen Sie Ihre eigenen Zahlen, bevor Sie Budget festlegen

  • Lesen Sie bei jeder Antwort usage und protokollieren Sie output_tokens_details.thinking_tokens getrennt von der sichtbaren Ausgabe. Nicht sichtbare Schlussfolgerungen sind der Kostenpunkt, der viele überrascht.
  • Setzen Sie effort explizit, statt den Standardwert zu übernehmen, und halten Sie den Wert innerhalb jeder Unterhaltung konstant, die Prompt-Caching verwendet.
  • Legen Sie Ihr stabiles Präfix zuerst hinter einem Cache-Breakpoint ab. Ein Cache-Read zum Zehntel des Preises für Base-Input spart mehr als die meisten Modell-Downgrades.
  • Verschieben Sie alles, was keine sofortige Antwort erfordert, in die Batch API.
  • Bewerten Sie die Alternative realistisch. Claude- und ChatGPT-API-Preise vergleichen anhand Ihres eigenen Workloads ist vor einer langfristigen Festlegung einen Nachmittag wert.

Wenn der Workload aus einem Agenten besteht, der auf Ihrem eigenen Server läuft, liegen die wichtigsten Steuerungsmöglichkeiten außerhalb der Modellwahl. Agentenkosten auf einem VPS unter Kontrolle halten behandelt die Schleifenlimits und Ausgabenobergrenzen, die eine außer Kontrolle geratene Sitzung stoppen. Wo Claude Code tatsächlich Tokens verbraucht erklärt die Zahlen, die Sie in Ihrem Nutzungs-Dashboard sehen.

FAQ

Wie viel kostet Claude Fable 5 pro Million Tokens?

Claude Fable 5 kostet laut der am 3. August 2026 geprüften Preisseite von Anthropic über die Claude API $10 pro Million Input-Tokens und $50 pro Million Output-Tokens. Das Lesen aus dem Cache kostet $1 pro Million Tokens und damit ein Zehntel des normalen Input-Preises. Die Batch API reduziert beide Preise um 50 %. Für asynchrone Verarbeitung ergeben sich dadurch $5 beziehungsweise $25 pro Million Tokens. Wenn die Inferenz mit dem Parameter inference_geo innerhalb der Vereinigten Staaten bleibt, gilt für jede Kategorie ein Multiplikator von 1.1.

Ist Claude Fable 5 in einem Claude-Pro-Abonnement enthalten?

Auf Anthropics Claude-Fable-Seite wird das Modell als für Pro-, Max-, Team- und Enterprise-Nutzer verfügbar aufgeführt. Der kostenlose Tarif wird dort nicht genannt. Der enthaltene Zugriff ist nicht unbegrenzt. Bei einigen Konten wird Fable auf das wöchentliche Nutzungslimit angerechnet, bei anderen über Nutzungsguthaben abgerechnet. Diese Regelung wurde im Juli 2026 mehr als einmal geändert. Lesen Sie am Tag Ihrer Entscheidung die Zeile Fable in der Tarifvergleichstabelle auf Anthropics Preisseite. Verlassen Sie sich nicht auf einen Wert aus einem Artikel. Wenn das enthaltene Kontingent aufgebraucht ist, wird die weitere Nutzung zum API-Preis abgerechnet.

Warum ist meine Rechnung für Claude Fable 5 höher, als die sichtbare Ausgabe vermuten lässt?

Adaptives Denken ist bei Claude Fable 5 immer aktiviert. Thinking-Tokens werden als Output-Tokens abgerechnet, und die rohe Gedankenkette wird nie zurückgegeben. Wenn thinking.display den Standardwert omitted verwendet, sehen Sie ein leeres Thinking-Feld, bezahlen aber trotzdem für jedes dahinterliegende Reasoning-Token. Lesen Sie usage.output_tokens_details.thinking_tokens in der Antwort aus, um die Aufteilung zu sehen. Beim Streaming trifft dieses Feld erst mit dem abschließenden message_delta-Ereignis ein. Verringern Sie die Einstellung effort, wenn der Anteil des Reasonings an der Antwort höher ist, als die Aufgabe erfordert.

Sollte ich Claude Fable 5 oder Claude Opus 5 verwenden?

Claude Opus 5 kostet pro Token die Hälfte und verfügt über einen aktuelleren, verlässlichen Wissensstand. Der Stichtag ist bei Opus 5 der Mai 2026, bei Fable 5 der Januar 2026. Beginnen Sie mit Opus 5 und wechseln Sie zu Fable, wenn eine Aufgabe damit fehlschlägt oder eine falsche Antwort mehr kostet als der Preisunterschied. Fable 5 eignet sich für agentische Aufgaben mit langem Planungshorizont, bei denen ein falscher Pfad stundenlange Nacharbeiten verursacht. Es eignet sich außerdem für einmalige Aufgaben, bei denen der Aufpreis nur auf einer Rechnung anfällt und nicht dauerhaft bei jeder Anfrage.

#claude#fable#model-selection#pricing#tokens