SSD Nodes Learn 🎉 VPS ab $4.99/Monat
Anleitungen Matt ConnorVon Matt Connor

Claude Fable 5: Preis und wann es sich lohnt

Claude Fable 5 kostet $10 je Million Eingabetokens und $50 je Million Ausgabetokens. Erfahren Sie, was die Listenpreise für Ihre konkreten Aufgaben bedeuten.

Was kostet Claude Fable 5?

Claude Fable 5 kostet $10 pro 1 Million Eingabetokens und $50 pro 1 Million Ausgabetokens über die Claude API. Das sind die von Anthropic veröffentlichten Listenpreise, abgerufen am 3. August 2026 auf der Preisseite. Die API-Modell-ID lautet claude-fable-5. Das Modell wurde am 9. Juni 2026 allgemein verfügbar gemacht: über die Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry.

ChartPublished Claude API list prices, US dollars per million tokens, checked 3 August 2026
The data behind this chart
[
  {
    "label": "Claude Fable 5",
    "input": "10",
    "output": "50",
    "cache_read": "1",
    "batch_input": "5",
    "batch_output": "25"
  },
  {
    "label": "Claude Opus 5",
    "input": "5",
    "output": "25",
    "cache_read": "0.50",
    "batch_input": "2.50",
    "batch_output": "12.50"
  },
  {
    "label": "Claude Sonnet 5 (intro rate)",
    "input": "2",
    "output": "10",
    "cache_read": "0.20",
    "batch_input": "1",
    "batch_output": "5"
  },
  {
    "label": "Claude Sonnet 5 (from 1 Sep)",
    "input": "3",
    "output": "15",
    "cache_read": "0.30",
    "batch_input": "1.50",
    "batch_output": "7.50"
  },
  {
    "label": "Claude Haiku 4.5",
    "input": "1",
    "output": "5",
    "cache_read": "0.10",
    "batch_input": "0.50",
    "batch_output": "2.50"
  }
]

Betrachten Sie die Preise als Stufen. Fable 5 kostet laut Liste das Doppelte von Claude Opus 5, das Fünffache des aktuellen Preises von Claude Sonnet 5 und das Zehnfache von Claude Haiku 4.5. Das Verhältnis ist bei Eingabe und Ausgabe identisch, weil jedes Modell in dieser Übersicht Ausgaben mit genau dem Fünffachen seines eigenen Eingabepreises berechnet. Wenn Sie also die Aufteilung zwischen Eingabe- und Ausgabetokens für einen Auftrag kennen, lässt sich ein Preis durch Multiplikation in jeden anderen umrechnen.

Ein Datum ändert die Berechnung. Für Sonnet 5 gilt bis zum 31. August 2026 ein Einführungspreis von $2 und $10 pro 1 Million Tokens. Ab dem 1. September 2026 wird das Modell mit $3 und $15 gelistet. Der Preis von Fable 5 ändert sich nicht. Dadurch verringert sich der Abstand an diesem Tag vom Fünffachen auf etwas mehr als das Dreifache. Wenn Sie ein Budget für den Herbst erstellen, verwenden Sie die späteren Sonnet-Preise.

Die Rabatte und der eine Multiplikator, der in die andere Richtung wirkt

Prompt-Caching ist der größte Hebel. Ein Cache-Lesevorgang kostet ein Zehntel des normalen Input-Preises. Bei Fable 5 sind das $1 pro 1 Million Tokens. Das Schreiben in den Cache kostet mehr als ein gewöhnlicher Input-Token: das 1,25-Fache des Basispreises für den Cache mit fünf Minuten Laufzeit und das 2-Fache des Basispreises für den Cache mit einer Stunde Laufzeit. Ein Cache mit fünf Minuten Laufzeit amortisiert sich nach einem einzigen Lesevorgang. Ein Cache mit einer Stunde Laufzeit amortisiert sich nach zwei Lesevorgängen. Diese Berechnung ist die Grundlage dafür, zu ermitteln, ab wann sich Prompt-Caching amortisiert, bevor Sie es überall aktivieren.

Die Batch API reduziert beide Seiten um 50 %. Gebatchte Fable-5-Aufgaben kosten daher $5 und $25 pro 1 Million Tokens. Batch-Anfragen werden asynchron verarbeitet. Das hilft daher nur bei Aufgaben, deren Antwort nicht sofort benötigt wird. Die beiden Rabatte lassen sich kombinieren. Dadurch ist ein gecachter Batch-Job auf beiden Seiten kostengünstig.

Das Kontextfenster mit 1M Tokens ist bei Claude 4.6 und späteren Modellen in den Standardpreisen enthalten. Es gibt keinen Aufpreis für lange Kontexte. Eine Anfrage mit 900k Tokens wird daher mit demselben Preis pro Token abgerechnet wie eine Anfrage mit 9k Tokens.

Der Multiplikator, der die Rechnung erhöht, betrifft die Datenresidenz. Wenn Sie inference_geo: "us" so konfigurieren, dass die Inferenz innerhalb der Vereinigten Staaten bleibt, wird auf jede Token-Kategorie, einschließlich Cache-Lese- und Cache-Schreibvorgängen, ein Multiplikator von 1,1 angewendet. Behalten Sie das globale Standard-Routing bei, sofern ein Vertrag keine andere Einstellung erfordert.

Für dieses Modell gilt eine besondere Abrechnungsregel. Fable 5 enthält Sicherheitsklassifizierer, die eine Anfrage ablehnen können. In diesem Fall gibt die Messages API stop_reason: "refusal" als erfolgreiche HTTP-200-Antwort statt als Fehler zurück. Für eine Anfrage, die abgelehnt wurde, bevor eine Ausgabe erzeugt wurde, wird keine Gebühr berechnet. Wenn Sie denselben Prompt mit einem anderen Claude-Modell erneut ausführen, erstattet das Fallback-Guthaben die Kosten für den Prompt-Cache durch den Modellwechsel. Sie zahlen daher nicht zweimal für das Aufwärmen desselben Caches.

Welche Tarife enthalten Claude Fable 5?

Am 3. August 2026 gibt die Claude-Fable-Seite von Anthropic an, dass das Modell für Pro-, Max-, Team- und Enterprise-Nutzer verfügbar ist. Der kostenlose Tarif wird nicht genannt. Für Entwickler ist das Modell allgemein über die Claude API und über die oben aufgeführten Cloud-Marktplätze verfügbar.

In einem Tarif verfügbar bedeutet nicht, dass das Modell unbegrenzt enthalten ist. Die Tarifvergleichstabelle auf der Preisseite von Anthropic begrenzt Fable bei einigen Konten auf einen Anteil der wöchentlichen Nutzungslimits und bei anderen auf Nutzungsguthaben. Diese Regelung wurde im Juli 2026 mehr als einmal geändert. In der eigenen Mitteilung von Anthropic zur erneuten Bereitstellung von Fable 5 war das Modell bis zum 7. Juli 2026 in Pro-, Max-, Team- und ausgewählten Enterprise-Tarifen für bis zu 50% der wöchentlichen Nutzungslimits enthalten. Danach galten Nutzungsguthaben. Berichte aus dem restlichen Juli beschrieben weitere Verlängerungen und eine Aufteilung nach Kontotyp.

Daher wird diese Seite kein Limit pro Tarif angeben. Keine im betreffenden Monat veröffentlichte Zahl blieb zwei Wochen lang gültig. Eine veraltete Zahl wäre hier schlechter als keine Angabe. Öffnen Sie an dem Tag, an dem Sie sich entscheiden, die Zeile mit der Bezeichnung Fable in der Tarifvergleichstabelle. Betrachten Sie jede Zahl in einem Nachrichtenartikel als veraltet.

Stabil ist der API-Tarif. Auf jeder Route wird die weitere Nutzung von Fable 5 nach dem Verbrauch eines enthaltenen Kontingents zu den oben in der Tabelle genannten Preisen abgerechnet. Daher ist die Preisliste in jedem Fall die maßgebliche Grundlage für die Planung. Zu demselben Ergebnis kommen Sie beim Vergleich der API-Abrechnung mit einem Abonnement für jedes andere Claude-Modell. Wenn Sie noch keinen Tarif ausgewählt haben, beginnen Sie mit dem passenden Claude-Tarif für Ihre Nutzung.

Warum Ihre Rechnung über dem vermuteten Preisverhältnis liegt

Zwei dokumentierte Mechanismen machen Fable 5 teurer, als ein direkter Preisvergleich vermuten lässt.

Der erste ist der Tokenizer. Fable 5 verwendet den mit Claude Opus 4.7 eingeführten Tokenizer. Im Vergleich zu Modellen, die vor Opus 4.7 veröffentlicht wurden, erzeugt derselbe Text ungefähr 30% mehr Tokens. Die genaue Zunahme hängt vom Inhalt ab. Haiku 4.5 verwendet noch nicht diesen Tokenizer. Deshalb entspricht der zehnfache Abstand in der Preisliste eher dem dreizehnfachen Abstand, wenn Sie beiden Modellen denselben Text übergeben. Sonnet 5 verwendet den neueren Tokenizer. Der Vergleich zwischen Fable und Sonnet ist daher pro Token fair. Der Vergleich zwischen Fable und Haiku ist es nicht.

Der zweite Mechanismus ist das Thinking. Adaptive thinking ist bei Fable 5 immer aktiviert, und thinking: {"type": "disabled"} wird nicht unterstützt. Thinking-Tokens werden als Output-Tokens zum vollständigen Output-Tarif abgerechnet. Der rohe Chain of Thought wird bei diesem Modell niemals zurückgegeben. Außerdem ist thinking.display standardmäßig auf "omitted" gesetzt. Dadurch kann eine kurze sichtbare Antwort eine große Anzahl abgerechneter Output-Tokens enthalten. In der Dokumentation von Anthropic wird dies ausdrücklich erklärt: Die Anzahl der abgerechneten Output-Tokens entspricht nicht der sichtbaren Token-Anzahl in der Antwort.

Lesen Sie die Aufschlüsselung, statt zu schätzen. Das Feld usage.output_tokens_details.thinking_tokens gibt an, wie viele abgerechnete Output-Tokens für das Reasoning verwendet wurden:

{
  "usage": {
    "input_tokens": 25,
    "output_tokens": 348,
    "output_tokens_details": {
      "thinking_tokens": 312
    }
  }
}

In diesem Beispiel aus der Thinking-Dokumentation von Anthropic entfielen 312 der 348 abgerechneten Output-Tokens auf Reasoning, das niemand zu sehen bekam. Beim Streamen wird diese Aufschlüsselung erst im abschließenden message_delta-Event übertragen. Ein Client, der nach dem letzten Text-Chunk nicht weiterliest, erfasst sie daher niemals.

Die Steuerung ist effort. Sie wird unter output_config.effort gesetzt und unterstützt die Stufen low, medium, high (der Standardwert), xhigh und max.

{
  "model": "claude-fable-5",
  "max_tokens": 32000,
  "output_config": { "effort": "medium" },
  "messages": [{ "role": "user", "content": "..." }]
}

Anthropic empfiehlt für dieses Modell, mit high zu beginnen. Erhöhen Sie den Wert nur für besonders anspruchsvolle Aufgaben auf xhigh. Für Routineaufgaben können Sie auf medium oder low reduzieren. Der Grund ist, dass ein geringerer Aufwand bei Fable 5 häufig xhigh bei älteren Modellen überlegen ist. Dabei gibt es zwei typische Fehlerquellen. Wenn Sie den Aufwand zwischen Anfragen ändern, wird der Prompt-Cache ungültig, weil der aufgelöste Aufwandswert in den Prompt eingesetzt wird. Wählen Sie daher pro Workload eine Stufe und behalten Sie sie konstant bei. Außerdem ist max_tokens eine harte Obergrenze für die gesamte Ausgabe, einschließlich Thinking und Antworttext. Ein für eine Antwort ohne Thinking bemessenes Limit führt daher zu einer abgeschnittenen Ausgabe. stop_reason: "max_tokens" bedeutet, dass Sie entweder das Limit erhöhen oder den Aufwand reduzieren müssen.

Kosten pro abgeschlossener Aufgabe statt Kosten pro Token

ChartCost of one job in US dollars, worked from published rates and assumed token volumes
The data behind this chart
[
  {
    "label": "Short answer (5k in, 1k out)",
    "fable_5": "0.10",
    "opus_5": "0.05",
    "sonnet_5": "0.02",
    "haiku_4_5": "0.01"
  },
  {
    "label": "Coding session (300k in, 40k out)",
    "fable_5": "5.00",
    "opus_5": "2.50",
    "sonnet_5": "1.00",
    "haiku_4_5": "0.50"
  },
  {
    "label": "Long agent run (2M in, 400k out)",
    "fable_5": "40.00",
    "opus_5": "20.00",
    "sonnet_5": "8.00",
    "haiku_4_5": "4.00"
  }
]

Diese 3 Zeilen sind eine Rechenhilfe, kein Benchmark. Die Preise sind veröffentlicht. Die Tokenmengen sind Annahmen, die Sie durch Werte aus Ihren eigenen Nutzungsdaten ersetzen sollten. Eine Codingsitzung nach dem Muster der mittleren Zeile kostet auf Fable 5 $5.00 gegenüber $1.00 auf Sonnet 5. Der lange Lauf kostet $40.00 gegenüber $8.00. Die Haiku-Spalte in der letzten Zeile ist nur eine Rechenangabe: Haiku 4.5 hat ein Kontextfenster von 200k Token und kann diese Aufgabe daher überhaupt nicht aufnehmen.

Kosten pro Token sind die falsche Einheit für eine Entscheidung. Kosten pro abgeschlossener Aufgabe ergeben sich aus den Kosten pro Versuch multipliziert mit der Anzahl der Versuche. Bei den heutigen Preisen kostet ein Versuch mit Fable 5 genauso viel wie fünf Versuche mit Sonnet 5. Die Anzahl der Wiederholungen allein rechtfertigt daher fast nie den Wechsel. Sonnet müsste in mehr als vier von fünf Fällen fehlschlagen, bevor der günstigere Weg bei den Tokenkosten schlechter abschneidet.

Ausschlaggebend sind dagegen alle Faktoren, die in der Tokenrechnung fehlen. Der Unterschied zwischen den beiden langen Läufen im Diagramm ist in den meisten Märkten kleiner als eine Stunde Arbeitszeit eines Engineers. Wenn das teurere Modell eine Stunde Prüfung einspart oder eine fehlerhafte Migration verhindert, die Sie anschließend rückgängig machen müssten, hat es sich bereits bezahlt gemacht. Diese Einsparung erscheint auf der Rechnung nicht. Vergleichen Sie die Kosten pro akzeptiertem Ergebnis und beziehen Sie Ihre eigene Zeit in die Gesamtsumme ein. Wie viel eine Million Token tatsächlich ermöglicht macht diese Schätzung deutlich weniger abstrakt.

Drei Aufgaben, bei denen sich Claude Fable 5 bezahlt macht

Agentenläufe mit langem Zeithorizont, bei denen ein falscher Abzweig teuer ist. Fable 5 ist für Aufgaben ausgelegt, die in Stunden gemessen werden: ein Kontextfenster mit 1M Tokens, bis zu 128k Ausgabetokens pro Anfrage und eine xhigh-Stufe für Aufgaben mit einer Laufzeit von mehr als dreißig Minuten und Tokenbudgets im Millionenbereich. Vergleichen Sie die Kosten des Laufs mit dem Aufwand für die Bereinigung, nachdem ein Agent in Schritt 40 einen falschen Pfad eingeschlagen hat, den bis Schritt 300 niemand bemerkt.

Eine Migration oder ein Audit, das Sie einmalig für eine große Codebasis ausführen. Bei einmaligen Aufgaben gibt es kein Volumen, über das sich die Kosten verteilen lassen. Der Aufpreis pro Token steht daher auf einer einzelnen Rechnung, und die gesamte Aufgabe passt möglicherweise in ein einziges Kontextfenster. Wenn sie asynchron ausgeführt werden kann, halbiert die Batch API die Kosten auf $25 pro 1M Ausgabetokens.

Die Aufgabe, an der ein günstigeres Modell bereits zweimal gescheitert ist. Zwei fehlgeschlagene Versuche plus Ihre Debugging-Zeit kosten bei den im Diagramm oben gezeigten Volumina mehr als ein Versuch mit Fable. Die Eskalation ist der günstigere Pfad. Dafür ist eine Modellhierarchie vorgesehen. Wenn Sie allgemein noch zwischen den Stufen wählen, beantwortet der Fähigkeitsvergleich zwischen den Claude-Modellstufen eine andere Frage als diese Seite.

Drei Aufgaben, bei denen Sonnet 5 oder Haiku 4.5 die sachlich richtige Wahl ist

Klassifizierung und Extraktion mit hohem Volumen. Diese Aufgaben werden nach Durchsatz und Stückkosten bewertet. Die Qualitätsgrenze ist niedrig genug, dass ein günstiges Modell sie erreicht. Wenn Haiku 4.5 eine Aufgabe für ein Zehntel des Preises korrekt erledigt, bietet Fable 5 keinen messbaren Mehrwert.

Interaktive Arbeit, bei der die Latenz entscheidend ist. In Anthonics Modellübersicht wird die vergleichende Latenz von Fable 5 als höher angegeben. Der Denkmodus kann nicht deaktiviert werden. Ein Chatfeld oder eine Vervollständigung im Editor fühlt sich mit dem leistungsfähigeren Modell schlechter an, weil Nutzer die Wartezeit wahrnehmen, bevor sie die Qualitätssteigerung bemerken.

Alles, was von Ereignissen nach January 2026 abhängt. Der verlässliche Wissensstand von Fable 5 reicht bis January 2026. Bei Opus 5 reicht er bis May 2026. Das teurere Modell ist weniger aktuell. Bei Fragen zur Aktualität zahlen Sie daher doppelt für älteres Wissen, sofern Sie ihm keine Such- oder Abrufwerkzeuge zur Verfügung stellen.

Eine Einschränkung steht vollständig außerhalb der Kostenfrage. Für Fable 5 gilt eine Datenaufbewahrung von 30 Tagen. Zero Data Retention wird nicht unterstützt, weil das Modell als Covered Model eingestuft ist. Wenn Ihre Vereinbarung eine Aufbewahrung von null Tagen verlangt, ist Fable 5 unabhängig vom Preis keine Option. Auch ein Rabatt ändert daran nichts.

Was die fable-method-Repositories zeigen und was nicht

Praktiker haben Repositories veröffentlicht, die Vorgehensweisen von Fable 5 so zusammenfassen, dass ein günstigeres Modell ihnen folgen kann. Das fable-method-Repository beschreibt eine Denkfähigkeit, eine Orchestrierungsschleife und einen adversarialen Verifizierer, der jede behauptete Prüfung erneut ausführt, statt den eigenen Bericht des Agenten zu lesen. In der README steht ausdrücklich: „Dies ist eine Zusammenfassung aus der Community und kein Artefakt von Anthropic.“

Behandeln Sie es genau so. Das Repository zeigt, wie Menschen das Modell steuern, und dokumentiert nicht, wie das Modell funktioniert. Nichts darin wurde von Anthropic validiert. Außerdem gibt es mehrere nahezu identische Forks mit abweichender Formulierung. Das entspricht eher einer überlieferten Praxis als einer Spezifikation.

Für eine Kostenentscheidung ist vor allem relevant, dass die kopierten Bestandteile prozedural sind. Klassifizieren Sie die Aufgabe, benennen Sie die Prüfung, die den Abschluss belegt, sammeln Sie vor der Entscheidung Belege und verifizieren Sie das Ergebnis anschließend durch Beobachtung statt durch das Lesen einer Zusammenfassung. Ein günstigeres Modell schließt einen Teil der Lücke, wenn Sie ihm eine explizite Checkliste und einen Verifizierungsschritt vorgeben. Führen Sie dieses Experiment daher mit Ihrem eigenen Evaluierungssatz durch, bevor Sie sich standardmäßig für das teurere Modell entscheiden. Das Ergebnis hängt von Ihren Aufgaben ab. Deshalb ist die Zahl einer anderen Person für Sie kaum aussagekräftig.

Prüfen Sie Ihre eigenen Zahlen, bevor Sie sich budgetmäßig festlegen

  • Lesen Sie usage bei jeder Antwort und protokollieren Sie output_tokens_details.thinking_tokens getrennt von der sichtbaren Ausgabe. Nicht sichtbare Reasoning-Ausgaben sind der Kostenpunkt, der häufig unerwartet zu Buche schlägt.
  • Setzen Sie effort ausdrücklich, statt den Standardwert zu übernehmen, und lassen Sie den Wert innerhalb einer Unterhaltung konstant, wenn Sie Prompt-Caching verwenden.
  • Legen Sie Ihren stabilen Präfix zuerst hinter einem Cache-Breakpoint ab. Ein Cache-Lesevorgang zum Zehntel des Basistarifs spart mehr als die meisten Modellwechsel auf eine niedrigere Stufe.
  • Verschieben Sie alles, was keine sofortige Antwort benötigt, in die Batch API.
  • Bewerten Sie die Alternative realistisch. Ein Vergleich der Claude- und ChatGPT-API-Preise anhand Ihrer eigenen Arbeitslast ist vor einer langfristigen Festlegung einen Nachmittag wert.

Wenn die Arbeitslast aus einem Agenten besteht, der auf Ihrem eigenen Server ausgeführt wird, liegen die wichtigsten Stellschrauben außerhalb der Modellwahl. Agentenkosten auf einem VPS unter Kontrolle halten behandelt Schleifenlimits und Ausgabenobergrenzen, die eine außer Kontrolle geratene Sitzung stoppen. wo Claude Code tatsächlich Tokens verbraucht erklärt die Zahlen, die Sie in Ihrem Nutzungs-Dashboard sehen.

FAQ

Wie viel kostet Claude Fable 5 pro 1 Million Tokens?

Claude Fable 5 kostet laut der am 3. August 2026 geprüften Preisseite von Anthropic in der Claude API $10 pro 1 Million Input-Tokens und $50 pro 1 Million Output-Tokens. Das Lesen aus dem Cache kostet $1 pro 1 Million Tokens und damit ein Zehntel des regulären Input-Preises. Die Batch API reduziert beide Seiten um 50 %. Damit kostet die asynchrone Verarbeitung $5 beziehungsweise $25 pro 1 Million Tokens. Wenn die Inferenz mit dem Parameter inference_geo innerhalb der Vereinigten Staaten bleibt, gilt für jede Kategorie ein Multiplikator von 1.1.

Ist Claude Fable 5 in einem Claude Pro-Abonnement enthalten?

Auf der Claude-Fable-Seite von Anthropic wird das Modell als für Benutzer von Pro, Max, Team und Enterprise verfügbar aufgeführt. Der kostenlose Tarif wird dort nicht genannt. Der enthaltene Zugriff ist nicht unbegrenzt. Bei einigen Konten ist Fable Bestandteil des wöchentlichen Nutzungslimits. Bei anderen erfolgt der Zugriff über Nutzungsguthaben. Diese Regelung wurde im Juli 2026 mehr als einmal geändert. Lesen Sie am Tag Ihrer Entscheidung die Zeile mit der Bezeichnung Fable in der Tarifvergleichstabelle auf der Preisseite von Anthropic. Verlassen Sie sich nicht auf eine Angabe aus einem Artikel. Sobald das enthaltene Kontingent aufgebraucht ist, wird die weitere Nutzung zum API-Tarif abgerechnet.

Warum ist meine Rechnung für Claude Fable 5 höher, als die sichtbare Ausgabe vermuten lässt?

Adaptives Denken ist bei Claude Fable 5 immer aktiviert. Thinking-Tokens werden als Output-Tokens abgerechnet. Die unverarbeitete Gedankenkette wird nie zurückgegeben. Wenn thinking.display den Standardwert omitted verwendet, sehen Sie ein leeres Thinking-Feld, bezahlen aber trotzdem für jedes darin enthaltene Reasoning-Token. Lesen Sie usage.output_tokens_details.thinking_tokens in der Antwort aus, um die Aufteilung anzuzeigen. Beim Streaming wird dieses Feld erst im abschließenden Ereignis message_delta übertragen. Verringern Sie die Einstellung effort, wenn das Verhältnis zwischen Reasoning und Antwort höher ist, als die Aufgabe erfordert.

Sollte ich Claude Fable 5 oder Claude Opus 5 verwenden?

Claude Opus 5 kostet pro Token halb so viel und hat einen aktuelleren, verlässlicheren Wissensstand. Der Cutoff liegt bei Opus 5 im Mai 2026, bei Fable 5 im Januar 2026. Beginnen Sie mit Opus 5 und wechseln Sie zu Fable 5, wenn die Aufgabe damit fehlschlägt oder eine falsche Antwort mehr kostet als der Preisunterschied. Fable 5 eignet sich für lang laufende Agentenaufgaben, bei denen ein fehlerhafter Pfad stundenlange Nacharbeiten verursacht. Es eignet sich auch für einmalige Aufgaben, bei denen der Aufpreis nur auf einer Rechnung anfällt und nicht dauerhaft bei jeder Anfrage.

#claude#fable#model-selection#pricing#tokens