Claude Fable 5: cennik i zastosowanie w API
Model Claude Fable 5 kosztuje 10 USD za milion tokenów wejściowych oraz 50 USD za milion wyjściowych. Sprawdź, jak te stawki przekładają się na realne koszty obsługi zadań w API.
Ile kosztuje Claude Fable 5?
Claude Fable 5 kosztuje $10 za milion tokenów wejściowych oraz $50 za milion tokenów wyjściowych w ramach Claude API. Są to oficjalne stawki publikowane przez Anthropic, odczytane ze strony cennika w dniu 3 sierpnia 2026. Identyfikator modelu w API to claude-fable-5. Model stał się ogólnodostępny 9 czerwca 2026 w usługach Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud oraz Microsoft Foundry.
The data behind this chart
[
{
"label": "Claude Fable 5",
"input": "10",
"output": "50",
"cache_read": "1",
"batch_input": "5",
"batch_output": "25"
},
{
"label": "Claude Opus 5",
"input": "5",
"output": "25",
"cache_read": "0.50",
"batch_input": "2.50",
"batch_output": "12.50"
},
{
"label": "Claude Sonnet 5 (intro rate)",
"input": "2",
"output": "10",
"cache_read": "0.20",
"batch_input": "1",
"batch_output": "5"
},
{
"label": "Claude Sonnet 5 (from 1 Sep)",
"input": "3",
"output": "15",
"cache_read": "0.30",
"batch_input": "1.50",
"batch_output": "7.50"
},
{
"label": "Claude Haiku 4.5",
"input": "1",
"output": "5",
"cache_read": "0.10",
"batch_input": "0.50",
"batch_output": "2.50"
}
]Należy traktować to zestawienie jako hierarchię. Cena Fable 5 jest dwukrotnie wyższa niż Claude Opus 5, pięciokrotnie wyższa niż obecna stawka Claude Sonnet 5 i dziesięciokrotnie wyższa niż Claude Haiku 4.5. Proporcja ta jest stała po obu stronach rozliczenia, ponieważ każdy model w tym zestawieniu wycenia wyjście dokładnie na pięciokrotność stawki wejściowej. Jeśli znany jest podział tokenów na wejściowe i wyjściowe dla danego zadania, jedną cenę można przeliczyć na inną za pomocą mnożnika.
Jedna data zmienia te wyliczenia. Sonnet 5 jest objęty ceną promocyjną w wysokości $2 oraz $10 za milion tokenów do 31 sierpnia 2026. Od 1 września 2026 stawka ta wyniesie $3 oraz $15. Cena Fable 5 pozostaje bez zmian, więc różnica między tymi modelami zmniejszy się tego dnia z pięciokrotności do nieco ponad trzykrotności. Przy planowaniu budżetu na jesień należy uwzględnić późniejsze stawki dla modelu Sonnet.
Rabaty oraz mnożnik zwiększający koszty
Prompt caching stanowi najważniejszy mechanizm optymalizacji. Odczyt z pamięci podręcznej kosztuje jedną dziesiątą podstawowej ceny wejściowej, co dla modelu Fable 5 wynosi $1 za milion tokenów. Zapis do pamięci podręcznej jest droższy niż standardowy token wejściowy: 1,25 raza ceny podstawowej w przypadku pamięci pięciominutowej oraz 2 razy ceny podstawowej dla pamięci jednogodzinnej. Pamięć pięciominutowa zwraca się po jednym odczycie, a jednogodzinna po dwóch. Ta kalkulacja stanowi główny argument za obliczeniem progu opłacalności prompt caching przed włączeniem tej funkcji w całym systemie.
Batch API oferuje 50% zniżki na oba rodzaje tokenów, dzięki czemu przetwarzanie wsadowe w modelu Fable 5 kosztuje $5 oraz $25 za milion tokenów. Żądania wsadowe są asynchroniczne, więc rozwiązanie to sprawdza się tylko w zadaniach, które nie wymagają natychmiastowej odpowiedzi. Oba rabaty łączą się, co sprawia, że zadania korzystające z pamięci podręcznej i przetwarzania wsadowego są tanie w obu kategoriach.
Okno kontekstowe o rozmiarze 1M tokenów jest dostępne w standardowych cenach w modelu Claude 4.6 i nowszych. Nie obowiązuje dopłata za długi kontekst, więc żądanie o rozmiarze 900k tokenów jest rozliczane według tej samej stawki za token, co żądanie o rozmiarze 9k.
Mnożnikiem zwiększającym rachunek jest rezydencja danych. Ustawienie inference_geo: "us" w celu utrzymania wnioskowania wewnątrz Stanów Zjednoczonych nakłada mnożnik 1,1 na każdą kategorię tokenów, w tym na odczyty i zapisy w pamięci podręcznej. Należy pozostawić domyślne routowanie globalne, chyba że umowa wymaga inaczej.
Jedna zasada rozliczeniowa dotyczy wyłącznie tego modelu. Fable 5 zawiera klasyfikatory bezpieczeństwa, które mogą odrzucić żądanie. W takim przypadku Messages API zwraca stop_reason: "refusal" jako udaną odpowiedź HTTP 200 zamiast błędu, a użytkownik nie jest obciążany kosztami za żądanie odrzucone przed wygenerowaniem jakichkolwiek danych wyjściowych. W przypadku ponowienia tego samego promptu w innym modelu Claude, kredyt awaryjny zwraca koszt prompt cache poniesiony przy przełączeniu, dzięki czemu użytkownik nie płaci dwukrotnie za rozgrzanie tej samej pamięci podręcznej.
Które plany obejmują Claude Fable 5?
Według stanu na 3 sierpnia 2026 r. strona Anthropic dotycząca Claude Fable wskazuje, że model jest dostępny dla użytkowników planów Pro, Max, Team oraz Enterprise. Plan darmowy nie został wymieniony. Pro jest najtańszym wariantem na tej liście, dlatego koszt planu Pro i limity jego wykorzystania wyznaczają dolną granicę kosztów subskrypcji umożliwiającej dostęp do Fable. Jeśli dostęp do Fable miałby być głównym powodem przejścia na wyższy plan, warto najpierw przeanalizować czy plan Pro jest opłacalny przy indywidualnym sposobie użytkowania, ponieważ niewielki limit dostępny w ramach Fable sam w sobie nie stanowi wystarczającego uzasadnienia dla subskrypcji. Dla programistów model jest ogólnie dostępny poprzez Claude API oraz wymienione wyżej platformy chmurowe. W tym modelu nie przewidziano darmowego poziomu, więc niewielki kredyt przyznawany przez Anthropic przy rejestracji to jedyne środki dostępne przed rozpoczęciem naliczania opłat.
Dostępność w ramach planu nie oznacza nieograniczonego dostępu. Subskrypcja nie jest też rozliczana tak jak API, ponieważ dla miejsca Pro nie opublikowano żadnego limitu tokenów, a wykorzystanie jest zamiast tego liczone w wiadomościach w ruchomym oknie. Dlatego żadnej pozycji w planie nie można bezpośrednio przeliczyć na podane wyżej wartości za milion jednostek.
Tabela porównawcza planów na stronie cenowej Anthropic uzależnia dostęp do Fable od części tygodniowych limitów wykorzystania w przypadku niektórych miejsc, a w przypadku innych — od kredytów na wykorzystanie. Zasady te zmieniały się więcej niż raz w lipcu 2026. Własny komunikat Anthropic dotyczący ponownego wdrożenia Fable 5 obejmował model w ramach maksymalnie 50% tygodniowych limitów wykorzystania do 7 July 2026 w planach Pro, Max, Team i wybranych planach Enterprise. Po tej dacie obowiązywały kredyty na wykorzystanie. Informacje publikowane przez pozostałą część lipca wskazywały na kolejne przedłużenia oraz podział zależny od typu miejsca.
Niniejsza strona nie podaje limitów dla poszczególnych planów. Żadna wartość opublikowana w tamtym miesiącu nie utrzymała się przez dwa tygodnie, a nieaktualna liczba byłaby bardziej szkodliwa niż jej brak. Należy sprawdzić wiersz oznaczony jako Fable w tabeli porównawczej planów w dniu podejmowania decyzji, traktując wszelkie liczby z artykułów prasowych jako nieaktualne. Jeśli subskrypcja zostanie wykupiona w celu uzyskania dostępu do Fable, a limit okaże się mniejszy, niż wynikało to z tabeli, rezygnacja przed kolejnym odnowieniem pozwala zachować dostęp do końca opłaconego miesiąca.
Stabilną wartością jest stawka API. W każdym przypadku, po wyczerpaniu limitu w ramach planu, dalsze korzystanie z Fable 5 jest rozliczane zgodnie z cenami w powyższej tabeli. W planie Enterprise struktura ta jest wyraźna, ponieważ opłata za stanowisko Enterprise zapewnia dostęp, podczas gdy tokeny są rozliczane według stawek API. To sprawia, że cennik jest kluczowym punktem odniesienia przy planowaniu budżetu, co prowadzi do tych samych wniosków, co porównanie rozliczeń API z subskrypcją dla każdego innego modelu Claude. Jeśli wybór planu jeszcze nie zapadł, warto zacząć od dopasowania planu Claude do własnego sposobu użytkowania. Jeśli dane stanowisko ma służyć jako codzienny asystent, a nie tylko jako sposób na uzyskanie dostępu do Fable, warto sprawdzić porównanie cen planów Claude z ofertą ChatGPT przed podjęciem ostatecznej decyzji.
Dlaczego rachunek jest wyższy, niż wynikałoby to z porównania cen
Dwa udokumentowane mechanizmy sprawiają, że Fable 5 kosztuje więcej, niż sugeruje bezpośrednie porównanie cenników.
Pierwszym z nich jest tokenizator. Fable 5 korzysta z tokenizatora wprowadzonego wraz z Claude Opus 4.7. W porównaniu z modelami wydanymi przed Opus 4.7, ten sam tekst generuje o około 30% więcej tokenów, a dokładny wzrost zależy od treści. Haiku 4.5 korzysta ze starszego tokenizatora, więc dziesięciokrotna różnica w cenniku w praktyce zbliża się do trzynastokrotnej, gdy oba modele przetworzą ten sam blok tekstu. Sonnet 5 używa nowszego tokenizatora, więc porównanie Fable do Sonnet pod kątem kosztu za token jest sprawiedliwe. Porównanie Fable do Haiku – nie.
Drugim mechanizmem jest proces myślowy. Adaptacyjne myślenie jest w Fable 5 zawsze włączone, a thinking: {"type": "disabled"} nie jest wspierane. Tokeny myślowe są rozliczane jako tokeny wyjściowe, według pełnej stawki za wyjście. Surowy ciąg rozumowania nigdy nie jest zwracany w tym modelu, a thinking.display domyślnie przyjmuje wartość "omitted", co oznacza, że krótka widoczna odpowiedź może wiązać się z dużą liczbą rozliczanych tokenów wyjściowych. Dokumentacja Anthropic stwierdza to wprost: liczba rozliczanych tokenów wyjściowych nie odpowiada liczbie tokenów widocznych w odpowiedzi.
Zamiast zgadywać, należy analizować szczegółowe zestawienie. Pole usage.output_tokens_details.thinking_tokens informuje, ile rozliczanych tokenów wyjściowych zostało zużytych na proces rozumowania:
{
"usage": {
"input_tokens": 25,
"output_tokens": 348,
"output_tokens_details": {
"thinking_tokens": 312
}
}
}W tym przykładzie, pochodzącym z dokumentacji Anthropic dotyczącej myślenia, 312 z 348 rozliczanych tokenów wyjściowych stanowiło rozumowanie, którego użytkownik nigdy nie zobaczył. Podczas strumieniowania to zestawienie dociera dopiero w ostatnim zdarzeniu message_delta, więc klient, który przestaje odczytywać dane po ostatnim fragmencie tekstu, nigdy go nie zarejestruje.
Kontrolę zapewnia parametr effort, ustawiany na output_config.effort, z poziomami low, medium, high (domyślny), xhigh oraz max.
{
"model": "claude-fable-5",
"max_tokens": 32000,
"output_config": { "effort": "medium" },
"messages": [{ "role": "user", "content": "..." }]
}Zalecenia Anthropic dla tego modelu sugerują rozpoczęcie od high, przejście na xhigh tylko w przypadku zadań wymagających najwyższych zdolności oraz obniżenie poziomu do medium lub low przy rutynowych pracach, z uwagi na to, że mniejszy wysiłek w Fable 5 często przewyższa xhigh w starszych modelach. Wiążą się z tym dwie pułapki. Zmiana poziomu wysiłku między żądaniami unieważnia prompt cache, ponieważ wartość wysiłku jest renderowana wewnątrz promptu, dlatego należy wybrać jeden poziom dla danego typu obciążenia i utrzymywać go na stałym poziomie. Ponadto max_tokens stanowi twardy limit całkowitej liczby tokenów wyjściowych, obejmujący zarówno proces myślowy, jak i tekst odpowiedzi, więc limit dobrany pod kątem odpowiedzi bez procesu myślowego spowoduje ucięcie treści. Wystąpienie stop_reason: "max_tokens" oznacza konieczność zwiększenia limitu lub obniżenia poziomu wysiłku.
Koszt wykonanego zadania, a nie koszt za token
The data behind this chart
[
{
"label": "Short answer (5k in, 1k out)",
"fable_5": "0.10",
"opus_5": "0.05",
"sonnet_5": "0.02",
"haiku_4_5": "0.01"
},
{
"label": "Coding session (300k in, 40k out)",
"fable_5": "5.00",
"opus_5": "2.50",
"sonnet_5": "1.00",
"haiku_4_5": "0.50"
},
{
"label": "Long agent run (2M in, 400k out)",
"fable_5": "40.00",
"opus_5": "20.00",
"sonnet_5": "8.00",
"haiku_4_5": "4.00"
}
]Wiersze 3 to wynik działań arytmetycznych, a nie benchmark. Stawki są publicznie dostępne. Wolumeny tokenów to założenia, które należy zastąpić wartościami z własnych danych o użyciu. Sesja programistyczna o charakterystyce środkowego wiersza kosztuje $5.00 przy użyciu Fable 5 w porównaniu do $1.00 przy użyciu Sonnet 5. Długotrwałe zadanie kosztuje $40.00 w porównaniu do $8.00. Kolumna Haiku w ostatnim wierszu to tylko wynik arytmetyczny: Haiku 4.5 posiada okno kontekstowe o rozmiarze 200k tokenów, więc nie jest w stanie obsłużyć tego zadania.
Koszt za token jest niewłaściwą jednostką przy podejmowaniu decyzji. Koszt wykonanego zadania to koszt jednej próby pomnożony przez liczbę prób. Przy obecnych stawkach jedna próba Fable 5 kosztuje tyle samo, co pięć prób Sonnet 5, więc sama liczba ponownych prób niemal nigdy nie uzasadnia aktualizacji modelu. Sonnet musiałby zawieść częściej niż cztery razy na pięć, aby tańsza ścieżka stała się nieopłacalna pod kątem zużycia tokenów.
Uzasadnieniem są czynniki, których rachunek za tokeny nie uwzględnia. Różnica między dwoma długotrwałymi zadaniami w tabeli jest mniejsza niż koszt jednej godziny pracy inżyniera na większości rynków. Jeśli droższy model pozwoli zaoszczędzić godzinę przeglądu kodu lub uniknąć jednej błędnej migracji, którą trzeba byłoby wycofywać, koszt modelu zwraca się w ramach wydatku, który nigdy nie wykaże tych oszczędności. Porównanie należy przeprowadzać w oparciu o pieniądze za zaakceptowany wynik, uwzględniając własny czas w całkowitym rozrachunku. Zrozumienie, co faktycznie kupuje milion tokenów sprawia, że szacunki te stają się znacznie mniej abstrakcyjne.
Trzy zastosowania, w których Claude Fable 5 uzasadnia swoją cenę
Długotrwałe zadania agentowe, w których błędna decyzja generuje wysokie koszty. Fable 5 zaprojektowano do pracy mierzonej w godzinach: okno kontekstowe o rozmiarze 1M tokenów, do 128k tokenów wyjściowych na żądanie oraz poziom wysiłku xhigh ukierunkowany na zadania trwające ponad trzydzieści minut, wymagające budżetów liczonych w milionach tokenów. Należy zestawić koszt uruchomienia z kosztami naprawy błędów, jeśli agent obierze niewłaściwą ścieżkę w kroku 40, a zostanie to zauważone dopiero w kroku 300.
Migracja lub audyt wykonywany jednorazowo w dużej bazie kodu. Praca jednorazowa nie pozwala na rozłożenie kosztów w czasie, więc wyższa cena za token obciąża jedną fakturę, a całe zadanie może zmieścić się w jednym oknie kontekstowym. Jeśli zadanie może być wykonywane asynchronicznie, Batch API obniża koszt o połowę do poziomu $25 za milion tokenów wyjściowych.
Zadanie, z którym tańszy model nie poradził sobie dwukrotnie. Dwie nieudane próby oraz czas poświęcony na debugowanie kosztują więcej niż jedna próba z użyciem Fable przy wolumenach wskazanych w powyższej tabeli. Eskalacja jest tańszym rozwiązaniem i właśnie do tego służy gradacja modeli. Jeśli nadal wybierasz między poszczególnymi poziomami, porównanie możliwości modeli Claude odpowiada na inne pytanie niż ta strona.
Trzy zastosowania, w których Sonnet 5 lub Haiku 4.5 są właściwym wyborem
Masowa klasyfikacja i ekstrakcja danych. Zadania te ocenia się pod kątem przepustowości oraz kosztu jednostkowego, a próg jakości jest na tyle niski, że tani model go osiąga. Przy dziesięciokrotnie wyższej cenie za zadanie, które Haiku 4.5 wykonuje poprawnie, Fable 5 nie oferuje żadnej mierzalnej korzyści.
Praca interaktywna, w której opóźnienie jest kluczowym parametrem produktu. Tabela modeli Anthropic wskazuje, że Fable 5 charakteryzuje się większym opóźnieniem, a procesu myślowego nie można wyłączyć. Okno czatu lub autouzupełnianie w edytorze działają gorzej w przypadku bardziej zaawansowanego modelu, ponieważ użytkownicy rejestrują czas oczekiwania szybciej niż różnicę w jakości.
Wszelkie zadania zależne od zdarzeń po styczniu 2026 roku. Wiarygodna data odcięcia wiedzy dla Fable 5 to styczeń 2026 roku. Dla Opus 5 jest to maj 2026 roku. Droższy model posiada mniej aktualne dane, więc w pytaniach o bieżące wydarzenia płaci się dwukrotnie więcej za starszą wiedzę, chyba że udostępni się modelowi narzędzia do wyszukiwania lub pobierania informacji.
Jedno ograniczenie jest całkowicie niezależne od kosztów. Fable 5 objęty jest 30-dniowym okresem przechowywania danych i nie jest dostępny w trybie zerowej retencji, ponieważ został sklasyfikowany jako Covered Model. Jeśli umowa wymaga zerowej retencji, Fable 5 nie jest opcją niezależnie od ceny i żadne rabaty tego nie zmienią.
Co pokazują repozytoria metody fable, a czego nie pokazują
Praktycy opublikowali repozytoria, które przekładają sposób działania Fable 5 na umiejętności, które może wykorzystać tańszy model. Repozytorium fable-method opisuje umiejętność myślenia, pętlę orkiestracji oraz weryfikator kontradyktoryjny, który ponownie wykonuje każde zadeklarowane sprawdzenie, zamiast polegać na raporcie agenta. Plik README stwierdza to wprost: „Jest to destylacja społecznościowa, a nie artefakt firmy Anthropic”.
Należy traktować to dokładnie w ten sposób. Jest to dowód na to, w jaki sposób ludzie sterują modelem, a nie dokumentacja techniczna jego działania. Żaden element tych repozytoriów nie został zweryfikowany przez Anthropic. Istnieje kilka niemal identycznych forów z różnym sformułowaniami, co jest typowe dla wiedzy przekazywanej nieoficjalnie, a nie dla specyfikacji technicznej.
Wartościową informacją przy podejmowaniu decyzji o kosztach jest to, że elementy uznane przez użytkowników za warte skopiowania mają charakter proceduralny. Należy sklasyfikować zadanie, nazwać sprawdzenie potwierdzające jego wykonanie, zgromadzić dowody przed podjęciem decyzji, a następnie zweryfikować wynik poprzez obserwację, zamiast czytać podsumowanie. Tańszy model, któremu dostarczono szczegółową listę kontrolną i krok weryfikacyjny, częściowo niweluje różnicę w wydajności. Warto przeprowadzić taki eksperyment na własnym zestawie ewaluacyjnym przed podjęciem decyzji o standaryzacji na droższym modelu. Wynik zależy od specyfiki zadań, dlatego cudze wyniki nie mają dla użytkownika dużej wartości.
Sprawdź własne liczby przed zatwierdzeniem budżetu
- Czytaj
usageprzy każdej odpowiedzi i logujoutput_tokens_details.thinking_tokensoddzielnie od widocznego wyjścia. Rozumowanie, którego nie widzisz, jest pozycją kosztową, która zaskakuje użytkowników. - Ustawiaj
effortjawnie zamiast akceptować wartość domyślną i utrzymuj ją na stałym poziomie w każdej konwersacji, która opiera się na cache'owaniu promptów. - Umieść stały prefiks za punktem przerwania cache'u. Odczyt z cache'u przy jednej dziesiątej ceny bazowej wejścia przynosi większe oszczędności niż większość zmian modelu na słabszy.
- Przenieś wszystko, co nie wymaga natychmiastowej odpowiedzi, do Batch API.
- Uczciwie wyceniaj alternatywy. Porównanie cenników API Claude i ChatGPT dla własnego obciążenia jest warte popołudnia pracy przed podjęciem długoterminowego zobowiązania.
Jeśli obciążenie stanowi agent działający na własnym serwerze, kontrolki o największym znaczeniu znajdują się poza wyborem modelu. Kontrola kosztów agenta na VPS omawia limity pętli i limity wydatków, które zatrzymują niekontrolowaną sesję, a gdzie Claude Code faktycznie zużywa tokeny wyjaśnia liczby, które zobaczysz w swoim panelu użycia.
FAQ
Ile kosztuje Claude Fable 5 za milion tokenów?
Model Claude Fable 5 kosztuje $10 za milion tokenów wejściowych oraz $50 za milion tokenów wyjściowych w API Claude, według danych ze strony cennika Anthropic z dnia 3 sierpnia 2026. Odczyt z pamięci podręcznej (cache read) kosztuje $1 za milion tokenów, co stanowi jedną dziesiątą podstawowej stawki wejściowej. Batch API oferuje 50% zniżki na obie strony, co daje odpowiednio $5 oraz $25 za milion tokenów w przypadku zadań asynchronicznych. Utrzymywanie wnioskowania na terenie Stanów Zjednoczonych przy użyciu parametru inference_geo nakłada mnożnik 1,1 na każdą kategorię.
Czy Claude Fable 5 jest zawarty w subskrypcji Claude Pro?
Strona Claude Fable firmy Anthropic wskazuje, że model jest dostępny dla użytkowników planów Pro, Max, Team oraz Enterprise; plan darmowy nie został wymieniony. Dostęp w ramach subskrypcji nie jest nieograniczony. W niektórych przypadkach dostęp do Fable jest częścią tygodniowych limitów użycia, a w innych opiera się na kredytach; zasady te zmieniały się kilkukrotnie w lipcu 2026. Należy sprawdzić wiersz oznaczony jako Fable w tabeli porównawczej planów na stronie cennika Anthropic w dniu podejmowania decyzji, zamiast polegać na danych z artykułów. Po wyczerpaniu dostępnego limitu, dalsze użycie jest rozliczane według stawek API.
Dlaczego mój rachunek za Claude Fable 5 jest wyższy, niż sugeruje widoczny wynik?
Funkcja adaptive thinking jest zawsze aktywna w Claude Fable 5. Tokeny procesu myślowego są rozliczane jako tokeny wyjściowe, a surowy ciąg rozumowania nigdy nie jest zwracany. Przy domyślnej wartości thinking.display wynoszącej omitted, pole myślowe pozostaje puste, mimo opłacania każdego wygenerowanego tokena rozumowania. Należy sprawdzić usage.output_tokens_details.thinking_tokens w odpowiedzi, aby zobaczyć podział; w przypadku strumieniowania dane te pojawiają się dopiero w ostatnim zdarzeniu message_delta. Należy obniżyć poziom effort, jeśli stosunek rozumowania do odpowiedzi jest wyższy, niż wymaga tego zadanie.
Czy powinienem używać Claude Fable 5 czy Claude Opus 5?
Claude Opus 5 kosztuje połowę stawki za token i posiada nowszą datę odcięcia wiedzy: maj 2026 w porównaniu do stycznia 2026 dla Fable 5. Zaleca się rozpoczęcie pracy od Opus 5 i przejście na wyższy model, gdy zadanie tam zawiedzie lub gdy koszt błędnej odpowiedzi przewyższy różnicę w cenie. Fable 5 jest właściwym wyborem do długotrwałych zadań agentowych, gdzie jedna błędna ścieżka generuje godziny pracy przy poprawkach, oraz do jednorazowych zadań, których wyższy koszt obciąża jedną fakturę, zamiast zwiększać koszt każdego zapytania na stałe.