Claude czy ChatGPT API: co jest tańsze?
Porównanie kosztów API Claude oraz ChatGPT w oparciu o realne scenariusze użycia. Sprawdź, w jakich proporcjach tokenów wejściowych i wyjściowych Claude generuje wyższe rachunki.
Krótka odpowiedź
Porównanie cen API Claude oraz ChatGPT nie wyłania jednoznacznego zwycięzcy, ponieważ obaj dostawcy stosują odmienne stawki za tokeny wejściowe i wyjściowe na każdym poziomie usług. Według stanu na sierpień 2026 r. dwa najwyższe poziomy Claude kosztują tyle samo za token wejściowy co odpowiedniki OpenAI, oferując jednocześnie niższą cenę za token wyjściowy, co czyni Claude nieco bardziej opłacalnym w zadaniach generujących dużą ilość treści. Na najniższym poziomie cenowym Claude jest kilkukrotnie droższy przy tym samym obciążeniu. Każda odpowiedź, która nie wskazuje konkretnego poziomu usług oraz proporcji tokenów, jest jedynie szacunkiem.
Niniejsza strona przedstawia najpierw obliczenia, następnie trzy przykładowe scenariusze obciążenia wraz z proporcjami tokenów, a na końcu mnożniki, które wpływają na ostateczną kwotę faktury w większym stopniu niż stawki podstawowe.
Jedyny wzór, którego potrzebujesz
Oba API rozliczają tekst w ten sam sposób. Płacisz za tokeny wysłane oraz według wyższej stawki za tokeny wygenerowane przez model.
cost = (input tokens / 1,000,000) * input rate + (output tokens / 1,000,000) * output rate
Jeden token to około 4 znaki w języku angielskim, co odpowiada mniej więcej 0,75 słowa. Traktuj tę wartość wyłącznie jako wstępne oszacowanie. Do rzeczywistego rozliczenia należy używać liczników zwracanych przez każde API w obiekcie usage każdej odpowiedzi.
# Rates are US dollars per million tokens.
def cost(in_tok, out_tok, in_rate, out_rate):
return in_tok / 1e6 * in_rate + out_tok / 1e6 * out_rate
# One support-chat turn: 1,400 tokens in, 220 tokens out, on a $2 / $10 model.
print(round(cost(1400, 220, 2.0, 10.0), 6))Skrypt wyświetla 0.005, co stanowi pół centa za turę. Pomnóż tę wartość przez liczbę tur przewidywanych w miesiącu, aby uzyskać budżet. Jeśli jednostka miliona tokenów w mianowniku wydaje się abstrakcyjna, co milion tokenów faktycznie oznacza w Claude przedstawia konkretną ilość tekstu, która się za tym kryje. Opanuj ten jeden wzór, a każda zmiana cen po dzisiejszym dniu będzie wymagała jedynie edycji jednej linii zamiast przeprowadzania nowej analizy.
Opublikowane stawki, sierpień 2026
Są to ceny katalogowe opublikowane przez obu dostawców w dniu 1 sierpnia 2026 roku. Ten blok jest jedynym miejscem w publikacji, w którym podano ceny. Przed zatwierdzeniem budżetu należy zweryfikować je na stronie claude.com/pricing oraz na stronie cennika OpenAI.
The data behind this chart
[
{
"label": "Frontier",
"claude_input": 5,
"claude_output": 25,
"openai_input": 5,
"openai_output": 30
},
{
"label": "Workhorse",
"claude_input": 2,
"claude_output": 10,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Workhorse from September",
"claude_input": 3,
"claude_output": 15,
"openai_input": 2,
"openai_output": 12
},
{
"label": "Small",
"claude_input": 1,
"claude_output": 5,
"openai_input": 0.2,
"openai_output": 1.2
}
]Zestawienia oparto na pozycji w ofercie, a nie na popularności modeli. Kategoria Frontier to Claude Opus 5 kontra gpt-5.6-sol. Kategoria Workhorse to Claude Sonnet 5 kontra gpt-5.6-terra. Kategoria Small to Claude Haiku 4.5 kontra gpt-5.6-luna. Obaj dostawcy oferują również wyższe pakiety niż te wymienione w bloku, a OpenAI utrzymuje starsze generacje w cenniku według ich pierwotnych stawek. Po stronie Claude dostępny jest pakiet Fable 5, wyceniony dwukrotnie wyżej niż kategoria frontier w obu kierunkach, przy zachowaniu tego samego pięciokrotnego stosunku cen wyjściowych, dlatego warto przeczytać ile kosztuje Fable 5 i kiedy obowiązuje ta stawka, zanim założysz, że Opus 5 jest najdroższą pozycją na fakturze. Porównywanie flagowego modelu jednego dostawcy z budżetowym modelem drugiego prowadzi do bezwartościowych wyników, co jest częstą praktyką w publikowanych zestawieniach.
Dwie kwestie z powyższego bloku wymagają wyraźnego podkreślenia. Stawki modelu Sonnet 5 wynoszące 2 oraz 10 są stawkami promocyjnymi. Anthropic wskazuje, że obowiązują one do 31 sierpnia 2026 roku, po czym cena modelu Sonnet 5 wzrośnie do 3 oraz 15. Ta jedna zmiana sprawia, że w kategorii workhorse niewielka przewaga Claude zamienia się w wyraźną przewagę OpenAI, a zmiana ta nastąpi w okresie aktualności niniejszej publikacji.
Druga kwestia to wzorzec, który warto zapamiętać: Claude wycenia dane wyjściowe dokładnie na 5-krotność własnej stawki wejściowej w każdym z powyższych wierszy, podczas gdy OpenAI wycenia je na 6-krotność. To właśnie ten stosunek, a nie stawka bezwzględna, decyduje o tym, który dostawca jest korzystniejszy w zależności od struktury używanych tokenów.
Dlaczego stawka za milion tokenów nie jest porównywalna między dostawcami
Stawka to dolary za token. Rachunek to dolary za token pomnożone przez liczbę tokenów, a liczba tokenów dla danego tekstu jest właściwością modelu, a nie samego tekstu.
Firma Anthropic dokumentuje to bezpośrednio: modele Claude 4.7 i nowsze, w tym Claude Opus 5 oraz Claude Sonnet 5, korzystają z nowszego tokenizatora, który generuje o około 30% więcej tokenów dla tego samego tekstu niż Claude Sonnet 4.6 i wcześniejsze wersje. Stawka nie uległa zmianie. Rachunek – tak.
Zatem dwie stawki wyglądające na identyczne nie oznaczają dwóch identycznych rachunków. Przed zaufaniem jakimkolwiek porównaniom, w tym niniejszemu, należy samodzielnie przeliczyć tokeny po obu stronach, używając własnego tekstu.
curl https://api.anthropic.com/v1/messages/count_tokens \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Summarise the attached contract."}]
}'Prawidłowa odpowiedź to mały obiekt JSON zawierający input_tokens. Kod 401 oznacza, że zmienna klucza jest pusta w powłoce. Należy przepuścić ten sam tekst przez tokenizator drugiego dostawcy, podzielić jeden wynik przez drugi, a następnie pomnożyć ten stosunek przez opublikowaną stawkę przed dokonaniem porównania. Jeśli stosunek ten faworyzuje jednego z dostawców o więcej niż około 1.2, przeważa on nad każdą różnicą w stawkach przedstawioną w powyższym bloku.
Scenariusz pierwszy: funkcja czatu
Asystent wsparcia wewnątrz aplikacji internetowej. 120 000 wymian wiadomości miesięcznie. Każda wymiana przesyła prompt systemowy, schematy narzędzi, dwa pobrane fragmenty z bazy wiedzy oraz kilka wcześniejszych wiadomości, co daje około 1400 tokenów wejściowych, a model odpowiada w około 220 tokenach. Jest to proces interaktywny, więc rabat za przetwarzanie wsadowe nie ma tu zastosowania. Uruchomienie na poziomie wydajnym (workhorse tier).
The data behind this chart
[
{
"label": "List price",
"claude_usd": "600.00",
"openai_usd": "652.80"
},
{
"label": "Cached prefix",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Small tier, cached",
"claude_usd": "213.60",
"openai_usd": "48.00"
}
]Według cennika standardowego Claude kosztuje 600.00, a OpenAI 652.80. Koszty wejściowe są identyczne, ponieważ stawki za wejście są takie same. Cała różnica wynika z kosztów wyjściowych, a przewaga Claude jest zbyt mała, aby decydowała o wyborze dostawcy.
Teraz oznacz 800 z tych 1400 tokenów wejściowych jako stały prefiks: prompt systemowy i schematy narzędzi, które nie zmieniają się między wymianami. Obaj dostawcy pobierają 10% podstawowej stawki wejściowej za trafienie w pamięć podręczną (cache hit). Rachunek za Claude spada do 427.20, a za OpenAI do 480.00. Buforowanie ma większe znaczenie niż wybór dostawcy, a obie platformy je oferują.
W tym miejscu Claude przegrywa. Większość odpowiedzi wsparcia nie wymaga modelu klasy workhorse. Przenieś ten sam ruch na poziom mały (small tier), a Claude będzie kosztować 213.60, podczas gdy OpenAI 48.00. Dzieląc te wartości przez siebie, Claude kosztuje około cztery i pół raza więcej za to samo zadanie. Claude Haiku 4.5 kosztuje 1 za milion tokenów wejściowych w porównaniu do gpt-5.6-luna za 0.2, a żadne buforowanie nie zniweluje pięciokrotnej różnicy. Jeśli obciążenie pozwala na użycie małego modelu, OpenAI jest tańsze, a różnica w kosztach jest znacząca.
Scenariusz drugi: potok przetwarzania długich dokumentów
25 000 umów miesięcznie. Każde żądanie zawiera tę samą instrukcję i schemat JSON o długości 9 000 tokenów, następnie 12 000 tokenów tekstu umowy, a model zwraca około 700 tokenów ustrukturyzowanych pól. Dane wyjściowe stanowią poniżej 4% tokenów w tym zadaniu i ten jeden fakt decyduje o porównaniu.
The data behind this chart
[
{
"label": "Chat feature",
"claude_usd": "427.20",
"openai_usd": "480.00"
},
{
"label": "Document pipeline",
"claude_usd": "820.00",
"openai_usd": "855.00"
},
{
"label": "Coding agent",
"claude_usd": "116.10",
"openai_usd": "124.20"
}
]Przy 9 000 tokenach prefiksu zapisanych w pamięci podręcznej po obu stronach, Claude nalicza 820.00, a OpenAI nalicza 855.00. Koszty danych wejściowych są identyczne co do centa, ponieważ stawki za podstawowe przetwarzanie danych wejściowych w sierpniu 2026 roku są wyrównane. Cała różnica wynika z danych wyjściowych, wycenionych na 5-krotność danych wejściowych w Claude i 6-krotność w OpenAI.
To zadanie można również przetwarzać wsadowo. Obaj dostawcy oferują 50% zniżki na dane wejściowe i wyjściowe w przypadku pracy asynchronicznej, więc obie sumy maleją o połowę, a relacja między nimi pozostaje bez zmian. Przetwarzanie wsadowe to największa pojedyncza zniżka na obu platformach, a nocny potok przetwarzania dokumentów zawsze może z niej skorzystać.
Claude przegrywa z powodu tej samej logiki poziomów, co poprzednio. Ekstrakcja pól według stałego schematu to dokładnie takie zadanie, w którym dobrze sprawdza się mały model, a dane wejściowe stanowią tu 97% tokenów. Przejście o jeden poziom niżej mnoży stawkę wejściową OpenAI przez 0,1, a stawkę wejściową Claude przez 0,5. Przetestuj mały model na 200 dokumentach, zanim założysz, że potrzebujesz większego, używając tej samej ewaluacji, którą przeprowadziłbyś dla wyboru odpowiedniego poziomu Claude dla zadania.
Scenariusz trzeci: agent programistyczny działający w trybie ciągłym
Jeden programista uruchamiający agenta na VPS, około 900 zapytań do modelu miesięcznie. Każde zapytanie zawiera około 60 000 tokenów wejściowych kontekstu repozytorium, z czego 80% stanowi trafienie w pamięć podręczną (cache hit), oraz generuje około 1 800 tokenów edycji i wyjaśnień. Koszt wyceniono w oparciu o najwyższą klasę wydajności (frontier tier), ponieważ w programowaniu różnica w możliwościach modelu przekłada się na realne straty finansowe.
Claude generuje rachunek na kwotę 116.10 w porównaniu do 124.20 w przypadku OpenAI. Przy tym samym tempie wejściowym i tym samym wskaźniku odczytów z pamięci podręcznej, niższa stawka za wyjście w Claude daje przewagę około 7%.
Te 7% mieści się w granicach błędu tokenizatora wspomnianego wcześniej, więc należy traktować ten scenariusz jako remis pod względem stawek. Tym, co nie jest remisem, jest model rozliczeniowy. Dla jednego programisty przy tym wolumenie subskrypcja zazwyczaj kosztuje mniej niż rozliczane licznikowo wywołania API, a całe porównanie zmienia się po uwzględnieniu tego faktu. Należy przeanalizować to zagadnienie korzystając z porównania kosztów API i subskrypcji przed uruchomieniem agenta w modelu rozliczeń licznikowych. Jeśli zdecydujesz się na rozliczanie licznikowe, najpierw sprawdź, na co zużywane są tokeny, ponieważ zużycie tokenów przez agenta programistycznego jest zdominowane przez kontekst przesyłany ponownie w każdym zapytaniu, a nie przez sam kod, który agent tworzy.
Mnożniki decydujące o wysokości rachunku
Stawka podstawowa jest najmniejszym elementem na tej liście. Każdy z poniższych czynników wpływa na rzeczywisty rachunek w stopniu większym niż różnica między dwoma dostawcami w tym samym planie cenowym.
Buforowanie danych wejściowych (Cached input). Obaj dostawcy pobierają 10% stawki podstawowej za trafienie w pamięć podręczną (cache hit). Anthropic nalicza również opłatę za zapis do pamięci podręcznej: 1,25-krotność stawki podstawowej za wpis pięciominutowy oraz 2-krotność za wpis jednogodzinny. Późniejsze trafienie odświeża wpis po cenie odczytu. W rezultacie wpis pięciominutowy zwraca się po jednym odczycie. W przypadku obciążeń z długimi przerwami między żądaniami zapisy występują częściej niż odczyty, przez co buforowanie generuje wyższe koszty niż oszczędności. Stały ruch dobrze współpracuje z pamięcią podręczną. Ruch o charakterze skokowym – nie.
Rabat za przetwarzanie wsadowe (Batch discounts). 50% zniżki na dane wejściowe i wyjściowe u obu dostawców, wyłącznie dla zadań asynchronicznych. Jeśli zadanie może poczekać, pozwala to obniżyć rachunek o połowę u dowolnego dostawcy, a rabat ten łączy się z buforowaniem.
Udział danych wyjściowych (Output share). Claude nalicza opłatę za dane wyjściowe w wysokości 5-krotności stawki za dane wejściowe. OpenAI nalicza 6-krotność. Im większy udział tokenów zapisanych w stosunku do odczytanych, tym korzystniej wypada Claude przy tej samej stawce wejściowej. Odwrotna zależność występuje w przypadku zadań zdominowanych przez dane wejściowe.
Ponowne próby (Retries). Każda ponowna próba oznacza ponowne opłacenie całego wejścia bez uzyskania użytecznego wyniku. Jeśli 6% wywołań nie przechodzi walidacji schematu i jest ponawianych, koszt danych wejściowych jest o 6% wyższy, niż zakładał plan. Należy rejestrować ponowne próby jako pozycję kosztową, a nie jako błąd. Zespoły odkrywają ten mnożnik jako ostatni, a często jest on większy niż różnica cenowa między dostawcami, o którą toczono tygodniowe dyskusje.
Która strona przegrywa i gdzie
Claude całkowicie przegrywa w segmencie niskich kosztów. Model gpt-5.6-luna nalicza 0.2 za milion tokenów wejściowych w porównaniu do 1 dla Claude Haiku 4.5, przy kosztach wyjściowych wynoszących 1.2 wobec 5. Masowa klasyfikacja oraz krótka ekstrakcja danych kosztują w Claude około cztery razy więcej.
Claude przegrywa w segmencie standardowym od 1 września 2026 roku, kiedy kończy się stawka promocyjna, a Sonnet 5 przechodzi na 3 oraz 15 w porównaniu do niezmienionego gpt-5.6-terra. Claude wygrywa w segmencie modeli granicznych pod względem kosztu wyjściowego, jednak różnica ta może zostać zniwelowana przez własną liczbę przetwarzanych tokenów. Żadna ze stron nie zyskuje przewagi w zadaniach zdominowanych przez dane wejściowe w sierpniu 2026 roku, ponieważ przy stawce 2 za milion po obu stronach, koszty wejściowe są identyczne.
Jak samodzielnie mierzyć zużycie w ruchu własnym
Odczytuj obiekt usage w każdej odpowiedzi i zapisuj cztery wartości dla każdego żądania: tokeny wejściowe, tokeny wyjściowe, tokeny odczytane z pamięci podręcznej oraz tokeny zapisane w pamięci podręcznej. W API Claude są one dostępne jako input_tokens, output_tokens, cache_read_input_tokens oraz cache_creation_input_tokens. Sumuj je dziennie, mnoż przez aktualne stawki i porównuj sumę z fakturą. Rozbieżność między tymi wartościami zazwyczaj wynika z ponownych prób (retries) lub ścieżki w kodzie, o której wdrożeniu zapomniano.
Przeprowadzaj porównanie na podstawie tygodniowego rzeczywistego ruchu, a nie na przykładowym zapytaniu. Porównuj koszt wykonania całego zadania, a nie koszt pojedynczego tokena. Model, który odpowiada poprawnie za pierwszym razem przy dwukrotnie wyższej stawce, jest tańszy niż model wymagający trzech prób przy stawce o połowę niższej. Koszt za token to tylko stawka. Koszt wykonania zadania to kwota na fakturze.
Ustaw twardy limit wydatków, zanim uruchomisz jakiekolwiek rozwiązanie. Obie platformy udostępniają limity wydatków w swoich panelach sterowania, a agent zablokowany w pętli ponownych prób może w jedną noc wyczerpać miesięczny budżet. Skonfiguruj to w sposób opisany w kontrola kosztów dla agenta działającego w trybie ciągłym. Jeśli budujesz pierwszą wersję na własnym serwerze, pierwsza aplikacja Claude API na VPS zawiera informacje o obsłudze kluczy oraz pętli żądań, na których opiera się ta kalkulacja.
FAQ
Czy API Claude jest tańsze niż API ChatGPT?
Nie zawsze. W sierpniu 2026 r. poziomy frontier i workhorse mają takie same stawki za token wejściowy u obu dostawców, a Claude pobiera mniej za token wyjściowy, więc w zadaniach generujących dużo tekstu Claude jest o kilka procent tańszy. W przypadku najniższego poziomu, model gpt-5.6-luna od OpenAI kosztuje jedną piątą ceny Claude Haiku 4.5 za token wejściowy, więc klasyfikacja na dużą skalę jest znacznie tańsza w OpenAI. Należy obliczyć własne koszty na podstawie używanego miksu tokenów, ponieważ tak niewielkie różnice zależą od charakteru obciążenia, a nie od cennika.
Dlaczego te same słowa kosztują różną liczbę tokenów w każdym API?
Ponieważ każdy model posiada własny tokenizator, a liczba tokenów jest właściwością modelu. Anthropic podaje, że modele Claude 4.7 i nowsze generują o około 30% więcej tokenów dla tego samego tekstu niż Claude Sonnet 4.6 i starsze. Należy wysłać własny tekst do punktu końcowego zliczania tokenów każdego dostawcy, podzielić jeden wynik przez drugi, a następnie pomnożyć ten współczynnik przez opublikowaną stawkę przed porównaniem. Różnica 20% w liczbie tokenów przeważa nad większością różnic w opublikowanych cennikach.
Czy cache'owanie promptów kiedykolwiek zwiększa rachunek?
Tak, w przypadku Anthropic. Zapis do pamięci podręcznej kosztuje 1,25 raza więcej niż podstawowa stawka wejściowa dla wpisu pięciominutowego i 2 razy więcej dla wpisu godzinnego, podczas gdy trafienie kosztuje 0,1 stawki. Jeśli ruch jest na tyle nieregularny, że większość wpisów wygasa, zanim zostaną odczytane, użytkownik płaci premię za zapis bez korzyści z odczytów. Należy porównać cache_creation_input_tokens z cache_read_input_tokens w dziennikach. Współczynnik bliski 1 oznacza, że cache'owanie generuje koszty, więc należy wydłużyć czas przechowywania wpisu lub z niego zrezygnować.
Czy powinienem uruchamiać agenta programistycznego przez API czy w ramach subskrypcji?
Dla jednego programisty przy standardowym wolumenie subskrypcja zazwyczaj kosztuje mniej niż rozliczanie przez API, ponieważ agent programistyczny przesyła duży kontekst przy każdej iteracji, a za ten kontekst naliczana jest opłata za każdym razem. Najpierw należy monitorować zużycie przez tydzień, a następnie porównać sumę kosztów API z ceną subskrypcji. API jest korzystniejsze przy skokowym obciążeniu lub gdy wymagany jest dostęp programowy, którego subskrypcja nie zapewnia. Jeśli powodem przejścia na API było osiągnięcie limitu użycia, a nie cena, sposoby na obejście limitu użycia Claude obejmują kilka opcji, które kosztują mniej niż przejście na rozliczenie metryczne.