OpenAI vs Claude API: ceny modeli i koszt 10 000 zadań
Aktualne stawki modeli OpenAI i Anthropic, wspólny przykład obliczeniowy oraz koszty cache, ponowień i kontroli wyników.
Syntalith
Koszt API policzysz z liczby rozliczanych tokenów i stawek modelu. Koszt użytecznego wyniku zależy dodatkowo od liczby prób, narzędzi oraz pracy przy poprawkach. Te dwie wartości warto mieć obok siebie przed wyborem dostawcy.
Poniższe stawki sprawdziliśmy 30 września 2026 w oficjalnych cennikach. Obliczenia dotyczą bezpośredniego API dostawców, standardowego przetwarzania tekstu i krótkiego kontekstu. Kwoty podajemy w USD, przed podatkami. Oferty chmurowych pośredników, przetwarzanie regionalne i inne tryby mogą mieć inne ceny.
Ceny za milion tokenów
Token to jednostka, na którą model dzieli tekst. Wejście obejmuje m.in. instrukcje, pytanie, historię i dostarczone materiały. Wyjście obejmuje rozliczane tokeny generowania, zgodnie z zasadami danego modelu. To nie jest stała liczba słów ani stron.
| Model | Wejście bez cache, za 1 mln | Wyjście, za 1 mln |
|---|---|---|
| OpenAI GPT-6 Luna | 0,10 USD | 0,50 USD |
| OpenAI GPT-6.1 Sol | 2 USD | 10 USD |
| OpenAI GPT-6 Astra | 10 USD | 50 USD |
| Claude Haiku 4.5 | 1 USD | 5 USD |
| Claude Sonnet 5.5 | 2 USD | 10 USD |
| Claude Opus 5.5 | 4 USD | 20 USD |
| Claude Fable 5.1 | 10 USD | 50 USD |
Źródła: OpenAI API pricing i Anthropic API pricing. Tabela porównuje stawki. Nie ustala kolejności jakości ani szybkości modeli. Długi kontekst, cache, tryb Batch i dodatkowe narzędzia wymagają sprawdzenia odpowiednich pozycji cennika.
Ten sam przykład: 10 000 wywołań miesięcznie
Przyjmijmy klasyfikację i przygotowanie krótkiego wyniku: jedno wywołanie ma 2 000 tokenów wejścia oraz 500 rozliczanych tokenów wyjścia. Każde z 10 000 zadań wymaga jednej próby. Miesięcznie daje to 20 mln wejścia i 5 mln wyjścia.
Koszt = 20 × stawka wejścia + 5 × stawka wyjścia.
| Model | Wejście | Wyjście | Razem za miesiąc |
|---|---|---|---|
| GPT-6 Luna | 2 USD | 2,50 USD | 4,50 USD |
| GPT-6.1 Sol | 40 USD | 50 USD | 90 USD |
| GPT-6 Astra | 200 USD | 250 USD | 450 USD |
| Claude Haiku 4.5 | 20 USD | 25 USD | 45 USD |
| Claude Sonnet 5.5 | 40 USD | 50 USD | 90 USD |
| Claude Opus 5.5 | 80 USD | 100 USD | 180 USD |
| Claude Fable 5.1 | 200 USD | 250 USD | 450 USD |
To model obliczeniowy przy identycznym założonym zużyciu. Ten sam dokument może mieć różną liczbę tokenów u różnych dostawców, a odpowiedzi mogą różnić się długością. W pilotażu zastąp założenia rzeczywistymi licznikami zużycia. Obliczenia nie uwzględniają narzędzi, przechowywania, ponowień ani kontroli człowieka.
Co zmienia rachunek
Najłatwiej przeoczyć rosnącą historię. Jeśli przy każdym kolejnym kroku wysyłasz całą rozmowę i dokumenty, ponownie płacisz za wejście zgodnie z zasadami rozliczenia i cache. Jedno zgłoszenie obsługiwane przez agenta może składać się z wielu takich kroków.
Cache może obniżyć koszt wielokrotnie używanego kontekstu, ale wymaga spełnienia warunków dostawcy. Zapis, odczyt i czas przechowywania mogą mieć odrębne stawki. Nie stosuj stawki odczytu cache do całego ruchu bez pomiaru trafień.
Batch może być korzystny dla zadań bez potrzeby natychmiastowej odpowiedzi. Wybór trzeba połączyć z czasem oczekiwania dopuszczalnym w procesie. Osobno policz płatne wyszukiwanie, przechowywanie plików, inne narzędzia oraz infrastrukturę aplikacji.
Tani model i droższa ścieżka dla trudnych spraw
Można zacząć od tańszego modelu, a określone przypadki przekazywać do mocniejszego. Warunkiem jest wiarygodny sposób rozpoznania niepoprawnego lub niepełnego wyniku. Sama pewność wyrażona przez model nie wystarcza.
Jeżeli pierwsza próba kosztuje 0,004 USD, a druga 0,02 USD, sprawa przekazana dalej kosztuje 0,024 USD za oba wywołania. To ilustracyjne stawki do pokazania rachunku. Oszczędność zależy od udziału takich spraw oraz jakości reguły przekazania. Sprawdź również przypadki, które powinny trafić dalej, a zostały błędnie zaakceptowane.
Dlaczego koszt kontroli może przesądzić o wyborze
Scenariusz: z 10 000 spraw 20% wymaga trzech minut sprawdzenia. To 10 000 × 20% × 3 / 60 = 100 godzin. Przy założonym koszcie pracy 100 zł za godzinę kontrola kosztuje 10 000 zł miesięcznie. Tę stawkę należy zastąpić własnym kosztem; do sumowania z USD potrzebny jest jawny kurs.
Jeśli inny model zmniejsza liczbę poprawek, może uzasadniać wyższą cenę tokenów. Trzeba to zmierzyć. Zbieraj koszt wszystkich prób, czas kontroli i liczbę zaakceptowanych spraw:
Koszt zaakceptowanej sprawy = (API + narzędzia + kontrola + poprawki) / liczba zaakceptowanych spraw.
Koszt budowy, hostingu i utrzymania dodaj do pełnego budżetu procesu. Odrzucone próby również zużywają pieniądze i powinny pozostać w liczniku.
Jak wybrać model do wdrożenia
Przetestuj wybrane modele na tym samym zestawie typowych spraw i wyjątków. Ustal kryteria poprawności przed oceną, zapisz wersję modelu oraz ustawienia. Zmierz czas odpowiedzi, koszt i pracę przy korektach. Następnie sprawdź wynik na nowej partii danych.
Stawki tokenów służą do wstępnego oszacowania. Decyzję o uruchomieniu oprzyj na jakości i koszcie przyjętej pracy. Plan porównania gotowych produktów znajdziesz w poradniku Claude czy ChatGPT dla firmy, a zakres budowy w wdrożeniu OpenAI API.
Syntalith wdraża rozwiązania OpenAI i Claude. Audyt procesu zaczyna się od 2 495 zł netto; cenę i zasady zaliczenia audytu na poczet budowy opisuje cennik. Porozmawiajmy o Twoim wolumenie i sposobie oceny wyników.
Syntalith ma status OpenAI Select Partner w OpenAI Partner Network.
Pomagamy szybciej odpowiadać klientom i znajdować informacje w firmowych dokumentach. Dobieramy i wdrażamy narzędzia AI, a Twój zespół uczymy z nich korzystać.
Jak wdrożyć ChatGPT i OpenAI w firmieBezpłatny skan procesów
Zacznij od bezpłatnego skanu procesów.
- 30 minut z inżynierem, który może prowadzić Twoje wdrożenie.
- Przegląd procesów, które kosztują Cię najwięcej czasu i pieniędzy.
- Pisemne podsumowanie: możliwy kierunek, brakujące informacje i następny krok.
W 30 minut wybieramy proces do oceny, a w ciągu 2 dni roboczych dostajesz rekomendację, także gdy lepsza będzie prostsza droga.
0 zł
30 minut · pisemne podsumowanie w 2 dni robocze
Terminy zobaczysz w swojej strefie czasowej.
Wolisz napisać? Opisz proces