Przejdź do treści
← Wróć do bloga
OpenAIArtykuł

OpenAI vs Claude API: ceny modeli i koszt 10 000 zadań

Aktualne stawki modeli OpenAI i Anthropic, wspólny przykład obliczeniowy oraz koszty cache, ponowień i kontroli wyników.

Autor

Syntalith

Opublikowano Zaktualizowano 3 min czytania

Koszt API policzysz z liczby rozliczanych tokenów i stawek modelu. Koszt użytecznego wyniku zależy dodatkowo od liczby prób, narzędzi oraz pracy przy poprawkach. Te dwie wartości warto mieć obok siebie przed wyborem dostawcy.

Poniższe stawki sprawdziliśmy 30 września 2026 w oficjalnych cennikach. Obliczenia dotyczą bezpośredniego API dostawców, standardowego przetwarzania tekstu i krótkiego kontekstu. Kwoty podajemy w USD, przed podatkami. Oferty chmurowych pośredników, przetwarzanie regionalne i inne tryby mogą mieć inne ceny.

Ceny za milion tokenów

Token to jednostka, na którą model dzieli tekst. Wejście obejmuje m.in. instrukcje, pytanie, historię i dostarczone materiały. Wyjście obejmuje rozliczane tokeny generowania, zgodnie z zasadami danego modelu. To nie jest stała liczba słów ani stron.

ModelWejście bez cache, za 1 mlnWyjście, za 1 mln
OpenAI GPT-6 Luna0,10 USD0,50 USD
OpenAI GPT-6.1 Sol2 USD10 USD
OpenAI GPT-6 Astra10 USD50 USD
Claude Haiku 4.51 USD5 USD
Claude Sonnet 5.52 USD10 USD
Claude Opus 5.54 USD20 USD
Claude Fable 5.110 USD50 USD

Źródła: OpenAI API pricing i Anthropic API pricing. Tabela porównuje stawki. Nie ustala kolejności jakości ani szybkości modeli. Długi kontekst, cache, tryb Batch i dodatkowe narzędzia wymagają sprawdzenia odpowiednich pozycji cennika.

Ten sam przykład: 10 000 wywołań miesięcznie

Przyjmijmy klasyfikację i przygotowanie krótkiego wyniku: jedno wywołanie ma 2 000 tokenów wejścia oraz 500 rozliczanych tokenów wyjścia. Każde z 10 000 zadań wymaga jednej próby. Miesięcznie daje to 20 mln wejścia i 5 mln wyjścia.

Koszt = 20 × stawka wejścia + 5 × stawka wyjścia.

ModelWejścieWyjścieRazem za miesiąc
GPT-6 Luna2 USD2,50 USD4,50 USD
GPT-6.1 Sol40 USD50 USD90 USD
GPT-6 Astra200 USD250 USD450 USD
Claude Haiku 4.520 USD25 USD45 USD
Claude Sonnet 5.540 USD50 USD90 USD
Claude Opus 5.580 USD100 USD180 USD
Claude Fable 5.1200 USD250 USD450 USD

To model obliczeniowy przy identycznym założonym zużyciu. Ten sam dokument może mieć różną liczbę tokenów u różnych dostawców, a odpowiedzi mogą różnić się długością. W pilotażu zastąp założenia rzeczywistymi licznikami zużycia. Obliczenia nie uwzględniają narzędzi, przechowywania, ponowień ani kontroli człowieka.

Co zmienia rachunek

Najłatwiej przeoczyć rosnącą historię. Jeśli przy każdym kolejnym kroku wysyłasz całą rozmowę i dokumenty, ponownie płacisz za wejście zgodnie z zasadami rozliczenia i cache. Jedno zgłoszenie obsługiwane przez agenta może składać się z wielu takich kroków.

Cache może obniżyć koszt wielokrotnie używanego kontekstu, ale wymaga spełnienia warunków dostawcy. Zapis, odczyt i czas przechowywania mogą mieć odrębne stawki. Nie stosuj stawki odczytu cache do całego ruchu bez pomiaru trafień.

Batch może być korzystny dla zadań bez potrzeby natychmiastowej odpowiedzi. Wybór trzeba połączyć z czasem oczekiwania dopuszczalnym w procesie. Osobno policz płatne wyszukiwanie, przechowywanie plików, inne narzędzia oraz infrastrukturę aplikacji.

Tani model i droższa ścieżka dla trudnych spraw

Można zacząć od tańszego modelu, a określone przypadki przekazywać do mocniejszego. Warunkiem jest wiarygodny sposób rozpoznania niepoprawnego lub niepełnego wyniku. Sama pewność wyrażona przez model nie wystarcza.

Jeżeli pierwsza próba kosztuje 0,004 USD, a druga 0,02 USD, sprawa przekazana dalej kosztuje 0,024 USD za oba wywołania. To ilustracyjne stawki do pokazania rachunku. Oszczędność zależy od udziału takich spraw oraz jakości reguły przekazania. Sprawdź również przypadki, które powinny trafić dalej, a zostały błędnie zaakceptowane.

Dlaczego koszt kontroli może przesądzić o wyborze

Scenariusz: z 10 000 spraw 20% wymaga trzech minut sprawdzenia. To 10 000 × 20% × 3 / 60 = 100 godzin. Przy założonym koszcie pracy 100 zł za godzinę kontrola kosztuje 10 000 zł miesięcznie. Tę stawkę należy zastąpić własnym kosztem; do sumowania z USD potrzebny jest jawny kurs.

Jeśli inny model zmniejsza liczbę poprawek, może uzasadniać wyższą cenę tokenów. Trzeba to zmierzyć. Zbieraj koszt wszystkich prób, czas kontroli i liczbę zaakceptowanych spraw:

Koszt zaakceptowanej sprawy = (API + narzędzia + kontrola + poprawki) / liczba zaakceptowanych spraw.

Koszt budowy, hostingu i utrzymania dodaj do pełnego budżetu procesu. Odrzucone próby również zużywają pieniądze i powinny pozostać w liczniku.

Jak wybrać model do wdrożenia

Przetestuj wybrane modele na tym samym zestawie typowych spraw i wyjątków. Ustal kryteria poprawności przed oceną, zapisz wersję modelu oraz ustawienia. Zmierz czas odpowiedzi, koszt i pracę przy korektach. Następnie sprawdź wynik na nowej partii danych.

Stawki tokenów służą do wstępnego oszacowania. Decyzję o uruchomieniu oprzyj na jakości i koszcie przyjętej pracy. Plan porównania gotowych produktów znajdziesz w poradniku Claude czy ChatGPT dla firmy, a zakres budowy w wdrożeniu OpenAI API.

Syntalith wdraża rozwiązania OpenAI i Claude. Audyt procesu zaczyna się od 2 495 zł netto; cenę i zasady zaliczenia audytu na poczet budowy opisuje cennik. Porozmawiajmy o Twoim wolumenie i sposobie oceny wyników.

OpenAI Select Partner

Syntalith ma status OpenAI Select Partner w OpenAI Partner Network.

Pomagamy szybciej odpowiadać klientom i znajdować informacje w firmowych dokumentach. Dobieramy i wdrażamy narzędzia AI, a Twój zespół uczymy z nich korzystać.

Jak wdrożyć ChatGPT i OpenAI w firmie
Syntalith jest członkiem Claude Partner Network, programu partnerskiego Anthropic.

Oznacza udział w programie partnerskim Anthropic dla Claude. Nie jest poparciem usług Syntalith przez Anthropic.

Bezpłatny skan procesów

Zacznij od bezpłatnego skanu procesów.

  • 30 minut z inżynierem, który może prowadzić Twoje wdrożenie.
  • Przegląd procesów, które kosztują Cię najwięcej czasu i pieniędzy.
  • Pisemne podsumowanie: możliwy kierunek, brakujące informacje i następny krok.

W 30 minut wybieramy proces do oceny, a w ciągu 2 dni roboczych dostajesz rekomendację, także gdy lepsza będzie prostsza droga.

0 zł

30 minut · pisemne podsumowanie w 2 dni robocze