Claude Haiku 5.5: 0,10 dol. za milion tokenów i kilka haczyków
Przejdź do treści i przykładów
Źródło: Link
Źródło: Link
Anthropic dołożył Claude Haiku 5.5 do rodziny Claude 5.5, co opisał Spider's Web 8 października 2026. Przy promptach do 100 tys. tokenów model kosztuje 0,10 dol. za milion tokenów wejściowych i 0,50 dol. za milion tokenów odpowiedzi. To dziesięć razy mniej niż w Haiku 4.5. Są to deklaracje z cennika, a niezależnych testów jakości źródło nie podaje.
Token to kawałek tekstu, na jakie model dzieli słowa. Rachunek za API liczy się właśnie w nich. Haiku 5.5 to trzeci model rodziny 5.5, obok Opusa 5.5 i Sonneta 5.5. Haiku 4.5 kosztował 1 dol. za milion tokenów wejścia i 5 dol. za milion wyjścia. Nowy model ma więc stawki 0,10 i 0,50 dol. w najczęściej używanym przedziale długości kontekstu.
Sam Anthropic jest ostrożniejszy od nagłówków. Firma podaje, że przeciętny koszt uruchamiania Haiku 5.5 jest około 75 proc. niższy niż Haiku 4.5. Uwzględnia przy tym różne długości zapytań i zmiany w tokenizacji, czyli w sposobie dzielenia tekstu na tokeny. Dziesięciokrotnie niższa stawka za token nie oznacza więc dziesięciokrotnie niższej faktury w każdym wdrożeniu. Policz to na własnych danych, nie na slajdzie z premiery.
Anthropic nie sprzedaje Haiku jako mózgu do każdego zadania. Model ma pracować tam, gdzie liczą się szybkość, niski koszt i duża liczba operacji. Firma nazywa go swoim najszybszym modelem w standardowym trybie pracy. Jako zastosowania wymienia:
Haiku 5.5 nie zastępuje starszych braci. Opus 5.5 zostaje do najtrudniejszych problemów, które wymagają długiego rozumowania i wysokiej jakości, a Sonnet 5.5 zajmuje środek oferty. Dla agentów AI to sensowny podział pracy: trudny problem trafia do Opusa, a dziesiątki prostych czynności pobocznych wykonują tańsze instancje Haiku. Płacenie za najmocniejszy model przy rozpoznawaniu kategorii e-maila to wynajmowanie auta wyścigowego do dojazdu po zakupy.
Wcześniejszy eksperyment Anthropic na symulowanym rynku pokazał, że Opus negocjował znacznie skuteczniej niż Haiku 4.5. To dane o poprzedniej generacji. Jak Haiku 5.5 radzi sobie z trudniejszymi zadaniami, źródło nie mówi, a wyników benchmarków nie podaje (brak danych). Do czasu niezależnych testów traktuj jakość nowego modelu jako niesprawdzoną. Cenę znasz już dokładnie.
Przy premierze Haiku Anthropic obniżył o połowę cenę odczytu z pamięci podręcznej (cache) w Sonnecie 5.5: z 0,20 do 0,10 dol. za milion tokenów. Cache pozwala nie przesyłać i nie przetwarzać od nowa tych samych fragmentów kontekstu przy kolejnych zapytaniach. Ma to znaczenie w długich zadaniach agentowych, w których model wraca do tych samych instrukcji, dokumentów czy historii działań.
Według Anthropic typowe zadania agentowe na Sonnecie 5.5 mogą dzięki temu kosztować około 20 proc. mniej. To zmiana tylko jednej pozycji cennika. Podstawowych stawek Sonneta 5.5 źródło nie podaje (brak danych), więc nie porównasz jego całkowitych kosztów z Haiku.
Konkurencja też schodzi z cenami. Według naszej karty cen, stan na 23.09.2026, GPT-6 Luna od OpenAI kosztuje 0,1 i 0,5 dol. za milion tokenów wejścia i wyjścia. Podstawowa stawka Haiku 5.5 jest więc taka sama. To porównanie samych cenników, bo o jakości obu modeli nic nie wiemy. O cięciach po stronie OpenAI pisaliśmy przy okazji GPT-6 Sol i Luna, a o obniżkach u Anthropic przy Claude Opus 5.5. Z kolei DeepSeek-V4.1-Flash atakuje koszty długiego kontekstu od strony architektury.
Jeśli raz dziennie zadajesz chatbotowi kilka pytań, różnicy między 0,10 a 1 dol. za milion tokenów nie poczujesz. Zmienia się to, gdy firma automatycznie analizuje każdą rozmowę z klientem, zgłoszenie, fakturę albo rekord wpadający do systemu. Wtedy koszt pojedynczego zapytania mnoży się przez ogromną liczbę operacji i może zdecydować, czy wdrożenie AI w ogóle się opłaca. Dla polskiego MSP to konkretny argument, żeby przeliczyć projekty, które wcześniej odpadły na kosztach. Jeśli małe firmy to Twój temat, zajrzyj też do programu Claude for Startups.
Zanim zaczniesz planować, miej na uwadze to, czego źródło nie rozstrzyga:
Na najbliższe miesiące wniosek jest prosty. Pierwszy etap wyścigu AI mierzono możliwościami modeli. Teraz równie ważny jest rachunek za ich uruchomienie. Anthropic chce, żeby model kosztował tak mało, że zaczniemy go wkładać praktycznie wszędzie, a najmocniejsze modele zostaną do zadań, przy których jakość naprawdę się liczy.
AI w firmie to rachunek. Gdy koszt tokena spada, więcej procesów da się zautomatyzować z sensownym zwrotem. Pomagamy dobrać model i zadania tak, żeby wdrożenie się spinało. Zobacz wdrożenia AI dla firm →
Na podstawie: Spiders Web
10 gotowych promptów do codziennej pracy + 5 narzędzi + plan na pierwszy tydzień. PDF, 4 strony konkretu.