REKLAMA

Claude zrobił się absurdalnie tani. Nowy model kosztuje grosze

Anthropic wypuścił Claude Haiku 5.5, czyli najmniejszy i najtańszy model z nowej rodziny. Przy typowych zapytaniach 1 mln tokenów wejściowych kosztuje zaledwie 0,10 dol.

Anthropic wypuścił absurdalnie taniego Claude Haiku 5.5
REKLAMA

Nowy Haiku ma być używany wszędzie tam, gdzie liczy się przede wszystkim skala: w obsłudze klienta, automatycznej klasyfikacji, podsumowaniach i agentach wykonujących tysiące powtarzalnych zadań. I właśnie dlatego cena może być tu ważniejsza niż kolejny rekord w benchmarku.

REKLAMA

1 mln tokenów za 0,10 dol.

Claude Haiku 5.5 jest trzecim modelem z rodziny Claude 5.5. Anthropic wcześniej pokazał najmocniejszego Opus 5.5 oraz bardziej uniwersalnego Sonnet 5.5, a teraz zamyka skład modelem przeznaczonym przede wszystkim do szybkiej i taniej pracy na dużą skalę.

Chyba najbardziej rzuca się w oczy cennik. Dla promptów o długości do 100 tys. tokenów milion tokenów wysyłanych do modelu kosztuje 0,10 dol., a milion tokenów wygenerowanej odpowiedzi 0,50 dol. Haiku 4.5 kosztował odpowiednio 1 dol. i 5 dol. Oznacza to więc 10-krotną różnicę w stawce za token w najczęściej używanym przedziale długości kontekstu.

REKLAMA

Przy bardzo długich zapytaniach ceny oczywiście rosną. Powyżej 100 tys. tokenów wejście kosztuje 0,50 dol. za milion tokenów, a wyjście 2,50 dol. Nadal jest więc 2 razy taniej niż w poprzedniej generacji. Anthropic podsumowuje te różnice ostrożniej i podaje, że przeciętny koszt uruchamiania Haiku 5.5 jest około 75 proc. niższy niż Haiku 4.5. Firma uwzględnia w tym zarówno różne długości zapytań, jak i zmiany w sposobie dzielenia tekstu na tokeny.

REKLAMA

Tutaj grosze zaczynają mieć ogromne znaczenie

Dla osoby, która raz dziennie zada chatbotowi kilka pytań związanych np. z zakupami czy majsterkowaniem, różnica między 0,10 a 1 dol. za milion tokenów może wydawać się nieistotna, jednak w zastosowaniach biznesowych skala całkowicie zmienia cały rachunek.

Haiku nie powstał po to, aby raz na godzinę napisać komuś długi raport. Anthropic wskazuje klasyfikowanie danych, tworzenie krótkich podsumowań, wyszukiwanie informacji w bazach, wyciąganie danych z dokumentów, obsługę klienta oraz asystentów działających wewnątrz aplikacji. To zadania wykonywane czasem miliony razy.

REKLAMA

Jeżeli firma automatycznie analizuje każdą rozmowę z klientem, każde zgłoszenie, fakturę albo rekord trafiający do systemu, to cena pojedynczego zapytania mnoży się przez ogromną liczbę operacji. W takim środowisku 10-krotna obniżka kosztu tokena potrafi zdecydować, czy wykorzystanie AI ma ekonomiczny sens.

REKLAMA

Właśnie w tę stronę rozwija się Claude. Dopiero co Anthropic wprowadził swojego asystenta bezpośrednio do Dokumentów, Arkuszy i Prezentacji Google. Coraz częściej model nie ma być osobnym chatbotem otwieranym kilka razy dziennie, lecz niewidoczną warstwą pracującą wewnątrz aplikacji.

Ma być szybki, a nie najmądrzejszy

Haiku 5.5 nie zastępuje Opusa ani Sonneta. Anthropic bardzo wyraźnie rozdziela role modeli. Opus 5.5 pozostaje przeznaczony do najbardziej wymagających problemów, w których potrzebne jest długie rozumowanie i wysoka jakość. Sonnet 5.5 zajmuje środek oferty. Haiku ma być wybierany tam, gdzie najważniejsze są szybkość, niski koszt i duża liczba wykonywanych operacji. Anthropic określa go jako swój najszybszy model w standardowym trybie pracy.

REKLAMA

Taki podział będzie mieć znaczenie zwłaszcza przy agentach AI. Jeden system nie musi używać najmocniejszego i najdroższego modelu do każdej czynności. Trudny problem może trafić do Opusa, podczas gdy dziesiątki prostych działań pobocznych wykonają tańsze instancje Haiku.

REKLAMA

Już wcześniejsze eksperymenty Anthropic pokazywały, jak bardzo możliwości Haiku i Opusa mogą różnić się przy bardziej wymagających zadaniach. W symulowanym rynku mocniejszy Opus znacznie skuteczniej prowadził negocjacje niż Haiku 4.5.

Nie zawsze jednak potrzebujemy najlepszego negocjatora. Jeżeli zadanie polega na rozpoznaniu kategorii e-maila, skróceniu tekstu albo pobraniu jednej informacji z dokumentu, płacenie za najmocniejszy model może przypominać wynajmowanie samochodu wyścigowego do dojazdu po zakupy.

REKLAMA

Anthropic obniżył też koszt większego Claude’a

Premiera Haiku 5.5 przyniosła jeszcze jedną zmianę w cenniku. Anthropic obniżył o połowę koszt odczytywania danych z pamięci podręcznej w Claude Sonnet 5.5. Teraz milion takich tokenów kosztuje 0,10 dol. zamiast 0,20 dol.

Cache pozwala nie przesyłać i nie przetwarzać od początku tych samych fragmentów kontekstu podczas kolejnych zapytań. Takie coś ma szczególne znaczenie w długotrwałych zadaniach agentowych, gdzie model wielokrotnie wraca do tych samych instrukcji, dokumentów albo historii wcześniejszych działań.

REKLAMA

Według Anthropic dzięki tej zmianie typowe zadania agentowe wykonywane przez Sonnet 5.5 mogą kosztować około 20 proc. mniej. Firma tnie więc ceny na dwóch poziomach jednocześnie. Z jednej strony dostarcza bardzo tani model do ogromnej liczby prostych operacji, a z drugiej zmniejsza rachunek za bardziej wymagające zadania wykonywane przez Sonneta.

Wojna o AI zaczyna być wojną o każdy ułamek centa

Nowa cena Haiku tak naprawdę doskonale pokazuje zmianę zachodzącą na rynku modeli językowych. Pierwszy etap wyścigu AI koncentrował się przede wszystkim na możliwościach. Firmy chwaliły się coraz lepszymi benchmarkami, większym kontekstem i trudniejszymi problemami rozwiązywanymi przez kolejne generacje. Teraz równie ważna staje się ekonomia.

REKLAMA

Jeżeli agent ma działać przez cały dzień, odpowiadać tysiącom klientów albo wykonywać setki czynności podczas jednego zadania, koszt pojedynczego wywołania zaczyna decydować o całkowitym rachunku. Najlepszy model świata może okazać się po prostu zbyt drogi do prostych zadań wykonywanych miliardy razy.

Przeczytaj także:

REKLAMA

Haiku 5.5 pokazuje, jak agresywnie producenci próbują obniżyć tę barierę. Przy typowym zapytaniu 10 mln tokenów wejściowych kosztuje około 1 dol., a 10 mln tokenów wygenerowanego tekstu około 5 dol. Jeszcze niedawno tani model oznaczał również wyraźny kompromis w możliwościach. Teraz Anthropic zamiast pytać, czy firma może sobie pozwolić na AI, chce doprowadzić do sytuacji, w której uruchomienie modelu będzie tak tanie, że zaczniemy wkładać go praktycznie wszędzie.

Marcin Kusz
Redaktor

Redaktor Spider's Web specjalizujący się w tematyce naukowej. O nowych technologiach zaczął pisać w 2012 r. na łamach portalu Telix. Później współtworzył treści dla Komputer Świata i PCLabu. Epizod dziennikarski zaliczył także w lokalnej gazecie i w dziale blogowym SpeedTest. Współzałożyciel agencji BlueCopy, zajmującej się copywritingiem i poligrafią. Przez pewien czas właściciel firmy transportowej. Prywatnie fan starych polskich oper mydlanych (oglądanych obowiązkowo z konkubiną), dumny opiekun kotki brytyjskiej i pasjonat-amator druku 3D.

REKLAMA
REKLAMA