Kimi K3 kosztuje 15 dolarów za milion tokenów. Chiny atakują premium
Źródło: Link
Źródło: Link
Audyty, wdrożenia, szkolenia sprzedażowe i AI. Dopasowane do zespołu i procesów.
"Impressive" - napisał Elon Musk. Nasdaq odpowiedział spadkiem o 1,47%, a indeks półprzewodników zjechał o 4,29%. Kimi K3, wypuszczony przez Moonshot AI tuż przed konferencją WAIC 2026, to trzecia fala uderzeniowa z chińskiego AI. Po DeepSeek R1 i Manus. Każda trafiła w inny nerw: DeepSeek pokazał, że można tanio, Manus podniósł poprzeczkę dla agentów AI, a K3 atakuje coś fundamentalnego - premium cenowe, na którym opiera się cały biznes amerykańskich gigantów AI.

Podstawowa różnica między K3 a wcześniejszymi chińskimi modelami to cena. 3 dolary za milion tokenów wejściowych, 15 dolarów za milion wyjściowych. To 3-4 razy więcej niż Moonshot K2.6 i znacznie drożej niż DeepSeek czy GLM. Moonshot stawia na prostą tezę: jeśli model radzi sobie lepiej w złożonym kodowaniu, obsłudze agentów AI i pracy z wiedzą, może kosztować więcej.
Wczesne dane z testów Artificial Analysis pokazują, że średni koszt wykonania zadania przez K3 to 0,94 dolara. Claude Opus 4.8? 1,80 dolara. GPT-5.6 Sol? 1,04 dolara. Wyższe ceny za token, niższe koszty całego zadania. Model potrzebuje mniej prób i krótszych łańcuchów rozumowania.
To zmienia narrację. Chińskie modele przestają być tylko tanim zamiennikiem. Teraz walczą o ten sam segment co Anthropic i OpenAI - wysokomarżowe zadania enterprise, gdzie liczy się niezawodność i jakość, nie tylko cena tokena.
Timing ma znaczenie. Chińskie modele osiągnęły już 30% udziału w tokenach używanych przez amerykańskie firmy na OpenRouter do połowy 2026 roku, z pikiem na poziomie 46%. Udział DeepSeek wzrósł z 9% do prawie 20%. Większość tego ruchu to zadania niskomarżowe - proste zapytania, gdzie liczy się cena.
K3 próbuje przesunąć chińskie AI z roli dostawcy tanich tokenów do dostawcy premium możliwości. Bezpośrednia konkurencja z Claude Opus i GPT-5 w zadaniach, gdzie niezawodność i jakość mają większe znaczenie niż absolutny koszt tokena.

CNN i AP cytowały K3 jako jeden z powodów spadków na giełdzie 16 lipca. Inwestorzy zaczynają kwestionować wyceny AI oparte na założeniu, że chińskie modele zawsze będą w tyle.
Guillermo Rauch, CEO Vercel, opublikował wyniki benchmarków pokazujące, że K3 osiągnął najlepszą wydajność w testach nextjs.org, dorównując Fable w krótszym czasie. Nathan Lambert, starszy badacz z Ai2, argumentuje, że tłumaczenie destylacją już nie wyjaśnia postępu chińskich modeli. "Chińskie zespoły są naprawdę dobre w budowaniu modeli" - napisał wprost.
Robin Zhu, analityk Bernstein, nazwał K3 "home runem". Stwierdził, że chińskie czołowe laboratoria dotrzymujące kroku globalnym liderom to już nie przypadek. Trzecia fala może być najbardziej konsekwentna - atakuje nie tylko założenia kosztowe, ale całą pulę zysków wspierającą model biznesowy amerykańskiego ekosystemu AI.
Kimi K3 z parametrami 2,8 biliona i architekturą open-source bije rekordy w swojej kategorii. Moonshot AI pokazuje, że można budować modele premium poza USA i wyceniać je na poziomie, który nie jest ani tanią kopią, ani pełnym premium amerykańskich gigantów.
Dla firm używających AI to dobra wiadomość - więcej opcji w segmencie wysokiej jakości, niższe koszty całkowitego zadania. Dla OpenAI i Anthropic? Presja na marże i pytanie, czy premium cenowe jest uzasadnione wyłącznie jakością, czy też po części monopolem na najlepsze modele.

Trzecia fala z Chin to nie tylko technologia. To pytanie o to, czy amerykańskie firmy AI mogą utrzymać obecne wyceny i ceny, kiedy konkurencja oferuje porównywalną jakość za 40-50% kosztu całkowitego zadania. Rynek już odpowiada - i odpowiedź widać w spadkach na giełdzie.
Kimi K3 kosztuje 3 dolary za milion tokenów wejściowych i 15 dolarów za milion wyjściowych. To drożej niż DeepSeek, ale średni koszt wykonania zadania (0,94 dolara) jest niższy niż Claude Opus 4.8 (1,80 dolara) i zbliżony do GPT-5.6 Sol (1,04 dolara), bo model potrzebuje mniej prób.
16 lipca Nasdaq spadł o 1,47%, a indeks półprzewodników o 4,29%. CNN i AP cytowały K3 jako jeden z powodów. Inwestorzy kwestionują wyceny AI oparte na założeniu, że chińskie modele zawsze będą gorsze - K3 pokazuje, że to założenie już nie działa.
W niektórych zadaniach tak. Kimi K3 osiągnął najlepszą wydajność w testach nextjs.org według CEO Vercel. Analityk Bernstein stwierdził, że chińskie laboratoria dotrzymujące kroku globalnym liderom to już nie przypadek. Nathan Lambert z Ai2 argumentuje, że chińskie zespoły są naprawdę dobre w budowaniu modeli.
Do połowy 2026 roku chińskie modele osiągnęły 30% udziału w tokenach używanych przez amerykańskie firmy na OpenRouter, z pikiem na poziomie 46%. Udział DeepSeek wzrósł z 9% do prawie 20%. Większość tego ruchu to zadania niskomarżowe, ale K3 celuje w segment premium.
Na podstawie: Pandaily - Moonshot AI Delivers the Third Shockwave