GPT-5.6 Luna i Terra tanieją pięciokrotnie. OpenAI obniża ceny
Źródło: Link
Źródło: Link
OpenAI właśnie obniżyło ceny dwóch modeli GPT-5.6 o połowę i więcej. To nie promocja - to efekt lat pracy nad optymalizacją infrastruktury. Konkretny sygnał dla rynku: AI ma być tańsza, szybsza i dostępna na masową skalę.
30 lipca firma ogłosiła nowe stawki dla GPT-5.6 Luna i Terra. Wprowadzono też tryb Fast dla najmocniejszego wariantu Sol. Zmiany dotyczą zarówno API, jak i sposobu rozliczania użycia w płatnych subskrypcjach ChatGPT Work i Codex.
GPT-5.6 Luna to najszybszy i najtańszy model w rodzinie GPT-5.6. Od 30 lipca milion tokenów wejściowych kosztuje w API 0,20 dolara, a milion tokenów wyjściowych 1,20 dolara. Pięciokrotna obniżka w stosunku do poprzednich stawek.
OpenAI pozycjonuje Lunę jako narzędzie do zadań wykonywanych masowo - bez potrzeby głębokiego "zastanawiania się". Klasyfikacja zapytań w helpdeskach, analiza dużych zbiorów dokumentów, rutynowe modyfikacje kodu, wieloetapowe działania z użyciem narzędzi. To scenariusze, w których Luna ma się sprawdzić.
Firma twierdzi, że Luna osiąga poziom modeli uznawanych rok wcześniej za flagowe przy koszcie odpowiadającym około sześciu centom na każdego dolara wydawanego na porównywalny system. Deklarowana szybkość działania? Niemal dziewięciokrotny wzrost - choć tu wiele zależy od rodzaju zadania, konfiguracji i przyjętej metodologii.
Niższa cena to nie tylko korzyść dla użytkowników API. W ChatGPT Work i Codex każde zadanie wykonywane przez Lunę zużywa teraz mniej limitu - przy niezmienionej cenie subskrypcji.
GPT-5.6 Terra, pozycjonowany jako wariant do codziennej pracy, również tanieje. Od 30 lipca stawki wynoszą 2 dolary za milion tokenów wejściowych i 12 dolarów za milion wyjściowych.
To model dla tych, którzy potrzebują czegoś więcej niż Luna, ale nie wymagają pełnej mocy Sol. Obniżka o jedną piątą robi różnicę dla firm, które przetwarzają dziesiątki milionów tokenów miesięcznie.
GPT-5.6 Sol, najmocniejszy wariant w rodzinie, nie tanieje. Zamiast tego dostaje opcję przyspieszenia - tryb Fast, który zastępuje dotychczasową usługę Priority Processing.
Tryb Fast ma zapewniać do 2,5 raza wyższą szybkość niż przetwarzanie w standardzie - bez zmiany poziomu inteligencji modelu. Cena jest dwukrotnie wyższa, dlatego rozwiązanie nie ma zastępować zwykłego trybu w każdym zadaniu. To opcja dla sytuacji, gdy czas wykonania zadania jest ważniejszy od kosztu.
Dotychczasowe żądania oznaczone jako priorytetowe będą automatycznie kierowane do Fast. Istniejące integracje nie wymagają przebudowy.
OpenAI podkreśla, że obniżki cen to wynik lat pracy nad modelami, oprogramowaniem inferencyjnym i sposobem przydzielania obciążeń do sprzętu. Firma nauczyła się robić to samo taniej i szybciej.
To denerwuje konkurencję (zwłaszcza tę, która nie ma takich zasobów na optymalizację), ale cieszy użytkowników. Zwłaszcza tych, którzy do tej pory odkładali wdrożenie AI ze względu na koszty.
Dla polskich firm to konkretna informacja: jeśli do tej pory testowałeś AI na małą skalę, bo "to za drogie" - właśnie przestało być. Luna przy 0,20 USD za milion tokenów wejściowych to koszt, który pozwala myśleć o masowym przetwarzaniu dokumentów, automatyzacji helpdeskowej czy analizie feedbacku klientów.
Korzystasz z API? Sprawdź swoje miesięczne zużycie tokenów i przelicz, ile zaoszczędzisz. Masz subskrypcję ChatGPT Work lub Codex? Ten sam limit wystarczy Ci teraz na więcej zadań wykonywanych przez Lunę i Terrę.
Jeśli do tej pory nie korzystałeś z AI w firmie, bo "to za drogie" - właśnie straciłeś argument. Luna przy obecnych cenach to narzędzie, które można wdrożyć na masową skalę bez ryzyka, że koszty uciekną.
A jeśli używasz modeli OpenAI do zadań, gdzie liczy się czas - tryb Fast dla Sol to opcja do przetestowania. Dwukrotnie wyższa cena to nie problem, jeśli alternatywą jest czekanie 2,5 raza dłużej.
Tak, nowe ceny obowiązują globalnie dla wszystkich użytkowników API OpenAI. Jeśli korzystasz z ChatGPT Work lub Codex, niższe koszty modeli przekładają się na mniejsze zużycie Twojego limitu - przy niezmienionej cenie subskrypcji.
Tak, tryb Fast zastępuje dotychczasową usługę Priority Processing. Jeśli wcześniej używałeś priorytetowego przetwarzania, Twoje żądania będą automatycznie kierowane do trybu Fast bez konieczności zmian w integracji.
Tryb Fast kosztuje dwukrotnie więcej niż standardowe przetwarzanie, ale zapewnia do 2,5 raza wyższą szybkość działania. Konkretne stawki zależą od typu tokenów (wejściowe/wyjściowe) - sprawdź aktualne ceny w dokumentacji API OpenAI.
Luna to najszybszy i najtańszy model w rodzinie GPT-5.6, przeznaczony do zadań masowych, które nie wymagają głębokiego "zastanawiania się". Terra i Sol oferują wyższą jakość rozumowania, ale kosztują więcej. Wybór modelu zależy od rodzaju zadania i budżetu.
Nie. OpenAI podkreśla, że obniżki to efekt lat pracy nad optymalizacją infrastruktury - lepsze oprogramowanie inferencyjne, efektywniejsze przydzielanie obciążeń do sprzętu. To nie promocja, a nowy standard kosztowy wynikający z postępu technologicznego.
10 gotowych promptów do codziennej pracy + 5 narzędzi + plan na pierwszy tydzień. PDF, 4 strony konkretu.