DeepSeek podnosi ceny API nawet o 1100%. Szczyt-dół od 17 sierpnia
Źródło: Link
Źródło: Link
17 sierpnia o północy DeepSeek uruchomił nowy cennik API. V4-Flash i V4-Pro dostały taryfy szczyt-dół w proporcji 1:2. Cache-hit input dla V4-Pro w szczycie podrożał o 1100% względem starej ceny. Reszta podwyżek - od 50% do 1100%, zależnie od modelu, typu tokenów i pory dnia.
Jeśli myślałeś, że DeepSeek utrzyma ceny na zawsze - masz odpowiedź. Nawet oni nie wytrzymali.

DeepSeek-V4-Flash w szczycie (9:00-12:00 i 14:00-18:00 czasu pekińskiego, łącznie 7 godzin dziennie):
Poza szczytem (pozostałe 17 godzin):
DeepSeek-V4-Pro w szczycie:
Poza szczytem:
Dla V4-Pro stare ceny wynosiły: 0,025 juana (cache-hit), 3 juany (cache-miss), 6 juanów (output). Nowe ceny szczytowe to wzrost o 1100%, 200% i 350%. Poza szczytem - wzrost o 500%, 50% i 125%.
V4-Flash miał wcześniej: 0,02 juana, 1 juan, 2 juany. Szczyt daje wzrost o 400%, 200%, 350%. Poza szczytem - 150%, 50%, 125%.

13 sierpnia DeepSeek wypuścił oficjalny DeepSeek-V4-Pro (numer wersji DeepSeek-V4-Pro-0813). Model obsługuje tryb myślenia i bez myślenia, ma okno kontekstu 1 milion tokenów i może wyprodukować do 384 000 tokenów na wyjściu. Natywnie wspiera wywołania narzędzi, Responses API i Anthropic API.
Limity współbieżności: 500 dla V4-Pro, 2500 dla V4-Flash.
Tego samego dnia ogłoszono nowy cennik. Nie przypadek - nowa wersja, nowe ceny. Klasyczny ruch: daj lepszy model, podnieś cenę, sprzedaj to jako "wartość".
Modele AI żrą moc obliczeniową non-stop. Zapytania kumulują się w godzinach pracy, poza szczytem - cisza. DeepSeek używa dźwigni cenowej, żeby przesunąć część ruchu poza szczyt. Klastry obliczeniowe pracują równomierniej, szczyt jest mniej zatłoczony.
Dla Ciebie to nowa matematyka: rozmowa w czasie rzeczywistym i agenci AI online nie uciekną od cen szczytowych. Analiza offline, tłumaczenia wsadowe, czyszczenie danych, nocna ewaluacja - da się przesunąć. Planowanie zadań wpływa teraz bezpośrednio na rachunek za tokeny.
DeepSeek zaczynał od niskich cen, żeby zbudować rynek. Teraz przechodzi na taryfikację opartą na podaży i popycie. Logika jak w taryfach energii elektrycznej - szczyt droższy, dół tańszy. Wojna cenowa w AI wchodzi w fazę 2.0 - nie tylko "kto tańszy", ale "kto lepiej zarządza mocą".

Jeśli budujesz chatbota dla klienta w Polsce, godziny szczytu DeepSeek (9:00-12:00 i 14:00-18:00 czasu pekińskiego) to u nas 3:00-6:00 i 8:00-12:00 czasu polskiego (latem; zimą przesunięcie o godzinę). Większość polskiego ruchu biznesowego wypada poza szczyt DeepSeek. Możesz płacić połowę.
Jeśli Twoi użytkownicy siedzą w Azji - płacisz pełną stawkę w ich godzinach pracy. Geografia ma znaczenie.
Dla projektów wsadowych (analiza danych, generowanie raportów, tłumaczenia masowe) - przesuń na noc polską, unikniesz szczytu. Dla chatbotów real-time - nie masz wyboru, płacisz ile trzeba.
Routing między modelami staje się ważniejszy. Jeśli masz elastyczność, możesz przełączać się między DeepSeek a innymi dostawcami w zależności od pory dnia i ceny.
Szczyt DeepSeek to 9:00-12:00 i 14:00-18:00 czasu pekińskiego. W Polsce (czas letni) to 3:00-6:00 i 8:00-12:00. Zimą przesunięcie o godzinę wcześniej. Sprawdź różnicę czasową przed zaplanowaniem zadań wsadowych.
Nie. Nowy cennik szczyt-dół dotyczy tylko DeepSeek-V4-Flash i DeepSeek-V4-Pro. Starsze wersje mogą mieć inne zasady - sprawdź dokumentację API przed migracją.
Ceny poza szczytem to dokładnie połowa cen szczytowych. Jeśli przetwarzasz 100 milionów tokenów miesięcznie i przesuniesz 80% poza szczyt, oszczędzasz około 40% całkowitego kosztu względem pracy tylko w szczycie. Dla dużych projektów to tysiące juanów miesięcznie.
Tak, nawet po podwyżkach. Claude Opus 4.7 kosztuje 15 USD za milion tokenów input (około 100 juanów), DeepSeek V4-Pro w szczycie to 9 juanów za cache-miss input. DeepSeek wciąż kilka razy tańszy, choć różnica się zmniejszyła.
Nie. Nowy cennik wszedł w życie 17 sierpnia dla wszystkich wywołań V4-Flash i V4-Pro, niezależnie od wersji klienta API. Jeśli chcesz starych cen, musisz wrócić do V3 - tracisz wtedy nowe funkcje (okno 1M tokenów, tryb myślenia, Responses API).
Na podstawie: Pandaily
10 gotowych promptów do codziennej pracy + 5 narzędzi + plan na pierwszy tydzień. PDF, 4 strony konkretu.