Dziennik zmian DeepSeeka opisuje każdą podmianę modelu od 2025 roku. Jest tam V3.1, jest Terminus, są obie wersje V3.2, jest kwietniowe wejście czwartej generacji. Ostatni wpis nosi datę 31 lipca, dotyczy modelu Flash i kończy się zdaniem, że oficjalne wydanie wersji Pro nastąpi wkrótce. To wydanie właśnie nastąpiło i nie ma o nim w tym dzienniku ani słowa. DeepSeek V4 Pro trafił do produkcji tak, że dowiadujesz się o tym z przypisu pod tabelą w dokumentacji dla programistów.
Gdzie właściwie stoi informacja o nowej wersji
Cała treść komunikatu mieści się w jednym zdaniu, schowanym pod tabelką z nazwami modeli na stronie pierwszego wywołania. Brzmi ono tak: model deepseek-v4-pro został zaktualizowany do wersji DeepSeek-V4-Pro-0813, a sposób wywołania pozostaje bez zmian.
Drugi ślad jest w cenniku, gdzie w wierszu z wersją modelu widnieje ta sama nazwa. I to tyle. W sprawdzonych przez nas materiałach producenta nie ma o tym wydaniu nic więcej. Nie ma go zwłaszcza w dzienniku zmian, który przecież istnieje i jest prowadzony.
Warto od razu doprecyzować, co się właściwie zmieniło. Nazwa deepseek-v4-pro działa od kwietnia, kiedy model wszedł w wersji zapowiedzianej. Nowością nie jest więc sam model w ofercie, tylko podmiana jego wersji pod tą samą nazwą.
Sposób dostarczenia jest tu istotny sam w sobie. Kto ma DeepSeeka wpiętego w produkcję, ten dostaje teraz odpowiedzi z innego modelu przy niezmienionej konfiguracji. Integracja nie wymaga przez to żadnej poprawki, co jest wygodne. Zachowanie aplikacji i tak warto przetestować, bo zmienił się model, a nie tylko jego numer.
Co dostaje ten, kto nie zmienił ani linijki kodu
Parametry techniczne trzeba wyłuskać z tabeli, bo nikt ich nie podsumował. Model pracuje z oknem kontekstowym miliona tokenów i potrafi wygenerować w odpowiedzi do 384 tysięcy. Obsługuje tryb z rozumowaniem, włączony domyślnie, oraz tryb bez niego.
Jedna liczba z tej tabeli bywa pomijana, a przy planowaniu wdrożenia jest istotna. Limit równoległych wywołań dla wersji Pro wynosi 500, podczas gdy tańszy Flash ma go ustawiony na 2 500. Dokumentacja nie wyjaśnia przyczyny tej różnicy, ale przy większym ruchu to ona wyznacza sufit, a nie cena.
Blog opisywał wejście modelu Flash na przełomie lipca i tamta premiera wyglądała inaczej. Miała wpis w dzienniku zmian, listę wyników z ośmiu testów i opis metody pomiaru. Ta sama firma, dwa tygodnie później, przy mocniejszym modelu nie podała nic.
Ile kosztuje milion tokenów i dlaczego to się zmieni
Cennik zawiera też zapowiedź dotyczącą przyszłości i akurat to jedno zdanie warto przeczytać uważnie.
Dziś za milion tokenów wejścia płaci się 0,435 dolara, jeśli zapytanie nie trafi w pamięć podręczną. Przy trafieniu jest to 0,003625 dolara, czyli około stu dwudziestu razy taniej. Milion tokenów wyjścia kosztuje 0,87 dolara. Dla porównania tańszy Flash bierze 0,14 dolara za wejście i 0,28 za wyjście.
Pod tą tabelą wisi przypis, którego nie da się przeoczyć, gdy się go raz zobaczy. DeepSeek zapowiada w nim podniesienie ogólnych cen swojego interfejsu programistycznego w niedalekiej przyszłości. Spodziewa się przy tym wzrostu istotnego i pisze to wprost. Prosi też, żeby planować zużycie z tą wiedzą. Konkretnego cennika ani daty nie podaje, odsyłając do przyszłego oficjalnego komunikatu.
To jest praktycznie ważniejsze niż sama podmiana modelu. Jeden z najtańszych dostawców uprzedza, że będzie drożej, i nie mówi, o ile ani od kiedy. Jak bardzo zmieni to jego pozycję cenową wobec konkurencji, na razie nie wiadomo, bo nowego cennika po prostu nie ma.
Pierwsza Misja AI · Kodożercy
AI bez technikaliów – kurs i certyfikat
Pierwsza Misja AI to kurs Kodożerców dla absolutnych początkujących. Sci-fi fabuła, gamifikacja, prawdziwy GPT-4 w ćwiczeniach, certyfikat na koniec.
Zacznij Pierwszą Misję →

Wyników tej wersji nie ma w materiałach producenta
Po sieci chodzi zestaw liczb o dużym skoku w zadaniach agentowych, przypisywanych DeepSeekowi przez serwisy branżowe i wpisy w mediach społecznościowych. Sprawdziliśmy, skąd pochodzą, i nie udało się dojść do żadnego dokumentu firmy. Dlatego ich tu nie podajemy.
Warto wiedzieć, gdzie DeepSeek wyniki publikuje, kiedy chce. Pierwsze miejsce to dziennik zmian, w którym przy lipcowym wydaniu Flasha wypisał osiem testów razem z opisem metody pomiaru. Drugie to karta modelu na Hugging Face, bo wagi wersji Pro są dostępne do pobrania na licencji MIT.
I tu robi się ciekawie. Ta karta opisuje 1,6 biliona parametrów, z czego 49 miliardów aktywnych, oraz milion tokenów kontekstu. Nazywa jednak model wersją zapowiedzianą, a jej ostatnia zmiana pochodzi z 22 czerwca. Wyniki w niej podane dotyczą starszego wydania testu Terminal Bench, w wersji 2.0. Innymi słowy to, co można dziś pobrać, nie jest tym, co odpowiada przez interfejs programistyczny, a różnicy nikt nie opisał.
Niezależny pomiar, jaki udało nam się znaleźć, wygląda skromniej niż krążące liczby. W tablicy Artificial Analysis wersja 0813 dostaje 53 punkty, a czoło tego samego zestawienia stoi dziś na 63. To jest różnica warta sprawdzenia, zanim ktoś przeniesie na ten model zadania wymagające najwyższej jakości.
Podpięcie pod agenta kodującego to kwestia trzech zmiennych
Ta część jest realnie użyteczna, bo dotyczy pieniędzy wydawanych na codzienną pracę.
Dokumentacja DeepSeeka wprost mówi, że jego model można podstawić jako silnik pod popularne narzędzia do kodowania. Wymienia przy tym Claude Code, GitHub Copilot i OpenCode, zaznaczając, że nie trzeba pisać własnego kodu. Osobny przewodnik pokazuje to krok po kroku dla Claude Code, OpenCode i OpenClaw.
Mechanizm jest prostszy, niż brzmi. DeepSeek wystawia adres zgodny z interfejsem Anthropica. Wystarczy więc przestawić w środowisku adres bazowy, klucz oraz nazwy modeli, po które narzędzie sięga. Producent podaje gotowy zestaw zmiennych, w tym osobne przypisanie tańszego Flasha do zadań pomocniczych.
Warto zestawić to z kierunkiem, w którym idą narzędzia. Kiedy pisaliśmy o tym, że Claude Code przestaje pytać o zgodę przy kolejnych krokach, sprawa dotyczyła zaufania do agenta. Tutaj dochodzi druga strona tego samego równania. Agent, który pracuje dłużej i pyta rzadziej, zużywa po prostu więcej tokenów. Rachunek za nie zależy zaś od cennika, który dostawca właśnie zapowiedział podnieść.
Czego o tej podmianie nie wiadomo
Zostaje lista rzeczy, których dokumentacja nie rozstrzyga, a które przy takim wejściu byłyby naturalne.
Nie wiadomo, czy zmieniła się sama architektura modelu, czy tylko dotrenowano istniejącą. Przy Flashu DeepSeek napisał to wprost, notując, że rozmiar i budowa zostały bez zmian, a zmieniło się wyłącznie dotrenowanie. Przy wersji Pro nie napisał nic. Dokumentacja nie wskazuje też sposobu wywołania poprzedniej wersji. Zespół, który chciałby porównać zachowanie obu albo tymczasowo wrócić do starszej, nie znajdzie tam instrukcji.
Nie wiadomo wreszcie, kiedy wejdzie podwyżka i jakiej będzie skali. Zapowiedź istnieje, harmonogram nie.
Podsumowanie
DeepSeek podmienił swój flagowy model na wersję DeepSeek-V4-Pro-0813 pod niezmienioną nazwą wywołania. W sprawdzonych materiałach producenta informuje o tym wyłącznie przypis w dokumentacji dla programistów i wiersz w cenniku. Dziennik zmian firmy, który opisuje każdą podmianę modelu od 2025 roku, tym razem milczy, choć jego wpis z 31 lipca zapowiadał to wydanie. Model pracuje z milionem tokenów kontekstu i wyjściem do 384 tysięcy. Kosztuje 0,435 dolara za milion tokenów wejścia i 0,87 za milion wyjścia, a pod cennikiem wisi zapowiedź istotnej podwyżki bez podanej daty i skali. Liczby o dużym skoku w testach krążą po sieci z powołaniem na firmę, tyle że nie prowadzą do żadnego jej dokumentu, więc ich nie podajemy. Wagi wersji Pro leżą na Hugging Face na licencji MIT, ale opisująca je karta dotyczy wydania zapowiedzianego i nie zmieniła się od 22 czerwca. Pomiar Artificial Analysis daje wersji 0813 53 punkty wobec 63 dla czoła tablicy.
Newsletter · DevstockAcademy & Kodożercy
Bądź na bieżąco ze światem IT, AI i automatyzacji
Co wtorek: newsy z branży, praktyczne tipy i narzędzia które warto znać. Zero spamu.




