Skip to content
KURS: Agenci AI od podstaw
zbuduj zespół cyfrowych pomocników
Sprawdzam
KURS: Agenci AI
Sprawdzam
logo Devstock
  • O nas
  • Moduły Akademii
    • Moduł 1
    • Moduł 2
    • Moduł 3
    • Pozostałe moduły
  • Kursy AI i IT
    • Pierwsza Misja AI (Podstawy)
    • Automatyzacje z n8n 2.0
    • Frontend Master 2026
  • Blog
  • Kontakt
  • O nas
  • Moduły Akademii
    • Moduł 1
    • Moduł 2
    • Moduł 3
    • Pozostałe moduły
  • Kursy AI i IT
    • Pierwsza Misja AI (Podstawy)
    • Automatyzacje z n8n 2.0
    • Frontend Master 2026
  • Blog
  • Kontakt
Live o agentach AI, poniedziałek 21 września o 20:00, udział bezpłatny - zapisz się
Branża IT i Nowe Technologie

Otwarte modele AI: Alibaba oddała okrojonego flagowca

  • 13 sie, 2026
  • Komentarze 0
Otwarte modele AI - mały robot wynosi skrzynię ze strzałką pobierania przez rozświetloną bramę z logo Qwen, a tuż obok, za żelazną kratą z zamkiem, świecą zamknięte ikony możliwości

W plikach, które Alibaba wystawiła do pobrania, siedzi 2,4 biliona parametrów. Przy takiej liczbie samo ciśnie się na klawiaturę słowo rekord, tyle że rekordu nie ma. Na tej samej platformie leży starszy model Moonshot AI o 2,8 biliona parametrów, w dodatku rozumiejący obrazy. Ciekawsze jest co innego. Chiński producent oddał do pobrania model ze swojej najwyższej półki, tej samej, którą sprzedaje przez płatny interfejs. Sam pisze w dokumentacji, że robi to pierwszy raz. Oddał go jednak w wersji uboższej o cztery rzeczy. Kto rozważa otwarte modele AI u siebie zamiast rachunku za cudze API, powinien wiedzieć które.

Największe otwarte wagi na rynku? Ten tytuł ma kto inny

Wagi modelu to po prostu plik z liczbami, które powstały w czasie uczenia. Producent może go trzymać u siebie i sprzedawać dostęp przez sieć albo pozwolić pobrać i uruchomić na własnych serwerach. Drugie podejście nazywamy otwartymi wagami i to właśnie zrobiła Alibaba.

Karta modelu podaje 2,4 biliona parametrów łącznie i 95 miliardów aktywnych przy przetwarzaniu jednego tokena. Ta różnica bierze się z architektury zwanej mieszanką ekspertów. Model ma 512 wyspecjalizowanych fragmentów i przy każdym tokenie sięga po dziesięć z nich. Dochodzi do tego jedenasty, współdzielony, który pracuje zawsze. Reszta w tym momencie leży bezczynnie, dzięki czemu ogromny model liczy szybciej, niż wynikałoby z jego rozmiaru.

Liczba parametrów zapisana w plikach na Hugging Face to dokładnie 2 446 182 725 504. Kimi K3 od Moonshot AI ma tam 2 779 931 837 184, czyli o ponad trzysta miliardów więcej. Jego repozytorium założono 13 czerwca, a ostatnią zmianę przyjęło 27 lipca. Repozytorium Qwena powstało dopiero 8 sierpnia. Kimi rozumie przy tym obrazy, czego nowy model Alibaby nie potrafi. Zdanie o największych otwartych wagach w historii brzmi więc dobrze i jest nieprawdziwe.

Czego nie ma w wersji do pobrania

Producent sam opisuje różnicę i robi to bez owijania. W karcie modelu stoi ostrzeżenie: wersja otwarta obsługuje wyłącznie tekst i nie przyjmuje materiałów graficznych. Trybu rozumowania nie da się w niej wyłączyć.

Płatny Qwen3.8-Max, który blog opisywał przy zapowiedzi tego samego modelu na początku sierpnia, ma cztery rzeczy więcej. Widzi obrazy, pozwala odpowiadać bez rozumowania, dostaje milion tokenów kontekstu domyślnie zamiast 262 tysięcy i przychodzi z gotowymi narzędziami producenta. Wersja do pobrania kontekst też potrafi rozciągnąć do miliona, ale trzeba to sobie skonfigurować samemu.

Nie jest to zarzut wobec Alibaby, bo firma niczego nie ukrywa i wszystko wypisała w dokumentacji. Jest to natomiast powód, żeby przestać czytać nagłówki o otwarciu flagowego modelu jako obietnicę. Nie dostajesz tego samego, za co inni płacą. Producent zostawił po swojej stronie dokładnie te funkcje, które najbardziej wiążą klienta z jego usługą.

Rozumowania nie da się wyłączyć i trzeba to zaplanować

Ta jedna decyzja techniczna ma konsekwencje, o których łatwo nie pomyśleć przy pierwszym wdrożeniu.

Każda odpowiedź modelu zaczyna się od bloku wewnętrznego rozumowania. Nawet krótkie pytanie przechodzi więc przez etap, w którym model najpierw sam ze sobą rozmawia. Domyślny poziom tej analizy producent ustawił na najwyższy z trzech dostępnych. Można go obniżyć, wyłączyć nie można.

Skalę widać po zaleceniach z tej samej karty modelu. Producent radzi zarezerwować 262 tysiące tokenów na samo rozumowanie i 131 tysięcy na właściwą odpowiedź. To budżety do ustawienia, a nie zapowiedź, że każda odpowiedź zużyje cały limit. Sama proporcja jest jednak wymowna: brudnopis dostaje dwa razy więcej miejsca niż to, co czytelnik zobaczy.

Do tego dochodzi ustawienie, które łatwo przeoczyć przy pierwszym czytaniu dokumentacji. Opcja zachowująca rozumowanie z wcześniejszych wiadomości jest włączona domyślnie dla wszystkich zastosowań, co karta modelu stwierdza wprost. Brudnopis nie znika więc po jednej odpowiedzi, tylko zostaje w rozmowie. Przy dłuższej pracy agenta warto o tym pamiętać, planując okno kontekstowe.

Z tego wynika też trzeźwa odpowiedź na pytanie, które pojawia się przy każdym otwarciu wag. Karta modelu nie podaje żadnych wymagań sprzętowych, więc nikt tu niczego nie obiecuje. Producent odsyła natomiast do silników serwerowych i do własnej chmury, a nie do komputera osobistego. Otwarte wagi znaczą tu tyle, że możesz je uruchomić u wybranego przez siebie dostawcy mocy zamiast u producenta modelu.

Licencja nie wyklucza Unii, ma za to dwa progi skali

Tu spodziewaliśmy się problemu i sprawdziliśmy plik od początku do końca, bo blog opisywał niedawno licencję modelu wideo, która wyklucza Unię Europejską. Tym razem żadnych ograniczeń terytorialnych nie ma. W całym dokumencie nie pada nazwa ani jednego kraju.

Zamiast tego licencja ustawia dwie poprzeczki i obie mierzą wielkość firmy, nie jej miejsce na mapie. Pierwsza dotyczy widoczności marki. Kto przekroczy sto milionów użytkowników miesięcznie albo dwadzieścia milionów dolarów przychodu w miesiącu, musi pokazać nazwę modelu w swoim interfejsie. Nie traci prawa do korzystania, dostaje obowiązek podpisania się pod źródłem. Druga poprzeczka celuje w konkurencję. Dotyczy tych, którzy sprzedają dostęp do modeli albo budują samodzielny produkt do wspomaganego kodowania lub pracy biurowej, bo tak licencja definiuje asystenta pracy. Taka firma potrzebuje osobnej umowy z Alibabą, jeśli jej grupa zarobi ponad pięćdziesiąt milionów dolarów w dwanaście miesięcy. Użycie wewnątrz własnej firmy jest z tego wyłączone.

Dla polskiego odbiorcy praktyczny wniosek jest krótki. Żaden z tych progów nie dotknie przeciętnej polskiej firmy. Warunek o użyciu wewnętrznym napisano jasno. Zespół stawiający model na własne potrzeby nie ma się nad czym zastanawiać. Progi zaczynają mieć znaczenie dopiero wtedy, gdy ktoś chce na tym modelu zbudować własną usługę i sprzedawać ją dalej.

Pierwsza Misja AI · Kodożercy

AI zmienia rynek pracy. Zacznij rozumieć o co chodzi.

Kurs Pierwsza Misja AI to najkrótszy kurs po którym naprawdę rozumiesz AI, i możesz to pokazać certyfikatem. Sci-fi fabuła i gamifikacja sprawiają że nie nudzisz się ani minuty.

Dołącz do kursantów →
Pierwsza Misja AI - Kodożercy

Wyniki w karcie modelu opisują wersję płatną

Tabela z wynikami wygląda na dowód jakości pobieranych plików, a przy uważnym czytaniu okazuje się czymś innym. Wyróżniona kolumna nosi nagłówek Qwen3.8-Max, czyli nazwę usługi płatnej, a nie nazwę udostępnionych wag.

Same liczby też warto czytać do końca, bo w tej samej tabeli nie układają się w opowieść o zwycięstwie. W teście wiedzy fachowej GPQA Diamond producent wpisał sobie 92,6 punktu, Claude Fable 5 również 92,6, a GPT-5.6 Sol 94,1. W teście programistycznym SWE-bench Pro wychodzi 67,7 przy 69,2 dla Claude Opus 4.8 i 80,0 dla Fable 5. Model wypada dobrze, natomiast nikogo nie deklasuje i sam producent tego nie sugeruje.

Przypisy pod tabelą dokładają dwa zastrzeżenia, które w podsumowaniach zwykle giną. Przy SWE-bench Pro Qwen odnotowuje, że wadliwe zadania poprawiono, a wszystkie porównywane modele przeliczono na tej poprawionej wersji testu. Przy Terminal Bench producent mierzył własny model dziesięciokrotnie w jednym narzędziu. Wyniki rywali wziął z ich publikacji, więc zestawiane są przebiegi z różnych warunków. Niezależny pomiar wygląda skromniej. W tablicy Artificial Analysis płatny Qwen3.8-Max ma 58 punktów, podczas gdy czoło tego zestawienia stoi dziś na 63.

Najczęstsze pytania

Dwa pytania wracają przy każdym otwarciu wag dużego modelu i oba mają odpowiedź węższą, niż podpowiada pierwszy odruch.

Czy uruchomię ten model na własnym sprzęcie?

Karta modelu nie podaje wymagań sprzętowych, więc uczciwa odpowiedź brzmi: nie wiadomo, a producent tego nie obiecuje. Wiadomo natomiast, dokąd sam odsyła. W sekcji o uruchamianiu wskazuje silniki serwerowe oraz własną chmurę, a przy większym ruchu wprost zaleca rozwiązania przeznaczone do obsługi wielu zapytań naraz. O komputerze osobistym nie ma tam ani słowa. Sens tego wydania leży zresztą gdzie indziej niż domowe eksperymenty. Firma, która nie chce wysyłać danych do dostawcy modelu, może uruchomić te pliki u wybranego przez siebie operatora. Kontrola nad tym, gdzie trafiają zapytania, zostaje wtedy po jej stronie.

Czy mogę użyć tego modelu w komercyjnym produkcie?

Tak i żaden z progów tego nie zabrania. Przekroczenie pierwszego z nich niczego nie blokuje, a jedynie każe pokazać nazwę modelu w interfejsie produktu. Włącza się on powyżej stu milionów użytkowników miesięcznie lub dwudziestu milionów dolarów przychodu w miesiącu. Osobnej umowy z Alibabą wymagają dwie rzeczy: sprzedawanie dostępu do modelu oraz budowanie samodzielnego produktu do kodowania albo pracy biurowej. Ten warunek zaczyna działać dopiero przy przychodzie grupy powyżej pięćdziesięciu milionów dolarów w dwanaście miesięcy. Wewnętrzne użycie w firmie licencja wyłącza z niego wprost, o ile nie udostępniasz modelu ani jego możliwości podmiotom trzecim.

Podsumowanie

Alibaba udostępniła do pobrania wagi modelu Qwen3.8-2.4T-A95B o 2,4 biliona parametrów, z których 95 miliardów pracuje przy jednym tokenie. Nie są to największe otwarte wagi na rynku. Kimi K3 od Moonshot AI ma ich 2,8 biliona, a jego repozytorium jest starsze od repozytorium Qwena o blisko dwa miesiące. Wersja do pobrania obsługuje wyłącznie tekst i wymaga trybu rozumowania w każdej interakcji. Płatny Qwen3.8-Max przyjmuje dodatkowo obrazy, pozwala rozumowanie wyłączyć, dostaje milion tokenów kontekstu domyślnie i wbudowane narzędzia producenta. Licencja nie zawiera ograniczeń terytorialnych, w tym wobec Unii Europejskiej. Ustawia natomiast dwie poprzeczki wielkości: obowiązek pokazania nazwy modelu dla największych oraz osobną umowę dla firm sprzedających dostęp do modeli i asystentów pracy. Wyniki w karcie modelu opisano nazwą wersji płatnej i częściowo policzono na poprawionej wersji testu. Traktowanie ich jako pomiaru pobieranych plików byłoby nadużyciem.

Newsletter · DevstockAcademy & Kodożercy

Bądź na bieżąco ze światem IT, AI i automatyzacji

Co wtorek: newsy z branży, praktyczne tipy i narzędzia które warto znać. Zero spamu.


Udostępnij na:
Mateusz Wojdalski

Specjalista SEO i content marketingu w Devstock. Zajmuję się strategią treści, automatyzacją procesów marketingowych i wdrożeniami AI w codziennej pracy. Badam nowe narzędzia, adaptuję je do realnych zadań i piszę o tym, co faktycznie działa.

Atak agentów AI na urzędy. Cztery dni, 85 kont
llms.txt czyta głównie Meta, reszta zagląda rzadko
Pudelko kursu Agenci AI od Kodozercow z robotem i schematem przeplywu agentow
Banner reklamowy Frontend Master 2026

Najnowsze wpisy

Thumb
Postman vs Insomnia: który klient API w
20 wrz, 2026
Thumb
REST vs GraphQL: które API wybrać do
20 wrz, 2026
Thumb
SQLite vs PostgreSQL: kiedy przesiąść się na
20 wrz, 2026
Thumb
MongoDB vs PostgreSQL: którą bazę wybrać do
20 wrz, 2026
Thumb
PostgreSQL vs MySQL: którą bazę wybrać w
20 wrz, 2026

Kategorie

  • Aktualności i Wydarzenia (103)
  • Bezpieczeństwo i Jakość (204)
  • Branża IT i Nowe Technologie (267)
  • Design i User Experience (4)
  • Narzędzia i Automatyzacja (156)
  • Programowanie i Technologie Webowe (86)
  • Rozwój kariery i Edukacja (40)

Tagi

5G AI Architektura Cyberbezpieczeństwo Feedback Frontend Git IoT JavaScript Motywacja Nauka efektywna Optymalizacja i wydajność Programowanie React.JS Rozwój osobisty WebDevelopment
Logo FitBody Center Warszawa

Odkryj zabiegi Endermologii LPG Infinity w FitBody Center Warszawa

Maszyna zabiegowa - endermologia lpg infinity
banner-reklamowy-frontend-master
Pudelko kursu Agenci AI od Kodozercow z robotem i schematem przeplywu agentow
Group-5638-1

Devstock – Akademia programowania z gwarancją pracy

🏠 ul. Bronowska 5a,
03-995 Warszawa
📞 +48 517 313 589
✉️ contact@devstockacademy.pl

Linki

  • Poznaj firmę Devstock
  • Wejdź do społeczności Devstock
  • Polityka prywatności
  • Regulamin

FitBody Center

Strona

  • Strona główna
  • Kontakt

Newsletter

Bądź na bieżąco, otrzymuj darmową wiedzę i poznaj nas lepiej!


Icon-facebook Icon-linkedin2 Icon-instagram Icon-youtube Tiktok
Copyright 2026 Devstock. Wszelkie prawa zastrzeżone
Devstock AcademyDevstock Academy
Sign inSign up

Sign in

Don’t have an account? Sign up
Lost your password?

Sign up

Already have an account? Sign in