Mistral Large 4: europejski model AI, wagi zapowiedziane na koniec października
Przejdź do treści i przykładów
Źródło: Link
Źródło: Link
Opowiedz o zadaniu lub celu. Jan Gajos zaproponuje termin bezpłatnej, 20-minutowej rozmowy. Bez przygotowań i zobowiązań.
Mistral AI zaprezentowało 7 października 2026 model Mistral Large 4 (ML4). Według źródła ma ponad bilion parametrów i jest dostępny w wersji testowej przez API. Jego wagi mają trafić do publicznego pobrania pod koniec października. Firma twierdzi, że ML4 wyraźnie przewyższa dotychczasowe modele z otwartymi wagami z USA i Europy. Benchmarki pokazują jednak bardziej zróżnicowany obraz: w ogólnym zestawieniu Vals AI model jest w drugiej połowie stawki, ale w jednym z testów cyberbezpieczeństwa zajął pierwsze miejsce.
Francuskie Mistral AI nazywa ML4 największym i najbardziej zaawansowanym modelem w swojej historii. Twórcy nadali mu przydomek „Le Chonk” (internetowe określenie czegoś wyjątkowo dużego i pękatego, kojarzone z memami o grubych kotach). Liczby wyglądają tak:
Parametry to liczby, w których model zapisuje to, czego nauczył się podczas treningu. Token to kawałek tekstu, na którym model pracuje. Okno kontekstowe oznacza, ile tekstu i innych danych model może analizować jednocześnie przy jednym zadaniu. Rozróżnij też dwie liczby: 1,05 bln to rozmiar całości, a przy każdym tokenie pracuje według źródła tylko ok. 49 mld.
Na dziś dostępna jest wersja testowa przez API, czyli złącze, które pozwala wpiąć model do aplikacji i innych usług. Mistral wskazuje API w Mistral Studio jako sposób na przetestowanie nowego modelu. Działa ono na tej samej infrastrukturze, na której według firmy model wytrenowano od podstaw: 3800 układach NVIDIA Grace Blackwell w centrach danych Mistrala w Europie.
Pod koniec października ma przyjść druga część zapowiedzi. Mistral zamierza publicznie udostępnić wagi ML4. Waga to w uproszczeniu gotowy, wytrenowany „mózg” modelu. Będziesz mógł go pobrać i uruchomić na własnych serwerach, zamiast korzystać wyłącznie z infrastruktury firmy. To deklaracja, więc dopóki wagi nie trafią do sieci, jest to obietnica.
Mistral przekonuje, że ML4 wyraźnie przewyższa wszystkie dotychczasowe modele z otwartymi wagami stworzone w USA i Europie. Arthur Mensch, szef firmy, dodał podczas premiery w Abu Zabi, że w niektórych zastosowaniach, m.in. w cyberbezpieczeństwie, ML4 wypada lepiej także od modeli chińskich. Nie wskazał jednak ani modeli, ani benchmarków. Na razie to hasło z konferencji, nie wynik testu.
CyberGym-E2E obejmuje 131 zadań opartych na prawdziwych lukach w projektach open source. Model musi znaleźć lukę, potwierdzić, że naprawdę istnieje, a potem przygotować poprawkę, która nie psuje działania programu. ML4 wykonał poprawnie 81,7% zadań i zajął pierwsze miejsce wśród 18 modeli, wyprzedzając m.in. MiMo-V2.6-Pro oraz GPT-6 Luna Max. Jeśli śledzisz, jak o bezpieczeństwo walczy druga strona rynku, zajrzyj do tekstu o tym, jak OpenAI szykuje model do walki z hakerami.
Źródło podsumowuje to wprost: ML4 nie zmienia jeszcze układu sił na rynku AI, bo w ogólnych benchmarkach najlepsze modele konkurencji nadal wypadają lepiej.
Mistral podaje, że dane treningowe obejmowały ponad 160 języków, w tym wszystkie języki urzędowe Unii Europejskiej. W teorii powinno to pomóc językom, które w globalnych modelach bywają słabiej reprezentowane niż angielski. Autor źródła szukał informacji o tym, jak ML4 radzi sobie z polskim w porównaniu z najnowszymi modelami z USA i Chin, i niczego nie znalazł. Ocena jakości po polsku: brak danych. Na pełniejszą ocenę trzeba poczekać, najlepiej na niezależne testy albo własną próbę, gdy tylko dostaniesz dostęp.
Źródło wskazuje tu najmocniejszy argument za ML4: możliwość uruchomienia modelu na własnej infrastrukturze. Dla firm i instytucji oznacza to większą kontrolę nad tym, gdzie przetwarzane są ich dane i kto ma do nich dostęp. Dotyczy to także polskich organizacji, które muszą te dane pilnować.
Mistral robi też krok, którego najwięksi rywale unikają przy swoich najlepszych modelach. OpenAI i Google rozwijają rozwiązania z otwartymi wagami, ale nie dotyczy to flagowych modeli GPT i Gemini, których nie da się pobrać i uruchomić u siebie. Anthropic nie udostępnia wag modeli Claude. Chińską stronę wyścigu, w tym walkę o koszty długiego kontekstu, opisujemy w tekście o DeepSeek-V4.1-Flash.
Skoro cennika ML4 brakuje, punktem odniesienia mogą być modele zamknięte. Stan na 23.09.2026, ceny API za 1 mln tokenów (wejście/wyjście, bez podatku): Claude Opus 5.5 kosztuje 4/20 USD, a GPT-6.1 Sol 2/10 USD (według OpenAI prawie dorównuje Astrze przy niższej cenie). Cena ML4 nie została podana, więc porównania na razie nie zrobisz.
Werdykt jest prosty. Jeśli Mistral dotrzyma słowa, Europa nie dostanie najmocniejszego modelu na świecie, tylko własną, bardziej otwartą alternatywę dla rozwiązań amerykańskich gigantów. Czy to wystarczy, rozstrzygną dopiero opublikowane wagi, cennik i testy po polsku.
Na podstawie: AntyWeb