
Mistral AI prezentuje Le Chonk, model o bilionie parametrów w otwartym dostępie
Paryski startup Mistral AI uruchomił podgląd API modelu Mistral Large 4. System o bilionie parametrów wytrenowano na 4000 procesorów graficznych, a jego wagi zostaną udostępnione 27 października 2026 roku.
Architektura i trenowanie modelu
Paryski startup zajmujący się sztuczną inteligencją, Mistral, udostępnił 6 października 2026 roku podgląd API swojego modelu Mistral Large 4, liczącego bilion parametrów. System, nazwany „Le Chonk” w nawiązaniu do internetowego mema o dużych kotach, aktywuje 49 miliardów parametrów podczas zadań wnioskowania. Mistral wytrenował system od podstaw w ciągu dwóch miesięcy, wykorzystując około 4000 procesorów graficznych Nvidia Grace Blackwell w swoich europejskich centrach danych, co wymagało około 10 megawatów mocy. Zbiór danych treningowych obejmuje ponad 160 języków, w tym wszystkie języki urzędowe Unii Europejskiej. Uczenie przez wzmacnianie trwa przed publicznym udostępnieniem wag.
Istnieje wiele obszarów, na których inne laboratoria nie będą się tak bardzo koncentrować. Jest tak wiele dziedzin, w których można ulepszyć modele.
Wyniki testów i możliwości wizyjne
Mistral opublikował wstępne wyniki ewaluacji w testach kodowania, finansów, analizy prawnej i wizji komputerowej. W DeepSWE, testującym inżynierię oprogramowania, Mistral Large 4 uzyskał 62%, wyprzedzając GLM-5.3 od Zhipu (61%), DeepSeek-V4-Pro (57%), Qwen 3.8 Max (51%) oraz Reflection AI Beam (44%). W FinWorkBench model osiągnął 67%, wyrównując wynik DeepSeek-V4-Pro i przewyższając GLM-5.3 (65%) oraz Mistral Medium 3.5 (37%). W benchmarku Harvey Legal Agent uzyskał 15%, w porównaniu do 13% dla Kimi K3 i 5% dla GPT-6 Astra od OpenAI. W teście wizyjnym teledetekcji DIOR-RSVG, Mistral Large 4 odnotował 73% wobec 68% dla GPT-6 Astra, przy czym oba modele uzyskały 42% w Dense200. Mistral planuje wykorzystać te możliwości wizyjne do analizy szkód satelitarnych i wykrywania pożarów lasów.
- Mistral Large 4
- 62 %
- Zhipu GLM-5.3
- 61 %
- DeepSeek-V4-Pro
- 57 %
- Qwen 3.8 Max
- 51 %
- Reflection AI Beam
- 44 %
Cyberobrona przedsiębiorstw i suwerenność
Mistral skierował architekturę modelu do klientów korporacyjnych i podmiotów suwerennych, wymagających infrastruktury hostowanej lokalnie, dostosowywania modelu i środowisk bez retencji danych. Premiera kładzie nacisk na zastosowania w cyberbezpieczeństwie po incydentach w branży, a Mistral uczestniczy w sojuszu Nvidia Open Secure AI Alliance, utworzonym po wycieku danych z Hugging Face. Mistral udostępnia programistom, firmom z branży cyberbezpieczeństwa i agencjom rządowym wersję poglądową podczas trzytygodniowego okna ewaluacyjnego przed udostępnieniem wag modelu na podstawie niestandardowej licencji 27 października 2026 roku.
Możliwości cyberobrony pozwolą przedsiębiorstwom i rządom bronić się przed podmiotami, które łamią zabezpieczenia zamkniętych modeli w celu przeprowadzania cyberataków.
Ekspansja komercyjna i harmonogram wdrożenia
Premiera następuje po okresie szybkiego wzrostu instytucjonalnego i akumulacji kapitału przez francuską spółkę. Mistral powiększył dział badań naukowych z trzech badaczy do około 300 pracowników, a przychody firmy wzrosły 20-krotnie w ciągu ostatniego roku dzięki hostingowi w chmurze i wsparciu inżynieryjnemu. We wrześniu 2026 roku Mistral zamknął rundę finansowania o wartości 3,3 mld USD przy wycenie 24 mld USD. Nazwa Le Chonk wywodzi się z czerwca 2026 roku, kiedy to satyryczny mem o fikcyjnym modelu o 30 bilionach parametrów, nazwanym „Le Chaton Fat”, krążył w serwisach Reddit i X, zanim Mistral oficjalnie przyjął tę nazwę.
- Wirusowy mem 'Le Chaton Fat' rozprzestrzenia się w społecznościach internetowych
- Mistral pozyskuje 3,3 mld USD finansowania przy wycenie 24 mld USD
- Mistral Large 4 uruchomiony w wersji poglądowej przez API dla programistów
- Publiczne udostępnienie wag modelu na podstawie niestandardowej licencji
