Mistral AI prezentuje model ML4 zbudowany na europejskiej infrastrukturze

Europejski start-up Mistral AI zaprezentował swój najnowszy, natywnie multimodalny model sztucznej inteligencji Mistral Large 4 z otwartymi wagami. Rozwiązanie o łącznej liczbie biliona parametrów jest obecnie dostępne w publicznej wersji testowej API, a pełne wagi zostaną udostępnione jeszcze w tym miesiącu. Nowa wersja została zaprojektowana z myślą o zaawansowanych zadaniach programistycznych, finansowych oraz związanych z cyberbezpieczeństwem. 

 

 

Europejska infrastruktura i niezależność cyfrowa

Mistral Large 4 został wytrenowany od podstaw w europejskich centrach danych firmy na 3800 układach NVIDIA Grace Blackwell. Firma podkreśla, że otwarte wagi oraz możliwość samodzielnego wdrożenia rozwiązania pozwalają organizacjom zachować większą kontrolę nad wykorzystywaną sztuczną inteligencją. Znacząca część danych treningowych obejmowała ponad 160 języków, w tym wszystkie oficjalne języki Unii Europejskiej. Architektura typu Mixture of Experts wykorzystuje 49 mld aktywnych parametrów spośród biliona wszystkich, co pozwala ograniczyć zapotrzebowanie na moc obliczeniową. API wyceniono na 1,36 dolara za milion tokenów wejściowych oraz 4,18 dolara za milion tokenów wyjściowych. Mistral Large 4 jest pierwszym etapem planu rozwoju finansowanego z rundy serii D o wartości 3 mld euro.

 

Wysokie wyniki w obszarze cyberbezpieczeństwa i programowania

Nowe rozwiązanie osiąga czołowe rezultaty w niezależnych testach cyberbezpieczeństwa, uzyskując 82% skuteczności w odtwarzaniu i naprawianiu luk w oprogramowaniu open-source w ramach benchmarku AA Cyber Index. W teście Cybench rozwiązuje 93% zadań, co stanowi jeden z najwyższych wyników odnotowanych dla modelu z otwartymi wagami. Mistral AI zwraca uwagę, że niektóre zamknięte wersje AI odmawiają wykonywania takich testów bezpieczeństwa ze względu na stosowane mechanizmy ochronne, co może ograniczać możliwości zespołów zajmujących się bezpieczeństwem cyfrowym. W Coding Agent Index wynik 49,8% daje mu przewagę nad DeepSeek V4 Pro 0813 i Qwen3.8 Max. Wykazuje on również odporność na pośrednie ataki typu prompt injection, powstrzymując 93,3% z nich w teście Lakera B3.

 

Zaawansowana analiza dokumentów oraz arkuszy finansowych

Mistral Large 4 umożliwia realizację złożonych prac biurowych, w tym tworzenie i edycję arkuszy kalkulacyjnych oraz analizę dokumentacji prawnej. Zewnętrzne ewaluacje na platformie vals.ai wykazały, że Mistral Large 4 przewyższa GPT-6 Astra w testach finansowych i prawniczych HarveyAI. Ponadto architektura multimodalna pozwala na dokładne przetwarzanie danych wizualnych, rysunków technicznych CAD oraz zdjęć satelitarnych. W ramach uczenia ze wzmocnieniem podczas treningu na 3000 układach GPU generowanych jest około 33 mld tokenów dziennie.