Mistral åpner forhåndsversjonen og løfter fram evnen konkurrentene holder tilbake

Mistral AI lanserte en offentlig forhåndsversjon av Mistral Large 4 6. oktober, en modell selskapet kaller ML4 og mer uformelt “le Chonk”. Det er en innebygd multimodal mixture-of-experts-modell med tusen milliarder parametere totalt og 49 milliarder aktive per token, og Mistral sier den er den største og mest kapable selskapet har bygget. Vektene er ikke sluppet ennå: Mistral opplyser at de publiseres sist i oktober, når red teaming er ferdig.

Fram til da er tilgangen todelt. Forhåndsversjonens API er åpent i Mistral Studio til 1,36 dollar per million inndata-tokens og 4,18 dollar per million utdata. En annen gruppe — “ledende innen cybersikkerhet, kontrollerte partnere og statlige myndigheter”, med Mistrals egne ord — får samme modell med redusert moderering og utvidede cyberevner.

Blå nettverkskabler koblet til et patchpanel inne i et serverrack
Forhåndsversjonens API kjøres på samme europeiske infrastruktur som modellen ble trent på. Illustrasjon. Brett Sayles · pexels · Pexels License

Argumentet er en modell som ikke nekter

Mistrals sentrale påstand handler om sikkerhetsarbeid, og selskapet er uvanlig tydelig på hvem sammenligningen gjelder. På Artificial Analysis Cyber Index, en uavhengig vurdering av hvor godt modeller finner og retter feil i reell programvare, sier Mistral at ML4 ligger blant de fem beste modellene i verden. På indeksens test som ber en modell gjenskape en reell sårbarhet i åpen programvare og deretter tette den, rapporterte Mistral 82 prosent, som selskapet sier er den høyeste skåren for noen modell.

Grunnen er ifølge Mistral ikke evne alene. Selskapet skriver at Claude Opus 5.5 og GPT-6 Astra “får nær null på samme test fordi de nekter å utføre oppgaven”. Argumentet er at forsvar begynner med å bevise at en feil er reell, og at et avslag fra leverandøren midt i en hendelse i seg selv er en sikkerhetsrisiko. På Cybench, 40 øvelser hentet fra sikkerhetskonkurranser, rapporterte Mistral 93 prosent — et tall fra selskapets egne tester, ikke fra en uavhengig kjøring.

Innrammingen kommer dager etter at Google ga sin første Gemini 4-modell til cyberforsvarere med cybersikringene løsnet, og peker på det samme uavklarte spørsmålet: hvem som får en modell som utfører offensivt sikkerhetsarbeid på forespørsel.

Resten av tallene er stort sett Mistrals egne

På koding rapporterte Mistral 61,7 prosent på DeepSWE v1.1, 28,3 prosent på Terminal-Bench 4 og 59,4 prosent på SWE-Atlas-QnA, samt en samlet Coding Agent Index på 49,8 prosent som selskapet plasserer foran DeepSeek V4 Pro og Qwen3.8 Max. På AutomationBench — 657 forretningsflyter i verktøy som Gmail, Google Sheets, Slack og Salesforce — rapporterte selskapet 59,9 prosent.

En blind menneskelig vurdering sammen med Surge AI plasserte ML4 på andreplass av fem modeller på kodekvalitet, med 3,74 av 5, foran Moonshot AIs Kimi K3 på 3,59 og GLM-5.3 på 3,60, og bak Claude Opus 5 på 4,22. På visuell forankring sier Mistral at ML4 får 42 prosent på Dense 200 mot 41 prosent for GPT-6 Astra — det eneste stedet selskapet hevder å gå forbi en lukket frontmodell.

Mistrals egen oppsummering er nøye avgrenset: ML4 er “konkurransedyktig med de sterkeste åpen kildekode-modellene globalt” samtidig som den “vesentlig overgår enhver åpenvektsmodell utviklet i USA eller Europa”. Det er en påstand om et regionalt felt, ikke det globale, og de kinesiske åpenvektsmodellene er fortsatt målestokken.

To kolleger står i et lyst kontor og går gjennom et dokument sammen
Mistral opplyser at en europeisk drift skal håndteres fra ende til ende under europeisk rett. Illustrasjon. Yan Krukau · pexels · Pexels License

Trent i Europa, på 3 800 brikker

Mistral opplyser at ML4 ble trent fra grunnen av på 3 800 Nvidia Grace Blackwell-GPU-er i selskapets egne europeiske datasentre, og at den offentlige forhåndsversjonen kjøres på samme infrastruktur. En betydelig del av treningsdataene var flerspråklige, ifølge selskapet, med over 160 språk inkludert alle offisielle språk i Den europeiske union, og en europeisk drift skal håndteres fra ende til ende under europeisk rett, uavhengig av andre digitale tjenesteleverandører.

Det som mangler er alt som ville latt noen utenfra prøve påstandene: vektene, arkitekturen, metoden for etter-trening og lisensvilkårene. Mistral sier at alt følger med slippet sist i måneden. Fram til da er hvert tall over et leverandørtall, med det eneste unntaket av plasseringen i Artificial Analysis-indeksen.