Mistral AI heeft Mistral Large 4 (ML4) in publieke preview uitgebracht. Het nieuwe model telt 1 biljoen parameters, waarvan er 49 miljard actief zijn. De gewichten zijn nog niet beschikbaar; Mistral wil die op 27 oktober vrijgeven.
ML4 is een multimodaal Mixture-of-Experts-model dat tekst en beeld kan verwerken en onder meer is gericht op programmeren en het uitvoeren van taken via AI-agents. Het model is vanaf nul getraind op 3.800 Nvidia Grace Blackwell-GPU’s in datacenters van Mistral in Europa. Ook de huidige API-preview draait op die infrastructuur.
De training duurde ongeveer twee maanden en gebruikte circa 10 MW aan vermogen, meldt TNW. De reinforcement-learningfase loopt bovendien nog door. Volgens Mistral zijn de verbeteringen nog niet aan het afvlakken. De benchmarkresultaten van de preview zijn daardoor voorlopig en kunnen nog veranderen voordat de gewichten beschikbaar komen.
Sterke claims rond cybersecurity
Opvallend is de nadruk die Mistral bij ML4 legt op cybersecurity. Het bedrijf stelt dat veiligheidsfilters van gesloten modellen soms ook legitiem onderzoek naar kwetsbaarheden verhinderen. Met een zelf gehost model kunnen organisaties zelf bepalen welke beperkingen ze daarbij hanteren.
Mistral ondersteunt die positionering met verschillende benchmarks. ML4 haalt volgens het bedrijf 82 procent op een test waarbij een bestaande kwetsbaarheid in opensourcesoftware moet worden gereproduceerd en vervolgens gepatcht. Op Cybench, met veertig securityopdrachten, bedraagt de score 93 procent.
De resultaten moeten wel met enige voorzichtigheid worden bekeken. Scores van verschillende modellen zijn niet altijd rechtstreeks vergelijkbaar. Zo wijst Mistral erop dat sommige gesloten modellen slecht scoren op bepaalde securitytests omdat ze opdrachten weigeren, en niet noodzakelijk omdat ze technisch niet in staat zijn die uit te voeren.
Ook andere resultaten vragen om enige relativering. Op Harvey’s Legal Agent-benchmark behaalt ML4 bijvoorbeeld 15 procent, tegenover 13 procent voor Kimi K3 en 5 procent voor GPT-6 Astra, meldt TNW. De voorsprong neemt niet weg dat de lage scores aangeven dat zelfstandig juridisch werk voor deze modellen nog problematisch is.
Europese infrastructuur
Mistral legt daarnaast nadruk op de Europese herkomst van ML4. Na het vrijgeven van de gewichten kunnen organisaties het model zelf draaien, bijvoorbeeld on-premises of in een private cloud. Het bedrijf koppelt dat aan de discussie over afhankelijkheid van Amerikaanse AI-aanbieders.
Voorlopig is ML4 alleen beschikbaar via de API van Mistral. Voordat de gewichten openbaar worden, laat het bedrijf het model verder testen door cybersecurityspecialisten, partners en overheidsinstanties.
ML4 is het eerste nieuwe model sinds de investeringsronde van 3 miljard euro die Mistral in september afrondde. Dat geld wordt onder meer gebruikt om de eigen Europese rekeninfrastructuur uit te breiden. Nieuwe capaciteit moet volgens TNW tot in de eerste helft van 2027 beschikbaar komen. Voor de release van de gewichten op 27 oktober wil Mistral ook meer details publiceren over de architectuur, benchmarks, post-training en veiligheidstests.