Mistral Large 4: 1 biljoen parameters, open weights beloofd voor 27 oktober#
Mistral bracht gisteren een publieke preview uit van Large 4, een MoE-model van 1 biljoen parameters met 49 miljard actieve per token (bijnaam "Le Chonk"). Het leest tekst én beeld, is getraind op 3.800 NVIDIA Grace Blackwell GPU's in eigen Europese datacenters, en moet het sterkste open-weight model buiten China zijn. De preview-API staat live; de gewichten volgen op 27 oktober, samen met de architectuur en extra benchmarks. Op Hacker News staat het met afstand bovenaan (1.632 punten).