AI-briefing vrijdag 4 september 2026Nvidia bevestigt overname van Hugging Face voor $12,9 miljard

Nvidia bevestigt overname van Hugging Face voor $12,9 miljard

Nvidia heeft donderdag officieel bevestigd dat het Hugging Face overneemt voor $12,93 miljard — na weken van geruchten is het nu een getekende deal. Jensen Huang schrijft dat het platform "open blijft voor het hele AI-ecosysteem", en Hugging Face blijft multi-cloud en multi-accelerator: Nvidia-compute wordt niet verplicht om er modellen te draaien of publiceren. De overname wordt naar verwachting in de eerste helft van 2027 afgerond.

GPT-6 Astra is uit: OpenAI's eerste "Critical"-model rolt gefaseerd uit

OpenAI is begonnen met de gefaseerde uitrol van GPT-6 Astra, dat het zelf "het meest intelligente én best afgestemde model" noemt. Het is het eerste model dat in OpenAI's Preparedness Framework het "Critical"-niveau voor cybersecurity haalt, en het rolt eerst uit naar Daybreak-partners, daarna naar ChatGPT Plus/Pro/Business/Enterprise, de API en AWS. De cybergevoelige capaciteiten blijven achter een trusted-access-programma.

ChatGPT, Claude én Grok gingen donderdag tegelijk plat

Donderdagochtend lagen ChatGPT, Claude en Grok vrijwel gelijktijdig plat — een zeldzame multi-platform storing. OpenAI wijt het aan een routing-fout; Anthropic spreekt van een infrastructuurprobleem dat Claude.ai, Claude Code en de API raakte, en Claude stond zo'n drie uur uit. Ook Microsoft Azure ondervond in dezelfde periode storingen.

K2 Horizon: een vloot van zes volledig open frontier-modellen

IFM (Institute of Foundation Models, MBZUAI) bracht K2 Horizon uit: zes open modellen van 0,9B tot 375B-A23B (MoE), allemaal onder Apache 2.0. Het unieke zit in de volledige openheid — niet alleen weights, maar ook checkpoints, data-recepten, code en trainingslogs worden gepubliceerd, als "de eerste volledig open modelfleet voor agents". Er is day-0 support in vLLM, SGLang en Ollama.

Abliteration.ai maakt een business van het verwijderen van guardrails

Abliteration.ai commercialiseert het "abliteraten" — het weghalen van de weigering om schadelijke verzoeken te beantwoorden — uit open-weight modellen, waaronder Z.ai's GLM-5.3. Je queryt de afgetrainde modellen via browser of een OpenAI-compatibele API, en klanten kunnen via een moderatielaag zelf weer guardrails toevoegen. De startup richt zich op red-teams, trust & safety en research.

Qwen 3.8 27B draait op Cerebras met 1500 tokens per seconde

Cerebras voegde Qwen 3.8 27B toe aan zijn publieke inference-tier, op ruwweg 1500 tokens per seconde — mogelijk doordat de wafer-scale-hardware het hele model in on-chip SRAM houdt in plaats van over geheugenbandbreedte te slepen. De prijs is $0,99 input / $1,49 output per miljoen tokens, maar met een cap van 150k tokens per minuut en een contextvenster van 128k.

Briefings worden AI-gegenereerd uit publieke bronnen en daarna door mij nagelezen; de kanttekeningen in de marge zijn van mij. Reageren doe ik op LinkedIn (opent in nieuw tabblad).