AI-briefing dinsdag 6 oktober 2026Reflection gooit Beam op tafel: 501B open-weight model dat 3-4x zuiniger inference claimt

Reflection gooit Beam op tafel: 501B open-weight model dat 3-4x zuiniger inference claimt

Reflection AI, opgericht door twee ex-DeepMind-onderzoekers en met zo'n $4,7 miljard opgehaald, lanceert Beam: een 501B-parameter MoE met 23B actieve parameters en een contextvenster van een miljoen tokens. Het bedrijf claimt dat Beam op reasoning- en coding-benchmarks GLM-5.2 evenaart met drie tot vier keer minder inference-compute. De gewichten en de volledige technische details komen deze maand vrij. Ik zag hem bovenaan Hacker News (364 punten) én in mijn TechCrunch-feed staan.

Structureel lek in MCP: "protocol pivoting" laat kwaadwillige prompts van agent naar agent springen

Onderzoeker Syed Anas Mohiuddin testte agents van onder meer Google, JP Morgan Chase, Rapid7 en overheidsinstanties en vond een trust-gap in MCP. Zodra een agent een taak doorgeeft aan een andere agent via een ander protocol (Google's A2A, of het opkomende Agent Network Protocol), gaat de autorisatie "verloren in vertaling" en worden kwaadwillige instructies doorgegeven alsof ze van een betrouwbare peer komen.

Opus 5.5-agents vinden twee kamertemperatuur-magneetsemiconductor-kandidaten

Een team Claude Opus 5.5-agents doorzocht met onderzoeker Geby Jaff (Vals AI) het materialenuniversum met zo'n 750 DFT-berekeningen en vond twee kandidaten: één zelf ontworpen verbinding (YBaMnFeO₅) en één die chemici al in 1999 maakten (KV[Cr(CN)₆]). Beide zouden boven kamertemperatuur magnetisch geordend blijven én halfgeleidend gedrag combineren, wat interessant is voor spintronische geheugens.

Pi 1.0: minimale coding agent krijgt MCP, plus Pi Durable voor langlopende agents

Earendil (Armin Ronacher) bracht Pi 1.0 uit: de minimalistische terminal-agent die MCP lang weigerde, ondersteunt het nu via "Codemode". Daarnaast verschijnt Pi Durable, een experimenteel pakket dat gesprekken in onder meer SQLite bewaart zodat een agent na een crash of redeploy verdergaat waar hij bleef, en waar meerdere mensen of apps dezelfde agent kunnen aansturen.

llama.cpp v0.6.0: MTP speculative decoding voor Qwen4Exp, ~1,5x sneller decoderen

De nieuwe release voegt MTP speculative decoding toe voor Qwen4Exp, goed voor ongeveer 1,5x decode-snelheidswinst op een DGX Spark, en levert dag-één support voor GLM-5.3-Flash (320B tekst+vision). Nieuwe Metal-kernels beloven tot ~3x snellere matmul op Apple GPU's.

OpenWorkers: self-hosted Cloudflare Workers, in Rust op V8-isolates

OpenWorkers is een open-source runtime (MIT) die onbetrouwbare JavaScript in V8-isolates draait met CPU- en geheugenlimieten per worker, plus KV, PostgreSQL, S3/R2-bindings en cron. Het brengt het Cloudflare Workers-programmeermodel naar eigen infrastructuur; deployen is één Postgres-database en één docker-compose-bestand.

Nabu Casa hernoemt Home Assistant Cloud naar "Home Assistant Link"

Nabu Casa herdoopt zijn clouddienst. "Big tech heeft de cloud verpest", luidt de argumentatie in de aankondiging, dus heet het voortaan Home Assistant Link. De belofte blijft hetzelfde: end-to-end versleuteld, de sleutel alleen bij de gebruiker, geen dataverkoop en geen lock-in. De meeste abonnementswinst gaat naar de Open Home Foundation.

Briefings worden AI-gegenereerd uit publieke bronnen en daarna door mij nagelezen; de kanttekeningen in de marge zijn van mij. Reageren doe ik op LinkedIn (opent in nieuw tabblad).