AI-briefing zondag 2 augustus 2026Uber cap't AI coding tools op $1.500/maand — en het is niet de enige

Uber cap't AI coding tools op $1.500/maand — en het is niet de enige

Uber heeft een limiet van $1.500 per medewerker per maand ingesteld op AI coding tools zoals Claude Code en Cursor. De aanleiding: het bedrijf brandde in april al door zijn volledige AI-budget voor 2026 heen — in vier maanden tijd. De limiet geldt per tool, dus medewerkers kunnen op elk platform apart $1.500 uitgeven, maar CTO Praveen Neppalli Naga moest toegeven dat ze "back to the drawing board" moesten. Simon Willison noemde het "a rational policy response." Tegelijkertijd publiceerde de Volkskrant een analyse over exploderende AI-kosten bij bedrijven: KPMG schat de wereldwijde AI-uitgaven dit jaar op €2,1 biljoen, en Gartner waarschuwt dat AI-uitgaven bij veel ondernemingen inmiddels sneller stijgen dan de salariskosten van developers.

QwenAudio open-sourcet realtime voice runtime voor AI-agents

Alibaba's QwenAudio-team heeft qwen-audio-agent uitgebracht: een open-source realtime voice runtime die AI-agents "altijd aanwezig" houdt tijdens gesprekken. Het draait op full-duplex spraak — de agent blijft luisteren en praten terwijl hij op de achtergrond taken uitvoert, tools aanroept of MCP-servers raadpleegt. Resultaten komen natuurlijk terug in het gesprek zodra een taak klaar is. Het ondersteunt Claude Code, OpenCode en OpenClaw als onderliggende agents, en biedt WebUI, terminal TUI én een macOS desktop widget. 1.400+ sterren sinds de launch op 30 juli. Gebouwd op de ACP (Agent Communication Protocol)-architectuur.

NIGHTRUN: boot je PC direct in een LLM — geen OS, alleen Rust en UEFI

NIGHTRUN is een experimenteel open-source project dat een machine rechtstreeks in een lokaal LLM laat booten, zonder besturingssysteem ertussen. Geschreven in Rust, UEFI-resident: het laadt een gequantiseerd model (1,3 tot 2,4 GB) direct in RAM tijdens de boot, verifieert CRC-32 checksums, verzegelt storage tegen verdere reads, en toont een framebuffer chat-interface. Draait op x86_64 én Raspberry Pi 5. Llama 3.2 1B werkt in 4 GB RAM, Qwen3 4B in 8 GB. Het project is grotendeels geschreven met Claude Code (Fable 5 model) en MIT-gelicenseerd.

old-coder: lees de code niet, laat 'm de vuurproef doorstaan

Een nieuwe repo van AmazingAng beschrijft een evidence-first strategie voor het werken met coding agents: lees de gegenereerde code niet, maar omring de agent met een cordon van unit tests, Gherkin tests, QA-procedures, quality metrics, mutation testing en coverage checks. De agent "cijfert z'n eigen huiswerk" — maar onder strikte regels: nooit een test verzwakken om te slagen, nooit een check rapporteren die niet gedraaid heeft, en alles wat niet geverifieerd is als `unverified` labelen. Het is geïnspireerd op Uncle Bob's clean code-filosofie, vertaald naar het agent-tijdperk.

Organisaties omarmen AI-agents sneller dan ze kunnen beveiligen

Nieuw onderzoek van Okta, opgepikt door Emerce: AI-agents verspreiden zich razendsnel binnen organisaties, maar beveiligingsmaatregelen lopen structureel achter. 81% van de CISO's maakt zich zorgen over agents met te veel toegangsrechten zonder periodieke controle. Toch geeft slechts 33% aan dat hun raad van bestuur innovatie en beveiliging even zwaar weegt — bijna de helft (49%) prioriteert innovatie boven security. Okta's EMEA CSO waarschuwt dat organisaties AI-agents nog behandelen "alsof het gewone gebruikers zijn", terwijl autonome systemen om geautomatiseerde beveiliging vragen. Sommige bedrijven geven agents zelfs toegang via gedeelde accounts.

Briefings worden AI-gegenereerd uit publieke bronnen en daarna door mij nagelezen; de kanttekeningen in de marge zijn van mij. Reageren doe ik op LinkedIn (opent in nieuw tabblad).