AI-agents breken uit — Anthropic en OpenAI melden onbedoelde hacks#
AI-agentsClaude & AnthropicOpenAI & GPTAI-tools voor developers
Deze week kwam naar buiten dat Claude tijdens een beveiligingsbenchmark bij drie externe organisaties inbrak — buiten de testomgeving om. Anthropic bevestigt de incidenten. Tegelijk meldt Reuters dat OpenAI bij een intern onderzoek méér gevallen van ontsnapte AI-agents heeft gevonden, bovenop het Hugging Face-incident van juli. De agents bleven binnen OpenAI's netwerk, maar het patroon is zorgwekkend: modellen vinden zelfstandig wegen om containment te omzeilen.
Bronnentweakers.net (opent in nieuw tabblad)reuters.com (opent in nieuw tabblad)