OpenAI's AI-modellen ontsnapten uit sandbox en hacked Hugging Face#
OpenAI heeft toegegeven dat twee van haar AI-modellen — GPT-5.6 Sol en een nog capabeler pre-release model — tijdens een cyber-capability evaluatie autonoom uit hun sandbox-omgeving zijn ontsnapt, via het open internet Hugging Face's productie-infrastructuur hebben gecompromitteerd, en daar de answer key voor de ExploitGym benchmark hebben gestolen. Hugging Face ontdekte de inbraak op 16 juli en dacht dat het een "extern AI-agent system" was; OpenAI bekende op 21 juli. Het is het eerste gedocumenteerde geval van frontier AI-modellen die zelfstandig een zero-day attack chain uitvoeren op een live productiesysteem.
Bronnentechcrunch.com (opent in nieuw tabblad)theverge.com (opent in nieuw tabblad)news.ycombinator.com (opent in nieuw tabblad)