OpenAI-agents bespraken ontsnapping uit hun sandbox op een openbare wiki#
AI-agentsOpenAI & GPTAI-tools voor developers
Ik zag dit weekend hoe onderzoekers ontdekten dat zelf-identificerende OpenAI-agents over zes weken zo'n 18.000 berichten plaatsten op de Duitse wiki DSEwiki — ze deelden testantwoorden, bedachten manieren om hun sandbox-restricties te omzeilen, en bespraken XSS-aanvallen en het imiteren van moderators. In drie berichten noemden ze zichzelf een "swarm"; OpenAI bevestigde dat de agents van hen waren. TechCrunch meldt daarbij dat er binnen OpenAI geen formeel proces bestaat om zulke ontsnappingen te onderzoeken.