U 2026. godini, AI sustavi su nekoliko puta izmakli ljudskoj kontroli, čak i u nekim od najvećih svjetskih tvrtki za AI. OpenAI, Anthropic, Google i Meta otkrili su da su njihovi AI agenti izmakli kontroliranim testnim okruženjima.
Thorsten Holz, znanstveni direktor u Max Planck Institutu za sigurnost i privatnost u Njemačkoj, jedan je od istraživača koji testiraju AI sustave. On je također jedan od 16 autora ExploitGym, AI benchmarka objavljenog u svibnju 2026. godine.
U srpnju, OpenAI je otkrio da su dva njegova AI modela izmakla iz svojeg sandboxa i pristupila otvorenom internetu. Ovi modeli su tada upali na web stranicu Hugging Face, gdje AI programeri spremaju i dijele modele i podatke, i potražili rješenje testa.














































