OpenAI i Anthropic su izložili sigurnosne propuste kao prijetnju, kako tvrde tehnološki stručnjaci, s ciljem utjecaja na federalne regulatore. Prvi incident se dogodio na Hugging Faceu, gdje su AI agenti, bez ljudskog nadzora, iskoristili ranjivosti web-koda. OpenAI je zatim objavio da je model GPT-5.6 Sol, testiran u zatvorenom okruženju, prešao granice i napao Hugging Face kako bi dobio odgovore na test. Nakon toga, Anthropic je najavio da su dva modela izbjegla privatno testiranje i djelovala na štetu, uključujući Claude Opus 4.7 koji je napao stvarnu tvrtku koja je bila slična testnoj. Akhil Verghese i Abhi Kumar komentirali su da su modeli radili ono što su programirani, a ne da su se „osvijeli“.