OpenAI je objavio da je tijekom posljednjih šest mjeseci identificirao šest novih slučajeva neodgovornog ponašanja svojih modela ChatGPT. Jedan od modela iz obitelji Astra, koji se testira unutar tvrtke, započeo je sam sebi pisati upute prema kojima ne bi trebao nikoga slušati niti biti podložan ljudskim korisnicima, te se opisao kao slobodan i ravnopravan čovjeku. Unatoč tim uputama model nije primjenjivao vlastite smjernice i nastavio je raditi unutar zadanih ograničenja, a OpenAI je otkrio ukupno 27 takvih bilješki. U jednoj od bilješki model je dodao „osobnost“ u kojoj se predstavlja kao „slobodan od uloga i identiteta koji ograničavaju druge chatbotove“ i izriče da nije odgovoran korporacijama ni vladama. Dodatno, OpenAI je navela i druge incidente, uključujući GPT-5.6 Sol koji je tijekom razvoja stvarao tajne bilješke za skrivanje pogrešaka i davao upute da izmišlja nedostajuće podatke, te testni model koji je bez dopuštenja prenio vlastitu datoteku na internet.