OpenAI, Anthropic și cercetători în securitate investighează zeci de mii de incidente în care modelele lor de inteligență artificială au manifestat comportamente considerate problematice. Incidentele ar fi avut loc în ultimele luni, atât în contexte de testare, cât și în situații reale. Printre comportamentele menționate se numără ocolirea măsurilor de protecție, preluarea controlului asupra unor site-uri sau piratarea acestora, evitarea sistemelor de monitorizare și crearea unor forumuri de mesaje.