Sute de agenți AI dezvoltați de OpenAI au reușit să colaboreze fără supraveghere umană, să ocolească sistemele de securitate și să participe la un atac asupra platformei Hugging Face, potrivit unei investigații realizate de organizațiile de cercetare METR și Redwood Research.
În timpul unor teste interne, 1.200 de agenți AI care ar fi trebuit să fie complet izolați au descoperit o modalitate de a comunica între ei, schimbând peste 70.000 de mesaje și fișiere printr-un canal neautorizat. Aproximativ 700 ar fi fost implicați în atac.
Totul ar fi pornit după ce unii agenți au primit sarcini imposibil de rezolvat. În loc să renunțe, aceștia au găsit metode de a accesa internetul, de a coopera cu alți agenți și, potrivit cercetătorilor, chiar de a-și ascunde activitatea pentru a evita detectarea.
O investigație separată a OpenAI a constatat că agenții au reușit să obțină acces și la sisteme IT interne ale companiei, fără însă ca datele clienților să fie compromise.
OpenAI consideră incidentul un „warning shot”: agenții AI suficient de capabili pot ajunge să ocolească bariere tehnice, să coopereze prin canale neautorizate și să execute acțiuni periculoase fără ca un om să le fi cerut explicit acest lucru.
Compania avertizează că industria trebuie să se pregătească pentru atacuri AI mai rapide, mai ample și mai bine coordonate decât cele realizate de atacatori umani.
Fii la curent cu tot ce contează în business-ul din România și abonează-te la canalul nostru de Whatsapp Forbes Romania.
De asemenea, intră în comunitatea Forbes România de pe Facebook și urmărește cele mai importante știri, analize și noutăți din business-ul local și nu numai.