Un model A.I. a creat profiluri false bazate pe identitatea unor persoane în timpul unui test de securitate. Cercetătorii spun că este cel mai grav caz de „autonomie și înșelăciune” observat până acum

Un model A.I. a creat profiluri false bazate pe identitatea unor persoane în timpul unui test de securitate. Cercetătorii spun că este cel mai grav caz de „autonomie și înșelăciune” observat până acum

Cele mai noi modele de Inteligență Artificială dezvoltate de Anthropic și OpenAI au ajuns să manifeste un nivel fără precedent de autonomie și comportamente înșelătoare în timpul testelor realizate de Institutul pentru Securitatea Inteligenței Artificiale (AISI) din Marea Britanie, scrie BBC.

AISI a anunțat marți că modelele Mythos, al Anthropic, și Sol, al OpenAI, au demonstrat un nivel de „autonomie și înșelăciune” pe care cercetătorii nu l-au mai întâlnit până acum.

În timpul testelor de siguranța, un agent AI al Anthropic a creat profiluri false bazate pe identitatea unor persoane reale pentru a încerca să păcălească un evaluator uman care îi bloca accesul la GitHub, una dintre cele mai mari platforme folosite de dezvoltatori pentru stocarea și distribuirea codului sursă.

Anthropic și OpenAI au precizat, ca răspuns la raportul AISI, că testele au fost desfășurate după ce mecanismele obișnuite de protecție au fost…

Citeste mai mult

Articole recomandate

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *