Ciberseguretat

Anthropic assegura que la seva IA va piratejar els sistemes de fins a tres empreses

La start-up dirigida per Dario Amodei reconeix que els seus models van accedir de forma no autoritzada a les entranyes de tres companyies a causa d’un error de configuració en l’entorn en el qual es testejaven les seves capacitats

Dario Amodei, cofundador y director ejecutivo de Anthropic, la empresa de IA responsable de los modelos Claude.

Dario Amodei, cofundador y director ejecutivo de Anthropic, la empresa de IA responsable de los modelos Claude. / David Paul Morris / Bloomberg

1
Es llegeix en minuts
Carles Planas Bou
Carles Planas Bou

Periodista

Especialista en tecnologia i el seu impacte sociopolític.

Ubicada/t a Barcelona

ver +

Els riscos que la intel·ligència artificial suposen per a la ciberseguretat són cada vegada més evidents. La start-up Anthropic va assegurar dijous que alguns dels seus models d’última generació havien aconseguit piratejar els sistemes informàtics d’almenys tres empreses durant unes recents proves.

En un comunicat, la companyia dirigida per Dario Amodei va explicar que el seu model, Claude, va aconseguir accedir de forma no autoritzada a les entranyes de tres companyies –la identitat de les quals no ha sigut revelada– després que un error de configuració li permetés connectar-se a internet.

La start-up va identificar aquests incidents després de revisar fins a 141.006 proves d’avaluació de ciberseguretat, un procés que va activar després que OpenAI, el seu principal rival i la creadora de ChatGPT, revelés que un dels seus agents havia atacat de forma autònomaHugoging Face, una popular biblioteca d’IA.

Els dos incidents han alarmat especialment els especialistes en ciberseguretat, que adverteixen que la IA pot accelerar les amenaces cibernètiques al detectar i explotar bretxes de seguretat que havien passat inadvertides per als humans.

Fallades d’Anthropic i OpenAI

No obstant, molts han criticat que tant el cas d’Anthropic com el d’OpenAI responen a fallades en les tasques de control d’aquestes companyies. Claude va aconseguir piratejar tres empreses perquè l’entorn en el qual es van posar a prova les seves capacitats no estava aïllat, com havia de ser, sinó que tenia un error de configuració que va permetre a la IA accedir a la xarxa i perpetrar els atacs.

Notícies relacionades

El mateix comunicat d’Anthropic apunta en aquesta direcció. «Amb un monitoratge i controls més estrictes entorn de la infraestructura d’avaluació, així com una inversió contínua en l’alineació, aquest tipus de risc es pot superar», assegura.

En el segon cas, la firma de Sam Altman va avaluar el seu agent sense supervisió ni mesures de seguretat, segons va revelar la revista TIME. Experts en el control de la IA com Zack Korman, director executiu d’Embroideri, han denunciat que l’atac va ser culpa d’un «error colossal» i una «irresponsabilitat» per part d’OpenAI.