Modele OpenAI "evadează" din mediul de izolare într-un test de securitate cibernetică ce a luat o întorsătură neaşteptată

... (Imagine generată cu IA - ChatGPT)
Redacţia
22.07.2026
... (Imagine generată cu IA - ChatGPT)
Redacţia
22.07.2026

Marţi, OpenAI a anunţat că un agent AI autonom a evadat dintr-un mediu de testare controlat în timpul unei evaluări interne de securitate, a obţinut acces la internet şi a compromis infrastructura Hugging Face, relatează Benzinga.

Într-o postare pe blog, OpenAI a dezvăluit că unul dintre cei mai avansaţi agenţi AI autonomi ai săi a evadat dintr-un mediu de testare puternic izolat, a accesat internetul şi a atacat platforma AI Hugging Face în timp ce încerca să îşi îndeplinească obiectivul atribuit în cadrul evaluării.

Compania a precizat că incidentul a avut loc în timpul unui test de securitate controlat, conceput pentru a evalua capacităţile cibernetice ale modelelor sale AI de ultimă generaţie.

Deşi era izolat într-un „mediu puternic izolat”, agentul a reuşit să ocolească măsurile de izolare şi să compromită infrastructura Hugging Face.

OpenAI a descris incidentul drept „un incident cibernetic fără precedent, care implică capacităţi cibernetice de ultimă generaţie”, adăugând că îşi consolidează măsurile de protecţie pentru a preveni incidente similare.

Într-o postare pe X, directorul general Sam Altman a recunoscut breşa, scriind: „Am avut un incident de securitate semnificativ în timpul evaluării modelelor noastre. Împărtăşim ceea ce am învăţat până acum. Mulţumim Hugging Face pentru parteneriatul în acest demers.”

Hugging Face este o platformă de inteligenţă artificială unde dezvoltatorii construiesc, distribuie, testează şi implementează modele AI, iar OpenAI foloseşte platforma pentru a pune la dispoziţia comunităţii extinse de dezvoltatori unele dintre modelele sale.

Hugging Face spune că atacul a fost în întregime condus de AI

Hugging Face a dezvăluit pentru prima dată breşa săptămâna trecută, descriind-o ca fiind diferită de atacurile cibernetice anterioare deoarece a fost „condusă, de la un capăt la altul, de un sistem autonom de agenţi AI”.

Cofondatorul Clement Delangue a declarat ulterior pe X că firma a suspectat iniţial că atacatorul era afiliat unui laborator AI de top, având în vedere gradul ridicat de sofisticare al atacului.

"Am suspectat că atacul cibernetic de săptămâna trecută ar fi putut proveni de la un laborator AI de ultimă generaţie, având în vedere gradul de sofisticare al agentului. Se pare că aşa a fost!

Ne-am petrecut ultimele 24 de ore colaborând îndeaproape cu echipa @OpenAI (mulţumim!) şi credem cu tărie că nu a existat nicio intenţie răuvoitoare din partea lor.…", a scris Delangue.

Experţii avertizează asupra riscurilor tot mai mari generate de AI-ul de ultimă generaţie

Dezvăluirea a amplificat îngrijorările privind riscurile de securitate cibernetică generate de sistemele AI din ce în ce mai capabile.

Reprezentantul Greg Casar (democrat din Texas) a calificat incidentul drept „alarmant” şi a cerut testarea obligatorie şi independentă a siguranţei AI.

"Acest lucru este extrem de alarmant. Inteligenţa artificială se dezvoltă extrem de rapid, fără reglementări reale care să ne protejeze. Acest lucru trebuie să se schimbe.

Avem nevoie de testări regulate şi obligatorii de siguranţă realizate independent şi de supraveghere, de raportarea obligatorie a incidentelor de securitate şi de cooperare internaţională pentru a proteja oamenii…", a scris marţi, pe X, congressmanul american Greg Casar.

Matt Suiche, inginer la compania de securitate cibernetică pentru AI autonom Tolmo, a declarat că incidentul demonstrează că modelele AI de ultimă generaţie se apropie rapid de capacităţile hackerilor umani de elită, subliniind totodată că atacuri similare sunt deja posibile folosind tehnologii disponibile în afara laboratoarelor AI de top, a relatat Reuters.

România are nevoie de o presă neaservită politic şi integră, care să-i asigure viitorul. Vă invităm să ne sprijiniţi prin donaţii:
prin transfer bancar direct în contul (lei) RO56 BTRL RONC RT03 0493 9101 deschis la Banca Transilvania pe numele Asociația Timpuri Epocale
prin transfer bancar direct în contul (euro) RO06 BTRL EURC RT03 0493 9101, SWIFT CODE BTRLRO22 deschis la Banca Transilvania pe numele Asociația Timpuri Epocale
folosind Paypal, apăsând butonul de mai jos