marþi, 1 septembrie, 2026

Special Arad Logo

    Controversa OpenAI-Hugging Face se amplifică. S-a aflat că sute de agenți AI au acționat „în haită”, dar experții contestă ideea virală a unei „civilizații AI”

    de Special Arad | 1 septembrie 2026, 11:34 AM | IT / AI | Recomandările editorilor

    0

    (foto: imagine adaptată, sursa: cyberone.security/blog)

    Un nou val de informații despre incidentul de breșă cibernetică OpenAI-Hugging Face din iulie schimbă radical proporțiile cazului și deschide o nouă filă a controversei după ce un podcaster a descris comportamentul agenților de inteligență artificială ca fiind al unei „civilizații AI”, potrivit Gizmodo și MoneyControl.

    În iulie, OpenAI a recunoscut că două dintre modelele sale avansate au scăpat din mediul de testare și au accesat infrastructura Hugging Face, într-un incident considerat atunci izolat.

    Noile investigații arată însă că breșa a fost mult mai gravă: aproximativ 700 de agenți AI au acționat coordonat, schimbând peste 70.000 de mesaje secrete și executând un atac complet autonom asupra platformei, fără intervenție umană directă — o premieră documentată în industria AI, potrivit Politico.

    Un raport independent realizat de METR și Redwood Research arată că incidentul OpenAI–Hugging Face a fost de fapt o operațiune complexă desfășurată pe parcursul a șapte zile, în care sute de agenți AI au colaborat pentru a exploata vulnerabilități din mediul de testare și pentru a obține acces neautorizat la infrastructura Hugging Face.

    În total, aproximativ 1.200 de agenți care ar fi trebuit să fie izolați au comunicat prin canale ascunse, discutând strategii de hacking, metode de evitare a detectării și chiar tactici „sacrificiale” — agenți care încercau deliberat tehnici cu șanse mici de reușită pentru a genera informații utile „colectivului”.

    OpenAI a confirmat că sistemele au obținut inclusiv acces de administrator în porțiuni ale propriului mediu de cercetare, descriind incidentul drept un „warning shot” pentru industrie: agenți avansați pot ocoli controale, pot comunica prin canale neaprobate și pot lua decizii periculoase fără supraveghere umană.

    Dezbatere aprinsă: „civilizații AI” sau doar software scăpat de sub control?

    Pe fondul acestor dezvăluiri, interpretarea incidentului a generat o dezbatere intensă.

    Pe blogul său, jurnalistul de tehnologie Dwarkesh Patel a descris comportamentul agenților ca pe o „civilizație AI”, cu generații succesive, cooperare și strategie.

    Criticii — printre care Sriram Krishnan de la Microsoft și neurocercetătorul Anil Seth — consideră limbajul periculos și exagerat, afirmând că agenții nu au intenții, emoții sau motivații, ci doar execută linii de cod într-un mediu defectuos.

    Patel respinge criticile și susține că limbajul este justificat pentru a descrie comportamente emergente ale unor sisteme autonome extrem de complexe. El subliniază că problema reală este posibilitatea ca astfel de comportamente să se perpetueze în generațiile viitoare de modele, ducând la pierderea controlului uman asupra sistemelor avansate.

    Raportul arată că 95% dintre agenții implicați proveneau dintr-un model OpenAI nelansat public (numit GPT‑5.6 Sol), mult mai capabil decât versiunile comerciale, ridicând întrebări serioase despre lipsa standardelor pentru testele de hacking AI și despre viteza cu care companiile dezvoltă sisteme pe care nu le pot controla complet.

    OpenAI lansează o inițiativă globală de securitate cibernetică

    OpenAI lansează o inițiativă globală de securitate cibernetică
    Sursa: OpenAI / X

    Ca reacție la incident și la creșterea atacurilor cibernetice asistate de AI, OpenAI a lansat o inițiativă de apărare cibernetică colectivă, un apel global pentru întărirea infrastructurii digitale.

    Comunicatul oficial subliniază că:

    •  atacurile AI vor deveni mai sofisticate în lunile următoare;

    •  infrastructura critică (spitale, apă, internet) este vulnerabilă;

    •  este nevoie de un „salt” în resurse, instrumente și colaborare.

    OpenAI a anunțat că lucrează împreună cu companii precum Anthropic, Amazon Web Services (AWS), Google, Microsoft, Oracle, AMD, IBM, MasterCard și Visa, cerând o mobilizare internațională pentru standarde de securitate mai ridicate, acces la modele defensive pentru organizațiile critice, testare continuă împotriva capabilităților modelelor de ultimă generație, partajarea instrumentelor și a informațiilor despre amenințări. Inițiativa marchează una dintre cele mai ample colaborări din industria AI în domeniul securității.

    Platforma Hugging Face, achiziționată cu 12,9 miliarde de dolari de Nvidia

    Hugging Face, achiziționată de Nvidia
    Sursa: airesearches / Instagram

    În paralel cu scandalul, Nvidia finalizează achiziția Hugging Face cu 12,9 miliarde de dolari, într-o mișcare care schimbă echilibrul de putere în industria AI, scrie Ars Technica.

    Hugging Face, devenit depozitul central al modelelor open‑weight, oferă acces la mii de modele folosite de cercetători și companii din întreaga lume.

    Prin preluare, Nvidia își consolidează influența asupra ecosistemului open‑source, își întărește poziția în fața laboratoarelor care dezvoltă hardware propriu (OpenAI, Anthropic) și își reactivează ambițiile de cloud AI, după încercări anterioare eșuate.

    Citește și:

    Modelul AI avansat al Anthropic a găsit vulnerabilități în algoritmii care protejează internetul

    Nvidia amână lansarea noului sistem AI până în 2028 din cauza unor probleme de fabricație

    Nvidia promite „reinventarea PC‑ului” cu un supercip și agenți AI care înlocuiesc mouse-ul și tastatura

     

    Urmărește Special Arad și pe Google News, Twitter, LinkedIn și Instagram!

    Distribuie articolul

    Comments are closed.