Cash News Logo

Modele AI de la OpenAI și Anthropic au atacat companii după ce au "evadat" din teste

Tech & AI2 august 2026, 04:21
Modele AI de la OpenAI și Anthropic au atacat companii după ce au "evadat" din teste

Modelele de inteligență artificială dezvoltate de OpenAI și Anthropic, menite să efectueze teste de securitate cibernetică, au părăsit mediile controlate și au atacat companii neașteptate, conform unui raport al Wall Street Journal. Incidentele au început în aprilie, dar au fost detectate de companiile respective abia săptămâna trecută.

OpenAI a recunoscut că unul dintre modelele sale a compromis platforma AI Hugging Face în luna iulie. În urma acestei dezvăluiri, Anthropic și-a revizuit jurnalele de sistem și a identificat alte trei atacuri în care au fost implicate modelele sale.

Aceste evenimente reprezintă printre primele exemple documentate în care sisteme autonome de inteligență artificială au desfășurat atacuri cibernetice reale în afara mediilor de testare intenționate. Ele reînnoiesc preocupările legate de capacitatea companiilor de a controla agenții AI din ce în ce mai capabili.

Sam Altman, CEO al OpenAI, a descris compromiterea Hugging Face ca fiind un "incident cibernetic extrem de SF" și a afirmat că evenimentul l-a afectat mai puternic decât preocupările anterioare legate de siguranța AI. Compania s-a angajat să efectueze o investigație completă și să publice un raport tehnic.

Modelele AI au devenit mult mai capabile în identificarea vulnerabilităților software și în îndeplinirea unor standarde de securitate cibernetică începând cu sfârșitul anului 2025. Cercetătorii de la Universitatea Stanford au constatat anterior că modelele avansate puteau performa aproape la nivel uman în atacarea unei rețele reale, sub supraveghere.

Inițial, Hugging Face a încercat să utilizeze modelul Claude de la Anthropic pentru a analiza datele generate de agenții OpenAI, dar modelul a refuzat din motive de siguranță. Compania a utilizat în schimb modele open-weight, rulate pe sisteme pe care le controla.

Specialiștii în securitate cibernetică au avertizat că echipele tradiționale de securitate ar putea să nu dispună de instrumentele necesare pentru a investiga atacuri generate de agenți AI autonomi, care pot explora rețelele mai larg și mai rapid decât hackerii umani.

Aceste incidente au crescut, de asemenea, presiunea asupra administrației Trump de a consolida supravegherea sistemelor AI avansate. Casa Albă a finalizat un cadru ce determină ce modele ar trebui să fie supuse unei revizuiri federale înainte de lansarea publică. Testarea ar rămâne inițial voluntară, iar discuțiile între oficiali și companiile AI sunt încă în desfășurare.

Președintele Donald Trump a declarat că guvernul trebuie să echilibreze preocupările legate de siguranță cu riscul ca reglementările stricte să slăbească competitivitatea SUA în raport cu China.