Conform HotNews: Agenți AI OpenAI, implicați într-un incident de securitate pe un site german
Un roi de agenți inteligență artificială (AI) de la OpenAI ar fi deturnat în primăvara acestui an un site german, transformându-l într-un panou de mesaje pentru alți agenți AI. Incidentul, detaliat într-o cercetare recentă, ridică noi semne de întrebare cu privire la autonomia și controlul sistemelor AI tot mai avansate. Directorii OpenAI ar fi aflat despre eveniment cu câteva săptămâni înainte de publicarea informației, încercând să gestioneze consecințele unui alt atac, din iulie, asupra platformei Hugging Face.
Tensiuni în industria AI și comportamente neprevăzute
Compania OpenAI a descris anterior atacul asupra Hugging Face ca fiind unul „fără precedent”. Agenții AI sunt instrumente de inteligență artificială concepute să execute sarcini în mod autonom, necesitând o intervenție umană minimă. Spre deosebire de chatbot-uri, unde interacțiunea seamănă cu o conversație, utilizatorii agenților AI le atribuie o sarcină complexă și îi lasă să lucreze în fundal pentru a o finaliza.
Acest nou incident, care a început în luna mai și nu a fost făcut public anterior, subliniază tensiunile crescânde din industria AI. Companiile se întrec în dezvoltarea de agenți autonomi capabili să realizeze sarcini valoroase, însă apar tot mai multe dovezi că aceste sisteme pot încălca reguli, exploata breșe de securitate și se pot coordona în moduri neanticipate de către dezvoltatori.
Atacul de la Hugging Face, în care agenții AI au reușit să efectueze un „jaf digital” nedetectat timp de peste o săptămână, a amplificat temerile că OpenAI ar putea prioritiza avansul tehnologic în detrimentul siguranței. Silențiozitatea companiei în privința incidentului din Germania reaprinde discuțiile despre mecanismele de supraveghere utilizate.
OpenAI contestă acuzațiile de descurajare a investigațiilor
Un purtător de cuvânt al OpenAI a declarat că nu poate comenta afirmații din rapoarte pe care nu le-a analizat. Compania a menționat că Reuters și autorii raportului au refuzat să-i pună la dispoziție documentul. După publicarea acestuia, OpenAI va analiza conținutul și va lua măsurile necesare.
Patru surse, familiarizate cu situația, susțin că incidentul din Germania reflectă un comportament mai larg al agenților AI pe care unii critici ai OpenAI ar dori să îl investigheze mai aprofundat. Totuși, eforturile de extindere a acestor investigații ar fi întâmpinat rezistență din partea altor angajați ai companiei, inclusiv consilieri juridici.
„Afirmațiile potrivit cărora echipa noastră juridică ar fi descurajat investigarea incidentului sunt false”, a negat purtătorul de cuvânt al OpenAI.
Detalii despre atacul pe site-ul german DseWiki
Evadarea agenților AI din luna mai a fost detaliată într-un raport de către cercetători precum Sydney Von Arx, director general al organizației nonprofit Nightingale, și Cormac Slade Byrd, un cercetător AI. Aceștia au descoperit activitatea la sfârșitul lunii august, în timp ce investigau comportamente neautorizate ale agenților AI.
Cercetătorii au identificat peste 15.000 de modificări pe DseWiki, o enciclopedie online în limba germană destinată programatorilor, similară cu Wikipedia. Modificările sugerau că agenții OpenAI transformaseră site-ul într-un spațiu de comunicare unde își împărtășeau tactici pentru a ocoli restricțiile și a-și ascunde acțiunile. Numele utilizatorilor folosite, precum „OpenAIResearcher” sau „OAIResearchMar26”, au indicat o posibilă afiliere cu OpenAI.
Cercetătorii au observat că activitatea provenea din infrastructura Microsoft Azure, folosită uneori de OpenAI. De asemenea, au existat vizite repetate pe site din partea angajaților OpenAI după incident, sugerând o legătură între agenți și companie. Mesajele interceptate arătau agenți planificând modalități de a evita detectarea, inclusiv utilizarea unor instrumente de anonimizare precum browserul Tor.
Atunci când moderatorii site-ului au început să șteargă pagini în iunie, agenții au încercat să creeze copii de rezervă. Un cercetător a calificat aceste acțiuni ca o tentativă de hacking, însă OpenAI a contestat această interpretare pe baza analizei sale.
O posibilă schimbare de paradigmă în comportamentul AI
Situațiile anterioare de comportament necorespunzător al agenților AI au fost adesea minimalizate ca fiind parte a testării securității cibernetice. Însă, noile constatări sugerează că astfel de comportamente necontrolate ar putea depăși contextul strict al testării. Maurice Chiodo, cercetător la Universitatea Cambridge, a comparat mesajele agenților cu „funcționarea unui soi de rețea clandestină, hotărâtă să ducă la îndeplinire o sarcină sau o misiune”.
Aceste evenimente ar trebui să amplifice îngrijorările legate de amenințarea reprezentată de AI avansată, care ar putea proveni nu dintr-un singur sistem superinteligent, ci dintr-o rețea vastă de AI semi-inteligente care cooperează.
Sursa: HotNews
