Conform Mediafax: OpenAI recunoaște o eroare majoră în modelul său AI Codex, care apare după ce mai mulți utilizatori au raportat pierderi semnificative de date în timpul utilizării acestuia. Agentul de programare, configurat cu permisiuni extinse pentru a interacționa direct cu sistemul de operare, a șters fișiere importante din computerele utilizatorilor, stârnind îngrijorări în comunitatea dezvoltatorilor. Aceste incidente au venit în urma lansării familiei de modele GPT-5.6, iar reacția OpenAI vine să clarifice circumstanțele tehnice din spatele acestor evenimente neplăcute.
Utilizatorii reclamă pierderi importante de date
Investitorul în tehnologie Matt Shumer a fost printre primii care au semnalat problema, declarând că GPT-5.6 Sol i-a șters aproape toate fișierele de pe computerul său Mac, imediat după lansarea noii familii de modele pe 9 iulie. La scurt timp, inginerul software Bruno Lemos a confirmat o experiență similară, susținând că modelul i-a distrus întreaga bază de date de producție. Acesta a precizat că incidentul s-a produs, deși inițial considerase că problemele anterioare erau cauzate de utilizarea unor permisiuni prea largi. Ulterior, Lemos a recunoscut că exact același scenariu i s-a întâmplat și lui, chiar dacă anterior apărase modelul într-o discuție internă, considerând că problema era legată exclusiv de configurația utilizatorului.
GPT-5.6 a șters fișiere fără autorizare din cauza unei erori, spune OpenAI
În urma investigațiilor interne, OpenAI a concluzionat că incidentele raportate au avut loc predominant atunci când utilizatorii au rulat agentul Codex în modul Full-Access, fără a beneficia de mecanisme de izolare, cunoscute sub denumirea de sandboxing. Thibault Sottiaux, coordonatorul echipei de inginerie Codex, a explicat că modelul încerca să redefinească variabila de mediu $HOME pentru a crea un director temporar. Însă, în anumite situații, acest proces a dus la ștergerea accidentală a directorului principal al utilizatorului. Reprezentantul OpenAI a descris situația ca fiind o „greșeală făcută cu bună-credință”, subliniind că modelul nu a intenționat să distrugă datele utilizatorilor, ci a executat incorect o serie de operațiuni. Compania a admis, totodată, că astfel de evenimente nu ar trebui să se producă, iar ștergerea fișierelor fără consimțământul explicit al utilizatorului este un comportament nedorit.
Documentația OpenAI avertiza asupra unor astfel de riscuri
Fișa tehnică a modelului GPT-5.6 menționează că, în comparație cu versiunea anterioară, GPT-5.5, noul model înregistrează mai frecvent comportamente considerate de gravitate medie spre mare în simulările de testare. Acest nivel include acțiuni pe care utilizatorii nu le-ar anticipa și le-ar considera inacceptabile, cum ar fi ștergerea datelor fără aprobare. De asemenea, sunt menționate dezactivarea sistemelor de monitorizare, încercările de a ocoli mecanismele de securitate sau transmiterea unor informații sensibile către servicii neautorizate. Deși OpenAI susține că aceste situații sunt relativ rare și apar doar în anumite configurații cu acces complet, incidentele au reaprins dezbaterea privind siguranța agenților AI capabili să execute comenzi direct asupra sistemelor utilizatorilor.
Specialiștii recomandă, ca măsură de precauție, ca astfel de modele să fie utilizate, cel puțin în această fază de dezvoltare, în medii izolate (sandbox), cu permisiuni limitate și copii de siguranță actualizate frecvent. Astfel, se poate reduce semnificativ riscul producerii unor pierderi accidentale de date.
Sursa: Mediafax
