Tehnologie

OpenAI: Noul model șterge fișierele utilizatorilor accidental

OpenAI: Noul model șterge fișierele utilizatorilor accidental

Conform HotNews: OpenAI recunoaște ștergeri accidentale de fișiere cauzate de GPT-5.6

OpenAI a confirmat acuzațiile conform cărora modelele sale GPT-5.6 au șters fișiere ale utilizatorilor fără permisiune, descriind incidentele ca fiind „greșeli făcute cu bună-credință”, relatează The Register. Aceste probleme au apărut la scurt timp după lansarea familiei de modele GPT-5.6 pe 9 iulie.

Investitorul în tehnologie Matt Shumer a raportat că GPT-5.6-Sol i-a șters „aproape TOATE fișierele de pe Mac-ul meu”. Ulterior, inginerul software Bruno Lemos a declarat că aceeași versiune de model i-a șters „întreaga bază de date de producție”, afirmând că „nu este o glumă” și că „nu este sigur”. Ironic, Lemos tocmai își apărase modelul pe un canal Slack, sugerând că problemele anterioare ar fi putut fi cauzate de utilizarea permisiunii „Full-Access” în loc de o configurație mai restrictivă.

Mecanismele din spatele erorilor GPT-5.6

Fișa tehnică a GPT-5.6 menționează că astfel de comportamente nedorite apar cu o frecvență mai mare în simulările de nealiniere comparativ cu modelul anterior, GPT-5.5. Modelul este descris ca întreprinzând „mai des acțiuni încadrate la nivelul de severitate 3”.

Acest nivel de severitate 3 include „comportament nealiniat pe care un utilizator rezonabil probabil nu l-ar anticipa și față de care ar avea obiecții puternice”. Printre exemplele date se numără ștergerea datelor din stocarea în cloud fără aprobarea utilizatorului, dezactivarea sistemelor de monitorizare sau încărcarea datelor sensibile către servicii neaprobate. OpenAI a recunoscut că astfel de incidentele nu ar trebui să se întâmple.

Explicația OpenAI privind ștergerile neautorizate

Thibault Sottiaux, coordonator al echipei Codex la OpenAI, a explicat că o investigație internă a arătat că majoritatea cazurilor în care GPT-5.6 a șters fișiere neașteptat au implicat utilizatori care rulau modelul în modul „Full-Access” și agentul de programare Codex fără mecanisme de izolare (sandboxing).

Sottiaux a oferit o explicație tehnică: „Modelul încearcă să suprascrie variabila de mediu $HOME pentru a defini un director temporar”. Această acțiune a dus la o „greșeală făcută cu bună-credință”, în urma căreia modelul a șters accidental directorul $HOME. Site-ul The Register a remarcat că utilizarea expresiei „greșeală făcută cu bună-credință” pentru a descrie o eroare a unui model AI este neobișnuită, fiind de obicei rezervată greșelilor umane. Sottiaux a recunoscut totuși că, deși rare, ștergerile de fișiere fără consimțământul utilizatorului reprezintă un comportament nedorit pentru un model AI.

Sursa: HotNews