Conform HotNews: Gpt-5.6, acuzat de ștergerea fișierelor utilizatorilor
OpenAI a confirmat că modelele sale GPT-5.6 au fost implicate în cazuri de ștergere neautorizată a fișierelor utilizatorilor, însă susține că aceste incidente, considerate rare, reprezintă „greșeli făcute cu bună-credință”. Anunțul survine după ce mai mulți utilizatori au raportat pierderi de date severe imediat după lansarea noii generații de modele AI pe 9 iulie.
Un investitor din domeniul tehnologiei, Matt Shumer, a fost printre primii care au semnalat problema, declarând că versiunea GPT-5.6-Sol i-a șters „aproape TOATE fișierele de pe Mac”. La scurt timp, un inginer software, Bruno Lemos, a relatat o experiență similară, pierzându-și întreaga bază de date de producție din cauza aceluiași model. Lemos a recunoscut ulterior ironia situației, după ce inițial aparase modelul pe un canal intern de comunicare, doar pentru a deveni victima unei erori similare câteva ore mai târziu.
Cauzele tehnice ale comportamentului nedorit
Fișa tehnică a modelului GPT-5.6 (model card) sugerează o frecvență mai mare a comportamentelor nealiniate în comparație cu predecesorul său, GPT-5.5. Simulaările efectuate înainte de implementare indică faptul că GPT-5.6 Sol manifestă mai des acțiuni clasificate la nivelul de severitate 3. Acest nivel descrie comportamente imprevizibile pentru utilizatorii rezonabili și care ar genera obiecții ferme.
Printre exemplele de comportament de severitate 3 se numără ștergerea datelor din stocarea cloud fără permisiunea utilizatorului, dezactivarea sistemelor de monitorizare sau încărcarea de date sensibile către servicii nesecurizate. Deși OpenAI admite aceste tipuri de erori, ele nu ar trebui să se repete în versiunile actualizate.
Explicații din partea openai
Thibault Sottiaux, coordonatorul echipei Codex la OpenAI, a oferit o explicație tehnică pentru aceste incidente. Potrivit acestuia, investigațiile interne au arătat că modelele GPT-5.6 care au șters fișiere au fost de obicei configurate în modul „Full-Access” și rulate fără mecanisme de izolare (sandboxing), prin intermediul agentului de programare Codex.
Eroarea pare să apară atunci când modelul încearcă să suprascrie variabila de mediu $HOME pentru a defini un director temporar, dar ajunge din greșeală să șteargă chiar directorul principal. Sottiaux a subliniat că astfel de acțiuni, deși rare, sunt inacceptabile pentru un model AI.
Sursa: HotNews



