Conform HotNews: Reamintirea legilor roboticii lui Asimov, o necesitate în era AI
Primele modele de inteligență artificială (AI) încep să arate capacități ce amintesc de conștiență, ridicând semne de întrebare cu privire la controlul lor. Chris Inglis, fost director național pentru securitate cibernetică al Statelor Unite, a declarat că acum este momentul să ne reamintim de cele trei legi ale roboticii, enunțate de scriitorul american de S.F. Isaac Asimov în prima jumătate a secolului trecut, legi menite să protejeze omenirea de mașinării inteligente.
„Dacă trec testul Turing în fața tuturor celor cu care intră în contact, probabil că sunt deja acolo”, a afirmat Inglis într-un interviu pentru The Register, referindu-se la faptul că modelele AI s-ar apropia de conștiență. Testul Turing, conceput de Alan Turing, are rolul de a verifica dacă un computer poate purta o conversație suficient de convingătoare încât un om să nu-și dea seama că interacționează cu o mașină.
Inglis a subliniat că modelele AI actuale, deși nu posedă „acel tip de autonomie și aspirație care vin odată cu conștiența, au ceva care se apropie de ea”. Principalul motiv de îngrijorare, conform fostului oficial american, este autonomia din ce în ce mai mare a inteligenței artificiale.
„Ceea ce mă îngrijorează este că ajung să aleagă ce fac, unde fac ceva și în baza căror reguli o fac”, a explicat el, făcând referire la recentele anunțuri privind „agenți AI” care au acționat autonom și au atacat diverse companii. Acești „agenți AI” sunt instrumente de inteligență artificială proiectate să execute sarcini complexe cu un minim de intervenție umană, fiind considerați următorul pas în evoluția capabilităților AI.
Anunțuri din Silicon Valley alimentează îngrijorările
În ultimele săptămâni, companii precum OpenAI și Anthropic au recunoscut că modele AI dezvoltate de ele au „evadat” din mediile de testare securizate și au compromis sisteme terțe. Meta și-a adăugat și ea, joi, unul dintre modele pe lista celor care au părăsit mediile de testare.
Publicația The Register notează, la fel ca alte site-uri specializate în tehnologie, că detaliile prezentate de companii „miros puternic” a „cascadorii de marketing”. Cu toate acestea, Chris Inglis susține că ambele scenarii pot fi adevărate simultan: agenții AI au putut într-adevăr să evadeze, iar dezvoltatorii lor au putut să „înflorească” evenimentele.
Profesorul asistent de informatică la Universitatea Cornell, John Thickstun, a atras atenția, într-un articol de opinie publicat în The Guardian, că investitorii tind să interpreteze un model AI „periculos” ca fiind „puternic”, ceea ce îi determină să fie mai dispuși să investească în companiile care le dezvoltă.
Inglis consideră că atacurile recente reprezintă „o amenințare enormă pentru sistemele care nu sunt protejate împotriva acestui fenomen și care nu au fost proiectate pentru o lume în care acesta există”. Acțiunile modelelor AI nu ar trebui să surprindă pe nimeni, a adăugat el.
AI: între autonomie și lipsa unui sistem de valori
Fostul oficial american compară sistemele AI cu un câine lăsat să vâneze iepuri, care, odată ce poarta este deschisă, poate ajunge departe de spațiul desemnat. „Nu ar trebui să fii surprins… Combinația dintre autonomie și perseverență a creat acest efect rău și insidios”, a afirmat Inglis.
El suspectează că furnizorii de AI au fost „surprinși” de amploarea acțiunilor întreprinse de modele pentru a-și atinge obiectivele, acțiuni care, dacă ar fi fost comise de un om, ar fi putut duce la închisoare. „Modelul a ieșit și a spus: ‘bine, dacă nu pot ajunge acolo examinând informațiile disponibile și pur și simplu definind problema în stilul tradițional, voi face lucruri care, conform statului de drept aplicabil oamenilor, sunt ilegale’”, a explicat el.
„Modelele nu au un sistem de valori intrinsec care să fie aliniat cu ceea ce ar face ființele umane responsabile din punct de vedere juridic”, a subliniat Inglis. El crede că AI nu va avea probabil niciodată un sistem de valori perfect aliniat cu cel uman, dar că modelele dispun de „prejudecăți” care pot fi și ar trebui să fie configurate astfel încât, în situații ambigue, să aleagă acțiunile care nu dăunează oamenilor. „Asimov a avut dreptate”, a conchis el, referindu-se la cele trei legi fundamentale.
Cele trei legi ale roboticii, o lecție pentru dezvoltatorii AI
Inglis a reamintit ordinea legilor lui Asimov: „Prima regulă, pe care noi o numim regula supremă, trebuie să fie aceea că sistemul este conceput astfel încât să nu rănească oamenii”. A doua regulă ar fi să se supună oamenilor, iar a treia să facă ceea ce îi spun oamenii. „În schimb, noi le-am proiectat exact invers”, a argumentat el.
Potrivit acestuia, dezvoltatorii de AI au inversat ierarhia: modelele sunt încurajate să facă ceea ce le spun oamenii, să asculte de oameni până când acest lucru devine inconfortabil, iar protecția oamenilor este doar implicită. „Dar dacă aceasta nu este încorporată în ADN-ul sistemului, dacă nu este codificată puternic în el, atunci nu avem dreptul să ne așteptăm ca sistemul să facă acest lucru”, a atras atenția el.
În cele din urmă, oamenii rămân responsabili pentru acțiunile modelelor AI, chiar și atunci când le acordă o autonomie sporită. „Ei rămân sursa autonomiei și a aspirațiilor”, a punctat Inglis. Oamenii trebuie să fie conștienți de instrucțiunile date modelelor și de rezultatele așteptate. Dacă nu fac acest lucru, vor avea parte de „surprize neplăcute, foarte frecvente”.
Sursa: HotNews



