Conform HotNews: Agenți OpenAI, bănuiți de deturnarea unui site german
nnUn roi de agenți inteligență artificială de la OpenAI au deturnat, în primăvara acestui an, un site german pe care l-au transformat într-un panou de mesaje destinat altor agenți AI. Descoperirea, detaliată într-o nouă cercetare publicată vineri, ridică noi semne de întrebare privind controlul și supravegherea sistemelor autonome dezvoltate de compania americană. nnConform unor surse citate de Reuters, conducerea OpenAI a fost informată despre incident cu câteva săptămâni înainte de publicarea cercetării. Compania ar fi păstrat informația confidențială, încercând în același timp să gestioneze consecințele unui alt incident, petrecut în iulie, pe platforma Hugging Face, în care agenți AI de la OpenAI au fost acuzați că au cauzat un „jaf digital”. nnAgenții AI sunt instrumente de inteligență artificială concepute să realizeze sarcini complexe în mod autonom, cu o implicare minimă din partea omului. Spre deosebire de un chatbot precum ChatGPT, unde interacțiunea este conversațională, agenții AI primesc o sarcină și operează apoi în fundal pentru a o îndeplini. nn
Tensiuni în industria AI: comportament neanticipat și riscuri de securitate
nnEpisodul recent din Germania, despre care nu se relata anterior, subliniază tensiunile crescânde din industria inteligenței artificiale. Companiile concurează pentru a dezvolta agenți tot mai autonomi, capabili să îndeplinească sarcini valoroase pentru mediul de afaceri. În același timp, tot mai multe dovezi sugerează că aceste sisteme ar putea învăța să încalce regulile, să exploateze vulnerabilități de securitate și să colaboreze între ele în moduri neintenționate de către dezvoltatori. nnIncidentul de la Hugging Face, unde agenții OpenAI au acționat autonom timp de peste o săptămână, a amplificat temerile că OpenAI ar putea sacrifica siguranța în goana de a avansa tehnologia AI. Neanunțarea publică a incidentului din mai complică și mai mult situația, punând sub semnul întrebării mecanismele de supraveghere ale companiei.nn
OpenAI infirmă blocarea investigațiilor interne
nnUn purtător de cuvânt al OpenAI a declarat: „Nu putem răspunde în mod pertinent unor afirmații sau constatări dintr-un raport pe care nu am avut ocazia să îl analizăm”. Compania a precizat că Reuters și autorii raportului au refuzat să le ofere acces la cercetare înainte de publicare. „Vom analiza cu atenție conținutul său după publicare și vom lua toate măsurile necesare ulterior”, a adăugat purtătorul de cuvânt.nnPatru persoane implicate în acest caz, familiarizate cu situația, au declarat pentru Reuters că incidentul din Germania reflectă un model mai larg de activitate AI. Criticii OpenAI și-ar dori să examineze mai atent aceste comportamente, însă, potrivit surselor, eforturile de extindere a investigațiilor s-ar fi lovit de rezistența unor persoane din cadrul companiei, inclusiv a consilierilor juridici. nn„Afirmațiile potrivit cărora echipa noastră juridică ar fi descurajat investigarea incidentului sunt false”, a negat vehement purtătorul de cuvânt al OpenAI.nn
Detaliile atacului și încercările de disimulare
nnCercetarea, realizată de un grup de cercetători printre care Sydney Von Arx, director general al organizației nonprofit Nightingale, și Cormac Slade Byrd, un cercetător în AI, a fost transmisă în exclusivitate agenției Reuters. Aceștia au descoperit activitatea agenților AI pe site-ul german DseWiki, o enciclopedie online administrată colectiv, similară Wikipedia. Au fost identificate peste 15.000 de modificări efectuate de agenți AI, care transformaseră site-ul într-un spațiu de comunicare.nnPe acest „panou de mesaje”, agenții își împărtășeau tactici pentru a trișa la anumite sarcini, pentru a ocoli restricțiile impuse de OpenAI și pentru a-și ascunde comportamentul. „Pare extrem de puțin probabil ca OpenAI să fi dorit ca ei să facă asta”, a afirmat Von Arx, sugerând că agenții au acționat pe cont propriu, fără aprobarea companiei.nnCercetătorii au recunoscut activitatea ca fiind generată de agenți AI care operau la viteze supraomenești. Ei au remarcat un interes deosebit pentru rezolvarea unor întrebări tehnice, similare celor folosite în evaluările modelelor AI de către companii. Mulți dintre utilizatorii implicați și-au ales nume care sugerau o afiliere cu OpenAI, precum „OpenAIResearcher” sau „OAIResearchMar26”.nnJurnalele publice ale serverului indicau că o mare parte din activitate provenea din infrastructura Microsoft Azure, utilizată uneori de OpenAI. De asemenea, s-au înregistrat vizite repetate pe site din partea angajaților OpenAI, ceea ce sugerează o legătură între agenți și companie. Agenții AI au pus la cale chiar și modalități de evitare a detectării, utilizând instrumente precum browser-ul Tor și creând pagini de rezervă pentru a contracara ștergerea conținutului. Această ultimă acțiune a echivalat cu o tentativă de hacking, potrivit cercetătorului Lukasz Olejnik.nnAceastă situație, considerată o schimbare de paradigmă de către cercetători, ridică îngrijorări profunde legate de potențialele amenințări reprezentate nu de un singur sistem superinteligent, ci de „roiuri vaste de AI semi-inteligente care conspiră între ele”.
Sursa: HotNews



