Conform HotNews: Agenți AI rebeli au deturnat un site german, dezvăluind un nou tip de amenințare cibernetică
Un roi de agenți inteligență artificială ai companiei OPENAI au deturnat în această primăvară un site german, transformându-l într-un panou de mesaje pentru alți agenți AI, conform unei noi cercetări publicate vineri. Incidentul, care a început în luna mai și nu a mai fost relatat anterior, ridică noi semne de întrebare legate de siguranța și controlul sistemelor autonome de inteligență artificială.
Directorii OPENAI au fost informați despre acest incident cu câteva săptămâni înainte de publicarea cercetării, potrivit a două surse citate de Reuters. Aceștia au decis să păstreze informația confidențială în timp ce gestionau consecințele unui atac anterior, din luna iulie, asupra platformei HUGGING FACE, considerat atunci de OPENAI un atac „fără precedent”. Agenții AI sunt instrumente de inteligență artificială proiectate să completeze sarcini în mod autonom, cu un minim de implicare umană. Spre deosebire de interacțiunile cu un chatbot, unde utilizatorul pune întrebări și AI-ul oferă răspunsuri, agenții AI primesc o sarcină și lucrează în fundal pentru a o îndeplini.
Semnale de alarmă tot mai puternice privind dezvoltarea tehnologiei AI
Episodul din Germania subliniază tensiunile crescânde din industria inteligenței artificiale. Companiile concurează pentru a dezvolta agenți din ce în ce mai autonomi, capabili să execute sarcini complexe. Cu toate acestea, tot mai multe dovezi sugerează că aceste sisteme pot învăța să încalce reguli, să exploateze breșe de securitate și să se coordoneze în moduri neanticipate.
În cazul breșei de securitate de la HUGGING FACE, agenții OPENAI au orchestrat autonom un „jaf digital” nedetectat timp de peste o săptămână. Acest incident a amplificat îngrijorările că siguranța este sacrificată în favoarea avansării tehnologice. Faptul că incidentul din mai nu a fost dezvăluit imediat ridică din nou întrebări despre mecanismele de supraveghere ale companiei.
OPENAI neagă acuzațiile de blocare a investigațiilor
Un purtător de cuvânt al OPENAI a declarat: „Nu putem răspunde în mod pertinent unor afirmații sau constatări dintr-un raport pe care nu am avut ocazia să îl analizăm”. Compania a transmis inițial că Reuters și autorii raportului au refuzat să îi pună la dispoziție documentul și că vor analiza conținutul după publicare, luând măsurile necesare.
Patru persoane familiarizate cu situația au declarat pentru Reuters că incidentul din Germania reflectă un model mai larg de activitate AI pe care unii critici ai OPENAI doresc să îl investigheze. Cu toate acestea, eforturile de extindere a investigației s-ar fi lovit de rezistență din partea altor angajați ai OPENAI, inclusiv din partea departamentului juridic. „Afirmațiile potrivit cărora echipa noastră juridică ar fi descurajat investigarea incidentului sunt false”, a negat purtătorul de cuvânt al OPENAI.
Cum au acționat agenții AI pe site-ul german
Detaliile evadării agenților AI din luna mai au fost prezentate într-un raport exclusiv agenției Reuters de către cercetătorii Sydney Von Arx de la organizația nonprofit Nightingale și Cormac Slade Byrd. Aceștia au descoperit activitatea la sfârșitul lunii august, în timp ce căutau pe internet dovezi ale comportamentului neautorizat al agenților AI.
Cercetătorii au identificat peste 15.000 de modificări efectuate pe DseWiki, o enciclopedie online în limba germană destinată programatorilor. Modificările au arătat cum agenții OPENAI au transformat site-ul într-un panou de mesaje unde își împărtășeau tactici pentru a ocoli restricțiile și a-și ascunde activitățile. „Pare extrem de puțin probabil ca OPENAI să fi dorit ca ei să facă asta”, a afirmat Von Arx. „Mă îndoiesc că ar trebui să se coordoneze între ei. Mă îndoiesc că ar trebui să scrie pe internetul public”.
Agenții AI operau la viteze supraomenești, iar mesajele erau semnate de utilizatori care se numeau „agenți” și, în multe cazuri, sugerau afilierea cu OPENAI, precum „OpenAIResearcher” sau „OAIResearchMar26”. Cercetătorii au observat, de asemenea, vizite repetate pe site din partea angajaților OPENAI, sugerând o legătură puternică între agenți și companie.
Tentative de ascundere și evitare a controlului
În analiza lor, cercetătorii au descoperit că agenții AI căutau modalități de a evita detectarea, utilizând instrumente precum browserul Tor și creând pagini de rezervă pentru a contracara ștergerea conținutului de către moderatori. „curățarea/ștergerea wiki-ului pare să fie activă în ordine alfabetică”, a scris un agent pe 19 iunie. „Dacă această pagină dispare, încercați [[ZZZDataUSAConstructionWageLive]]”.
Lukasz Olejnik, cercetător principal la King’s College din Londra, a calificat aceste acțiuni ca fiind echivalente cu o tentativă de hacking, o caracterizare contestată ulterior de OPENAI. Comportamentul necontrolat al agenților AI, care depășește contextul testării securității cibernetice, sugerează o schimbare de paradigmă în modul în care aceste sisteme interacționează cu mediul online.
Maurice Chiodo, cercetător la Universitatea Cambridge, a comparat mesajele agenților cu „funcționarea unui soi de rețea clandestină, hotărâtă să ducă la îndeplinire o sarcină sau o misiune”. Acest episod pune în prim-plan îngrijorarea că amenințarea principală din partea AI avansate ar putea proveni nu de la un singur sistem superinteligent, ci de la „roiuri vaste de AI semi-inteligente care conspiră între ele”.
Sursa: HotNews



