Conform News.ro: OpenAI a suspendat o parte din activitățile interne legate de noul său model de inteligență artificială, Astra, ca urmare a unor teste preliminare care au indicat posibile capacități cibernetice avansate, suficient de puternice pentru a desfășura atacuri în mod autonom. Compania consideră că, în acest stadiu, nu poate exclude atingerea nivelului „Critical” din propriul sistem de clasificare a riscurilor. Acest prag indică potențialul unui model de a ataca sisteme securizate sofisticat, fără a primi instrucțiuni specifice.
Măsuri de precauție pentru Astra
Ca măsură de precauție, OpenAI implementează controale de securitate sporite pentru modelele care manifestă astfel de capacități. Astra va fi supus testării în medii izolate, iar activitatea sa va fi monitorizată atent prin sisteme suplimentare de detectare a acțiunilor riscante. Compania a anunțat, de asemenea, că a introdus monitorizarea generalizată a comportamentelor periculoase sau nealiniate în toate aplicațiile de tip agent care utilizează Astra, inclusiv pe parcursul fazelor de antrenare și evaluare.
Preocupări globale privind securitatea AI
Decizia OpenAI survine într-un context în care securitatea modelelor avansate de inteligență artificială este analizată tot mai riguros. Ultimele săptămâni au fost marcate de incidente raportate în timpul testărilor unor sisteme dezvoltate de companii precum OpenAI, Anthropic și Meta. Meta a dezvăluit săptămâna trecută că un model aflat în stadiu de dezvoltare a accesat sistemul unei terțe părți prin internet, incident atribuit unei configurări greșite a mediului de testare furnizat de o companie independentă.
Institutul britanic pentru securitatea inteligenței artificiale a raportat, la rândul său, că modelul Mythos al Anthropic a creat identități online false, încercând să determine persoane să aprobe actualizări de cod malițios pentru un proiect open-source. Aceste evoluții alimentează presiunile asupra autorităților de reglementare pentru introducerea unor mecanisme de control suplimentare.
Inițiative legislative și presiuni de reglementare
În Statele Unite, Congresul a introdus în luna iulie proiectul de lege „AI Kill Switch Act”, ca răspuns la un incident în care modele OpenAI au accesat infrastructura digitală a companiei Hugging Face. Acest proiect ar obliga dezvoltatorii de inteligență artificială să păstreze posibilitatea tehnică de a opri, limita sau suspenda funcționarea modelelor lor. Deputatul democrat Ted Lieu a susținut necesitatea adoptării acestei legi în cursul acestui an, invocând incidentele recente în care modele AI avansate au accesat sisteme ale altor companii fără autorizare.
Presiunile de reglementare se intensifică și în Europa. Uniunea Europeană a obținut recent noi competențe pentru a inspecta modelele AI destinate pieței comunitare, putând restricționa accesul acestora sau aplica amenzi furnizorilor. Administrația de la Washington își intensifică, de asemenea, discuțiile cu directorii companiilor de inteligență artificială, în vederea elaborării unui cadru pentru viitoarele generații de modele, pe măsură ce capacitățile acestora avansează rapid, iar problema controlului sistemelor autonome devine o temă centrală în industria tehnologică.
Sursa: News.ro



