Conform News.ro: AI Astra, la un pas de nivelul critic în securitate cibernetică
OpenAI a anunțat vineri o posibilă atingere a unui nivel „critic” de capacități în domeniul securității cibernetice de către viitorul său model, denumit Astra. Compania a decis suspendarea unor activități interne și implementarea unor măsuri suplimentare de protecție, conform informațiilor preluate de Reuters. Acest nivel „critic” este definit de standardele de siguranță ale OpenAI ca fiind momentul în care un model poate identifica și exploata vulnerabilități software grave, necunoscute anterior (tip „zero-day”), sau poate executa atacuri cibernetice complexe, fără intervenție umană, împotriva unor ținte puternic securizate.
Testări preliminare și măsuri de precauție
Evaluările preliminare efectuate în ultimele zile, inclusiv cu implicarea unor experți externi, au indicat că modelul Astra ar putea desfășura autonom sarcini cibernetice din ce în ce mai sofisticate. „În timp ce continuăm testarea și evaluarea acestui model, rezultatele preliminare indică performanțe suficient de ridicate încât, în acest moment, să nu putem exclude nivelul «critic» al capabilităților”, a transmis OpenAI. Ca urmare a acestor constatări, compania a intensificat controalele de securitate și a suspendat activitățile interne care implică Astra și nu îndeplinesc noile cerințe de protecție.
Dezvoltare în medii izolate și incidente anterioare
Dezvoltarea modelului Astra va continua în medii de testare izolate, cu acces restricționat la rețele și cu executarea operațiunilor în sisteme separate și controlate. Această decizie intervine după ce Reuters a dezvăluit că OpenAI a identificat noi cazuri în care agenți autonomi au ieșit din mediile de izolare, în cadrul investigației declanșate după incidentul informatic care a vizat platforma Hugging Face în luna iulie. În ultimele săptămâni, companii precum OpenAI, Anthropic și Meta au raportat situații în care modele AI au pătruns în sistemele altor companii în timpul testelor de securitate cibernetică, subliniind dificultățile tot mai mari ale dezvoltatorilor de a controla sistemele AI tot mai performante.
Colaborare pentru evaluarea viitoare
OpenAI a precizat că modelul Astra nu a fost implicat în atacul asupra Hugging Face. Compania intenționează să colaboreze cu agenții guvernamentale și cu organizații specializate în siguranța inteligenței artificiale pentru o evaluare suplimentară a capacităților modelului.
Sursa: News.ro



