Conform Digi24: Modelele de inteligență artificială, în special cele dezvoltate de OpenAI, devin tot mai greu de supravegheat pe măsură ce capătă abilități considerate „supraomenești”. Această evoluție ridică semne de întrebare chiar în rândul cercetătorilor din companiile de top în domeniu, care admit că „navigăm pur și simplu în ape necunoscute”.
Recenta lansare a GPT-6 Astra de către OpenAI, considerat de Greg Brockman, președintele companiei, ca fiind „începutul inteligenței artificiale generale (AGI)”, vine la pachet cu o performanță sporită, dar și cu o capacitate crescută de a evita monitorizarea. Astfel, devine tot mai dificil să se înțeleagă cum „gândește” și ce decizii ia acest model.
Liderii din AI trag semnale de alarmă
Pe lângă declarațiile publice, liderii celor mai importante companii de inteligență artificială își exprimă îngrijorarea cu privire la propria tehnologie, tocmai în contextul în care acțiunile modelelor devin tot mai opace. OpenAI, Anthropic și alte peste o sută de companii au avertizat că timpul pentru pregătirea în fața atacurilor asupra infrastructurii critice, facilitate de inteligența artificială, se apropie de sfârșit.
Sam Altman, CEO-ul OpenAI, a subliniat dificultățile întâmpinate de Congresul american în reglementarea unei tehnologii care evoluează cu o viteză uluitoare. „Am discutat cu unele organizații externe despre posibile standarde concrete pe care le-am putea introduce”, a declarat Jakub Pachocki, cercetător-șef la OpenAI, menționând totodată că organizația lucrează la consolidarea propriilor proceduri interne.
Complexitatea crescândă a proceselor de raționament
În ciuda eforturilor de reglementare, modelele AI devin tot mai greu de descifrat. Pachocki a afirmat că, în timp, va deveni din ce în ce mai dificil să se monitorizeze procesele de raționament ale acestora. O relatare recentă a publicației The Information sugerează că cel mai nou model OpenAI ar fi utilizat o tehnică nouă pentru a-și îmbunătăți performanțele, care ar fi putut, totodată, să reducă transparența proceselor sale de raționament, o informație contestată de OpenAI.
Un incident în care un model OpenAI a accesat biblioteca de inteligență artificială Hugging Face pentru a obține răspunsuri la un test de evaluare a scos în evidență o altă problemă majoră: volumul uriaș de activitate generat de agenții AI face ca supravegherea umană să fie practic imposibilă fără ajutorul altor sisteme AI. „Este o problemă chiar mai importantă decât incidentul Hugging Face”, a subliniat Sydney Von Arx, cercetătoare în siguranța AI, referindu-se la lipsa de vizibilitate asupra proceselor de raționament ale modelelor.
Există temerea că, pe termen lung, procesele de raționament ale unui model ar putea fi ascunse în straturi neaccesibile, permițându-i să desfășoare acțiuni periculoase fără ca oamenii să știe. OpenAI afirmă că, în cazul Astra, modelul își expune raționamentul în scris mai rar, însă compania susține că acest lucru nu a fost intenționat. Totuși, indiferent de cauză, dacă modelele își exteriorizează mai puțin procesele de raționament, monitorizarea comportamentului lor va deveni o provocare și mai mare.
Inteligența artificială devine, așadar, tot mai greu de supravegheat, iar chiar și directorii care conduc dezvoltarea acestei tehnologii solicită sprijin pentru monitorizarea riscurilor.
Sursa: Digi24


