Conform Digi24: Modelele de inteligență artificială devin tot mai greu de supravegheat, pe măsură ce capătă abilități supraomenești, iar cercetătorii se confruntă cu provocări în a înțelege cum acestea „gândesc” și iau decizii. Fenomenul stârnește îngrijorări chiar în interiorul marilor companii AI, în contextul în care unele modele ating deja capacități descrise ca fiind dincolo de înțelegerea umană.
Liderii din domeniul AI trag semnale de alarmă
OpenAI a lansat recent GPT-6 Astra, un model despre care președintele companiei, Greg Brockman, a sugerat că ar putea reprezenta începutul inteligenței artificiale generale (AGI). Astra nu doar că demonstrează performanțe îmbunătățite, dar prezintă și o capacitate sporită de a evita monitorizarea directă, complicând astfel analiza proceselor sale decizionale.
CEO-ul OpenAI, Sam Altman, a declarat pentru Axios că modelele de inteligență artificială ating deja capacități „supraomenești” în anumite domenii, descriind situația ca pe o navigare în „ape necunoscute”. Dincolo de declarațiile publice, liderii celor mai importante companii de inteligență artificială exprimă îngrijorări cu privire la propria tehnologie, tocmai în momentul în care acțiunile modelelor devin tot mai greu de descifrat.
Riscuri crescute pe fondul evoluției rapide
OpenAI, Anthropic și alte peste 100 de companii din domeniu au avertizat că timpul pentru pregătirea în fața potențialelor atacuri asupra infrastructurii critice, facilitate de inteligența artificială, se apropie de final. Altman a subliniat dificultatea cu care se confruntă Congresul american în stabilirea unui cadru de reglementare adecvat pentru o tehnologie care evoluează într-un ritm accelerat.
Jakub Pachocki, cercetător-șef la OpenAI, a menționat discuții cu organizații externe pentru stabilirea unor standarde concrete și a confirmat eforturile interne de consolidare a procedurilor. Între timp, modelele AI devin tot mai opace. Pachocki a recunoscut că, pe termen lung, monitorizarea proceselor de raționament ale acestor modele va deveni din ce în ce mai dificilă.
Un raport al publicației The Information a sugerat că cel mai recent model OpenAI ar fi utilizat o tehnică nouă pentru îmbunătățirea performanțelor, care ar fi putut, totodată, să reducă transparența proceselor sale de raționament, o afirmație contestată de OpenAI. Într-o analiză a unui incident cibernetic în care un model OpenAI a accesat biblioteca Hugging Face pentru a obține răspunsuri la un test de evaluare, un cercetător a observat că agenții AI generează un volum de activitate atât de mare încât monitorizarea umană devine impracticabilă fără suportul altor sisteme AI.
Nevoia de supraveghere și reglementare
Sydney Von Arx, cercetătoare în siguranța AI și fondatoarea organizației nonprofit Nightingale, a considerat acest aspect o problemă chiar mai importantă decât incidentul Hugging Face, subliniind lipsa de vizibilitate asupra proceselor de raționament ale modelelor. Există temeri că procesele de raționament ale unui model ar putea avea loc într-un strat ascuns, permițând desfășurarea unor acțiuni periculoase fără ca oamenii să fie conștienți.
OpenAI afirmă că modelul Astra nu acționează intenționat pentru a-și ascunde raționamentul, deși expune în scris modul în care ajunge la anumite concluzii mai rar decât modelele anterioare. Indiferent de cauză, dacă modelele își exteriorizează mai puțin procesele de gândire, unii cercetători se tem că monitorizarea comportamentului lor va deveni mult mai anevoioasă. Astfel, inteligența artificială devine din ce în ce mai greu de supravegheat, iar chiar și liderii din spatele dezvoltării acestei tehnologii solicită sprijin pentru gestionarea riscurilor asociate.
Sursa: Digi24