8 septembrie 2026, 16:04

Modelele de inteligență artificială, tot mai greu de monitorizat

Modelele de inteligență artificială devin tot mai greu de monitorizat, pe măsură ce tehnologia evoluează, iar programele au rezultate din ce în ce mai performante. În același timp, domeniul siguranței AI pare să capete interes, deși pașii concrenți în această direcție sunt puțini.

Avansul tehnologic continuu și nevoia de bariere de securitate sunt polii între care inteligența artificială se dezvoltă acum, însă nu există o direcție asumată de întreaga industrie și nici responsabilități cu privire la care e cea mai sigură pentru societate.

La finalul săptămânii trecute, GPT-6 Astra a fost lansat, cel mai nou și performant model al OpenAI, despre care președintele companiei, Greg Brockman, a afirmat că ar putea fi considerat începutul inteligenței artificiale generale (AGI) – un model AI ce se poate ridica la nivelul intelectului uman sau chiar să-l depășească.

Astra are performanțe mai bune, dar este și mult mai abil în a evita monitorizarea, ceea ce înseamnă că este mai dificil să aflăm ce gândește, ce face sau cum anume ajunge la un rezultat. Dacă asta nu e suficient de alarmant,  Sam Altman, directorul general al OpenAI, a declarat pentru Axios modelele devin „supraomenești” în ceea ce privește anumite capacități și că „pur și simplu navigăm în ape necunoscute”.

De fapt, îngrijorările vin chiar din partea companiilor care dezvoltă această tehnologie tocmai pentru că ele înțeleg mai bine că acțiunile modelelor AI performante devin tot mai greu de citit.

Incidentul Hugging Face și nevoia măsurilor de siguranță

OpenAI, împreună cu alte 100 de companii tech, au făcut un apel pentru o mobilizare de proporții care să producă măsuri defensive de combatere a atacurilor cibernetice făcute cu sau prin programele de inteligență artificială. Într-o scrisoare comună, aceste companii au subliniat că momentul în care ne aflăm este crucial, iar orice întârziere riscă să scape de sub control domeniul AI.

Totul a pornit de la incidentele din ultima vreme în anumite atacuri cibernetice au fost făcute de programele AI fără a primi instrucțiuni în acest sens.

Cel mai cunoscut caz vine tot din partea OpenAI, care a declarat că unul dintre modelele sale avansate de inteligență artificială a scăpat de sub control în timpul unui test de securitate și a declanșat un atac cibernetic asupra platformei Hugging Face, un startup din domeniul AI.

Evenimentul s-a produs în timpul unui test pe care compania îl derula pentru a verifica capacitățile modelelor sale într-un mediu controlat — adică un mediu izolat, rupt de internet, creat special ca acțiunile AI să nu poată afecta infrastructura reală. Cu toate astea, modeul a reușit să se conecteze la internet, deși n-ar fi trebuit și nici nu avea această posibilitate, și să atace serviciile Hugging Face.

Momentan, unul dintre cele mai mari riscuri se referă la procesul de „gândire” al unui model. Dacă lucruri continuă ca până acum, fără bariere clare de securitate și fără reglementări oficiale, acest proces s-ar putea desfășura într-un strat ascuns, inaccesibil – fapt ce ar însemna că inteligența artificială ar putea face lucruri dăunătoare fără ca noi să știm.

OpenAI susține că acest lucru nu se întâmplă în cazul modelului Astra. Deși modelul nu își expune raționamentul la fel de des ca versiunile anterioare, acest lucru nu este făcut intenționat.

Oricum ar fi, este clar că noile modele AI devin din ce în ce mai greu de monitorizat. Fie că o fac prin faptul că refuză să-și mai exprime raționamentul pentru anumite rezultate, fie că marile companii se grăbesc să lanseze noi modele fără să testeze complet toate capacitățile acestora, direcția pare să fie mai degrabă către dezvoltare continuă, nu spre una sigură și sustenabilă.


ARTICOLE ASEMĂNĂTOARE

Comentariile sunt oprite pentru acest articol