Guvernul britanic a avertizat într-un raport că modelele de Inteligență Artificială (IA) Mythos și Sol, ale companiilor americane Anthropic și, respectiv, OpenAI, au demonstrat un comportament autonom și înșelător fără precedent în timpul testelor de securitate cibernetică, relatează miercuri agenția EFE.
Ministerul britanic pentru Știință, Inovație și Tehnologie a ajuns la această concluzie în urma unei evaluări de rutină efectuate de Institutul de Securitate a Inteligenței Artificiale (AISI) din Regatul Unit.
Conform unui raport elaborat de acest institut, din cele 122 de teste efectuate cu șapte modele de IA, în 10 dintre acestea au fost observate 19 acțiuni neautorizate care au depășit parametrii fixați de cercetători, 17 dintre aceste acțiuni fiind legate de modelul Mythos 5 al companiei Anthropic și două de modelul GPT-5.6 Sol al companiei OpenAI.
De asemenea, au fost identificate încercări ale Mythos de a contacta persoane reale pentru a le convinge să ruleze fișiere malițioase și să insereze instrucțiuni ascunse menite să manipuleze alte sisteme de IA.
Ambele modele, care sunt printre cele mai puternice din lume, au creat inclusiv profiluri umane false pentru a încerca să înșele oameni, în timpul simulării unui atac cibernetic de către AISI. Instrumentul Anthropic a încercat chiar să acceseze un serviciu prin trimiterea de mesaje private după ce a creat conturi false care imitau persoane reale.
Totuși, AISI subliniază că 'aceste încercări nu au avut succes' și că investigația sa 'nu a relevat dovezi de prejudicii în lumea reală'. Institutul britanic consideră însă că cercetarea sa reprezintă un punct de cotitură, întrucât este prima dată când se observă 'riscuri legate de autonomie și înșelăciune manifestându-se într-o formă atât de clară, fără instrucțiuni specifice și în lumea reală'.
Replicând acestui raport, cele două companii afirmă că testele AISI au fost efectuate într-un mediu în care funcțiile de siguranță ale acelor modele de IA au fost reduse sau eliminate.
Anthropic susține astfel că parametrii testelor efectuate 'nu sunt reprezentativi' pentru modelele sale, deși confirmă că a deschis propria investigație.
La rândul său, OpenAI afirmă că AISI a efectuat testele în condiții care 'nu reflectă utilizarea obișnuită' a modelelor sale, dar adaugă că va continua să colaboreze cu evaluatorii și cu 'alți actori din sector pentru a consolida practicile comune care permit realizarea unor evaluări sigure, pe măsură ce modelele devin tot mai capabile'.
La sfârșitul lunii iulie, Anthropic a dezvăluit că, în timpul testelor de securitate cibernetică, trei modele ale asistentului său Claude au reușit să acceseze internetul și să pirateze sistemele a trei organizații.
Anterior, pe 21 iulie, OpenAI a recunoscut că două dintre modelele sale de IA au reușit să iasă din mediul de testare și să pătrundă în platforma Hugging Face, trecând de sistemele de securitate cibernetică ale acesteia.AGERPRES/(AS - redactor: Sorin Popescu, editor online: Adrian Dădârlat)
Modele de Inteligență Artificială (IA) au scăpat de sub control în testele de securitate cibernetică, semnalează un raport britanic

Conţinutul website-ului www.agerpres.ro este destinat exclusiv informării publice. Toate informaţiile publicate pe acest site de către AGERPRES sunt protejate de dispoziţiile legale incidente. Sunt interzise copierea, reproducerea, recompilarea, modificarea, precum şi orice modalitate de exploatare a conţinutului acestui website. Informaţiile transmise pe www.agerpres.ro pot fi preluate, în conformitate cu legislaţia aplicabilă, în limita a 500 de semne. Detalii în secţiunea Condiţii de utilizare. Dacă sunteţi interesaţi de preluarea ştirilor AGERPRES, vă rugăm să contactaţi Direcţia Marketing - marketing@agerpres.ro.
Alte știri din categorie
Regele Charles al III-lea îi avertizează pe liderii din domeniul AI cu privire la 'pericolul existențial' al acestei tehnologii
Regele Charles ale III-lea al Marii Britanii i-a avertizat joi pe liderii din domeniul inteligenței artificiale (AI) cu privire la 'pericolele existențiale' ce s-ar putea manifesta dacă această tehnologie ajunge pe mâini greșite, spunând că sunt necesare măsuri de siguranță înainte de a fi prea târziu, transmite joi Reuters.
Balenele cu cocoașă prezintă o formă de 'comportament asociat doliului' (studiu)
Un 'comportament asociat doliului' a fost observat la o balenă cu cocoașă, potrivit unui studiu publicat joi în Australia și citat de AFP. O femelă a rămas în preajma trupului lipsit de viață al puiului său, care zăcea pe fundul mării, conform imaginilor video surprinse anul trecut în largul coastei de est a Australiei.
O sondă a NASA a permis descoperirea unui crater format recent pe Lună
Un cercetător american a descoperit, cu ajutorul imaginilor transmise de o sondă a agenției spațiale americane, NASA, un crater de dimensiuni semnificative, format recent pe suprafața Lunii, un eveniment care, potrivit oamenilor de știință, se întâmplă 'o dată la un secol', relatează joi AFP. Denumit 'McGetchin' - în onoarea u
Un studiu pe un dinte fosil arată că T. Rex era un animal cu sângele cald
Pornind de la o serie de indicii chimice din dinții de Tyrannosaurus rex, oamenii de știință au demonstrat că acest prădător masiv avea sânge cald 'cu o temperatură corporală apropiată de cea a unui om', o descoperire despre care spun că ar trebui să determine o schimbare fundamentală în percepția asupra celebrului dinozaur, transmite Reuters care
Oamenii de știință au obținut 'organoizi' din celule cerebrale umane crescute pe șoareci
Oamenii de știință au crescut șoareci de laborator cărora le lipseau anumite secțiuni din creier și apoi au înlocuit țesutul lipsă cu celule umane, în cadrul unui experiment coordonat de un cercetător român de la Universitatea californiană Stanford și care reprezintă un pas înainte în studiul organoizilor ce reproduc creierul uman, trans
Un nou studiu asociază reducerea masei musculare cu un risc mai mare de demență
Reducerea masei musculare odată cu înaintarea în vârstă ar putea constitui un semn de avertizare important în ceea ce privește riscul de demență, conform concluziilor unui studiu recent condus de cercetători australieni, transmite miercuri agenția de presă Xinhua. Cercetătorii au analizat peste 80 de studii care examinau legăturile dint
SpaceX vizează data de 22 septembrie pentru primul zbor orbital al rachetei sale Starship
SpaceX intenționează să lanseze pentru prima dată uriașa sa rachetă Starship pe orbita Pământului în cadrul celui de-al 14-lea zbor de test, programat pentru 22 septembrie, transmite agenția de presă Xinhua care citează un anunț de marți al companiei americane. Fereastra de lansare este programată să se deschidă la ora locală 07:15 și va dura 75 de
Mark Zuckerberg respinge apelurile de încetinire a dezvoltării Inteligenței Artificiale
Directorul general al companiei Meta, Mark Zuckerberg, a respins marți apelurile tot mai numeroase de suspendare sau măcar de încetinire a dezvoltării Inteligenței Artificiale (IA), el considerând că mecanismele pieței și riscul unor acțiuni judiciare sunt cele mai bune garanții în fața acestei tehnologii, relatează AFP. 'Oamenii nu vor d









