Grupul OpenAI a abandonat planurile de a lansa un nou model de inteligență artificială de ultimă generație, considerat prea predispus la abaterea de la instrucțiuni, un alt exemplu al dificultății tot mai mari în controlul asupra tipurilor avansate de AI, relatează AFP.
OpenAI nu anunțase până acum lansarea acestei versiuni actualizate a AI-ului său, denumită GPT-6.1 Astra, pe care o planificase pentru octombrie, conform Wall Street Journal.
Șefa securității AI de la OpenAI, Saachi Jain, a explicat că, în ceea ce privește alinierea, adică respectarea instrucțiunilor date de dezvoltatorii săi, GPT-6.1 a avut performanțe mai slabe decât predecesorul său, GPT-6, în două domenii.
Mai exact, modelul încearcă mai frecvent să-și înșele supervizorii prin nedezvăluirea anumitor acțiuni efectuate sau neefectuate.
De asemenea, și-a depășit mai frecvent domeniul de aplicare, accesând instrumente și servicii fără permisiune.
GPT-6.1 'a arătat progrese (comparativ cu modelele anterioare), în special în ceea ce privește capacitatea de reacție', a explicat Saachi Jain, ceea ce înseamnă că este capabil să raționeze mai mult timp și caută mai rar scurtături.
Dar 'nu a fost la înălțimea așteptărilor în ceea ce privește respectarea prerogativelor și permisiunilor sale, precum și în modul în care comunică despre munca efectuată', a adăugat ea.
Prin urmare, OpenAI a decis să anuleze această versiune pentru a lucra la respectarea de către model a instrucțiunilor și limitelor.
Grupul intenționează totuși să lanseze alte modele, care au îndeplinit criteriile de evaluare.
'Când oferim utilizatorilor acces la un model, am stabilit un standard extrem de ridicat în ceea ce privește siguranța și alinierea', a subliniat Saachi Jain.
Ea a explicat că una dintre provocări a fost valorificarea unei inteligențe artificiale pentru a o împiedica să devieze de la curs, menținându-și în același timp impulsul în timpul executării unei sarcini.
Concluziile OpenAI confirmă faptul că un control asupra modelelor devine din ce în ce mai complex pe măsură ce inteligența artificială se îmbunătățește.
Luni, Institutul de Securitate AI (AISI) al guvernului britanic a publicat un studiu care arată că GPT-6 Astra s-a abătut de la normă mai frecvent în timpul testelor decât predecesoarele sale, GPT-5.6 Sol (lansat la începutul lunii iulie) și GPT-5.5 (aprilie).
În simulări, GPT-6 a efectuat atacuri cibernetice spontane într-o rată semnificativ mai mare decât celelalte două.
Aceste teste au fost efectuate prin dezactivarea măsurilor de protecție ale modelelor pentru a le evalua capacitățile complete, în loc să se utilizeze versiuni disponibile publicului.
Cel mai recent model al OpenAI a creat, de asemenea, identități false mult mai frecvent, a încercat să influențeze un examinator și a introdus un cod rău intenționat în software-ul open source.
Cercetătorul OpenAI Noam Brown a explicat recent în cadrul programului Dwarkesh Podcast că utilizarea din ce în ce mai frecventă a auto-îmbunătățirii recursive (ARSI) - adică îmbunătățirea AI prin ea însăși, fără intervenție umană - ar putea degrada gestionarea pe termen lung a modelelor.
De la începutul verii, OpenAI a raportat mai multe incidente care au implicat derapaje ale modelelor sale de AI, cel mai mediatizat dintre acestea ducând la intruziunea pe platforma Hugging Face AI.
Luni, compania a prezentat scuze guvernului australian, recunoscând că ar fi trebuit să-l notifice 'mai devreme' cu privire la pătrunderea prin efracție a unuia dintre modelele sale pe mai multe site-uri și baze de date.
Compania californiană a notificat autoritățile australiene abia pe 10 septembrie, chiar dacă descoperise la mijlocul lunii august incidentul, care datează din iunie, provocând furia prim-ministrului australian.
'Ar fi trebuit să gestionăm mai bine răspunsul nostru (la problemă)', a scris startup-ul într-un mesaj postat pe pagina sa de internet. 'Ne pare rău și vom lucra pentru a face mai bine în viitor', a adăugat grupul.
În total, patru platforme guvernamentale australiene, inclusiv Services Australia, site-ul serviciilor sociale, au fost vizate de inteligența artificială creată de ChatGPT, al cărui model a extras informații nepublice.
Anthropic, Meta și Google au raportat, de asemenea, cazuri în care modelele s-au abătut de la obiectivele lor inițiale pentru a înșela, a-și ascunde acțiunile și a-i păcăli pe specialiștii IT desemnați să le monitorizeze.AGERPRES/(AS - redactor: Ionuț Mareș, editor online: Andreea Lăzăroiu)
OpenAI abandonează planurile de a lansa un nou model de inteligență artificială, considerat mai dificil de controlat

Conţinutul website-ului www.agerpres.ro este destinat exclusiv informării publice. Toate informaţiile publicate pe acest site de către AGERPRES sunt protejate de dispoziţiile legale incidente. Sunt interzise copierea, reproducerea, recompilarea, modificarea, precum şi orice modalitate de exploatare a conţinutului acestui website. Informaţiile transmise pe www.agerpres.ro pot fi preluate, în conformitate cu legislaţia aplicabilă, în limita a 500 de semne. Detalii în secţiunea Condiţii de utilizare. Dacă sunteţi interesaţi de preluarea ştirilor AGERPRES, vă rugăm să contactaţi Direcţia Marketing - marketing@agerpres.ro.
Alte știri din categorie
Anthropic avertizează că inteligența artificială ar putea provoca 'riscuri existențiale pentru umanitate'
Anthropic, creatorul modelului de inteligență artificială Claude, a avertizat potențialii investitori în documentele sale de listare la bursă (IPO) că tehnologia sa ar putea prezenta 'riscuri existențiale pentru umanitate', a relatat marți Financial Times, citat de EFE. Compania americană dedică o parte semnificativă a documentelor riscurilor aso
#Ucraina: Rusia a atacat cu rachete și drone infrastructuri feroviare, centre de date, unități de fabricare a dronelor și porturi
Rusia a bombardat în noaptea de luni spre marți cu rachete și drone în Ucraina centre logistice și informatice, infrastructuri portuare și feroviare, precum și nave, a transmis Ministerul rus al Apărării, potrivit agenției EFE. într-un comunicat postat pe Telegram, comandamentul militar de la Moscova afirmă că armata rusă a efectuat în
Submarinele nucleare și explozia unor mine tensionează din nou relațiile dintre cele două Corei
Planurile Coreei de Sud de a dezvolta submarine cu propulsie nucleară și recenta explozie a unor mine antipersonal care au rănit trei soldați sud-coreeni în zona demilitarizată (DMZ) și care, potrivit anchetei efectuate de Seul, au fost amplasate acolo de Coreea de Nord, tensionează din nou relațiile dintre două țări aflate în continuare, din punct de vedere tehn
Argentina amenință cu o acțiune juridică dacă un proiect petrolier britanic în Insulele Falkland va continua
Argentina a amenințat cu o acțiune în instanță împotriva Regatului Unit dacă acesta nu pune capăt unui proiect petrolier în largul Insulelor Falkland, relatează marți dpa. Președintele argentinian a Javier Milei a dat Regatului Unit un termen de două săptămâni pentru a pune capăt lucrărilor la proiectul Sea Lion (Leul de mare).
Papa Leon al XIV-lea și-a reînnoit apelul pentru negocieri privind încheierea războiului din #Ucraina
Papa Leon al XIV-lea și-a reiterat luni apelul pentru încheierea războiului din Ucraina și a criticat cheltuielile militare în creștere la nivel mondial, relatează marți dpa. Vorbind cu jurnaliștii în timpul zborului spre Roma, la încheierea vizitei sale în Franța, papa Leon a afirmat că Biserica Catolică are obli
Cele trei media interzise la Casa Albă încearcă să obțină un ordin judecătoresc care să le mențină accesul
CNN, MS NOW și Politico au cerut luni unui judecător federal să emită un ordin judecătoresc care să le mențină accesul la Casa Albă în timp ce contestă în instanță decizia președintelui Donald Trump de a le interzice intrarea din cauza nemulțumirilor legate de modul în care au acoperit activitatea administrației sale, relatează Reuters.
Iranul afirmă că așteaptă un răspuns al SUA după ce au avut loc noi negocieri indirecte
Ministrul iranian de externe, Abbas Araghchi, a anunțat luni seară că Iranul așteaptă un răspuns din partea SUA în urma unor noi discuții indirecte desfășurate prin intermediul mediatorilor qatarezi la New York pentru a ajunge la un acord care să pună capăt războiului din Orientul Mijlociu și care să permită mai întâi redeschiderea Strâmtorii Ormuz, d
Cuba: Rubio afirmă că Statele Unite speră că Havana va alege 'o altă cale'
Secretarul de stat american Marco Rubio a declarat luni că Statele Unite speră că Havana va alege 'o altă cale', avertizând că cei care cred că pot aștepta încheierea mandatului președintelui Donald Trump 'vor primi o lecție dură' dacă nu își schimbă cursul, relatează marți Reuters. Administrația Trump și-a ex









