ȘtiriTech&IT

OpenAI abandonează lansarea noului său model GPT-6.1 Astra sub pretextul preocupărilor legate de siguranță

Prins între nevoia de a frâna cheltuielile scăpate de sub control și presiunea de a anunța noi inovații care să dea speranță investitorilor tot sceptici cu privire la capacitatea OpenAI de a genera vreodată profit, Sam Altman mizează pe „cartea” siguranței naționale/globale pentru a explica de ce abandonează lansarea GPT-6.1 Astra, cel mai costisitor LLM creat vreodată de OpenAI.

Potrivit narativului susținut de lui Saachi Jain, șeful sistemelor de siguranță de la OpenAI, GPT-6.1 Astra, care îndeplinește singur sarcini precum navigarea pe web și utilizarea aplicațiilor, „nu a îndeplinit pe deplin standardele” companiei.

Modelul GPT-6.1 Astra ”a eșuat în ceea ce privește respectarea domeniului de aplicare și autorizație și modul în care comunică utilizatorului despre tipul de muncă efectuată. Vrem să ne asigurăm că dezvoltarea modelului nostru este sigură, indiferent dacă este în cadrul companiei sau atunci când îl livrăm utilizatorilor. Dar atunci când îl livrăm utilizatorilor, avem un standard extrem de ridicat în ceea ce privește siguranța și alinierea”.

OpenAI a publicat, de asemenea, o actualizare cu privire la incidentele care au avut loc în luna iunie, dar care nu au fost făcute publice decât săptămâna trecută, în care modelele sale au accesat site-uri web și sisteme guvernamentale australiene fără autorizație. Pe de altă parte, experți independenți evidențiază faptul că „escapadele” modelelor GPT au avut loc în cadrul unor experimente unde respectivele LLM-uri au fost lăsate să consume „la discreție” resurse de procesare costând zeci de milioane de dolari, agenții creați încercând nenumărate scenarii pentru a rezolva sarcinile cerute în timp ce acționau într-un mediu virtual slab protejat. Altfel spus, putem suspecta în mod rezonabil că OpenAI, Anthropic și alți jucători din industrie care militează acum pentru frânarea dezvoltării/investițiilor în modele AI de avangardă, susținând că tehnologia ar putea prezenta „riscuri catastrofale sau existențiale pentru umanitate”, au acționat mai întâi pentru crearea condițiilor în care o astfel de profeție să pară plauzibilă.

Reprezentanții OpenAI au recunoscut că, deși știau încă din luna august conștientă că agenți GPT experimentali au spart mai multe site-uri guvernamentale din Australia, au așteptat până în luna septembrie pentru a trimite autorităților primele notificări. Prim-ministrul australian, care a vorbit de la tribuna ONU despre aceste incidente, a precizat că OpenAI a trimis un e-mail generic, în loc să ia contact direct cu oficiali guvernamentali.

Separat, cei de la Anthropic vin cu propriile declarații alarmiste, chiar în timp ce invită investitorii să finanțeze compania care ar putea aduce sfârșitul umanității participând la cea mai mare ofertare pe bursă (IPO) din toate timpurile.

Dar chiar în timp ce lideri de top în domeniul inteligenței artificiale, inclusiv șeful Anthropic, Dario Amodei, și Sam Altman de la OpenAI, îndeamnă industria să încetinească ritmul de dezvoltare, mesajul cu subînțeles transmis investitorilor invitați la ofertele IPO reflectă exact opusul acestor preocupări: tehnologiile noastre sunt atât de periculoase (puternice) încât trebuie să investiți acum și oricât, pentru a nu rămâne în urmă.

Modelul agentic emblematic GPT-6 Astra a fost prezentat în septembrie și este specializat în raționament complex și executarea autonomă a sarcinilor. OpenAI a declarat că este rezultatul a „ani de cercetare și pariuri mari”. Pe de altă parte, cel mai complex LLM creat vreodată de OpenAI vine cu costuri de procesare semnificative, nefiind clar dacă GPT-6 Astra poate fi suficient de competitiv cu alternativele mai puțin performante dar mai eficiente oferite de rivali.

La începutul acestui an, Anthropic a anunțat că nu va lansa public un model Claude puternic, Mythos, deoarece acesta era prea bun la găsirea erorilor software latente. Dar compania a lansat publicului o versiune a acelui model câteva luni mai târziu, oferind însă performanțe „diluate” prin reducerea complexității de procesare.

Luni, gigantul producător de cipuri Nvidia a lansat un set de instrumente de siguranță software pentru platformele autonome de inteligență artificială – numite agenți – despre care spune că ar fi putut preveni atacul cibernetic Hugging Face. Unul dintre aceste instrumente folosește caracteristici hardware din cipurile Nvidia pentru a conține agenții „zburdalnici”, semn că viitoarele centre de date pentru procesare AI mai sigură ar trebui să conțină mai multe cipuri Nvidia. Dar tot Nvidia, prin șeful Jensen Huang, a respins în mare măsură apelurile pentru reglementări mai stricte privind inteligența artificială, argumentând că agenții necinstiți reprezintă o problemă inginerească ce poate fi rezolvată.

Autor

  • Aurelian Mihai

    Îmi place să fiu la curent cu ultimele inovații și gadgeturi high-tech. Când nu scriu articole pentru Zona IT, îmi ocup timpul cu seriale SF, documentare sau periind internetul după tot felul de știri sau informații care-mi captează atenția. În weekend mă găsești cu bicicleta în parc sau colindând prin țară cu familia.

Back to top button