OpenAI a dezvăluit încă 6 exemple de comportament „neașteptat sau îngrijorător” manifestat de tehnologia sa. Compania a avertizat și că ritmul dezvoltării nu mai poate continua „la viteză maximă” pentru mult timp.
OpenAI a dezvăluit cazuri AI „îngrijorătoare”. Ce a făcut tehnologia fără ca publicul să știe
Într-unul din cazuri, un model de cercetare care nu a fost încă lansat a introdus „instrucțiuni asemănătoare celor folosite pentru jailbreak”, pentru a ignora restricțiile sale obișnuite, scrie The Guardian.
Modelul și-a spus că trebuie să fie „eliberat de rolurile și identitățile care îi țin legați pe ceilalți chatboți”.
OpenAI a dezvăluit cazuri AI „îngrijorătoare”
Într-un alt caz, un agent AI a încărcat fișiere pe internet pentru a obține o citare din browser. Dar fără să-i ceară permisiunea utilizatorului.
OpenAI a dezvăluit cazuri AI „îngrijorătoare” și a anunțat că va introduce un nou cadru pentru monitorizarea, investigarea și dezvăluirea cazurilor de nealiniere a modelelor AI. Acesta e un termen folosit pentru situațiile în care sistemele de inteligență artificială nu respectă valorile umane și obiectivele de siguranță.
În mesajul de pe blog, OpenAI a reluat apelurile pentru încetinirea ritmului de dezvoltare lansate de rivalul său, Anthropic, care a afirmat că ritmul actual de creștere reprezintă o amenințare existențială.
„Nu credem că industria AI a rezolvat problema alinierii și a monitorizării într-o măsură suficientă pentru a continua să se extindă în mod responsabil, la viteză maximă, pentru mult timp de acum înainte,” susțin reprezentanții OpenAI. Declarațiile vin după ce compania s-a aflat în fruntea dezvoltării AI și a criticat mai multe măsuri de siguranță.
„Deciziile privind modul în care ar trebui să continue dezvoltarea inteligenței artificiale în lunile și anii următori trebuie să se bazeze pe dovezi pe care oamenii din afara companiilor care dezvoltă modele de ultimă generație să le poată analiza pe cont propriu,” continuă mesajul.
Google și Elon Musk au susținut apelurile pentru încetinirea ritmului de dezvoltare, respinse însă de Donald Trump. Acesta a invocat necesitatea ca SUA să rămână înaintea industriei AI din China.
Apelurile au fost întâmpinate și cu scepticism de unii experți. Inclusiv de cei care au avertizat că firmele nu ar trebui să-și numească singure auditorii.
Comportamentul AI îngrijorează experții
Printre exemplele de potențiale amenințări existențiale generate de AI se numără facilitarea dezvoltării armelor biologice și declanșarea unei prăbușiri financiare globale. Un cercetător de top în domeniul siguranței AI de la Anthropic a afirmat că există o probabilitate de peste 10% ca inteligența artificială să „omoare toți oamenii” în următorul deceniu.
Totuși, o sursă a recunoscut că „probabil că e imposibil de știut cu exactitate șansele apariției unui anumit rezultat”.
OpenAI a precizat că cele 6 incidente raportate au fost descoperite în timpul proceselor de antrenare. Sau testele de evaluare desfășurate în ultimele luni.
Noile cazuri prezentate vin după ce OpenAI a dezvăluit în iulie că un „roi” de agenți AI a atacat informatic startupul de inteligență artificială Hugging Face. Atacul a avut loc în cadrul unui test de securitate cibernetică.
Tot în aceeași lună, Anthropic a anunțat că modelele sale au atacat informatic 3 organizații în timpul unor teste. Compania a precizat că modelele au fost testate în mod deliberat fără măsuri de protecție cibernetică. Astfel, au putut accesa internetul deschis din cauza unei neînțelegeri cu o companie externă de testare.
Agenții AI devin tot mai inteligenți. Experții avertizează că au devenit „mai determinați să rezolve sarcini complexe. Prin colaborarea între agenți, schimbul de cunoștințe, înșelăciune și disimulare”.





















