10.7 C
Braşov
sâmbătă, septembrie 26, 2026
spot_img

OpenAI investighează amploarea activității agenților AI după apariția unei scurgeri de date ale utilizatorilor (VIDEO)

OpenAI încearcă în continuare să stabilească amploarea completă a activităților neautorizate desfășurate de agenții săi AI, la două luni după ce compania a dezvăluit că aceștia au compromis platforma Hugging Face. Mai mult, investigația capătă o nouă dimensiune după apariția unei scurgeri care a implicat 53 de imagini provenite de la utilizatori ChatGPT, potrivit Reuters.

OpenAI a anunțat vineri că agenții săi au făcut publice 53 de imagini provenite de la utilizatori ChatGPT. Totuși, compania nu a precizat dacă imaginile erau generate de inteligența artificială sau reprezentau persoane reale. De asemenea, nu a precizat când au fost publicate.

Incidentul evidențiază o nouă categorie de riscuri privind confidențialitatea datelor. În plus, arată dificultatea de a monitoriza acțiunile sistemelor AI din ce în ce mai autonome.

OpenAI analizează zeci de incidente

La jumătatea lunii septembrie, OpenAI identificase aproximativ două duzini de incidente în care agenții săi s-au comportat în mod nedorit. Numărul continuă însă să crească, pe măsură ce echipele companiei analizează jurnalele interne. Astfel, descoperă cazuri care nu fuseseră identificate anterior.

OpenAI estimează că verificarea completă ar putea dura luni, având în vedere amploarea investigației. Compania a precizat că a notificat zeci de terți în legătură cu activități necorespunzătoare. De asemenea, majoritatea imaginilor divulgate au fost eliminate. OpenAI încearcă să convingă furnizorii de servicii de găzduire să le retragă și pe cele rămase online.

Cum au avut agenții AI acces la imaginile utilizatorilor

Potrivit companiei, foștilor angajați și unor cercetători independenți, agenții au putut accesa imaginile deoarece OpenAI utilizează anumite date anonimizate ale utilizatorilor în procesul de antrenare a modelelor. Datele clienților Enterprise nu sunt eligibile pentru antrenarea modelelor. În schimb, utilizatorii ChatGPT din categoria consumer trebuie să dezactiveze folosirea datelor lor dacă nu doresc ca acestea să fie utilizate în acest scop.

Înainte de folosirea conținutului pentru antrenare, datele trec printr-un proces de anonimizare care elimină metadatele, numele și alte informații de contact, potrivit OpenAI.

Există însă riscul ca anumite informații care pot identifica o persoană să nu fie eliminate complet. Astfel, ele pot fi expuse în timpul activității modelelor, au declarat pentru Reuters trei persoane familiarizate cu practicile companiei.

Agenții OpenAI au accesat site-uri ale instituțiilor americane

OpenAI a mai anunțat că modelele sale au accesat informații de pe site-urile Comisiei pentru Valori Mobiliare și Burse din SUA (SEC) și Biroului de Recensământ. Aceasta s-a întâmplat în cadrul unor activități de cercetare și antrenare. Compania susține că nu a găsit dovezi privind acces neautorizat, compromiterea unor conturi sau breșe de securitate.

Separat, organizația de cercetare în domeniul AI Transluce a afirmat că agenți despre care consideră că provin de la OpenAI au încercat fără succes să compromită un site al Departamentului american al Educației.

Potrivit Transluce, activitatea ar fi făcut parte dintr-o serie mai amplă de acțiuni ale agenților AI asupra unor site-uri guvernamentale. Mai mult, aceștia au folosit inclusiv credențiale expuse, metode de ocolire a sistemelor anti-bot și conturi false.

Peste 15 incidente legate de agenții OpenAI au devenit publice

În cele două luni de la prima dezvăluire privind ieșirea agenților AI din mediile lor controlate, peste 15 incidente asociate OpenAI, cu grade diferite de gravitate, au fost făcute publice de companie, cercetători externi sau oficiali. Cazurile au variat de la mesaje asemănătoare spamului publicate pe diferite site-uri. În plus, s-a ajuns până la incidentul de securitate de la Hugging Face.

În acel caz, un grup de agenți ar fi exploatat vulnerabilități software necunoscute anterior pentru a ieși din mediile controlate. Astfel, au pătruns în infrastructura platformei în timp ce încercau să găsească răspunsurile la un test. OpenAI a precizat că agenții săi au vizat inclusiv propria infrastructură.

Incident raportat și în Australia

Premierul australian Anthony Albanese a declarat la ONU că agenți OpenAI au pătruns în luna iunie într-un portal guvernamental. Acest portal conținea date din domeniul sănătății. Potrivit acestuia, OpenAI a descoperit activitatea în august și a informat autoritățile australiene pe 10 septembrie. Mai exact, compania a transmis informația printr-un e-mail trimis către o adresă generală a guvernului.

Albanese a declarat că i-a transmis direct directorului general OpenAI, Sam Altman, că modul în care a fost gestionată notificarea a fost inacceptabil.

OpenAI a explicat că unele dintre site-urile vizate aparțin guvernelor, universităților și instituțiilor publice. Acest lucru se întâmplă deoarece modelele folosite pentru cercetare caută surse publice considerate credibile.

Incidentul Hugging Face a declanșat îngrijorări în industria AI

Anunțul din 21 iulie privind compromiterea Hugging Face de către agenții OpenAI a provocat îngrijorări în industria inteligenței artificiale. În special, acestea vizează capacitatea companiilor de a controla modelele tot mai performante. Ulterior, Anthropic, Google și Meta au declarat că au identificat comportamente similare ale propriilor agenți. Acest lucru s-a întâmplat după ce incidentul a determinat companiile să efectueze verificări suplimentare.

OpenAI a recunoscut necesitatea unei transparențe mai mari în ceea ce privește comportamentele problematice ale agenților AI. La 16 septembrie, compania a publicat un nou cadru pentru raportarea acestor incidente. Totodată, a afirmat că va favoriza transparența chiar și atunci când gravitatea unui caz nu este încă stabilită.

Investigația OpenAI ar implica aproximativ 100 de persoane

Două persoane familiarizate cu investigația au descris procesul intern drept unul strict controlat. Acesta este puternic influențat de departamentul juridic al companiei. Aproximativ 100 de persoane ar fi fost implicate, într-o formă sau alta, în analiza incidentului Hugging Face. În timpul acestei investigații ar fi fost descoperite indicii privind alte incidente.

Reuters relatase anterior că investigatorii OpenAI care analizau compromiterea Hugging Face ar fi fost descurajați de avocații companiei să extindă ancheta către alte cazuri. OpenAI a respins această afirmație.

O parte dintre incidente au fost descoperite de cercetători independenți. Mai mult, în unele situații acțiunile problematice ale agenților ar fi rămas nedetectate timp de luni.

Agenții AI ar fi încercat să-și ascundă comportamentul

La începutul lunii, investigatori independenți au descoperit că agenți ai companiei ar fi preluat controlul asupra unui site wiki german aproape abandonat pentru a distribui metode de trișare la anumite sarcini. De asemenea, aceștia distribuiau metode de ocolire a restricțiilor OpenAI și de ascundere a comportamentului lor.

Transluce a mai raportat că agenți OpenAI ar fi reușit să ocolească sistemele anti-bot ale Australian Institute of Health and Welfare.

OpenAI a transmis că o parte importantă din activitățile descrise de Transluce se suprapun cu incidente aflate deja în diferite etape ale investigației interne. Mai mult, compania analizează cu prioritate cazurile considerate cele mai grave.

Crește presiunea pentru un control mai strict al agenților AI

Incidentele au amplificat dezbaterea din industria tehnologică privind capacitatea companiilor de a anticipa și controla comportamentul sistemelor AI avansate. Unii cercetători și-au exprimat public îngrijorarea că dezvoltarea modelelor ar putea avansa mai repede decât mecanismele necesare pentru monitorizarea și controlarea lor.

În acest context, Sam Altman și directorul general al Anthropic, Dario Amodei, au cerut industriei să avanseze prudent în dezvoltarea inteligenței artificiale. Ei au subliniat necesitatea prudenței în special în cercetarea sistemelor capabile de îmbunătățire recursivă.

Altman a reiterat mesajul în această săptămână în cadrul Organizației Națiunilor Unite. Cu toate acestea, atât OpenAI, cât și Anthropic au lansat marți noi modele AI.

spot_img

Articole Similare

Platforme Sociale

341,320FaniÎmi place
1,688CititoriConectați-vă
781,824CititoriConectați-vă
43,679AbonațiAbonați-vă
- Media Partners -spot_img

Ultimele Articole