Anthropic susține că a blocat mai multe tentative de folosire abuzivă a modelelor sale Claude, inclusiv pentru cercetări care ar putea contribui la dezvoltarea armelor biologice și pentru o campanie de spionaj cibernetic împotriva Ucrainei. Aceste metode sunt asociate anterior hackerilor ruși. În plus, compania acuză și mai multe laboratoare de inteligență artificială din China că ar fi încercat să extragă capabilitățile Claude pentru dezvoltarea propriilor modele.
Informațiile apar în cel mai recent raport de Threat Intelligence publicat joi de Anthropic. Documentul analizează activități malițioase detectate în ultimele opt luni.
Compania avertizează că modelele AI devin suficient de performante pentru a prelua părți tot mai complexe din activități care anterior necesitau specialiști umani.
Claude, folosit în cercetări cu potențial pentru arme biologice
Una dintre cele mai grave probleme identificate de Anthropic privește cercetarea biologică. Compania afirmă că a descoperit cinci cazuri în care oameni de știință au utilizat modelele Claude în moduri care ar fi putut sprijini dezvoltarea armelor biologice.
Într-unul dintre cazuri, un cercetător aflat într-o regiune în care serviciile Anthropic nu sunt disponibile ar fi utilizat infrastructură de servere virtuale pentru a obține acces la Claude. Timp de mai multe săptămâni, acesta ar fi folosit modelul pentru planificarea unor experimente privind adaptarea gripei aviare la mamifere.
Anthropic nu a dezvăluit identitatea cercetătorului, instituția implicată, țara sau agenții biologici și tehnicile specifice analizate. După identificarea activității, compania spune că a blocat conturile respective și a folosit informațiile obținute pentru consolidarea măsurilor de siguranță.
AI folosită și pentru rachete, drone și alte arme
Raportul identifică și ceea ce Anthropic numește noi categorii de actori care încearcă să folosească Claude pentru dezvoltarea armamentului convențional.
Compania spune că a detectat utilizări legate de software pentru arme de foc, rachete, drone înarmate, bombe și alte tipuri de muniție. De asemenea, acestea au inclus sistemele de control și țintire asociate acestora. Au fost identificate astfel de activități în China, Rusia și Yemen.
Claude ar fi fost folosit fie pentru dezvoltarea unor componente software, fie pentru colectarea de informații și sprijinirea achizițiilor asociate programelor de armament.
Jacob Klein, șeful diviziei de informații privind amenințările din cadrul Anthropic, spune că progresul rapid al modelelor AI schimbă amploarea riscului. Potrivit acestuia, sarcini precum optimizarea software-ului unei drone sau al unei rachete pot fi realizate astăzi de modelele AI mult mai bine decât în urmă cu un an.
Presupuși hackeri ruși ar fi folosit AI împotriva Ucrainei
O altă secțiune importantă a raportului privește atacurile cibernetice. Anthropic susține că infractorii cibernetici și grupările sprijinite de state folosesc din ce în ce mai mult AI pentru a coordona și executa etape importante ale atacurilor. În unele cazuri, oamenii ar avea mai degrabă rolul de supraveghetori, în timp ce sistemele AI execută o mare parte din operațiuni.
Compania a identificat o grupare care ar fi desfășurat atacuri de phishing, compromiterea conexiunilor Wi-Fi din hoteluri și tentative de preluare a conturilor WhatsApp. Țintele proveneau din guvernul, armata și sectorul diplomatic ucrainean.
Metode similare cu cele asociate Midnight Blizzard
Anthropic afirmă că tehnicile grupării sunt compatibile cu cele atribuite anterior actorului cibernetic cunoscut sub numele de Midnight Blizzard. Guvernul american a asociat în trecut această grupare cu serviciul rus de informații externe, SVR.
Raportul nu stabilește însă în mod independent că operațiunea descrisă a fost desfășurată de serviciile rusești. Ambasada Rusiei la Washington nu a răspuns imediat unei solicitări de comentarii din partea Reuters.
Potrivit Anthropic, atacatorii ar fi folosit AI inclusiv pentru construirea unui sistem capabil să detecteze automat când programele malițioase erau identificate de instrumentele de securitate. Apoi modificau codul.
Compania afirmă că a identificat și perturbat separat activități asociate unor afiliați ai grupării de criminalitate cibernetică ShinyHunters.
Anthropic acuză șapte laboratoare chineze de atacuri asupra Claude
Raportul aduce acuzații și la adresa unor companii de inteligență artificială din China. Anthropic afirmă că, în perioada analizată, a blocat operațiuni provenite de la șapte laboratoare chineze, printre care Alibaba, Moonshot, DeepSeek și Xiaomi.
Companiile respective nu au răspuns imediat solicitărilor Reuters pentru comentarii.
Potrivit Anthropic, operatori asociați Alibaba ar fi desfășurat cea mai amplă tentativă de „distilare ilicită” identificată de companie. Scopul ar fi fost extragerea unor capabilități ale Claude pentru îmbunătățirea modelelor Qwen dezvoltate de Alibaba.
Peste 151 de milioane de interacțiuni atribuite Alibaba
Dimensiunea operațiunii descrise de Anthropic este considerabilă. Compania spune că a observat peste 151 de milioane de interacțiuni pe care le-a atribuit Alibaba în perioada mai-iulie 2026.
În anumite momente, activitatea ar fi ajuns la aproape trei milioane de interacțiuni pe zi. Acestea proveneau din peste 3.500 de conturi descrise de Anthropic drept frauduloase.
„Distilarea” este o metodă prin care răspunsurile unui model AI mai mare și mai performant sunt folosite pentru antrenarea unui model mai mic. Această procedură poate reduce semnificativ costurile necesare dezvoltării unui nou sistem AI.
Acuzația Anthropic este că această metodă ar fi fost utilizată fără autorizare pentru a reproduce o parte dintre capabilitățile Claude.
Acuzații și la adresa Moonshot și DeepSeek
Anthropic susține că a identificat și un alt tip de utilizare a tehnologiei sale. Moonshot, compania care dezvoltă chatbotul Kimi, și DeepSeek ar fi direcționat conversații reale ale utilizatorilor către Claude. Aceste companii ar fi utilizat răspunsurile obținute drept date pentru antrenarea propriilor modele. Potrivit raportului, unele dintre conversațiile respective ar fi conținut informații sensibile.
Nici Moonshot și nici DeepSeek nu au oferit imediat un răspuns pentru Reuters.
Ministerul chinez de Externe a declarat că nu cunoaște raportul Anthropic și că Beijingul susține dezvoltarea inteligenței artificiale în scopuri benefice. Autoritățile chineze au respins totodată ceea ce au descris drept denaturări ale faptelor și acuzații nefondate la adresa Chinei.
Crește presiunea pentru reguli mai stricte în domeniul AI
Raportul apare într-un moment în care dezvoltarea accelerată a inteligenței artificiale ridică tot mai multe întrebări privind securitatea.
Riscurile nu mai sunt limitate la generarea de texte înșelătoare sau fraude. Sistemele avansate pot fi integrate în procese complexe de cercetare, programare și automatizare.
Anthropic susține că exemplele descoperite arată cum AI poate deveni un instrument pentru atacuri cibernetice, programe de armament sau cercetări biologice cu potențial periculos.
Concluziile raportului și avertismentele venite chiar din interiorul industriei ar putea intensifica dezbaterea privind necesitatea unor măsuri suplimentare de control pentru cele mai performante modele de inteligență artificială.






