
Anthropic spune că a identificat și a oprit mai multe cazuri în care cercetători foloseau modelele sale de inteligență artificială pentru activități asociate dezvoltării unor posibile arme biologice. Compania a prezentat situațiile într-un raport publicat joi, care descrie și alte forme de utilizare abuzivă a modelelor sale.
Concluziile vin însă cu o precizare importantă: Anthropic nu afirmă că oamenii de știință implicați urmăreau să provoace rău. Compania subliniază că delimitarea dintre cercetarea legitimă și o utilizare biologică periculoasă poate fi dificilă, motiv pentru care a ales o abordare precaută.
Ce a identificat Anthropic în utilizarea modelelor sale AI
Raportul include cinci studii de caz referitoare la folosirea modelelor Anthropic în cercetări asociate unor posibile arme biologice. Pentru fiecare situație, compania prezintă mecanismele de siguranță care au semnalat activitatea și măsurile luate ulterior.
Potrivit Anthropic, această categorie de abuz capătă o importanță tot mai mare pe măsură ce modele mai noi, precum Fable 5, devin mai capabile să ofere ajutor în cercetarea științifică. Raportul tratează aceste riscuri alături de alte utilizări problematice ale inteligenței artificiale.
Compania a explicat pentru The New York Times că o investigație destinată dezvoltării unui vaccin poate semăna foarte mult cu una orientată spre crearea unei arme biologice. În cazurile prezentate, Anthropic susține că a preferat să intervină cu precauție, având în vedere posibilele consecințe.
O cerere adresată lui Claude a declanșat verificările
Unul dintre studiile de caz privește o solicitare din luna mai. Sistemul Anthropic de clasificare a riscurilor biologice a semnalat atunci o cerere prin care Claude era solicitat să redacteze o propunere de finanțare pentru cercetări asupra virusului chikungunya.
Proiectul viza cercetare de tip „gain-of-function”, care explorează modificarea genetică a unui organism. În descrierea companiei, propunerea urmărea modificări care ar fi putut face virusul mai transmisibil și mai capabil să evite răspunsul imunitar.
Anthropic afirmă că virusul nu are un tratament autorizat și poate provoca simptome debilitante timp de săptămâni sau luni. Un alt element care a sporit îngrijorarea companiei a fost afilierea cercetării propuse cu un institut de cercetare militară.
Raportul menționează și preocupări similare legate de cercetări de tip „gain-of-function” asupra gripei aviare. Într-un caz separat, un cercetător folosea Claude pentru a realiza un atlas al peptidelor toxice din venin și un sistem generativ destinat optimizării caracteristicilor toxinelor.
De ce Anthropic nu atribuie intenții răuvoitoare cercetătorilor
Jacob Klein, responsabilul Anthropic pentru informații despre amenințări, a explicat pentru The New York Times că asemenea situații sunt mult mai nuanțate decât o solicitare explicită de a construi o armă biologică. Evaluarea descrisă de companie presupune interpretarea unor activități de cercetare, nu doar identificarea unei intenții declarate.
Această distincție este esențială pentru felul în care trebuie citite concluziile raportului. Anthropic descrie utilizări considerate suficient de riscante pentru a justifica intervenția, dar nu susține că persoanele implicate aveau intenția de a face rău.
Din același motiv, compania nu publică numele cercetătorilor sau ale instituțiilor asociate acestor cazuri. Anthropic arată că persoanele vizate sunt oameni de știință activi, iar identificarea lor ori a laboratoarelor în care lucrează le-ar putea expune unor pericole.
Conturi blocate și măsuri de protecție revizuite
Anthropic spune că a blocat conturile tuturor celor identificați ca folosind abuziv Claude sau celelalte modele ale companiei. Rezultatele investigațiilor sunt utilizate pentru îmbunătățirea mecanismelor de protecție și prevenirea unor situații similare.
Documentul nu se limitează la riscurile biologice. El cuprinde și studii de caz despre folosirea modelelor ca instrumente de supraveghere, pentru crearea de exploit-uri software, propagandă și sisteme de armament.
În privința cercetării biologice, Anthropic păstrează astfel două concluzii distincte: activitățile identificate au justificat blocarea accesului, însă măsurile luate nu echivalează cu o acuzație că cercetătorii ar fi urmărit în mod deliberat să provoace rău.




















