AI modeli se koriste za stvaranje biološkog oružja
- Objavljeno u Znanost

Prema Anthropicu, biološka zlouporaba jedan je od najozbiljnijih rizika graničnih modela umjetne inteligencije. Dugo je postojala zabrinutost da bi modeli umjetne inteligencije jednog dana mogli dosegnuti razinu sposobnosti na kojoj mogu pomoći u povećanju opasnosti postojećih patogena, ili stvoriti potpuno nove. Bez ispravnih zaštitnih mjera, takve mogućnosti mogle bi imati katastrofalne posljedice.
Iz tog razloga i iz predostrožnosti, Anthropic je pokrenuo nedavne modele (najviše Claude Fable 5) s jačim zaštitnim mjerama koje ograničavaju pristup širokom rasponu upita o biološkim istraživanjima s dvojnom namjenom.
Anthropic je ujedno proveo istragu pet slučajeva u kojima su određeni znanstvenici zaobišli kontrole kako bi spriječili korisnike iz nepodržanih regija da pristupe njegovim modelima te su se uključili u druge napore kako bi prikrili svrhu svog istraživanja.
Kada su otkrili i istražili te slučajeve, zabranili su korisničke račune i uključili svoje istraživačke nalaze u zaštitne mjere, provedbu i procese obavještajnih podataka o prijetnjama na graničnim modelima kako bi bolje spriječili, otkrili i ometali te aktivnosti u budućnosti.
Anthropic ne želi javno otkriti imena istraživačkih institucija, zemalja u kojima se aktivnost odvijala i specifične biološke agense ili istraživačke tehnike koje su uključene, no kažu da su pojedinci uključeni u ove studije slučaja aktivni znanstvenici.
"Ne tvrdimo da su namjeravali nanijeti štetu, a identificiranje njih ili njihovih laboratorija moglo bi ih izložiti šteti", navodi Anthropic u svojem priopćenju.
Studije koje su istraživali uključivale su platformu za izbjegavanje zaštitnih mjera za vojno-civilna istraživanja, istraživački program za razvoj visoko patogene ptičje gripe prilagođene sisavcima, pristup modelu za istraživanje ortopoksvirusa, te studiju o otrovima i toksinima.
"Ove slučajeve ne uzimamo kao dokaz neposredne prisutnosti bioloških prijetnji koje trenutno ističe Claude, već kao dokaz da su značajni napori u istraživanju dvojne namjene povezani s državnim akterima koji izazivaju zabrinutost i koji rutinski izbjegavaju naše kontrole pristupa putem releja, zlouporabe ZDR-a, vraćanja na više modela i eksplicitnih pokušaja izbjegavanja klasifikatora da koriste Claudeove modele u ovom radu, često svjesni njegove prirode dvojne namjene", dodaje Anthropic.
Više detalja o Anthropicovom istraživanju znanstvenih studija u kojima su se zaobilazile zaštitne mjere s potencijalom stvaranja novih bioloških oružja možete pronaći na ovoj poveznici.