„Claude“ galėjo būti panaudotas kuriant biologinį ginklą: „Anthropic“ sustabdė tyrėjus
„Anthropic“ pranešė sustabdžiusi grupuotę, kuri galėjo bandyti naudoti jos dirbtinio intelekto modelį „Claude“ informacijai, susijusiai su biologinių ginklų kūrimu, gauti. Bendrovė nurodė aptikusi užklausas, kurios peržengė leistinų mokslinių diskusijų ribas ir galėjo padėti vykdyti pavojingą biologinę veiklą.
Įmonės vertinimu, šis atvejis parodė, kad pažangūs generatyvinio dirbtinio intelekto įrankiai gali būti išnaudojami ne tik teisėtiems moksliniams ar techniniams tikslams. „Anthropic“ reagavo apribodama prieigą prie sistemos tyrėjams, kurių veikla sukėlė įtarimų.
Užklausos buvo susijusios su biologinių ginklų tyrimais
„Anthropic“ teigė, kad tyrėjai naudojo „Claude“ bandydami gauti informacijos, kuri galėtų būti pritaikyta biologinių ginklų kūrimo procese. Bendrovė nepaskelbė, kas buvo šie vartotojai, iš kurios šalies jie veikė ir apie kokius konkrečius biologinius agentus buvo klausiama.
Taip pat nėra viešai patvirtinta, kad naudojantis „Claude“ būtų sukurtas biologinis ginklas ar kad būtų atlikti praktiniai bandymai. Bendrovės pranešimas susijęs su aptiktu galimu piktnaudžiavimu ir bandymu pasitelkti modelį pavojingai informacijai rinkti.
Vien užklausų pobūdis tapo pakankamu pagrindu imtis veiksmų. Tokios sistemos yra kuriamos padėti vartotojams spręsti sudėtingas užduotis, tačiau jų kūrėjai riboja atsakymus, galinčius reikšmingai palengvinti smurto, nusikalstamos veiklos ar masinės žalos planavimą.
„Anthropic“ nutraukė prieigą prie „Claude“
Bendrovė sustabdė su incidentu susijusius vartotojus, taip nutraukdama jų galimybę toliau naudotis „Claude“. „Anthropic“ viešai pabrėžia, kad jos paslaugomis draudžiama naudotis kuriant, platinant ar kitaip remiant biologinius, cheminius ir kitus masinio naikinimo ginklus.
Tokie apribojimai paprastai taikomi ne vien pagal pavienius raktažodžius. Dirbtinio intelekto bendrovės vertina užklausų seką, vartotojo pateikiamą kontekstą ir tai, ar informacija prašoma akademiniam, medicininiam ar akivaizdžiai žalingam tikslui.
Vis dėlto biologijos tema pati savaime nėra draudžiama. Tyrėjai, gydytojai, studentai ir laboratorijos gali teisėtai prašyti informacijos apie ligas, mikroorganizmus, biologinius procesus ar saugą. Rizika atsiranda tuomet, kai klausimai tampa orientuoti į tyčinį patogenų panaudojimą, žalos didinimą ar praktinį ginklo parengimą.
Atvejis sustiprino diskusiją dėl AI saugumo
„Anthropic“ incidentą pateikė kaip pavyzdį, kodėl pažangesniems modeliams būtinos papildomos saugumo priemonės. Kuo geriau dirbtinis intelektas geba apdoroti mokslinę ir techninę informaciją, tuo svarbiau atskirti teisėtą pagalbą nuo atsakymų, kurie galėtų palengvinti pavojingą veiklą.
Bendrovės sprendimas blokuoti įtartinus vartotojus reiškia, kad „Claude“ naudojimas yra stebimas ir vertinamas pagal paslaugos taisykles. „Anthropic“ nepateikė daugiau duomenų apie sustabdytų tyrėjų skaičių ar galimus tolesnius veiksmus jų atžvilgiu.








