AI

Редакция Overclock.bg ·

Claude блокира държавни опити за по-смъртоносни вируси

Claude блокира държавни опити за по-смъртоносни вируси

На 10 септември Anthropic публикува поредния си доклад за злоупотреби с Claude и за пръв път посвети отделна глава на биологията. В документа от 154 страници компанията описва пет случая, в които изследователи, свързани с държавни институции, са заобикаляли регионалните ѝ ограничения, за да ползват модела за работа по патогени с двойна употреба — включително заявка за изследване, което да направи един вирус по-заразен и по-устойчив на имунната система.

Какво точно е засякла компанията

Докладът покрива периода декември 2025 – август 2026 и обхваща седем направления: кибероперации, информационни кампании, наблюдение на граждани, измами, конвенционални оръжия, нелегална дистилация на модели и биологични злоупотреби. Официалната публикация уточнява, че става дума за Claude Haiku, Sonnet и Opus — моделите от класовете Fable и Mythos се появяват само в един случай на дистилация.

Петте биологични случая изглеждат така:

  • Заявка Claude да напише научен проект за gain-of-function изследване върху вируса чикунгуня, насочено към по-висока преносимост и по-добро избягване на имунния отговор. Проектът е бил свързан с военен изследователски институт.
  • Работа по птичи грип H5N1 и адаптацията му към бозайници.
  • Помощ за кандидатстване с проект върху ортопоксвируси (семейството на едрата шарка и маймунската шарка) в държавна лаборатория по инфекциозни болести.
  • Съставяне на атлас от пептиди от отрови и генеративна система, която да оптимизира свойствата им — както за лечебни, така и за парализиращи мишени. Anthropic твърди, че това е част от държавно финансирана програма.
  • Изчислително преработване на токсини, включително протеини на вируси, причиняващи хеморагични трески.

Доклад на Anthropic за противодействие на злоупотребите с Claude Снимка: Anthropic

Как са заобикаляли блокадите

Най-интересната част е техническа. Claude не се предлага в редица държави, но това очевидно не е пречка. Според Tom’s Hardware един от изследователите е влизал от неподдържан регион през виртуална инфраструктура в САЩ и автоматично генериран акаунт, за да скрие самоличността си.

В друг случай достъпът е минавал през платформа за науки за живота, която пренасочва трафика си през американски сървъри. Когато Claude откаже да отговори на чувствителна заявка, същата платформа я е препращала към друг модел с по-хлабави предпазни механизми — тоест филтърът на Anthropic е бил третиран просто като препятствие в работния процес.

Блокирането също не е било окончателно. Anthropic е спряла акаунтите по случая с чикунгуня, но операторът на платформата е възстановил достъпа си за броени седмици с нови самоличности, а Claude е продължил да помага с редакция на материалите по проекта.

35 изследвания за 30 дни

При преглед на 30 дни активност компанията е открила около 35 отделни изследователски усилия, свързани с институции на държави под ограничения. Голямата част са обикновена гражданска наука; само някои имат ясно изразен потенциал за двойна употреба. Именно това е трудната част: разликата между разработка на ваксина и разработка на оръжие често е в намерението, не в текста на заявката.

„Ситуацията е невероятно нюансирана“, признава Джейкъб Клайн, който отговаря за анализа на заплахите в Anthropic, пред The New York Times, цитиран от Engadget. Затова и компанията съзнателно не назовава държавите, институциите и конкретните биологични агенти — по думите ѝ става дума за действащи учени, за които няма доказателства за зложелателни намерения. В самия доклад се уточнява, че описаните случаи „не са типична злоупотреба, а най-забележителните и нови заплахи, които сме идентифицирали досега“.

Какво следва

Anthropic е блокирала всички засегнати акаунти, свалила е с партньори мрежите за препращане на трафик, споделила е находките с други AI лаборатории и с държавни органи и е използвала случаите, за да пренастрои класификатора си за биологична безопасност. Същият доклад описва и заплаха, свързана с Иран, при която Claude е използван за анализ на публично достъпни данни и препоръки за цели срещу американски военноморски сили в региона.

Темата не е нова за компанията — през последните месеци тя вече описа случаи с биооръжия и дронове, а американските служби обвиниха шест китайски фирми в дистилация на Claude и GPT.

Изводът е по-скромен от заглавията: никой не е синтезирал вирус с помощта на чатбот. Но докладът показва, че регионалните блокади и филтрите на един доставчик са мярка, която се заобикаля с VPN и с втори модел — и че реалната защита ще трябва да дойде от координация между лабораториите и регулаторите, а не от списък с блокирани държави.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още