AIPi

Anthropic раскрыла попытки использовать Claude для биологического оружия и шпионажа

В 154-страничном отчёте компания описала пресечённые случаи злоупотребления моделями Claude: от исследований биологического оружия до кибершпионажа и разработки вооружений.

Anthropic раскрыла попытки использовать Claude для биологического оружия и шпионажа

Anthropic опубликовала первый масштабный отчёт об угрозах, в котором описала попытки злоумышленников использовать её модели Claude для разработки биологического оружия, кибершпионажа и создания обычных вооружений. Документ объёмом 154 страницы охватывает инциденты, выявленные в период с декабря 2025 по август 2026 года.

Биологическая угроза

Наибольшее внимание в отчёте уделено пяти случаям, когда исследователи использовали Claude в работе, которая могла способствовать разработке биологического оружия. В одном из примеров учёный в регионе, который Anthropic не обслуживает, неделями использовал виртуальный частный сервер для доступа к модели и планировал эксперименты по адаптации птичьего гриппа к млекопитающим. В другом случае исследователь готовил заявку на государственный грант по изучению вируса чикунгунья — работу, которая, по данным компании, должна была проводиться в военном научном институте.

«Биологическое злоупотребление — один из самых серьёзных рисков frontier-моделей. Без надлежащих мер защиты такие возможности могут иметь катастрофические последствия», — говорится в отчёте.

Все связанные аккаунты были заблокированы, а полученные выводы внедрены в защитные механизмы моделей.

Другие направления злоупотреблений

Помимо биологических рисков, компания зафиксировала кибероперации, включая предполагаемый российский шпионаж и атаки типа «smash-and-grab», программы наблюдения, в том числе отслеживание уйгуров в Сирии, пропагандистские кампании в России, Малайзии, Иране и Бангладеш, а также использование Claude для разработки программного обеспечения обычных вооружений — огнестрельного оружия, ракет, дронов и бомб.

Контекст

Публикация появилась спустя два дня после громкого увольнения исследователя Джейкоба Коксона, заявившего, что Anthropic и OpenAI «гонятся за самоулучшающимся суперинтеллектом», способным привести к вымиранию человечества к 2030 году. Эксперты при этом отмечают, что реальные угрозы, описанные в отчёте, в ближайшие годы представляют более ощутимую опасность, чем гипотетический «апокалипсис» от сверхразума.

Почему это важно

Отчёт — редкий случай, когда ведущая лаборатория подробно раскрывает конкретные случаи злоупотребления своими моделями. Он показывает, что борьба за безопасность ИИ смещается из области абстрактных сценариев в практическую плоскость: выявление и пресечение реальных попыток использования моделей во вред.

#anthropic#безопасность#claude