Компания Anthropic, разработчик искусственного интеллекта Claude, представила 154-страничный отчёт, в котором впервые столь детально перечислены реальные случаи злонамеренного использования её технологии. Документ охватывает период с декабря 2025 года по август 2026 года и описывает угрозы в семи категориях: кибероперации, операции влияния, слежка, мошенничество, биологические угрозы, разработка обычных вооружений и дистилляция (копирование возможностей) моделей ИИ.
Публикация вышла всего через 48 часов после того, как исследователь Anthropic Джейкоб Коксон (Jacob Coxon) объявил об уходе из компании, заявив, что, по его мнению, эта технология способна уничтожить человеческий вид.
Особую тревогу у компании вызывает биологическое направление. «Злонамеренное использование в биологической сфере — один из самых серьёзных рисков передовых моделей ИИ», — признаёт Anthropic, добавляя, что «без надлежащих мер безопасности такие возможности могли бы иметь катастрофические последствия». В отчёте описаны пять выявленных случаев потенциально опасных биологических разработок, все они были заблокированы, а соответствующие аккаунты отключены.
Один из наиболее тревожных эпизодов связан с аккаунтом, где Claude использовали для получения государственного гранта на исследование вируса чикунгуньи (переносится комарами). Как поясняет Anthropic, эта работа могла быть направлена как на создание вакцины, так и на усиление вируса с целью нанесения большего ущерба. Компания не раскрыла страну происхождения запросов, но уточнила The New York Times, что исследование велось из военного научно-исследовательского института.
Пользователи, применявшие ИИ Anthropic для разработки ПО, предназначенного для проектирования и производства вооружений, а также для сбора информации и закупки материалов для оружейных программ, по данным компании, действовали из Китая, России и Йемена.
В документе отмечается, что «среди проанализированных злонамеренных субъектов — группы, предположительно спонсируемые государствами, киберпреступники, движимые финансовой выгодой, коммерческие поставщики шпионского ПО, государственные пропагандистские структуры и лица с политическими мотивами». Спектр угроз простирается «от сети фейковых сайтов знакомств, созданных для выманивания денег у пользователей, до систем слежки, предназначенных для выявления и подавления инакомыслящих».
Отдельно в отчёте указано, что семь китайских лабораторий ИИ, включая Alibaba, Moonshot, DeepSeek и Xiaomi, извлекали или перепродавали возможности Claude своим клиентам. Операторов, связанных с Alibaba, Anthropic обвиняет в атаке методом дистилляции — когда новая модель ИИ «вытягивает» способности более продвинутой обученной модели, чтобы снизить собственные затраты на разработку.
Кроме того, группа, предположительно связанная с российской государственной разведкой, атаковала государственные, военные, дипломатические и оборонные структуры в Украине и Европе, а также цели, связанные с внешней политикой США и технологиями беспилотников. Основной фокус атак, по данным Anthropic, приходился на Украину.
В компании подчёркивают, что прогресс ИИ в последние месяцы стремительно сокращает разрыв в возможностях между хорошо финансируемыми государственными группами и одиночными злоумышленниками — технология теперь способна выстраивать всю наступательную цепочку самостоятельно.