Инциденты произошли в период с декабря 2025 по август 2026 года и описаны в новом отчете Anthropic об угрозах. По мнению компании, они демонстрируют новую проблему для разработчиков ИИ: отличить опасную деятельность от легитимных биологических исследований становится все сложнее.
Один из случаев был связан с вирусом чикунгунья. Системы безопасности Claude заблокировали помощь в подготовке заявки на исследование, затрагивавшее потенциально опасное усиление свойств вируса и предназначавшееся для военного исследовательского учреждения. Anthropic утверждает, что после отказа пользователи пытались продолжить работу другими способами, в том числе через сервисы, перенаправлявшие запросы к менее защищенным моделям.
В другом случае исследователь несколько недель использовал Claude при работе с высокопатогенным птичьим гриппом — для планирования экспериментов, анализа данных и их научной интерпретации. Еще три выявленных эпизода касались ортопоксвирусов, токсинов и соединений, связанных с ядами.
Anthropic заблокировала связанные с этой деятельностью учетные записи и передала информацию властям и другим разработчикам ИИ. При этом компания не раскрывает личности и местонахождение исследователей или подробности их работы и отдельно подчеркивает, что доказательств намерения создать биологическое оружие у нее нет.
Главная проблема заключается в двойном назначении подобных знаний. Методы, необходимые для исследования болезней, создания лекарств и вакцин, могут одновременно оказаться полезными при работе с опасными патогенами. По мере развития ИИ-моделей провести границу между этими сценариями становится труднее.
В Anthropic считают, что новые поколения ИИ уже обладают значительно более серьезными возможностями для поддержки сложных научных исследований, чем ранние версии Claude. Поэтому компания усиливает защиту от биологических угроз, одновременно пытаясь сохранить возможности моделей для легитимной научной работы.











