Компания, работающая с ИИ, раскрыла новые случаи использования своих моделей для кибератак, пропаганды и опасных биологических исследований; это произошло спустя несколько дней после ухода одного из исследователей из-за опасений по поводу безопасности.
В четверг компания Anthropic заявила, что заблокировала попытки злоумышленников использовать её модели искусственного интеллекта для кибератак, слежки и биологических исследований, которые могли бы способствовать разработке оружия.
По мере того как модели ИИ становятся мощнее, для проведения сложных кибератак требуется всё меньше технических знаний, и это значит, что сегодня даже отдельные люди способны создавать угрозы, которые ещё год назад были невозможны, отметили в компании.
Anthropic добавила, что усилила меры защиты в своих новейших моделях, чтобы ограничить проведение биологических исследований, имеющих возможное применение в создании оружия.
«Приведённые здесь случаи нельзя назвать обычным злоупотреблением. Это примеры наиболее заметной и новой вредоносной активности, которую мы обнаружили на сегодняшний день», — заявили в Anthropic в своём третьем докладе о неправомерном использовании ИИ, подготовленном с марта 2025 года.
В отчёт включены фрагменты вредоносного кода и запросов к ИИ, которые, как заявляет компания, ей удалось выявить. Anthropic призывает правительства и конкурирующие ИИ-компании внимательно отслеживать подобные случаи злоупотреблений.
«Мы публикуем эту работу, потому что считаем своим долгом раскрывать случаи злонамеренного использования наших сервисов», — заявили в компании.
«По мере того как возможности моделей растут, будут увеличиваться и риски, если разработчики ИИ и защитники общества не предпримут шаги, чтобы сделать технологии более безопасными».
Anthropic, готовящаяся к первичному размещению акций этой осенью, опубликовала отчёт спустя два дня после того, как один из её исследователей объявил об уходе из компании, выразив обеспокоенность тем, что она и её конкуренты развивают ИИ без должной ответственности.
Он повторил звучащие в отрасли предупреждения о том, что технология может выйти из-под контроля человека.
Claude попросили помочь сделать вирус более опасным
С декабря 2025 по август 2026 года исследователи Anthropic зафиксировали случаи злоупотреблений со стороны самых разных акторов — от поставщиков шпионского ПО и политически мотивированных активистов до поддерживаемых государством групп, распространяющих пропаганду.
В числе описанных в отчёте эпизодов — попытки неизвестных лиц использовать модели Anthropic для исследований, которые могли привести к созданию биологического оружия.
В одном из случаев, по словам компании, её системы заблокировали запрос к чат-боту Claude с просьбой помочь подготовить заявку на научный грант.
«В заявке описывались исследования по усилению функций (gain-of-function), то есть генетическое изменение организма с целью придания ему новых или усиленных биологических свойств, применительно к вирусу чикунгунья», — говорится в отчёте.
Исследование было нацелено на повышение заразности вируса и его способности ускользать от иммунной системы.
Чикунгунья — переносимый комарами вирус, вызывающий сильную боль и жар. В заявке на грант предлагалось усилить мутации, которые сделали бы вирус всё более опасным.
Anthropic отметила, что подобные исследования «безусловно» могут помочь в разработке вакцин и методов лечения, однако добавила, что «их также можно использовать, чтобы сделать патоген более опасным».
«Мы не можем гарантировать отсутствие вреда»
Ни один из описанных в отчёте эпизодов не был связан с более новыми и мощными моделями Anthropic — Claude Fable или классом Mythos, за одним исключением: «масштабной скрытой кампанией по извлечению возможностей модели и их воспроизведению в другой модели без разрешения».
По словам Anthropic, её более ранние модели, включая Claude Opus 4 и Claude Sonnet 4.5 образца 2025 года, «значительно не дотягивали до порога, при котором они могли бы сколь-нибудь существенно помогать опытному пользователю проводить опасные биологические исследования».
«В результате меры защиты в этих моделях были менее жёсткими и были в основном нацелены на предотвращение доступа к материалам, которые могли бы помочь новичкам воссоздать известные биологические виды оружия», — говорится в отчёте.
«Но в отношении современных моделей, которые уже способны помогать в выполнении целого ряда сложных научно-исследовательских задач, доказательства больше не столь однозначны, и мы не можем повторить ту же гарантию».
Именно поэтому, как говорится в отчёте, Anthropic ужесточила защиту в более новых моделях, таких как Claude Fable 5, ограничив доступ к широкому спектру запросов, связанных с биологическими исследованиями двойного назначения.
По мере того как компании, работающие с ИИ, выводят на рынок всё более мощные модели, эксперты призывают правительства регулировать эту технологию, а не полагаться на самоконтроль отрасли.
По словам доцента кафедры информатики Корнеллского университета Джона Тикстона, это ставит такие компании, как Anthropic и OpenAI, в неловкое положение, поскольку им фактически приходится выносить «ценностные суждения в масштабах всего общества без какой-либо демократической или процедурной системы контроля».
Отчёт появился после предупреждения исследователя
Anthropic также выявила группы, создавшие сотни поддельных аккаунтов в социальных сетях, оформленных как страницы обычных пользователей. В течение недели через них публиковались сообщения, усиливавшие одну и ту же политическую позицию.
Компания описала девять подобных операций, происхождение которых она связывает с Россией, Ираном, Турцией, странами Персидского залива, Южной Азией, Африкой и Европой.
По словам Anthropic, тогда как платформы соцсетей способны выявлять кампании по влиянию лишь после того, как публикации уже начали распространяться, компания «может заметить их в Claude ещё на стадии подготовки операции».
Публикации отчёта предшествовало заявление об уходе исследователя Anthropic Джейкоба Коксона, который объяснил своё решение опасениями, что компания и её главный конкурент OpenAI «устремились в гонку за самоулучшающимся сверхразумом, рискуя нашими жизнями».
Коксон предупредил, что некоторые из его бывших коллег считают: ИИ может начать угрожать человеческой жизни ещё до конца десятилетия.
Anthropic сообщила, что заблокировала все выявленные в отчёте злоумышленные действия, использовала полученные данные для усиления мер безопасности и поделилась информацией с государственными органами и партнёрами по отрасли.
«Мы надеемся, что выводы данного отчёта помогут другим разработчикам распознавать похожие паттерны на собственных платформах, дадут правительствам и гражданскому обществу более ясное представление о том, как формируются новые угрозы, и укрепят коллективную защиту», — заявили в компании.