infonebpress.

Отделяем факты от медийного шума

Колонку ведёт Денис Архипов

Новость

Киберугрозы и ИИ: как Anthropic выявляет попытки использования Claude в опасных целях

10 сентября Anthropic опубликовала «самый подробный отчёт об угрозах», и, по данным National Herald, в нём описаны попытки использовать языковую модель Claude для кибератак, операций влияния, слежки, биологических разработок и конструирования оружия.

Денис Архипов, Аналитик данных и фактчекер·обновлено 11 сентября 2026 г.

Киберугрозы и ИИ: как Anthropic выявляет попытки использования Claude в опасных целях

Каждая из указанных операций, как утверждает компания, была пресечена, а её уроки уже учтены в защитных механизмах. Для тех, кто привык разбирать новости, а не пересказывать их, главный интерес здесь — не сам список угроз, а то, как именно компания преподносит находки и что из этого можно перепроверить.

Что именно показано в отчёте

Отчёт датируется 10 сентября и описывает несколько категорий злоупотреблений. Отдельно упомянута группа в Йемене, которая, как сообщается, использовала Claude при проектировании управляемых ракет и баллистических снарядов. В биологическом блоке речь идёт о пяти случаях, когда исследователи применяли модель для работы, связанной с биологическим оружием, вирусами и токсинами — с оговоркой, что часть этих обращений могла быть легитимной научной деятельностью и была заблокирована.

Особое место в отчёте занимают «операции влияния»: описаны девять эпизодов, в которых создавались сотни аккаунтов в соцсетях, мимикрирующих под обычных пользователей, и через них в течение примерно недели усиливалась одна и та же политическая позиция. По данным источника, такие сети фиксировались в России, Иране, Турции, странах Персидского залива, Южной Азии, Африке и Европе.

Бангладешский кейс — самый показательный для фактчекера

Для нашей ниши самым интересным оказался эпизод из Бангладеш. Anthropic заявляет, что отследила работу одного исполнителя из района Гайбанха, который с помощью Claude генерировал фейковые новости в пользу партии «Авами Лиг», находящейся в оппозиции после событий июля 2024 года. По данным отчёта, исполнитель ротировал 29 аккаунтов Claude, чтобы обойти лимиты платформы, и применял собственное программное обеспечение с говорящим названием «fake_news_3.py». Скрипт выдавал пакетами: 15 заголовков, 3 развёрнутых фейковых материала и 15 промптов для генерации изображений. Контент предназначался для прямых эфиров в Facebook Live, YouTube и TikTok и был заточен под сельских сторонников «Авами Лиг» с ограниченной грамотностью.

Отдельная деталь, на которую стоит обратить внимание: во внутренних коммуникациях исполнитель, по данным отчёта, прямо отмечал, что никто не знает о подделке новостей. Это самая циничная и одновременно самая показательная ремарка во всём документе — она в одну строчку описывает механику современной дезинформации: один человек с доступом к LLM и пониманием аудитории способен неделями наполнять ленты целевой группы сфабрикованным контентом.

Что проверить и что отслеживать

Здесь начинается собственно работа. Во-первых, имеет смысл дождаться полного текста самого отчёта Anthropic — National Herald упоминает, что ссылка на документ приводится внизу публикации, но в нашем распоряжении сейчас только пересказ, а значит, конкретные цифры, временные метки и методика обнаружения известны только со слов самой компании. Во-вторых, кейс из Бангладеш стоит сверить с независимыми источниками: были ли эти аккаунты обнаружены платформами, существует ли скрипт с указанным названием в открытых репозиториях, есть ли следы описанного контента в архивах соцсетей. В-третьих, отдельно стоит проверить заявление исследователя Anthropic Джейкоба Коксона о его отставке — это признак внутренних разногласий, и он заслуживает отдельной верификации.

Практический итог простой: отчёт Anthropic — полезный первичный документ, но не истина в последней инстанции. Компания одновременно описывает угрозы и продаёт нам свои системы безопасности, и это нужно учитывать при чтении. Для тех, кто занимается факт-чеком, главный вывод спрятан в бангладешском эпизоде: инфраструктура фабрик фейков больше не требует штата, бюджета и особых навыков. Достаточно одного человека, который знает, какую кнопку нажать.