Anthropic раскрыла: Claude использовали для шпионажа, кибератак и фейковых новостей
Anthropic опубликовала отчёт Threat Intelligence за сентябрь 2026 года: команда безопасности выявила и заблокировала операции по семи категориям вреда — от государственного кибершпионажа до фабрик фейковых новостей, работавших через Claude.
Anthropic представила очередной отчёт Threat Intelligence — на этот раз за сентябрь 2026 года. Команда безопасности компании задокументировала случаи, когда злоумышленники пытались использовать модели Claude (Haiku, Sonnet и Opus) для реальных атак, и рассказала, как их обнаружили и заблокировали. Разброс — от государственного шпионажа до коммерческих фабрик дезинформации.
Среди киберопераций — не только государственные группы. Финансово мотивированные злоумышленники (GTG-50020) взломали песочницу для оценки AI-инструментов и украли продакшн-ключи API, после чего атаковали около 30 AI-компаний за четыре дня. Китайская группа из провинции Хунань (GTG-10007) вела автономный поиск уязвимостей нулевого дня против средств защиты — «более десятка» потенциальных находок за один месяц — и атаковала порядка 50 организаций в образовании, ритейле, энергетике, медицине и финансах.
Что это значит на практике
Отчёт фиксирует смену масштаба: агентные ИИ-инструменты, включая Claude Code, злоумышленники используют не как игрушку для генерации текста, а как рабочий инструмент на всех этапах атаки — от разведки и написания эксплойтов до управления сетями фейковых аккаунтов. В деле малайзийских выборов (GTG-84005) сервис описывал себя заказчикам как «военного уровня ИИ-экосистема для политических операций» и управлял примерно тысячей поддельных аккаунтов в X. В истории с Молдовой (GTG-24015) Claude использовали для генерации материалов, которые затем публиковали Sputnik Moldova, RIA Novosti и RT в преддверии президентских выборов 2025 года.
Anthropic заблокировала все выявленные аккаунты и организации, усилила мониторинг и передала данные госорганам и партнёрам по индустрии. Для читателя вывод простой: то, что модель отказывается прямо помочь со взломом или дезинформацией на уровне одного запроса, не защищает от системного злоупотребления — риски переносятся в плоскость мониторинга поведения агентов, а не только фильтрации отдельных ответов.
Все цифры и атрибуция — из собственного расследования Anthropic; компания не раскрывает полный список заблокированных аккаунтов и уточняет, что часть операций отслеживалась с декабря 2025 года.
Источник: Anthropic
Упомянутые инструменты
Не пропускать важное
Заведите кабинет: добавьте нейросети, которыми пользуетесь, — и получайте только то, что касается именно их. Цены, тарифы, доступность из России, письмо перед списанием. Бесплатно.



