10 сентября компания Anthropic опубликовала отчет о злоупотреблениях ИИ, охватывающий декабрь 2025 года — август 2026-го. Компания описала операции, в которых Claude якобы использовали для кибершпионажа, слежки, кампаний влияния, разработки военного ПО и копирования возможностей моделей. В числе связанных с операциями стран Anthropic называет Россию, Китай, Иран, Йемен, Мали, Бангладеш и Кению.
Компания закрыла задействованные аккаунты и усилила системы выявления злоупотреблений, а в отдельных случаях передала данные партнерам и властям.
В России
В Anthropic утверждают, что в одной из российских кампаний Claude применяли почти на всех этапах атак: от фишинга и подготовки инфраструктуры до закрепления в системах, кражи почты и изменения вредоносного кода после его обнаружения средствами защиты. Anthropic связала операции с русскоязычными операторами, чьи методы совпадают с публичными описаниями группы Midnight Blizzard.
«Атаки затронули более 20 организаций в Украине и Европе, включая государственные, оборонные и разведывательные структуры, дипломатические представительства и подрядчиков оборонной цепочки», — согласно отчету.
В Китае
Другая группа, которую Anthropic связывает с Китаем, проводила разведку сетей на Ближнем Востоке, в Европе и Юго-Восточной Азии и искала уязвимости в системах защиты конечных точек. Среди затронутых организаций были образовательная платформа, розничная компания и госорган.
Слежка и влияние
Anthropic также выявила операции, связанные с мониторингом общественного мнения и профилированием активистов и религиозных общин. В одном из случаев Claude помогал вести вербовку уйгуров в Сирии, включая подготовку обращений на местном диалекте и перевод ответов в реальном времени.
Связанные с Ираном аккаунты использовали модель для сбора досье и разработки систем сбора данных. В Мали нейросеть применяли при создании платформы перехвата, которую компания связывает с местной спецслужбой.
Кампании влияния Anthropic обнаружила в операциях, связанных с Россией, Китаем, Ираном, Бангладеш и Кенией. Claude якобы использовали для планирования и подготовки материалов, часть которых затем распространяли государственные СМИ.
Копирование моделей
Отдельный блок документа посвящен копированию возможностей Claude. Anthropic связывает такие кампании с китайскими Alibaba, Moonshot, DeepSeek и Xiaomi. В случае Alibaba с мая по июль 2026 года зафиксировали более 151 млн обменов с Claude через более 3 500 аккаунтов. Полученные ответы планировали использовать для дообучения линейки Qwen.
Moonshot и DeepSeek, по версии Anthropic, передавали в Claude запросы из реальных пользовательских чатов и использовали ответы для обучения собственных моделей. Всего компания насчитала более 23 млн таких обменов у Moonshot и более 12 млн у DeepSeek.
Атаки на ИИ-компании
В числе прочего Anthropic описала финансово мотивированную кампанию русскоязычного оператора, который, как утверждается, после кражи около 26 ГБ данных потребовал выкуп $1,5-2,5 млн, а затем атаковал около 30 ИИ-компаний в попытке получить доступ к предрелизной модели Claude. Собственные системы Anthropic, по данным компании, не скомпрометировали.
Аккаунты, которые Anthropic связывает с предполагаемой хакерской группировкой ShinyHunters, использовали украденные учетные данные и ключи API для атак на приложения и облачную инфраструктуру. Компания зафиксировала, в частности, массовую кражу токенов Azure AD более чем из 40 корпоративных сред.
