Anthropic 10 сентября опубликовала отчёт об операциях, выявленных с декабря 2025-го по август 2026 года. Компания описала злоупотребления Claude в семи сферах: кибератаки, влияние на общественное мнение, слежка, мошенничество, биологические исследования, разработка обычных вооружений и незаконное копирование возможностей моделей.

Во всех раскрытых случаях Anthropic заблокировала связанные аккаунты. Часть сведений компания передала властям, другим разработчикам ИИ и организациям, занимающимся безопасностью.

Более 4700 ИИ-персонажей общались с 25 тысячами человек

Китайская студия использовала Claude для создания сети из более чем 20 приложений знакомств. Только за две недели апреля 2026 года свыше 4700 виртуальных персонажей отправили около 2,36 млн сообщений как минимум 25 тысячам пользователей из США.

Лента состояла примерно на 75% из ИИ-профилей и на 25% из анкет реальных людей. Пользователи тратили внутренние монеты на переписку, не зная, кто находится по другую сторону экрана. Ботам предписывали скрывать свою природу, уклоняться от видеозвонков и двигаться по заранее заданному сценарию общения.

Реальных исполнителей подключали для видеосвязи и подписок в соцсетях, чтобы снизить подозрения. Разработчики также встроили механизмы обхода проверок магазинов приложений: платёжные функции и отдельные элементы интерфейса можно было скрыть на время модерации.

ИИ подключили к ракетам, противоторпедной системе и слежке

В оружейном разделе Anthropic разобрала шесть операций — три в Китае, две в России и одну в Йемене. В северном Йемене Claude Code применяли вместо команды программистов для разработки систем навигации и управления управляемой ракетой, моделирования баллистической ракеты с заявленной дальностью более 2000 километров и варианта с гиперзвуковым планирующим аппаратом. Испытательный запуск управляемой ракеты, по данным компании, закончился неудачей.

В другом случае связанный с Китаем оператор подготовил с помощью Claude более 200 страниц технического предложения по противоторпедному комплексу и элементы программного обеспечения управления огнём.

Anthropic также выявила 16 аккаунтов двух связанных с Ираном групп. Они использовали Claude для обработки 155 216 публикаций, выделили 39 оппозиционных и эмигрантских аккаунтов, а также создали расширение Firefox для массового сбора данных пользователей. Программу маскировали под сервис с расписанием молитв.

Отдельный раздел посвящён пяти случаям биологических исследований двойного назначения. Среди них — подготовка заявки на изучение изменений вируса чикунгуньи, способных усилить его передачу и уклонение от иммунитета. Anthropic указывает, что такая работа может помочь разработке вакцин, но одновременно способна сделать возбудитель опаснее.

Компания усилила фильтры для запросов о биологии, взрывчатых веществах и разработке оружия. Большинство описанных эпизодов затронуло модели семейств Haiku, Sonnet и Opus; более новые Fable и Mythos в них не использовались, кроме одного случая незаконного копирования возможностей модели.