Для новичка

Claude применяли в семи видах злоупотреблений — Anthropic раскрыла границы отчёта

|Автор: Редакция QUASA|5 мин чтения| 10
Claude применяли в семи видах злоупотреблений — Anthropic раскрыла границы отчёта

Отчёт Anthropic, опубликованный 10 сентября 2026 года, охватывает пресечённые операции с Claude с декабря 2025-го по август 2026-го. Компания распределила их по семи областям: кибероперации, влияние, слежка, мошенничество, биологические исследования двойного назначения, разработка обычных вооружений и незаконная дистилляция моделей.

Материал Associated Press от 10 сентября независимо передаёт ключевое заявление о блокировке активности, связанной с кибератаками, слежкой и исследованиями, которые могли содействовать разработке биологического оружия. При этом публикация Anthropic описывает отобранные необычные операции из внутренних расследований, а не распространённость нарушений среди всей аудитории Claude.

Какие данные вошли в отчёт

Семь областей расследований Anthropic отделены от неизмеренного общего массива использования Claude

Доказательная база состоит прежде всего из внутренней телеметрии Anthropic, содержания взаимодействий с моделями и связей между учётными записями. Группы предполагаемых нарушителей получили внутренние обозначения GTG; среди них фигурируют предполагаемые государственные структуры, коммерческие поставщики средств слежки, финансово мотивированные преступники и политические активисты.

В рассмотренных операциях использовались модели классов Claude Haiku, Sonnet и Opus. Случаи с Fable и Mythos в основной выборке не обнаружены, кроме одного эпизода незаконной дистилляции. Это наблюдение относится только к выявленным операциям и не является сравнительной оценкой безопасности всех моделей.

«Прирост возможностей» в методике означает дополнительный вред, доступный участнику благодаря ИИ по сравнению со сценарием без него. Он оценивался через скорость, масштаб и глубину операций, однако единой числовой шкалы для сопоставления всех областей не опубликовано.

Матрица семи областей вреда и ответных мер

Anthropic прекращает доступ связанных аккаунтов, но внешняя инфраструктура операций остаётся за её границами

Версии Claude указаны не во всех эпизодах, поэтому полное распределение моделей по категориям восстановить нельзя. Опубликованные сведения позволяют составить следующую матрицу:

  • Кибероперации. Модели Haiku, Sonnet и Opus участвовали в разведке, поиске уязвимостей, создании инструментов, проникновении и обработке похищенных данных. Заявленный прирост — ускорение многоэтапных атак и возможность автоматизировать их значительную часть; меры — блокировка аккаунтов, новые детекторы и передача технических индикаторов партнёрам.
  • Операции влияния. Claude применялся для создания поддельных профилей и новостных сайтов, перевода материалов и массовой подготовки публикаций. Эффект связывается с объёмом, скоростью и языковым охватом, а ответ включал блокировку связанных аккаунтов и настройку обнаружения повторяющихся схем.
  • Слежка. Модели помогали проектировать средства перехвата и идентификации, составлять досье и отбирать объекты наблюдения. Расследование Axios об операциях в Мали, Китае и Иране показывает, что для заметного усиления слежки участникам не потребовались новейшие модели; связанные аккаунты были заблокированы, но уже развёрнутые локальные системы сохранились.
  • Мошенничество. В сети приложений для знакомств Claude управлял автономными персонажами, тогда как модели других поставщиков выполняли отдельные функции. Прирост состоял в одновременном поддержании множества разговоров; Anthropic закрыла связанные аккаунты и организации и передала сведения другим разработчикам ИИ.
  • Биологические исследования двойного назначения. В отдельных эпизодах фигурировали Sonnet 4, Haiku 4.5 и Opus 5. Модели помогали с анализом данных, планированием исследований и подготовкой заявки, однако вредоносное намерение учёных не установлено; аккаунты и обходные каналы блокировались, а чувствительные запросы получили более строгие ограничения.
  • Обычные вооружения. Чат Claude, Claude Code и агентные инструменты использовались для программ управления и наведения, моделирования, закупок и сбора открытых сведений. Заявленный эффект — автоматизация инженерной и аналитической работы; ответ включал блокировки, дополнительное наблюдение и новые классификаторы запросов.
  • Незаконная дистилляция. Целью преимущественно становились модели класса Opus; один случай затронул более новый класс. Сторонние лаборатории извлекали ответы и рассуждения для обучения собственных моделей, а Anthropic противодействовала этому блокировкой запросов и аккаунтов, выявлением прокси-сетей и специальными классификаторами.

Что в отчёте означает «пресечение»

В большинстве случаев пресечение означает прекращение выявленного доступа к Claude: блокировку аккаунтов, запросов или связанных организаций. Дополнительно могли усиливаться защитные механизмы и передаваться индикаторы государственным структурам, другим разработчикам или платформам распространения.

Эти меры не гарантируют остановку всей внешней операции. Система слежки в Мали была развёрнута локально с другой моделью, поэтому блокировка прекратила дальнейшую помощь Claude в проектировании, но не отключила готовое программное обеспечение. В одном биологическом эпизоде оператор восстановил доступ через новые учётные записи и другие каналы после первых ограничений.

Неравнозначны и описанные результаты. В случаях, связанных с обычными вооружениями, зафиксированы разработка программ, моделирование и отдельные испытания, но создание работоспособной конечной системы подтверждено не всегда. Для операций влияния выпуск материалов также не означает доказанного воздействия на реальную аудиторию.

Почему семь областей не показывают частоту злоупотреблений

Отобранные Anthropic случаи Claude не дают статистики о частоте злоупотреблений среди всех пользователей

У выборки нет опубликованного знаменателя. Не раскрыто, какую долю всех пользователей, аккаунтов, сообщений или запросов составляют рассмотренные операции. Поэтому по отчёту нельзя вычислить частоту злоупотреблений, сравнить её между моделями или определить изменение доли нарушений со временем.

Семь областей — классификация вреда, а не число инцидентов и не взаимоисключающие статистические группы. Одна операция могла сочетать вредоносное программирование, слежку и влияние. Случаи отбирались за заметность и новизну, вследствие чего выборка не является случайной или репрезентативной.

Независимые публикации подтверждают выход отчёта и пересказывают его основные кейсы, но не имеют доступа ко всему массиву телеметрии и запросов Anthropic. Особенно осторожно следует трактовать биологические эпизоды: потенциально опасные возможности исследований описаны, однако намерение участников в каждом случае определить нельзя.

На 14 сентября известно, какие виды вредоносного применения Anthropic обнаружила и какие доступы ограничила. Неизвестными остаются общий масштаб наблюдения, доля пропущенных нарушений и распространённость подобных действий среди всех пользователей Claude; без этих данных семь областей нельзя превращать в показатель частоты злоупотреблений.

Читайте также:

Поделиться:

Подпишитесь на рассылку

Получайте свежие новости Web3, AI и криптовалют прямо на вашу почту.

0