Anthropic: обнаружено атаки на Claude и попытки его клонировать

Anthropic обнаружила организованные атаки на свои модели и попытки воспроизвести поведение Claude через массовые запросы, автоматизированных агентов и злоупотребление API.
Anthropic обнаружила серию атак на свои большие языковые модели и попытки клонирования поведения Claude. В официальном заявлении компания сообщила о целенаправленных попытках восстановить функциональность модели без доступа к исходным весам и лицензиям; точные сроки атак в релизе не указаны. Ранее Anthropic уже сообщала о дистилляции Claude через миллионы запросов с поддельных аккаунтов, включая кампанию, связанную с Alibaba.
По данным компании, злоумышленники использовали методы извлечения модели, инъекции промптов, сети автоматизированных агентов, имитирующих пользователей, и создание поддельных интерфейсов для сбора входно-выходных пар. Такие наборы запросов и ответов позволяют собирать данные, на основе которых возможно натренировать или настроить систему, имитирующую ответы оригинальной модели.
В ответ Anthropic усилила мониторинг трафика и ввела дополнительные лимиты на количество запросов с новых и подозрительных учётных записей. Компания временно ограничила доступ к некоторым API-интерфейсам, ужесточила проверки партнёрских интеграций и сотрудничает с провайдерами инфраструктуры и правоохранительными органами для поиска источников атак.
Anthropic указывает ряд рисков, которые могут возникнуть при успешном извлечении: появление нелицензионных клонов Claude, обход внутренних политик безопасности, распространение недостоверной информации и коммерческие убытки от копирования уникальной функциональности. Компания подчёркивает, что клоны, созданные на основе собранных пар запрос–ответ, могут не включать механизмы ограничения вредоносного контента и безопасного поведения оригинальной модели.
В отрасли отмечают, что попытки извлечения моделей становятся более частыми для сервисов, предоставляющих доступ к крупным языковым моделям через облако и API. Поведение модели можно частично восстановить без прямого доступа к её весам — для этого требуется большой объём диалогов и ответов, достаточный для обучения менее сложной, но функционально схожей системы.
Anthropic напомнила, что Claude — семейство её крупных языковых моделей, используемых в коммерческих и исследовательских задачах, и что защита интеллектуальной собственности и пользовательских данных остаётся приоритетом. Компания не раскрыла имён или принадлежности предполагаемых атакующих и ограничилась описанием технических векторов и принятых мер.
Anthropic продолжит расследование и обновление мер безопасности, одновременно информируя клиентов и партнёров о возможных рисках и рекомендуемых шагах по защите ключей API и мониторингу аномального трафика.
Материалы на GNcrypto предоставляются исключительно в информационных целях и не являются финансовой рекомендацией. Мы стремимся публиковать точные и актуальные данные, однако не можем гарантировать их абсолютную достоверность, полноту или надёжность. GNcrypto не несёт ответственности за возможные ошибки, упущения или финансовые потери, возникшие вследствие использования данной информации. Все действия вы совершаете на свой страх и риск. Всегда проводите собственный анализ и консультируйтесь с профессионалами. Подробнее см. в наших страницах Условия, Политика конфиденциальности и Отказ от ответственности.







