OpenAI срывает кампанию, связанную с Moonshot, по мере обострения войны за дистилляцию ИИ

- OpenAI заявила, что выявила усилия по дистилляции данных, связанные с Moonshot.
- Компания приостановила работу некоторых аккаунтов, связанных с этой кампанией по дистилляции.
- Anthropic также сообщила, что Moonshot нацеливалась на свои модели Claude.
OpenAI выдвинула обвинения в скрапинге данных против своего китайского конкурента Moonshot AI. Компания связала массовую волну исследовательских запросов, направленных на расшифровку того, как её модели решают сложные задачи, с тысячами попыток со стороны пользователей, связанных с Moonshot.
Начиная с первой недели июля, скоординированная кампания, связанная с Moonshot, достигла 16 000 запросов от более чем 4 000 пользователей всего за два дня, сообщила OpenAI. Разработчик ChatGPT в конечном итоге выявил ещё больше связанной активности, охватывающей кластер из более чем 15 000 пользователей, которая была полностью пресечена к 28 июля.
Согласно анализу компании, кампания не привела к компрометации базы данных, нарушению шифрования или утечке сохранённых пользовательских чатов. Однако злоумышленники использовали манипуляции с промптами и моделью, что позволило им в явном виде воспроизвести запрещённые возможности рассуждения в рамках масштабной операции, нарушающей условия использования.
OpenAI заявляет, что внедрила дополнительные меры защиты для предотвращения дистилляции
По словам OpenAI, компания обнаружила и прервала ряд операций, в ходе которых пользователи пытались украсть скрытую логику путём передачи зашифрованной информации о рассуждениях между разными чатами с последующим её декодированием в другом чате.
Большинство таких операций были связаны с Moonshot. Одновременно другие сторонние исследователи сообщили компании об аналогичных уязвимостях, включая проблемы межмодельного взаимодействия и сжатия данных.
На данный момент разработчик ChatGPT охарактеризовал недавнее событие как «враждебную дистилляцию» и предупредил, что дистилляция логики может позволить оппонентам подражать передовым технологиям.
Кроме того, отмечается, что крупномасштабный процесс дистилляции может значительно сократить время, необходимое для разработки продвинутой способности ИИ, без каких-либо обязательств по обеспечению безопасности и соответствия.
На данный момент для противодействия тенденции к дистилляции OpenAI ввела санкции в отношении аккаунтов, усилила инфраструктуру и заключила партнёрские соглашения.
Более того, компания даже приостановила подозрительные аккаунты, ужесточила процесс регистрации и бэкенд-безопасность, а также расширила мониторинг пользовательского сообщества.
Кроме того, были внедрены более надёжные механизмы защиты скрытых рассуждений, которые затрагивают всех пользователей, рабочие пространства, корпоративные организации и архитектуры моделей.
Кэролайн Зир, руководитель стратегических инициатив в области национальной политики безопасности в OpenAI, добавила, что они продолжат инвестировать в усиление мер защиты. Она заявила: «Наша обеспокоенность связана с нарушением наших условий использования, а не с открытыми моделями или законной дистилляцией».
Почему дистилляция моделей ИИ становится всё более серьёзной проблемой
Дистилляция моделей позволяет разработчикам использовать выводы более мощной системы ИИ для улучшения или воспроизведения производительности другой модели.
Хотя легитимная дистилляция может использоваться для создания более компактных и эффективных систем, OpenAI утверждает, что несанкционированное масштабное извлечение данных может дать конкурентам доступ к возможностям, разработка которых потребовала значительных ресурсов.
Компания заявила, что последняя кампания вызывает особую обеспокоенность, поскольку злоумышленники использовали не просто ChatGPT для обычных задач. Вместо этого они, по утверждениям, создали автоматизированные рабочие процессы для многократного запроса моделей и переноса полезных ответов в другие системы.
Собирая достаточное количество выводов, атакующие потенциально могут воспроизвести аспекты рассуждений, навыков программирования и решения проблем модели без прямого доступа к её весам или инфраструктуре.
Раскрытие информации от OpenAI подчеркивает растущую проблему для компаний в сфере ИИ: по мере того как всё более мощные модели становятся широко доступны через API и потребительские продукты, провайдерам необходимо балансировать между широким доступом к своим системам и мерами защиты, направленными на предотвращение систематического извлечения проприетарных возможностей.
Anthropic также выявила кампанию по дистилляции Moonshot
За последние несколько месяцев Anthropic также ошибки в логике вычислений Aave V3, немедленно приостановив новые депозиты и займы на затронутых рынках. Этот шаг был предпринят для обеспечения безопасности средств пользователей и возможности вывода средств и погашения займов без каких-либо рисков. и пресекла несколько кибератак, в ходе которых злоумышленники нацеливались на Claude.
Эти злоумышленники включали подозреваемые разведывательные группы, поддерживаемые государствами, хакеров, действующих в корыстных целях, и политических активистов; инциденты произошли в период с декабря 2025 по август 2026 года.
Их конкретные атаки были направлены на извлечение высокоценных компетенций Claude: логического вывода, программирования, оценки данных и автоматизированных рабочих процессов агентов.
По сообщениям, пять различных процессов дистилляции привели к почти 200 млн незаконным запросам. Основная часть запросов на дистилляцию поступила от кампании Alibaba, которую Anthropic охарактеризовала как крупнейшую в истории компании операцию по сбору данных. Эта конкретная кампания сгенерировала 151 миллион зафиксированных запросов с мая по июль 2026 года, достигнув пика почти в 3 миллиона в день.
Вторая кампания Moonshot AI, по сообщениям, пересылала запросы напрямую из военных структур Китая в Anthropic. За 10 дней компания зафиксировала почти 300 000 запросов от 5 000 аккаунтов, большинство из которых были направлены на модель Opus.
Moonshot привлекает значительное внимание в Вашингтоне из-за стремительного темпа, с которым она опережает своих американских конкурентов.
Хотя Пекин уже проигнорировал предыдущие обвинения со стороны Кремниевой долины и администрации Трампа, касающиеся его деятельности по сбору данных, он предупредил о контрмерах в случае любых санкций со стороны Вашингтона.
Если вы читаете это, вы уже впереди. Оставайтесь с нами, подписавшись на нашу рассылку.
Часто задаваемые вопросы
Что такое дистилляция моделей ИИ?
Дистилляция моделей ИИ — это процесс, при котором разработчики используют выходные данные более мощной модели ИИ для обучения или улучшения другой модели. По словам OpenAI, несанкционированная массовая дистилляция позволяет другим воспроизводить продвинутые возможности без прямого доступа к внутренним системам оригинальной модели.
Нарушила ли кампания Moonshot AI системы OpenAI?
OpenAI заявила, что кампания не привела к компрометации баз данных, взлому шифрования или утечке сохранённых чатов пользователей. Вместо этого компания указала, что пользователи использовали многократные запросы и манипуляции с моделью для извлечения информации о возможностях рассуждения её моделей.
Сколько запросов Anthropic связала с кампанией Moonshot AI?
По данным Anthropic, кампания, связанная с Moonshot, сгенерировала почти 300 000 запросов примерно с 5 000 аккаунтов за 10 дней, причём большинство запросов было направлено на модель Claude Opus.

Неллиус Ирэн
Неллиус — выпускница программ по управлению бизнесом и информационным технологиям с пятилетним опытом работы в индустрии криптовалют. Она также окончила Bitcoin Dada. Неллиус внесла вклад в ведущие медиа-издания, включая BanklessTimes, Cryptobasic и Riseup Media.
















