Китай проверяет DeepSeek и Moonshot из-за данных
DeepSeekMoonshot AIClaude
Что именно проверяет Китай
Я бы не сводил эту историю к очередному спору о копировании моделей. Китайского интернет-регулятора, по сообщению The Information, заинтересовал возможный вывоз пользовательских данных через Claude. На 24 сентября 2026 года речь идет о расследовании, а не об установленном нарушении.
В отчете Anthropic о незаконной дистилляции утверждается, что Moonshot AI направила в Claude более 23 млн обменов между маем и июлем. Для DeepSeek компания указывает более 12,1 млн обменов за 14 дней июля. По версии Anthropic, использовались подставные аккаунты, посреднические сети, а также украденные или поддельные учетные данные.
Механика выглядит так: пользователь считает, что общается с китайской моделью, но его запрос незаметно пересылается внешнему сервису. Ответ Claude возвращается обратно и, как утверждает Anthropic, попадает в контур обучения конкурирующей модели. Вместе с промптом могли передаваться имена, электронная почта и корпоративные документы.
И вот тут история становится серьезнее обычной дистилляции. Вопрос уже не только в происхождении обучающих данных, но и в том, где фактически обрабатывался запрос и знал ли об этом пользователь.
- Anthropic является первичным источником заявленных объемов трафика.
- The Information сообщает о начавшейся китайской проверке.
- Окончательных выводов регулятора в исходных данных пока нет.
Почему скрытый маршрут меняет расклад
Главный риск здесь инженерный: обещание хранить данные внутри страны бессмысленно, если промежуточный слой может отправить промпт во внешний API. Я бы первым делом смотрел журналы маршрутизации, происхождение аккаунтов, цепочку посредников и правила обработки вложений.
Для пользователей проблема очевидна не всегда. Интерфейс может принадлежать одному поставщику, модель на экране называться его именем, а фактический инференс частично выполняться совсем другой системой. Такая архитектура ломает согласие на обработку данных и контроль над корпоративными секретами.
- Провайдерам придется точнее раскрывать место обработки запросов.
- Регуляторы получат повод проверять не только хранение, но и транзит данных.
- Разработчикам моделей станет сложнее маскировать внешние зависимости за собственным интерфейсом.
Миллионы обменов делают обвинение масштабным, но не доказывают его автоматически. Самый неприятный вопрос остается открытым: сколько AI-продуктов сегодня показывают пользователю одну модель, а за кулисами маршрутизируют его данные совсем в другую.