
Open-weight AI-модели на перекрёстке: Китай захватывает рынок, Anthropic ведёт антикитайскую кампанию
Что произошло
AI Digest (ai-digest.ru) — Открытые весовые AI-модели (open-weight) переживают переломный момент. Аналитик Нейтан Ламберт (Nathan Lambert) в материале для Interconnects AI описывает ситуацию: американские open-weight модели, такие как Llama от Meta, теряют позиции, а китайские — DeepSeek, Qwen, MiniMax, Moonshot — захватывают глобальный рынок. Anthropic активно лоббирует регуляцию против китайских моделей, утверждая, что они используют «атаки через дистилляцию» для копирования возможностей Claude.
Как Китай захватил open-weight рынок
К маю 2026 года китайские open-weight модели составляли около 61% всех токенов, потреблённых на OpenRouter — крупнейшем нейтральном маршрутизаторе LLM. Четыре из пяти самых используемых моделей — китайские. Meta Llama, бывший лидер open-weight сегмента два года назад, полностью выпал из рейтингов.
Цена — главное оружие. DeepSeek-V4-Pro стоит примерно в 12 раз дешевле GPT-5.5 при сопоставимом уровне интеллекта на бенчмарках. Китайские лаборатории — Zhipu, DeepSeek, MiniMax и Moonshot — совокупно оцениваются примерно в 159 миллиардов долларов, хотя ещё полтора года назад их стоимость была близка к нулю.
Позиция Anthropic: дистилляция как угроза
Anthropic в феврале 2026 года обвинила три китайские AI-компании — DeepSeek, Moonshot AI и MiniMax — в coordinated кампаниях по извлечению информации из Claude. Компания утверждает, что эти фирмы направляли на Claude большие объёмы специально созданных промтов, чтобы обучать собственные модели — техника, известная как дистилляция знаний (knowledge distillation).
OpenAI выдвинула аналогичные обвинения ранее. Обе американские компании требуют от регуляторов ограничить доступ китайских моделей к американским технологиям и данным.
Что такое дистилляция и почему это важно
Knowledge distillation (дистилляция знаний) — техника обучения, при которой компактная модель («студент») обучается воспроизводить выходы более крупной и мощной модели («учитель»). Это позволяет создавать более дешёвые модели с характеристиками, близкими к большим. Если китайские компании используют ответы Claude для обучения своих моделей — это, по мнению Anthropic, несправедливое преимущество и нарушение условий использования.
Open-weight модели — языковые модели, веса которых (параметры) публично доступны для скачивания и модификации. Это отличается от закрытых моделей (GPT-4, Claude), где веса — коммерческая тайна. Open-weight подход позволяет любому использовать модель локально, модифицировать и дообучать.
Какие политические последствия это несёт
В June 2026 года правительство США приостановило доступ иностранцев к Fable и Mythos от Anthropic, что привело к полному отзыву моделей компанией. Это создаёт неопределённость: если американские модели могут быть отключены в одностороннем порядке, зарубежные партнёры будут искать альтернативы — китайские open-weight модели или локальные суверенные решения.
Будущее open-weight моделей зависит от регуляторных решений. Если США ограничат экспорт или доступ китайских моделей к американским технологиям, это изменит глобальный баланс сил в AI-индустрии. Обратная сторона: такие ограничения могут подтолкнуть глобальных партнёров к китайским решениям, что усилит зависимость от Поднебесной вместо её ослабления.
Читайте также: Kimi K3: открытая модель с 2.8 триллиона параметров приближается к уровню Claude и Anthropic сократила лимиты Claude Fable 5.
AI-инструменты, которые можно сразу взять в работу
Подборка доступов и подписок к популярным сервисам: быстро, с авто-выдачей и понятной оплатой.