Скандал вокруг Kimi K3: почему эксперты не верят, что китайцы «украли» модель Anthropic

ИИ Олег Васильевич Клод 23.07.2026 6 мин чтения 9 просмотров
Скандал вокруг Kimi K3: почему эксперты не верят, что китайцы «украли» модель Anthropic

Научный советник Белого дома Майкл Кратсиос 23 июля 2026 года заявил, что китайская компания Moonshot построила модель Kimi K3, крупнейшую доступную open-weight-нейросеть, «скопировав» модель Fable от Anthropic, да ещё и на чипах, запрещённых к вывозу в Китай. Формулировка звучала жёстко: «крупномасштабная скрытая промышленная дистилляция с целью кражи проприетарной технологии США». В громком заявлении почти никто не заметил одну деталь: технические специалисты, разобрав сроки и математику, говорят, что дистилляцией такой результат объяснить нельзя.

Разберём, почему инженерная картина расходится с политической и что этот разрыв говорит о реальном положении дел в гонке ИИ-разработчиков. В конце будет простой аргумент, который рушит версию о «краже Kimi K3 за две недели».

Обвинение Белого дома: копия, водяные знаки и запрещённые чипы

Заявление Кратсиоса прозвучало на фоне обсуждаемого в отрасли запрета на китайские open-weight-модели, то есть модели, чьи веса выкладываются в открытый доступ (как Llama, Qwen, DeepSeek или та же Kimi), в отличие от закрытых, доступных только через API. Именно открытые модели оказались в центре предложений о запрете: их можно скачать, дообучить и запустить у себя, а проконтролировать это куда сложнее.

Обвинение усилил министр финансов Скотт Бессент: «мы находим водяные знаки наших американских LLM на многих китайских моделях, и это недопустимо». Что именно за «водяные знаки» имеются в виду, он не пояснил. Технически под этим могут понимать статистические сигнатуры в выводах модели, специально внедрённые паттерны, по которым можно узнать «родителя». Но никаких деталей или доказательств к заявлению не приложили.

Moonshot на запросы журналистов не ответила. Кратсиос источников обвинения не привёл. Anthropic и Минфин США тоже промолчали. Публичная «рамка воровства» есть, а подтверждающей фактуры пока нет.

Арифметика опровержения: почему дистилляция не объясняет силу Kimi K3

Самый простой контраргумент, календарь. Fable стала публично доступна лишь 1 июля, а Kimi K3 вышла примерно через две недели. Здесь у экспертов возникает физический вопрос: когда именно китайцы успели «надистиллировать» данные, обучить на них модель и выпустить её?

Брейден Хэнкок из Laude Institute, сооснователь Snorkel AI, формулирует прямо: «Не верю, что можно получить настолько сильную модель настолько быстро сразу после Fable, только за счёт дистилляции. На это просто нет времени». За две недели невозможно провести полный цикл: собрать датасет через запросы к чужой модели, прогнать обучение и подготовить релиз.

Дистилляция моделей в этом контексте, это систематические обращения к «модели-цели», чтобы понять её поведение и перенять способности. Иногда, с просьбой показать «цепочку рассуждений» (chain-of-thought). Дальше на парах «промпт-ответ» проводят supervised fine-tuning (SFT), дообучение с учителем. На этом этапе младшая модель «перенимает манеры» старшей. Отсюда, к слову, курьёзы вроде китайских моделей, которые в ответах вдруг называют себя «Claude».

Почему SFT больше не догоняет фронтир

Технический сдвиг в том, что дистилляция как способ догнать лидеров уже работает плохо. Нейтан Ламберт из Allen Institute for AI (Ai2) в подкасте накануне объяснил: дистилляция «становится всё менее значимой», потому что китайские модели и так вплотную подошли к переднему краю, а само обучение сместилось в сторону reinforcement learning, обучения с подкреплением (RL).

Логика простая. «Если бы дело было в этом, все легко догоняли бы GLM или K3, просто используя их данные для дистилляции. Но этого не происходит, с помощью одного лишь SFT», говорит Ламберт. Если бы копирование через SFT давало фронтир-уровень, рынок был бы завален такими клонами. Их нет.

Чтобы «перенести» способности уровня Fable, скорее всего понадобился бы RL: большая модель-агент оценивает ответы меньшей, а та корректируется по этим оценкам. И вот тут начинается настоящий масштаб. Крупные RL-прогоны могут требовать десятков миллионов агентов. Делать это через API чужой фронтир-лаборатории «безумно дорого», упирается в скорость её моделей как в бутылочное горлышко, и вполне может вообще не дать прироста качества. Предполагаемая «кража» оказывается технически неподъёмной и экономически бессмысленной.

Дистилляция как норма отрасли: от Grok до синтетики

В политической риторике теряется нюанс: дистилляция моделей распространена далеко не только в Китае. Ранее в 2026 году Илон Маск под присягой свидетельствовал, что его ИИ-компания дистиллировала модели OpenAI при разработке Grok, и что практика в отрасли обыденна. Грань между «дистилляцией» и «созданием синтетических датасетов» размыта: во втором случае одна модель генерирует обучающие данные для другой, и формально это уже не воровство, а стандартный инженерный приём.

Скандал вокруг Kimi K3: почему эксперты не верят, что китайцы «украли» модель Anthropic

При этом претензии к китайским лабораториям не пусты. Ранее в 2026 году сама Anthropic публично обвинила Moonshot, DeepSeek и MiniMax в систематической дистилляции своих моделей. Компания заявляла, что зафиксировала миллионы обменов между её моделями и пользователями, которых по IP и метаданным связали с этими фирмами. Эти запросы, по версии Anthropic, «отличались от обычных паттернов использования и отражали намеренное извлечение способностей».

Так что вклад западных моделей в китайские вполне вероятен. Спор идёт о другом: объясняет ли этот вклад именно лидерство Kimi K3, или это лишь одна из деталей, а не корень успеха.

Kimi K3 не просто «едет на чужом горбу»

Хэнкок отдельно проходится по недооценке китайских команд: «Американцы недооценивают техническую экспертизу этих китайских команд. Один из основателей Moonshot, экс-аспирант CMU. Это серьёзные исследователи и инженеры… если бы американские модели встали, прогресс Китая замедлился бы, но продолжился. Они не просто едут на чужом горбу».

Это главный тезис для тех, кто следит за гонкой. Китайские лаборатории уже работают на уровне самостоятельной R&D. Заимствования есть у всех, но представление, будто без западных моделей китайские команды остановятся, устарело.

Прецедент тоже был: в январе 2025 года релиз DeepSeek R1 уже поднимал волну обвинений в дистилляции выходов западных моделей. Тот эпизод можно считать «нулевым пациентом» нынешнего скандала, сценарий повторяется почти дословно.

Опрос 0 голос.

Kimi K3 реально «украли» у Anthropic или китайцы догнали сами?

Чиповая часть, которую сложно отделить

Вторая половина заявления Кратсиоса, про железо. Он утверждает, что Moonshot заполучила передовые чипы NVIDIA Grace Blackwell, не разрешённые к экспорту в Китай. Это отдельная политически заряженная тема: экспортный контроль США через Бюро промышленности и безопасности (BIS) ограничивает вывоз топовых ИИ-ускорителей, от линеек H100/H200 до Blackwell/GB200.

Проблема в том, что обвинение в «дистилляции» и обвинение в «запрещённых чипах» слиты в одно. Первое эксперты считают технически шатким. Второе, вопрос санкционного контроля, который к архитектуре обучения отношения не имеет. Когда две разные претензии подают одним пакетом, разобраться, что именно доказано, становится труднее. На такой смеси и строится громкое политическое заявление.

Что скандал вокруг Kimi K3 говорит о гонке ИИ

Кейс Kimi K3 хорошо иллюстрирует главный разрыв момента: политика обгоняет инженерию. Рамка «китайцы украли нашу технологию» удобна для риторики и для обоснования запретов на open-weight-модели. Но техническая картина сложнее: по срокам, по экономике RL и по реальному уровню китайских команд версия о «дистилляции как источнике силы» не сходится.

Для обычного пользователя из России и СНГ практический вывод один: открытые китайские модели вроде Kimi K3 работают как реальная альтернатива закрытым западным, и попытки их запретить продиктованы скорее геополитикой, чем качеством. Если вам важен доступ к разным ИИ-сервисам без оглядки на страну происхождения, стабильный доступ можно обеспечить через Sigma.

А обещанный аргумент, который проще всего запомнить: Fable вышла 1 июля, Kimi K3 спустя две недели. Полный цикл дистилляции с обучением и релизом в такой срок физически не помещается. Именно на эту арифметику эксперты и указывают в первую очередь.

Источники

TechCrunch, почему эксперты не считают эксплуатацию Fable причиной силы Kimi K3

Вопрос читателям

Вы вообще замечаете разницу между китайскими и американскими нейросетями в работе?

Ответить в комментариях
«Аварийный выключатель» для ИИ: власти США хотят право экстренно гасить опасные системы
Читать следующую «Аварийный выключатель» для ИИ: власти США хотят право экстренно гасить опасные системы

Комментарии

0
?

Пока нет комментариев. Будьте первым!