Обзор Kimi K3, китайского гиганта среди открытых моделей

16 июля 2026 года пекинская компания Moonshot AI представила Kimi K3, свою новую флагманскую модель и, по собственному заявлению разработчиков, крупнейшую открытую языковую модель из когда-либо выпущенных. Сначала K3 появилась только как облачный сервис через чат и API, а полные веса для локального запуска компания опубликовала чуть позже, 27 июля. Заявление громкое само по себе: модель почти достигла отметки в 3 триллиона параметров и при этом честно выложена в открытый доступ, что для такого масштаба до сих пор было редкостью. Ведь обычно подобные модели держат закрытыми.

Что там внутри

Всего у Kimi K3 около 2,8 триллиона параметров. Но это не значит, что модель считает всеми ими сразу. Архитектура построена по принципу смеси экспертов, и на каждый токен активируется лишь 16 из 896 экспертов, то есть меньше 2 % от общего объема. Именно за счет этого модель остается вычислительно приемлемой, несмотря на пугающий заголовочный размер. Разработчики также встроили в K3 два внутренних архитектурных решения: механизм внимания Kimi Delta Attention, чередующий облегченные линейные слои с обычным полным вниманием в пропорции три к одному, и отдельный механизм остаточных связей внимания. Он снижает потери информации на длинных последовательностях.

Отдельного упоминания заслуживает контекстное окно. Оно у K3 доходит примерно до миллиона токенов, и Moonshot AI подчеркивает, что добивается хороших результатов в длинных агентных задачах именно за счет этого запаса, без искусственного сжатия контекста и без разделения работы на несколько параллельных агентов. Модель при этом рассуждает постоянно, а не только по запросу. Глубину рассуждения можно настраивать отдельным параметром в зависимости от сложности задачи.

Kimi K3 пишет код

Официально Kimi K3 доступна через чат на kimi.com, через продукт Kimi Work для рабочих задач, через терминального агента Kimi Code и через API, а после публикации весов появилась и возможность развернуть модель у себя.

Пример работы

Нейросеть на фоне конкурентов

Сама Moonshot AI не скрывает, что, по общей оценке, K3 уступает Claude Fable 5 и GPT 5.6 Sol. Зато обходит все остальные модели в своей линейке сравнения, включая Claude Opus 4.8 и GPT 5.5 (особенно в программировании и агентных задачах). Например, в тесте на верстку веб-интерфейсов по результатам вслепую от разработчиков K3 заняла первое место, опередив даже Fable 5. Похожая картина в задачах на долгую самостоятельную работу в браузере и в длинных агентных сценариях программирования, там модель тоже оказалась впереди обоих ближайших конкурентов. При этом в тестах на общие знания и в отдельных бенчмарках по разработке ПО Fable 5 и GPT 5.6 Sol по-прежнему держат лидерство, так что называть K3 универсальным победителем было бы преувеличением.

Заслуживает уважения и то, что сама Moonshot AI открыто перечисляет слабые места модели, а не только хвалится сильными сторонами. Модель чувствительна к истории собственных рассуждений: если агентная среда обрезает или меняет цепочку мышления на лету, качество ответа заметно проседает. К3 также склонна действовать самостоятельно в неоднозначных ситуациях вместо того, чтобы переспросить пользователя. По субъективному ощущению от общения, даже при формальном паритете в бенчмарках, модель пока уступает конкурентам в живости и естественности диалога.

Пример работы

На каких чипах на самом деле обучали модель

Вот тут начинается самое любопытное. Соединенные Штаты годами ограничивают поставки в Китай самых мощных ускорителей Nvidia, и по идее модель такого масштаба обучить в Китае легально попросту не на чем. Однако 22 июля директор научно-технического управления Белого дома Майкл Кратсиос публично обвинил Moonshot AI в использовании чипов Nvidia GB300 поколения Blackwell, доступ к которым компания якобы получила через серверы в Таиланде. То есть формально вне территории Китая. Позже независимое расследование Bloomberg подтвердило отдельную, но похожую схему: значительная часть обучения K3 прошла на кластере примерно из 20 тысяч чипов Nvidia, предоставленных через облачную инфраструктуру Alibaba, которой принадлежит около трети Moonshot AI. Alibaba оспорила лишь конкретную модель чипов, но не сам факт аренды мощностей.

Получается забавная картина: для обучения модели используются самые мощные чипы, добытые окольными путями через зарубежные дата-центры, а для повседневной работы с уже готовой K3 компания открыто полагается на менее мощные, но легально доступные в Китае процессоры Nvidia H20, и по собственным рекомендациям Moonshot для запуска модели нужно не меньше 64 таких карт разом.  Американский Минторг уже готовит новые правила, которые должны закрыть лазейку с арендой чипов через дата-центры в третьих странах. Но юристы, специализирующиеся на экспортных ограничениях, сомневаются, что у ведомства хватит на это полномочий.

Выводы

Таким образом, Kimi K3 интересна не только масштабом, но и сочетанием открытых весов, сильных результатов в агентных задачах и необычной архитектуры. При этом модель пока не стала безоговорочным лидером: у нее остаются заметные слабые места в диалоге и работе с длинными цепочками рассуждений. Но сам факт появления открытой модели такого размера, как отмечают эксперты Креатор Проджект, уже делает K3 одним из самых заметных релизов года — и одновременно показывает, насколько тесно развитие ИИ теперь связано с вопросами доступа к вычислительным мощностям.

Если вы нашли ошибку, пожалуйста, выделите фрагмент текста и нажмите Ctrl+Enter. Можете написать лучше? Мы всегда рады новым авторам.

Интересно? Поделиться:

2 комментария к “Обзор Kimi K3, китайского гиганта среди открытых моделей”

  1. Судя по описанию это просто лютый монстр. Иначе и не назовёшь то, что может удерживать целый лям токенов контекста и жестко его анализировать, так что даже топовые закрытые нейронки от OpenAI и Anthropic нервно курят в сторонке.

Добавить комментарий

Оставляя комментарий вы соглашаетесь на обработку персональных данных в соответствии с политикой конфиденциальности, соглашаетесь с пользовательским соглашением. Ваш адрес email не будет опубликован. Обязательные поля помечены *

Рекомендуем почитать

Подпишитесь на нашу рассылку

Loading

Сообщить об опечатке

Текст, который будет отправлен нашим редакторам:

Продолжая использовать наш сайт, вы соглашаетесь с использованием файлов cookie. Они помогают нам обеспечивать корректную работу сайта и делать его более удобным.
Принять
Политика конфиденциальности