Kimi K3: что умеет нейросеть Moonshot AI и как ей пользоваться

Kimi K3: что умеет нейросеть Moonshot AI и как ей пользоваться
25 августа 2026 — 10 мин

Kimi K3 — флагманская нейросеть китайской компании Moonshot AI. Её обсуждают по одной причине: первая открытая модель, дошедшая до масштаба почти в три триллиона параметров, а веса разработчик выложил в открытый доступ. Разбираем по официальным данным, что умеет модель Kimi K3, где уступает конкурентам, сколько стоит и где получить доступ. Данные актуальны на 24 августа 2026 года.

Что такое Kimi K3 и почему о ней столько спорят

Kimi — линейка моделей Moonshot AI, китайской компании, которая развивает её с 2024 года. K3 вышла 16 июля 2026 года и стала третьим поколением линейки. Предыдущая версия, Kimi K2, закрепилась в нише под ярлыком «китайская модель с длинным контекстом»; новая — совсем другой разговор.

Главное отличие не в размере, а в эффективности. Moonshot перестроила архитектуру: добавила собственные механизмы внимания Kimi Delta Attention и Attention Residuals, переработала схему распределения нагрузки между экспертами. По расчётам разработчика, прирост эффективности масштабирования составил примерно два с половиной раза к прошлому поколению — та же вычислительная мощность превращается в качество ответов заметно лучше.

Второе отличие — зрение. Прошлая версия работала с текстом, новая понимает изображения внутри одной модели, а не через отдельный распознаватель. Третье — модель всегда рассуждает: отключить «размышление» нельзя, можно только менять его глубину.

Главные цифры модели

Всё, что ниже, взято из официальной карточки Moonshot AI.

Характеристика Значение
Разработчик Moonshot AI
Архитектура Mixture-of-Experts (смесь экспертов)
Параметров всего 2,8 трлн
Активных параметров на шаг 104 млрд
Экспертов в модели 896, на шаг активируется 16
Слоёв 93
Контекстное окно 1 048 576 токенов
Зрение энкодер MoonViT-V2, 401 млн параметров
Словарь 160 тыс. позиций
Квантование MXFP4 (веса) / MXFP8 (активации)
Лицензия Kimi K3 License, веса открыты

104 миллиарда активных параметров вместо 2,8 триллиона

Цифра «2,8 триллиона» звучит внушительно, но она не означает, что на ваш вопрос работает вся модель целиком. Архитектура Mixture-of-Experts разбивает нейросеть на 896 специализированных блоков, и при обработке очередного фрагмента текста система выбирает всего 16 из них плюс два общих. В работе одновременно участвует около 104 миллиардов параметров.

Смысл приёма простой: знаний в модели много, а считать на шаге приходится мало. Именно поэтому нейросеть такого размера вообще отвечает с приемлемой скоростью и по вменяемой цене.

Контекстное окно: сколько текста помещается за раз

Контекстом называют объём текста, который нейросеть удерживает в диалоге одновременно: ваши сообщения, свои ответы, приложенные файлы. Единица измерения — токен, кусочек слова, на которые модель дробит текст. В русском языке одно слово обычно занимает больше токенов, чем в английском; подробно мы разбирали механику в отдельном материале.

Миллион токенов — порядок нескольких сотен страниц за раз. На практике модели можно отдать не выжимку, а весь договор, весь отчёт или целый репозиторий кода, и она будет отвечать с учётом всего документа, а не первых страниц.

Высокая стопка одинаковых карточек уходит в широкую жёлтую арку, а с другой стороны выходит одна карточка со сводкой

Оговорка от самой Moonshot: на тесте веб-поиска BrowseComp разработчик прогонял нейросеть со сжатием контекста при 300 тысячах токенов, и результат без сжатия оказался ниже — 90,4 против 91,2. Миллион токенов доступен, но забивать его целиком не всегда выгодно.

Что умеет Kimi K3 на практике

Moonshot позиционирует новинку как агентную — рассчитанную не на один ответ, а на длинную самостоятельную работу. Три сценария, под которые её затачивали.

Длинные задачи по коду

Основной сценарий разработчика. Модель рассчитана на многочасовые сессии с минимальным контролем человека: разобраться в большом репозитории, вносить правки, запускать инструменты в терминале, проверять результат. Из примеров, которые Moonshot приводит сама: оптимизация вычислительных ядер для видеокарт, работа над компилятором, разработка игровых прототипов с опорой на скриншоты.

Оговорка для практики: длинная автономная сессия стоит дороже одного ответа. Модель тратит рассуждения на каждом шаге, и счёт растёт вместе с продолжительностью работы.

Для такой работы у компании есть собственная терминальная оболочка Kimi Code, и разработчик прямо пишет, что связка с ней работает лучше всего. Если вы знакомы с Claude Code, перед вами инструмент того же класса.

Документы, таблицы и отчёты

Второй заявленный сценарий — работа со знаниями от начала до конца: разобрать пачку документов, собрать исследование, сделать презентацию или интерактивную сводку. На тесте разбора документов OmniDocBench результат лучший среди сравниваемых — 91,1.

Отдельно отмечен формат, где документы поданы картинками и текстового слоя нет вовсе: нейросеть читает их изображениями.

Зрение: скриншоты, схемы, видео

Текст и изображения обрабатываются одной моделью — зрение встроено, а не приделано сбоку. Отсюда сценарии вроде «покажи скриншот интерфейса и попроси поправить вёрстку» или «дай схему и попроси объяснить, что на ней». На тесте понимания видео Video-MME набрано 90,0.

Бенчмарки Kimi K3: где K3 обходит конкурентов, а где уступает

Цифры из официальной таблицы Moonshot AI, режим максимальной глубины рассуждения.

Бенчмарк Что меряет Kimi K3 Claude Fable 5 GPT-5.6 Sol Claude Opus 4.8
GPQA Diamond научные вопросы уровня аспирантуры 93,5 92,6 94,1 91,0
Terminal-Bench 2.1 работа в терминале 88,3 88,0 88,8 84,6
SWE-Marathon длинные инженерные сессии 42,0 35,0 39,0 40,0
FrontierSWE сложные задачи по коду 81,2 86,6 71,3 66,7
BrowseComp поиск в вебе агентом 91,2 88,0 90,4 84,3
OmniDocBench разбор документов 91,1 89,8 85,8 87,9
Harvey Lab-AA юридические задачи 94,6 93,6 87,2 91,1

Картина неоднородная. Лидерство там, где задача длинная и требует самостоятельности: марафонские инженерные сессии, поиск в вебе, разбор документов, юридические задачи. Отставание — на сложных одиночных задачах по коду, где на FrontierSWE разрыв с Claude Fable 5 больше пяти пунктов.

Три крупные фигуры разной высоты стоят в ряд, жёлтая лента над ними спускается ступенями от самой высокой к самой низкой

Чего таблица не показывает вовсе — насколько удобно с моделью работать изо дня в день. Бенчмарки меряют результат на задаче, а не то, сколько попыток ушло на формулировку запроса и как часто приходилось переспрашивать.

Сравнение Kimi K3 с конкурентами: важная оговорка

Перед вами таблица Moonshot о собственной разработке. Часть чисел конкурентов взята из внешних источников (Artificial Analysis и Vals AI), остальные Moonshot измерила сама. При этом новинку в ряде тестов гоняли в родной оболочке Kimi Code, а конкурентов — в чужих. Оболочка на результат влияет: на внутреннем тесте компании нейросеть даёт 72,9 в Kimi Code и 73,7 в Claude Code.

Разработчик здесь честнее многих: в анонсе прямо написано, что общая производительность всё ещё уступает Claude Fable 5 и GPT 5.6 Sol.

«Открытая модель» — что означает и чего не означает

Веса действительно выложены, под собственной лицензией Kimi K3 License. Обещание из анонса выполнено: Moonshot назвала срок «до 27 июля 2026 года», и на момент проверки 24 августа 2026 года файлы лежат в открытом доступе. Многие русскоязычные обзоры до сих пор пишут, что весов нет: те тексты созданы до выкладки и с тех пор не обновлялись.

Открытые веса означают, что нейросеть можно скачать и запустить у себя. Они не означают, что бесплатно и что доступно каждому.

Почему 1,4 терабайта весов не поместятся в домашний компьютер

Простая арифметика. Параметров 2,8 триллиона, хранятся они в формате MXFP4 — четыре бита на параметр. Перемножаем: около 1,4 терабайта только под веса, без служебной памяти под контекст диалога.

Огромный плотный блок и рядом крошечная коробочка: оранжевая лента от блока обрывается, не дотянувшись до неё, персонаж разводит руками

Порядок на два больше того, что стоит в обычном компьютере. Поэтому статьи вида «запускаем локально на 8 гигабайтах оперативной памяти» описывают что угодно, только не эту нейросеть: разрыв с реальным требованием примерно в 175 раз. Запустить Kimi K3 дома нельзя, и никакие настройки положения не изменят.

Отдельно скажем про обещания «сжатых» и «облегчённых» сборок. Уменьшенные версии больших моделей существуют, но это другие модели с другим качеством ответов, и называть их именем флагмана некорректно.

Кому открытые веса нужны на самом деле

Тем, у кого есть свой серверный контур: компаниям с требованиями к хранению данных, исследовательским командам, провайдерам вычислений. Moonshot рекомендует три движка инференса — vLLM, SGLang и TokenSpeed. Для остальных «открытость» — про цену и конкуренцию на рынке, а не про личный компьютер.

Ограничения, которые Moonshot признаёт сама

В анонсе есть раздел Limitations, и в русскоязычных обзорах он почти не встречается. Ниже три пункта в той формулировке, которую даёт сам разработчик.

Чувствительность к истории размышлений. Обучение шло в режиме, где собственные рассуждения нейросети сохраняются в диалоге. Если оболочка не возвращает их целиком или диалог переключают на новую модель посреди сессии, качество генерации становится нестабильным. Практический вывод: не меняйте модель в середине важного разговора.

Избыточная инициатива. Обучение шло на длинных сложных задачах, и при мелкой неоднозначности нейросеть склонна принимать решение за вас, а не переспрашивать. Лечится явными рамками в задании.

Разрыв в удобстве. Дословная формулировка Moonshot: заметный разрыв в пользовательском опыте по сравнению с Claude Fable 5 и GPT 5.6 Sol.

Сколько стоит Kimi K3

Два варианта оплаты дают две разные цены и два разных способа считать расход.

API Kimi K3: цена для разработчиков

Тарифы платформы Moonshot указаны в долларах за миллион токенов:

Что Цена за 1 млн токенов
Вход, попадание в кэш $0,30
Вход, без кэша $3,00
Выход $15,00

Кэш здесь — повторно отправленный кусок контекста: если гонять один и тот же большой документ несколько раз, платформа берёт за него в десять раз меньше. Способы оплаты в открытой документации Moonshot не описаны, цены указаны только в долларах.

Доступ через chad: сколько искр уходит на слово

В chad нейросеть доступна наравне с остальными, а расход считается не в токенах, а в искрах — внутренней валюте сервиса. Искры списываются за введённый текст, сгенерированный ответ и контекст диалога.

На 24 августа 2026 года ставка составляет 3 искры за слово и 100 искр за распознавание одной картинки. Для сравнения по той же таблице: у Claude Opus 4.8 это 10 искр за слово и 1 400 за картинку, у Gemini 3.1 Pro — 13 искр за слово. По разбору изображений ставка одна из самых низких в сервисе.

Тарифы такие: Мини стоит 290 ₽ за 120 000 искр в месяц, Опти — 590 ₽ за 300 000 искр, Плюс — 1 690 ₽ за 900 000. Бизнес начинается от 5 000 ₽. Актуальные цифры стоит сверять на странице тарифов: и цены, и ставки моделей в искрах меняются.

Как пользоваться Kimi K3 в России

В чате

Самый короткий путь — открыть нейросеть в сервисе с российской оплатой и писать запросы привычным образом. Доступ к Kimi K3 в России есть на отдельной странице chad: без VPN и зарубежной карты. Там же можно попробовать модель на бесплатных ежедневных генерациях, прежде чем брать тариф.

Отдельного приложения под эту модель у Moonshot для российского рынка нет, поэтому вариантов ровно два: сервис-агрегатор или собственный доступ к платформе разработчика. Для большинства задач хватает первого.

Проверьте на своих задачах ровно две вещи: держит ли нейросеть длинный документ и насколько точно следует инструкции без лишней самодеятельности. Сильная и слабая стороны соответственно.

Через API

Для разработчиков есть текстовое API chad. Важная оговорка: формат запросов у него свой, поэтому инструкции для официальной платформы Moonshot напрямую не подойдут — параметры вроде глубины рассуждения и возврата истории размышлений относятся к ней, а не к нашему интерфейсу. Ориентируйтесь на документацию того сервиса, через который работаете.

Kimi K3 против ChatGPT, Claude и DeepSeek: что брать под задачу

Универсальной нейросети нет — вывод не из вежливости, а из таблицы бенчмарков выше. Kimi K3 против закрытых флагманов выигрывает выборочно, и выбирать разумнее под сценарий.

Задача Что разумно взять
Длинный документ целиком: договор, отчёт, исследование Kimi K3: миллион токенов контекста и лучший результат по разбору документов
Многочасовая работа над кодом с минимальным контролем Kimi K3 или Claude
Одиночная сложная задача по коду Claude: на FrontierSWE разрыв в его пользу
Быстрые повседневные запросы, письма, идеи ChatGPT или модели полегче: рассуждение включено всегда, а значит дороже и медленнее
Дешёвый разбор большого числа картинок Kimi K3: 100 искр за изображение
Задачи на русском без доступа к зарубежным сервисам любой сервис-агрегатор, см. обзор аналогов DeepSeek

Правила для промтов

Рассуждение включено всегда, поэтому короткая расплывчатая формулировка обойдётся дороже, чем у обычного чат-бота: нейросеть потратит размышление на угадывание вашего намерения. Отсюда три практических правила, которые экономят и время, и деньги.

Ставьте явные рамки. Избыточная инициатива — официально признанное свойство. Пишите не «улучши текст», а «перепиши второй абзац, не трогая соседние, сохрани термины и длину». Чем меньше пространства для домысливания, тем предсказуемее результат.

Ещё один приём для экономии: формулируйте задачу один раз и подробно, вместо серии уточняющих реплик. Каждая новая реплика тянет за собой весь предыдущий диалог, и расход растёт быстрее, чем кажется.

Отдавайте документ целиком. Не пересказывайте содержимое своими словами и не режьте файл на куски — контекста хватит. Работа по полному тексту выходит лучше, чем по вашей выжимке.

Не переключайте модель посреди диалога. Начали разбирать договор в одной — доводите до конца в ней же. Перенос длинной сессии ломает режим сохранённых рассуждений и роняет качество.

Частые вопросы

Kimi K3 бесплатная?

Открытая, но не бесплатная. Веса выложены под лицензией, а использование через официальную платформу оплачивается по числу токенов, через сервисы-агрегаторы — по их тарифам. Бесплатны только пробные лимиты: в chad ежедневные бесплатные генерации.

Понимает ли Kimi K3 русский язык?

Да, нейросеть многоязычная и отвечает по-русски. При этом русский текст занимает больше токенов, чем английский того же смысла, — на длинных документах разница заметна по расходу.

Чем Kimi K3 отличается от Kimi Code?

Kimi K3 это сама нейросеть. Kimi Code — терминальная оболочка Moonshot для разработчиков, внутри которой модель работает с файлами проекта. Вещи разные: нейросеть доступна во многих сервисах, а оболочка живёт отдельным инструментом.

Можно ли скачать Kimi K3?

Формально да, веса открыты. Практически для домашнего компьютера бессмысленно: около 1,4 терабайта только под веса. Скачивание оправдано, если есть серверные мощности и один из поддерживаемых движков инференса.

Что будет со статьёй, когда выйдет K4?

Написанное относится к состоянию на 24 августа 2026 года. Ниша обновляется быстро: за месяц до публикации актуальной была Kimi K2, а спрос на неё уже почти исчез. Характеристики и цены перед решением сверяйте с первоисточниками, ссылки на которые приведены ниже.

Алексей Крайнов
Алексей Крайнов
В этой статье: