Kimi K3 — флагманская нейросеть китайской компании Moonshot AI. Её обсуждают по одной причине: первая открытая модель, дошедшая до масштаба почти в три триллиона параметров, а веса разработчик выложил в открытый доступ. Разбираем по официальным данным, что умеет модель Kimi K3, где уступает конкурентам, сколько стоит и где получить доступ. Данные актуальны на 24 августа 2026 года.
Что такое Kimi K3 и почему о ней столько спорят
Kimi — линейка моделей Moonshot AI, китайской компании, которая развивает её с 2024 года. K3 вышла 16 июля 2026 года и стала третьим поколением линейки. Предыдущая версия, Kimi K2, закрепилась в нише под ярлыком «китайская модель с длинным контекстом»; новая — совсем другой разговор.
Главное отличие не в размере, а в эффективности. Moonshot перестроила архитектуру: добавила собственные механизмы внимания Kimi Delta Attention и Attention Residuals, переработала схему распределения нагрузки между экспертами. По расчётам разработчика, прирост эффективности масштабирования составил примерно два с половиной раза к прошлому поколению — та же вычислительная мощность превращается в качество ответов заметно лучше.
Второе отличие — зрение. Прошлая версия работала с текстом, новая понимает изображения внутри одной модели, а не через отдельный распознаватель. Третье — модель всегда рассуждает: отключить «размышление» нельзя, можно только менять его глубину.
Главные цифры модели
Всё, что ниже, взято из официальной карточки Moonshot AI.
| Характеристика | Значение |
|---|---|
| Разработчик | Moonshot AI |
| Архитектура | Mixture-of-Experts (смесь экспертов) |
| Параметров всего | 2,8 трлн |
| Активных параметров на шаг | 104 млрд |
| Экспертов в модели | 896, на шаг активируется 16 |
| Слоёв | 93 |
| Контекстное окно | 1 048 576 токенов |
| Зрение | энкодер MoonViT-V2, 401 млн параметров |
| Словарь | 160 тыс. позиций |
| Квантование | MXFP4 (веса) / MXFP8 (активации) |
| Лицензия | Kimi K3 License, веса открыты |
104 миллиарда активных параметров вместо 2,8 триллиона
Цифра «2,8 триллиона» звучит внушительно, но она не означает, что на ваш вопрос работает вся модель целиком. Архитектура Mixture-of-Experts разбивает нейросеть на 896 специализированных блоков, и при обработке очередного фрагмента текста система выбирает всего 16 из них плюс два общих. В работе одновременно участвует около 104 миллиардов параметров.
Смысл приёма простой: знаний в модели много, а считать на шаге приходится мало. Именно поэтому нейросеть такого размера вообще отвечает с приемлемой скоростью и по вменяемой цене.
Контекстное окно: сколько текста помещается за раз
Контекстом называют объём текста, который нейросеть удерживает в диалоге одновременно: ваши сообщения, свои ответы, приложенные файлы. Единица измерения — токен, кусочек слова, на которые модель дробит текст. В русском языке одно слово обычно занимает больше токенов, чем в английском; подробно мы разбирали механику в отдельном материале.
Миллион токенов — порядок нескольких сотен страниц за раз. На практике модели можно отдать не выжимку, а весь договор, весь отчёт или целый репозиторий кода, и она будет отвечать с учётом всего документа, а не первых страниц.

Оговорка от самой Moonshot: на тесте веб-поиска BrowseComp разработчик прогонял нейросеть со сжатием контекста при 300 тысячах токенов, и результат без сжатия оказался ниже — 90,4 против 91,2. Миллион токенов доступен, но забивать его целиком не всегда выгодно.
Что умеет Kimi K3 на практике
Moonshot позиционирует новинку как агентную — рассчитанную не на один ответ, а на длинную самостоятельную работу. Три сценария, под которые её затачивали.
Длинные задачи по коду
Основной сценарий разработчика. Модель рассчитана на многочасовые сессии с минимальным контролем человека: разобраться в большом репозитории, вносить правки, запускать инструменты в терминале, проверять результат. Из примеров, которые Moonshot приводит сама: оптимизация вычислительных ядер для видеокарт, работа над компилятором, разработка игровых прототипов с опорой на скриншоты.
Оговорка для практики: длинная автономная сессия стоит дороже одного ответа. Модель тратит рассуждения на каждом шаге, и счёт растёт вместе с продолжительностью работы.
Для такой работы у компании есть собственная терминальная оболочка Kimi Code, и разработчик прямо пишет, что связка с ней работает лучше всего. Если вы знакомы с Claude Code, перед вами инструмент того же класса.
Документы, таблицы и отчёты
Второй заявленный сценарий — работа со знаниями от начала до конца: разобрать пачку документов, собрать исследование, сделать презентацию или интерактивную сводку. На тесте разбора документов OmniDocBench результат лучший среди сравниваемых — 91,1.
Отдельно отмечен формат, где документы поданы картинками и текстового слоя нет вовсе: нейросеть читает их изображениями.
Зрение: скриншоты, схемы, видео
Текст и изображения обрабатываются одной моделью — зрение встроено, а не приделано сбоку. Отсюда сценарии вроде «покажи скриншот интерфейса и попроси поправить вёрстку» или «дай схему и попроси объяснить, что на ней». На тесте понимания видео Video-MME набрано 90,0.
Бенчмарки Kimi K3: где K3 обходит конкурентов, а где уступает
Цифры из официальной таблицы Moonshot AI, режим максимальной глубины рассуждения.
| Бенчмарк | Что меряет | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|---|
| GPQA Diamond | научные вопросы уровня аспирантуры | 93,5 | 92,6 | 94,1 | 91,0 |
| Terminal-Bench 2.1 | работа в терминале | 88,3 | 88,0 | 88,8 | 84,6 |
| SWE-Marathon | длинные инженерные сессии | 42,0 | 35,0 | 39,0 | 40,0 |
| FrontierSWE | сложные задачи по коду | 81,2 | 86,6 | 71,3 | 66,7 |
| BrowseComp | поиск в вебе агентом | 91,2 | 88,0 | 90,4 | 84,3 |
| OmniDocBench | разбор документов | 91,1 | 89,8 | 85,8 | 87,9 |
| Harvey Lab-AA | юридические задачи | 94,6 | 93,6 | 87,2 | 91,1 |
Картина неоднородная. Лидерство там, где задача длинная и требует самостоятельности: марафонские инженерные сессии, поиск в вебе, разбор документов, юридические задачи. Отставание — на сложных одиночных задачах по коду, где на FrontierSWE разрыв с Claude Fable 5 больше пяти пунктов.

Чего таблица не показывает вовсе — насколько удобно с моделью работать изо дня в день. Бенчмарки меряют результат на задаче, а не то, сколько попыток ушло на формулировку запроса и как часто приходилось переспрашивать.
Сравнение Kimi K3 с конкурентами: важная оговорка
Перед вами таблица Moonshot о собственной разработке. Часть чисел конкурентов взята из внешних источников (Artificial Analysis и Vals AI), остальные Moonshot измерила сама. При этом новинку в ряде тестов гоняли в родной оболочке Kimi Code, а конкурентов — в чужих. Оболочка на результат влияет: на внутреннем тесте компании нейросеть даёт 72,9 в Kimi Code и 73,7 в Claude Code.
Разработчик здесь честнее многих: в анонсе прямо написано, что общая производительность всё ещё уступает Claude Fable 5 и GPT 5.6 Sol.
«Открытая модель» — что означает и чего не означает
Веса действительно выложены, под собственной лицензией Kimi K3 License. Обещание из анонса выполнено: Moonshot назвала срок «до 27 июля 2026 года», и на момент проверки 24 августа 2026 года файлы лежат в открытом доступе. Многие русскоязычные обзоры до сих пор пишут, что весов нет: те тексты созданы до выкладки и с тех пор не обновлялись.
Открытые веса означают, что нейросеть можно скачать и запустить у себя. Они не означают, что бесплатно и что доступно каждому.
Почему 1,4 терабайта весов не поместятся в домашний компьютер
Простая арифметика. Параметров 2,8 триллиона, хранятся они в формате MXFP4 — четыре бита на параметр. Перемножаем: около 1,4 терабайта только под веса, без служебной памяти под контекст диалога.

Порядок на два больше того, что стоит в обычном компьютере. Поэтому статьи вида «запускаем локально на 8 гигабайтах оперативной памяти» описывают что угодно, только не эту нейросеть: разрыв с реальным требованием примерно в 175 раз. Запустить Kimi K3 дома нельзя, и никакие настройки положения не изменят.
Отдельно скажем про обещания «сжатых» и «облегчённых» сборок. Уменьшенные версии больших моделей существуют, но это другие модели с другим качеством ответов, и называть их именем флагмана некорректно.
Кому открытые веса нужны на самом деле
Тем, у кого есть свой серверный контур: компаниям с требованиями к хранению данных, исследовательским командам, провайдерам вычислений. Moonshot рекомендует три движка инференса — vLLM, SGLang и TokenSpeed. Для остальных «открытость» — про цену и конкуренцию на рынке, а не про личный компьютер.
Ограничения, которые Moonshot признаёт сама
В анонсе есть раздел Limitations, и в русскоязычных обзорах он почти не встречается. Ниже три пункта в той формулировке, которую даёт сам разработчик.
Чувствительность к истории размышлений. Обучение шло в режиме, где собственные рассуждения нейросети сохраняются в диалоге. Если оболочка не возвращает их целиком или диалог переключают на новую модель посреди сессии, качество генерации становится нестабильным. Практический вывод: не меняйте модель в середине важного разговора.
Избыточная инициатива. Обучение шло на длинных сложных задачах, и при мелкой неоднозначности нейросеть склонна принимать решение за вас, а не переспрашивать. Лечится явными рамками в задании.
Разрыв в удобстве. Дословная формулировка Moonshot: заметный разрыв в пользовательском опыте по сравнению с Claude Fable 5 и GPT 5.6 Sol.
Сколько стоит Kimi K3
Два варианта оплаты дают две разные цены и два разных способа считать расход.
API Kimi K3: цена для разработчиков
Тарифы платформы Moonshot указаны в долларах за миллион токенов:
| Что | Цена за 1 млн токенов |
|---|---|
| Вход, попадание в кэш | $0,30 |
| Вход, без кэша | $3,00 |
| Выход | $15,00 |
Кэш здесь — повторно отправленный кусок контекста: если гонять один и тот же большой документ несколько раз, платформа берёт за него в десять раз меньше. Способы оплаты в открытой документации Moonshot не описаны, цены указаны только в долларах.
Доступ через chad: сколько искр уходит на слово
В chad нейросеть доступна наравне с остальными, а расход считается не в токенах, а в искрах — внутренней валюте сервиса. Искры списываются за введённый текст, сгенерированный ответ и контекст диалога.
На 24 августа 2026 года ставка составляет 3 искры за слово и 100 искр за распознавание одной картинки. Для сравнения по той же таблице: у Claude Opus 4.8 это 10 искр за слово и 1 400 за картинку, у Gemini 3.1 Pro — 13 искр за слово. По разбору изображений ставка одна из самых низких в сервисе.
Тарифы такие: Мини стоит 290 ₽ за 120 000 искр в месяц, Опти — 590 ₽ за 300 000 искр, Плюс — 1 690 ₽ за 900 000. Бизнес начинается от 5 000 ₽. Актуальные цифры стоит сверять на странице тарифов: и цены, и ставки моделей в искрах меняются.
Как пользоваться Kimi K3 в России
В чате
Самый короткий путь — открыть нейросеть в сервисе с российской оплатой и писать запросы привычным образом. Доступ к Kimi K3 в России есть на отдельной странице chad: без VPN и зарубежной карты. Там же можно попробовать модель на бесплатных ежедневных генерациях, прежде чем брать тариф.
Отдельного приложения под эту модель у Moonshot для российского рынка нет, поэтому вариантов ровно два: сервис-агрегатор или собственный доступ к платформе разработчика. Для большинства задач хватает первого.
Проверьте на своих задачах ровно две вещи: держит ли нейросеть длинный документ и насколько точно следует инструкции без лишней самодеятельности. Сильная и слабая стороны соответственно.
Через API
Для разработчиков есть текстовое API chad. Важная оговорка: формат запросов у него свой, поэтому инструкции для официальной платформы Moonshot напрямую не подойдут — параметры вроде глубины рассуждения и возврата истории размышлений относятся к ней, а не к нашему интерфейсу. Ориентируйтесь на документацию того сервиса, через который работаете.
Kimi K3 против ChatGPT, Claude и DeepSeek: что брать под задачу
Универсальной нейросети нет — вывод не из вежливости, а из таблицы бенчмарков выше. Kimi K3 против закрытых флагманов выигрывает выборочно, и выбирать разумнее под сценарий.
| Задача | Что разумно взять |
|---|---|
| Длинный документ целиком: договор, отчёт, исследование | Kimi K3: миллион токенов контекста и лучший результат по разбору документов |
| Многочасовая работа над кодом с минимальным контролем | Kimi K3 или Claude |
| Одиночная сложная задача по коду | Claude: на FrontierSWE разрыв в его пользу |
| Быстрые повседневные запросы, письма, идеи | ChatGPT или модели полегче: рассуждение включено всегда, а значит дороже и медленнее |
| Дешёвый разбор большого числа картинок | Kimi K3: 100 искр за изображение |
| Задачи на русском без доступа к зарубежным сервисам | любой сервис-агрегатор, см. обзор аналогов DeepSeek |
Правила для промтов
Рассуждение включено всегда, поэтому короткая расплывчатая формулировка обойдётся дороже, чем у обычного чат-бота: нейросеть потратит размышление на угадывание вашего намерения. Отсюда три практических правила, которые экономят и время, и деньги.
Ставьте явные рамки. Избыточная инициатива — официально признанное свойство. Пишите не «улучши текст», а «перепиши второй абзац, не трогая соседние, сохрани термины и длину». Чем меньше пространства для домысливания, тем предсказуемее результат.
Ещё один приём для экономии: формулируйте задачу один раз и подробно, вместо серии уточняющих реплик. Каждая новая реплика тянет за собой весь предыдущий диалог, и расход растёт быстрее, чем кажется.
Отдавайте документ целиком. Не пересказывайте содержимое своими словами и не режьте файл на куски — контекста хватит. Работа по полному тексту выходит лучше, чем по вашей выжимке.
Не переключайте модель посреди диалога. Начали разбирать договор в одной — доводите до конца в ней же. Перенос длинной сессии ломает режим сохранённых рассуждений и роняет качество.
Частые вопросы
Kimi K3 бесплатная?
Открытая, но не бесплатная. Веса выложены под лицензией, а использование через официальную платформу оплачивается по числу токенов, через сервисы-агрегаторы — по их тарифам. Бесплатны только пробные лимиты: в chad ежедневные бесплатные генерации.
Понимает ли Kimi K3 русский язык?
Да, нейросеть многоязычная и отвечает по-русски. При этом русский текст занимает больше токенов, чем английский того же смысла, — на длинных документах разница заметна по расходу.
Чем Kimi K3 отличается от Kimi Code?
Kimi K3 это сама нейросеть. Kimi Code — терминальная оболочка Moonshot для разработчиков, внутри которой модель работает с файлами проекта. Вещи разные: нейросеть доступна во многих сервисах, а оболочка живёт отдельным инструментом.
Можно ли скачать Kimi K3?
Формально да, веса открыты. Практически для домашнего компьютера бессмысленно: около 1,4 терабайта только под веса. Скачивание оправдано, если есть серверные мощности и один из поддерживаемых движков инференса.
Что будет со статьёй, когда выйдет K4?
Написанное относится к состоянию на 24 августа 2026 года. Ниша обновляется быстро: за месяц до публикации актуальной была Kimi K2, а спрос на неё уже почти исчез. Характеристики и цены перед решением сверяйте с первоисточниками, ссылки на которые приведены ниже.