K2 → K3

Версии Kimi: от K2 до K3

Шесть моделей за тринадцать месяцев, три поколения архитектуры и одна смена лицензии. Что менялось от версии к версии и какую стоит брать сейчас.

Линейка Kimi по датам

За тринадцать месяцев Moonshot выпустила шесть заметных моделей. Даты ниже — день, когда репозиторий с весами появился на HuggingFace: это самая проверяемая точка отсчёта, задним числом её не поставить.

МодельВеса на HFПараметровКонтекстЛицензия
Kimi K211.07.20251,03 трлнModified MIT
Kimi K2 Thinking04.11.20251,06 трлнModified MIT
Kimi K2.501.01.20261,03 трлнModified MIT
Kimi K2.614.04.20261,03 трлн262 144Modified MIT
Kimi K2.7 Code11.06.20261,03 трлн262 144Modified MIT
Kimi K327.07.20262,8 трлн1 048 576Kimi K3 License

Видно две вещи. Во-первых, размер держался на отметке около триллиона параметров ровно год и подскочил втрое только на K3. Во-вторых, K3 стала первой моделью линейки, которая вышла не под Modified MIT, а под собственной лицензией.

K2 и K2 Thinking — фундамент

Kimi K2 (июль 2025) — модель, с которой Moonshot вошла в число вендоров, выкладывающих открытые веса на уровне фронтира. Архитектура MoE, около триллиона параметров, ориентация на инструментальные вызовы и агентские сценарии.

K2 Thinking (ноябрь 2025) — версия с явной цепочкой рассуждений. Это был отдельный релиз, а не режим: у моделей того поколения «думающий» вариант существовал файлом. Начиная с K2.5 рассуждения стали переключаемым режимом внутри одной модели, а в K3 рассуждение включено всегда и отключить его нельзя.

K2.5 и K2.6 — рабочие лошадки

К K2.5 (январь 2026) в линейке появилось понимание изображений и переключаемый режим рассуждения — в списке моделей API у неё указано и то, и другое. K2.6 (апрель 2026) — продолжение той же линии с упором на стабильность в длинных задачах: следование инструкциям на длинном контексте, самопроверка, устойчивая работа агента.

K2.6 важна не как флагман, а как бесплатная модель. Разработчик прямо пишет: K2.6, вызванная из чата, бесплатна и не тратит кредиты подписки. То есть человек без подписки пользуется именно ей, а не K3. Подробности того, как это работает с кредитами, — на странице про подписку.

В API K2.6 остаётся самой дешёвой из актуальных: 262 144 токена контекста, текст, изображения и видео на вход, два режима рассуждения. K2.5 после запуска K3 новым пользователям платформы уже не выдаётся.

K2.7 Code — модель под код

Kimi K2.7 Code (июнь 2026) — специализированная модель для программирования, построенная на базе K2.6. MoE на триллион параметров с 32 млрд активных, 384 эксперта, 8 на токен, 61 слой, отдельный визуальный энкодер на 400 млн параметров. Контекст 256k. Режим рассуждений включён по умолчанию, поддерживается сохранение цепочки рассуждений между ходами диалога.

У неё есть высокоскоростной вариант kimi-k2.7-code-highspeed — та же модель, но с выдачей около 180 токенов в секунду и до 260 на коротком контексте, вдвое дороже. Это осмысленный выбор, когда агент делает много мелких шагов и важна не глубина, а темп.

После выхода K3 K2.7 Code никуда не делась и не устарела: она вчетверо дешевле флагмана на выходе и заметно быстрее. В Kimi Code она стоит моделью по умолчанию, а K3 подключается на тарифе Moderato и выше.

K3 — смена поколения

Kimi K3 (16 июля 2026, веса 27 июля) — первая модель линейки, где поменялась несущая конструкция: механизм внимания Kimi Delta Attention на 69 слоях из 93, Attention Residuals и разрежённость 16 экспертов из 896. Итог — 2,8 трлн параметров, 104 млрд активных, контекст ровно миллион токенов и постоянно включённое рассуждение с уровнями low, high и max.

Что это меняет на практике. Контекст вырос вчетверо — в него помещается репозиторий среднего размера или несколько сотен страниц документов целиком. Модель нативно видит изображения, а значит может работать с интерфейсом по скриншотам. И она рассчитана на многочасовые сессии без человека — вендор отдельно подчёркивает сценарии вроде оптимизации GPU-ядер и разработки компилятора.

Расплата — скорость и цена. По независимым замерам K3 выдаёт порядка 32 токенов в секунду против сотен у более лёгких моделей, а выход стоит $15 за миллион токенов — почти вчетверо дороже K2.7 Code. Полная спецификация — на главной странице.

Kimi Linear — отдельная ветка

Помимо больших K-моделей у Moonshot есть Kimi Linear — небольшая модель на 48 млрд параметров (веса на HuggingFace с 30 октября 2025 года, лицензия MIT). Это исследовательская линия про эффективное внимание, а не уменьшенная копия флагмана, и в продуктах Kimi она не используется. Путать её с K-линейкой не стоит: разные задачи и разный статус.

Названия, которых не существует

Поиск постоянно приносит запросы про версии, которых нет. Чтобы не тратить время:

Ещё одна регулярная путаница — Moonshot V1. Это первое поколение API-моделей компании, оно снимается с платформы 31 августа 2026 года. Если вы видите в чужой инструкции moonshot-v1-8k или moonshot-v1-128k, инструкция устарела; актуальные имена моделей — на странице про API.

Частые вопросы

Какая последняя версия Kimi?

Kimi K3, анонсирована 16 июля 2026 года, веса опубликованы 27 июля. Для кода отдельно существует Kimi K2.7 Code, она свежая и не считается устаревшей.

Чем Kimi K3 отличается от K2.7 Code?

K3 — универсальный флагман: 2,8 трлн параметров, контекст 1M, всегда включённое рассуждение. K2.7 Code — специализированная модель для программирования: триллион параметров, контекст 256k, вчетверо дешевле на выходе и заметно быстрее.

Существует ли Kimi K4?

Нет. На август 2026 года старшая модель линейки — K3. Анонсов следующего поколения не было.

Какую версию Kimi выбрать?

Для длинных задач, работы с изображениями и большого контекста — K3. Для потока мелких правок в коде — K2.7 Code или её высокоскоростной вариант. Для бесплатного чата выбор сделан за вас: там работает K2.6.

Что стало с Moonshot V1?

Первое поколение API-моделей отключается 31 августа 2026 года и новым пользователям платформы уже не выдаётся. Мигрировать нужно на kimi-k3, kimi-k2.7-code или kimi-k2.6.

Китайские языковые модели: кто есть кто →Kimi, Qwen, DeepSeek, GLM и остальные разработчики из КНР в одном списке.