Telegram AI Assistant Search

Kimi K3

16 июля Moonshot AI выпустила Kimi K3 — модель на 2,8 триллиона параметров, которую компания называет «крупнейшей открытой в мире». Разбираем архитектуру, бенчмарки, цены и главное для нас: как получить доступ из России и можно ли поставить модель локально.

5.0
Автор: Филипп Неваленов 24.07.2026
time 5 мин views 193

Moonshot Kimi K3

Полтора года назад Moonshot AI выглядела компанией, которую переехал каток по имени DeepSeek: китайский стартап с сильной технологией и стремительно тающей долей рынка. Kimi K3, представленная 16 июля 2026 года, — неожиданный и очень громкий камбэк. Модель на 2,8 триллиона параметров дебютировала на первом месте в слепом рейтинге фронтенд-кода LMArena, обойдя Claude Fable 5, и вошла в тройку сильнейших по офисным задачам. Релиз подгадали к Всемирной конференции по искусственному интеллекту в Шанхае — и не просчитались: новинка «бахнула».

Разбираем по порядку: что внутри, насколько K3 действительно хороша, сколько стоит и что с ней делать пользователю из России.

Что такое модель Kimi K3

Технически в основе K3 лежит разреженная MoE-архитектура — «смесь экспертов». Из 2,8 триллиона параметров при обработке каждого токена активируется лишь малая часть, в каждый конкретный момент работает не более 16 экспертов из 896. Такой подход типичен для большинства современных больших моделей. Главный его выигрыш — объем знаний растет, а стоимость вычислений остается вменяемой, потому что вся махина целиком никогда не работает одновременно.

Что это дает на практике:

  • Контекст в 1 048 576 токенов. Миллион токенов — это примерно полторы тысячи страниц текста за один заход. В памяти чата уместится кодовая база среднего проекта, годовой архив переписки или несколько книг целиком.
  • Нативная мультимодальность. Модель принимает изображения на вход без внешних костылей — читает схемы, скриншоты интерфейсов, графики и документы со сканами.
  • Агентные сценарии. Вызов внешних инструментов, режим рассуждений и структурированный вывод — то, на чем строятся автономные помощники и код-агенты. Модель может сутками работать без участия человека и выдавать результат на уровне мировых топов.
  • Собственная среда для кода. Kimi Code — оболочка с доступом через командную строку, ориентированная на работу с репозиториями. В сочетании с продвинутым ИИ — отличный инструмент для разработки игр и приложений.

Инфографика с описанием возможностей китайской нейросети Kimi K3: создание игр, написание кода, понимание медиа, генерация изображений, работа с документами, анализ данных, агентные возможности, многоязычность и решение сложных задач.

Kimi K3 Max: а был ли мальчик?

В обзорах и бенчмарках регулярно мелькает Kimi K3 Max, что это вызывает путаницу. Уточняем: отдельной модели с таким именем нет. «Max» означает максимальный уровень рассуждений: параметр reasoning_effort, выставленный на предельное значение. В этом режиме ИИ думает дольше и тратит заметно больше выходных токенов, зато точнее решает сложные многоходовые задачи.

Так же маркируются и конкуренты в сравнительных таблицах — Claude Fable 5 Max, GPT-5.6 Sol Max.

В потребительском приложении Kimi режим Max доступен бесплатно в рамках стандартных лимитов, а в API за него платят объемом сгенерированных токенов.

Сравнение с предыдущей версией

Инфографика сравнения моделей нейросетей Kimi K3 и Kimi K2.6 по ключевым бенчмаркам с описанием их преимуществ и результатов тестирования.

Прошлое поколение, Kimi K2.6, было крепкой рабочей моделью с упором на длинный контекст и параллельных суб-агентов. Но K3 стал «квантовым скачком» в развитии линейки. Это не итерация, а смена весовой категории:

Параметр Kimi K2.6 Kimi K3
Параметров всего около 1 трлн 2,8 трлн
Архитектура MoE предыдущего поколения разреженная MoE, 16 экспертов из 896
Контекст 256 тыс. токенов 1 048 576 токенов
Мультимодальность ограниченная нативная работа с изображениями
Цена выхода за 1 млн заметно ниже 15 $
Frontend Code (LMArena) 18-е место 1-е место

Самая наглядная цифра здесь — прыжок в рейтинге фронтенд-кода: с восемнадцатого места на первое. Надо иметь в виду, что рейтинги LMArena оценивают не лабораторный бенчмарк. Там считаются слепые парные сравнения, проводимые людьми. Разработчики выбирают лучший результат, не зная, какая модель его выдала.

Обратная сторона прогресса тоже есть, и о ней стоит сказать прямо: выходные токены у K3 стоят более чем втрое дороже, чем у K2.6. Для многих задач предыдущее поколение остается разумнее по экономике.

Kimi K3 benchmark: цифры и что за ними стоит

Главный публичный ориентир — GDPval-AA v2, тест на реальных рабочих задачах из 44 профессий и 9 отраслей. Результаты по независимой оценке аналитической фирмы Artificial Analysis:

Модель GDPval-AA v2 Комментарий
Claude Fable 5 Max 1815 лидер рейтинга
GPT-5.6 Sol Max 1747,8 второе место
Kimi K3 1687 третье место, лучший результат среди открытых
Claude Opus 4.8 1600 K3 опережает

Добавим, что на AA-Briefcase, закрытом агентном тесте на длинных задачах интеллектуального труда, модель Kimi K3 заняла второе место, уступив лишь Fable 5.

Теперь — важная оговорка (у нас все-таки обзор, а не реклама, хотя K3 нам понравилась). Полный технический отчет на момент публикации еще не вышел. Значительная часть заявленных цифр опирается на замеры самой Moonshot, а независимые проверки только начинаются.

Сравнение с другими флагманами

Инфографика сравнивает флагманскую модель Kimi K3 с мировыми моделями ИИ по ключевым бенчмаркам на июль 2026 года.

За вычетом эмоций пресс-релиза, расстановка сил выглядит так.

  • По совокупному интеллекту в рабочих задачах K3 уступает Claude Fable 5 Max и GPT-5.6 Sol Max, но опережает Claude Opus 4.8 — то есть уверенно держится в первой тройке. В отдельных нишах она лидирует: фронтенд-код и работа с длинными документами.
  • Экономика тоже складывается в ее пользу. Запросы «kimi k3 free» в момент релиза были самыми популярными в поисковиках. Цена K3 соответствует уровню моделей класса Sonnet и заметно ниже Opus 4.8, а по стоимости выходных токенов примерно вдвое дешевле GPT-5.6 Sol.
  • Отдельное преимущество — единый тариф на всем окне в миллион токенов. Конкуренты нередко берут наценку за длинные промпты. Здесь ее нет.

Правда, есть подвох: в режиме максимальных рассуждений модель генерирует столько токенов, что ценовое превосходство может испариться. Считать нужно не по прайсу, а по итоговому чеку за типовую задачу.

Kimi K3 цена и подписка

Тарификация разделена на потребительскую и разработческую части — и первая приятно удивляет.

Тип доступа Стоимость Что входит
Чат на kimi.com и в приложении бесплатно K3 и K3 Max в рамках стандартных лимитов
Пакеты кредитов от 199 ¥ (около 28 $) снятие лимитов, приоритет в очереди, Kimi Code
API — вход (без кэша) 3 $ за 1 млн токенов единая цена на всём окне в 1 млн
API — вход (кэш) 0,30 $ за 1 млн токенов в десять раз дешевле при стабильном промпте
API — выход 15 $ за 1 млн токенов уровень Sonnet, дешевле Opus 4.8

Да, можно гонять Kimi K3 бесплатно. Базовый чат с моделью, включая режим Max, доступен по бесплатному аккаунту — с ограничениями по числу запросов в сутки, урезанным контекстом и без приоритета в очереди. Для эпизодических задач этого достаточно.

Отдельно стоит отметить кэширование. Повторно отправляемые фрагменты промта стоят в десять раз дешевле. Вы знали, что чем длиннее чат с моделью, чем больше токенов он сжирает? В Kimi K3 удорожание получилось самое маленькое на рынке. Это радикально меняет экономику, например, для агентных сценариев со стабильной системной инструкцией и большими неизменными документами.

Можно ли Kimi K3 скачать на локалку?

Самый интересный сюжет релиза — и самый неоднозначный. На момент подготовки этого обзора веса Kimi K3 еще не опубликованы, поэтому аналитики Artificial Analysis формально классифицируют модель как проприетарную.

Moonshot, однако, называет K3 открытой моделью и обещает выложить полные веса 27 июля 2026 года. Если вы читаете эту статью из будущего — проверьте, вдруг файлы уже доступны для скачивания.

Но допустим, веса выложат. Получится ли Kimi K3 скачать, например, на домашний компьютер?

Увы, нет. Для развертывания Moonshot рекомендует супернод не менее чем из 64 ускорителей — такого не потянет никакой ПК даже с топовой видеокартой. Понадобится стойка в дата-центре.

Практический смысл открытых весов здесь другой: их смогут поднять облачные провайдеры, исследователи и крупные компании с собственной инфраструктурой. А обычный пользователь получит выгоду опосредованно — через удешевление доступа у сторонних сервисов и возможность независимой проверки заявленных характеристик.

Если хочется именно локальной модели на своем железе, смотреть нужно в сторону компактных open-weight решений — Qwen, GLM или младших версий DeepSeek, которые запускаются через Ollama или LM Studio на обычном ноутбуке.

Доступ в России

Здесь ситуация двойственная. Формально сайт kimi.com для нас не заблокирован. Но работает он через Cloudflare и из России грузится нестабильно — от полной недоступности до вечно крутящегося интерфейса. Регистрация ограничена по географии, а главное — подписку не оплатить: платежная система Moonshot отклоняет карты российских банков.

Рабочее решение — российские агрегаторы, которые держат доступ к модели у себя и продают его за рубли. До сих пор Kimi не была популярна на отечественных платформах. Но хайп вокруг модели может изменить это отношение. На момент написания обзора Kimi K3 уже есть на сервисах FICHI AI и GPTunnel.

Русский язык модель поддерживает и на входе, и на выходе, хотя для сложных стилистических задач рекомендуем все-таки DeepSeek.

Kimi K3: есть ли цензура?

Еще один нюанс, о котором стоит знать: данные обрабатываются в китайской юрисдикции. Ответы на чувствительные для КНР политические темы цензурируются.

Но в целом, по отзывам, цензуры в K3 меньше, чем у американских флагманов. Однако некоторые «острые» темы, например, связанные с педофилией, модель обсуждать отказывается.

Плюсы
  • + Первое место в слепом рейтинге фронтенд-кода — выше Claude Fable 5.
  • + Контекст в миллион токенов с единой ценой на всем окне, без наценки за длину.
  • + Третье место по офисным задачам, впереди Claude Opus 4.8 при вдвое меньшей цене.
  • + Нативная мультимодальность и зрелые агентные возможности.
  • + Кэширование входных токенов в десять раз дешевле — сильно экономит в агентных сценариях.
  • + Меньше цензуры, чем в западных нейросетях.
Минусы
  • - Открытые веса на момент публикации обещаны, но не выложены.
  • - Локальный запуск требует не менее 64 ускорителей — для частного пользователя недостижимо.
  • - Выходные токены дороже более чем втрое по сравнению с K2.6.
  • - Прямой доступ из России нестабилен, оплата российскими картами невозможна.

Вывод

Kimi K3 — еще не победа китайского ИИ над западными флагманами. Но заявка мощная: впервые открытая модель подошла к переднему краю на расстояние вытянутой руки. Отставание от лидеров измеряется уже не поколениями, а месяцами.

Это меняет расстановку сил на рынке сильнее, чем любое первое место в отдельном рейтинге.

Кому рекомендуем? Если пишете фронтенд или работаете с очень длинными документами — пробуйте K3 прямо сейчас, у нее здесь объективное преимущество при разумной цене.

Если задачи повседневные, присмотритесь к K2.6 или DeepSeek. Они дешевле, а разницу в качестве ответов вы вряд ли заметите.

Часто задаваемые вопросы

Можно ли пользоваться Kimi K3 бесплатно? Toggle
Да, базовый чат с моделью доступен по бесплатному аккаунту на kimi.com и в приложении, включая режим Max.
Что такое Kimi K3 Max? Toggle
Не отдельная модель, а режим максимальных рассуждений: параметр reasoning_effort на предельном значении. Модель думает дольше и тратит больше токенов, но точнее решает сложные задачи.
Можно ли скачать Kimi K3 и запустить локально? Toggle
Веса обещаны к публикации 27 июля 2026 года. Но даже после выхода локальный запуск на домашнем компьютере не будет возможен — понадобится дата-центр.
Как получить доступ из России? Toggle
Прямой доступ нестабилен, а карты РФ не принимаются. Рабочий путь — российские агрегаторы с оплатой в рублях.
Kimi K3 лучше, чем Claude или GPT? Toggle
В отдельных нишах — да: она лидирует по фронтенд-коду. По совокупным рабочим задачам уступает Claude Fable 5 Max и GPT-5.6 Sol Max, но опережает Opus 4.8 при вдвое меньшей цене.

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *

AI AI Ассистент
Чем могу помочь?
Telegram канал AIMarketCap