Kimi K3 от Moonshot AI: 2,8 трлн параметров, открытые веса и доступ из России

Moonshot AI выпустила Kimi K3 16 июля 2026 года, а 27 июля открыла её веса. Это самая большая модель с открытыми весами в истории: 2,8 трлн параметров, миллион токенов контекста и встроенное зрение.

История как у DeepSeek полтора года назад, только крупнее — и с теми же последствиями для цен на рынке.

Kimi K3 от Moonshot AI: 2,8 трлн параметров, открытые веса и доступ из России
Дмитрий Борейчук
Автор
Дмитрий Борейчук
• 13 лет опыта в маркетинге и продажах • Более 1000 проектов • Основатель портала Wake up Marketing • Практикует маркетинг и внедрение ИИ в бизнес клиентов
Страница автора
💡 Хотите прокачаться в ИИ и маркетинге?
Подпишитесь на Telegram-канал Дмитрия: дневник развития портала Wake up Marketing, билдера сайтов и приложений в Ноя и маркетплейса шаблонов. Плюс выжимка 13 лет опыта в суровом маркетинге и плоды 2 лет работы с ИИ 24/7
Перейти в Telegram-канал

Что такое Kimi K3 и почему это важно

Kimi K3 — модель китайской компании Moonshot AI, вышедшая 16 июля 2026 года. Через одиннадцать дней, 27 июля, компания выложила её веса в открытый доступ.

История знакомая: полтора года назад ровно так же выстрелил DeepSeek — китайский стартап показал результат уровня западных флагманов и раздал модель бесплатно. Теперь то же самое, но крупнее: K3 — самая большая модель с открытыми весами в истории.

Для рынка это значит две вещи. Первая: разрыв между закрытыми и открытыми моделями продолжает сокращаться. Вторая: цены у всех остальных снова придётся пересматривать.

🇨🇳

Коротко: 2,8 трлн параметров, контекст 1 млн токенов, встроенное зрение, открытые веса. По общему индексу — четвёртое место в мире и первое среди открытых моделей.


2,8 триллиона параметров — и почему это не то, что вы подумали

Цифра «2,8 триллиона» звучит пугающе, но работает модель иначе, чем кажется.

K3 построена на архитектуре Mixture of Experts — «смесь экспертов». Внутри неё 896 экспертных блоков, но на каждый токен включаются только 16 из них. Из 2,8 трлн параметров в работе одновременно участвуют около 50 миллиардов.

Аналогия простая: это не один гигантский специалист, который знает всё, а большой институт, где на каждый вопрос вызывают тех нескольких сотрудников, кто в теме. Институт огромный, но зарплату за конкретную задачу платите шестнадцати людям, а не всем.

Что это даёт на практике:

  • знаний больше, потому что суммарный объём модели гигантский;
  • скорость и цена приемлемые, потому что считается только активная часть;
  • специализация лучше — разные эксперты отвечают за разные типы задач.

Эта же архитектура лежит в основе большинства современных больших моделей — подробнее про устройство и различия в разборе открытых нейросетей.


Российский сервис, без VPN
Сделайте сайт и ИИ-агента в одном окне — за вечер, а не за месяц
  • Сайт собирается диалогом: описали идею — смотрите, как он рождается
  • ИИ-сотрудник отвечает клиентам в Telegram, WhatsApp, Avito и на сайте
  • Без VPN и иностранных карт — оплата в рублях
Попробовать Ною
7 дней бесплатного пробного периода — платить не обязательно

Открытые веса: что это меняет

27 июля Moonshot AI выложила веса модели. Формально это означает: любой может скачать её и запустить у себя.

Практический смысл для бизнеса:

Что даётПочему это важно
Данные не уходят наружувсё считается на вашем сервере — критично для медицины, финансов, юристов
Нет зависимости от вендоракомпания не может поднять цену, изменить условия или закрыть доступ
Можно дообучить под себямодель настраивается на вашу предметную область
Цена предсказуемавы платите за железо, а не за токены

Оборотная сторона — железо, и она серьёзная. Об этом ниже честно.


Что показывают тесты

ТестРезультат Kimi K3
Artificial Analysis (общий индекс)57 баллов — 4-е место в мире
Среди открытых моделей1-е место: GLM-5.2 — 51, DeepSeek V4 Pro — 44
Frontend Code Arena1-е место, 76% побед над Claude Fable 5
GDPval v2 (рейтинг Elo)рост с 1190 у K2.6 до 1668

Что из этого стоит выделить:

  • Первое место среди открытых моделей с большим отрывом. Тринадцать баллов индекса над DeepSeek V4 Pro — это не погрешность, а другой класс.
  • Frontend Code Arena — самый неожиданный результат: 76% побед над Claude Fable 5 в задачах фронтенда. Для модели с открытыми весами это очень сильно.
  • Рост Elo с 1190 до 1668 между поколениями — скачок, а не шаг.

Четвёртое место в общем зачёте означает: до самых сильных закрытых моделей K3 не дотягивает. Но разрыв уже такой, что для большинства рабочих задач его не заметно.


Миллион токенов и встроенное зрение

Контекст — 1 млн токенов. Это примерно 700 тысяч слов: длинный договор, годовой отчёт или целая база документов помещаются в один запрос.

Зрение встроено в саму модель, а не приделано отдельным модулем. K3 принимает текст и изображения, а продукты Kimi работают ещё с видео и файлами. Разница между встроенной и приделанной мультимодальностью заметна на практике: модель понимает картинку в контексте текста, а не описывает её отдельно.

Что это даёт в работе: разбор сканов документов, анализ скриншотов интерфейса, чтение таблиц с картинки, проверка макетов — без дополнительных инструментов в цепочке.


Сколько стоит и где запускать

Официальный API Moonshot AI:

ЧтоЦена за 1 млн токенов
Вход$3
Выход$15
Кэшированный вход$0,30

Кэшированный вход по 30 центов — важная деталь для тех, кто гоняет один и тот же большой контекст: база знаний загружается один раз, дальше платится десятая часть.

Модель доступна в продуктах Kimi, Kimi Work, Kimi Code и через API. Хостинг у сторонних провайдеров: Together AI, Fireworks, DigitalOcean, Nebius, Baseten, Modal.

Для сравнения: Claude Opus 5 стоит $5/$25, GPT-5.6 Sol — $5/$30. То есть K3 примерно на 40% дешевле флагманов при четвёртом месте в общем зачёте.


Можно ли поднять у себя: честный ответ про железо

Открытые веса не означают «запущу на своём компьютере». Цифры отрезвляют:

🔴 Веса занимают около 1,4 ТБ даже в сжатом формате MXFP4. Это не помещается ни в одну потребительскую видеокарту и ни в какую разумную рабочую станцию.

Для запуска нужна серверная конфигурация с несколькими профессиональными ускорителями. Реалистично это для компании с собственной инфраструктурой или для тех, кому критична полная изоляция данных.

Всем остальным доступ через API или готовые платформы обойдётся кратно дешевле, чем содержание такого сервера. Открытость здесь важна не тем, что каждый поднимет модель дома, а тем, что никто не может отобрать доступ или в одностороннем порядке поменять правила.


Как получить доступ из России

Тут ситуация сложнее, чем с западными моделями, и я скажу как есть.

Что не работает

Интерфейс kimi.com из России грузится нестабильно — часто не полностью. Российская карта напрямую обычно не проходит. Для стабильной работы официального сайта нужен зарубежный IP.

Что работает

1. Российские сервисы-посредники. Дают доступ к K3 через OpenAI-совместимый API с оплатой рублями, без VPN. Самый практичный путь, если нужен именно API.

2. Платформы-агрегаторы. Несколько российских сервисов подключили Kimi у себя: работает без VPN, оплата картами российских банков.

3. Иностранная карта или зарубежный баланс App Store / Google Play — для подписки на сам сервис Kimi.

⚠️

В Ноя модели Kimi сейчас нет. Там доступны GPT-5.6 Sol/Terra/Luna, Claude Sonnet 5 и 4.6, Gemini 3.5 Flash, DeepSeek V4 Flash и Pro, Qwen3.7 Plus. Если задача — собрать рабочего ИИ-агента, а не поэкспериментировать с конкретной моделью, стоит смотреть на то, что уже подключено: разбор набора в обзоре платформы.


Kimi K3 против DeepSeek и других открытых моделей

МодельИндексОсобенность
Kimi K357самая большая открытая, встроенное зрение, 1 млн контекста
GLM-5.251компактнее, дешевле в хостинге
DeepSeek V4 Pro44зрелая экосистема, много готовых интеграций
Gemma 4 от Googleлегче поднимается, скромнее по возможностям

K3 сейчас уверенно первая среди открытых. Но у DeepSeek остаётся своё преимущество: экосистема, готовые интеграции и версия V4-Flash с очень агрессивной ценой. А Gemma 4 от Google выигрывает там, где важно поднять модель на скромном железе.

Выбор зависит не от места в рейтинге, а от того, что вы можете себе позволить обслуживать.


Кому подходит, а кому не нужен

Стоит присмотреться, если:

  • данные нельзя выпускать за периметр компании — медицина, финансы, юридические документы;
  • нужен очень длинный контекст: договоры, отчёты, большие базы;
  • в задачах много картинок и сканов — встроенное зрение тут выигрывает;
  • есть своя серверная инфраструктура и желание не зависеть от вендора.

Не нужен, если:

  • вы собираете ИИ-агента для мессенджеров — проще взять то, что уже подключено в готовой платформе;
  • нет своей инфраструктуры, а через API дешевле и проще взять модель с русской поддержкой;
  • задачи массовые и простые — там выигрывают лёгкие модели вроде GPT-5.6 Luna или DeepSeek V4 Flash.


FAQ

Когда вышла Kimi K3?

16 июля 2026 года, а 27 июля Moonshot AI открыла её веса — модель можно скачать и запустить у себя.

Что значит «2,8 триллиона параметров»?

Это общий размер модели. Но архитектура MoE включает на каждый запрос только 16 экспертных блоков из 896 — активно работают около 50 млрд параметров. То есть знаний много, а считается только нужная часть.

Kimi K3 сильнее DeepSeek?

По общему индексу — да, на 13 баллов выше DeepSeek V4 Pro и первая среди открытых моделей. Но у DeepSeek зрелее экосистема и есть очень дешёвая версия V4-Flash для массовых задач.

Можно ли запустить Kimi K3 на своём компьютере?

Нет. Веса занимают около 1,4 ТБ даже в сжатом виде — нужна серверная конфигурация с несколькими профессиональными ускорителями. Для большинства практичнее API.

Сколько стоит Kimi K3?

$3 за миллион входных токенов и $15 за выходные. Кэшированный вход — $0,30, что важно при работе с большой неизменной базой знаний.

Работает ли Kimi из России?

Официальный сайт грузится нестабильно, российская карта напрямую обычно не проходит. Работают сервисы-посредники с оплатой рублями и без VPN, а также российские платформы-агрегаторы, где Kimi подключена.

Есть ли Kimi в Ноя?

Нет. В Ноя доступны GPT-5.6 Sol/Terra/Luna, Claude Sonnet 5 и 4.6, Gemini 3.5 Flash, DeepSeek V4 Flash и Pro, Qwen3.7 Plus.


Вывод

Kimi K3 — самая большая модель с открытыми весами на сегодня и первая среди открытых по качеству. Для рынка это очередной удар по разрыву между «платными закрытыми» и «бесплатными открытыми»: разница осталась, но для большинства рабочих задач она уже не решающая.

Практический вывод для бизнеса скромнее, чем заголовки. Поднять K3 у себя может далеко не каждый — 1,4 ТБ весов требуют серверной стойки. Зато открытость даёт то, чего не даёт ни одна закрытая модель: гарантию, что доступ не отберут и правила не поменяют в одностороннем порядке.

А если задача не «пощупать самую большую модель», а собрать работающего ИИ-сотрудника — смотрите на то, что уже подключено и работает из России без плясок с VPN. Разбор такого набора — в обзоре платформы Ноя, где модель выбирается в настройках агента одним кликом.

Способ зарабатывать на ИИ
Зарабатывайте на создании сайтов и ИИ-агентов
  • Собираете клиенту сайт и ИИ-продавца за вечер вместо недель разработки
  • Конструктор сайтов и ИИ-сотрудники — в одном российском сервисе
  • Бонус 1 000 ₽ при регистрации по этой ссылке вместо обычных 500 ₽
Начать бесплатно
Регистрация занимает минуту, без VPN и иностранных карт

💬 Комментарии

Пока никто не написал. Будьте первым: расскажите, что оказалось полезным, а чего не хватило.
Ссылки в комментариях не публикуются.

🍋Ещё статьи в категории «Нейросети: обзоры и сравнения»

В категорию
Leonardo AI: что это за сервис, сколько стоят токены и картинки с видео и как обстоит дело с доступом из России
16.09.2026#Нейросети: обзоры и сравнения
Leonardo AI: что это за сервис, сколько стоят токены и картинки с видео и как обстоит дело с доступом из России
Leonardo AI это рабочее место для серийного визуала: своя обученная модель, сценарии в одну кнопку, холст, апскейл и видео, а сверху два десятка чужих моделей от GPT Image до Veo. Essential стоит 1 011 рублей в месяц, но расход токенов на картинку сервис не печатает: его нужно снять с кнопки до оплаты.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Mistral AI: что это за нейросеть, сколько стоит Vibe и API и как работает из России
14.09.2026#Нейросети: обзоры и сравнения
Mistral AI: что это за нейросеть, сколько стоит Vibe и API и как работает из России
Mistral это французская нейросеть, чат которой открывается из России без VPN: я снял коды ответов с российского и зарубежного адресов, они совпадают. Модели выложены с открытыми весами, ответ агента по API обходится в 5–15 копеек, а чат с 12 августа называется Vibe вместо Le Chat.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Gamma: что это за нейросеть для презентаций, сколько стоит и как ей пользоваться из России
07.09.2026#Нейросети: обзоры и сравнения
Gamma: что это за нейросеть для презентаций, сколько стоит и как ей пользоваться из России
Gamma собирает презентацию, документ или сайт из одной вашей мысли: вы даёте тему или план, а сервис возвращает готовый материал с версткой и картинками. Внутри работают Claude, ChatGPT, Gemini и модели для изображений, а платите вы кредитами, которые тратятся за каждую карточку и каждый кадр.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Stable Diffusion: что это, где запустить из России и сколько стоит — наш замер и срез 1200 моделей
04.09.2026#Нейросети: обзоры и сравнения
Stable Diffusion: что это, где запустить из России и сколько стоит — наш замер и срез 1200 моделей
Прогнали 4 сентября 2026 одну задачу через четыре модели, выгрузили 1200 самых скачиваемых сборок с Civitai и посчитали, во сколько обходится картинка. Главная находка: сообщество до сих пор работает на версии 2022 года — 500 сборок из 1200 построены на ней.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
Нейросеть бесплатно: что реально работает в России — наш замер шести моделей и бесплатный доступ на год от Сбера
03.09.2026#Нейросети: обзоры и сравнения
Нейросеть бесплатно: что реально работает в России — наш замер шести моделей и бесплатный доступ на год от Сбера
Проверили 3 сентября 2026, какие нейросети открываются из России без VPN, и прогнали четыре деловые задачи через пять бесплатных моделей. Ответили две из пяти — зато посчитали финансы правильно. Плюс главная находка: 365 млн бесплатных токенов GigaChat, о которых почти не пишут.
Дмитрий Борейчук
Автор
Дмитрий Борейчук
OpenRouter: что это такое, сколько стоит и как работает из России — 424 нейросети через один ключ
03.09.2026#Нейросети: обзоры и сравнения
OpenRouter: что это такое, сколько стоит и как работает из России — 424 нейросети через один ключ
Один ключ вместо десяти счетов у OpenAI, Google и Anthropic. Разбираем, сколько это стоит на самом деле, что даёт бесплатный уровень и почему сервис открывается с ноутбука, но не с сервера.
Александр Бабинцев
Автор
Александр Бабинцев

🏆Другие категории

Все категории