Новости IT-индустрии

Kimi K3: Что нужно знать о модели с открытым исходным кодом и 2,8 триллиона параметров

27 июля 2026 г.Игорь Гранитов1 мин

Переживает ли искусственный интеллект свой второй «момент DeepSeek» с анонсом модели Kimi K3 от китайской компании Moonshot AI? Эта модель обещает многое: почти 3 триллиона параметров (её называют моделью 3T-класса) и обещание открытых весов. Американский фондовый рынок не остался равнодушным: индекс Nasdaq снизился на 1,5% после объявления.

Moonshot AI не является самой известной компанией в мире генеративного искусственного интеллекта, но это может измениться с выходом её большой языковой модели (LLM) Kimi K3, анонсированной на прошлой неделе.

Kimi K3: Впечатляющие цифры

Компания представляет её как «первую модель с открытым исходным кодом, достигшую 2,8 триллиона параметров». Она также обладает широким контекстным окном до одного миллиона токенов (как Fable 5, Opus 4.8 и GPT-5.6 sol). Однако стоит отметить, что анонс «открытого исходного кода» пока представляет собой лишь декларацию намерений, с обещанием, что «полные веса моделей будут опубликованы к 27 июля 2026 года».

Kimi K3 использует архитектуру Mixture of Experts (MoE), которая предполагает использование только части параметров каждый раз. Модель включает 896 экспертов, из которых 16 активируются при каждом вызове.

Вы, возможно, встретите в интернете упоминание «2.8T-A50B» – это простой расчёт, основанный на официальной информации: 2800 миллиардов параметров, что даёт 3,125 миллиарда параметров на одного эксперта (2800/896), и, следовательно, 50 миллиардов параметров для 16 экспертов. Но это упрощённый расчёт, тем более без дополнительных уточнений от Moonshot AI.

  • Что такое Mixture of Experts (MoE) для генеративного ИИ?

«Kimi K3 продемонстрировала производительность на грани возможного»