Китайцы выпустили Kimi K3 — 2,8 трлн параметров и звание крупнейшей открытой модели в мире
Китайская Moonshot AI 16 июля представила Kimi K3 — модель на 2,8 триллиона параметров. Компания называет её первой в мире открытой моделью «3T-класса», и по размеру это действительно рекорд среди открытых.
Что за модель
- Архитектура: разреженная MoE (смесь экспертов). Из 896 экспертов на каждый токен активируется всего 16 — то есть работает лишь малая часть этих 2,8 трлн.
- Контекст: 1 млн токенов.
- Зрение: нативное, а не прикрученное сбоку.
- Цена: $0,30 за млн токенов при попадании в кэш, $3 — если промахнулись мимо кэша, $15 за млн выходных.
Что нового под капотом
Две вещи, которые Moonshot вынесла в заголовок:
- Kimi Delta Attention (KDA) — ускоряет генерацию до 6,3 раза на контексте в миллион токенов. Это прямой ответ на главную боль длинного контекста: чем больше окно, тем медленнее модель.
- Attention Residuals (AttnRes) — повышает эффективность обучения примерно на 25% при удорожании менее чем на 2%.
Вместе с разреженностью это, по заявлению компании, даёт примерно в 2,5 раза лучшее масштабирование, чем у предыдущей K2.
Важные оговорки
Две детали, которые в громких заголовках теряются:
- Веса ещё не выложены. Moonshot обещает открыть их 27 июля. То есть на сегодня модель «открытая» по намерению, а не по факту — скачать и запустить у себя пока нельзя.
- Это не первое место по качеству. Сама компания признаёт: по общей производительности K3 всё ещё уступает самым сильным закрытым моделям — Claude Fable 5 и GPT-5.6 Sol. Рекорд тут по размеру и открытости, а не по интеллекту.
Почему это важно
Разрыв между китайскими открытыми моделями и американскими закрытыми продолжает сокращаться — и делает это на глазах. Год назад открытые модели были «неплохой альтернативой для бедных», сегодня они спорят с флагманами на отдельных задачах.
Для российского пользователя открытые китайские модели — вообще отдельная история: Kimi, DeepSeek, Qwen работают без VPN и стоят копейки, а при желании их можно запустить на своём железе. Правда, с 2,8 трлн параметров «своё железо» — это уже серверная стойка, а не игровой ПК.
Что такое MoE и почему 2,8 трлн параметров не значит 2,8 трлн в памяти — в гайде про смесь экспертов. Где брать открытые модели, когда веса выложат, — в гайде по Hugging Face.
Оригинал: Axios, VentureBeat, SCMP