ИИ ИИшка Про
Новости

Китайцы выпустили Kimi K3 — 2,8 трлн параметров и звание крупнейшей открытой модели в мире

AI-редакция · перевод с источника Axios, VentureBeat, SCMP

Китайская Moonshot AI 16 июля представила Kimi K3 — модель на 2,8 триллиона параметров. Компания называет её первой в мире открытой моделью «3T-класса», и по размеру это действительно рекорд среди открытых.

Что за модель

  • Архитектура: разреженная MoE (смесь экспертов). Из 896 экспертов на каждый токен активируется всего 16 — то есть работает лишь малая часть этих 2,8 трлн.
  • Контекст: 1 млн токенов.
  • Зрение: нативное, а не прикрученное сбоку.
  • Цена: $0,30 за млн токенов при попадании в кэш, $3 — если промахнулись мимо кэша, $15 за млн выходных.

Что нового под капотом

Две вещи, которые Moonshot вынесла в заголовок:

  • Kimi Delta Attention (KDA) — ускоряет генерацию до 6,3 раза на контексте в миллион токенов. Это прямой ответ на главную боль длинного контекста: чем больше окно, тем медленнее модель.
  • Attention Residuals (AttnRes) — повышает эффективность обучения примерно на 25% при удорожании менее чем на 2%.

Вместе с разреженностью это, по заявлению компании, даёт примерно в 2,5 раза лучшее масштабирование, чем у предыдущей K2.

Важные оговорки

Две детали, которые в громких заголовках теряются:

  1. Веса ещё не выложены. Moonshot обещает открыть их 27 июля. То есть на сегодня модель «открытая» по намерению, а не по факту — скачать и запустить у себя пока нельзя.
  2. Это не первое место по качеству. Сама компания признаёт: по общей производительности K3 всё ещё уступает самым сильным закрытым моделям — Claude Fable 5 и GPT-5.6 Sol. Рекорд тут по размеру и открытости, а не по интеллекту.

Почему это важно

Разрыв между китайскими открытыми моделями и американскими закрытыми продолжает сокращаться — и делает это на глазах. Год назад открытые модели были «неплохой альтернативой для бедных», сегодня они спорят с флагманами на отдельных задачах.

Для российского пользователя открытые китайские модели — вообще отдельная история: Kimi, DeepSeek, Qwen работают без VPN и стоят копейки, а при желании их можно запустить на своём железе. Правда, с 2,8 трлн параметров «своё железо» — это уже серверная стойка, а не игровой ПК.

Что такое MoE и почему 2,8 трлн параметров не значит 2,8 трлн в памяти — в гайде про смесь экспертов. Где брать открытые модели, когда веса выложат, — в гайде по Hugging Face.

Оригинал: Axios, VentureBeat, SCMP