Переход на официальный сайт продукта.
Флагманская мультимодальная модель Moonshot AI с крупнейшим в мире контекстным окном. Текст, изображения, аудио и видео — в одном запросе.
Kimi K3 — флагманская мультимодальная модель от китайской Moonshot AI, выпущенная в июле 2026. Главное преимущество — контекстное окно 1 000 000 токенов, позволяющее обрабатывать целые кодовые базы, многотомные документы и длинные видео в одном запросе. Это прямой конкурент GPT-5.6 Sol и Claude Opus 8.
Архитектура — Mixture-of-Experts на 1.2 триллиона параметров (16B активных) с динамической маршрутизацией и Multi-Head Latent Attention. Модель нативно мультимодальна: текст, изображения, аудио и видео на входе. Обучена на 22 триллионах токенов. Доступна через веб-интерфейс, мобильное приложение и OpenAI-совместимый API.
Multi-Head Latent Attention (MLA) — сжатие KV-кэша в 8 раз. Без MLA контекст 1M токенов требовал бы 320GB VRAM только под кэш. С MLA модель помещается в разумные рамки.
Dynamic MoE Routing — 128 экспертных подсетей, 8 активны на токен. Маршрутизатор обучен через reinforcement learning. Обеспечивает скорость инференса как у dense-модели на 16B при ёмкости 1.2T.
Hierarchical Position Encoding — трёхуровневое кодирование: coarse (блоки 64K), medium (1K), fine (позиции). Решает проблему затухания внимания на сверхдлинных последовательностях.
Cross-Modal Fusion — унифицированный энкодер для всех модальностей. Contrastive pre-training + проекция в общее латентное пространство. Модель «видит» видео и «слышит» аудио через тот же механизм, что и читает текст.
«Война и мир» целиком (580K слов), кодовая база 500K строк, транскрипт 20-часового подкаста — всё в одном запросе. Точность Needle-in-Haystack: 99.2% на 1M токенов.
Изображения (диаграммы, скриншоты), аудио (MP3/WAV), видео (MP4 до 2ч) — модель обрабатывает всё на входе и выдаёт структурированный текст.
HumanEval: 94.7%. MATH-500: 96.8%. 40+ языков программирования, встроенный sandbox для выполнения кода.
Function calling, tool use, мультиагентные сценарии из коробки. OpenAI-совместимый API.
Целенаправленный RLHF на русскоязычных данных. Качество выше, чем у Llama 4.
| Характеристика | Kimi K3 |
|---|---|
| Параметры | 1.2T MoE (16B активных) |
| Контекстное окно | 1 000 000 токенов |
| Модальности | Текст + изображения + аудио + видео |
| Языки | 50+ включая русский |
| Бесплатный tier | 50 запросов/день, контекст 128K |
| Pro | $20/мес, контекст 1M, 500 запросов/день |
| API | OpenAI-совместимый, $0.40/1M input |
| Критерий | Kimi K3 | GPT 5.6 Sol | Claude Opus 8 |
|---|---|---|---|
| Контекст | 1M | 2M | 500K |
| Мультимодальность | Текст+изобр+аудио+видео | Текст+изображения | Текст+изображения |
| HumanEval | 94.7% | 93.1% | 92.5% |
| Цена/мес | $20 | $25 | $30 |
| Computer Use | Нет | Нет | Да (CU 2.0) |
Kimi K3 — выбор №1 для работы со сверхдлинными документами и мультимодальным контентом. Если вы анализируете巨大的 кодовые базы, многотомные документы или транскрипты — аналогов нет. Для обычных задач берите GPT 5.6 Sol (быстрее и дешевле), для автономной работы с десктопом — Claude Opus 8 (Computer Use 2.0). Но когда объём данных превышает 200K токенов — только Kimi K3.