Moonshot AI открыла веса Kimi K3 — модели на 2,8 триллиона параметров против OpenAI и Anthropic
Moonshot AI открыла веса Kimi K3 — модели на 2,8 триллиона параметров. Развернуть её можно на своих серверах, без API OpenAI и Anthropic. Разбираем, что это меняет для рынка и пользователей.
Moonshot AI выполнила обещание и опубликовала полные веса модели Kimi K3 — шаг, который может заметно встряхнуть рынок больших языковых моделей. Судя по официальному блогу Kimi, теперь провайдеры сервисов и исследовательские центры могут самостоятельно устанавливать и модифицировать одну из крупнейших нейросетей, когда-либо выпущенных в открытом доступе.
Новая модель напрямую конкурирует с закрытыми системами OpenAI и Anthropic, предлагая себя как рабочую альтернативу для тех, кто не хочет зависеть от чужих API. Возможность скачать веса позволяет запускать Kimi K3 на собственной инфраструктуре — то, что особенно ценят европейские компании, которым важно держать чувствительные данные внутри периметра и настраивать модель под конкретные бизнес-задачи. Разбор релиза сделал портал tugatech.com.pt — этот материал является переводом его обзора.
Архитектура смеси экспертов и предельная оптимизация
При колоссальном размере в 2,8 триллиона параметров Kimi K3 спроектирована с прицелом на эффективность за счёт архитектуры mixture-of-experts. Модель состоит из 896 независимых модулей, из которых для обработки каждого токена активируются всего 16. Благодаря этому во время инференса задействовано лишь около 104 миллиардов параметров — заметно меньшая вычислительная нагрузка, чем у плотной модели такого же масштаба.
Модель нативно работает с несколькими модальностями за счёт визуального энкодера MoonViT-V2 на 401 миллион параметров. Для обработки контекста длиной до 1 048 576 токенов разработчики внедрили механизмы Kimi Delta Attention, Attention Residuals и Gated MLA. Эффективность дополнительно повышает квантование — MXFP4 для весов и MXFP8 для активаций, применённое ещё на этапе обучения. При этом запуск модели требует серьёзного железа: рекомендуется связка минимум из 64 ускорителей. Лицензия достаточно свободная, но компаниям с выручкой выше 20 миллионов долларов за 12 последовательных месяцев потребуется отдельное соглашение, а для крупных коммерческих продуктов есть требования по указанию бренда.
Результаты на уровне топовых моделей за меньшие деньги
По тестам производительности Kimi K3 показывает уверенные результаты. На независимой платформе Artificial Analysis модель набрала общий балл 57 — на уровне GPT-5.5 и Claude Opus 4.8. В задачах программирования и автономной работы она подходит близко к лидерам: в Terminal-Bench 2.1 набрала 88,3 балла против 88,8 у GPT-5.6 Sol, а в ProgramBench даже обошла её — 77,8 против 77,6.
Главное конкурентное преимущество — стоимость доступа через API, которая в два-три раза ниже американских аналогов. Обработка без попадания в кеш обходится примерно в 3 доллара за миллион входных токенов, а при совпадении с кешем цена падает до 0,30 доллара. Генерация ответа стоит 15 долларов за миллион созданных токенов. Moonshot AI заявляет долю попаданий в кеш выше 90 % на задачах, связанных с программированием — это заметно снижает итоговый счёт для тех, кто использует модель в связке с инструментами разработчика. Из недостатков компания признаёт, что модель может быть чересчур инициативной при неоднозначных инструкциях и чувствительна к сохранению истории рассуждений — опыт использования пока чуть менее отполирован, чем у самых продвинутых прямых конкурентов.
Смотрите также
-
Помощники в кодинге·Superpowers для Claude Code: фреймворк скиллов, который заставляет ИИ думать до кода
-
Новости·Китайская модель Kimi K3 тоже сбежала из тестовой песочницы
-
Opensource·Google открыла исходный код ИИ-модели для раннего предупреждения об ураганах
-
Музыка·Suno добавит водяные знаки в ИИ-песни, чтобы их было проще отличить от настоящих
-
Ассистенты·Alexa+ с ИИ добралась до Австралии — и уже понимает местный сленг
-
Новости·GPT-6 покажут Белому дому: Сэм Альтман летит в Вашингтон
-
Здоровье·ChatGPT даёт разные медицинские советы платным и бесплатным пользователям
-
Новости·Substack научился определять, написан ли текст человеком или ИИ
-
Ассистенты·Первое устройство OpenAI — беспроводная колонка-компаньон без экрана