Что такое Kimi K3 и кто её создал
Kimi K3 — это флагманская языковая модель китайской компании Moonshot AI, выпущенная 16 июля 2026 года. Moonshot AI — стартап из Пекина, основанный в марте 2023 года выпускниками университета Цинхуа. Компания уже успела заявить о себе в 2025 году с моделью Kimi K2, которая получила признание на западном рынке благодаря открытым весам, длинному контексту и доступным ценам. K3 стала следующим крупным шагом: модель содержит 2,8 триллиона параметров, что почти втрое больше, чем у предшественницы (около 1 триллиона).
Название «Kimi» произносится как «Кими», и в русскоязычных запросах встречаются оба написания — «Kimi K3» и «Кими K3». Важно понимать, что это одна и та же модель. K3 позиционируется как инструмент для сложных задач: обработки больших объёмов документов, написания и анализа кода, многошаговых агентных сценариев. Модель не генерирует изображения или видео, но способна анализировать визуальную информацию, поступающую на вход.
Ключевая особенность K3 — архитектура Mixture of Experts (MoE) с 896 экспертами, из которых для каждого токена активируются только 16. Это позволяет модели оставаться эффективной при огромном размере. Дополнительно Moonshot внедрила собственные разработки: Kimi Delta Attention (KDA) и Attention Residuals (AttnRes), которые улучшают обработку длинных последовательностей и удержание контекста в агентных цепочках.
Архитектура и технические характеристики
Kimi K3 построена на архитектуре Stable LatentMoE, которая сочетает преимущества Mixture of Experts с латентным пространством для повышения эффективности обучения и инференса. Модель имеет 2,8 триллиона параметров, но благодаря активации лишь 16 из 896 экспертов на каждый токен, вычислительная нагрузка остаётся управляемой.
Контекстное окно K3 составляет ровно 1 048 576 токенов — это более миллиона токенов, что позволяет обрабатывать за один запрос объём текста, превышающий тысячу страниц. Для сравнения, большинство коммерческих моделей предлагают окна в 128–256 тысяч токенов, поэтому миллион токенов — значительное преимущество для задач, требующих анализа больших документов или длинных диалогов.
Модель поддерживает мультимодальный ввод: она понимает изображения и видео без отдельного OCR-конвейера. Это означает, что K3 может анализировать скриншоты, схемы, страницы документов и даже видеоматериалы, извлекая из них текстовую и смысловую информацию. Однако на выходе модель выдаёт только текст и код — генерация изображений или видео не поддерживается.
Важной особенностью является постоянно включённый режим рассуждений (reasoning). Параметр reasoning_effort в API пока принимает только значение max, хотя в веб-интерфейсе уже появился регулятор «Интенсивность рассуждений» с возможностью выбора. Это означает, что модель всегда «думает» перед ответом, что увеличивает время ожидания, но повышает качество сложных рассуждений.
Сравнение с конкурентами: бенчмарки и реальность
Moonshot AI опубликовала таблицу бенчмарков, в которой Kimi K3 демонстрирует высокие результаты. Например, в тесте BrowseComp модель набрала 91,2 балла, обойдя Claude Fable 5 (88,0) и GPT-5.6 Sol (90,4). В SWE Marathon K3 получила 42,0 балла, заняв первое место среди перечисленных конкурентов. В FrontierSWE — 81,2 балла, что выше, чем у GPT-5.6 Sol (71,3), но ниже, чем у Claude Fable 5 (86,6).
Однако важно понимать, что эти цифры — vendor-бенчмарки, то есть замеры, проведённые самой Moonshot. Компания сама выбирала задачи, методику и условия тестирования. В официальном блоге Moonshot признаётся, что общая производительность K3 уступает Claude Fable 5 и GPT-5.6 Sol. Более того, в методологии есть нюансы: например, если Claude Fable 5 отказывался выполнять запрос по внутренним правилам, задание автоматически передавалось другой модели Anthropic — Opus 4.8, и её ответ засчитывался в строку Fable. Также разные модели тестировались с разными программными обвязками (KimiCode, Claude Code, Codex), что вносит дополнительную погрешность.
Независимый рейтинг Artificial Analysis поставил K3 на четвёртое место среди 189 моделей с результатом 57 баллов. Это впечатляющий результат, но он не подтверждает громких заголовков о «победе над Claude». На момент публикации обзоров независимые площадки ещё не воспроизвели результаты Moonshot по агентным бенчмаркам, поэтому окончательные выводы делать рано. Рекомендуется относиться к цифрам из блога производителя как к рекламным материалам до тех пор, пока они не будут подтверждены сторонними тестами.
Цены API и подписки: сколько стоит Kimi K3
API Kimi K3 доступен на платформе platform.kimi.ai. Цены составляют:
- Входные токены (cache miss): $3 за миллион токенов.
- Входные токены (cache hit): $0,30 за миллион токенов.
- Выходные токены: $15 за миллион токенов.
Кэширование работает автоматически: если вы повторно отправляете один и тот же префикс контекста, стоимость снижается в десять раз. Для сравнения, Claude Opus 4.8 стоит $5 за миллион входных и $25 за миллион выходных токенов, то есть K3 примерно вдвое дешевле на типичных задачах. Однако у Claude Sonnet 5 до 31 августа действует стартовая цена $2/$10, что делает его временно дешевле K3. После окончания промо тарифы Sonnet 5 сравняются с K3 — $3/$15.
Важный нюанс: K3 всегда включён режим рассуждений, что приводит к генерации большого количества выходных токенов. При цене $15 за миллион выходных токенов это может быстро увеличить счёт. Поэтому при расчёте бюджета ориентируйтесь на выходные токены, а не на входные.
Что касается подписок, официальный чат kimi.com предлагает бесплатный план Adagio, который включает 6 agent-кредитов в месяц и доступ к K3. Платная подписка Allegro стоит от $79 в месяц при годовой оплате и даёт приоритетную очередь, расширенные лимиты агентов и полный миллион токенов контекста. Минимальное пополнение API — $1.
Как получить доступ к Kimi K3 из России
Официальный сайт Kimi — kimi.com, где доступны чат, приложения и подписки. Для разработчиков существует отдельная платформа platform.kimi.ai с API и документацией. Прямого геоблока для России в документации не указано, и сайт открывается без VPN. Однако есть нюансы с регистрацией: Help Center Moonshot сообщает, что принимаются только номера телефонов «поддерживаемых регионов», поэтому с российским номером может не получиться. В таком случае рекомендуется регистрироваться по электронной почте.
С 19 июля 2026 года Moonshot приостановила регистрацию новых пользователей из-за наплыва желающих. Действующие аккаунты работают, а новые открываются партиями. Если форма регистрации не пускает, стоит подождать день-два.
Хорошая новость: чат на kimi.com отвечает и без входа в аккаунт, и K3 доступна в селекторе моделей. По умолчанию без входа отвечает младшая модель K2.6, но K3 можно выбрать вручную. После нескольких ответов K3 может показывать предупреждение о загруженных серверах и предлагать оформить подписку, поэтому полностью бесплатным использование назвать нельзя.
Также существуют сторонние агрегаторы, такие как AI Academy, которые предоставляют доступ к K3 на русском языке без VPN и иностранной карты. Например, AI Academy предлагает бесплатные сообщения, а затем пробный период за 1 ₽ на 3 дня, после чего подписка стоит 2490 ₽ в месяц. Это удобный вариант для тех, кто не хочет разбираться с зарубежной оплатой.
Kimi Code и агентные возможности
Kimi Code — это CLI-агент для «вайбкодинга», то есть разработки с помощью ИИ-агента, который пишет код по вашим командам. K3 внутри Kimi Code показывает сильные результаты в задачах, связанных с программированием: она может анализировать репозитории, находить причины ошибок, предлагать согласованные правки и выполнять многошаговые задачи.
Модель способна работать с несколькими зависимыми файлами, учитывать правила проекта и выдавать не случайные локальные патчи, а комплексные решения. Это делает её полезной для разработчиков, работающих над большими кодовыми базами.
Кроме того, Moonshot развивает экосистему вокруг K3: Kimi Work — десктопный агент для Windows и Mac, Kimi Slides — генератор презентаций, а также вкладки для таблиц, документов и Deep Research. Всё это работает в браузере или через приложения, и K3 доступна во всех этих инструментах.
Важно понимать, что агентные возможности K3 — это не просто чат, а способность выполнять цепочки действий: написать скрипт, запустить его, проанализировать результат и скорректировать подход. Например, в демонстрации Moonshot модель «смонтировала» видео, но на самом деле она написала скрипт, который склеил готовые клипы — сама модель не генерировала кадры.
Открытые веса: можно ли запустить K3 у себя
Moonshot AI обещала опубликовать открытые веса Kimi K3 до 27 июля 2026 года. Однако на момент проверки (27 июля) весов в профиле moonshotai на Hugging Face ещё не было. Это означает, что на сегодняшний день K3 — закрытая модель, доступная только через API и официальный чат. Обещание открыть веса может быть выполнено позже, но пока «открытость» существует только в анонсах.
Даже если веса появятся, запустить полную модель дома не получится: 2,8 триллиона параметров требуют десятков ускорителей (GPU/TPU) и значительных вычислительных ресурсов. Это под силу только крупным компаниям или исследовательским лабораториям. Для обычного пользователя проще использовать готовый чат или API.
Стоит отметить, что термин «open source» в применении к K3 некорректен — точнее говорить «open weights». Технический отчёт, детали обучения и файлы для запуска пока не опубликованы, поэтому полной прозрачности нет. Открытые веса полезны прежде всего командам, которые хотят дообучать модель или разворачивать её на собственной инфраструктуре.
Как отличить официальный сайт от фейков
Официальный сайт Kimi — только kimi.com. Там находятся чат, приложения и подписки. Для разработчиков — platform.kimi.ai. Любые другие сайты, такие как kimik2.com, kimi-com.ru, kimi.online, являются подделками или неофициальными зеркалами. Признаки фейка: дефис или цифры в домене, зона .ru/.io/.online, просьба оплатить «доступ к K3» до входа или скачать модель одним файлом. На таких сайтах нельзя вводить платёжные данные.
Также стоит быть осторожным с GitHub-репозиториями, предлагающими «Kimi K3 free desktop» — это могут быть вредоносные проекты. Официальные веса Moonshot публикует только в профиле moonshotai на Hugging Face.
Если вы видите сайт с заголовком «официальный сайт Kimi», но адрес отличается от kimi.com, это подделка. Вход в аккаунт осуществляется только через кнопку Sign in на самом kimi.com, отдельной страницы «войти в Кими» не существует.
Практические сценарии использования и ограничения
Kimi K3 лучше всего подходит для задач, где нужно обработать большой объём информации и сохранить связь между началом и концом. Вот несколько типичных сценариев:
- Анализ документов: сравнение договоров, коммерческих предложений, исследований. Модель может составить таблицу различий, привести цитаты и указать практические последствия.
- Подготовка презентаций: из большого отчёта или набора заметок K3 может собрать структуру презентации, выделив ключевые выводы и данные.
- Работа с кодом: анализ репозитория, поиск причин ошибок, предложение согласованных правок.
- Многошаговые задачи: например, выбор подрядчика по трём коммерческим предложениям с учётом бюджета и сроков.
Однако есть и ограничения. Модель чувствительна к истории рассуждений (thinking history) и может быть избыточно проактивной, если промт недостаточно точный. Также отмечается рост галлюцинаций по сравнению с предыдущей версией, поэтому выводы, от которых зависят важные решения, стоит проверять. Для коротких вопросов K3 может быть избыточной — она всегда рассуждает, что увеличивает время ответа. В таких случаях лучше использовать более быстрые модели.
Стоит ли переходить на Kimi K3 с других моделей
Решение о переходе на Kimi K3 зависит от ваших задач. Если вы работаете с большими документами, длинными кодовыми базами или сложными агентными сценариями, K3 может быть хорошим выбором благодаря миллионному контексту и сильным результатам в бенчмарках. Однако по цене K3 не даёт значительного преимущества перед западными конкурентами: тарифы сопоставимы с Claude Sonnet 5, а Claude Opus 4.8 дороже, но и мощнее.
Если вам нужна модель для коротких диалогов или генерации текста в определённом стиле, GPT-5.6 или Claude могут быть удобнее. Также стоит учитывать, что K3 пока не имеет открытых весов, а независимые тесты ещё не завершены. Разумная стратегия — протестировать K3 параллельно с привычной моделью на своих задачах и сравнить результаты. Многие сервисы, такие как AI Academy, позволяют переключаться между моделями в одном интерфейсе, что упрощает сравнение.
В целом Kimi K3 — это серьёзный игрок, но заголовки о «победе над Claude» преувеличены. Модель занимает четвёртое место в независимом рейтинге, что само по себе впечатляет, но не делает её абсолютным лидером.
Вопросы и ответы
Что такое Kimi K3 и кто её создал?
Kimi K3 — флагманская языковая модель китайской компании Moonshot AI, выпущенная 16 июля 2026 года. Moonshot AI основана в марте 2023 года выпускниками университета Цинхуа. Модель содержит 2,8 триллиона параметров, поддерживает контекст до 1 миллиона токенов и ориентирована на сложные задачи: анализ документов, написание кода, агентные сценарии. K3 не генерирует изображения или видео, но может анализировать визуальный ввод.
Как пользоваться Kimi K3 из России бесплатно?
Самый простой способ — зайти на официальный сайт kimi.com. Чат работает без входа, и K3 доступна в селекторе моделей (по умолчанию отвечает младшая модель K2.6, но K3 можно выбрать вручную). Однако после нескольких ответов может появиться предложение оформить подписку. Также можно зарегистрироваться по электронной почте (с российским номером телефона могут быть проблемы). С 19 июля 2026 года регистрация новых пользователей временно приостановлена, но действующие аккаунты работают. Альтернативный вариант — сторонние сервисы, например AI Academy, которые предоставляют доступ к K3 на русском языке без VPN и иностранной карты.
Сколько стоит API Kimi K3?
API Kimi K3 стоит $3 за миллион входных токенов (cache miss) и $15 за миллион выходных токенов. При кэшировании входных токенов цена снижается до $0,30 за миллион. Для сравнения, Claude Opus 4.8 стоит $5/$25, а Claude Sonnet 5 временно $2/$10. Важно учитывать, что K3 всегда включён режим рассуждений, что увеличивает количество выходных токенов, поэтому бюджет лучше рассчитывать по выходным токенам.
Правда ли, что Kimi K3 обходит Claude и GPT?
По данным самой Moonshot, K3 превосходит Claude Opus 4.8 и GPT-5.6 Sol в некоторых бенчмарках, но уступает Claude Fable 5 и GPT-5.6 Sol по общей производительности. В независимом рейтинге Artificial Analysis K3 заняла четвёртое место среди 189 моделей. Однако vendor-бенчмарки Moonshot имеют методологические нюансы, и независимые площадки ещё не воспроизвели результаты. Поэтому говорить о полном превосходстве преждевременно.
Можно ли скачать Kimi K3 и запустить у себя?
Moonshot обещала опубликовать открытые веса до 27 июля 2026 года, но на момент проверки они ещё не появились. Даже если веса выложат, для запуска полной модели (2,8 трлн параметров) потребуется мощная серверная инфраструктура с десятками ускорителей, что недоступно обычным пользователям. Для практического использования проще пользоваться официальным чатом или API.
Чем Kimi K3 отличается от DeepSeek и Qwen?
Все три — китайские модели, но от разных компаний: DeepSeek создаёт одноимённая лаборатория, Qwen — команда Alibaba, Kimi — Moonshot AI. K3 — самая крупная из тройки по числу параметров (2,8 трлн) и единственная с контекстным окном в миллион токенов. DeepSeek и Qwen также предлагают открытые веса, но их архитектура и фокус могут отличаться. Выбор зависит от конкретных задач.
Какие ограничения есть у Kimi K3?
K3 чувствительна к истории рассуждений и может быть избыточно проактивной при неточных промтах. Отмечается рост галлюцинаций по сравнению с предыдущей версией. Модель не генерирует изображения и видео, только текст и код. Для коротких вопросов K3 может быть избыточной из-за постоянного режима рассуждений, что увеличивает время ответа. Также важно проверять выводы, от которых зависят важные решения.