Kimi K3 — это один из тех проектов, которые становятся гораздо интереснее, если не ограничиваться лишь цифрами из заголовков. Да, она имеет 2,8 триллиона параметров, контекстное окно размером 1 048 576 токенов и поддерживает ввод изображений. Но что ещё важнее, первые результаты тестирования указывают на то, что модель создана для выполнения сложных задач в области программирования, исследований и интеллектуальной работы, а не для быстрого и бесполезного общения в чатах.
Мое мнение: начинайте с K3, если вы пишете или отлаживаете код, работаете с обширными исследовательскими наборами данных или регулярно предоставляете ИИ больше материала, чем может обработать обычное окно чата. Результаты Moonshot AI в области программирования и работы с информацией впечатляют, а ранние тесты от сторонних разработчиков подтверждают, что это действительно передовая модель. Минус заключается в том, что K3 по умолчанию работает в режиме глубокого анализа, поэтому она больше подходит для важных задач, чем для быстрого составления черновиков.
Если K3 — это именно та модель, которую вы хотите попробовать для серьезной работы, GlobalGPT предоставляет вам более широкие возможности для работы с ней. Одно рабочее пространство объединяет чат, поиск информации, написание текстов, помощь в программировании, рецензирование документов, генерацию изображений, создание видео и переключение моделей, поэтому K3 может выполнять задачи, требующие рассуждений на основе обширного контекста в то время как GPT, Claude, Gemini, Perplexity и другие модели лучше справляются с теми этапами, для которых они лучше подходят. При годовой оплате тарифный план «Pro» — это $10.80/месяц а тарифный план «Unlimited» — это $25/месяц, благодаря чему GlobalGPT становится удобным способом использования нескольких ведущих ИИ-инструментов без необходимости оплачивать отдельную подписку для каждого этапа рабочего процесса.
Что такое Kimi K3?
Kimi K3 — это флагманская модель логического мышления компании Moonshot AI, выпущенная 16 июля 2026 года. Эта официальный пост о запуске описывает модель «смеси экспертов» с общим количеством параметров 2,8 триллиона, механизмом Kimi Delta Attention, остатками внимания (Attention Residuals), встроенным пониманием визуальной информации и контекстным окном длиной в один миллион токенов. Модель принимает входные данные в виде текста и изображений и возвращает текстовый результат.
Заголовок «2.8T» требует небольшого пояснения. K3 не использует все параметры для каждого токена. По словам Moonshot, система направляет каждый шаг через 16 из 896 экспертов, что является практичным способом выделить больше ресурсов на обработку сложных запросов, не рассматривая при этом каждый мелкий запрос как ресурсоемкую задачу.
Краткий обзор Kimi K3
| Выпуск | 16 июля 2026 года |
|---|---|
| Общие параметры | 2,8 Тб MoE; 16 из 896 экспертов активны |
| Контекст | 1 048 576 токенов |
| Методы | Ввод текста и изображений; вывод текста |
| Запуск API | Только расчет по методу Макса; фиксированные настройки выборки |
Какие задачи ставит перед собой архитектура
Kimi Delta Attention и Attention Residuals — это решения компании Moonshot для известной проблемы длинного контекста: обеспечение доступности релевантной информации при значительном увеличении объема входных данных. По заявлению Moonshot, данный подход повышает эффективность масштабирования по сравнению с Kimi K2. Это заявление разработчика, поэтому его следует рассматривать как замысел разработчиков, а не как результат независимого подтверждения эффективности.
API запуска имеет более непосредственные последствия для покупателей. Его официальное краткое руководство по началу работы поддерживает только макс. логика, с фиксированными настройками запроса, включая температура 1.0, top_p 0,95, и n 1. Другими словами, K3 в первую очередь предназначен для решения сложных задач; пока что его нельзя использовать для простой и быстрой переработки.
Тесты Kimi K3: официальные данные против независимых результатов
K3 появился на рынке с более полным набором результатов тестирования, чем большинство других новинок. Собственные результаты Moonshot охватывают программирование, работу с виртуальными помощниками, просмотр веб-страниц, работу с электронными таблицами и интеллектуальную работу. Artificial Analysis добавляет независимый индекс интеллекта, а Arena даёт предварительное представление о том, как люди реагируют на результаты работы системы. В совокупности эти цифры являются весомым аргументом в пользу включения K3 в шорт-лист.
Опубликованные результаты компании Moonshot AI
Moonshot демонстрирует особенно высокие результаты при решении задач, связанных с программированием с долгосрочной перспективой, работой агентов, поиском информации в Интернете и интеллектуальной деятельностью. Среди наиболее впечатляющих результатов — 88,3 в тесте Terminal-Bench 2.1, 81,2 в FrontierSWE, 77,8 в Program Bench, рейтинг GDPval-AA v2 Elo на уровне 1668 и 91,2 в BrowseComp. В его диаграмме визуальных агентов указан показатель 91,3 по исследовательским вопросам CharXiv с использованием инструментов.
Практический вывод прост. K3 выглядит особенно подходящей для многоэтапного кодирования, работ с интенсивным исследовательским компонентом и задач, в которых модели необходимо учитывать обширный контекст. Компания Moonshot также относит её к группе передовых моделей, а не утверждает, что она лидирует во всех категориях, что представляется правильным подходом к позиционированию новой модели, ориентированной на столь широкую целевую аудиторию.


| Эталон | Сообщенный результат |
|---|---|
| Terminal-Bench 2.1 | 88.3 |
| FrontierSWE | 81.2 |
| GDPval-AA v2 | 1668 Elo |
| BrowseComp | 91.2 |
| CharXiv RQ с инструментами | 91.3 |
Результаты, представленные производителями, являются полезными данными для скрининга, но не являются независимым подтверждением.
K3 уже находится в верхней части турнирной таблицы
Один из самых явных ранних признаков — это то, что альбом «K3» не попал в собственные чарты Moonshot. Он набрал 57 баллов в Индекс искусственного интеллекта в области анализа, заняв четвертое место среди 189 сопоставимых моделей по данным на 17 июля 2026 года. Это впечатляющий старт для новой версии, особенно с учетом того, что K3 ориентирована на более сложный сегмент рынка: программирование, работу в стиле агентов, научное мышление и сложный анализ, а не простой чат.
Его профиль производительности также выглядит вполне логично. K3 начинает реагировать примерно через 1,99 секунды и генерирует около 62 токенов вывода в секунду, однако объем вывода у него превышает среднее значение по сравнению. Проще говоря, он создан для того, чтобы тщательно прорабатывать проблему, а не стремиться к быстрому ответу. Именно это и нужно при отладке кода, анализе отчёта или сборе данных для исследования. Для быстрой переделки текста или однострочного ответа его мощности, вероятно, будет больше, чем нужно.

Его первые достижения в области веб-разработки трудно не заметить
K3 заняла первое место в предварительном рейтинге Code WebDev на сайте Arena, набрав 1679 +17/-17 баллов по результатам 1 757 голосований. В общем рейтинге по текстовым задачам она заняла более низкое — девятое — место с результатом 1486 ±11 баллов по результатам 3 024 голосований. Этот разрыв говорит о многом: K3 не пытается победить, опираясь исключительно на непринуждённую беседу. Его преимущество в начале становится очевидным, когда задача напоминает реальную работу над продуктом.
Если вы занимаетесь разработкой интерфейсов, создаете прототипы продуктовых идей или ежедневно переводите требования к продукту на язык кода и наоборот, то K3 стоит попробовать уже сейчас. Данные WebDev также совпадают с результатами собственного анализа Moonshot, так что это не просто одна эффектная цифра. Чтобы получить более широкое представление о рынке, ознакомьтесь с нашим руководством по лучшие модели искусственного интеллекта.

- Результаты запуска K3 наиболее впечатляют в таких областях, как программирование, работа с агентами, просмотр веб-страниц и интеллектуальная деятельность.
- Данные независимых источников подтверждают, что эта модель входит в число самых производительных из доступных на сегодняшний день.
- Контекстное окно размером 1M обеспечивает ему реальное преимущество при выполнении задач, требующих обработки больших объемов исходного кода.
- Используйте его в тех случаях, когда более глубокий анализ оправдывает дополнительные затраты времени и ресурсов.
Где Kimi K3 показывает себя наиболее эффективно
K3 не стремится стать универсальным решением для всех задач в области искусственного интеллекта. Первые результаты указывают на то, что он наиболее эффективен в задачах, требующих глубокого анализа: обработка объемных документов, обобщение результатов исследований, анализ кода и многоэтапные проекты. Именно с этого я бы и начал его использовать.
Контекстное окно объемом 1 млн токенов предоставляет K3 достаточно места для отчетов, исследовательских пакетов и обширной истории проектов, не разбивая все на мелкие подсказки.
Объемные документы: естественное место для начала
Окно объемом 1 млн токенов предоставляет K3 достаточно места для годовых отчетов, юридических приложений, исследовательских материалов и обширной истории проектов. Уже одно это делает систему привлекательной, если вы устали разбивать документы на фрагменты перед тем, как задать вопрос. Результаты тестирования в сфере интеллектуальной работы подтверждают это. Для анализа документов я бы сначала использовал K3, а затем проверил наиболее важные цифры и ссылки на страницы. Наше руководство по Как ИИ-помощники читают PDF-файлы объясняет, почему этап извлечения данных имеет такое же большое значение, как и сама модель.
K3 представляется особенно полезным инструментом для преобразования обширного набора источников в четкое задание, систематизации противоречивых утверждений и выявления общей нити в хаотичных результатах исследования.
Обзор научных исследований: полезно для «неоднозначной середины»
Исследовательская работа обычно становится сложной на среднем этапе: слишком много источников, мелкие расхождения и огромный объем контекста, который нужно удержать в голове одновременно. BrowseComp, независимый интеллектуальный рейтинг и окно контекста K3 делают этот инструмент отличным помощником на данном этапе работы. Используйте его, чтобы структурировать аргументацию, выделить точки разногласий и превратить обширный набор источников в полезный краткий обзор. Инструмент веб-поиска Moonshot на момент запуска ещё находился в стадии доработки, поэтому для срочных задач лучше использовать собственные источники и держать их под рукой.
Благодаря своим показателям производительности при программировании и ранним результатам в области веб-разработки K3 становится отличным выбором для устранения ошибок, разработки новых функций и проектов, включающих несколько взаимосвязанных компонентов.
Программирование: самая веская причина попробовать это
Официальный набор инструментов для программирования K3 и его результат — Arena WebDev — являются самой весомой причиной попробовать эту систему. Именно к этой модели я бы обратился, если бы задание включало в себя несколько взаимосвязанных этапов: изучение кодовой базы, отслеживание ошибки, внесение изменений и объяснение компромиссов. Для полноценного тестирования следует использовать одну реальную ошибку или изменение, соответствующее по масштабу новой функции, из вашего собственного репозитория, а не общий шаблон для программирования. Именно в этом случае его обширный контекст и возможности для логического обоснования смогут проявить себя в полной мере.
Благодаря встроенной функции вставки изображений K3 станет отличным помощником при работе с отчетами, графиками, диаграммами и скриншотами, когда нужно быстро донести суть дела.
Графики и визуальный анализ: полезны для первоначального анализа
Благодаря возможности ввода исходных изображений K3 оказывается более полезной, чем модель, работающая только с текстом, когда отчет изобилует графиками, диаграммами и скриншотами. Результаты работы визуального агента Moonshot обнадеживают, особенно для команд, которые уделяют больше времени презентациям и отчетам, чем чистым CSV-файлам. Я бы использовал его, чтобы визуализировать суть истории в диаграмме, а затем приучился бы быстро проверять оси, легенду и единицы измерения, прежде чем передавать выводы дальше.
K3 обладает достаточным объемом контекста для размещения заметок по встречам, сводок по нескольким документам и аналитических материалов, которые перегрузили бы обычный чат.
Работа в офисе и с несколькими файлами: разумный подход к повышению продуктивности
Записи со встреч, сводки по нескольким документам и аналитические материалы — все это разумные варианты применения K3. Модель обладает достаточным контекстуальным запасом для исходных материалов и ориентирами профессиональной деятельности, что делает эту идею убедительной. Полный опыт использования будет зависеть от файлов и сопутствующих инструментов, но для повседневной работы с информацией я бы отнес эту модель к первой группе, которую стоит попробовать. Если вам нужно обработать несколько исходных файлов, это руководство по работа со всей папкой — это полезный перечень пунктов, которые необходимо проверить.
K3 — это интересный вариант, когда агенту необходимо собрать контекстную информацию, проанализировать ситуацию в несколько этапов и выполнить четко определённую задачу.
Рабочие процессы агентов: перспективны, когда задача имеет чётко сформулированную цель
Благодаря тестам производительности агентов K3 эта платформа представляет собой интересный вариант для работы с четко обозначенной конечной целью: изучение проблемы, сбор соответствующих материалов, внесение изменений или подготовка краткого отчета. Kimi Work и Kimi Code могут дополнить модель полезными инструментами, а пользователи API могут создавать собственные сценарии работы. Наилучшие результаты будут достигнуты, если задать агенту чёткую цель и определить способ проверки его работы. Для агентов, ориентированных на исследования, наш подробное руководство по рабочему процессу исследования рассказывает о привычках, которые стоит сохранить.
С чего начать
С чего начать
| Рабочий процесс | Почему K3 — идеальный выбор | Лучшее задание для начала |
|---|---|---|
| Кодирование | Наиболее явный ранний признак | Настоящая ошибка или изменение, влияющее на функциональность |
| Длинные документы | Контекстное окно 1M | Годовой отчет или пакет исследовательских материалов |
| Исследование | Хорошо объединяет противоречивые источники | Брифинг с приведением источников |
| Визуальный анализ | Ввод изображений в исходном формате | Отчет с большим количеством диаграмм |
| Офисная работа | Полезный запас по высоте | Протокол встречи и сопутствующие файлы |
Причины для проведения оценки
- Контекстное окно токена 1M
- Явный ранний сигнал кодирования
- Ввод текста и изображений
- Результаты независимого сравнительного анализа индексов
Причины, по которым следует проявлять осторожность
- Рассуждения Макса только при запуске
- Выходные токены $15/M
- Надежность на уровне задач здесь не проверена
- Веса и технический отчет на момент отлова не были опубликованы
Ограничения Kimi K3 и предостережения в день запуска
Главное, что нужно знать перед тем, как приступить к работе с K3, — это то, что он настроен на серьезную работу. Функция «Максимальное рассуждение» всегда включена, а фиксированные параметры выборки оставляют меньше возможностей для настройки скорости, стоимости и стиля ответа. Это разумный компромисс для отладки или исследований. Однако для классификации больших объемов данных, коротких переформулировок или задач, где длинный ответ в основном является излишним, это излишне.
Вывод данных — это самая затратная часть расходов. При стоимости $15 за миллион токенов вывода модель, которая «мыслит вслух», может быстро стать дорогостоящей. Это не обязательно является препятствием: несколько центов или долларов могут показаться мелочью, если это сэкономит инженеру полдня работы. Однако это означает, что перед составлением бюджета вам следует проанализировать как входные, так и выходные данные задач, которые вы выполняете каждую неделю.
В-третьих, на дату представления доказательств информация о весовых категориях K3 оставалась лишь обещанием. Компания Moonshot заявила, что полные данные о весовых категориях будут представлены к 27 июля 2026 года вместе с дополнительными техническими подробностями. При проверке 17 июля официальный Организация Moonshot AI Hugging Face K3 не был указан. До тех пор, пока репозиторий, лицензия, описание модели и файлы не будут опубликованы, формулировка “запланированный выпуск в открытом весовом классе” будет более точной, чем “доступно для самостоятельного развертывания”.”


Ограничения, действующие в день запуска, о которых следует помнить
- API поддерживает только максимальный уровень логического вывода и фиксированные настройки выборки.
- Стоимость вывода может стать определяющим фактором в длительном процессе рассуждений.
- Официальный инструмент веб-поиска был помечен как обновлённый.
- Функция продукта или интеграция со сторонними сервисами не всегда автоматически входит в базовую комплектацию.
Цены на Kimi K3
17 июля 2026 года компания Moonshot опубликовала цены на API Kimi K3: $0.30 за миллион входных токенов, попавших в кэш; $3 за миллион входных токенов, не попавших в кэш; и $15 за миллион выходных токенов. Размер контекстного окна составляет 1 048 576 токенов. Это официальные цены по прейскуранту API, указанные без учета налогов и наценок сторонних поставщиков.

Официальные расценки API за миллион токенов
Стоимость — это, в основном, вопрос объема производства
Расчет прост: входные токены с соответствующей скоростью кэширования плюс выходные токены со скоростью $15 на миллион. Запрос со 100 000 некэшированных входных токенов и 10 000 выходных токенов дает примерно $0,45. Отчет на 200 000 токенов с 5 000 выходных токенов составляет примерно $0,675. Миллион некешированных входных токенов и 50 000 выходных токенов составят примерно $3,75. Это арифметические примеры, а не счета по результатам частного тестирования.
Примеры стоимости API
| Запрос | Сметная стоимость |
|---|---|
| 100K входных данных без кэширования + 10K выходных данных | $0.45 |
| 200K входных данных, не кэшированных + 5K выходных данных | $0.675 |
| 1 млн некешированных входных данных + 50 тыс. выходных данных | $3.75 |
Доступ для потребителей и доступ через API — это разные виды покупок
Потребительский тарифный план, прямой доступ к API и сторонний мультимодельный абонемент позволяют решать разные задачи. Потребительские тарифные планы, как правило, являются более простым вариантом для работы с чатами и файлами; API предназначены для создания рабочих процессов и отслеживания токенов. Права, предоставляемые тарифными планами, и региональная доступность могут меняться, поэтому рекомендуется уточнить, какой вариант вы планируете использовать, прежде чем рассматривать стартовую цену как постоянное предложение.
Выберите маршрут доступа для задания
Тарифные планы для частных клиентов обычно являются самым простым способом обмена сообщениями и файлами. API предназначены для создания и анализа рабочих процессов. Мультимодельные рабочие пространства Это может оказаться полезным, если вам нужно сравнить одну и ту же реальную задачу на разных моделях. Доступность и квоты могут варьироваться в зависимости от тарифного плана и региона.
Где можно опробовать Kimi K3?
Вы можете протестировать K3 с помощью потребительских продуктов Moonshot или API с учетом доступности и ограничений на использование для каждого способа доступа. Если ваш практический вопрос звучит так: “Какая модель лучше всего справится с этой задачей?”, то мультимодельное рабочее пространство может стать наиболее удобным отправным пунктом: используйте один и тот же типичный промпт и файлы, а затем сравните результаты, не настраивая API заново для каждой модели.
Попробуйте Kimi K3 в GlobalGPT если вы хотите протестировать его вместе с другими доступными моделями в одной рабочей среде. Это просто один из вариантов доступа, а не утверждение о том, что каждый тарифный план включает все функции K3 или что он заменяет прямой API для разработки.
- Революционные потребительские продукты для общего общения и работы с файлами.
- API Moonshot для разработки, отслеживания токенов и настраиваемых интеграций.
- Мультимодельная рабочая среда для сравнения одной типовой задачи на различных доступных моделях.
Кто должен включить «Kimi K3» в список финалистов?
K3 отлично подходит для исследователей, аналитиков и разработчиков, которые регулярно работают со сложным исходным материалом или крупными проектами. Его также стоит попробовать при составлении отчетов с большим количеством диаграмм и при выполнении офисной работы, когда объем задания достаточно велик, чтобы оправдать использование реального логического анализа вместо быстрого ответа по шаблону.
Если для вас приоритетом является минимально возможная стоимость токенов, облегченный режим для рутинной работы или возможность самостоятельного хостинга весов уже сегодня, то я бы порекомендовал поискать другие решения. Всем остальным стоит рассматривать K3 как привлекательный новый вариант: поручите ему реальную задачу, сравните результат с инструментами, которым вы уже доверяете, и посмотрите, стоит ли дополнительное время, затрачиваемое на вычисления, того, чтобы подождать.
Окончательный вердикт
Kimi K3 — одна из самых интересных новинок этого года. Первые независимые данные и отзывы WebDev подтверждают заявления компании Moonshot, а контекстное окно размером 1 Мб придает проекту явную практическую ценность. Начните с программирования, исследований и работы с объемными документами — именно в этих областях его дизайн выглядит наиболее полезным.
K3 не станет оптимальным выбором для всех запросов, и его стоимость не соответствует цене модели для повседневного общения. Однако если задача достаточно сложна, чтобы оправдать использование модели, которая тратит время на обдумывание, она заслуживает места в вашем наборе инструментов. Самый простой способ принять решение — поручить ей выполнение той задачи, которая обычно замедляет работу вашей команды, и сравнить результат с результатом модели, которую вы используете сегодня.
Если вы ищете более простой способ сравнить, как вещь сидит на вас, см. планы GlobalGPT и запустите ту же реальную задачу на доступных вам моделях.
Часто задаваемые вопросы
Что такое Kimi K3?
Kimi K3 — это флагманская модель логического вывода компании Moonshot AI, выпущенная 16 июля 2026 года. По данным Moonshot, модель имеет 2,8 триллиона параметров, задействует 16 из 896 экспертов, принимает текст и изображения и поддерживает контекстное окно размером 1 048 576 токенов.
Kimi K3 — это проект с открытым исходным кодом или с открытыми техническими характеристиками?
Компания Moonshot AI заявила, что полные веса модели K3 будут опубликованы к 27 июля 2026 года. По состоянию на 17 июля на официальном сайте Hugging Face модель K3 не фигурировала. До публикации репозитория и лицензии наиболее точным описанием ситуации является запланированный выпуск открытых весов.
Сколько стоит Kimi K3?
Официальная цена API, зафиксированная 17 июля, составила $0,30 за миллион кэшированных входных токенов, $3 за миллион некэшированных входных токенов и $15 за миллион выходных токенов. Налоговые сборы, наценки провайдеров, квоты и региональные цены могут повлиять на итоговую стоимость.
Можно ли бесплатно опробовать Kimi K3?
17 июля на странице с ценами для потребителей сервиса Kimi был указан бесплатный тарифный план «Adagio», а услуга K3 также была доступна по платным тарифам или в рамках квот. Доступность бесплатных услуг может быть ограничена в зависимости от региона, пропускной способности и лимита использования, поэтому не следует считать, что она является неограниченной.
Действительно ли Kimi K3 поддерживает контекстное окно длиной 1 млн токенов?
Да. На официальной странице «Быстрый старт» и «Цены» указано, что окно контекста вмещает 1 048 576 токенов. Это максимальный объем контекста, а не гарантия того, что каждый ответ, содержащий длинный документ, будет точным или полностью цитированным.
Может ли Kimi K3 анализировать PDF-файлы, диаграммы и таблицы?
K3 принимает текст и изображения, а Moonshot предоставляет отчеты о результатах тестирования на основе тестов для электронных таблиц и визуальных агентов. В данном обзоре не представлена проверка PDF-файлов, диаграмм или электронных таблиц на уровне отдельных задач, поэтому пользователям следует самостоятельно проверять точные значения, ссылки на страницы, легенды, формулы и пропущенные строки.
Подходит ли Kimi K3 для научной работы и офисных задач?
Имеющиеся результаты тестирования позволяют отнести K3 к числу наиболее перспективных решений для научно-исследовательской и офисной работы, особенно при работе с объемными документами и проведении структурированного анализа. Однако пока не подтверждена точность цитирования, надежность при работе с несколькими файлами, а также качество конечных результатов в рамках конкретного рабочего процесса.
Можно ли использовать Kimi K3 в Codex?
Компания Moonshot публикует руководство по интеграции с Codex, в котором описывается использование CC Switch для преобразования трафика API Codex Responses в функции автозаполнения Kimi Chat. CC Switch является сторонним программным обеспечением, поэтому организациям следует ознакомиться с маршрутом передачи данных и требованиями к безопасности перед использованием конфиденциальных репозиториев или документов.
В чём разница между Kimi K3 и Kimi Work?
Модель — это Kimi K3. Kimi Work — это среда работы с продуктом, в которой модели объединены с файлами, инструментами, действиями в браузере, созданием документов Office, запланированными задачами и другими функциями рабочего процесса. Функция, представленная в Kimi Work, не всегда автоматически реализуется с помощью простого вызова API K3.


