Notebookcheck Logo

Что на самом деле стоит за рекордными показателями Kimi K3

Главный экран веб-интерфейса Kimi с полем ввода и логотипом K3
ⓘ Screenshot: Kimi.com / Moonshot AI
За простым интерфейсом скрывается крупнейшая открытая модель искусственного интеллекта
Новая флагманская модель Китая бьёт рекорды по размеру, и заголовки появляются один за другим. Сама компания Moonshot ставит Kimi K3 на третье место после Claude и GPT. Мы разберём, что на самом деле означают эти цифры, сможете ли вы когда-нибудь запустить эту модель самостоятельно, сколько она на самом деле стоит и что происходит с вашими входными данными.

Модель Kimi K3 доступна в сети с 16 июля, и судя по заголовкам, создается впечатление, будто Китай только что обогнал США. Обладая 2,8 триллионами параметров, это крупнейшая модель, весовые коэффициенты которой планируется сделать общедоступными. Некоторые наблюдатели уже называют это событие «новым моментом DeepSeek».

Однако самое интересное утверждение об этой модели содержится не в заголовках, а в собственном техническом блоге компании Moonshot. Там разработчик пишет, что общая производительность по-прежнему уступает самым мощным проприетарным моделям, а именно Claude Fable 5 и GPT-5.6 Sol. Компания, которая представляет собственный продукт и заявляет, что он не является лучшим, — явление редкое. Именно поэтому эти рекордные показатели заслуживают более пристального внимания.

Мы уже освещали саму новость о том, что K3 доступна и её можно бесплатно опробовать. В этой статье речь пойдёт о том, что будет дальше.

Первое место и что оно на самом деле означает

K3 действительно побеждает в одном важном сравнении. В тесте Frontend Code Arena, где участники видят два результата рядом и выбирают лучший, не зная, какая модель его сгенерировала, K3 занимает первое место. Опередив даже Claude и GPT.

Но есть один нюанс: этот тест оценивает субъективные предпочтения. Пользователи оценивают, какой веб-интерфейс им нравится больше. Это многое говорит о дизайне, но мало — о правильности. Любой, кто интерпретирует это как «Kimi превосходит американские модели», упускает разницу между рейтингом предпочтений и тестом на точность.

Почему таблицы тестовых результатов требуют внимательного изучения

Компания Moonshot публикует результаты своих измерений, и самое интересное содержится в сносках. В зависимости от теста каждая модель запускалась в различной среде агентов: то в KimiCode, то в Claude Code, то в Codex. Это разные исходные условия, а не «чистая гонка» на одной и той же трассе.

В одном из тестов по кодированию сама компания Moonshot признаёт, что модель Claude Fable 5 в 35 процентах задач сталкивалась с резервными механизмами, что, возможно, снизило её оценку. В другом тесте модель K3 достигает максимального результата только при использовании метода, сжимающего контекст до 300 000 токенов. Без такого управления контекстом показатель снижается.

О том, насколько легко такие цифры могут измениться, свидетельствует оценка независимой аналитической компании Artificial Analysis. В ней показатель «галлюцинаций» модели Kimi K3 составляет 49 %. На первый взгляд это кажется слабым результатом. Однако шкала построена в обратном порядке: она учитывает, как часто модель не допускает ошибок. Чем выше показатель, тем лучше; в том же списке модель Claude Fable 5 занимает место ниже K3 с результатом 45 %, а несколько вариантов GPT-5.6 отстают значительно дальше.

Стоит запомнить следующее правило: прежде чем доверять заголовкам о результатах тестирования, проверьте, что именно измерялось и в какую сторону ориентирована шкала.

Можете ли вы запустить K3 самостоятельно?

Для наших читателей это и есть главный вопрос. Честный ответ: для обычных пользователей это практически не будет иметь значения, даже после публикации весов. Причина кроется просто в размере.

Посчитайте сами. Компания Moonshot с самого начала обучает модель K3 в компактном числовом формате MXFP4, в котором на каждый вес приходится около четырёх битов. Веса, также называемые параметрами, представляют собой обученные числовые значения, из которых состоит модель искусственного интеллекта. При 2,8 триллионах параметров размер одного только файла модели составляет примерно 1,4 терабайта. Не гигабайта. А терабайта. Для сравнения: типичная модель с восемью миллиардами параметров, которая работает на хорошо оснащённом ноутбуке, занимает около пяти гигабайт.

Файл модели объёмом 1,4 терабайта: K3 слишком велик для любого домашнего ПК

Сама компания Moonshot рекомендует запускать K3 на суперузлах, оснащённых 64 или более ускорителями. Это не чрезмерная осторожность, а простое следствие указанных параметров. Мощность одной профессиональной видеокарты с 96 гигабайтами памяти в десять раз ниже требуемой.

Поэтому термин «открытые веса» не означает, что вы сможете запустить эту модель у себя дома. Это означает, что исследователи, компании и поставщики облачных услуг могут загрузить её, изучить и запустить на своей собственной инфраструктуре, а не только арендовать через серверы Moonshot. Это ценно, но отличается от того, что представляют себе многие люди.

Если вы действительно хотите использовать ИИ без облака на своём собственном компьютере, правильным выбором станут небольшие модели, созданные специально для этой задачи. В отдельной статье мы показали, как это работает и какое оборудование для этого потребуется.

Примечание для тех, кто интересуется техническими деталями: поскольку модель K3 с самого начала обучалась с такой низкой точностью, её компактный формат является исходным состоянием, а не результатом последующего сжатия. Обычный вопрос о том, насколько снижение размера сказывается на качестве, в данном случае не возникает в том же ключе.

Сколько это стоит на практике

Расчеты осуществляются в токенах — небольших фрагментах текста, как правило, состоящих всего из нескольких символов. Через API компания Moonshot взимает 3 доллара за миллион входных токенов и 15 долларов за миллион выходных токенов. Повторные вводные запросы тарифицируются по цене 30 центов, что значительно дешевле.

В связи с этим K3 уже не является выгодным вариантом. Он обходится примерно в три раза дороже своего предшественника, который взимал чуть менее одного доллара за ввод. По сравнению с Claude Fable 5, стоимость которого составляет 10 и 50 долларов, K3 явно дешевле. Однако Claude Sonnet 5 по-прежнему предлагается по более низкой цене — в рамках текущей вводной акции за 2 и 10 долларов — и сравняется с K3 только в сентябре. Эпоха китайских моделей, конкурирующих в основном по цене, в Moonshot подходит к концу.

Стоимость K3 в три раза превышает стоимость его предшественника, но остаётся ниже цены Fable 5

Есть ещё один момент, который легко упустить из виду. В настоящее время K3 всегда работает на максимальном уровне интенсивности. В будущем компания Moonshot планирует добавить более экономичные режимы работы. Это обеспечивает исчерпывающие ответы, но также означает, что даже простой вопрос запускает ресурсоёмкий процесс рассуждений. Независимые измерения также показывают, что скорость модели составляет около 62 токенов вывода в секунду, что соответствует среднему показателю по скорости.

Что происходит с вашими входными данными

Для всех, кто пробует K3 в приложении или на веб-сайте, этот раздел имеет наибольшее значение. В политике конфиденциальности Moonshot прямо указано, что вводные данные, аудиозаписи, изображения, видео и файлы обрабатываются с целью предоставления и улучшения услуг, что явно включает обучение и оптимизацию собственных моделей.

В политике нигде не указано наличие специального переключателя, позволяющего отключить обучение на основе вашего контента. В ней указывается на общие права субъектов данных, которыми вы можете воспользоваться через настройки своей учетной записи или путем отправки электронного письма контактному лицу по вопросам конфиденциальности. ChatGPT и Claude, напротив, разместили соответствующий переключатель прямо в настройках.

Кроме того, в политике указано: собираемые данные включают IP-адрес, идентификаторы устройств, идентификаторы сеансов и бесед, а также, если это допускают настройки устройства, данные из буфера обмена. Что касается места хранения, в политике указано лишь то, что данные могут передаваться на серверы за пределами страны вашего проживания. Конкретные страны не называются. Поставщиком услуг является компания Moonshot AI PTE. LTD., расположенный в Сингапуре, а дата политики — 7 июля 2025 года.

Для тестового использования с безобидными задачами это приемлемо. Что касается внутренних данных компании, данных клиентов или личных документов, здесь действует то же правило, что и в случае с любым облачным сервисом, только в данном случае речь идет о провайдере, чьи собственные условия прямо предусматривают использование данных для обучения.

Кому Kimi K3 принесёт наибольшую пользу

Попробовать его можно совершенно бесплатно. Наибольшую выгоду получат две группы: те, кто занимается разработкой или дизайном, и те, кто регулярно работает с очень длинными документами. K3 особенно сильна там, где пересекаются код и визуальные элементы: в веб-интерфейсах, 3D и анимации. Контекстное окно объёмом в один миллион токенов — весомый аргумент в пользу работы с длинными текстами, а обработка изображений встроена в систему.

Если вам требуется наилучшее качество ответов или максимально плавная работа, лучшим выбором по-прежнему остаются ведущие американские модели. Об этом заявляет сама компания Moonshot. А тем, кто надеется в ближайшее время установить передовую модель на свой компьютер, следует помнить об объёме в 1,4 терабайта.

Удивительным в K3 является не столько её место в рейтинге, сколько темпы развития. Китайская компания представляет модель, не уступающую лучшим в мире, и открывает доступ к данным модели. Два года назад это было бы трудно представить.

Google LogoAdd as a preferred source on Google
Mail Logo
Steffen Zahn, 2026-07-20 (Update: 2026-07-20)