hubris
Логотип Moonshot Kimi — провайдер модели MoonshotAI: Kimi K3

MoonshotAI: Kimi K3

moonshotai/kimi-k3
moonshotai
Выпущена 16 июля 2026 г.|1.0М контекст|379,08 ₽/М вход|1 895,41 ₽/М выход

Kimi K3 — это сверхкрупномасштабная, открытая мультимодальная модель рассуждений от Moonshot AI. Она подходит для сложного кодирования, работы со знаниями и долгосрочных агентных рабочих процессов, и особенно сильна в навигации по большим репозиториям, использовании инструментов, отладке и итерациях с изображениями, логами, тестами и обратной связью во время выполнения. Её архитектура использует KDA и Attention Residuals для вычислительной эффективности.

Провайдер для MoonshotAI: Kimi K3

Hubris маршрутизирует запросы к лучшему доступному провайдеру с автоматическим fallback при сбоях.

moonshotai
Контекст
1.0М
токенов
Макс. ответ
Вход
379,08 ₽
за 1М токенов
Выход
1 895,41 ₽
за 1М токенов
Кеш чтение
37,91 ₽
за 1М токенов

Модальности

Вход:ТекстИзображенияВидеоВыход:Текст

Провайдеры

Запросы обслуживает один из провайдеров ниже — маршрутизация автоматически выбирает оптимального по доступности и скорости в момент запроса. Итоговая стоимость зависит от того, какой провайдер обслужил запрос, и от попадания в кэш: при повторяющемся контексте вход тарифицируется по цене чтения кэша — до 60–80 % дешевле. Цены — в рублях за 1 млн токенов.

Средняя фактическая цена
86,95 ₽
по запросам за 30 дней · за 1 млн токенов
Sail Research
328,54 ₽1 642,69 ₽36,64 ₽98,4 %< 0,1 %
Morph
353,81 ₽1 769,05 ₽36,64 ₽20 т/с80,9 %1,1 %
DigitalOcean
360,13 ₽1 800,64 ₽36,01 ₽23 т/с98,4 %3,1 %
DeepInfra
360,13 ₽1 800,64 ₽36,01 ₽96,3 %< 0,1 %
Fireworks
379,08 ₽1 895,41 ₽37,91 ₽34 т/с98,8 %11,6 %
Chutes
379,08 ₽1 895,41 ₽37,91 ₽18 т/с96,8 %0,6 %
Together
379,08 ₽1 895,41 ₽37,91 ₽23 т/с99,0 %16,4 %
Moonshot AI
379,08 ₽1 895,41 ₽37,91 ₽26 т/с99,7 %59,7 %
Wafer
379,08 ₽1 895,41 ₽37,91 ₽95,4 %< 0,1 %
Modal
379,08 ₽1 895,41 ₽37,91 ₽38 т/с99,4 %7,4 %
BaseTen
379,08 ₽1 895,41 ₽37,91 ₽93,0 %< 0,1 %
Phala
379,08 ₽1 895,41 ₽189,54 ₽94,8 %< 0,1 %
Morph
758,16 ₽2 843,12 ₽75,82 ₽20 т/с69,5 %1,1 %

Доля запросов, скорость и латентность считаются по нашему трафику за 30 дней, в разрезе по провайдеру. У одного провайдера может быть несколько строк — разные регионы или тарифы с отдельными ценами; эти значения общие для провайдера, поэтому в таких строках они совпадают.

Поддерживаемые параметры

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Другие модели от moonshotai

MoonshotAI: Kimi K2.7 Code

MoonshotAI: Kimi K2.7 Code — это модель семейства Kimi K2 от Moonshot AI, ориентированная на кодирование и предназначенная для надёжного выполнения сквозных задач программирования в длинных контекстах. Она использует нативную мультимодальную архитектуру MoE, которая принимает текстовые и графические входные данные, и всегда работает в режиме мышления, сохраняя полное содержание рассуждений в многоходовых диалогах. С окном контекста в 256K токенов, она нацелена на долгосрочное кодирование, декомпозицию агентских задач и многоходовый диалог. Модель активирует 32 миллиарда параметров из примерно 1 триллиона общих.

262К контекст·от 89,72 ₽/М

MoonshotAI: Kimi K2.7 Code (batch)

MoonshotAI: Kimi K2.7 Code — это модель семейства Kimi K2 от Moonshot AI, ориентированная на кодирование и предназначенная для надёжного выполнения сквозных задач программирования в длинных контекстах. Она использует нативную мультимодальную архитектуру MoE, которая принимает текстовые и графические входные данные, и всегда работает в режиме мышления, сохраняя полное содержание рассуждений в многоходовых диалогах. С окном контекста в 256K токенов, она нацелена на долгосрочное кодирование, декомпозицию агентских задач и многоходовый диалог. Модель активирует 32 миллиарда параметров из примерно 1 триллиона общего числа.

262К контекст·от 120,04 ₽/М

MoonshotAI Kimi Latest

Эта модель всегда перенаправляется на последнюю модель в семействе MoonshotAI Kimi.

1.0М контекст·от 328,54 ₽/М

MoonshotAI: Kimi K2.6

Kimi K2.6 — это мультимодальная модель нового поколения от Moonshot AI, разработанная для долгосрочного кодирования, генерации UI/UX на основе кодирования и оркестрации мультиагентов. Она справляется со сложными сквозными задачами кодирования на Python, Rust и Go, а также может преобразовывать промпты и визуальные входные данные в готовые к производству интерфейсы. Её архитектура роя агентов масштабируется до сотен параллельных субагентов для автономной декомпозиции задач — создания документов, веб-сайтов и электронных таблиц за один запуск без участия человека.

262К контекст·от 120,04 ₽/М

MoonshotAI: Kimi K2.5

Kimi K2.5 — это нативная мультимодальная модель Moonshot AI, обеспечивающая передовые возможности визуального кодирования и парадигму самонаправляемой агентной системы. Созданная на базе Kimi K2 с продолженным предварительным обучением на примерно 15 триллионах смешанных визуальных и текстовых токенов, она демонстрирует высокую производительность в общем рассуждении, визуальном кодировании и агентном вызове инструментов.

262К контекст·от 56,86 ₽/М

MoonshotAI: Kimi K2 Thinking

Kimi K2 Thinking — это самая передовая открытая модель рассуждений Moonshot AI на сегодняшний день, расширяющая серию K2 в область агентных рассуждений с длительным горизонтом. Построенная на архитектуре Mixture-of-Experts (MoE) с триллионом параметров, представленной в Kimi K2, она активирует 32 миллиарда параметров за один прямой проход и поддерживает контекстные окна размером 256 тысяч токенов. Модель оптимизирована для последовательного пошагового мышления, динамического вызова инструментов и сложных рабочих процессов рассуждений, охватывающих сотни ходов. Она чередует пошаговые рассуждения с использованием инструментов, обеспечивая автономные исследования, кодирование и написание текстов, которые могут продолжаться сотни последовательных действий без отклонений. Она устанавливает новые открытые бенчмарки на HLE, BrowseComp, SWE-Multilingual и LiveCodeBench, сохраняя при этом стабильное многоагентное поведение на протяжении 200–300 вызовов инструментов. Построенная на крупномасштабной архитектуре MoE с оптимизацией MuonClip, она сочетает в себе сильную глубину рассуждений с высокой эффективностью вывода для требовательных агентных и аналитических задач.

262К контекст·от 75,82 ₽/М