Kimi K3
⧉Kimi K3 — новый флагман Moonshot AI, сильный в понимании длинных документов, анализе нескольких документов и написании текстов на китайском языке, с отличной поддержкой агентов и инструментов. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content; температура сэмплирования фиксирована самой моделью, поэтому temperature / top_p в запросе игнорируются. Поддерживаются вызов функций, потоковый вывод и кэширование промптов (повторяющийся длинный префикс тарифицируется по ставке кэша). Полностью совместима с OpenAI: укажите в поле model значение kimi-k3. Оплата по факту использования, неудачные запросы никогда не оплачиваются.
Почему эта модель
Новый флагман Moonshot: 2,8 трлн параметров, открытые веса и контекст около 1M токенов
Особенности
- 2,8 трлн параметров и открытые веса — одна из крупнейших моделей с открытыми весами на сегодня
- Контекст около 1M токенов (1 048 576): можно передать длинный документ целиком
- Рассуждает по умолчанию; ход рассуждения приходит отдельно в reasoning_content и не смешивается с ответом
- Вызов инструментов, потоковый вывод и кэширование промптов; повторяющийся длинный префикс оплачивается по цене кэша
- Совместимость с OpenAI: в существующем коде на SDK меняются только base_url и model
Цена относительно официального прайс-листа
За 1M токенов, USD · Вы экономите ↓40%
Скопировать и вызвать
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "kimi-k3", "messages": [{"role": "user", "content": "Hello"}]}'from openai import OpenAI
client = OpenAI(api_key="YOUR_API_KEY", base_url="https://nezhagate.com/v1")
r = client.chat.completions.create(model="kimi-k3", messages=[{"role": "user", "content": "Hello"}])
print(r.choices[0].message.content)Замените YOUR_API_KEY на ключ из вашей консоли.
Онлайн-тест · Песочница
Попробуйте Kimi K3 прямо здесь (доступно после входа).
Ввод
Дополнительно
Диалог
О Kimi K3
Kimi K3 — новый флагман от Moonshot AI, доступный на NezhaGate через совместимый с OpenAI API. Модель сильна в понимании длинных документов, анализе нескольких документов одновременно и в написании текстов на китайском языке, а также отлично работает с агентами и вызовом инструментов. Она всегда рассуждает перед ответом: рассуждение возвращается в message.reasoning_content, а ответ — в content. Температура сэмплирования зафиксирована самой моделью, поэтому шлюз игнорирует temperature / top_p в запросе, вместо того чтобы возвращать ошибку. Поддерживаются вызов инструментов, потоковый вывод и кэширование промптов. Укажите в поле model значение kimi-k3; оплата по факту использования, неудачные вызовы никогда не оплачиваются.
Сценарии использования
Резюме, сравнения и ответы на вопросы по длинным контрактам, статьям или финансовым отчётам; мы проверили, что модель точно находит факты внутри документов объёмом более 100K токенов.
Инструменты и tool_calls в формате OpenAI для дополнения ответов данными (retrieval augmentation), вызова функций и оркестрации многошаговых задач.
Длинные статьи, отчёты, рекламные тексты и их доработка на естественном, беглом китайском языке.
Модель рассуждает перед ответом, что подходит для задач по математике, логике и многошаговых задач; рассуждение видно в reasoning_content.
Как выбрать
Выбирайте Kimi K3 в первую очередь для длинных документов, работы с несколькими документами и агентных задач; для повседневного общения по более низкой цене также подойдут DeepSeek V4.1 Flash или GLM-5.3. Переключение — это всего лишь изменение поля model.
Частые вопросы
Влияет ли параметр temperature на что-либо?
Можно ли отключить рассуждение?
Что нужно знать о длинных ответах?
Поддерживается ли кэширование промптов?
Взимается ли плата за неудачные вызовы?
Похожие модели
Изучите другие модели, которые можно подключить.
GLM-5.3
Новый флагман Z.ai — программирование и агенты
Qwen3.7 Max
Флагман Qwen от Alibaba — рассуждение и код
Grok 4.7
Флагманская модель рассуждений от xAI - длинный контекст
DeepSeek V4.1 Flash
Актуальная модель DeepSeek Flash — рассуждение можно включать и выключать
Claude Sonnet 4.6
Сбалансированная и эффективная модель для чата и кода
Gemini 3.1 Pro
Флагманская модель рассуждения нового поколения от Google