NezhaGateNezhaGate
Чат

Kimi K3

⧉
kimi-k3

Kimi K3 — новый флагман Moonshot AI, сильный в понимании длинных документов, анализе нескольких документов и написании текстов на китайском языке, с отличной поддержкой агентов и инструментов. Модель всегда рассуждает перед ответом, рассуждение возвращается в reasoning_content; температура сэмплирования фиксирована самой моделью, поэтому temperature / top_p в запросе игнорируются. Поддерживаются вызов функций, потоковый вывод и кэширование промптов (повторяющийся длинный префикс тарифицируется по ставке кэша). Полностью совместима с OpenAI: укажите в поле model значение kimi-k3. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

ЧатДлинный контекстАгентыВызов функцийСовместим с OpenAI

Почему эта модель

Новый флагман Moonshot: 2,8 трлн параметров, открытые веса и контекст около 1M токенов

Особенности

  • 2,8 трлн параметров и открытые веса — одна из крупнейших моделей с открытыми весами на сегодня
  • Контекст около 1M токенов (1 048 576): можно передать длинный документ целиком
  • Рассуждает по умолчанию; ход рассуждения приходит отдельно в reasoning_content и не смешивается с ответом
  • Вызов инструментов, потоковый вывод и кэширование промптов; повторяющийся длинный префикс оплачивается по цене кэша
  • Совместимость с OpenAI: в существующем коде на SDK меняются только base_url и model

Цена относительно официального прайс-листа

NezhaGateБазовая цена Ввод$1.8$3 Вывод$9$15

За 1M токенов, USD · Вы экономите ↓40%

Скопировать и вызвать

curl
curl https://nezhagate.com/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model": "kimi-k3", "messages": [{"role": "user", "content": "Hello"}]}'
Python
from openai import OpenAI

client = OpenAI(api_key="YOUR_API_KEY", base_url="https://nezhagate.com/v1")
r = client.chat.completions.create(model="kimi-k3", messages=[{"role": "user", "content": "Hello"}])
print(r.choices[0].message.content)

Замените YOUR_API_KEY на ключ из вашей консоли.

Онлайн-тест · Песочница

Попробуйте Kimi K3 прямо здесь (доступно после входа).

Ввод

Дополнительно
Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О Kimi K3

Kimi K3 — новый флагман от Moonshot AI, доступный на NezhaGate через совместимый с OpenAI API. Модель сильна в понимании длинных документов, анализе нескольких документов одновременно и в написании текстов на китайском языке, а также отлично работает с агентами и вызовом инструментов. Она всегда рассуждает перед ответом: рассуждение возвращается в message.reasoning_content, а ответ — в content. Температура сэмплирования зафиксирована самой моделью, поэтому шлюз игнорирует temperature / top_p в запросе, вместо того чтобы возвращать ошибку. Поддерживаются вызов инструментов, потоковый вывод и кэширование промптов. Укажите в поле model значение kimi-k3; оплата по факту использования, неудачные вызовы никогда не оплачиваются.

Сценарии использования

Длинные документы и анализ нескольких документов

Резюме, сравнения и ответы на вопросы по длинным контрактам, статьям или финансовым отчётам; мы проверили, что модель точно находит факты внутри документов объёмом более 100K токенов.

Агенты и вызов инструментов

Инструменты и tool_calls в формате OpenAI для дополнения ответов данными (retrieval augmentation), вызова функций и оркестрации многошаговых задач.

Написание текстов на китайском

Длинные статьи, отчёты, рекламные тексты и их доработка на естественном, беглом китайском языке.

Сложные рассуждения

Модель рассуждает перед ответом, что подходит для задач по математике, логике и многошаговых задач; рассуждение видно в reasoning_content.

Как выбрать

Выбирайте Kimi K3 в первую очередь для длинных документов, работы с несколькими документами и агентных задач; для повседневного общения по более низкой цене также подойдут DeepSeek V4.1 Flash или GLM-5.3. Переключение — это всего лишь изменение поля model.

Частые вопросы

Влияет ли параметр temperature на что-либо?
Kimi K3 использует температуру сэмплирования, зафиксированную самой моделью, поэтому шлюз игнорирует temperature и top_p в запросе (ошибка не возвращается). Стиль вывода определяет сама модель.
Можно ли отключить рассуждение?
Нет. Kimi K3 всегда рассуждает перед ответом, и токены рассуждения оплачиваются по цене вывода в рамках usage.completion_tokens. Чтобы получить более короткие ответы, попросите об этом прямо в промпте.
Что нужно знать о длинных ответах?
Для длинного контента, генерация которого занимает больше примерно 2 минут, используйте stream=true; запрос без потокового вывода может быть прерван по тайм-ауту. Если max_tokens меньше 256, шлюз повышает его до 256, чтобы рассуждение не съедало весь бюджет токенов.
Поддерживается ли кэширование промптов?
Да. Повторяющийся длинный префикс, например один и тот же длинный документ, попадает в кэш, и закэшированная часть оплачивается по ставке кэша, которая значительно ниже цены ввода.
Взимается ли плата за неудачные вызовы?
Нет. Оплачиваются только вызовы, завершившиеся нормально, по фактическому расходу; ошибки вышестоящего провайдера и тайм-ауты никогда не затрагивают ваш баланс.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →