NezhaGateNezhaGate
Чат

GPT-6 Luna

⧉
gpt-6-luna
Тип модели AstraSolLuna

GPT-6 Luna — самая эффективная модель в семействе GPT-6, созданная для сфокусированных высоконагруженных задач: тот же контекст на 1,050,000 токенов и до 128,000 выходных токенов, reasoning_effort в шести шагах от none до max, ввод изображений и вызов инструментов. Полностью совместима с OpenAI SDK - укажите в поле model значение gpt-6-luna - и доступна как на /chat/completions, так и на /responses. Оплата по факту использования, неудачные вызовы никогда не оплачиваются; кэшированный ввод оплачивается по одной десятой цены.

ЧатСемейство GPT-6БыстроНедорого1.05M контекст

Онлайн-тест · Песочница

Попробуйте GPT-6 Luna прямо здесь (доступно после входа).

Ввод

Дополнительно

Эта модель работает через вышестоящего провайдера на основе подписки ChatGPT, который не принимает temperature / top_p / max_tokens (они молча игнорируются). Используйте reasoning_effort ниже, чтобы задать глубину рассуждения, а для длины — формулировку промпта.

Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О GPT-6 Luna

GPT-6 Luna — самая эффективная модель в линейке GPT-6 от OpenAI, созданная для сфокусированных высокообъёмных задач; доступна на NezhaGate через совместимый с OpenAI API: то же контекстное окно на 1,050,000 токенов, до 128,000 выходных токенов за вызов, reasoning_effort в шести ступенях от none до max, ввод изображений и вызов инструментов — как на /chat/completions, так и на /responses. Укажите gpt-6-luna в поле model — и подключение готово. Оплата по факту использования, неудачные вызовы никогда не оплачиваются, а кэшированный ввод тарифицируется по одной десятой цены ввода.

Сценарии использования

Высокообъёмный чат и классификация

Ответы поддержки, определение намерений и извлечение тегов в больших объёмах — там, где на первом месте стоимость и задержка.

Простые шаги внутри агентных цепочек

Множество мелких шагов принятия решений и форматирования в агентной цепочке: Luna экономит и время, и бюджет.

Массовая работа с длинными документами

Контекст на 1,050,000 токенов по очень низкой цене за единицу подходит для массового реферирования, извлечения данных и переписывания длинных документов.

Быстрое прототипирование

Сначала запустите весь процесс целиком на Luna, а затем переведите критичные шаги на GPT-6 Sol или Astra.

Как выбрать

Направляйте простые, высокообъёмные и чувствительные к задержке задачи на GPT-6 Luna; переходите на GPT-6 Sol ради более сильного кода и рассуждения и на GPT-6 Astra для самых сложных задач. Все три модели принадлежат к линейке GPT-6, поэтому переключение — это изменение всего одного поля.

Частые вопросы

Чем она отличается от GPT-6 Sol?
Luna быстрее и дешевле, создана для высокообъёмного трафика с низкой задержкой; Sol сильнее в сложной разработке и агентных рабочих процессах. Контекст и интеграция идентичны.
Какие уровни reasoning_effort поддерживаются?
Шесть: none / low / medium / high / xhigh / max. Если параметр не указан, шлюз запрашивает medium — значение по умолчанию у самой модели; чем глубже рассуждение, тем больше выходных токенов, оплата — по фактическому расходу.
Поддерживается ли потоковый вывод?
Да. Передайте stream=true, и ответ будет приходить частями по SSE.
Взимается ли плата за неудачные вызовы?
Нет. Оплачиваются по фактическому расходу только вызовы, вернувшие корректный ответ; ошибки вышестоящего провайдера и тайм-ауты никогда не затрагивают ваш баланс.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →