GPT-5.6 Luna
⧉GPT-5.6 Luna — быстрая и экономичная модель в семействе GPT-5.6, ориентированная на низкую задержку и экономичность для высоконагруженных чатов и агентных задач с низкой задержкой. Полностью совместима с OpenAI SDK: укажите в поле model значение gpt-5.6-luna — и всё готово.
Онлайн-тест · Песочница
Попробуйте GPT-5.6 Luna прямо здесь (доступно после входа).
Ввод
Дополнительно
Эта модель работает через вышестоящего провайдера на основе подписки ChatGPT, который не принимает temperature / top_p / max_tokens (они молча игнорируются). Используйте reasoning_effort ниже, чтобы задать глубину рассуждения, а для длины — формулировку промпта.
Диалог
О GPT-5.6 Luna
GPT-5.6 Luna — быстрая и экономичная модель семейства GPT-5.6, ориентированная на низкую задержку и экономичность для высоконагруженных чат- и агентных сценариев с низкой задержкой. Полностью совместима с OpenAI SDK, поддерживает потоковый вывод и reasoning_effort; укажите в поле model значение gpt-5.6-luna — и вы подключены. Оплата по факту использования, неудачные запросы никогда не оплачиваются.
Сценарии использования
Ответы поддержки, определение намерений и извлечение тегов в больших объёмах, где на первом месте стоимость и задержка.
Множество простых шагов принятия решений и форматирования внутри агентного флоу: Luna экономит и время, и бюджет.
Сначала запустите флоу на Luna, а затем перенесите критичные шаги на Terra или Sol.
Как выбрать
Простые, высоконагруженные и чувствительные к задержке задачи — для Luna; переключайтесь на Terra ради более сильного рассуждения и на Sol — для самых сложных задач, меняя только поле model.
Частые вопросы
Чем она отличается от Terra?
Поддерживается ли потоковый вывод?
Какого размера контекстное окно?
Спишутся ли деньги за неудачные запросы?
Похожие модели
Изучите другие модели, которые можно подключить.
GPT-5.6 Terra
Сбалансированная модель для повседневного агентного программирования
GPT-5.6 Sol
Флагман на переднем крае агентного программирования
GPT-5.5
Флагманская модель для чата и рассуждений
Gemini 2.5 Flash
Быстрый и экономичный чат с низкой задержкой
Gemini 3 Flash
Быстрая, экономичная модель чата с низкой задержкой
GPT-6 Astra
Флагман OpenAI нового поколения — контекст 1.05M