NezhaGateNezhaGate
Чат

Doubao Seed 2.1 Pro

⧉
doubao-seed-2-1-pro
Тип модели ProTurbo

Doubao Seed 2.1 Pro — флагманская модель серии Doubao Seed 2.1 от ByteDance для рассуждений, кода и работы с агентами, с поддержкой ввода изображений. По умолчанию модель думает перед ответом, рассуждение возвращается в reasoning_content; с reasoning_effort: "minimal" модель обычно пропускает рассуждение и сразу отвечает (8 из 10 вызовов в наших тестах, без гарантии). Поддерживаются вызов функций, вывод в JSON и потоковый вывод, а изображения можно передавать в base64 или публичными ссылками. Полностью совместима с OpenAI: укажите в поле model значение doubao-seed-2-1-pro. Оплата по факту использования, неудачные запросы никогда не оплачиваются.

ЧатРассуждениеКодВвод изображенийСовместим с OpenAI

Онлайн-тест · Песочница

Попробуйте Doubao Seed 2.1 Pro прямо здесь (доступно после входа).

Ввод

Дополнительно
Веб-поиск
Память · многоходовой диалог

Диалог

Начните диалогВведите сообщение ниже, чтобы начать

О Doubao Seed 2.1 Pro

Doubao Seed 2.1 Pro — флагманская модель серии Doubao Seed 2.1 от ByteDance, доступная на NezhaGate через совместимый с OpenAI API. Она предназначена для рассуждений, написания кода и работы с агентами и принимает изображения. По умолчанию модель думает перед ответом: рассуждение возвращается в message.reasoning_content, а ответ — в content; с reasoning_effort: "minimal" модель обычно пропускает рассуждение и отвечает сразу, хотя и не всегда. Поддерживаются вызов функций, вывод в JSON и потоковый вывод. Укажите в поле model значение doubao-seed-2-1-pro; оплата по факту использования, неудачные запросы никогда не оплачиваются.

Сценарии использования

Сложные рассуждения и математика

По умолчанию модель думает перед ответом, что подходит для многошаговых задач, математики и логики; рассуждение видно в reasoning_content.

Код и агенты

tools / tool_calls в формате OpenAI и вывод в JSON подключаются к любому агентному фреймворку для поиска, вызова функций и многошаговых задач.

Понимание изображений

Вопросы и ответы по скриншотам, чекам и графикам; в наших тестах модель точно прочитала текст на изображении. Изображения можно передавать в base64 или публичными ссылками.

Быстрые ответы без рассуждения

С reasoning_effort: "minimal" модель обычно пропускает рассуждение (8 из 10 вызовов в наших тестах), что подходит для простых задач, где нужен только ответ: выходных токенов будет меньше.

Как выбрать

Выбирайте Pro, когда нужны рассуждения, код и работа с агентами на уровне флагмана серии Doubao Seed 2.1; выбирайте Turbo для повседневного общения, больших объёмов или когда важнее всего цена за единицу: она примерно вдвое ниже, чем у Pro, а повторяющийся длинный префикс автоматически попадает в кэш. Обе модели относятся к семейству Doubao Seed 2.1, поэтому для переключения достаточно поменять поле model.

Частые вопросы

Можно ли отключить рассуждение?
Обычно да, но без гарантии. С reasoning_effort: "minimal" модель чаще всего отвечает сразу: в наших тестах 8 из 10 вызовов обошлись без рассуждения, а в остальных 2 оно всё же вернулось. thinking: {"type": "disabled"} на эту модель не действует. Если параметр не указан, модель сначала думает даже над простейшими запросами (приветствие из пяти слов заняло от 362 до 802 токенов в наших тестах), а токены рассуждения оплачиваются по тарифу вывода внутри usage.completion_tokens.
Ограничивает ли max_tokens вывод?
Нет. max_tokens принимается, но не обрывает вывод (при max_tokens 100 приветствие из пяти слов всё равно заняло от 362 до 802 токенов в наших тестах), а оплата идёт по фактическим токенам в usage. Для коротких ответов попросите краткости в промпте; reasoning_effort: "minimal" обычно тоже помогает.
Поддерживается ли кэширование промптов?
С cache_control {"type": "ephemeral"} в части контента повторяющийся длинный префикс может попасть в кэш: в наших тестах все 9 827 входных токенов второго вызова оказались в кэше, и эта часть оплачивалась по тарифу кэша. Без этой пометки попаданий не было. Попадание решает провайдер, а оплата следует возвращённому usage. Если нужен автоматический кэш, выбирайте Turbo.
Что важно знать о длинных ответах?
Модель сначала думает, и ответ в один абзац занимал в наших тестах 50-90 секунд. Для длинного вывода или чувствительных к задержке вызовов используйте stream=true: рассуждение приходит в delta.reasoning_content, ответ — в delta.content, а запрос без потоковой передачи, который ждёт слишком долго, может быть прерван.
Взимается ли плата за неудачные запросы?
Нет. Списание происходит только за успешно завершённые запросы, по фактическому расходу; ошибки провайдера и тайм-ауты никогда не затрагивают ваш баланс.

Похожие модели

Изучите другие модели, которые можно подключить.

Смотреть все →