NezhaGateNezhaGate
Anthropic ● Скоро

Claude Haiku 5.5

claude-haiku-5-5

API Claude Haiku 5.5: самая быстрая, дешёвая и способная небольшая модель Anthropic на сегодня — контекст 1 млн токенов, первый Haiku с настройкой effort и официальные цены до 90% ниже, чем у Haiku 4.5

Claude Haiku 5.5 — новый Haiku от Anthropic, выпущенный 7 октября 2026 года на смену Claude Haiku 4.5. Anthropic называет его самой дешёвой, быстрой и способной небольшой моделью из всех, что выпускала, и это модель с самой низкой задержкой в текущей линейке Claude. Она рассчитана на массовые задачи, где важны скорость и цена: классификация, маршрутизация, извлечение данных, резюме и сжатие контекста, поддержка клиентов в реальном времени, а также роль субагента в агентах для программирования во главе с Claude Opus 5.5 или Sonnet 5.5. Контекст — 1 млн токенов, ответ — до 128 тыс. токенов; адаптивное мышление включено по умолчанию, и это первый Haiku с настройкой effort (пять уровней от low до max, по умолчанию medium). Для промптов до 100 тыс. токенов официальная цена — $0.10 за ввод и $0.50 за вывод за миллион токенов, на 90% ниже, чем у Haiku 4.5. Мы уже подключаем модель: оставьте email, и мы напишем в день запуска.

Выпущено производителем: 2026-10-07 · пока недоступна на NezhaGate

Особенности

Что улучшилось по сравнению с Haiku 4.5

В пять раз больше контекста, вдвое больше вывода, впервые настройка effort и намного более сильные агентные результаты — при более низкой цене.

Claude Haiku 4.5Claude Haiku 5.5
Выход2025-10-152026-10-07
Контекстное окно200 тыс. токенов1 млн токенов
Максимальный вывод за запрос64 тыс. токенов128 тыс. токенов
МышлениеРучной бюджет (budget_tokens)Адаптивное, включено по умолчанию
Настройка effortНетlow / medium / high / xhigh / max, по умолчанию medium
Надёжные знания дофевраля 2025 г.июня 2026 г.
Инструмент для работы с браузеромНетЕсть
Официальная цена: ввод (за 1 млн токенов)$1$0.10 (промпты до 100 тыс. токенов) / $0.50 (свыше 100 тыс.)
Официальная цена: вывод (за 1 млн токенов)$5$0.50 / $2.50
Официальная цена: чтение кэша (за 1 млн токенов)$0.10$0.01 / $0.05
OSWorld 2.1, офлайн-подмножество (управление компьютером)15.7%72.4%
Terminal-Bench 4.0 (агентные задачи в командной строке)0.0%39.2%
Humanity’s Last Exam (без инструментов / с инструментами)10.2% / 18.7%45.9% / 57.4%
GDPval-AA v2.1 (реальные рабочие задачи, Elo)7351620
AA-Briefcase v1.1 (агентная работа со знаниями, Elo)6141578

Характеристики и цены — из документации Anthropic, результаты тестов — из анонса Anthropic от 7 октября 2026 года. Цены в таблице — официальные цены Anthropic, а не наши. Haiku 5.5 использует новый токенизатор, который считает тот же текст примерно на 30% длиннее в токенах; по данным Anthropic, в среднем модель всё равно обходится примерно на 75% дешевле, чем Haiku 4.5.

Сценарии использования

Массовая классификация, разметка, определение намерений и маршрутизация запросов
Извлечение данных: поля из договоров, веб-страниц и переписки — в структурированный JSON
Резюме и сжатие контекста для длинных документов и долгих диалогов
Субагенты в агентах для программирования: поиск по коду, чтение файлов, запуск команд и сбор результатов для основной модели
Поддержка клиентов в реальном времени, чат-боты и ответы на вопросы по базам данных
Агенты для работы с браузером и компьютером: заполнение форм, переходы по страницам, сбор информации с разных сайтов

FAQ

Что улучшилось в Claude Haiku 5.5 по сравнению с Haiku 4.5?
Главное — пять пунктов. (1) Контекст вырос с 200 тыс. до 1 млн токенов, лимит вывода — с 64 тыс. до 128 тыс. токенов. (2) Вместо ручного бюджета мышления (budget_tokens) — адаптивное мышление, и у Haiku впервые появилась настройка effort. (3) Резкий рост в агентных задачах: OSWorld 2.1 — с 15.7% до 72.4%, Terminal-Bench 4.0 — с 0.0% до 39.2%, Humanity’s Last Exam без инструментов — с 10.2% до 45.9%. (4) Надёжные знания теперь до июня 2026 года (было — до февраля 2025-го), добавлен инструмент для работы с браузером. (5) Цены ниже: на 90% за токен для промптов до 100 тыс. токенов и на 50% — для более длинных. Anthropic также сообщает о заметных улучшениях по сравнению с Haiku 4.5 почти во всех своих оценках согласованности (alignment).
Какая официальная цена Claude Haiku 5.5?
Anthropic использует две ценовые ступени в зависимости от длины промпта (за миллион токенов). Промпты до 100 тыс. токенов: ввод $0.10, вывод $0.50, запись в 5-минутный кэш $0.125, запись в часовой кэш $0.20, чтение кэша $0.01. Промпты свыше 100 тыс. токенов: все тарифы в пять раз выше — ввод $0.50, вывод $2.50, чтение кэша $0.05. Batch API экономит ещё 50%. Для сравнения: Haiku 4.5 стоит $1 за ввод и $5 за вывод. Это официальные цены Anthropic; нашу цену мы опубликуем при запуске.
Haiku 5.5 расходует больше токенов?
Есть два момента. Во-первых, модель использует новый токенизатор, появившийся в Claude Opus 4.7, поэтому тот же текст даёт примерно на 30% больше токенов, чем у Haiku 4.5. Во-вторых, мышление включено по умолчанию, а его токены оплачиваются как вывод и входят в max_tokens; чем выше effort, тем больше модель размышляет. Независимая компания Artificial Analysis насчитала около 162 тыс. выходных токенов на одну задачу своего Intelligence Index при effort max. Для массовых простых запросов обычно хватает low или medium по умолчанию. С учётом всего этого, по данным Anthropic, в среднем Haiku 5.5 обходится примерно на 75% дешевле, чем Haiku 4.5.
Какой уровень effort выбрать и можно ли отключить мышление?
Рекомендации Anthropic: для большинства задач, включая агентное программирование, начинайте с medium — это значение по умолчанию. Для чатов, коротких задач с инструментами и массовых простых запросов берите low — самый быстрый и дешёвый уровень; но в длинных промптах для агентов на low модель чаще пропускает поиск или заканчивает раньше времени. Для работы со знаниями, длинных агентных задач и строгого следования инструкциям используйте high. К xhigh и max переходите, только если ваши тесты показывают выигрыш в качестве, и сравнивайте их с Sonnet 5.5 по качеству, цене и скорости. Мышление можно отключить через thinking: disabled на уровне high и ниже, но не на xhigh и max. Текст размышлений по умолчанию не возвращается; чтобы получить краткое изложение, задайте thinking.display = summarized.
Что поменять при переходе с Haiku 4.5?
Основное: ID модели — claude-haiku-5-5 (без суффикса с датой); бюджет мышления (budget_tokens) теперь даёт ошибку 400, используйте адаптивное мышление и effort; уберите temperature, top_p и top_k (top_k, а также temperature или top_p не по умолчанию дают 400); предзаполнение ответа ассистента (prefill) больше не принимается — используйте структурированный вывод или задайте формат в системном промпте; ответ может начинаться с блоков мышления, поэтому выбирайте текстовые блоки по type, а не по позиции; тот же текст даёт больше токенов — пересчитайте max_tokens и оценку стоимости; управление компьютером переходит на набор computer_toolset_20260801; обрабатывайте stop_reason refusal, потому что классификаторы безопасности могут отклонить запрос.
Когда здесь можно будет вызвать Claude Haiku 5.5?
Мы подключаем и тестируем модель. Как только её можно будет стабильно вызывать, страница переключится в статус «доступна» и покажет цену. Оставьте email — мы напишем в день запуска.
Как вызывать модель после запуска и работает ли она с Claude Code?
Подойдут оба API: OpenAI-совместимый (/v1/chat/completions) и нативный Anthropic Messages API (/anthropic), модель — claude-haiku-5-5. Claude Code отправляет многие мелкие фоновые задачи своей модели Haiku; после запуска Haiku 5.5 укажите claude-haiku-5-5 в качестве модели Haiku в Claude Code. Как это сделать, описано на странице Claude Code в нашей документации.
Есть ли модель Claude, которой можно пользоваться уже сейчас?
Да. Claude Sonnet 5.5, Claude Opus 5.5 и Claude Sonnet 5 уже доступны, их можно вызывать прямо сейчас. Если пока нужна дешёвая и быстрая небольшая модель, есть также Gemini 3.8 Flash, DeepSeek V4.1 Flash и GPT-6 Luna.

Доступно сейчас

Эти модели уже доступны на NezhaGate:

Смотреть все →