Claude Haiku 5.5 API

Claude Haiku 5.5 вышла 2026-10-07 — это самая дешёвая и быстрая модель Anthropic и первая Haiku с уровнями effort. Цена зависит от длины промпта: до 100K токенов она на 90% дешевле Haiku 4.5, а как только промпт превышает 100K, весь запрос тарифицируется по цене в 5 раз выше. На этой странице — как устроена цена, официальные бенчмарки, выбор между ней, GPT-6 Luna и Sonnet 5.5, отзывы сообщества, ошибки 400 при переходе с Haiku 4.5 и как включить её в Claude Code.

Сравнение цен: официальный API, OpenRouter и Wokey

Цены в USD за 1 млн токенов. Тарифы официального API и OpenRouter проверены вручную 2026-10-08, без учёта налогов; цена Wokey берётся из актуального прайс-листа.

КаналВходныеЧтение из кэшаВыходные
Официальный API$0.1$0.01$0.5
OpenRouter$0.1$0.01$0.5
Wokey$0.08$0.008$0.4

В таблице указаны цены для промптов до 100 000 токенов. Если промпт (входные токены + чтение из кэша + запись в кэш) длиннее 100 000, официальный API и OpenRouter тарифицируют весь запрос по $0.5 за входные / $2.5 за выходные; у Wokey цена тоже зависит от длины промпта — тарифы для длинных промптов приведены в таблице цен ниже.

· Официальная страница цен · Список эндпоинтов OpenRouter

Использование в Claude Code

На Wokey эта модель поддерживает /v1/messages. Задайте эти переменные окружения и запустите claude.

export ANTHROPIC_BASE_URL="https://api.wokey.ai"
export ANTHROPIC_AUTH_TOKEN="$WOKEY_API_KEY"
export ANTHROPIC_MODEL="claude-haiku-5-5"

Claude Haiku 5.5 коротко

Дата выхода
2026-10-07, последняя модель линейки Claude 5.5 (Opus 5.5 вышла 09-22, Sonnet 5.5 — 09-28). Начиная с Claude Code 2.1.293 алиас haiku в Anthropic API указывает на неё
Назначение
Массовые задачи, чувствительные к задержке (классификация, извлечение данных, маршрутизация, саммари, сжатие контекста), и субагенты под Opus 5.5 или Sonnet 5.5. Anthropic называет её своей самой быстрой моделью — в среднем примерно на 75% дешевле в работе, чем Haiku 4.5
Официальная цена (по ступеням)
Промпты до 100K токенов: $0.10 за входные / $0.50 за выходные, чтение из кэша $0.01, запись в кэш на 5 минут $0.125, на 1 час $0.20. Промпты больше 100K: все позиции 5x ($0.50 / $2.50). Промпт = входные токены + чтение из кэша + запись в кэш; Batch — ещё скидка 50%
Контекст и вывод
Контекст 1M без beta-заголовка; максимум 128K выходных токенов, или 300K в Batch API с beta-заголовком output-300k-2026-03-24
Thinking и effort
Adaptive thinking включён по умолчанию, effort по умолчанию — medium в API и в Claude Code, пять уровней: low / medium / high / xhigh / max; текст размышлений по умолчанию не возвращается
Токенизатор
Тот же, что у Claude 4.7 и новее: тот же текст даёт примерно на 30% больше токенов, чем на Haiku 4.5, поэтому пересчитайте стоимость в токенах и max_tokens
ID модели
claude-haiku-5-5 (без суффикса даты и без отдельного алиаса; anthropic.claude-haiku-5-5 в Bedrock)

· Источники: Anthropic · Руководство по миграции

Официальные бенчмарки: Haiku 5.5 vs Haiku 4.5 vs GPT-6 Luna vs Sonnet 5.5

Данные со страницы анонса Haiku 5.5 от Anthropic — это результаты, опубликованные самим вендором. «—» означает, что результат не публиковался. Столбец Sonnet 5.5 — ориентир от Anthropic; результат FrontierCode у неё получен на xhigh.

БенчмаркHaiku 5.5Haiku 4.5GPT-6 LunaSonnet 5.5
GDPval-AA v2.1162073514371840
AA-Briefcase v1.1157861413361824
OSWorld 2.1 (offline subset)72.4%15.7%48.9%83.9%
Humanity's Last Exam (no tools)45.9%10.2%—56.9%
Humanity's Last Exam (tools)57.4%18.7%—64.5%
Terminal-Bench 4.039.2%0.0%16.4%70.6%
FrontierCode 1.1 Main46.4%—42.4%52.1%
Chartography (no tools)46.4%6.4%29.1%61.6%

В Terminal-Bench 4.0 Haiku 5.5 запускалась в Claude Code, а GPT-6 Luna — в Codex (публичный лидерборд), так что условия не равны. OSWorld здесь — офлайн-подмножество, и цифра не совпадает с указанной на странице анонса Sonnet 5.5. В независимом Intelligence Index от Artificial Analysis (v4.3.2) Haiku 5.5 набирает 43 на max (xhigh 41, high 38, medium 34, low 29) против 17 у Haiku 4.5, 56 у Sonnet 5.5 и 58 у Opus 5.5; ряд публикаций приводит для GPT-6 Luna (max) 38 баллов по тому же индексу.

Что выбрать: Haiku 5.5, GPT-6 Luna или Sonnet 5.5

По сравнению с Haiku 4.5

Та же роль, прямая замена: на 90% дешевле за токен до 100K и на 50% дешевле сверх этого, плюс лидерство во всех опубликованных бенчмарках (Terminal-Bench 4.0 — с 0% до 39.2%, OSWorld — с 15.7% до 72.4%). Сначала проверьте список изменений для миграции ниже и пересчитайте токены: с новым токенизатором тот же текст даёт примерно на 30% больше токенов.

По сравнению с GPT-6 Luna

До 100K токенов обе стоят $0.10 / $0.50, и Haiku 5.5 выше и в официальных бенчмарках, и в индексе Artificial Analysis (43 против 38). Но надбавка за длинный контекст у Luna начинается только с 272K и составляет лишь 2x на вход / 1.5x на выход, поэтому на длинных промптах Luna заметно дешевле; к тому же в тестах сообщества Haiku 5.5 на высоких уровнях effort тратила больше токенов. Выбирайте Haiku 5.5, если промпты в основном до 100K и важно качество; Luna — для длинного контекста или минимальной цены за токен.

По сравнению с Sonnet 5.5

Для сложной агентной разработки берите Sonnet 5.5 (Terminal-Bench 70.6% против 39.2%); чётко поставленный поиск, саммари, классификацию, исследование кодовой базы и работу субагентов отдавайте Haiku 5.5 — примерно за 1/20 официальной цены Sonnet 5.5. Популярная схема: Opus 5.5 или Sonnet 5.5 в основной сессии и Haiku 5.5 в субагентах.

Как выбрать effort

Уровень medium по умолчанию подходит для большинства задач; для простой классификации или извлечения данных используйте low — Artificial Analysis намерила 6.3 секунды до первого токена ответа и около $0.02 за задачу из индекса. Max в среднем обходится примерно в $0.21 за задачу при очень большом объёме вывода, а в прогонах сообщества max работал в десятки раз дольше low. Если нужен xhigh или max, сначала попробуйте Sonnet 5.5 на low или medium.

Документация по effort

Независимые оценки и отзывы сообщества

  • Artificial Analysis: Intelligence Index (v4.3.2) — 43 на max, на 26 баллов выше Haiku 4.5; около 243 выходных токенов/с на max. Задача из индекса по официальным ценам обходилась в среднем в $0.21 на max и $0.02 на low; на max весь индекс дал 440 млн выходных токенов — модель многословна.
  • Hacker News (638 баллов, 321 комментарий): Плюсы: наконец-то цена на уровне GPT-6 Luna (Simon Willison отметил, что Haiku 4.5 стоила в 10 раз дороже Luna), заметно умнее Luna и вполне годится в субагенты. Критика: порог 100K низковат для агентных сессий; новый токенизатор добавляет около 30% токенов; по стоимости задачи у Artificial Analysis Haiku всё ещё примерно в 3 раза дороже Luna; на low качество падает, а переход с xhigh на max — большой скачок по времени и токенам.

Переход с Haiku 4.5: запросы, которые возвращают 400

Эти изменения описаны в официальном руководстве по миграции. Проверьте свои запросы, прежде чем менять модель на claude-haiku-5-5. При работе через Wokey часть из них шлюз обрабатывает сам — это указано в каждом пункте.

  • thinking: {"type": "enabled", "budget_tokens": N} возвращает 400 — используйте {"type": "adaptive"} вместе с effort. thinking: {"type": "disabled"} работает только на effort high и ниже. Wokey удаляет ручной budget_tokens и disabled на xhigh / max, возвращаясь к стандартному adaptive thinking.
  • Нестандартные temperature, top_p или top_k возвращают 400 (temperature должна быть 1, top_p — 0.99, любой top_k вызывает ошибку). Wokey удаляет все три поля автоматически.
  • Prefill от assistant (сообщения, заканчивающиеся репликой assistant) возвращает 400, даже при выключенном thinking. Заканчивайте репликой user, а вместо prefill используйте structured outputs или системный промпт.
  • Инструмент computer use computer_20250124 возвращает 400 — используйте набор инструментов computer_toolset_20260801.
  • Блоки thinking воспроизводятся только в том аккаунте, где были созданы, и молча отбрасываются в других; повторная отправка после правки system, tools или предыдущих сообщений возвращает 400, поэтому ведите диалоги только с добавлением в конец.
  • Ответ может начинаться с блока thinking, текст которого по умолчанию опущен, поэтому выбирайте блоки по type; размышления входят в max_tokens, так что увеличьте маленькие лимиты.
  • Принудительный tool_choice (any или конкретный инструмент) работает, но ответ начинается сразу с вызова инструмента без размышлений; отказы возвращают stop_reason: "refusal"; Priority Tier не поддерживается.

Запуск haiku и субагентов на Haiku 5.5 в Claude Code (Wokey)

export ANTHROPIC_BASE_URL="https://api.wokey.ai"
export ANTHROPIC_AUTH_TOKEN="<your Wokey API key>"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="claude-haiku-5-5"
# Optional: run sub-agents that do not name a model on Haiku 5.5
export CLAUDE_CODE_SUBAGENT_MODEL="haiku"
claude
ID модели
claude-haiku-5-5
Поставщики
anthropic
Статус поставок
Доступна для вызова

Текущие цены каталога

Цены указаны за 1 млн токенов; списание идёт по цене на момент обработки запроса.

ПозицияWokeyОфициальная ценаЭкономия
Input$0.08$0.120%
Output$0.4$0.520%
Cache read$0.008$0.0120%
Cache write$0.16$0.220%

Промпты длиннее 100K токенов

Промпт = входные токены + чтение из кэша + запись в кэш. Если промпт превышает 100,000 токенов, весь запрос, включая выходные токены и кэш, тарифицируется по этой таблице; таблица выше относится к промптам до 100K.

ПозицияWokeyОфициальная ценаЭкономия
Input$0.1$0.580%
Output$0.5$2.580%
Cache read$0.01$0.0580%
Cache write$0.2$180%

Источник официальной цены: https://platform.claude.com/docs/en/models/haiku-5-5/overview

Возможности модели

Context
1,000,000 tokens
Максимальный вывод
128,000 tokens
Streaming
Поддерживается
Tools
Поддерживается
Vision
Поддерживается
Поддерживаемые форматы API
/v1/messages

Отправить запрос

/v1/messages

curl https://api.wokey.ai/v1/messages \
  -H "x-api-key: $WOKEY_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-5-5","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'

Claude Haiku 5.5 в ваших инструментах

Адрес шлюза — https://api.wokey.ai (OpenAI-совместимые клиенты обычно принимают https://api.wokey.ai/v1), ID модели — claude-haiku-5-5. Откройте руководство для своего клиента.

Частые вопросы

Как работает ступень 100K в цене Claude Haiku 5.5? Выходные токены после 100K тоже дорожают?

У официальной цены две ступени по длине промпта. Когда промпт (входные токены + чтение из кэша + запись в кэш) не превышает 100,000 токенов: $0.10 за входные, $0.50 за выходные, $0.01 за чтение из кэша и $0.125 за запись в кэш на 5 минут на 1 млн токенов. Свыше 100,000 токенов все позиции всего запроса умножаются на 5 ($0.50 за входные, $2.50 за выходные), так что при промпте в 120K токенов вывод тоже стоит $2.50. По данным Anthropic, около 90% запросов к Haiku 4.5 укладывались в 100K. В Wokey цена — $0.08 / $0.4 за входные / выходные на 1 млн токенов для промптов до 100K и $0.1 / $0.5 свыше 100K (официально $0.10 / $0.50 и $0.50 / $2.50 свыше 100K), с теми же ступенями по длине промпта.

Claude Haiku 5.5 или GPT-6 Luna: что лучше и что дешевле?

До 100K токенов обе стоят $0.10 / $0.50. Haiku 5.5 лидирует в бенчмарках, опубликованных Anthropic (GDPval-AA 1620 против 1437, OSWorld 72.4% против 48.9%), и в индексе Artificial Analysis (43 против 38). Но надбавка за длинный контекст у GPT-6 Luna начинается с 272K и составляет лишь 2x на вход / 1.5x на выход, тогда как Haiku 5.5 с 100K умножает все позиции на 5, а её токенизатор даёт на тот же текст примерно на 30% больше токенов. Haiku 5.5 — для коротких промптов, где важно качество, Luna — для длинного контекста или минимальной цены за токен; проверьте обе на своих задачах.

Насколько Claude Haiku 5.5 лучше Haiku 4.5 в бенчмарках?

В бенчмарках Anthropic Terminal-Bench 4.0 вырос с 0% до 39.2%, OSWorld 2.1 (офлайн-подмножество) — с 15.7% до 72.4%, GDPval-AA — с 735 до 1620, а Humanity’s Last Exam с инструментами — с 18.7% до 57.4%. Intelligence Index от Artificial Analysis вырос с 17 до 43 на max — второе место в своей ценовой категории. В сложных задачах по коду Sonnet 5.5 по-прежнему заметно впереди.

Что выбрать: Claude Haiku 5.5 или Sonnet 5.5?

Sonnet 5.5 — для сложной агентной разработки и задач, где нужны длительные рассуждения (Terminal-Bench 70.6% против 39.2%). Haiku 5.5 — для классификации, извлечения данных, саммари, сжатия контекста, поиска по кодовой базе и субагентов примерно за 1/20 официальной цены Sonnet 5.5. Anthropic и сама рекомендует использовать Haiku 5.5 как субагента для Opus 5.5 и Sonnet 5.5.

Как использовать Claude Haiku 5.5 в Claude Code?

Начиная с Claude Code 2.1.293 алиас haiku в Anthropic API указывает на Haiku 5.5 с effort medium по умолчанию; сначала выполните claude update. При работе через шлюз, например Wokey, задайте ANTHROPIC_BASE_URL="https://api.wokey.ai", в ANTHROPIC_AUTH_TOKEN укажите ваш API-ключ Wokey и задайте ANTHROPIC_DEFAULT_HAIKU_MODEL="claude-haiku-5-5" — тогда фоновые задачи и агенты, объявленные как haiku, будут работать на Haiku 5.5; добавьте CLAUDE_CODE_SUBAGENT_MODEL="haiku", чтобы туда же шли субагенты без указанной модели. Основную сессию переключайте командой /model claude-haiku-5-5. Отключить размышления Haiku 5.5 в Claude Code нельзя.

Можно ли получить Claude Haiku 5.5 API дешевле официальной цены?

Wokey предоставляет claude-haiku-5-5 через нативный Anthropic API /v1/messages. В Wokey цена — $0.08 / $0.4 за входные / выходные на 1 млн токенов для промптов до 100K и $0.1 / $0.5 свыше 100K (официально $0.10 / $0.50 и $0.50 / $2.50 свыше 100K). Если для API-ключа включена «Проверка официального подключения», ответы Messages, переданные без изменений, содержат подпись tee.proof, которую можно проверить локально на /tools/verify и убедиться, что ответ — оригинальный вывод официального upstream.

Сколько стоит API Claude Haiku 5.5 и насколько это дешевле официального API?

Для промптов (входные токены + чтение из кэша + запись в кэш) до 100,000 токенов включительно Wokey берёт $0.08 за 1 млн входных токенов и $0.4 за 1 млн выходных; официальные справочные цены — $0.1 и $0.5. Это на 20% дешевле для входных токенов и на 20% — для выходных. Если промпт длиннее 100,000 токенов, весь запрос, включая кэш, тарифицируется по $0.1 за 1 млн входных и $0.5 за 1 млн выходных токенов (официально — $0.5 и $2.5). Расчёт ведётся по цене на момент обработки запроса; ссылка на официальный прайс поставщика есть на этой странице.

Какой ID модели у Claude Haiku 5.5 в API?

ID модели Claude Haiku 5.5 в Wokey — claude-haiku-5-5. Указывайте его точно в таком виде в поле model тела запроса или в настройке модели вашего клиента (например, ANTHROPIC_MODEL в Claude Code или model в config.toml Codex CLI); он также есть в списке, который возвращает GET https://api.wokey.ai/v1/models.

Какие форматы API поддерживает Claude Haiku 5.5 и как вызвать модель через Wokey?

Claude Haiku 5.5 поддерживает /v1/messages (запросы Messages). Укажите базовый URL API https://api.wokey.ai, авторизуйтесь API-ключом Wokey и используйте канонический ID модели claude-haiku-5-5; начать можно с /v1/messages. В разделе «Отправить запрос» есть пример curl для каждого поддерживаемого формата API.

Как использовать Claude Haiku 5.5 в Claude Code?

Claude Code обращается к Claude Haiku 5.5 через /v1/messages. Задайте ANTHROPIC_BASE_URL="https://api.wokey.ai", запишите в ANTHROPIC_AUTH_TOKEN свой API-ключ Wokey, укажите ANTHROPIC_MODEL="claude-haiku-5-5" и запустите claude. Claude Desktop тоже работает через /v1/messages; пошаговая настройка обоих клиентов есть в руководствах по подключению.

Какое контекстное окно и максимальный объём вывода у Claude Haiku 5.5?

Контекстное окно Claude Haiku 5.5 по каталогу — 1,000,000 токенов, максимальный объём вывода — 128,000 токенов. Это разные ограничения, и запрос также должен укладываться в ограничения upstream, действующие на момент его обработки.

Как тарифицируются чтение из кэша и запись в кэш для Claude Haiku 5.5?

Чтение из кэша: у Wokey — $0.008 за 1 млн токенов, официальная справочная цена — $0.01 за 1 млн токенов. Запись в кэш: у Wokey — $0.16 за 1 млн токенов, официальная справочная цена — $0.2 за 1 млн токенов.

Чем вызов Claude Haiku 5.5 через Wokey отличается от OpenRouter?

Wokey предлагает Claude Haiku 5.5 по $0.08 за входные / $0.4 за выходные токены (за 1 млн) при официальной справочной цене $0.1 / $0.5. OpenRouter заявляет, что не делает наценку на инференс и берёт комиссию при покупке кредитов (5,5% при оплате картой). В Wokey — отобранный набор моделей и нет параметров маршрутизации по провайдерам, поэтому, если нужен более широкий каталог, OpenRouter подойдёт лучше. Полное сравнение — на странице об альтернативе OpenRouter.

Чем Claude Haiku 5.5 и Claude Haiku 4.5 отличаются по цене и контексту?

По публичным ценам Claude Haiku 5.5 стоит $0.08 / $0.4 (входные/выходные) при контекстном окне 1,000,000 токенов; Claude Haiku 4.5 — $0.2 / $1 при контекстном окне 200,000 токенов. Это фактическое сравнение цены и ёмкости, а не рейтинг качества; учитывайте также поддерживаемые форматы API и возможности моделей.

Похожие модели и документация

Получить API-ключ · claude-haiku-5-5