Claude Haiku 5.5 API
Claude Haiku 5.5 вышла 2026-10-07 — это самая дешёвая и быстрая модель Anthropic и первая Haiku с уровнями effort. Цена зависит от длины промпта: до 100K токенов она на 90% дешевле Haiku 4.5, а как только промпт превышает 100K, весь запрос тарифицируется по цене в 5 раз выше. На этой странице — как устроена цена, официальные бенчмарки, выбор между ней, GPT-6 Luna и Sonnet 5.5, отзывы сообщества, ошибки 400 при переходе с Haiku 4.5 и как включить её в Claude Code.
Сравнение цен: официальный API, OpenRouter и Wokey
Цены в USD за 1 млн токенов. Тарифы официального API и OpenRouter проверены вручную 2026-10-08, без учёта налогов; цена Wokey берётся из актуального прайс-листа.
| Канал | Входные | Чтение из кэша | Выходные |
|---|---|---|---|
| Официальный API | $0.1 | $0.01 | $0.5 |
| OpenRouter | $0.1 | $0.01 | $0.5 |
| Wokey | $0.08 | $0.008 | $0.4 |
В таблице указаны цены для промптов до 100 000 токенов. Если промпт (входные токены + чтение из кэша + запись в кэш) длиннее 100 000, официальный API и OpenRouter тарифицируют весь запрос по $0.5 за входные / $2.5 за выходные; у Wokey цена тоже зависит от длины промпта — тарифы для длинных промптов приведены в таблице цен ниже.
· Официальная страница цен · Список эндпоинтов OpenRouter
Использование в Claude Code
На Wokey эта модель поддерживает /v1/messages. Задайте эти переменные окружения и запустите claude.
export ANTHROPIC_BASE_URL="https://api.wokey.ai"
export ANTHROPIC_AUTH_TOKEN="$WOKEY_API_KEY"
export ANTHROPIC_MODEL="claude-haiku-5-5"Claude Haiku 5.5 коротко
- Дата выхода
- 2026-10-07, последняя модель линейки Claude 5.5 (Opus 5.5 вышла 09-22, Sonnet 5.5 — 09-28). Начиная с Claude Code 2.1.293 алиас haiku в Anthropic API указывает на неё
- Назначение
- Массовые задачи, чувствительные к задержке (классификация, извлечение данных, маршрутизация, саммари, сжатие контекста), и субагенты под Opus 5.5 или Sonnet 5.5. Anthropic называет её своей самой быстрой моделью — в среднем примерно на 75% дешевле в работе, чем Haiku 4.5
- Официальная цена (по ступеням)
- Промпты до 100K токенов: $0.10 за входные / $0.50 за выходные, чтение из кэша $0.01, запись в кэш на 5 минут $0.125, на 1 час $0.20. Промпты больше 100K: все позиции 5x ($0.50 / $2.50). Промпт = входные токены + чтение из кэша + запись в кэш; Batch — ещё скидка 50%
- Контекст и вывод
- Контекст 1M без beta-заголовка; максимум 128K выходных токенов, или 300K в Batch API с beta-заголовком output-300k-2026-03-24
- Thinking и effort
- Adaptive thinking включён по умолчанию, effort по умолчанию — medium в API и в Claude Code, пять уровней: low / medium / high / xhigh / max; текст размышлений по умолчанию не возвращается
- Токенизатор
- Тот же, что у Claude 4.7 и новее: тот же текст даёт примерно на 30% больше токенов, чем на Haiku 4.5, поэтому пересчитайте стоимость в токенах и max_tokens
- ID модели
- claude-haiku-5-5 (без суффикса даты и без отдельного алиаса; anthropic.claude-haiku-5-5 в Bedrock)
· Источники: Anthropic · Руководство по миграции
Официальные бенчмарки: Haiku 5.5 vs Haiku 4.5 vs GPT-6 Luna vs Sonnet 5.5
Данные со страницы анонса Haiku 5.5 от Anthropic — это результаты, опубликованные самим вендором. «—» означает, что результат не публиковался. Столбец Sonnet 5.5 — ориентир от Anthropic; результат FrontierCode у неё получен на xhigh.
| Бенчмарк | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1 (offline subset) | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity's Last Exam (no tools) | 45.9% | 10.2% | — | 56.9% |
| Humanity's Last Exam (tools) | 57.4% | 18.7% | — | 64.5% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1 Main | 46.4% | — | 42.4% | 52.1% |
| Chartography (no tools) | 46.4% | 6.4% | 29.1% | 61.6% |
В Terminal-Bench 4.0 Haiku 5.5 запускалась в Claude Code, а GPT-6 Luna — в Codex (публичный лидерборд), так что условия не равны. OSWorld здесь — офлайн-подмножество, и цифра не совпадает с указанной на странице анонса Sonnet 5.5. В независимом Intelligence Index от Artificial Analysis (v4.3.2) Haiku 5.5 набирает 43 на max (xhigh 41, high 38, medium 34, low 29) против 17 у Haiku 4.5, 56 у Sonnet 5.5 и 58 у Opus 5.5; ряд публикаций приводит для GPT-6 Luna (max) 38 баллов по тому же индексу.
Что выбрать: Haiku 5.5, GPT-6 Luna или Sonnet 5.5
По сравнению с Haiku 4.5
Та же роль, прямая замена: на 90% дешевле за токен до 100K и на 50% дешевле сверх этого, плюс лидерство во всех опубликованных бенчмарках (Terminal-Bench 4.0 — с 0% до 39.2%, OSWorld — с 15.7% до 72.4%). Сначала проверьте список изменений для миграции ниже и пересчитайте токены: с новым токенизатором тот же текст даёт примерно на 30% больше токенов.
По сравнению с GPT-6 Luna
До 100K токенов обе стоят $0.10 / $0.50, и Haiku 5.5 выше и в официальных бенчмарках, и в индексе Artificial Analysis (43 против 38). Но надбавка за длинный контекст у Luna начинается только с 272K и составляет лишь 2x на вход / 1.5x на выход, поэтому на длинных промптах Luna заметно дешевле; к тому же в тестах сообщества Haiku 5.5 на высоких уровнях effort тратила больше токенов. Выбирайте Haiku 5.5, если промпты в основном до 100K и важно качество; Luna — для длинного контекста или минимальной цены за токен.
По сравнению с Sonnet 5.5
Для сложной агентной разработки берите Sonnet 5.5 (Terminal-Bench 70.6% против 39.2%); чётко поставленный поиск, саммари, классификацию, исследование кодовой базы и работу субагентов отдавайте Haiku 5.5 — примерно за 1/20 официальной цены Sonnet 5.5. Популярная схема: Opus 5.5 или Sonnet 5.5 в основной сессии и Haiku 5.5 в субагентах.
Как выбрать effort
Уровень medium по умолчанию подходит для большинства задач; для простой классификации или извлечения данных используйте low — Artificial Analysis намерила 6.3 секунды до первого токена ответа и около $0.02 за задачу из индекса. Max в среднем обходится примерно в $0.21 за задачу при очень большом объёме вывода, а в прогонах сообщества max работал в десятки раз дольше low. Если нужен xhigh или max, сначала попробуйте Sonnet 5.5 на low или medium.
Независимые оценки и отзывы сообщества
- Artificial Analysis: Intelligence Index (v4.3.2) — 43 на max, на 26 баллов выше Haiku 4.5; около 243 выходных токенов/с на max. Задача из индекса по официальным ценам обходилась в среднем в $0.21 на max и $0.02 на low; на max весь индекс дал 440 млн выходных токенов — модель многословна.
- Hacker News (638 баллов, 321 комментарий): Плюсы: наконец-то цена на уровне GPT-6 Luna (Simon Willison отметил, что Haiku 4.5 стоила в 10 раз дороже Luna), заметно умнее Luna и вполне годится в субагенты. Критика: порог 100K низковат для агентных сессий; новый токенизатор добавляет около 30% токенов; по стоимости задачи у Artificial Analysis Haiku всё ещё примерно в 3 раза дороже Luna; на low качество падает, а переход с xhigh на max — большой скачок по времени и токенам.
Переход с Haiku 4.5: запросы, которые возвращают 400
Эти изменения описаны в официальном руководстве по миграции. Проверьте свои запросы, прежде чем менять модель на claude-haiku-5-5. При работе через Wokey часть из них шлюз обрабатывает сам — это указано в каждом пункте.
- thinking: {"type": "enabled", "budget_tokens": N} возвращает 400 — используйте {"type": "adaptive"} вместе с effort. thinking: {"type": "disabled"} работает только на effort high и ниже. Wokey удаляет ручной budget_tokens и disabled на xhigh / max, возвращаясь к стандартному adaptive thinking.
- Нестандартные temperature, top_p или top_k возвращают 400 (temperature должна быть 1, top_p — 0.99, любой top_k вызывает ошибку). Wokey удаляет все три поля автоматически.
- Prefill от assistant (сообщения, заканчивающиеся репликой assistant) возвращает 400, даже при выключенном thinking. Заканчивайте репликой user, а вместо prefill используйте structured outputs или системный промпт.
- Инструмент computer use computer_20250124 возвращает 400 — используйте набор инструментов computer_toolset_20260801.
- Блоки thinking воспроизводятся только в том аккаунте, где были созданы, и молча отбрасываются в других; повторная отправка после правки system, tools или предыдущих сообщений возвращает 400, поэтому ведите диалоги только с добавлением в конец.
- Ответ может начинаться с блока thinking, текст которого по умолчанию опущен, поэтому выбирайте блоки по type; размышления входят в max_tokens, так что увеличьте маленькие лимиты.
- Принудительный tool_choice (any или конкретный инструмент) работает, но ответ начинается сразу с вызова инструмента без размышлений; отказы возвращают stop_reason: "refusal"; Priority Tier не поддерживается.
Запуск haiku и субагентов на Haiku 5.5 в Claude Code (Wokey)
export ANTHROPIC_BASE_URL="https://api.wokey.ai"
export ANTHROPIC_AUTH_TOKEN="<your Wokey API key>"
export ANTHROPIC_DEFAULT_HAIKU_MODEL="claude-haiku-5-5"
# Optional: run sub-agents that do not name a model on Haiku 5.5
export CLAUDE_CODE_SUBAGENT_MODEL="haiku"
claude- ID модели
claude-haiku-5-5- Поставщики
- anthropic
- Статус поставок
- Доступна для вызова
Текущие цены каталога
Цены указаны за 1 млн токенов; списание идёт по цене на момент обработки запроса.
| Позиция | Wokey | Официальная цена | Экономия |
|---|---|---|---|
| Input | $0.08 | $0.1 | 20% |
| Output | $0.4 | $0.5 | 20% |
| Cache read | $0.008 | $0.01 | 20% |
| Cache write | $0.16 | $0.2 | 20% |
Промпты длиннее 100K токенов
Промпт = входные токены + чтение из кэша + запись в кэш. Если промпт превышает 100,000 токенов, весь запрос, включая выходные токены и кэш, тарифицируется по этой таблице; таблица выше относится к промптам до 100K.
| Позиция | Wokey | Официальная цена | Экономия |
|---|---|---|---|
| Input | $0.1 | $0.5 | 80% |
| Output | $0.5 | $2.5 | 80% |
| Cache read | $0.01 | $0.05 | 80% |
| Cache write | $0.2 | $1 | 80% |
Источник официальной цены: https://platform.claude.com/docs/en/models/haiku-5-5/overview
Возможности модели
- Context
- 1,000,000 tokens
- Максимальный вывод
- 128,000 tokens
- Streaming
- Поддерживается
- Tools
- Поддерживается
- Vision
- Поддерживается
- Поддерживаемые форматы API
/v1/messages
Отправить запрос
/v1/messages
curl https://api.wokey.ai/v1/messages \
-H "x-api-key: $WOKEY_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-5-5","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'Claude Haiku 5.5 в ваших инструментах
Адрес шлюза — https://api.wokey.ai (OpenAI-совместимые клиенты обычно принимают https://api.wokey.ai/v1), ID модели — claude-haiku-5-5. Откройте руководство для своего клиента.
- Claude Haiku 5.5 в Claude Code: Anthropic Messages · настройка base URL и API-ключа
- Claude Haiku 5.5 в Claude Desktop: Anthropic Messages · настройка base URL и API-ключа
- Калькулятор стоимости Claude API: сколько Claude Haiku 5.5 стоит в месяц: Сравните месячные расходы в Anthropic API, OpenRouter и Wokey для вашего объёма и доли попаданий в кэш.
- Альтернатива OpenRouter: сравнение Wokey и OpenRouter: Сравнение цен за токены, комиссий за оплату, форматов API и источников upstream.
- Проверяемый AI API: убедитесь, что ответ Claude Haiku 5.5 пришёл от официального upstream: Какие ответы содержат tee.proof и что доказательство подтверждает, а что нет.
- Проверить ответ Claude Haiku 5.5 онлайн: инструмент проверки API-ретрансляторов: Вставьте ответ вместе с tee.proof и проверьте его локально в браузере — данные никуда не отправляются.
Частые вопросы
Как работает ступень 100K в цене Claude Haiku 5.5? Выходные токены после 100K тоже дорожают?
У официальной цены две ступени по длине промпта. Когда промпт (входные токены + чтение из кэша + запись в кэш) не превышает 100,000 токенов: $0.10 за входные, $0.50 за выходные, $0.01 за чтение из кэша и $0.125 за запись в кэш на 5 минут на 1 млн токенов. Свыше 100,000 токенов все позиции всего запроса умножаются на 5 ($0.50 за входные, $2.50 за выходные), так что при промпте в 120K токенов вывод тоже стоит $2.50. По данным Anthropic, около 90% запросов к Haiku 4.5 укладывались в 100K. В Wokey цена — $0.08 / $0.4 за входные / выходные на 1 млн токенов для промптов до 100K и $0.1 / $0.5 свыше 100K (официально $0.10 / $0.50 и $0.50 / $2.50 свыше 100K), с теми же ступенями по длине промпта.
Claude Haiku 5.5 или GPT-6 Luna: что лучше и что дешевле?
До 100K токенов обе стоят $0.10 / $0.50. Haiku 5.5 лидирует в бенчмарках, опубликованных Anthropic (GDPval-AA 1620 против 1437, OSWorld 72.4% против 48.9%), и в индексе Artificial Analysis (43 против 38). Но надбавка за длинный контекст у GPT-6 Luna начинается с 272K и составляет лишь 2x на вход / 1.5x на выход, тогда как Haiku 5.5 с 100K умножает все позиции на 5, а её токенизатор даёт на тот же текст примерно на 30% больше токенов. Haiku 5.5 — для коротких промптов, где важно качество, Luna — для длинного контекста или минимальной цены за токен; проверьте обе на своих задачах.
Насколько Claude Haiku 5.5 лучше Haiku 4.5 в бенчмарках?
В бенчмарках Anthropic Terminal-Bench 4.0 вырос с 0% до 39.2%, OSWorld 2.1 (офлайн-подмножество) — с 15.7% до 72.4%, GDPval-AA — с 735 до 1620, а Humanity’s Last Exam с инструментами — с 18.7% до 57.4%. Intelligence Index от Artificial Analysis вырос с 17 до 43 на max — второе место в своей ценовой категории. В сложных задачах по коду Sonnet 5.5 по-прежнему заметно впереди.
Что выбрать: Claude Haiku 5.5 или Sonnet 5.5?
Sonnet 5.5 — для сложной агентной разработки и задач, где нужны длительные рассуждения (Terminal-Bench 70.6% против 39.2%). Haiku 5.5 — для классификации, извлечения данных, саммари, сжатия контекста, поиска по кодовой базе и субагентов примерно за 1/20 официальной цены Sonnet 5.5. Anthropic и сама рекомендует использовать Haiku 5.5 как субагента для Opus 5.5 и Sonnet 5.5.
Как использовать Claude Haiku 5.5 в Claude Code?
Начиная с Claude Code 2.1.293 алиас haiku в Anthropic API указывает на Haiku 5.5 с effort medium по умолчанию; сначала выполните claude update. При работе через шлюз, например Wokey, задайте ANTHROPIC_BASE_URL="https://api.wokey.ai", в ANTHROPIC_AUTH_TOKEN укажите ваш API-ключ Wokey и задайте ANTHROPIC_DEFAULT_HAIKU_MODEL="claude-haiku-5-5" — тогда фоновые задачи и агенты, объявленные как haiku, будут работать на Haiku 5.5; добавьте CLAUDE_CODE_SUBAGENT_MODEL="haiku", чтобы туда же шли субагенты без указанной модели. Основную сессию переключайте командой /model claude-haiku-5-5. Отключить размышления Haiku 5.5 в Claude Code нельзя.
Можно ли получить Claude Haiku 5.5 API дешевле официальной цены?
Wokey предоставляет claude-haiku-5-5 через нативный Anthropic API /v1/messages. В Wokey цена — $0.08 / $0.4 за входные / выходные на 1 млн токенов для промптов до 100K и $0.1 / $0.5 свыше 100K (официально $0.10 / $0.50 и $0.50 / $2.50 свыше 100K). Если для API-ключа включена «Проверка официального подключения», ответы Messages, переданные без изменений, содержат подпись tee.proof, которую можно проверить локально на /tools/verify и убедиться, что ответ — оригинальный вывод официального upstream.
Сколько стоит API Claude Haiku 5.5 и насколько это дешевле официального API?
Для промптов (входные токены + чтение из кэша + запись в кэш) до 100,000 токенов включительно Wokey берёт $0.08 за 1 млн входных токенов и $0.4 за 1 млн выходных; официальные справочные цены — $0.1 и $0.5. Это на 20% дешевле для входных токенов и на 20% — для выходных. Если промпт длиннее 100,000 токенов, весь запрос, включая кэш, тарифицируется по $0.1 за 1 млн входных и $0.5 за 1 млн выходных токенов (официально — $0.5 и $2.5). Расчёт ведётся по цене на момент обработки запроса; ссылка на официальный прайс поставщика есть на этой странице.
Какой ID модели у Claude Haiku 5.5 в API?
ID модели Claude Haiku 5.5 в Wokey — claude-haiku-5-5. Указывайте его точно в таком виде в поле model тела запроса или в настройке модели вашего клиента (например, ANTHROPIC_MODEL в Claude Code или model в config.toml Codex CLI); он также есть в списке, который возвращает GET https://api.wokey.ai/v1/models.
Какие форматы API поддерживает Claude Haiku 5.5 и как вызвать модель через Wokey?
Claude Haiku 5.5 поддерживает /v1/messages (запросы Messages). Укажите базовый URL API https://api.wokey.ai, авторизуйтесь API-ключом Wokey и используйте канонический ID модели claude-haiku-5-5; начать можно с /v1/messages. В разделе «Отправить запрос» есть пример curl для каждого поддерживаемого формата API.
Как использовать Claude Haiku 5.5 в Claude Code?
Claude Code обращается к Claude Haiku 5.5 через /v1/messages. Задайте ANTHROPIC_BASE_URL="https://api.wokey.ai", запишите в ANTHROPIC_AUTH_TOKEN свой API-ключ Wokey, укажите ANTHROPIC_MODEL="claude-haiku-5-5" и запустите claude. Claude Desktop тоже работает через /v1/messages; пошаговая настройка обоих клиентов есть в руководствах по подключению.
Какое контекстное окно и максимальный объём вывода у Claude Haiku 5.5?
Контекстное окно Claude Haiku 5.5 по каталогу — 1,000,000 токенов, максимальный объём вывода — 128,000 токенов. Это разные ограничения, и запрос также должен укладываться в ограничения upstream, действующие на момент его обработки.
Как тарифицируются чтение из кэша и запись в кэш для Claude Haiku 5.5?
Чтение из кэша: у Wokey — $0.008 за 1 млн токенов, официальная справочная цена — $0.01 за 1 млн токенов. Запись в кэш: у Wokey — $0.16 за 1 млн токенов, официальная справочная цена — $0.2 за 1 млн токенов.
Чем вызов Claude Haiku 5.5 через Wokey отличается от OpenRouter?
Wokey предлагает Claude Haiku 5.5 по $0.08 за входные / $0.4 за выходные токены (за 1 млн) при официальной справочной цене $0.1 / $0.5. OpenRouter заявляет, что не делает наценку на инференс и берёт комиссию при покупке кредитов (5,5% при оплате картой). В Wokey — отобранный набор моделей и нет параметров маршрутизации по провайдерам, поэтому, если нужен более широкий каталог, OpenRouter подойдёт лучше. Полное сравнение — на странице об альтернативе OpenRouter.
Чем Claude Haiku 5.5 и Claude Haiku 4.5 отличаются по цене и контексту?
По публичным ценам Claude Haiku 5.5 стоит $0.08 / $0.4 (входные/выходные) при контекстном окне 1,000,000 токенов; Claude Haiku 4.5 — $0.2 / $1 при контекстном окне 200,000 токенов. Это фактическое сравнение цены и ёмкости, а не рейтинг качества; учитывайте также поддерживаемые форматы API и возможности моделей.
Похожие модели и документация
Получить API-ключ · claude-haiku-5-5