GLM-5.3-Flash API
Вызывайте GLM-5.3-Flash через Wokey: публичные цены каталога, нативные форматы API upstream, контекст и возможности модели.
- ID модели
glm-5.3-flash- Поставщики
- zhipu, volcengine, opencode
- Статус поставок
- Доступна для вызова
Текущие цены каталога
Цены указаны за 1 млн токенов; списание идёт по цене на момент обработки запроса.
| Позиция | Wokey | Официальная цена | Экономия |
|---|---|---|---|
| Input | $0.075 | $0.15 | 50% |
| Output | $0.25 | $0.5 | 50% |
| Cache read | $0.015 | $0.03 | 50% |
| Cache write | — | — | — |
Источник официальной цены: https://docs.z.ai/guides/overview/pricing
Возможности модели
- Context
- 1,000,000 tokens
- Максимальный вывод
- 131,072 tokens
- Streaming
- Поддерживается
- Tools
- Поддерживается
- Vision
- Поддерживается
- Поддерживаемые форматы API
/v1/chat/completions·/v1/messages
Отправить запрос
/v1/chat/completions
curl https://api.wokey.ai/v1/chat/completions \
-H "Authorization: Bearer $WOKEY_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.3-flash","messages":[{"role":"user","content":"Hello"}]}'/v1/messages
curl https://api.wokey.ai/v1/messages \
-H "x-api-key: $WOKEY_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{"model":"glm-5.3-flash","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'GLM-5.3-Flash в ваших инструментах
Адрес шлюза — https://api.wokey.ai (OpenAI-совместимые клиенты обычно принимают https://api.wokey.ai/v1), ID модели — glm-5.3-flash. Откройте руководство для своего клиента.
- GLM-5.3-Flash в Claude Code: Anthropic Messages · настройка base URL и API-ключа
- GLM-5.3-Flash в Claude Desktop: Anthropic Messages · настройка base URL и API-ключа
- GLM-5.3-Flash в opencode: OpenAI Chat Completions · настройка base URL и API-ключа
- GLM-5.3-Flash в OpenClaw: OpenAI Chat Completions · настройка base URL и API-ключа
- GLM-5.3-Flash в Hermes Agent: OpenAI Chat Completions · настройка base URL и API-ключа
- Альтернатива OpenRouter: сравнение Wokey и OpenRouter: Сравнение цен за токены, комиссий за оплату, форматов API и источников upstream.
- Проверяемый AI API: какие модели и форматы API содержат доказательства ответов: Сейчас доказательства ответов есть только у Claude Messages и GPT Responses, переданных без изменений по официальным маршрутам.
Частые вопросы
Сколько стоит API GLM-5.3-Flash и насколько это дешевле официального API?
Wokey берёт $0.075 за 1 млн входных токенов и $0.25 за 1 млн выходных; официальные справочные цены — $0.15 и $0.5. Это на 50% дешевле для входных токенов и на 50% — для выходных. Расчёт ведётся по цене на момент обработки запроса; ссылка на официальный прайс поставщика есть на этой странице.
Какой ID модели у GLM-5.3-Flash в API?
ID модели GLM-5.3-Flash в Wokey — glm-5.3-flash. Указывайте его точно в таком виде в поле model тела запроса или в настройке модели вашего клиента (например, ANTHROPIC_MODEL в Claude Code или model в config.toml Codex CLI); он также есть в списке, который возвращает GET https://api.wokey.ai/v1/models.
Какие форматы API поддерживает GLM-5.3-Flash и как вызвать модель через Wokey?
GLM-5.3-Flash поддерживает /v1/chat/completions (запросы Chat Completions) и /v1/messages (запросы Messages). Укажите базовый URL API https://api.wokey.ai, авторизуйтесь API-ключом Wokey и используйте канонический ID модели glm-5.3-flash; начать можно с /v1/chat/completions. В разделе «Отправить запрос» есть пример curl для каждого поддерживаемого формата API.
Как использовать GLM-5.3-Flash в Claude Code?
Claude Code обращается к GLM-5.3-Flash через /v1/messages. Задайте ANTHROPIC_BASE_URL="https://api.wokey.ai", запишите в ANTHROPIC_AUTH_TOKEN свой API-ключ Wokey, укажите ANTHROPIC_MODEL="glm-5.3-flash" и запустите claude. Claude Desktop тоже работает через /v1/messages; пошаговая настройка обоих клиентов есть в руководствах по подключению.
Какое контекстное окно и максимальный объём вывода у GLM-5.3-Flash?
Контекстное окно GLM-5.3-Flash по каталогу — 1,000,000 токенов, максимальный объём вывода — 131,072 токенов. Это разные ограничения, и запрос также должен укладываться в ограничения upstream, действующие на момент его обработки.
Как тарифицируются чтение из кэша и запись в кэш для GLM-5.3-Flash?
Чтение из кэша: у Wokey — $0.015 за 1 млн токенов, официальная справочная цена — $0.03 за 1 млн токенов. Запись в кэш: поставщик модели не публикует отдельную тарифную позицию, поэтому в публичной цене Wokey тоже стоит —.
Чем вызов GLM-5.3-Flash через Wokey отличается от OpenRouter?
Wokey предлагает GLM-5.3-Flash по $0.075 за входные / $0.25 за выходные токены (за 1 млн) при официальной справочной цене $0.15 / $0.5. OpenRouter заявляет, что не делает наценку на инференс и берёт комиссию при покупке кредитов (5,5% при оплате картой). В Wokey — отобранный набор моделей и нет параметров маршрутизации по провайдерам, поэтому, если нужен более широкий каталог, OpenRouter подойдёт лучше. Полное сравнение — на странице об альтернативе OpenRouter.
Чем GLM-5.3-Flash и GLM-5.3 отличаются по цене и контексту?
По публичным ценам GLM-5.3-Flash стоит $0.075 / $0.25 (входные/выходные) при контекстном окне 1,000,000 токенов; GLM-5.3 — $0.28 / $0.88 при контекстном окне 1,000,000 токенов. Это фактическое сравнение цены и ёмкости, а не рейтинг качества; учитывайте также поддерживаемые форматы API и возможности моделей.
Похожие модели и документация
Получить API-ключ · glm-5.3-flash