GLM-5.3-Flash API

通过 Wokey 调用 GLM-5.3-Flash,查看公开目录价格、官方原生支持接口、上下文和模型能力。

模型 ID
glm-5.3-flash
供应商
zhipu, volcengine, opencode
供应状态
当前可调用

目录价格快照

价格单位为每 100 万 tokens;实际结算以请求处理时价格为准。

计费项Wokey官方参考节省幅度
Input$0.075$0.1550%
Output$0.25$0.550%
Cache read$0.015$0.0350%
Cache write———

官方价格来源: https://docs.z.ai/guides/overview/pricing

模型能力

Context
1,000,000 tokens
最大输出
131,072 tokens
Streaming
支持
Tools
支持
Vision
支持
支持接口
/v1/chat/completions · /v1/messages

发送请求

/v1/chat/completions

curl https://api.wokey.ai/v1/chat/completions \
  -H "Authorization: Bearer $WOKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"glm-5.3-flash","messages":[{"role":"user","content":"Hello"}]}'

/v1/messages

curl https://api.wokey.ai/v1/messages \
  -H "x-api-key: $WOKEY_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{"model":"glm-5.3-flash","max_tokens":1024,"messages":[{"role":"user","content":"Hello"}]}'

在客户端中使用 GLM-5.3-Flash

网关地址是 https://api.wokey.ai(OpenAI 兼容客户端通常写成 https://api.wokey.ai/v1),模型 ID 填 glm-5.3-flash。按你使用的客户端打开对应接入文档。

常见问题

GLM-5.3-Flash API 价格是多少?与官方 API 相比能节省多少?

Wokey 输入价为 $0.075 / 1M tokens,输出价为 $0.25 / 1M tokens;官方参考价分别为 $0.15 和 $0.5。输入较官方参考价低 50%,输出低 50%。实际结算以请求处理时价格为准,官方定价来源见本页链接。

GLM-5.3-Flash 的 API 模型 ID 是什么?

在 Wokey 调用 GLM-5.3-Flash 时,模型 ID 是 glm-5.3-flash。把它原样填进请求体的 model 字段,或客户端的模型设置(例如 Claude Code 的 ANTHROPIC_MODEL、Codex CLI config.toml 里的 model);GET https://api.wokey.ai/v1/models 返回的列表里也有这个 ID。

GLM-5.3-Flash 支持哪些 API 接口,如何通过 Wokey 调用?

GLM-5.3-Flash 支持 /v1/chat/completions(Chat Completions 请求)、/v1/messages(Messages 请求)。将 API Base URL 设为 https://api.wokey.ai,使用 Wokey API Key,并把模型 ID 设为 canonical ID glm-5.3-flash;可先使用 /v1/chat/completions。本页“发送请求”部分提供了每一种支持接口的 curl 示例。

如何在 Claude Code 中使用 GLM-5.3-Flash?

Claude Code 通过 /v1/messages 调用 GLM-5.3-Flash。设置 ANTHROPIC_BASE_URL="https://api.wokey.ai"、ANTHROPIC_AUTH_TOKEN 为你的 Wokey API Key、ANTHROPIC_MODEL="glm-5.3-flash",再启动 claude 即可。Claude Desktop 同样走 /v1/messages,两者的完整步骤见接入文档。

GLM-5.3-Flash 的上下文窗口和最大输出是多少?

GLM-5.3-Flash 的目录上下文窗口为 1,000,000 tokens,最大输出为 131,072 tokens。上下文窗口和最大输出是两个不同限制,实际请求还要满足处理时的上游约束。

GLM-5.3-Flash 的缓存读取和缓存写入如何计费?

缓存读取:Wokey 为 $0.015 / 1M tokens,官方参考为 $0.03 / 1M tokens。缓存写入:厂商未公布独立计费项,Wokey 公开价格也显示 —。

通过 Wokey 调用 GLM-5.3-Flash 和通过 OpenRouter 有什么区别?

Wokey 的 GLM-5.3-Flash 公开价为输入 $0.075 / 输出 $0.25 每 100 万 tokens,官方参考价为 $0.15 / $0.5。OpenRouter 表示推理 token 不加价,费用在购买积分时收取(银行卡 5.5%)。Wokey 只上架一组精选模型,也不提供按供应商排序的路由参数;需要更宽的模型目录时,OpenRouter 更合适。完整对比见 OpenRouter 替代方案页面。

GLM-5.3-Flash 和 GLM-5.3 的价格与上下文有什么区别?

公开价格对比中,GLM-5.3-Flash 的输入/输出价格为 $0.075 / $0.25,上下文窗口为 1,000,000 tokens;GLM-5.3 分别为 $0.28 / $0.88 和 1,000,000 tokens。这是价格与容量的事实比较,不代表模型质量排序;选择时还应结合各自支持接口和能力。

相关模型与文档

获取 API Key · glm-5.3-flash