Gemini 3.5 Flash API

通过 Wokey 调用 Gemini 3.5 Flash,查看带时间边界的目录价格、官方原生支持接口、上下文和模型能力。

模型 ID
gemini-3.5-flash
供应商
google
供应状态
当前供应暂不可用

目录价格快照

价格单位为每 100 万 tokens;实际结算以请求处理时价格为准。

计费项Wokey官方参考节省幅度
Input$0.3$1.580%
Output$1.8$980%
Cache read$0.03
Cache write

价格检查时间:

官方价格来源: https://ai.google.dev/gemini-api/docs/pricing

模型能力

Context
1,000,000 tokens
最大输出
65,536 tokens
Streaming
支持
Tools
支持
Vision
支持接口
/v1/chat/completions

发送请求

/v1/chat/completions

curl https://api.wokey.ai/v1/chat/completions \
  -H "Authorization: Bearer $WOKEY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gemini-3.5-flash","messages":[{"role":"user","content":"Hello"}]}'

常见问题

Gemini 3.5 Flash API 价格是多少?与官方 API 相比能节省多少?

截至 2026-08-26,Wokey 输入价为 $0.3 / 1M tokens,输出价为 $1.8 / 1M tokens;官方参考价分别为 $1.5 和 $9。输入较官方参考价低 80%,输出低 80%。实际结算以请求处理时价格为准,官方定价来源见本页链接。

Gemini 3.5 Flash 支持哪些 API 接口,如何通过 Wokey 调用?

Gemini 3.5 Flash 支持 /v1/chat/completions(Chat Completions 请求)。将 API Base URL 设为 https://api.wokey.ai,使用 Wokey API Key,并把模型 ID 设为 canonical ID gemini-3.5-flash;可先使用 /v1/chat/completions。本页“发送请求”部分提供了每一种支持接口的 curl 示例。

Gemini 3.5 Flash 的上下文窗口和最大输出是多少?

Gemini 3.5 Flash 的目录上下文窗口为 1,000,000 tokens,最大输出为 65,536 tokens。上下文窗口和最大输出是两个不同限制,实际请求还要满足处理时的上游约束。

Gemini 3.5 Flash 的缓存读取和缓存写入如何计费?

缓存读取:Wokey 公开价为 $0.03 / 1M tokens;厂商未公布独立官方参考价。缓存写入:厂商未公布独立计费项,Wokey 公开价格也显示 —。

Gemini 3.5 Flash 支持流式输出、工具调用和图片输入吗?

流式输出:支持;工具调用:支持;图片输入:目录未声明。这些结果直接来自当前运行时模型目录,不根据模型名称推断。

相关模型与文档

获取 API Key · gemini-3.5-flash