Gemini 3 Flash Preview

供货中Google
调用名gemini-3-flash-preview

Google 推出的 Gemini 3 Flash Preview1M 上下文、64K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、音频、视频、文件输入、流式输出、联网搜索。通过 SoleAPI 调用,输入 0.8 Credits / M tokens,较官方价节省 76%近 7 天可用率 96.8%;兼容 Gemini generateContent 协议,替换 Base URL 即可接入。

上下文窗口
1Mtokens
1,048,576
最大输出
64Ktokens
65,536
7 天可用率
96.8%
344 次探测 · 11 次失败
实测吞吐
近 7 天真实流量 · 输出侧

支持能力

按目录里的能力开关如实列出,包括这个模型不支持的项。

10 / 15 项支持

视觉视觉

原生多模态:图片配文、分类、视觉问答、图表与截图理解。图像按 tokens 折算进输入价。

函数调用函数调用

把模型连接到外部工具和 API:模型判断何时调用哪个函数并给出参数,由你的代码执行;可用 tool_choice 强制或禁止调用。

推理推理

模型先进行「思考过程」再作答,显著提升多步规划与推理能力,适合编码、数学与数据分析类复杂任务。思考 tokens 按输出价计费。

提示词缓存提示词缓存

反复传入相同前缀(系统提示、长文档)时命中缓存,读取价远低于输入价;写入按时长计价。

结构化输出结构化输出

按给定 JSON Schema 约束输出,得到可预测、类型安全的结果,省去从自由文本里抽结构的步骤。

音频音频

音频输入或语音输出。

视频视频

视频输入理解或视频生成。

文件输入文件输入

直接上传 PDF 等文档,以原生视觉理解整份文档的上下文。

流式输出流式输出

SSE 逐 token 返回,首帧即转发、不做任何缓冲;Claude Code、Codex 等工具依赖此能力。

联网搜索联网搜索

上游托管的实时联网检索工具,模型自行决定何时搜索并引用来源。

实时实时不支持

WebSocket 双向低延迟语音 / 文本会话。

会话会话不支持

服务端保存多轮上下文(如 Responses 的 previous_response_id),不必每次重发历史。

媒体媒体不支持

图像 / 视频 / 音乐生成类入口。

表单上传表单上传不支持

multipart/form-data 文件上传类请求。

二进制响应二进制响应不支持

直接返回音频 / 图片字节流的入口。

稳定性与性能

SoleAPI 定期用真实供货链路探测,数据是实测不是自报。

最近探测:2026/9/10 07:01:25
96.8%近 7 天 344 次探测,11 次失败 · 故障时自动切换到备用货源
14.23 s14.07 s14.40 s14.15 s14.40 s1.78 s2.54 s3.58 s14.32 s✕ 9/9/2026, 5:10:54 AM13.94 s2.58 s2.43 s3.27 s3.44 s3.09 s25.04 s3.24 s26.37 s3.23 s14.48 s14.40 s2.48 s5.06 s14.50 s13.97 s17.24 s14.53 s29.55 s14.89 s2.69 s3.75 s14.33 s7.00 s14.40 s2.45 s3.25 s18.59 s5.07 s2.45 s6.00 s6.82 s24.45 s3.65 s14.28 s14.13 s14.50 s14.62 s34.26 s2.99 s14.03 s5.62 s14.56 s13.88 s13.85 s14.06 s14.62 s3.51 s13.91 s19.54 s
2026/9/9 00:30:18现在
探测成功,柱高 = 端到端延迟(刻度 0–4 s)探测失败网格 1 s

延迟与吞吐

最近一次延迟19.54s
最近 60 次平均延迟11.16s
最近 60 次 P95 延迟26.37s
输出吞吐
协议Gemini generateContent

接入协议与示例

Base URL 换成 SoleAPI,其余不变。原生协议直通;标「适配」的协议由网关翻译。

Gemini CLI 接入指南

Google GenAI SDK 或按 generateContent 协议写的客户端:把 base URL 指向 https://api.soleapi.com。

curl "https://api.soleapi.com/v1beta/models/gemini-3-flash-preview:generateContent" \
  -H "x-goog-api-key: $SOLEAPI_KEY" \
  -H "content-type: application/json" \
  -d '{
    "contents": [{"parts": [{"text": "用一句话解释提示缓存"}]}]
  }'

完整价目表

官方价 → SoleAPI 各渠道价,全部计费项,一项不藏。

计费项单位Google 官方价Gemini官方分组 ×1.6省 76%
输入每百万 tokens$0.5¥3.320.8 Credits
输出每百万 tokens$3.00¥19.924.8 Credits
缓存读取每百万 tokens$0.05¥0.3320.08 Credits
图像输入每百万 tokens$0.5¥3.320.8 Credits
音频输入每百万 tokens$1.00¥6.641.6 Credits
视频输入每百万 tokens$0.5¥3.320.8 Credits
Web 搜索(通用)每千次$14.00¥92.9722.4 Credits

「省」按 1 Credit = ¥1 与当日汇率计算,等于 1 − 渠道倍率 × (1 Credit 折算成计价币种)。 Priority 档:请求体 service_tier 匹配 ^priority$时按 音频输入 ×2.7、缓存读取 ×2.7、输出 ×2.7、图像输入 ×2.7、输入 ×2.7、视频输入 ×2.7、其余计费项 ×2.7 计,可与任一渠道叠加。

常见问题

Gemini 3 Flash Preview API 多少钱?

通过 SoleAPI 调用,输入 0.8 Credits / M tokens,1 Credit = ¥1。相当于较 Google 官方价节省 76%。

Gemini 3 Flash Preview 的上下文窗口和输出上限是多少?

上下文窗口 1M tokens,单次最大输出 64K tokens。

Gemini 3 Flash Preview 支持函数调用和结构化输出吗?

支持函数调用(Function Calling)与 tool_choice 控制;支持结构化输出(JSON Schema 约束)。

可用率 96.8% 是怎么算的?

SoleAPI 定期用真实供货链路向该模型发送探测请求,统计近 7 天成功次数 ÷ 总次数。单条货源故障时网关会自动切换到备用货源,探测量的是最终用户视角的成功率。

一个 API Key,调用 Gemini 3 Flash Preview 与 30+ 模型

注册即送体验额度,支付宝充值,按量计费无月费。

获取 API Key