Gemini 2.5 Flash

供货中Google别名:gemini-2.5-flash-preview-04-17, gemini-2.5-flash-preview-05-20
调用名gemini-2.5-flash

Google 推出的 Gemini 2.5 Flash1M 上下文、64K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、音频、流式输出、联网搜索。通过 SoleAPI 调用,输入 0.48 Credits / M tokens,较官方价节省 76%近 7 天可用率 99.3%;兼容 Gemini generateContent 协议,替换 Base URL 即可接入。

上下文窗口
1Mtokens
1,048,576
最大输出
64Ktokens
65,536
7 天可用率
99.3%
297 次探测 · 2 次失败
实测吞吐
近 7 天真实流量 · 输出侧

支持能力

按目录里的能力开关如实列出,包括这个模型不支持的项。

8 / 15 项支持

视觉视觉

原生多模态:图片配文、分类、视觉问答、图表与截图理解。图像按 tokens 折算进输入价。

函数调用函数调用

把模型连接到外部工具和 API:模型判断何时调用哪个函数并给出参数,由你的代码执行;可用 tool_choice 强制或禁止调用。

推理推理

模型先进行「思考过程」再作答,显著提升多步规划与推理能力,适合编码、数学与数据分析类复杂任务。思考 tokens 按输出价计费。

提示词缓存提示词缓存

反复传入相同前缀(系统提示、长文档)时命中缓存,读取价远低于输入价;写入按时长计价。

结构化输出结构化输出

按给定 JSON Schema 约束输出,得到可预测、类型安全的结果,省去从自由文本里抽结构的步骤。

音频音频

音频输入或语音输出。

流式输出流式输出

SSE 逐 token 返回,首帧即转发、不做任何缓冲;Claude Code、Codex 等工具依赖此能力。

联网搜索联网搜索

上游托管的实时联网检索工具,模型自行决定何时搜索并引用来源。

视频视频不支持

视频输入理解或视频生成。

文件输入文件输入不支持

直接上传 PDF 等文档,以原生视觉理解整份文档的上下文。

实时实时不支持

WebSocket 双向低延迟语音 / 文本会话。

会话会话不支持

服务端保存多轮上下文(如 Responses 的 previous_response_id),不必每次重发历史。

媒体媒体不支持

图像 / 视频 / 音乐生成类入口。

表单上传表单上传不支持

multipart/form-data 文件上传类请求。

二进制响应二进制响应不支持

直接返回音频 / 图片字节流的入口。

稳定性与性能

SoleAPI 定期用真实供货链路探测,数据是实测不是自报。

最近探测:2026/9/9 05:30:13
99.3%近 7 天 297 次探测,2 次失败 · 故障时自动切换到备用货源
1.63 s2.98 s6.59 s1.59 s1.67 s1.72 s1.95 s3.02 s1.66 s2.24 s1.83 s2.10 s2.18 s50.68 s2.66 s2.12 s25.50 s8.65 s1.83 s2.10 s1.57 s1.91 s3.21 s2.70 s2.30 s4.60 s1.82 s1.81 s6.41 s3.88 s1.81 s1.88 s1.55 s2.49 s3.90 s28.86 s1.80 s2.17 s1.88 s2.31 s1.90 s1.79 s1.63 s2.73 s3.38 s1.71 s1.48 s1.67 s1.64 s1.69 s1.69 s1.67 s11.82 s2.16 s1.64 s6.08 s3.48 s2.16 s4.99 s2.50 s
2026/9/7 23:32:51现在
探测成功,柱高 = 端到端延迟(刻度 0–4 s)探测失败网格 1 s

延迟与吞吐

最近一次延迟2.50s
最近 60 次平均延迟4.36s
最近 60 次 P95 延迟11.82s
输出吞吐
协议Gemini generateContent

接入协议与示例

Base URL 换成 SoleAPI,其余不变。原生协议直通;标「适配」的协议由网关翻译。

Gemini CLI 接入指南

Google GenAI SDK 或按 generateContent 协议写的客户端:把 base URL 指向 https://api.soleapi.com。

curl "https://api.soleapi.com/v1beta/models/gemini-2.5-flash:generateContent" \
  -H "x-goog-api-key: $SOLEAPI_KEY" \
  -H "content-type: application/json" \
  -d '{
    "contents": [{"parts": [{"text": "用一句话解释提示缓存"}]}]
  }'

完整价目表

官方价 → SoleAPI 各渠道价,全部计费项,一项不藏。

计费项单位Google 官方价Gemini官方分组 ×1.6省 76%
输入每百万 tokens$0.3¥1.990.48 Credits
输出每百万 tokens$2.50¥16.604 Credits
缓存读取每百万 tokens$0.03¥0.1990.048 Credits
图像输入每百万 tokens$0.3¥1.990.48 Credits
音频输入每百万 tokens$1.00¥6.641.6 Credits
视频输入每百万 tokens$0.3¥1.990.48 Credits
Web 搜索(通用)每千次$35.00¥232.4356 Credits

「省」按 1 Credit = ¥1 与当日汇率计算,等于 1 − 渠道倍率 × (1 Credit 折算成计价币种)。 Flex 档 ×0.5:请求体 service_tier 匹配 ^flex$时全部计费项按此系数计,可与任一渠道叠加。 Priority 档 ×1.8:请求体 service_tier 匹配 ^priority$时全部计费项按此系数计,可与任一渠道叠加。

常见问题

Gemini 2.5 Flash API 多少钱?

通过 SoleAPI 调用,输入 0.48 Credits / M tokens,1 Credit = ¥1。相当于较 Google 官方价节省 76%。

Gemini 2.5 Flash 的上下文窗口和输出上限是多少?

上下文窗口 1M tokens,单次最大输出 64K tokens。

Gemini 2.5 Flash 支持函数调用和结构化输出吗?

支持函数调用(Function Calling)与 tool_choice 控制;支持结构化输出(JSON Schema 约束)。

可用率 99.3% 是怎么算的?

SoleAPI 定期用真实供货链路向该模型发送探测请求,统计近 7 天成功次数 ÷ 总次数。单条货源故障时网关会自动切换到备用货源,探测量的是最终用户视角的成功率。

一个 API Key,调用 Gemini 2.5 Flash 与 30+ 模型

注册即送体验额度,支付宝充值,按量计费无月费。

获取 API Key