Gemini 3.1 Pro Preview

供货中Google别名:gemini-3.1-pro-preview-customtools
调用名gemini-3.1-pro-preview

Google 推出的 Gemini 3.1 Pro Preview1M 上下文、64K 最大输出,支持视觉、函数调用、推理、提示词缓存、结构化输出、音频、视频、文件输入、流式输出、联网搜索。通过 SoleAPI 调用,输入 3.2 Credits / M tokens,较官方价节省 76%近 7 天可用率 83.0%;兼容 Gemini generateContent 协议,替换 Base URL 即可接入。

上下文窗口
1Mtokens
1,048,576
最大输出
64Ktokens
65,536
7 天可用率
83.0%
294 次探测 · 50 次失败
实测吞吐
82.8tokens / s
近 7 天真实流量 · 输出侧

支持能力

按目录里的能力开关如实列出,包括这个模型不支持的项。

10 / 15 项支持

视觉视觉

原生多模态:图片配文、分类、视觉问答、图表与截图理解。图像按 tokens 折算进输入价。

函数调用函数调用

把模型连接到外部工具和 API:模型判断何时调用哪个函数并给出参数,由你的代码执行;可用 tool_choice 强制或禁止调用。

推理推理

模型先进行「思考过程」再作答,显著提升多步规划与推理能力,适合编码、数学与数据分析类复杂任务。思考 tokens 按输出价计费。

提示词缓存提示词缓存

反复传入相同前缀(系统提示、长文档)时命中缓存,读取价远低于输入价;写入按时长计价。

结构化输出结构化输出

按给定 JSON Schema 约束输出,得到可预测、类型安全的结果,省去从自由文本里抽结构的步骤。

音频音频

音频输入或语音输出。

视频视频

视频输入理解或视频生成。

文件输入文件输入

直接上传 PDF 等文档,以原生视觉理解整份文档的上下文。

流式输出流式输出

SSE 逐 token 返回,首帧即转发、不做任何缓冲;Claude Code、Codex 等工具依赖此能力。

联网搜索联网搜索

上游托管的实时联网检索工具,模型自行决定何时搜索并引用来源。

实时实时不支持

WebSocket 双向低延迟语音 / 文本会话。

会话会话不支持

服务端保存多轮上下文(如 Responses 的 previous_response_id),不必每次重发历史。

媒体媒体不支持

图像 / 视频 / 音乐生成类入口。

表单上传表单上传不支持

multipart/form-data 文件上传类请求。

二进制响应二进制响应不支持

直接返回音频 / 图片字节流的入口。

稳定性与性能

SoleAPI 定期用真实供货链路探测,数据是实测不是自报。

最近探测:2026/9/9 05:09:40
83.0%近 7 天 294 次探测,50 次失败 · 故障时自动切换到备用货源
✕ 9/7/2026, 10:42:25 PM✕ 9/7/2026, 11:13:50 PM4.44 s✕ 9/8/2026, 12:15:50 AM✕ 9/8/2026, 12:47:20 AM✕ 9/8/2026, 1:18:50 AM✕ 9/8/2026, 1:50:20 AM✕ 9/8/2026, 2:21:50 AM✕ 9/8/2026, 2:53:20 AM✕ 9/8/2026, 3:24:50 AM4.04 s✕ 9/8/2026, 4:26:50 AM4.17 s3.40 s7.24 s3.98 s4.58 s6.24 s✕ 9/8/2026, 8:01:06 AM4.68 s4.26 s4.68 s✕ 9/8/2026, 10:03:32 AM✕ 9/8/2026, 10:34:41 AM✕ 9/8/2026, 11:06:00 AM9.69 s5.75 s3.96 s✕ 9/8/2026, 1:09:00 PM5.21 s5.23 s✕ 9/8/2026, 2:41:20 PM✕ 9/8/2026, 3:12:50 PM6.00 s✕ 9/8/2026, 4:14:51 PM5.30 s7.73 s5.12 s11.04 s✕ 9/8/2026, 6:48:20 PM✕ 9/8/2026, 7:19:50 PM4.15 s3.91 s5.01 s✕ 9/8/2026, 9:22:50 PM3.51 s✕ 9/8/2026, 10:24:52 PM✕ 9/8/2026, 10:56:20 PM4.28 s✕ 9/8/2026, 11:58:20 PM✕ 9/9/2026, 12:29:50 AM✕ 9/9/2026, 1:01:20 AM✕ 9/9/2026, 1:32:50 AM✕ 9/9/2026, 2:04:20 AM✕ 9/9/2026, 2:35:50 AM5.07 s4.56 s3.91 s✕ 9/9/2026, 4:38:26 AM✕ 9/9/2026, 5:09:40 AM
2026/9/7 22:42:25现在
探测成功,柱高 = 端到端延迟(刻度 0–4 s)探测失败网格 1 s

延迟与吞吐

最近一次延迟60.06s
最近 60 次平均延迟5.21s
最近 60 次 P95 延迟9.69s
输出吞吐82.8t/s
协议Gemini generateContent

接入协议与示例

Base URL 换成 SoleAPI,其余不变。原生协议直通;标「适配」的协议由网关翻译。

Gemini CLI 接入指南

Google GenAI SDK 或按 generateContent 协议写的客户端:把 base URL 指向 https://api.soleapi.com。

curl "https://api.soleapi.com/v1beta/models/gemini-3.1-pro-preview:generateContent" \
  -H "x-goog-api-key: $SOLEAPI_KEY" \
  -H "content-type: application/json" \
  -d '{
    "contents": [{"parts": [{"text": "用一句话解释提示缓存"}]}]
  }'

完整价目表

官方价 → SoleAPI 各渠道价,全部计费项,一项不藏。

计费项单位Google 官方价Gemini官方分组 ×1.6省 76%
输入每百万 tokens$2.00¥13.283.2 Credits
输出每百万 tokens$12.00¥79.6919.2 Credits
缓存读取每百万 tokens$0.2¥1.330.32 Credits
Web 搜索(通用)每千次$14.00¥92.9722.4 Credits

「省」按 1 Credit = ¥1 与当日汇率计算,等于 1 − 渠道倍率 × (1 Credit 折算成计价币种)。 Priority 档 ×1.8:请求体 service_tier 匹配 ^priority$时全部计费项按此系数计,可与任一渠道叠加。

常见问题

Gemini 3.1 Pro Preview API 多少钱?

通过 SoleAPI 调用,输入 3.2 Credits / M tokens,1 Credit = ¥1。相当于较 Google 官方价节省 76%。

Gemini 3.1 Pro Preview 的上下文窗口和输出上限是多少?

上下文窗口 1M tokens,单次最大输出 64K tokens。

Gemini 3.1 Pro Preview 支持函数调用和结构化输出吗?

支持函数调用(Function Calling)与 tool_choice 控制;支持结构化输出(JSON Schema 约束)。

可用率 83.0% 是怎么算的?

SoleAPI 定期用真实供货链路向该模型发送探测请求,统计近 7 天成功次数 ÷ 总次数。单条货源故障时网关会自动切换到备用货源,探测量的是最终用户视角的成功率。

一个 API Key,调用 Gemini 3.1 Pro Preview 与 30+ 模型

注册即送体验额度,支付宝充值,按量计费无月费。

获取 API Key