gemini-3.1-pro-preview

输入价
$1.80/1M tokens
输出价
$10.80/1M tokens
上下文窗口
1M
模态
文本 · 图像 · 音频 · 视频 · PDF → 文本

价格

API 调用价9折

输入

$1.80

输出

$10.80

缓存写入

—

缓存读取

$0.18

价格单位均为每百万 Token,已按上方折扣计算。

以上公共价格不含用户组折扣,实际账单价格可能因所属用户组而更低。



接入与能力

支持协议

Gemini API
兼容格式Google Gemini
路由
POST /v1beta/models/{model}:{action}
支持特性流式输出 · 推理 · 提示缓存
请求参数contents, systemInstruction, tools, generationConfig

cURL 示例

curl -X POST "https://api.openmodel.ai/v1beta/models/gemini-3.1-pro-preview:generateContent?key=$API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {"role": "user", "parts": [{"text": "Hello"}]}
    ]
  }'

支持能力

函数调用Function Calling
借助函数调用,您可以将模型连接到外部工具和 API。模型不会生成文本回答,而是会确定何时调用特定函数,并提供执行实际操作所需的参数。
工具选择Tool Choice
默认情况下,模型会自行决定何时使用工具以及使用多少个工具。您可以通过 tool_choice 参数强制指定特定行为。
结构化输出Structured Outputs
您可以将模型配置为生成符合所提供的 JSON 架构的回答。这可确保获得可预测的类型安全结果,并简化从非结构化文本中提取结构化数据的过程。
流式输出Streaming
为了实现更流畅的互动,请使用流式传输来处理生成的响应块。
系统消息System Messages
您可以使用系统指令来引导模型的行为。
推理Reasoning
模型采用「思考过程」,可显著提升推理和多步规划能力,非常适合处理编码、高等数学和数据分析等复杂任务。
提示缓存Prompt Caching
反复将相同的输入令牌传递给模型时,缓存可优化性能和成本。
视觉理解Vision
模型从一开始就具有多模态特性,可用于执行各种图像处理和计算机视觉任务,包括图片配文、分类和视觉问答。
音频输入Audio Input
可以分析音频输入内容并生成文本回答。
视频输入Video Input
模型可以处理视频,包括描述视频、对视频进行分段和提取视频中的信息、回答有关视频内容的问题,以及引用视频中的特定时间戳。
PDF 输入PDF Input
可以处理 PDF 格式的文档,并使用原生视觉功能来理解整个文档的上下文。
URL 上下文URL Context
借助网址上下文工具,您可以以网址的形式为模型提供额外的上下文。模型将访问这些网页中的内容,以便为回答提供信息并改进回答。
网页搜索Web Search
可将模型与实时 Web 内容连接起来,从而提供更准确的回答,并引用其知识截点之外的可验证来源。
服务等级Service Tier
弹性处理以更慢的响应时间换取更低的费用;优先处理则提供显著更低且更稳定的延迟。

上下文与限制

上下文窗口

1M

输出 token 限制

65.5K

音频时长上限(小时)

8.4h

每个提示的图片数上限

3000