gemini-3.6-flash

输入价
$0.75/1M tokens
输出价
$3.75/1M tokens
上下文窗口
1M
模态
文本 · 图像 → 文本

价格

API 调用价

输入

$0.75

输出

$3.75

缓存写入

$0.75

缓存读取

$0.075

价格单位均为每百万 Token,已按上方折扣计算。

以上公共价格不含用户组折扣,实际账单价格可能因所属用户组而更低。



接入与能力

支持协议

Gemini API
兼容格式Google Gemini
路由
POST /v1beta/models/{model}:{action}
支持特性流式输出 · 推理 · 提示缓存
请求参数contents, systemInstruction, tools, generationConfig

cURL 示例

curl -X POST "https://api.openmodel.ai/v1beta/models/gemini-3.6-flash:generateContent?key=$API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      {"role": "user", "parts": [{"text": "Hello"}]}
    ]
  }'

支持能力

函数调用Function Calling
借助函数调用,您可以将模型连接到外部工具和 API。模型不会生成文本回答,而是会确定何时调用特定函数,并提供执行实际操作所需的参数。
并行工具调用Parallel Function Calling
当多个函数相互独立时,可同时调用这些函数。
结构化输出Structured Outputs
您可以将模型配置为生成符合所提供的 JSON 架构的回答。这可确保获得可预测的类型安全结果,并简化从非结构化文本中提取结构化数据的过程。
系统消息System Messages
您可以使用系统指令来引导模型的行为。
提示缓存Prompt Caching
反复将相同的输入令牌传递给模型时,缓存可优化性能和成本。
视觉理解Vision
模型从一开始就具有多模态特性,可用于执行各种图像处理和计算机视觉任务,包括图片配文、分类和视觉问答。
网页搜索Web Search
可将模型与实时 Web 内容连接起来,从而提供更准确的回答,并引用其知识截点之外的可验证来源。

上下文与限制

上下文窗口

1M

输出 token 限制

65.5K