deepseek-v4-pro

输入价
$0.528/1M tokens
输出价
$1.584/1M tokens
上下文窗口
1M
模态
文本 → 文本

价格

API 调用价8折

输入

$0.528

输出

$1.584

缓存写入

—

缓存读取

$0.0176

分时定价

时间已按 UTC+08:00 显示

工作日09:00 – 12:00
×1
工作日14:00 – 18:00
×1

未列出的时段按原价计。

实际价格 = 上表价格 × 请求完成时刻命中时段的费率。

价格单位均为每百万 Token,已按上方折扣计算。

以上公共价格不含用户组折扣,实际账单价格可能因所属用户组而更低。



接入与能力

支持协议

兼容格式Anthropic
路由
POST /v1/messages
POST /v1/messages/count_tokens
支持特性流式输出 · 提示缓存 · 函数调用 · 系统消息
请求参数model, messages, system, tools, stream, metadata

cURL 示例

curl -X POST https://api.openmodel.ai/v1/messages \
  -H "Content-Type: application/json" \
  -H "x-api-key: $API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "deepseek-v4-pro",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Hello"}
    ]
  }'

支持能力

函数调用Function Calling
借助函数调用,您可以将模型连接到外部工具和 API。模型不会生成文本回答,而是会确定何时调用特定函数,并提供执行实际操作所需的参数。
并行工具调用Parallel Function Calling
当多个函数相互独立时,可同时调用这些函数。
工具选择Tool Choice
默认情况下,模型会自行决定何时使用工具以及使用多少个工具。您可以通过 tool_choice 参数强制指定特定行为。
结构化输出Structured Outputs
您可以将模型配置为生成符合所提供的 JSON 架构的回答。这可确保获得可预测的类型安全结果,并简化从非结构化文本中提取结构化数据的过程。
流式输出Streaming
为了实现更流畅的互动,请使用流式传输来处理生成的响应块。
系统消息System Messages
您可以使用系统指令来引导模型的行为。
提示缓存Prompt Caching
反复将相同的输入令牌传递给模型时,缓存可优化性能和成本。

上下文与限制

上下文窗口

1M

输出 token 限制

384K