glm-5.3-flashx

输入价
$0.37/1M tokens
输出价
$1.25/1M tokens
上下文窗口
1M
模态
文本 → 文本

价格

API 调用价

输入

$0.37

输出

$1.25

缓存写入

$0.00

缓存读取

$0.75

价格单位均为每百万 Token,已按上方折扣计算。

以上公共价格不含用户组折扣,实际账单价格可能因所属用户组而更低。



接入与能力

支持协议

Messages API
兼容格式Anthropic
路由
POST /v1/messages
POST /v1/messages/count_tokens
支持特性流式输出 · 提示缓存 · 函数调用 · 系统消息
请求参数model, messages, system, tools, stream, metadata

cURL 示例

curl -X POST https://api.openmodel.ai/v1/messages \
  -H "Content-Type: application/json" \
  -H "x-api-key: $API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -d '{
    "model": "glm-5.3-flashx",
    "max_tokens": 1024,
    "messages": [
      {"role": "user", "content": "Hello"}
    ]
  }'

支持能力

函数调用Function Calling
借助函数调用,您可以将模型连接到外部工具和 API。模型不会生成文本回答,而是会确定何时调用特定函数,并提供执行实际操作所需的参数。
工具选择Tool Choice
默认情况下,模型会自行决定何时使用工具以及使用多少个工具。您可以通过 tool_choice 参数强制指定特定行为。
推理Reasoning
模型采用「思考过程」,可显著提升推理和多步规划能力,非常适合处理编码、高等数学和数据分析等复杂任务。

上下文与限制

上下文窗口

1M

输出 token 限制

128K