Zhipu / GLM API 模型

Zhipu: glm-5.3-flash

Zhipu GLM-5.3-Flash(320B-A18B)——GLM-5 系列首个原生多模态模型,面向视觉编码和 Agent 工作流。支持文本、图像、视频和文件输入,上下文窗口 1M,最高输出 128K,始终开启思考,并支持函数调用、结构化输出、流式输出和上下文缓存。

规格

价格与 API 详情

透明的美元定价。无需中国大陆账号或手机号。Standard 模型价格按厂商国际刊例价的 100% 执行;部分模型在首次充值后另有 Paid 价。

上下文窗口

1M

模态

文本、图像和视频输入

输入 $/1M

$0.15

输出 $/1M

$0.5

端点

OpenAI-compatible /v1/chat/completions

关于 glm-5.3-flash

Zhipu GLM-5.3-Flash(320B-A18B)——GLM-5 系列首个原生多模态模型,面向视觉编码和 Agent 工作流。支持文本、图像、视频和文件输入,上下文窗口 1M,最高输出 128K,始终开启思考,并支持函数调用、结构化输出、流式输出和上下文缓存。

价格

透明的美元定价

glm-5.3-flash

输入 $0.15/M tokens、输出 $0.5/M tokens。以美元结算。Standard 模型价格按厂商国际刊例价的 100% 执行;部分模型在首次充值后另有 Paid 价。 查看实时价格 自动缓存命中按每 1M 输入 tokens $0.0300 计费;上方的标准输入价为缓存未命中时的价格。

快速开始

可直接复制的 API 请求

curl -X POST https://api.chinaapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $CHINAAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [
      {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ]
  }'

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["CHINAAPI_API_KEY"],
    base_url="https://api.chinaapi.ai/v1",
)

response = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[
        {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ],
)
print(response.choices[0].message.content)

站内链接

相关模型页面与指南

如何使用 glm-5.3-flash?

通过 ChinaAPI 使用 glm-5.3-flash:准备一个 API key,调用上方的 OpenAI-compatible 端点即可。

glm-5.3-flash 的价格是多少?

glm-5.3-flash 的价格为输入 $0.15/M tokens、输出 $0.5/M tokens,以美元结算。价格以实时价格页为准。首次充值后,Paid 价为输入 $0.135/M tokens、输出 $0.45/M tokens(−10%)。Standard 模型价格按厂商国际刊例价的 100% 执行;部分模型在首次充值后另有 Paid 价。

使用 glm-5.3-flash 需要中国账号吗?

不需要。ChinaAPI 无需中国大陆账号或手机号即可使用,并提供 $2 免费试用。展示的美元价格请查看实时价格页。