ChinaAPI Insights · 价格

中国 AI API 价格全景 — 2026 年 7 月

2026 年 7 月中国 LLM、图像和视频 API 的价格——低于 $0.20 的档位、1M 上下文俱乐部、视频按秒计费与按每次生成计费的换算,以及按工作负载该怎么选。

ChinaAPI Research · 2026-07-06 · 最后更新于 2026-09-28

过去一个季度,中国模型厂商一直在相互压价,结果形成了全球最便宜、接近前沿水平的 API 市场。本文分析目前覆盖 65 个已在我们网关上线的模型:33 个 LLMs,以及 32 个图像、视频和语音模型。下文所有价格均基于 我们的公开价格数据集 生成,而非手工抄入本文。 Dataset revision: 2026-09-27; pricing fingerprint: cf6224dc69f8d229.

先坦白一点: 价格不等于质量。 本文告诉你各模型的价格;我们的基准测试系列(按模型统计的任务完成率,同样通过本网关测得)是它的配套篇,告诉你这些模型值多少。

输入价低于 $0.20 的档位

有 6 个模型的输入价低于每百万 tokens $0.20。在这一档里,真正重要的是比较输出成本:两个输入价同样便宜的模型,一旦开始生成长回答,费用就可能大幅拉开。

模型厂商输入 /1M输出 /1M上下文
step-3.5-flashStepFun$0.1$0.3256K
step-3.5-flash-2603StepFun$0.1$0.3256K
mimo-v2.5Xiaomi$0.14$0.281M
hy3Tencent$0.1481$0.5926256K
qwen3.8-flashAlibaba$0.15$0.471M
glm-5.3-flashZhipu AI$0.15$0.51M

有两点值得注意。首先,这一档的输入价只在每百万 tokens $0.1 到 $0.15 之间,仅凭输入价几乎无法区分这些模型。其次,要关注 输出 价格:从 $0.28 的 mimo-v2.5 到 $0.5926 的 hy3,这一差距对生成量大的工作负载起决定性作用。

1M 上下文俱乐部

当前目录的 33 个 LLMs 中,有 18 个公布了 1M token 的上下文窗口: qwen3.6-flash、 qwen3.6-plus、 qwen3.7-max、 qwen3.7-plus、 qwen3.8-flash、 qwen3.8-max、 deepseek-flash、 deepseek-v4-pro、 LongCat-2.0、 MiniMax-M3、 kimi-k3、 step-5-preview、 hy4-preview、 mimo-v2.5、 mimo-v2.5-pro、 glm-5.2、 glm-5.3、 glm-5.3-flash。一年前,1M 上下文还是高端功能;在中国市场,它正在成为标配。

在这些百万上下文模型中, mimo-v2.5 公布的输入价最低:每百万输入 tokens $0.14(输出 $0.28)。最值得关注的长上下文模型是 Meituan 的 LongCat-2.0:一款开放权重的 MoE 推理模型,输入 $0.3 / 输出 $1.2,并提供完整的 1M 窗口——旗舰级规格,flash 档价格。

各厂商旗舰价格

取每家厂商公布的最高 输出 价格(以当前文本模型目录为准)作为统一的参照指标——而非质量排名——得到如下对比:

厂商最高价文本模型输入 /1M输出 /1M上下文
Moonshotkimi-k3$3$151M
Alibabaqwen3.7-max$2.5$7.51M
ByteDancedoubao-seed-2-1-pro-260628$0.8889$4.4444256K
Zhipu AIglm-5.1$1.4$4.4200K
DeepSeekdeepseek-v4-pro$1.32$3.961M
MiniMaxMiniMax-M3$0.9$3.61M
StepFunstepaudio-2.5-chat$1.5$3.5—
Tencenthy4-preview$0.8889$2.66671M
MeituanLongCat-2.0$0.3$1.21M
Xiaomimimo-v2.5-pro$0.435$0.871M

Moonshot 的 kimi-k3 目前是本表中输出价最高的,为每百万 tokens $15;Xiaomi 的 mimo-v2.5-pro 则处在另一端,为 $0.87。这种价差是厂商自己的定价主张,并不能证明质量上也存在同等差距;溢价是否站得住脚,只有任务完成率基准测试才能回答。

Tencent 的 hy3 值得特别标注:这是一家大厂的模型,每百万 tokens 输入 $0.1481 / 输出 $0.5926。在中国境外访问不便,而消除这道障碍正是本网关存在的意义。

亲自运行这些模型。 一个 API key、OpenAI-compatible 端点,外加透明的美元定价。当前展示价格请查看实时价格页。

获取 API key — 赠送 $2 免费额度

视频:按秒计费与按条计费,附真实算例

视频定价有两种形式,要比较二者,就得做一些厂商不会替你做的算术:

模型厂商计费方式一段 5 秒代表性片段
happyhorse-1.1-t2vAlibaba每秒 $0.075$0.375
wan2.7-t2vAlibaba每秒 $0.1$0.5
MiniMax-Hailuo-2.3-FastMiniMax每次生成 $0.1875$0.1875
MiniMax-Hailuo-2.3MiniMax每次生成 $0.2778$0.2778
kling-v3Kuaishou每次 5 秒 720p 无声生成 $0.42$0.42
kling-3.0-turboKuaishou每次生成 $0.56$0.56

做短草稿时,按每次生成计费的 MiniMax-Hailuo-2.3-Fast 在代表性目录配置下为 $0.1875。需要极短的片段或精确控制时长时,按秒计费(HappyHorse、Wan)可能更划算。ByteDance 的 Seedance 系列按具体配置定价,因此公开数据集有意不为这些行标注单一的代表性单价,而是指向实时价格。

按工作负载怎么选

我们的立场,仅基于价格和规格(质量基准测试另行发布):

本文没有告诉你的

全部 65 个模型都通过同一个 OpenAI-compatible 端点提供,只需一个 key。下载 JSON 或 CSV,阅读 方法说明,并用 $2 免费额度发送一个真实请求,验证公布的价格。

在 ChinaAPI 上试试。 本文中的每个模型都已上线,统一通过一个端点调用——无需中国大陆账号或手机号,起步即享 $2 免费试用。

免费开始 — 赠送 $2 额度 查看实时价格
Method & data. Written by: ChinaAPI Research. Published 2026-07-06, last updated 2026-09-28. Data source: ChinaAPI public model-pricing dataset, generated from gateway-reconciled models-data.json. Standard token-model rates follow providers' international list prices at 100%; some models have a separate Paid rate after the first top-up. Media rates use the displayed billing unit and may include a service margin covering provider input/output billing, payment processing, chargeback exposure, and operations; any margin is included in the displayed rate and is not added separately. The 实时价格页 is authoritative.