ChinaAPI Insights · 价格
中国 AI API 价格全景 — 2026 年 7 月
2026 年 7 月中国 LLM、图像和视频 API 的价格——低于 $0.20 的档位、1M 上下文俱乐部、视频按秒计费与按每次生成计费的换算,以及按工作负载该怎么选。
过去一个季度,中国模型厂商一直在相互压价,结果形成了全球最便宜、接近前沿水平的 API 市场。本文分析目前覆盖 65 个已在我们网关上线的模型:33 个 LLMs,以及 32 个图像、视频和语音模型。下文所有价格均基于 我们的公开价格数据集 生成,而非手工抄入本文。 Dataset revision: 2026-09-27; pricing fingerprint: cf6224dc69f8d229.
先坦白一点: 价格不等于质量。 本文告诉你各模型的价格;我们的基准测试系列(按模型统计的任务完成率,同样通过本网关测得)是它的配套篇,告诉你这些模型值多少。
输入价低于 $0.20 的档位
有 6 个模型的输入价低于每百万 tokens $0.20。在这一档里,真正重要的是比较输出成本:两个输入价同样便宜的模型,一旦开始生成长回答,费用就可能大幅拉开。
| 模型 | 厂商 | 输入 /1M | 输出 /1M | 上下文 |
|---|---|---|---|---|
| step-3.5-flash | StepFun | $0.1 | $0.3 | 256K |
| step-3.5-flash-2603 | StepFun | $0.1 | $0.3 | 256K |
| mimo-v2.5 | Xiaomi | $0.14 | $0.28 | 1M |
| hy3 | Tencent | $0.1481 | $0.5926 | 256K |
| qwen3.8-flash | Alibaba | $0.15 | $0.47 | 1M |
| glm-5.3-flash | Zhipu AI | $0.15 | $0.5 | 1M |
有两点值得注意。首先,这一档的输入价只在每百万 tokens $0.1 到 $0.15 之间,仅凭输入价几乎无法区分这些模型。其次,要关注 输出 价格:从 $0.28 的 mimo-v2.5 到 $0.5926 的 hy3,这一差距对生成量大的工作负载起决定性作用。
1M 上下文俱乐部
当前目录的 33 个 LLMs 中,有 18 个公布了 1M token 的上下文窗口: qwen3.6-flash、 qwen3.6-plus、 qwen3.7-max、 qwen3.7-plus、 qwen3.8-flash、 qwen3.8-max、 deepseek-flash、 deepseek-v4-pro、 LongCat-2.0、 MiniMax-M3、 kimi-k3、 step-5-preview、 hy4-preview、 mimo-v2.5、 mimo-v2.5-pro、 glm-5.2、 glm-5.3、 glm-5.3-flash。一年前,1M 上下文还是高端功能;在中国市场,它正在成为标配。
在这些百万上下文模型中, mimo-v2.5 公布的输入价最低:每百万输入 tokens $0.14(输出 $0.28)。最值得关注的长上下文模型是 Meituan 的 LongCat-2.0:一款开放权重的 MoE 推理模型,输入 $0.3 / 输出 $1.2,并提供完整的 1M 窗口——旗舰级规格,flash 档价格。
各厂商旗舰价格
取每家厂商公布的最高 输出 价格(以当前文本模型目录为准)作为统一的参照指标——而非质量排名——得到如下对比:
| 厂商 | 最高价文本模型 | 输入 /1M | 输出 /1M | 上下文 |
|---|---|---|---|---|
| Moonshot | kimi-k3 | $3 | $15 | 1M |
| Alibaba | qwen3.7-max | $2.5 | $7.5 | 1M |
| ByteDance | doubao-seed-2-1-pro-260628 | $0.8889 | $4.4444 | 256K |
| Zhipu AI | glm-5.1 | $1.4 | $4.4 | 200K |
| DeepSeek | deepseek-v4-pro | $1.32 | $3.96 | 1M |
| MiniMax | MiniMax-M3 | $0.9 | $3.6 | 1M |
| StepFun | stepaudio-2.5-chat | $1.5 | $3.5 | — |
| Tencent | hy4-preview | $0.8889 | $2.6667 | 1M |
| Meituan | LongCat-2.0 | $0.3 | $1.2 | 1M |
| Xiaomi | mimo-v2.5-pro | $0.435 | $0.87 | 1M |
Moonshot 的 kimi-k3 目前是本表中输出价最高的,为每百万 tokens $15;Xiaomi 的 mimo-v2.5-pro 则处在另一端,为 $0.87。这种价差是厂商自己的定价主张,并不能证明质量上也存在同等差距;溢价是否站得住脚,只有任务完成率基准测试才能回答。
Tencent 的 hy3 值得特别标注:这是一家大厂的模型,每百万 tokens 输入 $0.1481 / 输出 $0.5926。在中国境外访问不便,而消除这道障碍正是本网关存在的意义。
亲自运行这些模型。 一个 API key、OpenAI-compatible 端点,外加透明的美元定价。当前展示价格请查看实时价格页。
获取 API key — 赠送 $2 免费额度视频:按秒计费与按条计费,附真实算例
视频定价有两种形式,要比较二者,就得做一些厂商不会替你做的算术:
| 模型 | 厂商 | 计费方式 | 一段 5 秒代表性片段 |
|---|---|---|---|
| happyhorse-1.1-t2v | Alibaba | 每秒 $0.075 | $0.375 |
| wan2.7-t2v | Alibaba | 每秒 $0.1 | $0.5 |
| MiniMax-Hailuo-2.3-Fast | MiniMax | 每次生成 $0.1875 | $0.1875 |
| MiniMax-Hailuo-2.3 | MiniMax | 每次生成 $0.2778 | $0.2778 |
| kling-v3 | Kuaishou | 每次 5 秒 720p 无声生成 $0.42 | $0.42 |
| kling-3.0-turbo | Kuaishou | 每次生成 $0.56 | $0.56 |
做短草稿时,按每次生成计费的 MiniMax-Hailuo-2.3-Fast 在代表性目录配置下为 $0.1875。需要极短的片段或精确控制时长时,按秒计费(HappyHorse、Wan)可能更划算。ByteDance 的 Seedance 系列按具体配置定价,因此公开数据集有意不为这些行标注单一的代表性单价,而是指向实时价格。
按工作负载怎么选
我们的立场,仅基于价格和规格(质量基准测试另行发布):
- 批量抽取、分类、RAG 预处理:
mimo-v2.5(输入 $0.14 / 输出 $0.28)或deepseek-flash(输入 $0.3 / 输出 $1.2)——两者都提供 1M 窗口。 - 预算有限的长文档 Agent:
LongCat-2.0——1M 上下文,针对推理调优,输入 $0.3 / 输出 $1.2。 - 多模态 Agent 循环(图像和视频输入):先从
qwen3.8-flash开始(输入 $0.15 / 输出 $0.47)。在本目录支持图像和视频输入的百万上下文模型中,它的输出价最低;这些模型包括:qwen3.8-flash、kimi-k3、step-5-preview、glm-5.3-flash。 - 低成本视频草稿(在按每次生成计费的代表性条目中):
MiniMax-Hailuo-2.3-Fast,目前每次生成 $0.1875。 - 高端编码:Moonshot 的
kimi-k3是本目录中输出价最高的模型,为 $15/M。投入预算之前,先在你自己的代码仓库上做基准测试。
本文没有告诉你的
- 质量。 一个便宜的模型如果两次都没完成你的任务,花费可能比一次就成功的高端模型还高。我们的任务完成率基准测试是与本文配套的文章。
- 负载下的稳定性。 中国厂商的 API 在速率限制和高峰时段表现上各不相同;我们在网关层规避了其中一部分问题,但还没有公布相关数据。
- 未来的价格。 厂商调价很激进(通常是降价,偶尔先促销再恢复原价)。我们现在会为每一次价格变动留存快照,因此本文后续版本将展示趋势线,而不只是某一时点的快照。
全部 65 个模型都通过同一个 OpenAI-compatible 端点提供,只需一个 key。下载 JSON 或 CSV,阅读 方法说明,并用 $2 免费额度发送一个真实请求,验证公布的价格。
