<!-- GENERATED BY scripts/gen_localization_release.py; DO NOT EDIT; source: zh-cn/model-updates/index.html -->

# 中国 AI 都发布了什么

> 追踪中国 AI 模型的发布日期与可用情况，涵盖主要的 LLM、图像、视频和音频模型系列。

- Canonical page: https://chinaapi.ai/zh-cn/model-updates/
- Human-readable page: https://chinaapi.ai/zh-cn/model-updates/
- Live pricing: https://dash.chinaapi.ai/models?lang=zh-cn&utm_source=chinaapi&utm_medium=markdown&utm_campaign=model-updates

简明的中国 AI 模型发布动态，每条均附来源链接，ChinaAPI 上的可用情况一目了然。源数据中有 3 个估计日期和 5 个未知日期，均已标注。

[查看实时价格](https://dash.chinaapi.ai/models?lang=zh-cn&utm_source=chinaapi&utm_medium=model-updates&utm_campaign=pricing)

[浏览模型页面](https://chinaapi.ai/zh-cn/models/)

[Agent 生态动态](https://chinaapi.ai/zh-cn/agent-updates/)

## 发布墙

### 2026.09

**Xiaomi MiMo-V2.6-Pro-UltraSpeed** LLM MiMo V2.6 [来源 · mimo.mi.com](https://mimo.mi.com/models/zh-CN/mimo-v2.6-pro-ultraspeed)

Xiaomi 发布了一个低延迟服务档位，保留 MiMo-V2.6-Pro 的全模态输入、旗舰级推理能力、1M tokens 上下文窗口和 128K 输出上限。Xiaomi 宣称其输出速度最高可达标准 Pro 服务的 20 倍；RPM 和 TPM 以定制服务的形式提供。官方 API model ID 为 mimo-v2.6-pro-ultraspeed。ChinaAPI 已上架该路由供客户调用；当前价格请查看实时模型目录。 2026-09-22 ✓ On ChinaAPI confirmed **Xiaomi MiMo-V2.6-Pro** LLM MiMo V2.6 [来源 · mimo.mi.com](https://mimo.mi.com/docs/zh-CN/news/latest/v2-6)

Xiaomi 发布了原生全模态旗舰推理模型，面向复杂项目、长程任务、网络安全和科研。MiMo-V2.6-Pro 接受文本、图像、视频和音频输入，输出文本，提供 1M tokens 上下文窗口和最高 128K 输出，并支持深度思考、工具调用、流式输出、联网搜索、结构化输出和上下文缓存。官方 API model ID 为 mimo-v2.6-pro。ChinaAPI 现已提供该路由供客户调用；当前价格请查看实时模型目录。 2026-09-22 ✓ On ChinaAPI confirmed **Xiaomi MiMo-V2.6-Flash** LLM MiMo V2.6 [来源 · mimo.mi.com](https://mimo.mi.com/docs/zh-CN/news/latest/v2-6)

Xiaomi 发布了原生全模态推理模型，针对高频专业工作和规模化任务调优，成本更低。MiMo-V2.6-Flash 接受文本、图像、视频和音频输入，输出文本，提供 1M tokens 上下文窗口和最高 128K 输出，并支持深度思考、工具调用、流式输出、联网搜索、结构化输出和上下文缓存。官方 API model ID 为 mimo-v2.6-flash。ChinaAPI 现已提供该路由供客户调用；当前价格请查看实时模型目录。 2026-09-22 ✓ On ChinaAPI confirmed **Xiaomi Batch API for MiMo-V2.6** LLM MiMo Batch API [来源 · mimo.mi.com](https://mimo.mi.com/docs/zh-CN/quick-start/usage-guide/text-generation/batch-api)

Xiaomi 为 mimo-v2.6-pro 和 mimo-v2.6-flash 推出了异步 Batch API 推理，价格为其实时 API 价格的 50%。该服务面向评测、标注和批量生成等非实时任务，接受 JSONL 请求，支持 OpenAI Chat Completions、OpenAI Responses 和 Anthropic Messages 请求格式，但不支持流式输出。ChinaAPI 提供的是这两个模型的实时路由，并不意味着支持 Xiaomi 独立的 Batch API。 2026-09-22 Not on ChinaAPI confirmed [StepFun Step 5 Preview](https://chinaapi.ai/zh-cn/models/step-5-preview/)

LLM Step 5 [来源 · stepfun.com](https://www.stepfun.com/step-5-preview)

StepFun 于 2026-09-20 发布 Step 5 Preview，作为其面向软件工程、长程 Agent 任务、专业知识工作和金融领域的旗舰模型。这款稀疏混合专家模型总参数 600B，每个 token 激活 27B，上下文窗口为 1M tokens。官方 API model ID 为 step-5-preview；它接受文本、图像和视频输入，输出文本，最多支持 64K 输出 tokens。该 API 还支持流式输出、工具调用、JSON Mode 和 JSON Schema、low/medium/high 推理强度以及提示词缓存。StepFun 公布其 Artificial Analysis Intelligence Index 得分为 44，并给出了一系列编码、Agent、金融和多模态基准测试结果；以上均为厂商自报结果，并非 ChinaAPI 实测。StepFun 表示将于 2026-10-15 发布开放权重。ChinaAPI 实时模型目录现已将 step-5-preview 上架为可供客户调用的路由，按厂商刊例价计费：输入 $1.00/M tokens、输出 $2.70/M tokens、提示词缓存读取 $0.05/M tokens；以实时网关为准。 2026-09-20 ✓ On ChinaAPI confirmed **Alibaba Qwen Qwen-Image-2.1 open weights** Image Qwen-Image [来源 · github.com](https://github.com/QwenLM/Qwen-Image-2.1)

Qwen 于 2026-09-20 发布了 Qwen-Image-2.1 权重。其 7B 参数的视觉生成组件统一了文生图与图像编辑，支持原生 RGBA 透明通道、最多 10 张参考图像、局部编辑和 2K 输出。以上能力均由 Qwen 自行公布，并非 ChinaAPI 实测。权重采用 Qwen Research License，在未另行取得商业许可的情况下，仅允许非商业性的研究与评估。Alibaba Model Studio 尚未公布 Qwen-Image-2.1 的 API model ID 或价格，ChinaAPI 不提供该路由，也未发布相应的 ChinaAPI 模型页面或价格。 2026-09-20 Not on ChinaAPI confirmed [DeepSeek V4.1-Flash](https://chinaapi.ai/zh-cn/models/deepseek-flash/)

LLM DeepSeek V4.1 [来源 · deepseek.com](https://deepseek.com/news/deepseek-v4-1-flash/)

DeepSeek 于 2026-09-10 发布并开源了 DeepSeek-V4.1-Flash。这款原生图文模型采用 552B 参数的混合专家因果编码器-解码器（Causal Encoder-Decoder）架构，输入预填充阶段激活 8B 参数，输出解码阶段激活 16B 参数，上下文窗口为 1M，最高输出 384K。DeepSeek 称其公布的基准测试结果超过 V4 Pro，且新的 KV Cache 设计所需的 HBM 仅为上一代 V4 Flash 的四分之一，SSD 存储仅为其八分之一；以上均为厂商说法，并非 ChinaAPI 实测。直连 DeepSeek API 时的 model ID 为 deepseek-flash。DeepSeek 已下线独立的 V4 Flash 和 Vision-Exp 检查点，但暂时将它们的旧 model IDs 映射到 V4.1 Flash。ChinaAPI 实时模型目录现已上架规范的 deepseek-flash ID，取代两个旧的 Flash ID；两个已下线 Flash 模型的营销页 URL 会重定向到该规范模型页面。非高峰时段价格为输入 $0.15/M tokens、输出 $0.60/M tokens、缓存读取 $0.003/M tokens；北京时间工作日高峰时段价格正好是其 2 倍，即输入 $0.30/M tokens、输出 $1.20/M tokens、缓存读取 $0.006/M tokens。以实时网关为准。DeepSeek 此前还宣布，2026-09-14 之后直接调用 deepseek-v4-pro 的请求将路由到 V4.1 Flash，但随后撤回了该计划：V4 Pro 在该日期之后仍然可用，计费不变，deepseek-v4-pro 在 ChinaAPI 上仍是一条独立路由。 2026-09-10 ✓ On ChinaAPI confirmed **Tencent Hunyuan AuK and AuK-Flash open source** Audio AuK [来源 · github.com](https://github.com/Tencent-Hunyuan/AuK)

Tencent 于 2026-09-09 开源了 AuK 和 AuK-Flash。AuK 是一个 1.5B 参数的语音生成与编辑基础模型，训练使用了 195 万小时的有效监督数据，涵盖语音生成、内容编辑、增强与分离、副语言编辑和声学编辑。一个共享的自然语言指令接口支持零样本和基于指令的 TTS、语音与歌词编辑、音高/语速/音量调整、情感与音色编辑、去口音、非语言声音编辑、增强以及音源分离。AuK-Flash 是蒸馏得到的四步版本；论文报告，在相同条件下按实际耗时（wall-clock）计算，其速度是 AuK 的 4.5 倍，这是厂商公布的结果，并非 ChinaAPI 实测。两个官方仓库均提供可下载的 MIT 许可证权重，并使用 Qwen2.5-Omni-3B 作为外部编码器。官方代码和 SGLang-Omni 提供了自托管推理的文档，但 ChinaAPI 目前未将 AuK 作为可供客户调用的路由开放，因此没有发布 API 价格或模型页面。 2026-09-09 Not on ChinaAPI confirmed

### 2026.08

[Tencent Hy 团队 Hy4 preview 开放权重](https://chinaapi.ai/zh-cn/models/hy4-preview/)

LLM Hy4 [来源 · github.com](https://github.com/Tencent-Hunyuan/Hy4-preview)

Tencent 于 2026-08-28 开源了 Hy4 preview，这是一款 770B 参数的混合专家模型，每个 token 激活 49B 主干参数，另有一个原生 10B MTP 层用于投机解码。该文本模型支持 1M 上下文窗口，在两个官方权重仓库中发布：原始检查点和 FP8 精度版本。Tencent 的文档介绍了通过 vLLM 和 SGLang 提供 OpenAI-compatible 服务的方式；官方 SGLang 部署矩阵包括在 8x B200 或 4x B300/GB300 上运行 FP8，以及在 16x H200 上运行 BF16。此次发布采用 Apache-2.0 许可证，定位于长程软件工程、办公分析、游戏开发和科学研究；已公布的评测结果来自厂商，并非 ChinaAPI 实测。ChinaAPI 已将 hy4-preview 上架为可供客户调用的路由，并提供专门的模型页面和部署成本分析；当前价格以实时模型目录为准。 2026-08-28 ✓ On ChinaAPI confirmed [Zhipu / Z.ai GLM-5.3-Flash](https://chinaapi.ai/zh-cn/models/glm-5.3-flash/)

LLM GLM [来源 · docs.bigmodel.cn](https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash)

Z.ai 于 2026-08-27 发布并开源了 GLM-5.3-Flash（320B-A18B），这是 GLM-5 系列首个原生多模态模型。它接受文本、图像、视频和文件输入，上下文窗口为 1M，最高输出 128K。官方 Chat Completion API 始终开启思考模式，并支持函数调用、上下文缓存和结构化输出。其低成本架构将稀疏注意力和线性注意力与流形约束超连接（Manifold-Constrained Hyper-Connections）相结合；Z.ai 称该模型在 30T 多模态 tokens 上完成预训练，与 GLM-5.3 相比，注意力计算量降低 3.01 倍，平均每层 KV cache 降低 4.44 倍。Z.ai 还公布其 Artificial Analysis Intelligence Index 得分为 57，编码性能与 Claude Opus 4.8 相当；以上均为厂商说法，并非 ChinaAPI 实测。glm-5.3-flash 路由现已可在 ChinaAPI 上供客户调用，可通过 OpenAI-compatible 和 Anthropic-compatible 端点接入，支持文本、图像和视频输入。 2026-08-27 ✓ On ChinaAPI confirmed [Alibaba Qwen Qwen3.8-Flash-Next 开放权重与部署](https://chinaapi.ai/zh-cn/models/qwen3.8-flash/)

LLM Qwen3.8 [来源 · github.com](https://github.com/QwenLM/Qwen3.8-Flash-Next)

Qwen 于 2026-08-26 发布了 Qwen3.8-Flash-Next，作为 Qwen4 架构的多模态混合专家预览版。其语言模型包含 125B 参数的主模型、额外 51B 的 N-gram 嵌入和 4B 的 MTP 模块，每个 token 激活 6B 参数；原生上下文为 262K，可通过 YaRN 扩展到 1M。Qwen 发布了官方 BF16 和 FP8 检查点；Hugging Face 标注的大小分别约为 360GB 和 186GB，而 vLLM recipe 实测为 335.28GiB 和 172.78GiB。vLLM 验证 2x GB300 为官方 FP8 的最低部署拓扑，并报告在 4x H100 上将 N-gram 表卸载到主机内存、以 64 并发运行随机 1,024 输入/256 输出负载时，输出速度约为 1,430 tokens/s。另有第三方 NVFP4 recipe 报告了在单台 128GB DGX Spark 上的运行结果，但它使用的是非 Qwen 官方的四位量化检查点，并做了定制的服务化改造，因此不能算作官方最低配置。根据 Qwen Community License 1.0，将模型商用于 MaaS 或许可证所定义的 AI Work Assistant 业务前，须另行取得许可。ChinaAPI 已将 qwen3.8-flash（基于 Flash-Next 的托管生产模型）上架为可供客户调用的路由；不应将其视为与可下载的预览版权重逐字节一致。 2026-08-26 ✓ On ChinaAPI confirmed **DeepSeek DeepSeek-V4-Flash-Vision-Exp** LLM DeepSeek V4 Flash Vision [来源 · api-docs.deepseek.com](https://api-docs.deepseek.com/zh-cn/news/news260821)

DeepSeek 于 2026-08-21 在其 API 平台上线了 DeepSeek-V4-Flash-Vision-Exp，这是一款独立的实验性视觉理解模型，调用时使用 model='deepseek-v4-flash-vision-exp'。它通过 OpenAI-compatible 的 Chat Completions 和 Responses APIs 以及 Anthropic-compatible 的 Messages API 接受图文混合输入。图像可以 base64 数据、公开 URL 或 Files API 引用的形式提供，格式为 JPEG、PNG、GIF 或 WebP。该模型上下文窗口为 1M，最高输出 384K，支持思考与非思考模式、JSON Output 和 Tool Calls，但不支持 FIM。DeepSeek 称其纯文本的 Agent、推理和世界知识能力与生产版 DeepSeek-V4-Flash 模型持平，视觉 Agent 结果则大幅提升；这些基准测试对比均为厂商说法，并非 ChinaAPI 实测。每张图像最多折算为 384 tokens，并按官方 V4-Flash 的 token 价格计费。deepseek-v4-flash-vision-exp 路由在发布时可在 ChinaAPI 上供客户调用；此后已从实时模型目录下线，由 deepseek-flash 取代，其旧营销页 URL 会重定向到规范页面。 2026-08-21 Not on ChinaAPI confirmed **Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B** LLM Qwen3.8 [来源 · huggingface.co](https://huggingface.co/Qwen/Qwen3.8-27B)

Qwen 发布了两个可部署的 Qwen3.8 模型规格和四个官方权重仓库：Qwen3.8-27B 与 Qwen3.8-27B-FP8 是同一个稠密原生视觉语言模型的不同精度版本，而 Qwen3.8-2.4T-A95B 及其 FP8 仓库是同一个纯文本混合专家模型的不同版本，激活参数为 95B。两个规格均支持 262K 原生上下文，并提供有文档说明的自托管部署路径。27B 版本采用 Apache-2.0；2.4T 版本采用自定义的 Qwen3.8-Max License，附带署名要求，以及针对高营收 MaaS 或 AI Work Assistant 业务的条件。ChinaAPI 实时模型目录已上架可供客户调用的 qwen3.8-27b 和 qwen3.8-2.4t-a95b 路由；这并不表示它们与可下载的权重逐字节一致。当前价格请查看实时价格页。 2026-08-14 ✓ On ChinaAPI confirmed [Zhipu / Z.ai GLM-5.3](https://chinaapi.ai/zh-cn/models/glm-5.3/)

LLM GLM [来源 · docs.bigmodel.cn](https://docs.bigmodel.cn/cn/guide/models/text/glm-5.3)

Z.ai 于 2026-08-14 发布 GLM-5.3，并向所有 GLM Coding Plan 用户开放。它与 GLM-5.2 使用相同的基座模型，所有提升均来自后训练。这款纯文本模型支持 1M 上下文窗口和最高 128K 输出；思考模式始终开启，推理强度可选 low、high 和 max。Z.ai 公布其在内部 Z.ai Code Bench 上比 GLM-5.2 提升 50%，公开的编码和网络安全基准测试结果也更强；以上均为厂商说法，并非 ChinaAPI 实测。官方 Model API 现已上线，glm-5.3 路由已在 ChinaAPI 上可用，支持 OpenAI-compatible 接入。如果从关闭了思考模式的配置迁移过来，请先开启思考模式并将 reasoning_effort 设为 low，再切换 model ID；官方指南提醒，否则请求会失败。 2026-08-14 ✓ On ChinaAPI confirmed [DeepSeek DeepSeek-V4-Pro-0813](https://chinaapi.ai/zh-cn/models/deepseek-v4-pro/)

LLM DeepSeek V4 Pro [来源 · api-docs.deepseek.com](https://api-docs.deepseek.com/zh-cn/)

DeepSeek 更新了现有的 deepseek-v4-pro API 别名，改由 DeepSeek-V4-Pro-0813 提供服务。调用方式和 model ID 均不变：使用 deepseek-v4-pro 的请求会获得最新版本。官方快速开始页面也确认，deepseek-v4-flash 仍映射到 DeepSeek-V4-Flash-0731。这是一次服务版本的切换，而非新的 API 路由。DeepSeek 后来撤回了将 deepseek-v4-pro 切换到 V4.1 Flash 的计划；V4 Pro 在 2026-09-14 之后仍然可用，计费不变，因此现有的 ChinaAPI 集成可以继续使用同一个 model ID。 2026-08-13 ✓ On ChinaAPI confirmed [Alibaba Cloud Qwen3.8-Max](https://chinaapi.ai/zh-cn/models/qwen3.8-max/)

LLM Qwen3.8 [来源 · help.aliyun.com](https://help.aliyun.com/en/model-studio/newly-released-models)

Alibaba Cloud 于 2026-08-03 发布 qwen3.8-max，这是 Qwen 迄今能力最强的旗舰模型。这款原生视觉语言模型采用 2.4T 参数的混合专家架构，支持推理、文本生成和视觉理解，相比 Qwen3.7 系列有显著提升。官方 Model Studio 文档列出了北京及多个全球地域的 OpenAI-compatible、Anthropic-compatible 和 DashScope 接入方式。该路由现已可通过 ChinaAPI 使用。 2026-08-03 ✓ On ChinaAPI confirmed

### 2026.07

[MiniMax MiniMax-H3](https://chinaapi.ai/zh-cn/models/minimax-h3/)

Video MiniMax H3 [来源 · platform.minimax.io](https://platform.minimax.io/docs/release-notes/models)

MiniMax 发布了 H3（Hailuo 3.0）。官方发布说明称其为新一代开放式通用多模态视频模型，能够理解文本、图像、视频和音频上下文中的创作意图，生成效果更自然、更连贯。ChinaAPI 提供该路由，可在一次生成中输出 4-15 秒、768P 和 2K 分辨率并带原生立体声音频的视频片段，按输出时长每秒计费，并可通过 OpenAI-compatible 视频端点调用。 2026-07-31 ✓ On ChinaAPI confirmed **ByteDance Doubao-Seedance-2.5** Video Seedance 2.5 [来源 · console.volcengine.com](https://console.volcengine.com/ark/region:cn-beijing/model/detail?name=doubao-seedance-2-5)

Volcano Engine 的 Ark 模型目录以 model ID doubao-seedance-2-5-260628 收录了 Doubao-Seedance-2.5。该视频模型于 2026-07-31 发布，最长可生成 30 秒视频，最多接受 50 个参考素材（30 张图像、10 段视频和 10 段音频），并支持多模态参考、视频编辑、视频延长，以及超过 10 种语言的生成。260628 后缀仍为模型版本标签。ChinaAPI 现已上架该路由供客户调用；当前价格请查看实时模型目录。 2026-07-31 ✓ On ChinaAPI confirmed **DeepSeek DeepSeek-V4-Flash-0731** LLM DeepSeek V4 Flash [来源 · api-docs.deepseek.com](https://api-docs.deepseek.com/updates/)

DeepSeek 升级了现有的 deepseek-v4-flash API 路由，换用重新后训练的检查点，保留预览版的架构和模型规模，同时增强了编码和 Agent 能力。DeepSeek 公布，在 max 推理强度和一个未公开的精简测试框架（harness）下，其 Terminal Bench 2.1 得分 82.7、DeepSWE 得分 54.4、Toolathlon Verified 得分 70.3；以上均为厂商公布的结果，并非 ChinaAPI 实测。官方路由现已原生支持 Responses API 和 Codex 集成，而 DeepSeek 的网页版、移动 App 和 V4-Pro API 不在此次更新范围内。 2026-07-31 Not on ChinaAPI confirmed [Moonshot Kimi K3 开放权重](https://chinaapi.ai/zh-cn/models/kimi-k3/)

LLM Kimi [来源 · huggingface.co](https://huggingface.co/moonshotai/Kimi-K3)

Moonshot 按发布时的承诺，于 2026-07-27 以 Kimi K3 License 开放了 Kimi K3 的完整权重。该检查点是总参数 2.8T 的 Mixture-of-Experts 模型，每个 token 激活 104B 参数（896 个路由专家中选 16 个，另有 2 个共享专家），上下文窗口 1M tokens，原生支持图像与视频理解；路由专家以 MXFP4 格式发布。Moonshot 提供了基于 vLLM、SGLang 和 TokenSpeed 的自托管部署文档。许可证对超大规模商业部署附加了条件，自托管前请先阅读。ChinaAPI 已将 kimi-k3 上架为可供客户调用的路由；当前价格以实时模型目录为准。 2026-07-27 ✓ On ChinaAPI confirmed **Alibaba Cloud Qwen3.7-Flash** LLM Qwen3.7 [来源 · cn.aliyun.com](https://cn.aliyun.com/product/news?category=224&from_alibabacloud=&product=294)

Alibaba Cloud 发布了原生视觉语言 Flash 模型，支持 1M 上下文和最高 131K 输出；相比 Qwen3.6-Flash，在多模态理解、真实世界与空间感知、Search Agent 和 CI Agent 执行以及多模态编码方面均有升级。官方模型接受文本、图像和视频输入，并通过 Responses API 提供内置工具。ChinaAPI 现已将 qwen3.7-flash 上架为可供客户调用的路由；当前价格请查看实时模型目录。 2026-07-25 ✓ On ChinaAPI confirmed [Moonshot Kimi K3](https://chinaapi.ai/zh-cn/models/kimi-k3/)

LLM Kimi [来源 · kimi.com](https://www.kimi.com/code/docs/en/kimi-code/whats-new.html)

Moonshot 发布了 2.8T 参数的旗舰模型，支持 1M 上下文、始终开启的推理，以及原生图像和视频理解。已宣布的开源权重预计在 July 27, 2026 之前发布。 2026-07-16 ✓ On ChinaAPI confirmed [Tencent Hy3](https://chinaapi.ai/zh-cn/models/hunyuan-hy3/)

LLM Hunyuan [来源 · tencent.com](https://www.tencent.com/tencent-hunyuan-officially-releases-hy3-advancing-agent-capabilities-and-deeper-product-integration/)

Tencent 正式发布 Hy3，这是一款 256K 上下文的快慢思考融合模型，稳定性和成本效率均有提升。 2026-07-06 ✓ On ChinaAPI confirmed

### 2026.06

[Meituan LongCat-2.0](https://chinaapi.ai/zh-cn/models/longcat-2.0/)

LLM LongCat [来源 · meituan.com](https://www.meituan.com/news/NN260630164005904)

Meituan 发布了开放权重的 MoE 推理模型，支持 1M 上下文，面向编码 Agent 和长程工具调用。 2026-06-30 ✓ On ChinaAPI confirmed [ByteDance Doubao Seed 2.1 Turbo](https://chinaapi.ai/zh-cn/models/doubao-seed-2-1-turbo-260628/)

LLM Doubao Seed [来源 · volcengine.com](https://www.volcengine.com/product/yunque)

延迟更低的 Doubao Seed 2.1 模型，适用于多模态推理、编码和生产级 Agent 工作流。 2026-06-28 ✓ On ChinaAPI confirmed [ByteDance Doubao Seed 2.1 Pro](https://chinaapi.ai/zh-cn/models/doubao-seed-2-1-pro-260628/)

LLM Doubao Seed [来源 · volcengine.com](https://www.volcengine.com/product/yunque)

旗舰级 Doubao Seed 2.1 模型，适用于多模态推理、编码、工具调用和长程 Agent 任务。 2026-06-28 ✓ On ChinaAPI confirmed [Alibaba happyhorse-1.1-t2v](https://chinaapi.ai/zh-cn/models/happyhorse-1.1-t2v/)

Video HappyHorse HappyHorse 1.1 文生视频网关模型，语义理解和运镜控制能力均有提升。 2026-06-22 ✓ On ChinaAPI confirmed [Alibaba happyhorse-1.1-r2v](https://chinaapi.ai/zh-cn/models/happyhorse-1.1-r2v/)

Video HappyHorse HappyHorse 1.1 参考生视频网关模型，可在多参考输入下保持主体、场景和风格一致。 2026-06-22 ✓ On ChinaAPI confirmed [Alibaba happyhorse-1.1-i2v](https://chinaapi.ai/zh-cn/models/happyhorse-1.1-i2v/)

Video HappyHorse HappyHorse 1.1 图生视频网关模型，纹理表现和身份一致性更强。 2026-06-22 ✓ On ChinaAPI confirmed [Zhipu / Z.ai glm-5.2](https://chinaapi.ai/zh-cn/models/glm-5.2/)

LLM GLM [来源 · huggingface.co](https://huggingface.co/zai-org/GLM-5.2)

开放权重旗舰 GLM，支持 1M 上下文，长程编码与 Agent 工作流能力更强。 2026-06-16 ✓ On ChinaAPI confirmed [ByteDance doubao-seedance-2-0-mini-260615](https://chinaapi.ai/zh-cn/models/doubao-seedance-2-0-mini-260615/)

Video Seedance 快速的 Seedance 2.0 mini 视频模型，适合低成本短视频生成。 2026-06-15 ✓ On ChinaAPI confirmed [Moonshot kimi-k2.7-code-highspeed](https://chinaapi.ai/zh-cn/models/kimi-k2.7-code-highspeed/)

LLM Kimi Kimi K2.7 高速网关版本，面向更低延迟的编码和 Agent 任务。 2026-06-12 ✓ On ChinaAPI confirmed [Moonshot kimi-k2.7-code](https://chinaapi.ai/zh-cn/models/kimi-k2.7-code/)

LLM Kimi 专注编码的 Kimi 网关模型，面向长程代码仓库工作，支持视觉理解。 2026-06-12 ✓ On ChinaAPI confirmed [Xiaomi mimo-v2.5-asr](https://chinaapi.ai/zh-cn/models/mimo-v2.5-asr/)

Audio MiMo Audio [来源 · mimo.mi.com](https://mimo.mi.com/docs/en-US/updates/model)

MiMo 语音识别，适用于中英混说、方言（粤语、吴语、闽南语和四川话）、嘈杂与远场录音、多人重叠说话以及歌词。 2026-06-02 ✓ On ChinaAPI confirmed [Alibaba qwen3.7-plus](https://chinaapi.ai/zh-cn/models/qwen3.7-plus/)

LLM Qwen 多模态 Qwen 网关模型，适用于视觉分析、规划、文件处理和工具调用。 2026-06-01 ✓ On ChinaAPI confirmed [MiniMax MiniMax-M3](https://chinaapi.ai/zh-cn/models/minimax-m3/)

LLM MiniMax M [来源 · minimax.io](https://www.minimax.io/blog/minimax-m3)

原生多模态 M 系列模型，具备 1M 上下文和 MSA 注意力，支持编码、Agent 以及图像和视频输入。 2026-06-01 ✓ On ChinaAPI confirmed

### 2026.05

[StepFun step-3.7-flash](https://chinaapi.ai/zh-cn/models/step-3.7-flash/)

LLM Step 快速的 StepFun 网关模型，支持 256K 上下文、视觉输入、推理和工具调用。 2026-05-28 ✓ On ChinaAPI confirmed **Meituan LongCat-Video-Avatar 1.5** Video LongCat Video [来源 · arxiv.org](https://arxiv.org/abs/2605.26486)

音频驱动的数字人视频技术发布，聚焦口型同步、身份一致性和长视频生成。 2026-05-26 Not on ChinaAPI confirmed [Alibaba qwen3.7-max](https://chinaapi.ai/zh-cn/models/qwen3.7-max/)

LLM Qwen 旗舰 Qwen 网关模型，面向高要求的分析、编码和生产级 Agent 工作流。 2026-05-21 ✓ On ChinaAPI confirmed

### 2026.04

[Alibaba qwen3.6-flash](https://chinaapi.ai/zh-cn/models/qwen3.6-flash/)

LLM Qwen [来源 · en.wikipedia.org](https://en.wikipedia.org/wiki/Qwen)

Qwen 3.6 快速视觉语言模型，适用于视觉推理、文件处理和 Agent 工作流。 2026-04-27 ✓ On ChinaAPI confirmed [Xiaomi mimo-v2.5-pro](https://chinaapi.ai/zh-cn/models/mimo-v2.5-pro/)

LLM MiMo [来源 · huggingface.co](https://huggingface.co/XiaomiMiMo/MiMo-V2.5-Pro)

1.02T 参数的 MiMo Agent 模型，支持 1M 上下文，面向高要求的编码和长程任务。 2026-04-27 ✓ On ChinaAPI confirmed [Xiaomi mimo-v2.5](https://chinaapi.ai/zh-cn/models/mimo-v2.5/)

LLM MiMo [来源 · huggingface.co](https://huggingface.co/XiaomiMiMo/MiMo-V2.5)

原生全模态 MiMo 模型，支持 1M 上下文，可理解文本、图像、视频和音频。 2026-04-27 ✓ On ChinaAPI confirmed [Alibaba wan2.7-i2v](https://chinaapi.ai/zh-cn/models/wan2.7-i2v/)

Video Wan [来源 · help.aliyun.com](https://help.aliyun.com/en/model-studio/model-pricing)

Wan 2.7 图生视频，支持首尾帧控制、视频续写、音频驱动，以及 720P/1080P 输出。 2026-04-25 ✓ On ChinaAPI confirmed [DeepSeek deepseek-v4-pro](https://chinaapi.ai/zh-cn/models/deepseek-v4-pro/)

LLM DeepSeek V4 [来源 · tomshardware.com](https://www.tomshardware.com/tech-industry/artificial-intelligence/deepseek-launches-1-6-trillion-parameter-v4-on-huawei-chips-as-us-escalates-ai-theft-accusations)

旗舰级 DeepSeek V4 版本，总参数 1.6T，上下文为 1M tokens。 2026-04-24 ✓ On ChinaAPI confirmed **DeepSeek deepseek-v4-flash** LLM DeepSeek V4 [来源 · api-docs.deepseek.com](https://api-docs.deepseek.com/news/news260424/)

快速的 DeepSeek V4 版本，适用于高效对话、编码辅助和 Agent 循环。 2026-04-24 Not on ChinaAPI confirmed [Xiaomi mimo-v2.5-tts](https://chinaapi.ai/zh-cn/models/mimo-v2.5-tts/)

Audio MiMo Audio [来源 · mimo.mi.com](https://mimo.mi.com/docs/en-US/updates/model)

MiMo 高表现力语音合成，提供优质内置音色，并可用自然语言控制语速、情绪、语气、方言和角色演绎。 2026-04-23 ✓ On ChinaAPI confirmed [Moonshot kimi-k2.6](https://chinaapi.ai/zh-cn/models/kimi-k2.6/)

LLM Kimi [来源 · huggingface.co](https://huggingface.co/moonshotai/Kimi-K2.6)

开放权重的原生多模态 Kimi 模型，适用于长程编码、视觉设计和 Agent 集群工作流。 2026-04-14 ✓ On ChinaAPI confirmed **Zhipu AI GLM-5V-Turbo** LLM GLM [来源 · docs.bigmodel.cn](https://docs.bigmodel.cn/cn/update/new-releases)

200K 上下文的多模态编码基础模型，适用于图像、视频、文件、GUI Agent 和工具驱动的工作流。 2026-04-07 Not on ChinaAPI confirmed [Alibaba wan2.7-videoedit](https://chinaapi.ai/zh-cn/models/wan2.7-videoedit/)

Video Wan Wan 2.7 自然语言视频编辑模型，支持局部/全局编辑和元素替换。 2026-04-03 ✓ On ChinaAPI confirmed [Alibaba wan2.7-t2v](https://chinaapi.ai/zh-cn/models/wan2.7-t2v/)

Video Wan Wan 2.7 文生视频模型，用于提示词驱动的视频生成。 2026-04-03 ✓ On ChinaAPI confirmed [Alibaba wan2.7-r2v](https://chinaapi.ai/zh-cn/models/wan2.7-r2v/)

Video Wan Wan 2.7 参考生视频模型，基于视觉参考进行可控生成。 2026-04-03 ✓ On ChinaAPI confirmed [Zhipu / Z.ai glm-5.1](https://chinaapi.ai/zh-cn/models/glm-5.1/)

LLM GLM [来源 · huggingface.co](https://huggingface.co/zai-org/GLM-5.1)

GLM 更新版本，面向更长程的任务、编码 Agent 和混合推理。 2026-04-03 ✓ On ChinaAPI confirmed [Alibaba wan2.7-image-pro](https://chinaapi.ai/zh-cn/models/wan2.7-image-pro/)

Image Wan [来源 · help.aliyun.com](https://help.aliyun.com/en/model-studio/image-model/)

Wan 2.7 Pro 图像生成与编辑，支持品牌色控制、多参考一致性，最高 4096×4096 输出。 2026-04-01 ✓ On ChinaAPI confirmed [Alibaba wan2.7-image](https://chinaapi.ai/zh-cn/models/wan2.7-image/)

Image Wan Wan 2.7 图像模型，支持文生图、图像编辑、多参考生成，文字渲染能力更强。 2026-04-01 ✓ On ChinaAPI confirmed

### 2026.03

[MiniMax MiniMax-M2.7-highspeed](https://chinaapi.ai/zh-cn/models/minimax-m2.7-highspeed/)

LLM MiniMax M [来源 · minimax.io](https://www.minimax.io/)

MiniMax 高速版本，适用于低延迟编码和 Agent 工作流。 2026-03 ✓ On ChinaAPI estimated [MiniMax MiniMax-M2.7](https://chinaapi.ai/zh-cn/models/minimax-m2.7/)

LLM MiniMax M [来源 · minimax.io](https://www.minimax.io/)

开放权重的 MiniMax 模型，适用于对话、编码、办公和 Agent 任务。 2026-03 ✓ On ChinaAPI estimated

### 2026.02

**Alibaba Qwen3.5** LLM Qwen [来源 · en.wikipedia.org](https://en.wikipedia.org/wiki/Qwen)

原生多模态 Agent 方向的 Qwen 版本，发布时间早于网关现已提供的 Qwen 3.6 和 3.7 模型。 2026-02-16 Not on ChinaAPI confirmed [Zhipu / Z.ai glm-5-turbo](https://chinaapi.ai/zh-cn/models/glm-5-turbo/)

LLM GLM [来源 · huggingface.co](https://huggingface.co/zai-org/GLM-5)

高效的 GLM-5 turbo 版本，适用于更快的推理、编码和 Agent 工作。 2026-02-11 ✓ On ChinaAPI confirmed [Zhipu / Z.ai glm-5](https://chinaapi.ai/zh-cn/models/glm-5/)

LLM GLM [来源 · huggingface.co](https://huggingface.co/zai-org/GLM-5)

GLM-5 发布版，面向编码、推理和 Agent 工作流。 2026-02-11 ✓ On ChinaAPI confirmed [Kuaishou kling-v3-omni](https://chinaapi.ai/zh-cn/models/kling-v3-omni/)

Video Kling [来源 · en.wikipedia.org](https://en.wikipedia.org/wiki/Kling_AI)

Kling 3.0 Omni 版本，适用于参考生视频和编辑工作流。 2026-02-05 ✓ On ChinaAPI confirmed [Kuaishou kling-v3](https://chinaapi.ai/zh-cn/models/kling-v3/)

Video Kling [来源 · en.wikipedia.org](https://en.wikipedia.org/wiki/Kling_AI)

Kling 3.0 视频生成，支持文生视频、图生视频、音频，以及 720p 至 4K 的输出档位。 2026-02-05 ✓ On ChinaAPI confirmed [Kuaishou kling-3.0-turbo](https://chinaapi.ai/zh-cn/models/kling-3.0-turbo/)

Video Kling [来源 · en.wikipedia.org](https://en.wikipedia.org/wiki/Kling_AI)

快速的 Kling 3.0 Turbo 通道，用于更低延迟的带音频视频生成。 2026-02-05 ✓ On ChinaAPI confirmed **StepFun Step-3.5-Flash** LLM Step [来源 · huggingface.co](https://huggingface.co/stepfun-ai/Step-3.5-Flash)

开放权重的 StepFun flash 模型，支持 256K 上下文和工具调用。ChinaAPI 已上架 step-3.5-flash 供客户调用；当前价格请查看实时模型目录。 2026-02-01 ✓ On ChinaAPI confirmed

### 2026.01

[ByteDance doubao-seedream-5-0-260128](https://chinaapi.ai/zh-cn/models/doubao-seedream-5-0-260128/)

Image Seedream Seedream 5.0-lite 图像模型，支持可控创作和检索，主体一致性更强。 2026-01-28 ✓ On ChinaAPI confirmed [ByteDance doubao-seedance-2-0-fast-260128](https://chinaapi.ai/zh-cn/models/doubao-seedance-2-0-fast-260128/)

Video Seedance 快速的 Seedance 2.0 视频生成选项，适合高性价比地生成视频片段。 2026-01-28 ✓ On ChinaAPI confirmed [ByteDance doubao-seedance-2-0-260128](https://chinaapi.ai/zh-cn/models/doubao-seedance-2-0-260128/)

Video Seedance Seedance 2.0 旗舰视频生成模型，按输出分辨率计费。 2026-01-28 ✓ On ChinaAPI confirmed [MiniMax Speech 2.8 Turbo](https://chinaapi.ai/zh-cn/models/speech-2.8-turbo/)

Audio Speech 2.8 [来源 · minimax.io](https://www.minimax.io/news/minimax-speech-28)

MiniMax 发布了 Speech 2.8，支持原生声音标签、改进的声音克隆、录音棚级音质和跨语种语音；Turbo 是其侧重速度的版本。 2026-01-23 ✓ On ChinaAPI confirmed [MiniMax Speech 2.8 HD](https://chinaapi.ai/zh-cn/models/speech-2.8-hd/)

Audio Speech 2.8 [来源 · minimax.io](https://www.minimax.io/news/minimax-speech-28)

MiniMax 发布了 Speech 2.8，支持原生声音标签、改进的声音克隆、录音棚级音质和跨语种语音；HD 是其高保真版本。 2026-01-23 ✓ On ChinaAPI confirmed [Alibaba Qwen3-ASR-Flash 新增 OpenAI-compatible 模式](https://chinaapi.ai/zh-cn/models/qwen3-asr-flash/)

Audio Qwen Audio [来源 · help.aliyun.com](https://help.aliyun.com/en/model-studio/newly-released-models)

Alibaba 为 Qwen3-ASR-Flash 新增了 OpenAI-compatible 模式，同时保留多语种转写、ITN 和流式输出支持。 2026-01-06 ✓ On ChinaAPI confirmed **Moonshot kimi-k2.5** LLM Kimi [来源 · huggingface.co](https://huggingface.co/moonshotai/Kimi-K2.5)

开放权重的原生多模态 Kimi Agent 模型，支持 256K 上下文，采用视觉语言联合训练。 2026-01-01 Not on ChinaAPI confirmed

### 2025.12

**Zhipu AI GLM-ASR-2512** Audio GLM Audio [来源 · docs.z.ai](https://docs.z.ai/release-notes/new-released)

Z.AI 发布了多语种 ASR 模型，改进了自定义词典支持和专业术语识别。 2025-12-10 Not on ChinaAPI confirmed **Meituan LongCat-Image** Image LongCat [来源 · en.wikipedia.org](https://en.wikipedia.org/wiki/Meituan)

小型图像生成模型，更看重数据质量而非模型规模。 2025-12 Not on ChinaAPI confirmed

### 2025.10

[MiniMax MiniMax-Hailuo-2.3-Fast](https://chinaapi.ai/zh-cn/models/minimax-hailuo-2.3-fast/)

Video Hailuo [来源 · minimax.io](https://www.minimax.io/news/minimax-hailuo-23)

快速的 Hailuo 2.3 通道，用于低成本图生视频。 2025-10-28 ✓ On ChinaAPI confirmed [MiniMax MiniMax-Hailuo-2.3](https://chinaapi.ai/zh-cn/models/minimax-hailuo-2.3/)

Video Hailuo [来源 · minimax.io](https://www.minimax.io/news/minimax-hailuo-23)

Hailuo 2.3 提升了复杂运动、物理动作、风格化和微表情表现。 2025-10-28 ✓ On ChinaAPI confirmed

### 2025.09

[Alibaba Qwen3-TTS-Flash](https://chinaapi.ai/zh-cn/models/qwen3-tts-flash/)

Audio Qwen Audio [来源 · help.aliyun.com](https://help.aliyun.com/en/model-studio/newly-released-models)

Alibaba 发布了 Qwen3-TTS-Flash，用于离线语音合成，提供富有表现力的音色、多语种与方言输出，以及低延迟的 API 接入。 2025-09-22 ✓ On ChinaAPI confirmed

### 2025.06

[MiniMax MiniMax-Hailuo-02](https://chinaapi.ai/zh-cn/models/minimax-hailuo-02/)

Video Hailuo [来源 · minimax.io](https://www.minimax.io/news/minimax-hailuo-23)

经济型 Hailuo 02 视频模型，支持从 512p 起的文生视频和图生视频。 2025-06 ✓ On ChinaAPI estimated

### 发布日期尚未公开确认

[StepFun StepAudio 2.5 TTS](https://chinaapi.ai/zh-cn/models/stepaudio-2.5-tts/)

Audio StepAudio [来源 · platform.stepfun.com](https://platform.stepfun.com/docs/zh/guides/models/stepaudio-2.5-tts)

上下文感知的语音合成，支持全局和行内的自然语言指令、富有表现力的演绎，并可通过 OpenAI-compatible 的 /v1/audio/speech 直接输出。 Release date not publicly confirmed ✓ On ChinaAPI unknown [StepFun StepAudio 2.5 ASR](https://chinaapi.ai/zh-cn/models/stepaudio-2.5-asr/)

Audio StepAudio [来源 · platform.stepfun.com](https://platform.stepfun.com/docs/zh/guides/models/audio)

快速的 4B MTP 流式转写，面向中英文音频，支持 ITN 规范化，并提供 OpenAI-compatible 转写路由。 Release date not publicly confirmed ✓ On ChinaAPI unknown **StepFun Step TTS Mini** Audio Step TTS [来源 · platform.stepfun.com](https://platform.stepfun.com/docs/zh/guides/models/overview)

高性价比的多语种语音合成，支持官方音色和克隆音色、发音映射以及风格控制。 Release date not publicly confirmed Not on ChinaAPI unknown [StepFun Step TTS 2](https://chinaapi.ai/zh-cn/models/step-tts-2/)

Audio Step TTS [来源 · platform.stepfun.com](https://platform.stepfun.com/docs/zh/api-reference/audio/create-audio)

富有表现力的语音合成，支持官方音色和克隆音色、发音映射、风格控制以及 OpenAI-compatible 输出。 Release date not publicly confirmed ✓ On ChinaAPI unknown [Zhipu AI GLM-TTS](https://chinaapi.ai/zh-cn/models/glm-tts/)

Audio GLM Audio [来源 · docs.bigmodel.cn](https://docs.bigmodel.cn/cn/guide/models/sound-and-video/glm-tts)

上下文感知、富有表现力的语音合成，支持流式输出以及音色、语速和音量控制。 Release date not publicly confirmed ✓ On ChinaAPI unknown

---

Markdown twin of https://chinaapi.ai/zh-cn/model-updates/ — generated from its canonical HTML by scripts/gen_localization_release.py. Full site reference: https://chinaapi.ai/llms-full.txt
