模型动态墙

中国 AI 都发布了什么

简明的中国 AI 模型发布动态,每条均附来源链接,ChinaAPI 上的可用情况一目了然。源数据中有 3 个估计日期和 5 个未知日期,均已标注。

最新在前

发布墙

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 来源 · mimo.mi.com
Xiaomi 发布了一个低延迟服务档位,保留 MiMo-V2.6-Pro 的全模态输入、旗舰级推理能力、1M tokens 上下文窗口和 128K 输出上限。Xiaomi 宣称其输出速度最高可达标准 Pro 服务的 20 倍;RPM 和 TPM 以定制服务的形式提供。官方 API model ID 为 mimo-v2.6-pro-ultraspeed。ChinaAPI 已上架该路由供客户调用;当前价格请查看实时模型目录。
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 来源 · mimo.mi.com
Xiaomi 发布了原生全模态旗舰推理模型,面向复杂项目、长程任务、网络安全和科研。MiMo-V2.6-Pro 接受文本、图像、视频和音频输入,输出文本,提供 1M tokens 上下文窗口和最高 128K 输出,并支持深度思考、工具调用、流式输出、联网搜索、结构化输出和上下文缓存。官方 API model ID 为 mimo-v2.6-pro。ChinaAPI 现已提供该路由供客户调用;当前价格请查看实时模型目录。
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 来源 · mimo.mi.com
Xiaomi 发布了原生全模态推理模型,针对高频专业工作和规模化任务调优,成本更低。MiMo-V2.6-Flash 接受文本、图像、视频和音频输入,输出文本,提供 1M tokens 上下文窗口和最高 128K 输出,并支持深度思考、工具调用、流式输出、联网搜索、结构化输出和上下文缓存。官方 API model ID 为 mimo-v2.6-flash。ChinaAPI 现已提供该路由供客户调用;当前价格请查看实时模型目录。
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API 来源 · mimo.mi.com
Xiaomi 为 mimo-v2.6-pro 和 mimo-v2.6-flash 推出了异步 Batch API 推理,价格为其实时 API 价格的 50%。该服务面向评测、标注和批量生成等非实时任务,接受 JSONL 请求,支持 OpenAI Chat Completions、OpenAI Responses 和 Anthropic Messages 请求格式,但不支持流式输出。ChinaAPI 提供的是这两个模型的实时路由,并不意味着支持 Xiaomi 独立的 Batch API。
2026-09-22
Not on ChinaAPI confirmed
StepFun 于 2026-09-20 发布 Step 5 Preview,作为其面向软件工程、长程 Agent 任务、专业知识工作和金融领域的旗舰模型。这款稀疏混合专家模型总参数 600B,每个 token 激活 27B,上下文窗口为 1M tokens。官方 API model ID 为 step-5-preview;它接受文本、图像和视频输入,输出文本,最多支持 64K 输出 tokens。该 API 还支持流式输出、工具调用、JSON Mode 和 JSON Schema、low/medium/high 推理强度以及提示词缓存。StepFun 公布其 Artificial Analysis Intelligence Index 得分为 44,并给出了一系列编码、Agent、金融和多模态基准测试结果;以上均为厂商自报结果,并非 ChinaAPI 实测。StepFun 表示将于 2026-10-15 发布开放权重。ChinaAPI 实时模型目录现已将 step-5-preview 上架为可供客户调用的路由,按厂商刊例价计费:输入 $1.00/M tokens、输出 $2.70/M tokens、提示词缓存读取 $0.05/M tokens;以实时网关为准。
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image 来源 · github.com
Qwen 于 2026-09-20 发布了 Qwen-Image-2.1 权重。其 7B 参数的视觉生成组件统一了文生图与图像编辑,支持原生 RGBA 透明通道、最多 10 张参考图像、局部编辑和 2K 输出。以上能力均由 Qwen 自行公布,并非 ChinaAPI 实测。权重采用 Qwen Research License,在未另行取得商业许可的情况下,仅允许非商业性的研究与评估。Alibaba Model Studio 尚未公布 Qwen-Image-2.1 的 API model ID 或价格,ChinaAPI 不提供该路由,也未发布相应的 ChinaAPI 模型页面或价格。
2026-09-20
Not on ChinaAPI confirmed
DeepSeek 于 2026-09-10 发布并开源了 DeepSeek-V4.1-Flash。这款原生图文模型采用 552B 参数的混合专家因果编码器-解码器(Causal Encoder-Decoder)架构,输入预填充阶段激活 8B 参数,输出解码阶段激活 16B 参数,上下文窗口为 1M,最高输出 384K。DeepSeek 称其公布的基准测试结果超过 V4 Pro,且新的 KV Cache 设计所需的 HBM 仅为上一代 V4 Flash 的四分之一,SSD 存储仅为其八分之一;以上均为厂商说法,并非 ChinaAPI 实测。直连 DeepSeek API 时的 model ID 为 deepseek-flash。DeepSeek 已下线独立的 V4 Flash 和 Vision-Exp 检查点,但暂时将它们的旧 model IDs 映射到 V4.1 Flash。ChinaAPI 实时模型目录现已上架规范的 deepseek-flash ID,取代两个旧的 Flash ID;两个已下线 Flash 模型的营销页 URL 会重定向到该规范模型页面。非高峰时段价格为输入 $0.15/M tokens、输出 $0.60/M tokens、缓存读取 $0.003/M tokens;北京时间工作日高峰时段价格正好是其 2 倍,即输入 $0.30/M tokens、输出 $1.20/M tokens、缓存读取 $0.006/M tokens。以实时网关为准。DeepSeek 此前还宣布,2026-09-14 之后直接调用 deepseek-v4-pro 的请求将路由到 V4.1 Flash,但随后撤回了该计划:V4 Pro 在该日期之后仍然可用,计费不变,deepseek-v4-pro 在 ChinaAPI 上仍是一条独立路由。
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent 于 2026-09-09 开源了 AuK 和 AuK-Flash。AuK 是一个 1.5B 参数的语音生成与编辑基础模型,训练使用了 195 万小时的有效监督数据,涵盖语音生成、内容编辑、增强与分离、副语言编辑和声学编辑。一个共享的自然语言指令接口支持零样本和基于指令的 TTS、语音与歌词编辑、音高/语速/音量调整、情感与音色编辑、去口音、非语言声音编辑、增强以及音源分离。AuK-Flash 是蒸馏得到的四步版本;论文报告,在相同条件下按实际耗时(wall-clock)计算,其速度是 AuK 的 4.5 倍,这是厂商公布的结果,并非 ChinaAPI 实测。两个官方仓库均提供可下载的 MIT 许可证权重,并使用 Qwen2.5-Omni-3B 作为外部编码器。官方代码和 SGLang-Omni 提供了自托管推理的文档,但 ChinaAPI 目前未将 AuK 作为可供客户调用的路由开放,因此没有发布 API 价格或模型页面。
2026-09-09
Not on ChinaAPI confirmed

Tencent 于 2026-08-28 开源了 Hy4 preview,这是一款 770B 参数的混合专家模型,每个 token 激活 49B 主干参数,另有一个原生 10B MTP 层用于投机解码。该文本模型支持 1M 上下文窗口,在两个官方权重仓库中发布:原始检查点和 FP8 精度版本。Tencent 的文档介绍了通过 vLLM 和 SGLang 提供 OpenAI-compatible 服务的方式;官方 SGLang 部署矩阵包括在 8x B200 或 4x B300/GB300 上运行 FP8,以及在 16x H200 上运行 BF16。此次发布采用 Apache-2.0 许可证,定位于长程软件工程、办公分析、游戏开发和科学研究;已公布的评测结果来自厂商,并非 ChinaAPI 实测。ChinaAPI 已将 hy4-preview 上架为可供客户调用的路由,并提供专门的模型页面和部署成本分析;当前价格以实时模型目录为准。
2026-08-28
✓ On ChinaAPI confirmed
Z.ai 于 2026-08-27 发布并开源了 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型。它接受文本、图像、视频和文件输入,上下文窗口为 1M,最高输出 128K。官方 Chat Completion API 始终开启思考模式,并支持函数调用、上下文缓存和结构化输出。其低成本架构将稀疏注意力和线性注意力与流形约束超连接(Manifold-Constrained Hyper-Connections)相结合;Z.ai 称该模型在 30T 多模态 tokens 上完成预训练,与 GLM-5.3 相比,注意力计算量降低 3.01 倍,平均每层 KV cache 降低 4.44 倍。Z.ai 还公布其 Artificial Analysis Intelligence Index 得分为 57,编码性能与 Claude Opus 4.8 相当;以上均为厂商说法,并非 ChinaAPI 实测。glm-5.3-flash 路由现已可在 ChinaAPI 上供客户调用,可通过 OpenAI-compatible 和 Anthropic-compatible 端点接入,支持文本、图像和视频输入。
2026-08-27
✓ On ChinaAPI confirmed
Qwen 于 2026-08-26 发布了 Qwen3.8-Flash-Next,作为 Qwen4 架构的多模态混合专家预览版。其语言模型包含 125B 参数的主模型、额外 51B 的 N-gram 嵌入和 4B 的 MTP 模块,每个 token 激活 6B 参数;原生上下文为 262K,可通过 YaRN 扩展到 1M。Qwen 发布了官方 BF16 和 FP8 检查点;Hugging Face 标注的大小分别约为 360GB 和 186GB,而 vLLM recipe 实测为 335.28GiB 和 172.78GiB。vLLM 验证 2x GB300 为官方 FP8 的最低部署拓扑,并报告在 4x H100 上将 N-gram 表卸载到主机内存、以 64 并发运行随机 1,024 输入/256 输出负载时,输出速度约为 1,430 tokens/s。另有第三方 NVFP4 recipe 报告了在单台 128GB DGX Spark 上的运行结果,但它使用的是非 Qwen 官方的四位量化检查点,并做了定制的服务化改造,因此不能算作官方最低配置。根据 Qwen Community License 1.0,将模型商用于 MaaS 或许可证所定义的 AI Work Assistant 业务前,须另行取得许可。ChinaAPI 已将 qwen3.8-flash(基于 Flash-Next 的托管生产模型)上架为可供客户调用的路由;不应将其视为与可下载的预览版权重逐字节一致。
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision 来源 · api-docs.deepseek.com
DeepSeek 于 2026-08-21 在其 API 平台上线了 DeepSeek-V4-Flash-Vision-Exp,这是一款独立的实验性视觉理解模型,调用时使用 model='deepseek-v4-flash-vision-exp'。它通过 OpenAI-compatible 的 Chat Completions 和 Responses APIs 以及 Anthropic-compatible 的 Messages API 接受图文混合输入。图像可以 base64 数据、公开 URL 或 Files API 引用的形式提供,格式为 JPEG、PNG、GIF 或 WebP。该模型上下文窗口为 1M,最高输出 384K,支持思考与非思考模式、JSON Output 和 Tool Calls,但不支持 FIM。DeepSeek 称其纯文本的 Agent、推理和世界知识能力与生产版 DeepSeek-V4-Flash 模型持平,视觉 Agent 结果则大幅提升;这些基准测试对比均为厂商说法,并非 ChinaAPI 实测。每张图像最多折算为 384 tokens,并按官方 V4-Flash 的 token 价格计费。deepseek-v4-flash-vision-exp 路由在发布时可在 ChinaAPI 上供客户调用;此后已从实时模型目录下线,由 deepseek-flash 取代,其旧营销页 URL 会重定向到规范页面。
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwen 发布了两个可部署的 Qwen3.8 模型规格和四个官方权重仓库:Qwen3.8-27B 与 Qwen3.8-27B-FP8 是同一个稠密原生视觉语言模型的不同精度版本,而 Qwen3.8-2.4T-A95B 及其 FP8 仓库是同一个纯文本混合专家模型的不同版本,激活参数为 95B。两个规格均支持 262K 原生上下文,并提供有文档说明的自托管部署路径。27B 版本采用 Apache-2.0;2.4T 版本采用自定义的 Qwen3.8-Max License,附带署名要求,以及针对高营收 MaaS 或 AI Work Assistant 业务的条件。ChinaAPI 实时模型目录已上架可供客户调用的 qwen3.8-27b 和 qwen3.8-2.4t-a95b 路由;这并不表示它们与可下载的权重逐字节一致。当前价格请查看实时价格页。
2026-08-14
✓ On ChinaAPI confirmed
Z.ai 于 2026-08-14 发布 GLM-5.3,并向所有 GLM Coding Plan 用户开放。它与 GLM-5.2 使用相同的基座模型,所有提升均来自后训练。这款纯文本模型支持 1M 上下文窗口和最高 128K 输出;思考模式始终开启,推理强度可选 low、high 和 max。Z.ai 公布其在内部 Z.ai Code Bench 上比 GLM-5.2 提升 50%,公开的编码和网络安全基准测试结果也更强;以上均为厂商说法,并非 ChinaAPI 实测。官方 Model API 现已上线,glm-5.3 路由已在 ChinaAPI 上可用,支持 OpenAI-compatible 接入。如果从关闭了思考模式的配置迁移过来,请先开启思考模式并将 reasoning_effort 设为 low,再切换 model ID;官方指南提醒,否则请求会失败。
2026-08-14
✓ On ChinaAPI confirmed
DeepSeek 更新了现有的 deepseek-v4-pro API 别名,改由 DeepSeek-V4-Pro-0813 提供服务。调用方式和 model ID 均不变:使用 deepseek-v4-pro 的请求会获得最新版本。官方快速开始页面也确认,deepseek-v4-flash 仍映射到 DeepSeek-V4-Flash-0731。这是一次服务版本的切换,而非新的 API 路由。DeepSeek 后来撤回了将 deepseek-v4-pro 切换到 V4.1 Flash 的计划;V4 Pro 在 2026-09-14 之后仍然可用,计费不变,因此现有的 ChinaAPI 集成可以继续使用同一个 model ID。
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloud 于 2026-08-03 发布 qwen3.8-max,这是 Qwen 迄今能力最强的旗舰模型。这款原生视觉语言模型采用 2.4T 参数的混合专家架构,支持推理、文本生成和视觉理解,相比 Qwen3.7 系列有显著提升。官方 Model Studio 文档列出了北京及多个全球地域的 OpenAI-compatible、Anthropic-compatible 和 DashScope 接入方式。该路由现已可通过 ChinaAPI 使用。
2026-08-03
✓ On ChinaAPI confirmed

MiniMax 发布了 H3(Hailuo 3.0)。官方发布说明称其为新一代开放式通用多模态视频模型,能够理解文本、图像、视频和音频上下文中的创作意图,生成效果更自然、更连贯。ChinaAPI 提供该路由,可在一次生成中输出 4-15 秒、768P 和 2K 分辨率并带原生立体声音频的视频片段,按输出时长每秒计费,并可通过 OpenAI-compatible 视频端点调用。
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
Volcano Engine 的 Ark 模型目录以 model ID doubao-seedance-2-5-260628 收录了 Doubao-Seedance-2.5。该视频模型于 2026-07-31 发布,最长可生成 30 秒视频,最多接受 50 个参考素材(30 张图像、10 段视频和 10 段音频),并支持多模态参考、视频编辑、视频延长,以及超过 10 种语言的生成。260628 后缀仍为模型版本标签。ChinaAPI 现已上架该路由供客户调用;当前价格请查看实时模型目录。
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash 来源 · api-docs.deepseek.com
DeepSeek 升级了现有的 deepseek-v4-flash API 路由,换用重新后训练的检查点,保留预览版的架构和模型规模,同时增强了编码和 Agent 能力。DeepSeek 公布,在 max 推理强度和一个未公开的精简测试框架(harness)下,其 Terminal Bench 2.1 得分 82.7、DeepSWE 得分 54.4、Toolathlon Verified 得分 70.3;以上均为厂商公布的结果,并非 ChinaAPI 实测。官方路由现已原生支持 Responses API 和 Codex 集成,而 DeepSeek 的网页版、移动 App 和 V4-Pro API 不在此次更新范围内。
2026-07-31
Not on ChinaAPI confirmed
Moonshot 按发布时的承诺,于 2026-07-27 以 Kimi K3 License 开放了 Kimi K3 的完整权重。该检查点是总参数 2.8T 的 Mixture-of-Experts 模型,每个 token 激活 104B 参数(896 个路由专家中选 16 个,另有 2 个共享专家),上下文窗口 1M tokens,原生支持图像与视频理解;路由专家以 MXFP4 格式发布。Moonshot 提供了基于 vLLM、SGLang 和 TokenSpeed 的自托管部署文档。许可证对超大规模商业部署附加了条件,自托管前请先阅读。ChinaAPI 已将 kimi-k3 上架为可供客户调用的路由;当前价格以实时模型目录为准。
2026-07-27
✓ On ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloud 发布了原生视觉语言 Flash 模型,支持 1M 上下文和最高 131K 输出;相比 Qwen3.6-Flash,在多模态理解、真实世界与空间感知、Search Agent 和 CI Agent 执行以及多模态编码方面均有升级。官方模型接受文本、图像和视频输入,并通过 Responses API 提供内置工具。ChinaAPI 现已将 qwen3.7-flash 上架为可供客户调用的路由;当前价格请查看实时模型目录。
2026-07-25
✓ On ChinaAPI confirmed
Moonshot 发布了 2.8T 参数的旗舰模型,支持 1M 上下文、始终开启的推理,以及原生图像和视频理解。已宣布的开源权重预计在 July 27, 2026 之前发布。
2026-07-16
✓ On ChinaAPI confirmed
Tencent 正式发布 Hy3,这是一款 256K 上下文的快慢思考融合模型,稳定性和成本效率均有提升。
2026-07-06
✓ On ChinaAPI confirmed

Meituan 发布了开放权重的 MoE 推理模型,支持 1M 上下文,面向编码 Agent 和长程工具调用。
2026-06-30
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 文生视频网关模型,语义理解和运镜控制能力均有提升。
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 参考生视频网关模型,可在多参考输入下保持主体、场景和风格一致。
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 图生视频网关模型,纹理表现和身份一致性更强。
2026-06-22
✓ On ChinaAPI confirmed
专注编码的 Kimi 网关模型,面向长程代码仓库工作,支持视觉理解。
2026-06-12
✓ On ChinaAPI confirmed
MiMo 语音识别,适用于中英混说、方言(粤语、吴语、闽南语和四川话)、嘈杂与远场录音、多人重叠说话以及歌词。
2026-06-02
✓ On ChinaAPI confirmed
多模态 Qwen 网关模型,适用于视觉分析、规划、文件处理和工具调用。
2026-06-01
✓ On ChinaAPI confirmed
原生多模态 M 系列模型,具备 1M 上下文和 MSA 注意力,支持编码、Agent 以及图像和视频输入。
2026-06-01
✓ On ChinaAPI confirmed

快速的 StepFun 网关模型,支持 256K 上下文、视觉输入、推理和工具调用。
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video 来源 · arxiv.org
音频驱动的数字人视频技术发布,聚焦口型同步、身份一致性和长视频生成。
2026-05-26
Not on ChinaAPI confirmed
旗舰 Qwen 网关模型,面向高要求的分析、编码和生产级 Agent 工作流。
2026-05-21
✓ On ChinaAPI confirmed

DeepSeek deepseek-v4-flash
快速的 DeepSeek V4 版本,适用于高效对话、编码辅助和 Agent 循环。
2026-04-24
Not on ChinaAPI confirmed
MiMo 高表现力语音合成,提供优质内置音色,并可用自然语言控制语速、情绪、语气、方言和角色演绎。
2026-04-23
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
200K 上下文的多模态编码基础模型,适用于图像、视频、文件、GUI Agent 和工具驱动的工作流。
2026-04-07
Not on ChinaAPI confirmed
Wan 2.7 自然语言视频编辑模型,支持局部/全局编辑和元素替换。
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Wan 2.7 文生视频模型,用于提示词驱动的视频生成。
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Wan 2.7 参考生视频模型,基于视觉参考进行可控生成。
2026-04-03
✓ On ChinaAPI confirmed
Wan 2.7 图像模型,支持文生图、图像编辑、多参考生成,文字渲染能力更强。
2026-04-01
✓ On ChinaAPI confirmed

Alibaba Qwen3.5
原生多模态 Agent 方向的 Qwen 版本,发布时间早于网关现已提供的 Qwen 3.6 和 3.7 模型。
2026-02-16
Not on ChinaAPI confirmed
StepFun Step-3.5-Flash
开放权重的 StepFun flash 模型,支持 256K 上下文和工具调用。ChinaAPI 已上架 step-3.5-flash 供客户调用;当前价格请查看实时模型目录。
2026-02-01
✓ On ChinaAPI confirmed

MiniMax 发布了 Speech 2.8,支持原生声音标签、改进的声音克隆、录音棚级音质和跨语种语音;Turbo 是其侧重速度的版本。
2026-01-23
✓ On ChinaAPI confirmed
MiniMax 发布了 Speech 2.8,支持原生声音标签、改进的声音克隆、录音棚级音质和跨语种语音;HD 是其高保真版本。
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
开放权重的原生多模态 Kimi Agent 模型,支持 256K 上下文,采用视觉语言联合训练。
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio 来源 · docs.z.ai
Z.AI 发布了多语种 ASR 模型,改进了自定义词典支持和专业术语识别。
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
小型图像生成模型,更看重数据质量而非模型规模。
2025-12
Not on ChinaAPI confirmed

Alibaba 发布了 Qwen3-TTS-Flash,用于离线语音合成,提供富有表现力的音色、多语种与方言输出,以及低延迟的 API 接入。
2025-09-22
✓ On ChinaAPI confirmed

上下文感知的语音合成,支持全局和行内的自然语言指令、富有表现力的演绎,并可通过 OpenAI-compatible 的 /v1/audio/speech 直接输出。
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
高性价比的多语种语音合成,支持官方音色和克隆音色、发音映射以及风格控制。
Release date not publicly confirmed
Not on ChinaAPI unknown
富有表现力的语音合成,支持官方音色和克隆音色、发音映射、风格控制以及 OpenAI-compatible 输出。
Release date not publicly confirmed
✓ On ChinaAPI unknown
上下文感知、富有表现力的语音合成,支持流式输出以及音色、语速和音量控制。
Release date not publicly confirmed
✓ On ChinaAPI unknown