Mô hình cập nhật tường

Lịch trình ra mắt mô hình AI của Trung Quốc.

Một bảng tổng hợp dữ liệu về các bản phát hành mô hình AI của Trung Quốc. Ngày tháng được lấy từ các nguồn nhà cung cấp liên kết; trạng thái khả dụng của ChinaAPI được hiển thị trên mỗi mục như một trạng thái phụ. 3 ngày dự kiến và 5 ngày không xác định được đánh dấu trong dữ liệu nguồn.

Mới nhất trước

Giải phóng bức tường.

2026-08-03

Alibaba Cloud phát hành qwen3.8-max vào 2026-08-03, giới thiệu đây là mô hình chủ lực Qwen mạnh nhất từ trước đến nay. Mô hình thị giác-ngôn ngữ gốc dùng kiến trúc Mixture-of-Experts với 2.4T tham số, hỗ trợ suy luận, tạo văn bản và hiểu hình ảnh, đồng thời cải thiện đáng kể so với dòng Qwen3.7. Tài liệu Model Studio chính thức liệt kê quyền truy cập OpenAI-compatible, Anthropic-compatible và DashScope tại Bắc Kinh cùng nhiều khu vực toàn cầu. Tuyến này hiện đã có trên ChinaAPI.

LLM ✓ On ChinaAPI confirmed Nguồn · help.aliyun.com
2026-07-31

MiniMax đã phát hành H3 (Hailuo 3.0). Ghi chú phát hành chính thức mô tả đây là mô hình video đa phương thức mở đa dụng đời mới, hiểu ý đồ sáng tạo từ ngữ cảnh văn bản, hình ảnh, video và âm thanh, cho kết quả tạo sinh tự nhiên và mạch lạc hơn. ChinaAPI phục vụ tuyến tạo clip 4–15 giây ở 768P và 2K với âm thanh stereo gốc trong một lần chạy, tính phí theo từng giây đầu ra và có thể gọi qua endpoint video OpenAI-compatible.

Video ✓ On ChinaAPI confirmed Nguồn · platform.minimax.io
2026-07-31
ByteDance Doubao-Seedance-2.5 Seedance 2.5

Danh mục mô hình Ark của Volcano Engine liệt kê Doubao-Seedance-2.5 với model ID doubao-seedance-2-5-260628. Ra mắt ngày 2026-07-31, mô hình video này có thể tạo tối đa 30 giây, nhận tối đa 50 tài liệu tham chiếu (30 ảnh, 10 video và 10 đoạn âm thanh), đồng thời hỗ trợ tham chiếu đa phương thức, chỉnh sửa, kéo dài video và tạo nội dung bằng hơn 10 ngôn ngữ. 260628 vẫn là nhãn phiên bản mô hình. ChinaAPI chưa xác minh tuyến này cho các lệnh gọi của khách hàng, vì vậy chưa công bố trang mô hình hoặc giá.

Video Not yet confirmed Nguồn · console.volcengine.com
2026-07-31

DeepSeek nâng cấp tuyến API deepseek-v4-flash hiện có bằng checkpoint được hậu huấn luyện lại, giữ nguyên kiến trúc và quy mô của bản Preview nhưng tăng cường năng lực lập trình và Agent. Với mức suy luận tối đa và minimal harness chưa được công bố, DeepSeek báo cáo 82.7 trên Terminal Bench 2.1, 54.4 trên DeepSWE và 70.3 trên Toolathlon Verified; đây là kết quả do nhà cung cấp công bố, không phải thử nghiệm của ChinaAPI. Tuyến chính thức hiện hỗ trợ gốc Responses API và tích hợp Codex; ứng dụng web DeepSeek, ứng dụng di động và V4-Pro API không nằm trong đợt cập nhật này.

LLM ✓ On ChinaAPI confirmed Nguồn · api-docs.deepseek.com
2026-07-25
Alibaba Cloud Qwen3.7-Flash Qwen3.7

Alibaba Cloud phát hành mô hình Flash thị giác-ngôn ngữ gốc với ngữ cảnh 1M và đầu ra tối đa 131K. So với Qwen3.6-Flash, mô hình nâng cấp khả năng hiểu đa phương thức, nhận thức thế giới thực và không gian, thực thi Search Agent và CI Agent, cùng lập trình đa phương thức. Mô hình chính thức nhận văn bản, hình ảnh và video, đồng thời cung cấp công cụ tích hợp qua Responses API. Hiện tuyến này chưa có trong gateway ChinaAPI.

LLM Not yet confirmed Source · cn.aliyun.com
2026-07-16

Moonshot đã phát hành sản phẩm chủ lực của 2.8T-parameter với 1M ngữ cảnh, khả năng suy luận liên tục và hiểu biết hình ảnh và video gốc. Các trọng số mã nguồn mở được công bố dự kiến sẽ ra mắt vào ngày July 27, 2026 .

LLM ✓ On ChinaAPI confirmed Nguồn: kimi.com
2026-07-06
Tencent Hy3 Hunyuan

Tencent chính thức ra mắt Hy3 , một mô hình tư duy lai nhanh-chậm với 256K-context , được cải thiện về độ ổn định và hiệu quả chi phí.

LLM ✓ On ChinaAPI confirmed Nguồn: tencent.com
2026-06-30

Meituan đã phát hành mô hình suy luận MoE mở với 1M ngữ cảnh dành cho việc lập trình tác nhân và sử dụng công cụ tầm xa.

LLM ✓ On ChinaAPI confirmed Nguồn: meituan.com
2026-06-28

Mô hình hàng đầu Doubao Seed 2.1 dành cho suy luận đa phương thức, lập trình, sử dụng công cụ và các nhiệm vụ tác nhân tầm xa.

LLM ✓ On ChinaAPI confirmed Nguồn: volcengine.com
2026-06-22

Mô hình cổng chuyển đổi văn bản thành video HappyHorse 1.1 với khả năng hiểu ngữ nghĩa và điều khiển camera được cải tiến.

Video ✓ On ChinaAPI confirmed
2026-06-22

Mô hình cổng tham chiếu-video HappyHorse 1.1 đảm bảo tính nhất quán về chủ thể, bối cảnh và phong cách khi sử dụng nhiều nguồn tham chiếu khác nhau.

Video ✓ On ChinaAPI confirmed
2026-06-22

Mô hình cổng chuyển đổi hình ảnh sang video HappyHorse 1.1 với kết cấu và tính nhất quán nhận diện mạnh mẽ hơn.

Video ✓ On ChinaAPI confirmed
2026-06-16

Nền tảng mã nguồn mở hàng đầu GLM với 1M ngữ cảnh và khả năng mã hóa dài hạn mạnh mẽ hơn cùng quy trình làm việc của tác nhân.

LLM ✓ On ChinaAPI confirmed Nguồn: huggingface.co
2026-06-12

Biến thể cổng Kimi K2.7 tốc độ cao dành cho các tác vụ mã hóa và xử lý tác nhân có độ trễ thấp hơn.

LLM ✓ On ChinaAPI confirmed
2026-06-12

Mô hình cổng Kimi tập trung vào lập trình dành cho công việc lưu trữ dữ liệu dài hạn với hỗ trợ thị giác máy tính.

LLM ✓ On ChinaAPI confirmed
2026-06-02

Nhận dạng giọng nói MiMo hỗ trợ chuyển đổi mã tiếng Trung-Anh, các phương ngữ Quảng Đông, Ngô, Dân Nam và Tứ Xuyên, các bản ghi âm nhiễu và ở xa, giọng nói chồng chéo và lời bài hát.

Audio ✓ On ChinaAPI confirmed Nguồn: mimo.mi.com
2026-06-01

Mô hình cổng thông tin đa phương thức Qwen dành cho phân tích trực quan, lập kế hoạch, quản lý tệp và sử dụng công cụ.

LLM ✓ On ChinaAPI confirmed
2026-06-01

Mô hình M-series đa phương thức gốc với hỗ trợ 1M ngữ cảnh, cơ chế chú ý MSA, mã hóa, tác nhân, hình ảnh và video.

LLM ✓ On ChinaAPI confirmed Nguồn: minimax.io
2026-05-28

Mô hình cổng StepFun nhanh với 256K ngữ cảnh, đầu vào hình ảnh, suy luận và sử dụng công cụ.

LLM ✓ On ChinaAPI confirmed
2026-05-26
Meituan LongCat-Video-Avatar 1.5 LongCat Video

Phát hành kỹ thuật video avatar dựa trên âm thanh tập trung vào đồng bộ hóa môi, tính nhất quán về nhận diện và tạo video dài.

Video Not yet confirmed Nguồn: arxiv.org
2026-05-21

Mô hình cổng Qwen hàng đầu dành cho các quy trình phân tích, lập trình và sản xuất đòi hỏi cao.

LLM ✓ On ChinaAPI confirmed
2026-04-27

Qwen 3.6 là mô hình ngôn ngữ-hình ảnh nhanh dành cho suy luận trực quan, quản lý tệp và quy trình làm việc của tác nhân.

LLM ✓ On ChinaAPI confirmed Nguồn: en.wikipedia.org
2026-04-27

Mô hình tác nhân MiMo 1.02T-parameter với 1M ngữ cảnh dành cho các tác vụ lập trình đòi hỏi cao và các tác vụ dài hạn.

LLM ✓ On ChinaAPI confirmed Nguồn: huggingface.co
2026-04-27

Mô hình MiMo đa phương thức gốc với 1M ngữ cảnh và khả năng hiểu văn bản, hình ảnh, video và âm thanh.

LLM ✓ On ChinaAPI confirmed Nguồn: huggingface.co
2026-04-25

Wan 2.7 Chuyển đổi hình ảnh thành video với điều khiển khung hình đầu/cuối, tiếp tục, âm thanh điều khiển và đầu ra 720 P/ 1080 P.

Video ✓ On ChinaAPI confirmed Nguồn · help.aliyun.com
2026-04-23

MiMo là ứng dụng chuyển văn bản thành giọng nói biểu cảm với các giọng nói tích hợp chất lượng cao và khả năng điều khiển ngôn ngữ tự nhiên về tốc độ, cảm xúc, giọng điệu, phương ngữ và hiệu suất nhân vật.

Audio ✓ On ChinaAPI confirmed Nguồn: mimo.mi.com
2026-04-14

Mở mô hình Kimi đa phương thức gốc cho lập trình tầm nhìn dài hạn, thiết kế trực quan và quy trình làm việc bầy đàn tác nhân.

LLM ✓ On ChinaAPI confirmed Nguồn: huggingface.co
2026-04-07
Zhipu AI GLM-5V-Turbo GLM

Một mô hình nền tảng mã hóa đa phương 200K-context dành cho quy trình làm việc dựa trên hình ảnh, video, tệp tin, tác nhân giao diện người dùng đồ họa (GUI) và công cụ.

LLM Not yet confirmed Nguồn: docs.bigmodel.cn
2026-04-03

Mô hình chỉnh sửa video ngôn ngữ tự nhiên Wan 2.7 dành cho chỉnh sửa cục bộ/toàn cục và thay thế các thành phần.

Video ✓ On ChinaAPI confirmed
2026-04-03

Mô hình chuyển đổi văn bản thành video Wan 2.7 để tạo video dựa trên lời nhắc.

Video ✓ On ChinaAPI confirmed
2026-04-03

Mô hình tham chiếu video Wan 2.7 để tạo nội dung có kiểm soát từ các tham chiếu hình ảnh.

Video ✓ On ChinaAPI confirmed
2026-04-01

Wan 2.7 Pro hỗ trợ tạo và chỉnh sửa ảnh với khả năng kiểm soát màu sắc thương hiệu, độ nhất quán đa tham chiếu và độ phân giải đầu ra lên đến 4096 × 4096 .

Image ✓ On ChinaAPI confirmed Nguồn · help.aliyun.com
2026-04-01

Mô hình hình ảnh Wan 2.7 dành cho chuyển đổi văn bản thành hình ảnh, chỉnh sửa, tạo đa tham chiếu và hiển thị văn bản mạnh mẽ hơn.

Image ✓ On ChinaAPI confirmed
2026-03

Mô hình MiniMax trọng lượng mở dành cho trò chuyện, lập trình, công việc văn phòng và các tác vụ tự động.

LLM ✓ On ChinaAPI estimated Nguồn: minimax.io
2026-02-16
Alibaba Qwen3.5 Qwen

Phiên bản Qwen tích hợp tác nhân đa phương thức gốc được phát hành trước các mô hình cổng Qwen 3.6 và 3.7 hiện hành.

LLM Not yet confirmed Nguồn: en.wikipedia.org
2026-02-05

Kling thế hệ 3.0 với các tính năng chuyển đổi văn bản thành video, hình ảnh thành video, âm thanh và các cấp độ đầu ra 720p đến 4K .

Video ✓ On ChinaAPI confirmed Nguồn: en.wikipedia.org
2026-02-01
StepFun Step-3.5-Flash Step

Mở mô hình flash StepFun với hỗ trợ ngữ cảnh và công cụ 256K .

LLM Not yet confirmed Nguồn: huggingface.co
2026-01-28

Mô hình hình ảnh Seedream 5.0-lite với khả năng tạo, truy xuất có thể kiểm soát và tính nhất quán chủ thể mạnh mẽ hơn.

Image ✓ On ChinaAPI confirmed
2026-01-28

Seedance 2.0 là dòng sản phẩm chủ lực tạo video, được quảng cáo dựa trên độ phân giải đầu ra.

Video ✓ On ChinaAPI confirmed
2026-01-23

MiniMax đã phát hành Speech 2.8 với các thẻ âm thanh gốc, cải thiện khả năng sao chép giọng nói, âm thanh chất lượng phòng thu và hỗ trợ nhận diện giọng nói đa ngôn ngữ; Turbo là phiên bản tập trung vào tốc độ.

Audio ✓ On ChinaAPI confirmed Nguồn: minimax.io
2026-01-23

MiniMax đã phát hành Speech 2.8 với các thẻ âm thanh gốc, cải thiện khả năng sao chép giọng nói, âm thanh chất lượng phòng thu và hỗ trợ nhận diện giọng nói đa ngôn ngữ; HD là tùy chọn chất lượng cao.

Audio ✓ On ChinaAPI confirmed Nguồn: minimax.io
2026-01-01
Moonshot kimi-k2.5 Kimi

Mở mô hình tác nhân Kimi đa phương thức gốc với 256K ngữ cảnh và huấn luyện ngôn ngữ thị giác.

LLM Not yet confirmed Nguồn: huggingface.co
2025-12-10
Zhipu AI GLM-ASR-2512 GLM Audio

Z.AI đã phát hành mô hình nhận dạng giọng nói tự động đa ngôn ngữ (ASR) với khả năng hỗ trợ từ điển tùy chỉnh được cải tiến và nhận diện thuật ngữ chuyên ngành.

Audio Not yet confirmed Nguồn: docs.z.ai
2025-12
Meituan LongCat-Image LongCat

Mô hình tạo ảnh nhỏ gọn, tập trung vào chất lượng dữ liệu hơn là kích thước mô hình.

Image Not yet confirmed Nguồn: en.wikipedia.org
2025-10-28

Hailuo 2.3 cải thiện khả năng thể hiện chuyển động phức tạp, hành động vật lý, tạo kiểu và biểu cảm vi mô.

Video ✓ On ChinaAPI confirmed Nguồn: minimax.io
2025-09-22

Alibaba đã phát hành Qwen3-TTS-Flash , một phần mềm tổng hợp giọng nói ngoại tuyến với giọng nói biểu cảm, hỗ trợ nhiều ngôn ngữ và phương ngữ, cùng khả năng truy cập API độ trễ thấp.

Audio ✓ On ChinaAPI confirmed Nguồn · help.aliyun.com
2025-06

Mô hình máy dựng video Hailuo 02 giá rẻ dùng để chuyển đổi văn bản thành video và hình ảnh thành video từ độ phân giải 512p .

Video ✓ On ChinaAPI estimated Nguồn: minimax.io
Release date not publicly confirmed

Chuyển văn bản thành giọng nói dựa trên ngữ cảnh với khả năng điều khiển bằng ngôn ngữ tự nhiên toàn cục và nội tuyến, truyền đạt biểu cảm và xuất OpenAI-compatible /v1/audio/speech .

Audio ✓ On ChinaAPI unknown Nguồn: platform.stepfun.com
Release date not publicly confirmed

Chuyển đổi giọng nói thành văn bản nhanh chóng sang tiếng Anh và tiếng Trung 4B MTP với chuẩn hóa ITN và OpenAI-compatible lộ trình phiên âm.

Audio ✓ On ChinaAPI unknown Nguồn: platform.stepfun.com
Release date not publicly confirmed

Giải pháp tổng hợp giọng nói đa ngôn ngữ tiết kiệm chi phí với giọng nói chính thức và giọng nói sao chép, lập bản đồ phát âm và điều khiển kiểu giọng.

Audio ✓ On ChinaAPI unknown Nguồn: platform.stepfun.com
Release date not publicly confirmed

Tổng hợp giọng nói biểu cảm với giọng nói chính thức và giọng nói sao chép, ánh xạ phát âm, điều khiển kiểu dáng và đầu ra OpenAI-compatible .

Audio ✓ On ChinaAPI unknown Nguồn: platform.stepfun.com
Release date not publicly confirmed

Tổng hợp giọng nói biểu cảm nhận ngữ cảnh với đầu ra trực tuyến và các điều khiển cho giọng nói, tốc độ và âm lượng.

Audio ✓ On ChinaAPI unknown Nguồn: docs.bigmodel.cn