Mô hình cập nhật tường

Các bản phát hành mới của AI Trung Quốc.

Dòng tin ngắn gọn về các bản phát hành mô hình AI Trung Quốc, kèm liên kết nguồn và tình trạng khả dụng trên ChinaAPI. Dữ liệu nguồn đánh dấu 3 ngày ước tính và 5 ngày chưa xác định.

Mới nhất trước

Giải phóng bức tường.

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 Nguồn: mimo.mi.com
Xiaomi phát hành tầng phục vụ độ trễ thấp, giữ nguyên đầu vào đa phương thức toàn diện, năng lực suy luận chủ lực, ngữ cảnh 1M tokens và giới hạn đầu ra 128K của MiMo-V2.6-Pro. Xiaomi công bố tốc độ đầu ra nhanh hơn tối đa 20 lần so với dịch vụ Pro tiêu chuẩn; giới hạn RPM và TPM được cung cấp theo dịch vụ tùy chỉnh. API model ID chính thức là mimo-v2.6-pro-ultraspeed. ChinaAPI hiện cung cấp tuyến mimo-v2.6-pro-ultraspeed cho khách hàng; xem danh mục trực tiếp để biết giá hiện tại.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 Nguồn: mimo.mi.com
Xiaomi phát hành mô hình suy luận chủ lực đa phương thức toàn diện, hướng tới dự án phức tạp, tác vụ dài hạn, an ninh mạng và nghiên cứu. MiMo-V2.6-Pro nhận văn bản, hình ảnh, video và âm thanh, trả về văn bản, có ngữ cảnh 1M tokens và đầu ra tối đa 128K, đồng thời hỗ trợ deep thinking, tool calling, streaming, web search, structured output và context caching. API model ID chính thức là mimo-v2.6-pro. ChinaAPI hiện cung cấp tuyến này cho khách hàng; hãy xem danh mục trực tiếp để biết giá hiện hành.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 Nguồn: mimo.mi.com
Xiaomi phát hành mô hình suy luận đa phương thức toàn diện, được tối ưu cho công việc chuyên môn gọi thường xuyên và tác vụ quy mô lớn với chi phí thấp hơn. MiMo-V2.6-Flash nhận văn bản, hình ảnh, video và âm thanh, trả về văn bản, có ngữ cảnh 1M tokens và đầu ra tối đa 128K, đồng thời hỗ trợ deep thinking, tool calling, streaming, web search, structured output và context caching. API model ID chính thức là mimo-v2.6-flash. ChinaAPI hiện cung cấp tuyến này cho khách hàng; hãy xem danh mục trực tiếp để biết giá hiện hành.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API Nguồn: mimo.mi.com
Xiaomi ra mắt Batch API bất đồng bộ cho mimo-v2.6-pro và mimo-v2.6-flash với mức giá bằng 50% API thời gian thực. Dịch vụ dành cho các công việc không thời gian thực như đánh giá, gắn nhãn và tạo nội dung hàng loạt, nhận yêu cầu JSONL và hỗ trợ định dạng OpenAI Chat Completions, OpenAI Responses và Anthropic Messages nhưng không streaming. ChinaAPI cung cấp hai tuyến thời gian thực, nhưng điều đó không đồng nghĩa với việc hỗ trợ Batch API riêng của Xiaomi.
2026-09-22
Not on ChinaAPI confirmed
StepFun phát hành Step 5 Preview vào ngày 2026-09-20 dưới dạng mô hình chủ lực cho kỹ nghệ phần mềm, tác vụ Agent dài hạn, công việc tri thức chuyên môn và tài chính. Mô hình sparse Mixture-of-Experts có tổng cộng 600B tham số, kích hoạt 27B tham số cho mỗi token và hỗ trợ ngữ cảnh 1M tokens. API model ID chính thức là step-5-preview; mô hình nhận văn bản, hình ảnh và video, trả về văn bản, với đầu ra tối đa 64K tokens. API còn hỗ trợ streaming, tool calling, JSON Mode, JSON Schema, reasoning effort ở mức low/medium/high và prompt caching. StepFun công bố điểm Artificial Analysis Intelligence Index là 44 cùng các kết quả benchmark về lập trình, Agent, tài chính và multimodal; đây là kết quả do nhà cung cấp công bố, không phải thử nghiệm của ChinaAPI. StepFun dự kiến phát hành open weights vào ngày 2026-10-15. Live catalog của ChinaAPI hiện cung cấp route step-5-preview cho khách hàng với giá niêm yết của nhà cung cấp: $1.00/M input, $2.70/M output và $0.05/M cho prompt cache read; live Gateway là nguồn giá chính thức.
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image Nguồn · github.com
Qwen công bố trọng số Qwen-Image-2.1 vào 2026-09-20. Thành phần tạo ảnh 7B tham số kết hợp tạo ảnh từ văn bản và chỉnh sửa ảnh, hỗ trợ độ trong suốt RGBA gốc, tối đa 10 ảnh tham chiếu, chỉnh sửa cục bộ và đầu ra 2K. Đây là các khả năng do Qwen công bố, chưa phải kết quả kiểm thử của ChinaAPI. Trọng số tuân theo Qwen Research License; nếu không có giấy phép thương mại riêng, chỉ được dùng cho nghiên cứu và đánh giá phi thương mại. Alibaba Model Studio chưa công bố API model ID hoặc giá cho Qwen-Image-2.1, và ChinaAPI chưa cung cấp tuyến này; không có trang mô hình hay giá ChinaAPI.
2026-09-20
Not on ChinaAPI confirmed
DeepSeek phát hành và mở trọng số DeepSeek-V4.1-Flash vào ngày 2026-09-10. Mô hình hình ảnh-văn bản gốc này là Mixture-of-Experts 552B tham số trên kiến trúc Causal Encoder-Decoder mới, kích hoạt 8B tham số khi prefill đầu vào và 16B khi decode đầu ra, hỗ trợ ngữ cảnh 1M và đầu ra tối đa 384K. Theo DeepSeek, kết quả đánh giá của nhà cung cấp vượt V4 Pro, còn KV Cache mới chỉ cần 1/4 HBM và 1/8 dung lượng SSD so với V4 Flash trước đó. Đây là tuyên bố của nhà cung cấp, không phải thử nghiệm ChinaAPI. Model ID khi gọi trực tiếp DeepSeek API là deepseek-flash. Các checkpoint V4 Flash và Vision-Exp độc lập đã ngừng hoạt động, nhưng model IDs cũ tạm thời được ánh xạ sang V4.1 Flash. Live catalog của ChinaAPI hiện công bố ID chính thức deepseek-flash thay cho cả hai ID Flash cũ; hai URL tiếp thị Flash đã ngừng hoạt động sẽ chuyển hướng đến trang mô hình chính thức đó. Giá thấp điểm là $0.15/M đầu vào, $0.60/M đầu ra và $0.003/M cache read; vào giờ cao điểm ngày làm việc theo giờ Bắc Kinh, giá tăng đúng 2 lần lên $0.30/M, $1.20/M và $0.006/M. Live ChinaAPI Gateway là nguồn chính thức. DeepSeek cũng từng thông báo rằng sau 2026-09-14, các lệnh gọi trực tiếp deepseek-v4-pro sẽ được chuyển sang V4.1 Flash, nhưng sau đó đã rút lại kế hoạch này: DeepSeek V4 Pro vẫn được cung cấp sau ngày đó với cách tính phí không đổi, và deepseek-v4-pro vẫn là một tuyến riêng trên ChinaAPI.
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent Hunyuan đã mở mã nguồn và trọng số của AuK cùng AuK-Flash vào 2026-09-09. AuK là mô hình nền tảng tạo và chỉnh sửa giọng nói 1.5B tham số, được huấn luyện với 1.95M giờ giám sát hiệu dụng trên năm nhóm tác vụ: tạo giọng nói, chỉnh sửa nội dung, tăng cường và phân tách, chỉnh sửa cận ngôn ngữ và chỉnh sửa âm học. Một giao diện chỉ dẫn ngôn ngữ tự nhiên duy nhất hỗ trợ zero-shot và instruction-based TTS, chỉnh sửa lời nói và ca từ, thay đổi pitch, speed và volume, chỉnh sửa emotion và timbre, khử giọng địa phương, âm thanh phi ngôn ngữ, tăng cường lời nói và phân tách nguồn. AuK-Flash là biến thể chưng cất 4-step; bài báo cho biết tốc độ wall-clock nhanh hơn AuK 4.5x trong cùng điều kiện, nhưng đây là kết quả của nhà cung cấp, không phải thử nghiệm ChinaAPI. Cả hai kho chính thức đều cung cấp trọng số có thể tải xuống theo MIT và dùng Qwen2.5-Omni-3B làm encoder bên ngoài. Mã nguồn chính thức và SGLang-Omni có tài liệu self-hosted inference, nhưng ChinaAPI hiện chưa cung cấp AuK như một Route khách hàng có thể gọi, vì vậy chưa công bố giá API hay Model Page.
2026-09-09
Not on ChinaAPI confirmed

Tencent Hy Team đã mở trọng số Hy4 preview vào ngày 2026-08-28. Backbone Mixture-of-Experts có tổng cộng 770B tham số, kích hoạt 49B tham số cho mỗi token, cùng một lớp MTP gốc 10B để speculative decoding. Mô hình văn bản hỗ trợ ngữ cảnh 1M và có hai kho trọng số chính thức: checkpoint gốc và biến thể FP8. Tencent cung cấp hướng dẫn phục vụ OpenAI-compatible bằng vLLM và SGLang; ma trận SGLang chính thức gồm FP8 trên 8x B200 hoặc 4x B300/GB300 và BF16 trên 16x H200. Mô hình dùng giấy phép Apache-2.0 và được định vị cho Software Engineering dài hạn, phân tích văn phòng, Game Development và Scientific Research. Các đánh giá công bố là kết quả của nhà cung cấp, không phải thử nghiệm của ChinaAPI. ChinaAPI hiện cung cấp Route hy4-preview cho khách hàng, cùng Model Page riêng và bài phân tích Deployment và chi phí; danh mục thời gian thực là nguồn chính thức cho giá hiện tại.
2026-08-28
✓ On ChinaAPI confirmed
Z.ai phát hành và mở trọng số GLM-5.3-Flash (320B-A18B) vào ngày 2026-08-27, đây là mô hình đa phương thức gốc đầu tiên trong dòng GLM-5. Mô hình nhận văn bản, hình ảnh, video và tệp, có ngữ cảnh 1M và đầu ra tối đa 128K. Chat Completion API chính thức luôn bật chế độ suy luận, đồng thời hỗ trợ Function Calling, Context Caching và Structured Output. Kiến trúc chi phí thấp kết hợp Sparse Attention và Linear Attention với Manifold-Constrained Hyper-Connections. Theo Z.ai, mô hình được tiền huấn luyện trên 30T tokens đa phương thức; so với GLM-5.3, lượng tính toán Attention giảm 3,01 lần và KV Cache trung bình mỗi lớp giảm 4,44 lần. Z.ai cũng công bố điểm 57 trên Artificial Analysis Intelligence Index và hiệu năng Coding tương đương Claude Opus 4.8; đây là tuyên bố của nhà cung cấp, không phải thử nghiệm của ChinaAPI. API Route glm-5.3-flash hiện có thể được gọi trên ChinaAPI qua Endpoint OpenAI-compatible và Anthropic-compatible với đầu vào văn bản, hình ảnh và video.
2026-08-27
✓ On ChinaAPI confirmed
Qwen phát hành Qwen3.8-Flash-Next ngày 2026-08-26 như bản xem trước multimodal Mixture-of-Experts của kiến trúc Qwen4. Mô hình ngôn ngữ gồm mô hình chính 125B tham số, embedding N-gram bổ sung 51B, mô-đun MTP 4B và kích hoạt 6B tham số trên mỗi token; ngữ cảnh gốc 262K có thể mở rộng lên 1M bằng YaRN. Qwen phát hành checkpoint BF16 và FP8 chính thức; Hugging Face ghi kích thước khoảng 360GB và 186GB, còn công thức vLLM đo 335.28GiB và 172.78GiB. vLLM xác nhận 2x GB300 là cấu hình FP8 chính thức tối thiểu và báo cáo khoảng 1,430 output tokens/s ở concurrency 64 trên 4x H100 khi offload bảng N-gram sang bộ nhớ host, với workload ngẫu nhiên 1,024 đầu vào/256 đầu ra. Một công thức NVFP4 của bên thứ ba cũng báo cáo chạy trên một DGX Spark 128GB, nhưng dùng checkpoint 4-bit không chính thức của Qwen và quy trình serving tùy chỉnh nên không phải cấu hình tối thiểu chính thức. Qwen Community License 1.0 yêu cầu giấy phép riêng trước khi dùng thương mại cho MaaS hoặc doanh nghiệp AI Work Assistant theo định nghĩa. ChinaAPI niêm yết qwen3.8-flash, mô hình production được quản lý dựa trên Flash-Next, như một route khách hàng có thể gọi; không tuyên bố nó byte-identical với trọng số preview tải xuống.
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision Nguồn · api-docs.deepseek.com
DeepSeek phát hành DeepSeek-V4-Flash-Vision-Exp trên nền tảng API vào ngày 2026-08-21 dưới dạng mô hình hiểu hình ảnh thử nghiệm, độc lập. Mô hình được gọi bằng model='deepseek-v4-flash-vision-exp' và nhận đầu vào kết hợp văn bản-hình ảnh qua OpenAI-compatible Chat Completions và Responses API cùng Messages API tương thích Anthropic. Có thể truyền ảnh JPEG, PNG, GIF hoặc WebP bằng base64, URL công khai hay Files API. Mô hình có ngữ cảnh 1M, đầu ra tối đa 384K, hỗ trợ chế độ suy luận và không suy luận, JSON Output và Tool Calls nhưng không hỗ trợ FIM. Theo DeepSeek, năng lực Agent, suy luận và kiến thức thế giới ở tác vụ chỉ văn bản ngang với bản DeepSeek-V4-Flash chính thức, còn kết quả Agent thị giác tăng đáng kể; đây là công bố của nhà cung cấp, không phải thử nghiệm của ChinaAPI. Mỗi ảnh được quy đổi tối đa 384 tokens và áp dụng đơn giá token chính thức của V4-Flash. Tuyến deepseek-v4-flash-vision-exp từng gọi được trên ChinaAPI khi phát hành; sau đó tuyến này đã rời live catalog để chuyển sang deepseek-flash, và URL tiếp thị cũ chuyển hướng đến trang chính thức.
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwen đã công bố hai cấu hình mô hình Qwen3.8 có thể tự triển khai và bốn kho trọng số chính thức. Qwen3.8-27B và Qwen3.8-27B-FP8 là hai biến thể độ chính xác của cùng một mô hình thị giác-ngôn ngữ dense gốc. Qwen3.8-2.4T-A95B và kho FP8 tương ứng là hai biến thể của cùng một mô hình Mixture-of-Experts chỉ xử lý văn bản với 95B tham số hoạt động. Cả hai cấu hình hỗ trợ ngữ cảnh gốc 262K và có hướng dẫn tự lưu trữ. Bản 27B dùng Apache-2.0; bản 2.4T dùng giấy phép tùy chỉnh Qwen3.8-Max License với nghĩa vụ hiển thị tên mô hình và điều kiện dành cho hoạt động MaaS hoặc AI Work Assistant có doanh thu cao. Danh mục ChinaAPI hiện có các tuyến qwen3.8-27b và qwen3.8-2.4t-a95b để khách hàng gọi; điều này không khẳng định chúng giống hệt từng byte với trọng số có thể tải về. Xem danh mục trực tiếp để biết giá hiện tại.
2026-08-14
✓ On ChinaAPI confirmed
Z.ai phát hành GLM-5.3 vào 2026-08-14 và triển khai cho toàn bộ người dùng GLM Coding Plan. Mô hình dùng cùng base model với GLM-5.2, còn toàn bộ cải thiện đến từ hậu huấn luyện. Đây là mô hình chỉ xử lý văn bản, hỗ trợ ngữ cảnh 1M và đầu ra tối đa 128K; chế độ suy luận luôn bật với các mức reasoning_effort low, high và max. Z.ai công bố mức cải thiện 50% so với GLM-5.2 trên Z.ai Code Bench nội bộ cùng kết quả tốt hơn trên các benchmark công khai về lập trình và an ninh mạng; đây là tuyên bố của nhà cung cấp, không phải thử nghiệm của ChinaAPI. Model API chính thức hiện đã hoạt động và tuyến glm-5.3 có thể được gọi trên ChinaAPI qua giao diện tương thích OpenAI. Khi chuyển từ cấu hình từng tắt suy luận, tài liệu chính thức yêu cầu bật suy luận và đặt reasoning_effort thành low trước khi đổi model ID; nếu không, yêu cầu sẽ thất bại (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
DeepSeek đã cập nhật bí danh API deepseek-v4-pro hiện có để phục vụ DeepSeek-V4-Pro-0813. Cách gọi và model ID không thay đổi: các yêu cầu dùng deepseek-v4-pro sẽ nhận phiên bản mới nhất. Trang bắt đầu nhanh chính thức cũng xác nhận deepseek-v4-flash vẫn ánh xạ tới DeepSeek-V4-Flash-0731. Đây là lần chuyển phiên bản phục vụ, không phải tuyến API mới. Sau đó DeepSeek đã rút lại kế hoạch chuyển deepseek-v4-pro sang V4.1 Flash; V4 Pro vẫn được cung cấp sau 2026-09-14 với cách tính phí không đổi, vì vậy các tích hợp ChinaAPI hiện có có thể tiếp tục dùng cùng model ID.
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloud phát hành qwen3.8-max vào 2026-08-03, giới thiệu đây là mô hình chủ lực Qwen mạnh nhất từ trước đến nay. Mô hình thị giác-ngôn ngữ gốc dùng kiến trúc Mixture-of-Experts với 2.4T tham số, hỗ trợ suy luận, tạo văn bản và hiểu hình ảnh, đồng thời cải thiện đáng kể so với dòng Qwen3.7. Tài liệu Model Studio chính thức liệt kê quyền truy cập OpenAI-compatible, Anthropic-compatible và DashScope tại Bắc Kinh cùng nhiều khu vực toàn cầu. Tuyến này hiện đã có trên ChinaAPI.
2026-08-03
✓ On ChinaAPI confirmed

MiniMax đã phát hành H3 (Hailuo 3.0). Ghi chú phát hành chính thức mô tả đây là mô hình video đa phương thức mở đa dụng đời mới, hiểu ý đồ sáng tạo từ ngữ cảnh văn bản, hình ảnh, video và âm thanh, cho kết quả tạo sinh tự nhiên và mạch lạc hơn. ChinaAPI phục vụ tuyến tạo clip 4–15 giây ở 768P và 2K với âm thanh stereo gốc trong một lần chạy, tính phí theo từng giây đầu ra và có thể gọi qua endpoint video OpenAI-compatible.
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
Danh mục mô hình Ark của Volcano Engine liệt kê Doubao-Seedance-2.5 với model ID doubao-seedance-2-5-260628. Ra mắt ngày 2026-07-31, mô hình video này có thể tạo tối đa 30 giây, nhận tối đa 50 tài liệu tham chiếu (30 ảnh, 10 video và 10 đoạn âm thanh), đồng thời hỗ trợ tham chiếu đa phương thức, chỉnh sửa, kéo dài video và tạo nội dung bằng hơn 10 ngôn ngữ. 260628 vẫn là nhãn phiên bản mô hình. ChinaAPI hiện cung cấp tuyến này cho khách hàng; xem danh mục trực tiếp để biết giá hiện tại.
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash Nguồn · api-docs.deepseek.com
DeepSeek nâng cấp tuyến API deepseek-v4-flash hiện có bằng checkpoint được hậu huấn luyện lại, giữ nguyên kiến trúc và quy mô của bản Preview nhưng tăng cường năng lực lập trình và Agent. Với mức suy luận tối đa và minimal harness chưa được công bố, DeepSeek báo cáo 82.7 trên Terminal Bench 2.1, 54.4 trên DeepSWE và 70.3 trên Toolathlon Verified; đây là kết quả do nhà cung cấp công bố, không phải thử nghiệm của ChinaAPI. Tuyến chính thức hiện hỗ trợ gốc Responses API và tích hợp Codex; ứng dụng web DeepSeek, ứng dụng di động và V4-Pro API không nằm trong đợt cập nhật này.
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloud phát hành mô hình Flash thị giác-ngôn ngữ gốc với ngữ cảnh 1M và đầu ra tối đa 131K. So với Qwen3.6-Flash, mô hình nâng cấp khả năng hiểu đa phương thức, nhận thức thế giới thực và không gian, thực thi Search Agent và CI Agent, cùng lập trình đa phương thức. Mô hình chính thức nhận văn bản, hình ảnh và video, đồng thời cung cấp công cụ tích hợp qua Responses API. ChinaAPI hiện cung cấp qwen3.7-flash cho khách hàng; xem danh mục trực tiếp để biết giá hiện tại.
2026-07-25
✓ On ChinaAPI confirmed
Moonshot đã phát hành sản phẩm chủ lực của 2.8T-parameter với 1M ngữ cảnh, khả năng suy luận liên tục và hiểu biết hình ảnh và video gốc. Các trọng số mã nguồn mở được công bố dự kiến sẽ ra mắt vào ngày July 27, 2026 .
2026-07-16
✓ On ChinaAPI confirmed
Tencent chính thức ra mắt Hy3 , một mô hình tư duy lai nhanh-chậm với 256K-context , được cải thiện về độ ổn định và hiệu quả chi phí.
2026-07-06
✓ On ChinaAPI confirmed

Meituan đã phát hành mô hình suy luận MoE mở với 1M ngữ cảnh dành cho việc lập trình tác nhân và sử dụng công cụ tầm xa.
2026-06-30
✓ On ChinaAPI confirmed
Mô hình hàng đầu Doubao Seed 2.1 dành cho suy luận đa phương thức, lập trình, sử dụng công cụ và các nhiệm vụ tác nhân tầm xa.
2026-06-28
✓ On ChinaAPI confirmed
Video HappyHorse
Mô hình cổng chuyển đổi văn bản thành video HappyHorse 1.1 với khả năng hiểu ngữ nghĩa và điều khiển camera được cải tiến.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Mô hình cổng tham chiếu-video HappyHorse 1.1 đảm bảo tính nhất quán về chủ thể, bối cảnh và phong cách khi sử dụng nhiều nguồn tham chiếu khác nhau.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Mô hình cổng chuyển đổi hình ảnh sang video HappyHorse 1.1 với kết cấu và tính nhất quán nhận diện mạnh mẽ hơn.
2026-06-22
✓ On ChinaAPI confirmed
Nền tảng mã nguồn mở hàng đầu GLM với 1M ngữ cảnh và khả năng mã hóa dài hạn mạnh mẽ hơn cùng quy trình làm việc của tác nhân.
2026-06-16
✓ On ChinaAPI confirmed
Biến thể cổng Kimi K2.7 tốc độ cao dành cho các tác vụ mã hóa và xử lý tác nhân có độ trễ thấp hơn.
2026-06-12
✓ On ChinaAPI confirmed
Mô hình cổng Kimi tập trung vào lập trình dành cho công việc lưu trữ dữ liệu dài hạn với hỗ trợ thị giác máy tính.
2026-06-12
✓ On ChinaAPI confirmed
Nhận dạng giọng nói MiMo hỗ trợ chuyển đổi mã tiếng Trung-Anh, các phương ngữ Quảng Đông, Ngô, Dân Nam và Tứ Xuyên, các bản ghi âm nhiễu và ở xa, giọng nói chồng chéo và lời bài hát.
2026-06-02
✓ On ChinaAPI confirmed
Mô hình cổng thông tin đa phương thức Qwen dành cho phân tích trực quan, lập kế hoạch, quản lý tệp và sử dụng công cụ.
2026-06-01
✓ On ChinaAPI confirmed
Mô hình M-series đa phương thức gốc với hỗ trợ 1M ngữ cảnh, cơ chế chú ý MSA, mã hóa, tác nhân, hình ảnh và video.
2026-06-01
✓ On ChinaAPI confirmed

Mô hình cổng StepFun nhanh với 256K ngữ cảnh, đầu vào hình ảnh, suy luận và sử dụng công cụ.
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video Nguồn: arxiv.org
Phát hành kỹ thuật video avatar dựa trên âm thanh tập trung vào đồng bộ hóa môi, tính nhất quán về nhận diện và tạo video dài.
2026-05-26
Not on ChinaAPI confirmed
Mô hình cổng Qwen hàng đầu dành cho các quy trình phân tích, lập trình và sản xuất đòi hỏi cao.
2026-05-21
✓ On ChinaAPI confirmed

Qwen 3.6 là mô hình ngôn ngữ-hình ảnh nhanh dành cho suy luận trực quan, quản lý tệp và quy trình làm việc của tác nhân.
2026-04-27
✓ On ChinaAPI confirmed
Mô hình tác nhân MiMo 1.02T-parameter với 1M ngữ cảnh dành cho các tác vụ lập trình đòi hỏi cao và các tác vụ dài hạn.
2026-04-27
✓ On ChinaAPI confirmed
Mô hình MiMo đa phương thức gốc với 1M ngữ cảnh và khả năng hiểu văn bản, hình ảnh, video và âm thanh.
2026-04-27
✓ On ChinaAPI confirmed
Wan 2.7 Chuyển đổi hình ảnh thành video với điều khiển khung hình đầu/cuối, tiếp tục, âm thanh điều khiển và đầu ra 720 P/ 1080 P.
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
Phiên bản DeepSeek V4 nhanh chóng, lý tưởng cho việc trò chuyện hiệu quả, hỗ trợ lập trình và xử lý các vòng lặp tác vụ.
2026-04-24
Not on ChinaAPI confirmed
MiMo là ứng dụng chuyển văn bản thành giọng nói biểu cảm với các giọng nói tích hợp chất lượng cao và khả năng điều khiển ngôn ngữ tự nhiên về tốc độ, cảm xúc, giọng điệu, phương ngữ và hiệu suất nhân vật.
2026-04-23
✓ On ChinaAPI confirmed
Mở mô hình Kimi đa phương thức gốc cho lập trình tầm nhìn dài hạn, thiết kế trực quan và quy trình làm việc bầy đàn tác nhân.
2026-04-14
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
Một mô hình nền tảng mã hóa đa phương 200K-context dành cho quy trình làm việc dựa trên hình ảnh, video, tệp tin, tác nhân giao diện người dùng đồ họa (GUI) và công cụ.
2026-04-07
Not on ChinaAPI confirmed
Mô hình chỉnh sửa video ngôn ngữ tự nhiên Wan 2.7 dành cho chỉnh sửa cục bộ/toàn cục và thay thế các thành phần.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Mô hình chuyển đổi văn bản thành video Wan 2.7 để tạo video dựa trên lời nhắc.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Mô hình tham chiếu video Wan 2.7 để tạo nội dung có kiểm soát từ các tham chiếu hình ảnh.
2026-04-03
✓ On ChinaAPI confirmed
Wan 2.7 Pro hỗ trợ tạo và chỉnh sửa ảnh với khả năng kiểm soát màu sắc thương hiệu, độ nhất quán đa tham chiếu và độ phân giải đầu ra lên đến 4096 × 4096 .
2026-04-01
✓ On ChinaAPI confirmed
Mô hình hình ảnh Wan 2.7 dành cho chuyển đổi văn bản thành hình ảnh, chỉnh sửa, tạo đa tham chiếu và hiển thị văn bản mạnh mẽ hơn.
2026-04-01
✓ On ChinaAPI confirmed

Mô hình MiniMax trọng lượng mở dành cho trò chuyện, lập trình, công việc văn phòng và các tác vụ tự động.
2026-03
✓ On ChinaAPI estimated

Alibaba Qwen3.5
Phiên bản Qwen tích hợp tác nhân đa phương thức gốc được phát hành trước các mô hình cổng Qwen 3.6 và 3.7 hiện hành.
2026-02-16
Not on ChinaAPI confirmed
Kling thế hệ 3.0 với các tính năng chuyển đổi văn bản thành video, hình ảnh thành video, âm thanh và các cấp độ đầu ra 720p đến 4K .
2026-02-05
✓ On ChinaAPI confirmed
StepFun Step-3.5-Flash
Mô hình flash StepFun mở với ngữ cảnh 256K và hỗ trợ dùng công cụ. ChinaAPI hiện cung cấp step-3.5-flash cho khách hàng; xem danh mục trực tiếp để biết giá hiện tại.
2026-02-01
✓ On ChinaAPI confirmed

Mô hình hình ảnh Seedream 5.0-lite với khả năng tạo, truy xuất có thể kiểm soát và tính nhất quán chủ thể mạnh mẽ hơn.
2026-01-28
✓ On ChinaAPI confirmed
Seedance 2.0 là dòng sản phẩm chủ lực tạo video, được quảng cáo dựa trên độ phân giải đầu ra.
2026-01-28
✓ On ChinaAPI confirmed
MiniMax đã phát hành Speech 2.8 với các thẻ âm thanh gốc, cải thiện khả năng sao chép giọng nói, âm thanh chất lượng phòng thu và hỗ trợ nhận diện giọng nói đa ngôn ngữ; Turbo là phiên bản tập trung vào tốc độ.
2026-01-23
✓ On ChinaAPI confirmed
MiniMax đã phát hành Speech 2.8 với các thẻ âm thanh gốc, cải thiện khả năng sao chép giọng nói, âm thanh chất lượng phòng thu và hỗ trợ nhận diện giọng nói đa ngôn ngữ; HD là tùy chọn chất lượng cao.
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
Mở mô hình tác nhân Kimi đa phương thức gốc với 256K ngữ cảnh và huấn luyện ngôn ngữ thị giác.
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio Nguồn: docs.z.ai
Z.AI đã phát hành mô hình nhận dạng giọng nói tự động đa ngôn ngữ (ASR) với khả năng hỗ trợ từ điển tùy chỉnh được cải tiến và nhận diện thuật ngữ chuyên ngành.
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
Mô hình tạo ảnh nhỏ gọn, tập trung vào chất lượng dữ liệu hơn là kích thước mô hình.
2025-12
Not on ChinaAPI confirmed

Hailuo 2.3 cải thiện khả năng thể hiện chuyển động phức tạp, hành động vật lý, tạo kiểu và biểu cảm vi mô.
2025-10-28
✓ On ChinaAPI confirmed

Alibaba đã phát hành Qwen3-TTS-Flash , một phần mềm tổng hợp giọng nói ngoại tuyến với giọng nói biểu cảm, hỗ trợ nhiều ngôn ngữ và phương ngữ, cùng khả năng truy cập API độ trễ thấp.
2025-09-22
✓ On ChinaAPI confirmed

Mô hình máy dựng video Hailuo 02 giá rẻ dùng để chuyển đổi văn bản thành video và hình ảnh thành video từ độ phân giải 512p .
2025-06
✓ On ChinaAPI estimated

Chuyển văn bản thành giọng nói dựa trên ngữ cảnh với khả năng điều khiển bằng ngôn ngữ tự nhiên toàn cục và nội tuyến, truyền đạt biểu cảm và xuất OpenAI-compatible /v1/audio/speech .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Chuyển đổi giọng nói thành văn bản nhanh chóng sang tiếng Anh và tiếng Trung 4B MTP với chuẩn hóa ITN và OpenAI-compatible lộ trình phiên âm.
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
Giải pháp tổng hợp giọng nói đa ngôn ngữ tiết kiệm chi phí với giọng nói chính thức và giọng nói sao chép, lập bản đồ phát âm và điều khiển kiểu giọng.
Release date not publicly confirmed
Not on ChinaAPI unknown
Tổng hợp giọng nói biểu cảm với giọng nói chính thức và giọng nói sao chép, ánh xạ phát âm, điều khiển kiểu dáng và đầu ra OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Tổng hợp giọng nói biểu cảm nhận ngữ cảnh với đầu ra trực tuyến và các điều khiển cho giọng nói, tốc độ và âm lượng.
Release date not publicly confirmed
✓ On ChinaAPI unknown