Pembaruan model dinding

Rilis terbaru dari AI Tiongkok.

Ringkasan singkat rilis model AI Tiongkok, lengkap dengan tautan sumber dan status ketersediaan di ChinaAPI. Data sumber menandai 3 tanggal perkiraan dan 5 tanggal yang belum diketahui.

Terbaru terlebih dahulu

Lepaskan dinding.

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 Sumber · mimo.mi.com
Xiaomi merilis tier layanan berlatensi rendah yang mempertahankan input omni-modal, kemampuan penalaran unggulan, 1M-token context window, dan batas output 128K milik MiMo-V2.6-Pro. Xiaomi mengiklankan kecepatan output hingga 20 kali layanan Pro standar; RPM dan TPM disediakan sebagai layanan khusus. API model ID resminya adalah mimo-v2.6-pro-ultraspeed. ChinaAPI kini menyediakan rute ini untuk panggilan pelanggan; periksa katalog langsung untuk harga terbaru.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 Sumber · mimo.mi.com
Xiaomi merilis model penalaran unggulan native omni-modal untuk proyek kompleks, tugas jangka panjang, keamanan siber, dan riset. MiMo-V2.6-Pro menerima teks, gambar, video, dan audio, menghasilkan teks, menyediakan 1M-token context window dan output hingga 128K, serta mendukung deep thinking, tool calling, streaming, web search, structured output, dan context caching. API model ID resminya adalah mimo-v2.6-pro. ChinaAPI kini menyediakan route ini bagi pelanggan; lihat harga terbaru di live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 Sumber · mimo.mi.com
Xiaomi merilis model penalaran native omni-modal yang dioptimalkan untuk panggilan berfrekuensi tinggi dalam pekerjaan profesional dan tugas berskala besar dengan biaya lebih rendah. MiMo-V2.6-Flash menerima teks, gambar, video, dan audio, menghasilkan teks, menyediakan 1M-token context window dan output hingga 128K, serta mendukung deep thinking, tool calling, streaming, web search, structured output, dan context caching. API model ID resminya adalah mimo-v2.6-flash. ChinaAPI kini menyediakan route ini bagi pelanggan; lihat harga terbaru di live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API Sumber · mimo.mi.com
Xiaomi meluncurkan inferensi asinkron Batch API untuk mimo-v2.6-pro dan mimo-v2.6-flash dengan harga 50% dari API real-time. Layanan ini dirancang untuk pekerjaan non-real-time seperti evaluasi, pelabelan, dan pembuatan massal, menerima permintaan JSONL, serta mendukung format permintaan OpenAI Chat Completions, OpenAI Responses, dan Anthropic Messages tanpa streaming. ChinaAPI menyediakan kedua route model real-time; hal ini tidak berarti mendukung Batch API Xiaomi yang terpisah.
2026-09-22
Not on ChinaAPI confirmed
StepFun merilis Step 5 Preview pada 2026-09-20 sebagai model flagship untuk rekayasa perangkat lunak, tugas Agent jangka panjang, pekerjaan pengetahuan profesional, dan keuangan. Model sparse Mixture-of-Experts ini memiliki total 600B parameter, mengaktifkan 27B per token, dan mendukung konteks 1M tokens. API model ID resminya adalah step-5-preview; model menerima input teks, gambar, dan video, menghasilkan teks, serta mendukung output hingga 64K tokens. API juga mendukung streaming, tool calling, JSON Mode, JSON Schema, reasoning effort low/medium/high, dan prompt caching. StepFun melaporkan skor 44 pada Artificial Analysis Intelligence Index beserta hasil benchmark coding, Agent, keuangan, dan multimodal; ini adalah hasil yang dilaporkan vendor, bukan pengujian ChinaAPI. StepFun menyatakan open weights akan dirilis pada 2026-10-15. Live catalog ChinaAPI kini menyediakan route step-5-preview yang dapat dipanggil pelanggan dengan harga daftar vendor: input $1.00/M, output $2.70/M, dan prompt-cache read $0.05/M; live Gateway tetap menjadi sumber resmi.
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image Sumber · github.com
Qwen merilis bobot Qwen-Image-2.1 pada 2026-09-20. Komponen pembangkit gambar dengan 7B parameter menyatukan pembuatan gambar dari teks dan penyuntingan gambar, dengan transparansi RGBA bawaan, hingga 10 gambar referensi, penyuntingan lokal, dan keluaran 2K. Ini adalah kemampuan yang diumumkan Qwen, bukan hasil pengujian ChinaAPI. Bobotnya tunduk pada Qwen Research License, yang tanpa lisensi komersial terpisah hanya mengizinkan penelitian dan evaluasi nonkomersial. Alibaba Model Studio belum menerbitkan API model ID atau harga untuk Qwen-Image-2.1, dan ChinaAPI belum menyediakan route ini; halaman model dan harga ChinaAPI belum dipublikasikan.
2026-09-20
Not on ChinaAPI confirmed
DeepSeek merilis dan membuka bobot DeepSeek-V4.1-Flash pada 2026-09-10. Model native gambar-teks ini memakai arsitektur Causal Encoder-Decoder Mixture-of-Experts 552B parameter, dengan 8B aktif saat prefill input dan 16B saat decode output, konteks 1M, serta output hingga 384K. Menurut DeepSeek, evaluasi vendor melampaui V4 Pro dan KV Cache baru memakai 1/4 HBM serta 1/8 penyimpanan SSD dibanding V4 Flash sebelumnya; ini klaim vendor, bukan pengujian ChinaAPI. Model ID API DeepSeek langsung adalah deepseek-flash. DeepSeek menghentikan checkpoint mandiri V4 Flash dan Vision-Exp, tetapi sementara memetakan model IDs lama ke V4.1 Flash. Live catalog ChinaAPI kini menampilkan ID kanonis deepseek-flash sebagai pengganti kedua ID Flash lama; dua URL pemasaran Flash yang dihentikan dialihkan ke halaman model kanonis tersebut. Harga di luar jam sibuk adalah $0.15/M untuk input, $0.60/M untuk output, dan $0.003/M untuk cache read; pada jam sibuk hari kerja waktu Beijing, harga tepat 2x menjadi $0.30/M, $1.20/M, dan $0.006/M. live ChinaAPI Gateway tetap menjadi acuan resmi. DeepSeek sempat mengumumkan bahwa setelah 2026-09-14 panggilan langsung deepseek-v4-pro akan diarahkan ke V4.1 Flash, tetapi kemudian membatalkan rencana tersebut: V4 Pro tetap tersedia setelah tanggal itu dengan penagihan yang tidak berubah, dan deepseek-v4-pro tetap menjadi rute ChinaAPI tersendiri.
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent Hunyuan membuka kode sumber dan bobot AuK serta AuK-Flash pada 2026-09-09. AuK adalah model fondasi pembuatan dan penyuntingan ucapan 1.5B parameter yang dilatih dengan 1.95M jam supervisi efektif pada lima kelompok tugas: pembuatan ucapan, penyuntingan konten, peningkatan dan pemisahan, penyuntingan paralinguistik, serta penyuntingan akustik. Satu antarmuka instruksi bahasa alami mendukung zero-shot dan instruction-based TTS, penyuntingan ucapan dan lirik, perubahan pitch, speed dan volume, penyuntingan emotion dan timbre, penghilangan aksen, suntingan suara nonverbal, peningkatan ucapan, serta pemisahan sumber. AuK-Flash adalah varian hasil distilasi 4-step; makalah melaporkan percepatan wall-clock 4.5x dibanding AuK dalam kondisi yang sama, tetapi ini adalah hasil vendor, bukan pengujian ChinaAPI. Kedua repositori resmi menyediakan bobot MIT yang dapat diunduh dan memakai Qwen2.5-Omni-3B sebagai encoder eksternal. Kode resmi dan SGLang-Omni mendokumentasikan self-hosted inference, tetapi ChinaAPI saat ini tidak menyediakan AuK sebagai Route yang dapat dipanggil pelanggan, sehingga harga API dan Model Page belum diterbitkan.
2026-09-09
Not on ChinaAPI confirmed

Tencent Hy Team membuka bobot Hy4 preview pada 2026-08-28. Model Mixture-of-Experts ini memiliki 770B parameter backbone dengan 49B aktif per token, ditambah lapisan MTP native 10B untuk speculative decoding. Model teks ini mendukung konteks 1M dan diterbitkan dalam dua repositori bobot resmi: checkpoint asli dan varian FP8. Tencent mendokumentasikan layanan OpenAI-compatible melalui vLLM dan SGLang; matriks SGLang resmi mencakup FP8 pada 8x B200 atau 4x B300/GB300 serta BF16 pada 16x H200. Model dirilis di bawah Apache-2.0 dan ditujukan untuk Software Engineering jangka panjang, analisis Office, Game Development, dan Scientific Research. Evaluasi yang dipublikasikan merupakan hasil vendor, bukan pengujian ChinaAPI. ChinaAPI menyediakan Route hy4-preview yang dapat dipanggil pelanggan, Model Page khusus, serta analisis Deployment dan biaya; katalog real-time tetap menjadi acuan harga terkini.
2026-08-28
✓ On ChinaAPI confirmed
Z.ai merilis dan membuka bobot GLM-5.3-Flash (320B-A18B) pada 2026-08-27 sebagai model multimodal native pertama dalam keluarga GLM-5. Model ini menerima input teks, gambar, video, dan file, dengan konteks 1M dan output hingga 128K. Chat Completion API resminya selalu mengaktifkan thinking serta mendukung Function Calling, Context Caching, dan Structured Output. Arsitektur berbiaya rendah menggabungkan Sparse Attention dan Linear Attention dengan Manifold-Constrained Hyper-Connections. Menurut Z.ai, model ini dipra-latih pada 30T tokens multimodal dan, dibandingkan GLM-5.3, mengurangi komputasi Attention sebesar 3,01 kali serta KV Cache rata-rata per lapisan sebesar 4,44 kali. Z.ai juga melaporkan skor 57 pada Artificial Analysis Intelligence Index dan kinerja Coding yang sebanding dengan Claude Opus 4.8; ini adalah klaim vendor, bukan pengujian ChinaAPI. API Rute glm-5.3-flash kini dapat dipanggil di ChinaAPI melalui endpoint OpenAI-compatible dan Anthropic-compatible dengan input teks, gambar, dan video.
2026-08-27
✓ On ChinaAPI confirmed
Qwen merilis Qwen3.8-Flash-Next pada 2026-08-26 sebagai preview multimodal Mixture-of-Experts dari arsitektur Qwen4. Model bahasa ini memiliki model utama 125B parameter, embedding N-gram tambahan 51B, modul MTP 4B, dan mengaktifkan 6B parameter per token, dengan konteks native 262K yang dapat diperluas hingga 1M melalui YaRN. Qwen menerbitkan checkpoint BF16 dan FP8 resmi; Hugging Face mencatat sekitar 360GB dan 186GB, sedangkan resep vLLM mengukur 335.28GiB dan 172.78GiB. vLLM memvalidasi 2x GB300 sebagai topologi FP8 resmi minimum dan melaporkan sekitar 1,430 output tokens/s pada concurrency 64 di 4x H100 dengan tabel N-gram di-offload ke memori host, menggunakan workload acak 1,024 input/256 output. Resep NVFP4 pihak ketiga juga melaporkan operasi pada satu DGX Spark 128GB, tetapi memakai checkpoint 4-bit yang bukan resmi Qwen dan serving khusus, sehingga bukan minimum resmi. Qwen Community License 1.0 memerlukan lisensi terpisah sebelum penggunaan komersial untuk MaaS atau bisnis AI Work Assistant yang didefinisikan. ChinaAPI mencantumkan qwen3.8-flash, model production terkelola berbasis Flash-Next, sebagai route yang dapat dipanggil pelanggan; model itu tidak dinyatakan byte-identical dengan bobot preview yang dapat diunduh.
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision Sumber · api-docs.deepseek.com
DeepSeek meluncurkan DeepSeek-V4-Flash-Vision-Exp di platform API pada 2026-08-21 sebagai model pemahaman visual eksperimental yang berdiri sendiri. Model ini dipanggil dengan model='deepseek-v4-flash-vision-exp' dan menerima input campuran teks-gambar melalui OpenAI-compatible Chat Completions dan Responses API serta Messages API yang kompatibel dengan Anthropic. Gambar JPEG, PNG, GIF, dan WebP dapat dikirim sebagai base64, URL publik, atau referensi Files API. Model ini memiliki konteks 1M dan output hingga 384K, mendukung mode thinking dan non-thinking, JSON Output, serta Tool Calls, tetapi tidak mendukung FIM. Menurut DeepSeek, kemampuan Agent khusus teks, penalaran, dan pengetahuan dunianya setara dengan DeepSeek-V4-Flash resmi, sedangkan hasil Agent visual meningkat tajam; perbandingan ini adalah klaim vendor, bukan pengujian ChinaAPI. Setiap gambar dikonversi menjadi paling banyak 384 tokens dan memakai tarif token resmi V4-Flash. Rute deepseek-v4-flash-vision-exp dapat dipanggil di ChinaAPI saat dirilis; rute ini kemudian dihentikan dari live catalog dan digantikan oleh deepseek-flash, sedangkan URL pemasaran lamanya dialihkan ke halaman kanonis.
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwen menerbitkan dua spesifikasi model Qwen3.8 yang dapat diterapkan sendiri dan empat repositori bobot resmi. Qwen3.8-27B dan Qwen3.8-27B-FP8 adalah varian presisi dari satu model dense vision-language native. Qwen3.8-2.4T-A95B dan repositori FP8-nya adalah varian dari satu model Mixture-of-Experts khusus teks dengan 95B parameter aktif. Kedua spesifikasi mendukung konteks native 262K dan jalur self-hosting yang terdokumentasi. Rilis 27B memakai Apache-2.0, sedangkan rilis 2.4T memakai Qwen3.8-Max License khusus dengan kewajiban atribusi serta ketentuan bagi bisnis MaaS atau AI Work Assistant berpendapatan tinggi. Katalog langsung ChinaAPI mencantumkan rute qwen3.8-27b dan qwen3.8-2.4t-a95b yang dapat dipanggil pelanggan. Ini tidak berarti rute tersebut identik byte demi byte dengan bobot yang dapat diunduh. Periksa harga terbaru di katalog langsung.
2026-08-14
✓ On ChinaAPI confirmed
Z.ai merilis GLM-5.3 pada 2026-08-14 dan menyediakannya bagi seluruh pengguna GLM Coding Plan. Model ini memakai base model yang sama dengan GLM-5.2; seluruh peningkatannya berasal dari post-training. Model khusus teks ini mendukung konteks 1M dan output hingga 128K. Thinking selalu aktif, dengan tingkat reasoning_effort low, high, dan max. Z.ai melaporkan peningkatan 50% dibandingkan GLM-5.2 pada Z.ai Code Bench internal serta hasil yang lebih baik pada benchmark publik untuk coding dan keamanan siber; ini adalah klaim vendor, bukan pengujian ChinaAPI. Model API resmi kini aktif, dan rute glm-5.3 tersedia di ChinaAPI melalui akses yang kompatibel dengan OpenAI. Saat bermigrasi dari konfigurasi yang menonaktifkan thinking, aktifkan thinking dan atur reasoning_effort ke low sebelum mengganti model ID; panduan resmi memperingatkan bahwa jika tidak, permintaan akan gagal (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
DeepSeek memperbarui alias API deepseek-v4-pro yang sudah ada agar menyajikan DeepSeek-V4-Pro-0813. Cara pemanggilan dan model ID tidak berubah: permintaan yang menggunakan deepseek-v4-pro akan menerima versi terbaru. Halaman mulai cepat resmi juga mengonfirmasi bahwa deepseek-v4-flash tetap dipetakan ke DeepSeek-V4-Flash-0731. Ini adalah pergantian versi yang disajikan, bukan rute API baru. DeepSeek kemudian membatalkan rencana peralihan deepseek-v4-pro ke V4.1 Flash; V4 Pro tetap tersedia setelah 2026-09-14 dengan penagihan yang tidak berubah, sehingga integrasi ChinaAPI yang sudah ada dapat terus memakai model ID yang sama.
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloud merilis qwen3.8-max pada 2026-08-03 sebagai model unggulan Qwen paling mampu hingga saat ini. Model visi-bahasa native ini menggunakan arsitektur Mixture-of-Experts dengan 2.4T parameter, mendukung penalaran, pembuatan teks, dan pemahaman visual, serta meningkat signifikan dibandingkan seri Qwen3.7. Dokumentasi resmi Model Studio mencantumkan akses OpenAI-compatible, Anthropic-compatible, dan DashScope di Beijing dan beberapa wilayah global. Rute ini kini tersedia melalui ChinaAPI.
2026-08-03
✓ On ChinaAPI confirmed

MiniMax merilis H3 (Hailuo 3.0). Catatan rilis resminya menggambarkannya sebagai model video multimodal serbaguna terbuka generasi baru yang memahami maksud kreatif dari konteks teks, gambar, video, dan audio serta menghasilkan hasil generasi yang lebih alami dan koheren. ChinaAPI melayani rute untuk klip 4-15 detik pada 768P dan 2K dengan audio stereo native dalam sekali proses, ditagih per detik output dan dapat dipanggil melalui endpoint video OpenAI-compatible.
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
Katalog model Ark Volcano Engine mencantumkan Doubao-Seedance-2.5 dengan model ID doubao-seedance-2-5-260628. Dirilis pada 2026-07-31, model video ini dapat membuat video hingga 30 detik, menerima hingga 50 aset referensi (30 gambar, 10 video, dan 10 klip audio), serta mendukung referensi multimodal, penyuntingan dan perpanjangan video, dan pembuatan dalam lebih dari 10 bahasa. 260628 tetap menjadi tag versi model. ChinaAPI kini menyediakan rute ini untuk panggilan pelanggan; periksa katalog langsung untuk harga terbaru.
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash Sumber · api-docs.deepseek.com
DeepSeek meningkatkan rute API deepseek-v4-flash yang ada dengan checkpoint yang dilatih ulang pada tahap post-training. Arsitektur dan ukuran model Preview tetap sama, sementara kemampuan coding dan Agent ditingkatkan. Dengan tingkat penalaran maksimum dan minimal harness yang belum dirilis, DeepSeek melaporkan 82.7 pada Terminal Bench 2.1, 54.4 pada DeepSWE, dan 70.3 pada Toolathlon Verified; ini adalah hasil vendor, bukan pengujian ChinaAPI. Rute resmi kini mendukung Responses API dan integrasi Codex secara native; web DeepSeek, aplikasi seluler, dan V4-Pro API tidak termasuk dalam pembaruan ini.
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloud merilis model Flash visi-bahasa native dengan konteks 1M dan output hingga 131K. Dibandingkan Qwen3.6-Flash, model ini meningkatkan pemahaman multimodal, persepsi dunia nyata dan spasial, eksekusi Search Agent dan CI Agent, serta coding multimodal. Model resmi menerima teks, gambar, dan video serta menyediakan alat bawaan melalui Responses API. ChinaAPI kini menyediakan qwen3.7-flash sebagai rute yang dapat dipanggil pelanggan; periksa katalog langsung untuk harga terbaru.
2026-07-25
✓ On ChinaAPI confirmed
Moonshot merilis 2.8T-parameter andalannya dengan 1M konteks, penalaran yang selalu aktif, dan pemahaman gambar dan video asli. Bobot sumber terbuka yang diumumkan akan dirilis pada July 27, 2026 .
2026-07-16
✓ On ChinaAPI confirmed
Tencent secara resmi merilis Hy3 , sebuah model berpikir cepat dan lambat hibrida 256K-context yang memiliki stabilitas dan efisiensi biaya yang lebih baik.
2026-07-06
✓ On ChinaAPI confirmed

Meituan merilis model penalaran MoE terbuka dengan 1M konteks untuk agen pengkodean dan penggunaan alat jangka panjang.
2026-06-30
✓ On ChinaAPI confirmed
Video HappyHorse
Model gateway teks-ke-video HappyHorse 1.1 dengan pemahaman semantik dan kontrol kamera yang lebih baik.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Model gerbang referensi-ke-video HappyHorse 1.1 untuk konsistensi subjek, adegan, dan gaya multi-referensi.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Model gateway gambar-ke-video HappyHorse 1.1 dengan konsistensi tekstur dan identitas yang lebih kuat.
2026-06-22
✓ On ChinaAPI confirmed
Varian gateway Kimi K2.7 berkecepatan tinggi untuk pengkodean latensi rendah dan tugas agen.
2026-06-12
✓ On ChinaAPI confirmed
Model gerbang Kimi yang berfokus pada pengkodean untuk pekerjaan repositori jangka panjang dengan dukungan visi.
2026-06-12
✓ On ChinaAPI confirmed
Pengenalan suara MiMo untuk peralihan kode bahasa Tionghoa-Inggris, dialek Kanton, Wu, Minnan dan Sichuan, rekaman bising dan jarak jauh, pembicara yang tumpang tindih, dan lirik.
2026-06-02
✓ On ChinaAPI confirmed
Model gerbang Qwen multimodal untuk analisis visual, perencanaan, file, dan penggunaan alat.
2026-06-01
✓ On ChinaAPI confirmed
Model M-series multimodal asli dengan 1M konteks, perhatian MSA, pengkodean, agen, dukungan input gambar, dan video.
2026-06-01
✓ On ChinaAPI confirmed

Model gateway StepFun cepat dengan 256K konteks, input visual, penalaran, dan penggunaan alat.
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video Sumber · arxiv.org
Rilis teknis video avatar berbasis audio yang berfokus pada sinkronisasi bibir, konsistensi identitas, dan pembuatan video berdurasi panjang.
2026-05-26
Not on ChinaAPI confirmed
Model gateway Qwen unggulan untuk alur kerja agen analisis, pengkodean, dan produksi yang menuntut.
2026-05-21
✓ On ChinaAPI confirmed

Konverter gambar ke video Wan 2.7 dengan kontrol bingkai pertama/terakhir, kelanjutan, audio penggerak, dan output 720P / 1080P .
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
Varian DeepSeek V4 yang cepat untuk obrolan yang efisien, bantuan pengkodean, dan perulangan agen.
2026-04-24
Not on ChinaAPI confirmed
MiMo adalah teknologi text-to-speech ekspresif dengan suara bawaan premium dan kontrol bahasa alami atas kecepatan, emosi, nada, dialek, dan performa karakter.
2026-04-23
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
Model dasar pengkodean multimodal 200K-context untuk alur kerja berbasis gambar, video, file, agen GUI, dan alat.
2026-04-07
Not on ChinaAPI confirmed
Wan 2.7 model pengeditan video bahasa alami untuk pengeditan lokal/global dan penggantian elemen.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Model teks-ke-video Wan 2.7 untuk pembuatan video berbasis perintah.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Model referensi-ke-video Wan 2.7 untuk pembangkitan terkontrol dari referensi visual.
2026-04-03
✓ On ChinaAPI confirmed
Model gambar Wan 2.7 untuk konversi teks ke gambar, pengeditan, pembuatan multi-referensi, dan rendering teks yang lebih kuat.
2026-04-01
✓ On ChinaAPI confirmed

Alibaba Qwen3.5
Rilis Qwen agen multimodal asli yang mendahului model gateway Qwen 3.6 dan 3.7 yang digunakan.
2026-02-16
Not on ChinaAPI confirmed
Kling generasi 3.0 dengan kemampuan konversi teks ke video, gambar ke video, audio, dan output resolusi 720p hingga 4K .
2026-02-05
✓ On ChinaAPI confirmed
StepFun Step-3.5-Flash
Buka model flash StepFun dengan konteks 256K dan dukungan penggunaan alat. ChinaAPI menyediakan step-3.5-flash untuk panggilan pelanggan; periksa katalog langsung untuk harga terbaru.
2026-02-01
✓ On ChinaAPI confirmed

Model citra Seedream 5.0-lite dengan pembuatan, pengambilan, dan konsistensi subjek yang lebih kuat dan dapat dikontrol.
2026-01-28
✓ On ChinaAPI confirmed
MiniMax merilis Speech 2.8 dengan tag suara asli, kloning suara yang lebih baik, audio berkualitas studio, dan ucapan lintas bahasa; Turbo adalah opsi yang berfokus pada kecepatan.
2026-01-23
✓ On ChinaAPI confirmed
MiniMax merilis Speech 2.8 dengan tag suara asli, kloning suara yang lebih baik, audio berkualitas studio, dan ucapan lintas bahasa; HD adalah opsi fidelitas tingginya.
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
Model agen Kimi multimodal asli terbuka dengan 256K konteks dan pelatihan bahasa-visi.
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio Sumber · docs.z.ai
Z.AI merilis model ASR multibahasa dengan dukungan kamus khusus yang lebih baik dan pengenalan terminologi khusus.
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
Model pembangkitan gambar kecil yang berfokus pada kualitas data daripada ukuran model.
2025-12
Not on ChinaAPI confirmed

Alibaba merilis Qwen3-TTS-Flash untuk sintesis suara offline dengan suara ekspresif, keluaran multibahasa dan dialek, serta akses API dengan latensi rendah.
2025-09-22
✓ On ChinaAPI confirmed

Konversi teks ke ucapan yang peka konteks dengan arahan bahasa alami global dan langsung, penyampaian ekspresif, dan /v1/audio/speech OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
Sintesis suara multibahasa yang hemat biaya dengan suara resmi dan suara tiruan, pemetaan pengucapan, dan kontrol gaya.
Release date not publicly confirmed
Not on ChinaAPI unknown
Sintesis ucapan ekspresif dengan suara resmi dan suara tiruan, pemetaan pengucapan, kontrol gaya, dan keluaran OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Sintesis ucapan ekspresif yang peka konteks dengan output streaming dan kontrol untuk suara, kecepatan, dan volume.
Release date not publicly confirmed
✓ On ChinaAPI unknown