Comparaison guidée par la tâche

Choisissez un modèle IA chinois selon la contrainte qui compte.

Déterminez d’abord ce qui ferait échouer la tâche : code, contexte, latence, vidéo ou budget. Cette page présente des faits de catalogue, pas un classement général de qualité ou de popularité.

Nous publions le contexte, la modalité, les capacités déclarées et les tarifs actuels. Pour la production, testez les candidats avec les mêmes prompts et critères d’acceptation.

30LLM facturés au token avec contexte, prix et capacités actuels
13LLM avec une fenêtre de contexte de 1M dans le catalogue actuel
24modèles de génération d’images et de vidéo facturés comme médias

Commencez par la décision

Cinq parcours, un standard de preuve.

Chaque parcours distingue les faits connus, le bon cas d’usage et ce qui doit encore être testé.

Code et agents

À utiliser lorsque: Lorsque les appels d’outils, la génération de code ou une boucle d’agent sont le goulot d’étranglement.

Limite: Les tags décrivent une adéquation déclarée, pas une mesure de qualité de code.

Contexte long

À utiliser lorsque: Pour de grands dépôts, de longs documents et du travail de connaissance en plusieurs étapes.

Limite: La fenêtre de contexte ne prouve ni récupération, ni raisonnement, ni latence.

Faible latence

À utiliser lorsque: Lorsque le temps de réponse ou le premier token est une condition de livraison.

Limite: N’inférez pas la latence depuis le prix ou une requête isolée.

Vidéo

À utiliser lorsque: Pour les récits, le mouvement, les images de référence ou l’audio.

Limite: Le catalogue n’est pas un classement de qualité visuelle ou de succès.

Coût

À utiliser lorsque: Lorsque le budget est une contrainte forte et qu’une comparaison de prix aide.

Limite: Le tarif d’entrée le plus bas ne prouve ni qualité ni coût total.

Données actuelles par tâche

Établissez une liste courte, puis validez votre workload.

L’ordre des tableaux vient des données actuelles des modèles ; ce n’est pas une position de benchmark.

Contexte long

Les LLM à contexte 1M sont affichés par prix d’entrée croissant. Un grand contexte ne garantit ni récupération, ni raisonnement, ni latence.

ModèleFournisseurContexteEntrée $/1M tokens
deepseek-v4-flashDeepSeek1M$0.14
mimo-v2.5Xiaomi1M$0.14
qwen3.6-flashAlibaba1M$0.1846
MiniMax-M3MiniMax1M$0.2877
LongCat-2.0Meituan1M$0.3
qwen3.7-plusAlibaba1M$0.3077
deepseek-v4-proDeepSeek1M$0.435
mimo-v2.5-proXiaomi1M$0.435
qwen3.6-plusAlibaba1M$0.5
glm-5.2Zhipu AI1M$1.4
qwen3.8-maxAlibaba1M$1.99
qwen3.7-maxAlibaba1M$2.5
kimi-k3Moonshot1M$2.7397

Filtre par prix d’entrée

Trié par tarif USD affiché pour 1M tokens d’entrée. Le plus bas prix ne prouve ni qualité, ni latence, ni coût par résultat accepté.

ModèleFournisseurContexteEntrée $/1M tokensSortie $/1M tokens
step-3.5-flashStepFun256K$0.1$0.3
step-3.5-flash-2603StepFun256K$0.1$0.3
deepseek-v4-flashDeepSeek1M$0.14$0.28
mimo-v2.5Xiaomi1M$0.14$0.28
hy3Tencent256K$0.1538$0.6154
qwen3.6-flashAlibaba1M$0.1846$1.1077
step-3.7-flashStepFun256K$0.2$1.15
MiniMax-M2.7MiniMax200K$0.2877$1.1507
MiniMax-M3MiniMax1M$0.2877$1.1507
LongCat-2.0Meituan1M$0.3$1.2
qwen3.7-plusAlibaba1M$0.3077$1.2308
step-1o-turbo-visionStepFun32K$0.4$1.28
deepseek-v4-proDeepSeek1M$0.435$0.87
mimo-v2.5-proXiaomi1M$0.435$0.87
doubao-seed-2-1-turbo-260628ByteDance256K$0.4615$2.3077
qwen3.6-plusAlibaba1M$0.5$3
MiniMax-M2.7-highspeedMiniMax200K$0.5753$2.3014
doubao-seed-2-1-pro-260628ByteDance256K$0.9231$4.6154
kimi-k2.6Moonshot256K$0.95$3.9462
kimi-k2.7-codeMoonshot256K$0.95$3.9462
glm-5Zhipu AI200K$1$3.6667
glm-5-turboZhipu AI200K$1.2$4.4571
glm-5.1Zhipu AI200K$1.4$4.4
glm-5.2Zhipu AI1M$1.4$4.4
stepaudio-2.5-chatStepFun$1.5$3.5
kimi-k2.7-code-highspeedMoonshot256K$1.7808$7.3973
qwen3.8-maxAlibaba1M$1.99$5.97
qwen3.7-maxAlibaba1M$2.5$7.5
kimi-k3Moonshot1M$2.7397$13.6986
step-1o-audioStepFun$3.85$9.24

Modèles de génération vidéo

La vidéo est facturée selon la durée, la résolution ou l’unité affichée, pas selon le contexte. Testez prompt, durée et besoins de référence.

ModèleFournisseurCapacitésUnité de facturation
doubao-seedance-2-0-260128ByteDanceVideo, Text-to-Video, Image-to-Videogeneration
doubao-seedance-2-0-fast-260128ByteDanceVideo, Text-to-Video, Image-to-Video, Fastgeneration
doubao-seedance-2-0-mini-260615ByteDanceVideo, Text-to-Video, Fastgeneration
doubao-seedance-2-5-260628ByteDanceVideo, Text-to-Video, Image-to-Videogeneration
happyhorse-1.1-i2vAlibabaVideo, Image-to-Video$0.075 / second
happyhorse-1.1-r2vAlibabaVideo, Reference-to-Video$0.075 / second
happyhorse-1.1-t2vAlibabaVideo, Text-to-Video$0.075 / second
kling-3.0-turboKuaishouVideo, Text-to-Video, Image-to-Video, Audio, Fast$0.5556 / generation
kling-v3KuaishouVideo, Text-to-Video, Image-to-Video, Audio$0.4799 / 5-second 720p silent generation
kling-v3-omniKuaishouVideo, Reference-to-Video, Editing$0.4167 / generation
MiniMax-H3MiniMaxVideo, Text-to-Video, Image-to-Video, Reference-to-Video, Audio, Open Weights$0.08 / second
MiniMax-Hailuo-02MiniMaxVideo, Text-to-Video, Image-to-Video$0.2778 / generation
MiniMax-Hailuo-2.3MiniMaxVideo, Text-to-Video, Image-to-Video$0.2778 / generation
MiniMax-Hailuo-2.3-FastMiniMaxVideo, Image-to-Video, Fast$0.1875 / generation
wan2.7-i2vAlibabaVideo, Image-to-Video, Audio$0.1 / second
wan2.7-r2vAlibabaVideo, Reference-to-Video$0.35 / second
wan2.7-t2vAlibabaVideo, Text-to-Video$0.1 / second
wan2.7-videoeditAlibabaVideo, Video-Edit$0.2 / second

Comment choisir un modèle IA chinois ?

Définissez la contrainte critique, puis testez uniquement les modèles capables de lire vos entrées avec les mêmes prompts et critères d’acceptation.

Quels modèles ont le plus long contexte ?

Cette page liste les candidats actuels à contexte 1M avec leurs prix et capacités. Validez la récupération et la synthèse sur vos propres documents.

Quel modèle a la plus faible latence ?

ChinaAPI ne publie pas de classement de latence interrégional. Mesurez la même région, la concurrence, le streaming et le même prompt.

Commencer le test

Voir le catalogue des modèles

Nous publions le contexte, la modalité, les capacités déclarées et les tarifs actuels. Pour la production, testez les candidats avec les mêmes prompts et critères d’acceptation.