Comparaison guidée par la tâche

Choisissez un modèle IA chinois selon la contrainte qui compte.

Déterminez d’abord ce qui ferait échouer la tâche : code, contexte, latence, vidéo ou budget. Cette page présente des faits de catalogue, pas un classement général de qualité ou de popularité.

Nous publions le contexte, la modalité, les capacités déclarées et les tarifs actuels. Pour la production, testez les candidats avec les mêmes prompts et critères d’acceptation.

33LLM facturés au token avec contexte, prix et capacités actuels
18LLM avec une fenêtre de contexte de 1M dans le catalogue actuel
21modèles de génération d’images et de vidéo facturés comme médias

Commencez par la décision

Cinq parcours, un standard de preuve.

Chaque parcours distingue les faits connus, le bon cas d’usage et ce qui doit encore être testé.

Code et agents

À utiliser lorsque: Lorsque les appels d’outils, la génération de code ou une boucle d’agent sont le goulot d’étranglement.

Limite: Les tags décrivent une adéquation déclarée, pas une mesure de qualité de code.

Contexte long

À utiliser lorsque: Pour de grands dépôts, de longs documents et du travail de connaissance en plusieurs étapes.

Limite: La fenêtre de contexte ne prouve ni récupération, ni raisonnement, ni latence.

Faible latence

À utiliser lorsque: Lorsque le temps de réponse ou le premier token est une condition de livraison.

Limite: N’inférez pas la latence depuis le prix ou une requête isolée.

Vidéo

À utiliser lorsque: Pour les récits, le mouvement, les images de référence ou l’audio.

Limite: Le catalogue n’est pas un classement de qualité visuelle ou de succès.

Coût

À utiliser lorsque: Lorsque le budget est une contrainte forte et qu’une comparaison de prix aide.

Limite: Le tarif d’entrée le plus bas ne prouve ni qualité ni coût total.

Données actuelles par tâche

Établissez une liste courte, puis validez votre workload.

L’ordre des tableaux vient des données actuelles des modèles ; ce n’est pas une position de benchmark.

Contexte long

Les LLM à contexte 1M sont affichés par prix d’entrée croissant. Un grand contexte ne garantit ni récupération, ni raisonnement, ni latence.

ModèleFournisseurContexteEntrée $/1M tokens
mimo-v2.5Xiaomi1M$0.14
qwen3.8-flashAlibaba1M$0.15
glm-5.3-flashZhipu AI1M$0.15
deepseek-flashDeepSeek1M$0.3
LongCat-2.0Meituan1M$0.3
mimo-v2.5-proXiaomi1M$0.435
hy4-previewTencent1M$0.8889
MiniMax-M3MiniMax1M$0.9
step-5-previewStepFun1M$1
qwen3.6-flashAlibaba1M$1
qwen3.7-plusAlibaba1M$1.2
deepseek-v4-proDeepSeek1M$1.32
glm-5.2Zhipu AI1M$1.4
glm-5.3Zhipu AI1M$1.4
qwen3.6-plusAlibaba1M$2
qwen3.8-maxAlibaba1M$2
qwen3.7-maxAlibaba1M$2.5
kimi-k3Moonshot1M$3

Filtre par prix d’entrée

Trié par tarif USD affiché pour 1M tokens d’entrée. Le plus bas prix ne prouve ni qualité, ni latence, ni coût par résultat accepté.

ModèleFournisseurContexteEntrée $/1M tokensSortie $/1M tokens
step-3.5-flashStepFun256K$0.1$0.3
step-3.5-flash-2603StepFun256K$0.1$0.3
mimo-v2.5Xiaomi1M$0.14$0.28
hy3Tencent256K$0.1481$0.5926
glm-5.3-flashZhipu AI1M$0.15$0.5
qwen3.8-flashAlibaba1M$0.15$0.47
step-3.7-flashStepFun256K$0.2$1.15
deepseek-flashDeepSeek1M$0.3$1.2
LongCat-2.0Meituan1M$0.3$1.2
MiniMax-M2.7MiniMax200K$0.3$1.2
mimo-v2.5-proXiaomi1M$0.435$0.87
doubao-seed-2-1-turbo-260628ByteDance256K$0.4444$2.2222
MiniMax-M2.7-highspeedMiniMax200K$0.6$2.4
doubao-seed-2-1-pro-260628ByteDance256K$0.8889$4.4444
hy4-previewTencent1M$0.8889$2.6667
MiniMax-M3MiniMax1M$0.9$3.6
kimi-k2.6Moonshot256K$0.95$4
kimi-k2.7-codeMoonshot256K$0.95$4
glm-5Zhipu AI200K$1$3.2
qwen3.6-flashAlibaba1M$1$4
step-5-previewStepFun1M$1$2.7
glm-5-turboZhipu AI200K$1.2$4
qwen3.7-plusAlibaba1M$1.2$4.8
deepseek-v4-proDeepSeek1M$1.32$3.96
glm-5.1Zhipu AI200K$1.4$4.4
glm-5.2Zhipu AI1M$1.4$4.4
glm-5.3Zhipu AI1M$1.4$4.4
stepaudio-2.5-chatStepFun$1.5$3.5
kimi-k2.7-code-highspeedMoonshot256K$1.9$8
qwen3.6-plusAlibaba1M$2$6
qwen3.8-maxAlibaba1M$2$6
qwen3.7-maxAlibaba1M$2.5$7.5
kimi-k3Moonshot1M$3$15

Modèles de génération vidéo

La vidéo est facturée selon la durée, la résolution ou l’unité affichée, pas selon le contexte. Testez prompt, durée et besoins de référence.

ModèleFournisseurCapacitésUnité de facturation
doubao-seedance-2-0-260128ByteDanceVideo, Text-to-Video, Image-to-Videogeneration
doubao-seedance-2-0-fast-260128ByteDanceVideo, Text-to-Video, Image-to-Video, Fastgeneration
doubao-seedance-2-0-mini-260615ByteDanceVideo, Text-to-Video, Fastgeneration
doubao-seedance-2-5-260628ByteDanceVideo, Text-to-Video, Image-to-Videogeneration
happyhorse-1.1-i2vAlibabaVideo, Image-to-Video$0.075 / second
happyhorse-1.1-r2vAlibabaVideo, Reference-to-Video$0.075 / second
happyhorse-1.1-t2vAlibabaVideo, Text-to-Video$0.075 / second
kling-3.0-turboKuaishouVideo, Text-to-Video, Image-to-Video, Audio, Fast$0.5556 / generation
kling-v3KuaishouVideo, Text-to-Video, Image-to-Video, Audio$0.4799 / 5-second 720p silent generation
kling-v3-omniKuaishouVideo, Reference-to-Video, Editing$0.4167 / generation
MiniMax-H3MiniMaxVideo, Text-to-Video, Image-to-Video, Reference-to-Video, Audio, Open Weights$0.08 / second
MiniMax-Hailuo-02MiniMaxVideo, Text-to-Video, Image-to-Video$0.2778 / generation
MiniMax-Hailuo-2.3MiniMaxVideo, Text-to-Video, Image-to-Video$0.2778 / generation
MiniMax-Hailuo-2.3-FastMiniMaxVideo, Image-to-Video, Fast$0.1875 / generation
wan2.7-i2vAlibabaVideo, Image-to-Video, Audio$0.1 / second
wan2.7-r2vAlibabaVideo, Reference-to-Video$0.35 / second
wan2.7-t2vAlibabaVideo, Text-to-Video$0.1 / second
wan2.7-videoeditAlibabaVideo, Video-Edit$0.2 / second

Comment choisir un modèle IA chinois ?

Définissez la contrainte critique, puis testez uniquement les modèles capables de lire vos entrées avec les mêmes prompts et critères d’acceptation.

Quels modèles ont le plus long contexte ?

Cette page liste les candidats actuels à contexte 1M avec leurs prix et capacités. Validez la récupération et la synthèse sur vos propres documents.

Quel modèle a la plus faible latence ?

ChinaAPI ne publie pas de classement de latence interrégional. Mesurez la même région, la concurrence, le streaming et le même prompt.

Commencer le test

Voir le catalogue des modèles

Nous publions le contexte, la modalité, les capacités déclarées et les tarifs actuels. Pour la production, testez les candidats avec les mêmes prompts et critères d’acceptation.