Comparaison guidée par la tâche
Choisissez un modèle IA chinois selon la contrainte qui compte.
Déterminez d’abord ce qui ferait échouer la tâche : code, contexte, latence, vidéo ou budget. Cette page présente des faits de catalogue, pas un classement général de qualité ou de popularité.
Nous publions le contexte, la modalité, les capacités déclarées et les tarifs actuels. Pour la production, testez les candidats avec les mêmes prompts et critères d’acceptation.
Commencez par la décision
Cinq parcours, un standard de preuve.
Chaque parcours distingue les faits connus, le bon cas d’usage et ce qui doit encore être testé.
Code et agents
À utiliser lorsque: Lorsque les appels d’outils, la génération de code ou une boucle d’agent sont le goulot d’étranglement.
Limite: Les tags décrivent une adéquation déclarée, pas une mesure de qualité de code.
Contexte long
À utiliser lorsque: Pour de grands dépôts, de longs documents et du travail de connaissance en plusieurs étapes.
Limite: La fenêtre de contexte ne prouve ni récupération, ni raisonnement, ni latence.
Faible latence
À utiliser lorsque: Lorsque le temps de réponse ou le premier token est une condition de livraison.
Limite: N’inférez pas la latence depuis le prix ou une requête isolée.
Vidéo
À utiliser lorsque: Pour les récits, le mouvement, les images de référence ou l’audio.
Limite: Le catalogue n’est pas un classement de qualité visuelle ou de succès.
Coût
À utiliser lorsque: Lorsque le budget est une contrainte forte et qu’une comparaison de prix aide.
Limite: Le tarif d’entrée le plus bas ne prouve ni qualité ni coût total.
Données actuelles par tâche
Établissez une liste courte, puis validez votre workload.
L’ordre des tableaux vient des données actuelles des modèles ; ce n’est pas une position de benchmark.
Contexte long
Les LLM à contexte 1M sont affichés par prix d’entrée croissant. Un grand contexte ne garantit ni récupération, ni raisonnement, ni latence.
| Modèle | Fournisseur | Contexte | Entrée $/1M tokens |
|---|---|---|---|
| deepseek-v4-flash | DeepSeek | 1M | $0.14 |
| mimo-v2.5 | Xiaomi | 1M | $0.14 |
| qwen3.6-flash | Alibaba | 1M | $0.1846 |
| MiniMax-M3 | MiniMax | 1M | $0.2877 |
| LongCat-2.0 | Meituan | 1M | $0.3 |
| qwen3.7-plus | Alibaba | 1M | $0.3077 |
| deepseek-v4-pro | DeepSeek | 1M | $0.435 |
| mimo-v2.5-pro | Xiaomi | 1M | $0.435 |
| qwen3.6-plus | Alibaba | 1M | $0.5 |
| glm-5.2 | Zhipu AI | 1M | $1.4 |
| qwen3.8-max | Alibaba | 1M | $1.99 |
| qwen3.7-max | Alibaba | 1M | $2.5 |
| kimi-k3 | Moonshot | 1M | $2.7397 |
Filtre par prix d’entrée
Trié par tarif USD affiché pour 1M tokens d’entrée. Le plus bas prix ne prouve ni qualité, ni latence, ni coût par résultat accepté.
| Modèle | Fournisseur | Contexte | Entrée $/1M tokens | Sortie $/1M tokens |
|---|---|---|---|---|
| step-3.5-flash | StepFun | 256K | $0.1 | $0.3 |
| step-3.5-flash-2603 | StepFun | 256K | $0.1 | $0.3 |
| deepseek-v4-flash | DeepSeek | 1M | $0.14 | $0.28 |
| mimo-v2.5 | Xiaomi | 1M | $0.14 | $0.28 |
| hy3 | Tencent | 256K | $0.1538 | $0.6154 |
| qwen3.6-flash | Alibaba | 1M | $0.1846 | $1.1077 |
| step-3.7-flash | StepFun | 256K | $0.2 | $1.15 |
| MiniMax-M2.7 | MiniMax | 200K | $0.2877 | $1.1507 |
| MiniMax-M3 | MiniMax | 1M | $0.2877 | $1.1507 |
| LongCat-2.0 | Meituan | 1M | $0.3 | $1.2 |
| qwen3.7-plus | Alibaba | 1M | $0.3077 | $1.2308 |
| step-1o-turbo-vision | StepFun | 32K | $0.4 | $1.28 |
| deepseek-v4-pro | DeepSeek | 1M | $0.435 | $0.87 |
| mimo-v2.5-pro | Xiaomi | 1M | $0.435 | $0.87 |
| doubao-seed-2-1-turbo-260628 | ByteDance | 256K | $0.4615 | $2.3077 |
| qwen3.6-plus | Alibaba | 1M | $0.5 | $3 |
| MiniMax-M2.7-highspeed | MiniMax | 200K | $0.5753 | $2.3014 |
| doubao-seed-2-1-pro-260628 | ByteDance | 256K | $0.9231 | $4.6154 |
| kimi-k2.6 | Moonshot | 256K | $0.95 | $3.9462 |
| kimi-k2.7-code | Moonshot | 256K | $0.95 | $3.9462 |
| glm-5 | Zhipu AI | 200K | $1 | $3.6667 |
| glm-5-turbo | Zhipu AI | 200K | $1.2 | $4.4571 |
| glm-5.1 | Zhipu AI | 200K | $1.4 | $4.4 |
| glm-5.2 | Zhipu AI | 1M | $1.4 | $4.4 |
| stepaudio-2.5-chat | StepFun | $1.5 | $3.5 | |
| kimi-k2.7-code-highspeed | Moonshot | 256K | $1.7808 | $7.3973 |
| qwen3.8-max | Alibaba | 1M | $1.99 | $5.97 |
| qwen3.7-max | Alibaba | 1M | $2.5 | $7.5 |
| kimi-k3 | Moonshot | 1M | $2.7397 | $13.6986 |
| step-1o-audio | StepFun | $3.85 | $9.24 |
Modèles de génération vidéo
La vidéo est facturée selon la durée, la résolution ou l’unité affichée, pas selon le contexte. Testez prompt, durée et besoins de référence.
| Modèle | Fournisseur | Capacités | Unité de facturation |
|---|---|---|---|
| doubao-seedance-2-0-260128 | ByteDance | Video, Text-to-Video, Image-to-Video | generation |
| doubao-seedance-2-0-fast-260128 | ByteDance | Video, Text-to-Video, Image-to-Video, Fast | generation |
| doubao-seedance-2-0-mini-260615 | ByteDance | Video, Text-to-Video, Fast | generation |
| doubao-seedance-2-5-260628 | ByteDance | Video, Text-to-Video, Image-to-Video | generation |
| happyhorse-1.1-i2v | Alibaba | Video, Image-to-Video | $0.075 / second |
| happyhorse-1.1-r2v | Alibaba | Video, Reference-to-Video | $0.075 / second |
| happyhorse-1.1-t2v | Alibaba | Video, Text-to-Video | $0.075 / second |
| kling-3.0-turbo | Kuaishou | Video, Text-to-Video, Image-to-Video, Audio, Fast | $0.5556 / generation |
| kling-v3 | Kuaishou | Video, Text-to-Video, Image-to-Video, Audio | $0.4799 / 5-second 720p silent generation |
| kling-v3-omni | Kuaishou | Video, Reference-to-Video, Editing | $0.4167 / generation |
| MiniMax-H3 | MiniMax | Video, Text-to-Video, Image-to-Video, Reference-to-Video, Audio, Open Weights | $0.08 / second |
| MiniMax-Hailuo-02 | MiniMax | Video, Text-to-Video, Image-to-Video | $0.2778 / generation |
| MiniMax-Hailuo-2.3 | MiniMax | Video, Text-to-Video, Image-to-Video | $0.2778 / generation |
| MiniMax-Hailuo-2.3-Fast | MiniMax | Video, Image-to-Video, Fast | $0.1875 / generation |
| wan2.7-i2v | Alibaba | Video, Image-to-Video, Audio | $0.1 / second |
| wan2.7-r2v | Alibaba | Video, Reference-to-Video | $0.35 / second |
| wan2.7-t2v | Alibaba | Video, Text-to-Video | $0.1 / second |
| wan2.7-videoedit | Alibaba | Video, Video-Edit | $0.2 / second |
Comment choisir un modèle IA chinois ?
Définissez la contrainte critique, puis testez uniquement les modèles capables de lire vos entrées avec les mêmes prompts et critères d’acceptation.
Quels modèles ont le plus long contexte ?
Cette page liste les candidats actuels à contexte 1M avec leurs prix et capacités. Validez la récupération et la synthèse sur vos propres documents.
Quel modèle a la plus faible latence ?
ChinaAPI ne publie pas de classement de latence interrégional. Mesurez la même région, la concurrence, le streaming et le même prompt.
Commencer le test
Voir le catalogue des modèles
Nous publions le contexte, la modalité, les capacités déclarées et les tarifs actuels. Pour la production, testez les candidats avec les mêmes prompts et critères d’acceptation.
