Investigación y comparación basadas en tareas

Seleccione un modelo de IA chino según la restricción que le interese.

Empieza por programación, contexto, medición de latencia, video o relación calidad-precio. Cada ruta separa los datos actuales del modelo de la decisión que todavía necesitas probar. Los precios Standard de los modelos de token siguen el 100% de los precios de lista internacionales de los proveedores; algunos modelos tienen un precio Paid distinto tras la primera recarga. Las filas de medios muestran tarifas de servicio transparentes en USD; cualquier margen de servicio ya está incluido en la tarifa mostrada.

Este es un centro de decisiones, no una clasificación de popularidad o calidad. Publicamos únicamente información actualizada del catálogo: ventana de contexto, precio en USD, modalidad y capacidades declaradas. Para consultar comparativas de calidad independientes, consulte Artificial Analysis.

33Token-billed LLMs with current context, price, and capability facts.
18LLMs with 1M context windows in the current model data.
21Image and video generation models listed separately with media billing.

Comencemos con la decisión

Cinco rutas, un estándar de evidencia.

Las tarjetas de ruta indican la información disponible, cuándo es útil y dónde finaliza. Estas tarjetas conducen a los datos relevantes del modelo y a una única ruta de registro con etiquetas UTM.

Codificación y agentes

Comience con modelos cuyas descripciones o capacidades actuales mencionen explícitamente codificación, herramientas, agentes, ingeniería, planificación o trabajo estructurado.

  • Úselo cuando: Utilice esta ruta cuando el cuello de botella sea el uso de herramientas, la generación de código o un bucle de agente.
  • Límite: Las etiquetas de capacidad describen la idoneidad declarada; no son una puntuación medida de la calidad de la codificación.
Abra esta ruta de decisión

Contexto largo

Utilice el campo de ventana de contexto actual para reducir el número de candidatos antes de evaluar la calidad de la recuperación, la estructura de la solicitud y el coste total del token.

  • Úselo cuando: Utilice esta ruta para repositorios grandes, documentos extensos y trabajos de conocimiento que consten de varios pasos.
  • Límite: Una ventana de contexto más grande no demuestra una mejor capacidad de recuerdo, razonamiento o latencia.
Abra esta ruta de decisión

Baja latencia

ChinaAPI aún no publica una clasificación de latencia entre regiones. Esta ruta le ofrece una forma reproducible de medir su propio mensaje, región y modo de transmisión.

  • Úselo cuando: Utilice esta ruta cuando el tiempo de interacción o el tiempo del primer token sea un límite de liberación.
  • Límite: No deduzca la latencia a partir del precio indicado, el contexto o una solicitud individual.
Abra esta ruta de decisión

Generación de vídeo

Compare las modalidades de vídeo actuales, las capacidades y los precios de servicio transparentes por unidad en USD antes de probar su propio intervalo y duración.

  • Úselo cuando: Utilice esta ruta para los requisitos de historia, movimiento, imagen de referencia y audio.
  • Límite: El catálogo no es una clasificación basada en la calidad visual ni en el éxito de las tareas.
Abra esta ruta de decisión

Valor

Utilice el precio de entrada indicado como filtro de costes y, a continuación, pruebe el coste del resultado aceptado teniendo en cuenta su carga de trabajo, los reintentos, la longitud de la salida y las restricciones operativas.

  • Úselo cuando: Utilice esta opción cuando el presupuesto sea una limitación importante y le resulte útil comparar precios directamente.
  • Límite: El precio de entrada más bajo que aparece en la lista no constituye una garantía de calidad, latencia ni coste total.
Abra esta ruta de decisión

Modelar hechos por tarea

Selecciona los candidatos basándote en datos objetivos y, a continuación, valida tu carga de trabajo.

Los modelos pueden aparecer en más de un grupo. Dentro de estas tablas compactas, las filas se ordenan primero por ventana de contexto más grande y luego por precio de entrada listado más bajo.

Codificación y agentes

LLMs cuyas descripciones o capacidades hacen referencia a codificación, agentes, herramientas, ingeniería, planificación o trabajo de oficina. Esto es evidencia de catálogo, no una clasificación de calidad medida.

ModeloProveedorContextoEntrada $/ 1M
mimo-v2.5Xiaomi1M$0.14
glm-5.3-flashZhipu AI1M$0.15
qwen3.8-flashAlibaba1M$0.15
deepseek-flashDeepSeek1M$0.3
LongCat-2.0Meituan1M$0.3
mimo-v2.5-proXiaomi1M$0.435
hy4-previewTencent1M$0.8889
MiniMax-M3MiniMax1M$0.9
qwen3.6-flashAlibaba1M$1
step-5-previewStepFun1M$1
qwen3.7-plusAlibaba1M$1.2
deepseek-v4-proDeepSeek1M$1.32
glm-5.2Zhipu AI1M$1.4
glm-5.3Zhipu AI1M$1.4
qwen3.6-plusAlibaba1M$2
qwen3.8-maxAlibaba1M$2
qwen3.7-maxAlibaba1M$2.5
kimi-k3Moonshot1M$3
step-3.5-flashStepFun256K$0.1
step-3.5-flash-2603StepFun256K$0.1
hy3Tencent256K$0.1481
step-3.7-flashStepFun256K$0.2
doubao-seed-2-1-turbo-260628ByteDance256K$0.4444
doubao-seed-2-1-pro-260628ByteDance256K$0.8889
kimi-k2.6Moonshot256K$0.95
kimi-k2.7-codeMoonshot256K$0.95
kimi-k2.7-code-highspeedMoonshot256K$1.9
MiniMax-M2.7MiniMax200K$0.3
MiniMax-M2.7-highspeedMiniMax200K$0.6
glm-5Zhipu AI200K$1
glm-5-turboZhipu AI200K$1.2
glm-5.1Zhipu AI200K$1.4
stepaudio-2.5-chatStepFun$1.5

Ideal para razonar

LLMs etiquetado con Razonamiento en la fuente de datos actual.

ModeloProveedorContextoEntrada $/ 1M
mimo-v2.5Xiaomi1M$0.14
glm-5.3-flashZhipu AI1M$0.15
qwen3.8-flashAlibaba1M$0.15
deepseek-flashDeepSeek1M$0.3
LongCat-2.0Meituan1M$0.3
mimo-v2.5-proXiaomi1M$0.435
hy4-previewTencent1M$0.8889
MiniMax-M3MiniMax1M$0.9
qwen3.6-flashAlibaba1M$1
step-5-previewStepFun1M$1
qwen3.7-plusAlibaba1M$1.2
deepseek-v4-proDeepSeek1M$1.32
glm-5.2Zhipu AI1M$1.4
glm-5.3Zhipu AI1M$1.4
qwen3.6-plusAlibaba1M$2
qwen3.8-maxAlibaba1M$2
qwen3.7-maxAlibaba1M$2.5
kimi-k3Moonshot1M$3
step-3.5-flashStepFun256K$0.1
step-3.5-flash-2603StepFun256K$0.1
hy3Tencent256K$0.1481
step-3.7-flashStepFun256K$0.2
doubao-seed-2-1-turbo-260628ByteDance256K$0.4444
doubao-seed-2-1-pro-260628ByteDance256K$0.8889
kimi-k2.6Moonshot256K$0.95
kimi-k2.7-codeMoonshot256K$0.95
kimi-k2.7-code-highspeedMoonshot256K$1.9
MiniMax-M2.7MiniMax200K$0.3
MiniMax-M2.7-highspeedMiniMax200K$0.6
glm-5Zhipu AI200K$1
glm-5-turboZhipu AI200K$1.2
glm-5.1Zhipu AI200K$1.4
stepaudio-2.5-chatStepFun$1.5

Contexto largo

Todos LLMs con una 1M ventana de contexto, ordenados por precio de entrada listado más bajo.

ModeloProveedorContextoEntrada $/ 1M
mimo-v2.5Xiaomi1M$0.14
glm-5.3-flashZhipu AI1M$0.15
qwen3.8-flashAlibaba1M$0.15
deepseek-flashDeepSeek1M$0.3
LongCat-2.0Meituan1M$0.3
mimo-v2.5-proXiaomi1M$0.435
hy4-previewTencent1M$0.8889
MiniMax-M3MiniMax1M$0.9
qwen3.6-flashAlibaba1M$1
step-5-previewStepFun1M$1
qwen3.7-plusAlibaba1M$1.2
deepseek-v4-proDeepSeek1M$1.32
glm-5.2Zhipu AI1M$1.4
glm-5.3Zhipu AI1M$1.4
qwen3.6-plusAlibaba1M$2
qwen3.8-maxAlibaba1M$2
qwen3.7-maxAlibaba1M$2.5
kimi-k3Moonshot1M$3

Multimodal

LLMs con visión=verdaderaLos modelos que solo contienen texto no están incluidos en este grupo.

ModeloProveedorContextoEntrada $/ 1M
mimo-v2.5Xiaomi1M$0.14
glm-5.3-flashZhipu AI1M$0.15
qwen3.8-flashAlibaba1M$0.15
deepseek-flashDeepSeek1M$0.3
mimo-v2.5-proXiaomi1M$0.435
MiniMax-M3MiniMax1M$0.9
qwen3.6-flashAlibaba1M$1
step-5-previewStepFun1M$1
qwen3.7-plusAlibaba1M$1.2
qwen3.6-plusAlibaba1M$2
qwen3.8-maxAlibaba1M$2
kimi-k3Moonshot1M$3
step-3.7-flashStepFun256K$0.2
doubao-seed-2-1-turbo-260628ByteDance256K$0.4444
doubao-seed-2-1-pro-260628ByteDance256K$0.8889
kimi-k2.6Moonshot256K$0.95
kimi-k2.7-codeMoonshot256K$0.95
kimi-k2.7-code-highspeedMoonshot256K$1.9

Desde la preselección hasta la implementación

Elige un modelo, verifica su ruta de configuración y, a continuación, regístralo.

Las fichas de modelos reducen el catálogo; las guías de integración proporcionan el siguiente paso de configuración. Los enlaces a las guías solo se muestran para herramientas con un registro de verificación fechado, por lo que una etiqueta de capacidad del catálogo nunca se presenta como una garantía de compatibilidad.

Continúa con una guía de configuración verificada.

Abre la guía de herramientas que mejor se adapte a tu flujo de trabajo y, a continuación, realiza una pequeña prueba antes de enrutar el tráfico de producción.

Validación de baja latencia

Mide el flujo de trabajo que realmente vas a enviar.

No publicamos una clasificación de latencia entre regiones porque el catálogo actual no contiene un conjunto de datos de latencia multirregional reproducible. Mantenga fijos el modelo, el parámetro de solicitud, la forma de la solicitud, la región, la concurrencia y el modo de transmisión durante las pruebas.

Una comprobación de latencia repetible

Registra el tiempo hasta el primer token y el tiempo total de finalización en varias ejecuciones. Compara solo las ejecuciones con el mismo mensaje y límite de salida, y guarda las mediciones sin procesar junto con la fecha y la región de la prueba.

Límite: Una sola solicitud, una especificación del proveedor o un precio publicado no pueden respaldar una afirmación sobre la latencia. Hasta que una sonda documentada publique el tamaño de la muestra y la región, este centro no etiquetará ningún modelo como la opción de menor latencia.

Ventana de contexto más larga

LLMs ordenados por contexto.

Ordenado por ventana de contexto descendente, luego se muestra el precio de entrada ascendente. El precio de salida se muestra para los modelos facturados con tokens.

RangoModeloProveedorContextoEntrada $/ 1MSalida $/ 1M
1mimo-v2.5Xiaomi1M$0.14$0.28
2glm-5.3-flashZhipu AI1M$0.15$0.5
3qwen3.8-flashAlibaba1M$0.15$0.47
4deepseek-flashDeepSeek1M$0.3$1.2
5LongCat-2.0Meituan1M$0.3$1.2
6mimo-v2.5-proXiaomi1M$0.435$0.87
7hy4-previewTencent1M$0.8889$2.6667
8MiniMax-M3MiniMax1M$0.9$3.6
9qwen3.6-flashAlibaba1M$1$4
10step-5-previewStepFun1M$1$2.7
11qwen3.7-plusAlibaba1M$1.2$4.8
12deepseek-v4-proDeepSeek1M$1.32$3.96
13glm-5.2Zhipu AI1M$1.4$4.4
14glm-5.3Zhipu AI1M$1.4$4.4
15qwen3.6-plusAlibaba1M$2$6
16qwen3.8-maxAlibaba1M$2$6
17qwen3.7-maxAlibaba1M$2.5$7.5
18kimi-k3Moonshot1M$3$15
19step-3.5-flashStepFun256K$0.1$0.3
20step-3.5-flash-2603StepFun256K$0.1$0.3
21hy3Tencent256K$0.1481$0.5926
22step-3.7-flashStepFun256K$0.2$1.15
23doubao-seed-2-1-turbo-260628ByteDance256K$0.4444$2.2222
24doubao-seed-2-1-pro-260628ByteDance256K$0.8889$4.4444
25kimi-k2.6Moonshot256K$0.95$4
26kimi-k2.7-codeMoonshot256K$0.95$4
27kimi-k2.7-code-highspeedMoonshot256K$1.9$8
28MiniMax-M2.7MiniMax200K$0.3$1.2
29MiniMax-M2.7-highspeedMiniMax200K$0.6$2.4
30glm-5Zhipu AI200K$1$3.2
31glm-5-turboZhipu AI200K$1.2$4
32glm-5.1Zhipu AI200K$1.4$4.4
33stepaudio-2.5-chatStepFun$1.5$3.5

Filtro de valor

LLMs ordenado por precio de entrada indicado.

Ordenado por USD de entrada listado por 1M de tokens, de forma ascendente. Utilice esto como filtro de costo, no como clasificación de calidad, latencia o costo de resultados aceptados.

RangoModeloProveedorContextoEntrada $/ 1MSalida $/ 1M
1step-3.5-flashStepFun256K$0.1$0.3
2step-3.5-flash-2603StepFun256K$0.1$0.3
3mimo-v2.5Xiaomi1M$0.14$0.28
4hy3Tencent256K$0.1481$0.5926
5glm-5.3-flashZhipu AI1M$0.15$0.5
6qwen3.8-flashAlibaba1M$0.15$0.47
7step-3.7-flashStepFun256K$0.2$1.15
8deepseek-flashDeepSeek1M$0.3$1.2
9LongCat-2.0Meituan1M$0.3$1.2
10MiniMax-M2.7MiniMax200K$0.3$1.2
11mimo-v2.5-proXiaomi1M$0.435$0.87
12doubao-seed-2-1-turbo-260628ByteDance256K$0.4444$2.2222
13MiniMax-M2.7-highspeedMiniMax200K$0.6$2.4
14hy4-previewTencent1M$0.8889$2.6667
15doubao-seed-2-1-pro-260628ByteDance256K$0.8889$4.4444
16MiniMax-M3MiniMax1M$0.9$3.6
17kimi-k2.6Moonshot256K$0.95$4
18kimi-k2.7-codeMoonshot256K$0.95$4
19qwen3.6-flashAlibaba1M$1$4
20step-5-previewStepFun1M$1$2.7
21glm-5Zhipu AI200K$1$3.2
22qwen3.7-plusAlibaba1M$1.2$4.8
23glm-5-turboZhipu AI200K$1.2$4
24deepseek-v4-proDeepSeek1M$1.32$3.96
25glm-5.2Zhipu AI1M$1.4$4.4
26glm-5.3Zhipu AI1M$1.4$4.4
27glm-5.1Zhipu AI200K$1.4$4.4
28stepaudio-2.5-chatStepFun$1.5$3.5
29kimi-k2.7-code-highspeedMoonshot256K$1.9$8
30qwen3.6-plusAlibaba1M$2$6
31qwen3.8-maxAlibaba1M$2$6
32qwen3.7-maxAlibaba1M$2.5$7.5
33kimi-k3Moonshot1M$3$15

Modelos de generación de vídeo

Kling, Seedance, Hailuo, Wan y HappyHorse.

Los modelos de vídeo no tienen ventanas de LLM en la fuente de datos. Se facturan en USD por la unidad que se muestra a continuación. Pruebe la solicitud, la duración, la resolución, las necesidades de control de referencia y el modo de fallo antes de elegir una ruta de producción.

ModeloProveedorCapacidadesFacturación
kling-3.0-turboKuaishouVídeo, texto a vídeo, imagen a vídeo, audio, rápido$0.5556 por generación
MiniMax-H3MiniMaxVídeo, texto a vídeo, imagen a vídeo, referencia a vídeo, audio, pesos abiertos$0.08 por segundo
doubao-seedance-2-5-260628ByteDanceVídeo, texto a vídeo, imagen a vídeoPor generación
MiniMax-Hailuo-2.3MiniMaxVídeo, texto a vídeo, imagen a vídeo$0.2778 por generación
doubao-seedance-2-0-mini-260615ByteDanceVídeo, texto a vídeo, rápidoPor generación
kling-v3KuaishouVídeo, texto a vídeo, imagen a vídeo, audio$0.4799 por generación silenciosa de 5-second a 720
kling-v3-omniKuaishouVídeo, Referencia a vídeo, Edición$0.4167 por generación
MiniMax-Hailuo-02MiniMaxVídeo, texto a vídeo, imagen a vídeo$0.2778 por generación
doubao-seedance-2-0-260128ByteDanceVídeo, texto a vídeo, imagen a vídeoPor generación
MiniMax-Hailuo-2.3-FastMiniMaxVídeo, Imagen a vídeo, Rápido$0.1875 por generación
doubao-seedance-2-0-fast-260128ByteDanceVídeo, texto a vídeo, imagen a vídeo, rápidoPor generación
happyhorse-1.1-t2vAlibabaVídeo, texto a vídeo$0.075 por segundo
happyhorse-1.1-r2vAlibabaVídeo, Referencia a vídeo$0.075 por segundo
happyhorse-1.1-i2vAlibabaVídeo, Imagen a vídeo$0.075 por segundo
wan2.7-t2vAlibabaVídeo, texto a vídeo$0.1 por segundo
wan2.7-r2vAlibabaVídeo, Referencia a vídeo$0.35 por segundo
wan2.7-videoeditAlibabaVídeo, Edición de vídeo$0.2 por segundo
wan2.7-i2vAlibabaVídeo, Imagen a vídeo, Audio$0.1 por segundo

Modelos de generación de imágenes

Modelos de imágenes de Seedream y Wan.

Los modelos de imagen no tienen ventanas de LLM en la fuente de datos. Se facturan por imagen en USD.

ModeloProveedorCapacidadesFacturación
doubao-seedream-5-0-260128ByteDanceImagen, texto a imagen, imagen a imagen, 4K$0.0306 por imagen
wan2.7-imageAlibabaImagen, texto a imagen, edición de imágenes, multirreferencia$0.0278 por imagen
wan2.7-image-proAlibabaImagen, texto a imagen, edición de imágenes, multirreferencia, 4K$0.0694 por imagen

¿Cómo debo elegir un modelo de IA chino?

Comience con la ruta que coincida con su restricción, luego pruebe los candidatos con sus indicaciones y criterios de aceptación. Este centro publica información actualizada del catálogo, no una clasificación de calidad universal. Para obtener puntos de referencia de calidad independientes, utilice una fuente de terceros como Artificial Analysis.

¿Qué modelos tienen el contexto más extenso?

Los LLMs con contexto de 1M en los datos actuales son mimo-v2.5, glm-5.3-flash, qwen3.8-flash, deepseek-flash, LongCat-2.0, mimo-v2.5-pro, hy4-preview, MiniMax-M3, qwen3.6-flash, step-5-preview, qwen3.7-plus, deepseek-v4-pro, glm-5.2, glm-5.3, qwen3.6-plus, qwen3.8-max, qwen3.7-max, kimi-k3.

¿Qué modelos son los más baratos?

Entre los LLMs facturados por token, step-3.5-flash y step-3.5-flash-2603 comparten el precio de entrada más bajo listado, a $0.1 por 1M tokens de entrada. El siguiente precio de entrada listado es mimo-v2.5 a $0.14 por 1M tokens de entrada.

¿Qué modelo tiene la menor latencia?

ChinaAPI no publica una clasificación de latencia entre regiones. Mida la latencia con la misma solicitud, región, concurrencia y modo de transmisión antes de tomar una decisión en producción.

Comienza a realizar pruebas.

Utilice las rutas de decisión como una lista reducida y, a continuación, pruebe su propia carga de trabajo.

Los datos del catálogo reducen las opciones. La elección final del modelo debe basarse en las indicaciones, los datos, los requisitos de latencia, los criterios de aceptación y el coste total por resultado aceptado.

Prueba ChinaAPI

Comience con crédito gratuito o revise los precios en tiempo real antes de enrutar el tráfico de producción.