Investigación y comparación basadas en tareas
Seleccione un modelo de IA chino según la restricción que le interese.
Comience con codificación, contexto, medición de latencia, video o valor. Cada ruta separa los datos del modelo actual de la decisión que aún necesita probar. Las tarifas de token se sincronizan desde la puerta de enlace y pueden seguir los precios de lista oficiales de China de los proveedores cuando estén configurados. Las filas de medios muestran tarifas de servicio transparentes en USD; cualquier margen de servicio está incluido en la tarifa mostrada.
Este es un centro de decisiones, no una clasificación de popularidad o calidad. Publicamos únicamente información actualizada del catálogo: ventana de contexto, precio en USD, modalidad y capacidades declaradas. Para consultar comparativas de calidad independientes, consulte Artificial Analysis.
Comencemos con la decisión
Cinco rutas, un estándar de evidencia.
Las tarjetas de ruta indican la información disponible, cuándo es útil y dónde finaliza. Estas tarjetas conducen a los datos relevantes del modelo y a una única ruta de registro con etiquetas UTM.
Codificación y agentes
Comience con modelos cuyas descripciones o capacidades actuales mencionen explícitamente codificación, herramientas, agentes, ingeniería, planificación o trabajo estructurado.
- Úselo cuando: Utilice esta ruta cuando el cuello de botella sea el uso de herramientas, la generación de código o un bucle de agente.
- Límite: Las etiquetas de capacidad describen la idoneidad declarada; no son una puntuación medida de la calidad de la codificación.
Contexto largo
Utilice el campo de ventana de contexto actual para reducir el número de candidatos antes de evaluar la calidad de la recuperación, la estructura de la solicitud y el coste total del token.
- Úselo cuando: Utilice esta ruta para repositorios grandes, documentos extensos y trabajos de conocimiento que consten de varios pasos.
- Límite: Una ventana de contexto más grande no demuestra una mejor capacidad de recuerdo, razonamiento o latencia.
Baja latencia
ChinaAPI aún no publica una clasificación de latencia entre regiones. Esta ruta le ofrece una forma reproducible de medir su propio mensaje, región y modo de transmisión.
- Úselo cuando: Utilice esta ruta cuando el tiempo de interacción o el tiempo del primer token sea un límite de liberación.
- Límite: No deduzca la latencia a partir del precio indicado, el contexto o una solicitud individual.
Generación de vídeo
Compare las modalidades de vídeo actuales, las capacidades y los precios de servicio transparentes por unidad en USD antes de probar su propio intervalo y duración.
- Úselo cuando: Utilice esta ruta para los requisitos de historia, movimiento, imagen de referencia y audio.
- Límite: El catálogo no es una clasificación basada en la calidad visual ni en el éxito de las tareas.
Valor
Utilice el precio de entrada indicado como filtro de costes y, a continuación, pruebe el coste del resultado aceptado teniendo en cuenta su carga de trabajo, los reintentos, la longitud de la salida y las restricciones operativas.
- Úselo cuando: Utilice esta opción cuando el presupuesto sea una limitación importante y le resulte útil comparar precios directamente.
- Límite: El precio de entrada más bajo que aparece en la lista no constituye una garantía de calidad, latencia ni coste total.
Modelar hechos por tarea
Selecciona los candidatos basándote en datos objetivos y, a continuación, valida tu carga de trabajo.
Los modelos pueden aparecer en más de un grupo. Dentro de estas tablas compactas, las filas se ordenan primero por ventana de contexto más grande y luego por precio de entrada listado más bajo.
Codificación y agentes
LLMs cuyas descripciones o capacidades hacen referencia a codificación, agentes, herramientas, ingeniería, planificación o trabajo de oficina. Esto es evidencia de catálogo, no una clasificación de calidad medida.
| Modelo | Proveedor | Contexto | Entrada $/ 1M |
|---|---|---|---|
| deepseek-v4-flash | DeepSeek | 1M | $0.14 |
| mimo-v2.5 | Xiaomi | 1M | $0.14 |
| qwen3.6-flash | Alibaba | 1M | $0.1846 |
| MiniMax-M3 | MiniMax | 1M | $0.2877 |
| LongCat-2.0 | Meituan | 1M | $0.3 |
| qwen3.7-plus | Alibaba | 1M | $0.3077 |
| deepseek-v4-pro | DeepSeek | 1M | $0.435 |
| mimo-v2.5-pro | Xiaomi | 1M | $0.435 |
| qwen3.6-plus | Alibaba | 1M | $0.5 |
| glm-5.2 | Zhipu AI | 1M | $1.4 |
| qwen3.8-max | Alibaba | 1M | $1.99 |
| qwen3.7-max | Alibaba | 1M | $2.5 |
| kimi-k3 | Moonshot | 1M | $2.7397 |
| step-3.5-flash | StepFun | 256K | $0.1 |
| step-3.5-flash-2603 | StepFun | 256K | $0.1 |
| hy3 | Tencent | 256K | $0.1538 |
| step-3.7-flash | StepFun | 256K | $0.2 |
| doubao-seed-2-1-turbo-260628 | ByteDance | 256K | $0.4615 |
| doubao-seed-2-1-pro-260628 | ByteDance | 256K | $0.9231 |
| kimi-k2.6 | Moonshot | 256K | $0.95 |
| kimi-k2.7-code | Moonshot | 256K | $0.95 |
| kimi-k2.7-code-highspeed | Moonshot | 256K | $1.7808 |
| MiniMax-M2.7 | MiniMax | 200K | $0.2877 |
| MiniMax-M2.7-highspeed | MiniMax | 200K | $0.5753 |
| glm-5 | Zhipu AI | 200K | $1 |
| glm-5-turbo | Zhipu AI | 200K | $1.2 |
| glm-5.1 | Zhipu AI | 200K | $1.4 |
| stepaudio-2.5-chat | StepFun | $1.5 | |
| step-1o-audio | StepFun | $3.85 |
Ideal para razonar
LLMs etiquetado con Razonamiento en la fuente de datos actual.
| Modelo | Proveedor | Contexto | Entrada $/ 1M |
|---|---|---|---|
| deepseek-v4-flash | DeepSeek | 1M | $0.14 |
| mimo-v2.5 | Xiaomi | 1M | $0.14 |
| qwen3.6-flash | Alibaba | 1M | $0.1846 |
| MiniMax-M3 | MiniMax | 1M | $0.2877 |
| LongCat-2.0 | Meituan | 1M | $0.3 |
| qwen3.7-plus | Alibaba | 1M | $0.3077 |
| deepseek-v4-pro | DeepSeek | 1M | $0.435 |
| mimo-v2.5-pro | Xiaomi | 1M | $0.435 |
| qwen3.6-plus | Alibaba | 1M | $0.5 |
| glm-5.2 | Zhipu AI | 1M | $1.4 |
| qwen3.8-max | Alibaba | 1M | $1.99 |
| qwen3.7-max | Alibaba | 1M | $2.5 |
| kimi-k3 | Moonshot | 1M | $2.7397 |
| step-3.5-flash | StepFun | 256K | $0.1 |
| step-3.5-flash-2603 | StepFun | 256K | $0.1 |
| hy3 | Tencent | 256K | $0.1538 |
| step-3.7-flash | StepFun | 256K | $0.2 |
| doubao-seed-2-1-turbo-260628 | ByteDance | 256K | $0.4615 |
| doubao-seed-2-1-pro-260628 | ByteDance | 256K | $0.9231 |
| kimi-k2.6 | Moonshot | 256K | $0.95 |
| kimi-k2.7-code | Moonshot | 256K | $0.95 |
| kimi-k2.7-code-highspeed | Moonshot | 256K | $1.7808 |
| MiniMax-M2.7 | MiniMax | 200K | $0.2877 |
| MiniMax-M2.7-highspeed | MiniMax | 200K | $0.5753 |
| glm-5 | Zhipu AI | 200K | $1 |
| glm-5-turbo | Zhipu AI | 200K | $1.2 |
| glm-5.1 | Zhipu AI | 200K | $1.4 |
| stepaudio-2.5-chat | StepFun | $1.5 |
Contexto largo
Todos LLMs con una 1M ventana de contexto, ordenados por precio de entrada listado más bajo.
| Modelo | Proveedor | Contexto | Entrada $/ 1M |
|---|---|---|---|
| deepseek-v4-flash | DeepSeek | 1M | $0.14 |
| mimo-v2.5 | Xiaomi | 1M | $0.14 |
| qwen3.6-flash | Alibaba | 1M | $0.1846 |
| MiniMax-M3 | MiniMax | 1M | $0.2877 |
| LongCat-2.0 | Meituan | 1M | $0.3 |
| qwen3.7-plus | Alibaba | 1M | $0.3077 |
| deepseek-v4-pro | DeepSeek | 1M | $0.435 |
| mimo-v2.5-pro | Xiaomi | 1M | $0.435 |
| qwen3.6-plus | Alibaba | 1M | $0.5 |
| glm-5.2 | Zhipu AI | 1M | $1.4 |
| qwen3.8-max | Alibaba | 1M | $1.99 |
| qwen3.7-max | Alibaba | 1M | $2.5 |
| kimi-k3 | Moonshot | 1M | $2.7397 |
Multimodal
LLMs con visión=verdaderaLos modelos que solo contienen texto no están incluidos en este grupo.
| Modelo | Proveedor | Contexto | Entrada $/ 1M |
|---|---|---|---|
| mimo-v2.5 | Xiaomi | 1M | $0.14 |
| qwen3.6-flash | Alibaba | 1M | $0.1846 |
| MiniMax-M3 | MiniMax | 1M | $0.2877 |
| qwen3.7-plus | Alibaba | 1M | $0.3077 |
| mimo-v2.5-pro | Xiaomi | 1M | $0.435 |
| qwen3.6-plus | Alibaba | 1M | $0.5 |
| qwen3.8-max | Alibaba | 1M | $1.99 |
| kimi-k3 | Moonshot | 1M | $2.7397 |
| step-3.7-flash | StepFun | 256K | $0.2 |
| doubao-seed-2-1-turbo-260628 | ByteDance | 256K | $0.4615 |
| doubao-seed-2-1-pro-260628 | ByteDance | 256K | $0.9231 |
| kimi-k2.6 | Moonshot | 256K | $0.95 |
| kimi-k2.7-code | Moonshot | 256K | $0.95 |
| kimi-k2.7-code-highspeed | Moonshot | 256K | $1.7808 |
| step-1o-turbo-vision | StepFun | 32K | $0.4 |
Desde la preselección hasta la implementación
Elige un modelo, verifica su ruta de configuración y, a continuación, regístralo.
Las fichas de modelos reducen el catálogo; las guías de integración proporcionan el siguiente paso de configuración. Los enlaces a las guías solo se muestran para herramientas con un registro de verificación fechado, por lo que una etiqueta de capacidad del catálogo nunca se presenta como una garantía de compatibilidad.
Continúa con una guía de configuración verificada.
Abre la guía de herramientas que mejor se adapte a tu flujo de trabajo y, a continuación, realiza una pequeña prueba antes de enrutar el tráfico de producción.
Validación de baja latencia
Mide el flujo de trabajo que realmente vas a enviar.
No publicamos una clasificación de latencia entre regiones porque el catálogo actual no contiene un conjunto de datos de latencia multirregional reproducible. Mantenga fijos el modelo, el parámetro de solicitud, la forma de la solicitud, la región, la concurrencia y el modo de transmisión durante las pruebas.
Una comprobación de latencia repetible
Registra el tiempo hasta el primer token y el tiempo total de finalización en varias ejecuciones. Compara solo las ejecuciones con el mismo mensaje y límite de salida, y guarda las mediciones sin procesar junto con la fecha y la región de la prueba.
Límite: Una sola solicitud, una especificación del proveedor o un precio publicado no pueden respaldar una afirmación sobre la latencia. Hasta que una sonda documentada publique el tamaño de la muestra y la región, este centro no etiquetará ningún modelo como la opción de menor latencia.
Ventana de contexto más larga
LLMs ordenados por contexto.
Ordenado por ventana de contexto descendente, luego se muestra el precio de entrada ascendente. El precio de salida se muestra para los modelos facturados con tokens.
| Rango | Modelo | Proveedor | Contexto | Entrada $/ 1M | Salida $/ 1M |
|---|---|---|---|---|---|
| 1 | deepseek-v4-flash | DeepSeek | 1M | $0.14 | $0.28 |
| 2 | mimo-v2.5 | Xiaomi | 1M | $0.14 | $0.28 |
| 3 | qwen3.6-flash | Alibaba | 1M | $0.1846 | $1.1077 |
| 4 | MiniMax-M3 | MiniMax | 1M | $0.2877 | $1.1507 |
| 5 | LongCat-2.0 | Meituan | 1M | $0.3 | $1.2 |
| 6 | qwen3.7-plus | Alibaba | 1M | $0.3077 | $1.2308 |
| 7 | deepseek-v4-pro | DeepSeek | 1M | $0.435 | $0.87 |
| 8 | mimo-v2.5-pro | Xiaomi | 1M | $0.435 | $0.87 |
| 9 | qwen3.6-plus | Alibaba | 1M | $0.5 | $3 |
| 10 | glm-5.2 | Zhipu AI | 1M | $1.4 | $4.4 |
| 11 | qwen3.8-max | Alibaba | 1M | $1.99 | $5.97 |
| 12 | qwen3.7-max | Alibaba | 1M | $2.5 | $7.5 |
| 13 | kimi-k3 | Moonshot | 1M | $2.7397 | $13.6986 |
| 14 | step-3.5-flash | StepFun | 256K | $0.1 | $0.3 |
| 15 | step-3.5-flash-2603 | StepFun | 256K | $0.1 | $0.3 |
| 16 | hy3 | Tencent | 256K | $0.1538 | $0.6154 |
| 17 | step-3.7-flash | StepFun | 256K | $0.2 | $1.15 |
| 18 | doubao-seed-2-1-turbo-260628 | ByteDance | 256K | $0.4615 | $2.3077 |
| 19 | doubao-seed-2-1-pro-260628 | ByteDance | 256K | $0.9231 | $4.6154 |
| 20 | kimi-k2.6 | Moonshot | 256K | $0.95 | $3.9462 |
| 21 | kimi-k2.7-code | Moonshot | 256K | $0.95 | $3.9462 |
| 22 | kimi-k2.7-code-highspeed | Moonshot | 256K | $1.7808 | $7.3973 |
| 23 | MiniMax-M2.7 | MiniMax | 200K | $0.2877 | $1.1507 |
| 24 | MiniMax-M2.7-highspeed | MiniMax | 200K | $0.5753 | $2.3014 |
| 25 | glm-5 | Zhipu AI | 200K | $1 | $3.6667 |
| 26 | glm-5-turbo | Zhipu AI | 200K | $1.2 | $4.4571 |
| 27 | glm-5.1 | Zhipu AI | 200K | $1.4 | $4.4 |
| 28 | step-1o-turbo-vision | StepFun | 32K | $0.4 | $1.28 |
| 29 | stepaudio-2.5-chat | StepFun | $1.5 | $3.5 | |
| 30 | step-1o-audio | StepFun | $3.85 | $9.24 |
Filtro de valor
LLMs ordenado por precio de entrada indicado.
Ordenado por USD de entrada listado por 1M de tokens, de forma ascendente. Utilice esto como filtro de costo, no como clasificación de calidad, latencia o costo de resultados aceptados.
| Rango | Modelo | Proveedor | Contexto | Entrada $/ 1M | Salida $/ 1M |
|---|---|---|---|---|---|
| 1 | step-3.5-flash | StepFun | 256K | $0.1 | $0.3 |
| 2 | step-3.5-flash-2603 | StepFun | 256K | $0.1 | $0.3 |
| 3 | deepseek-v4-flash | DeepSeek | 1M | $0.14 | $0.28 |
| 4 | mimo-v2.5 | Xiaomi | 1M | $0.14 | $0.28 |
| 5 | hy3 | Tencent | 256K | $0.1538 | $0.6154 |
| 6 | qwen3.6-flash | Alibaba | 1M | $0.1846 | $1.1077 |
| 7 | step-3.7-flash | StepFun | 256K | $0.2 | $1.15 |
| 8 | MiniMax-M3 | MiniMax | 1M | $0.2877 | $1.1507 |
| 9 | MiniMax-M2.7 | MiniMax | 200K | $0.2877 | $1.1507 |
| 10 | LongCat-2.0 | Meituan | 1M | $0.3 | $1.2 |
| 11 | qwen3.7-plus | Alibaba | 1M | $0.3077 | $1.2308 |
| 12 | step-1o-turbo-vision | StepFun | 32K | $0.4 | $1.28 |
| 13 | deepseek-v4-pro | DeepSeek | 1M | $0.435 | $0.87 |
| 14 | mimo-v2.5-pro | Xiaomi | 1M | $0.435 | $0.87 |
| 15 | doubao-seed-2-1-turbo-260628 | ByteDance | 256K | $0.4615 | $2.3077 |
| 16 | qwen3.6-plus | Alibaba | 1M | $0.5 | $3 |
| 17 | MiniMax-M2.7-highspeed | MiniMax | 200K | $0.5753 | $2.3014 |
| 18 | doubao-seed-2-1-pro-260628 | ByteDance | 256K | $0.9231 | $4.6154 |
| 19 | kimi-k2.6 | Moonshot | 256K | $0.95 | $3.9462 |
| 20 | kimi-k2.7-code | Moonshot | 256K | $0.95 | $3.9462 |
| 21 | glm-5 | Zhipu AI | 200K | $1 | $3.6667 |
| 22 | glm-5-turbo | Zhipu AI | 200K | $1.2 | $4.4571 |
| 23 | glm-5.2 | Zhipu AI | 1M | $1.4 | $4.4 |
| 24 | glm-5.1 | Zhipu AI | 200K | $1.4 | $4.4 |
| 25 | stepaudio-2.5-chat | StepFun | $1.5 | $3.5 | |
| 26 | kimi-k2.7-code-highspeed | Moonshot | 256K | $1.7808 | $7.3973 |
| 27 | qwen3.8-max | Alibaba | 1M | $1.99 | $5.97 |
| 28 | qwen3.7-max | Alibaba | 1M | $2.5 | $7.5 |
| 29 | kimi-k3 | Moonshot | 1M | $2.7397 | $13.6986 |
| 30 | step-1o-audio | StepFun | $3.85 | $9.24 |
Modelos de generación de vídeo
Kling, Seedance, Hailuo, Wan y HappyHorse.
Los modelos de vídeo no tienen ventanas de LLM en la fuente de datos. Se facturan en USD por la unidad que se muestra a continuación. Pruebe la solicitud, la duración, la resolución, las necesidades de control de referencia y el modo de fallo antes de elegir una ruta de producción.
| Modelo | Proveedor | Capacidades | Facturación |
|---|---|---|---|
| kling-3.0-turbo | Kuaishou | Vídeo, texto a vídeo, imagen a vídeo, audio, rápido | $0.5556 por generación |
| MiniMax-H3 | MiniMax | Vídeo, texto a vídeo, imagen a vídeo, referencia a vídeo, audio, pesos abiertos | $0.08 por segundo |
| doubao-seedance-2-5-260628 | ByteDance | Vídeo, texto a vídeo, imagen a vídeo | Por generación |
| MiniMax-Hailuo-2.3 | MiniMax | Vídeo, texto a vídeo, imagen a vídeo | $0.2778 por generación |
| doubao-seedance-2-0-mini-260615 | ByteDance | Vídeo, texto a vídeo, rápido | Por generación |
| kling-v3 | Kuaishou | Vídeo, texto a vídeo, imagen a vídeo, audio | $0.4799 por generación silenciosa de 5-second a 720 |
| kling-v3-omni | Kuaishou | Vídeo, Referencia a vídeo, Edición | $0.4167 por generación |
| MiniMax-Hailuo-02 | MiniMax | Vídeo, texto a vídeo, imagen a vídeo | $0.2778 por generación |
| doubao-seedance-2-0-260128 | ByteDance | Vídeo, texto a vídeo, imagen a vídeo | Por generación |
| MiniMax-Hailuo-2.3-Fast | MiniMax | Vídeo, Imagen a vídeo, Rápido | $0.1875 por generación |
| doubao-seedance-2-0-fast-260128 | ByteDance | Vídeo, texto a vídeo, imagen a vídeo, rápido | Por generación |
| happyhorse-1.1-t2v | Alibaba | Vídeo, texto a vídeo | $0.075 por segundo |
| happyhorse-1.1-r2v | Alibaba | Vídeo, Referencia a vídeo | $0.075 por segundo |
| happyhorse-1.1-i2v | Alibaba | Vídeo, Imagen a vídeo | $0.075 por segundo |
| wan2.7-t2v | Alibaba | Vídeo, texto a vídeo | $0.1 por segundo |
| wan2.7-r2v | Alibaba | Vídeo, Referencia a vídeo | $0.35 por segundo |
| wan2.7-videoedit | Alibaba | Vídeo, Edición de vídeo | $0.2 por segundo |
| wan2.7-i2v | Alibaba | Vídeo, Imagen a vídeo, Audio | $0.1 por segundo |
Modelos de generación de imágenes
Modelos de imágenes de Seedream y Wan.
Los modelos de imagen no tienen ventanas de LLM en la fuente de datos. Se facturan por imagen en USD.
| Modelo | Proveedor | Capacidades | Facturación |
|---|---|---|---|
| step-2x-large | StepFun | Imagen, texto a imagen | $0.0155 por imagen |
| step-image-edit-2 | StepFun | Imagen, edición de imagen, rápido | $0.0035 por imagen |
| image-01 | MiniMax | Imagen, texto a imagen | $0.0035 por imagen |
| doubao-seedream-5-0-260128 | ByteDance | Imagen, texto a imagen, imagen a imagen, 4K | $0.0306 por imagen |
| wan2.7-image | Alibaba | Imagen, texto a imagen, edición de imágenes, multirreferencia | $0.0278 por imagen |
| wan2.7-image-pro | Alibaba | Imagen, texto a imagen, edición de imágenes, multirreferencia, 4K | $0.0694 por imagen |
¿Cómo debo elegir un modelo de IA chino?
Comience con la ruta que coincida con su restricción, luego pruebe los candidatos con sus indicaciones y criterios de aceptación. Este centro publica información actualizada del catálogo, no una clasificación de calidad universal. Para obtener puntos de referencia de calidad independientes, utilice una fuente de terceros como Artificial Analysis.
¿Qué modelos tienen el contexto más extenso?
Los LLMs con contexto 1M en los datos actuales son deepseek-v4-flash, mimo-v2.5, qwen3.6-flash, MiniMax-M3, LongCat-2.0, qwen3.7-plus, deepseek-v4-pro, mimo-v2.5-pro, qwen3.6-plus, glm-5.2, qwen3.8-max, qwen3.7-max, kimi-k3.
¿Qué modelos son los más baratos?
Entre los LLMs facturados por token, step-3.5-flash y step-3.5-flash-2603 comparten el precio de entrada más bajo listado, a $0.1 por 1M tokens de entrada. El siguiente precio de entrada listado es deepseek-v4-flash a $0.14 por 1M tokens de entrada.
¿Qué modelo tiene la menor latencia?
ChinaAPI no publica una clasificación de latencia entre regiones. Mida la latencia con la misma solicitud, región, concurrencia y modo de transmisión antes de tomar una decisión en producción.
Comienza a realizar pruebas.
Utilice las rutas de decisión como una lista reducida y, a continuación, pruebe su propia carga de trabajo.
Los datos del catálogo reducen las opciones. La elección final del modelo debe basarse en las indicaciones, los datos, los requisitos de latencia, los criterios de aceptación y el coste total por resultado aceptado.
Prueba ChinaAPI
Comience con crédito gratuito o revise los precios en tiempo real antes de enrutar el tráfico de producción.
