Muro de actualización del modelo

Cronograma de lanzamiento del modelo de IA de China.

Un análisis detallado de los lanzamientos de modelos de IA chinos. Las fechas provienen de las fuentes de los proveedores vinculados; la disponibilidad de ChinaAPI se muestra en cada entrada como un estado secundario. En los datos de origen se indican 3 fechas estimadas y 5 fechas desconocidas.

Más recientes primero

Muro de liberación.

2026-08-03

Alibaba Cloud lanzó qwen3.8-max el 2026-08-03 como el modelo insignia Qwen más capaz hasta la fecha. El modelo nativo de visión y lenguaje usa una arquitectura Mixture-of-Experts de 2.4T parámetros, admite razonamiento, generación de texto y comprensión visual y mejora significativamente frente a la serie Qwen3.7. La documentación oficial de Model Studio enumera acceso OpenAI-compatible, Anthropic-compatible y DashScope en Pekín y varias regiones globales. Esta ruta ya está disponible mediante ChinaAPI.

LLM ✓ On ChinaAPI confirmed Fuente · help.aliyun.com
2026-07-31

MiniMax lanzó H3 (Hailuo 3.0). Las notas de lanzamiento oficiales lo describen como un modelo de vídeo multimodal de propósito general, abierto y de nueva generación, que entiende la intención creativa a partir del contexto de texto, imagen, vídeo y audio y ofrece generaciones más naturales y coherentes. ChinaAPI sirve la ruta para clips de 4 a 15 segundos en 768P y 2K con audio estéreo nativo en una sola pasada, facturados por segundo de salida y llamables a través del endpoint de vídeo OpenAI-compatible.

Video ✓ On ChinaAPI confirmed Fuente · platform.minimax.io
2026-07-31
ByteDance Doubao-Seedance-2.5 Seedance 2.5

El catálogo de modelos Ark de Volcano Engine incluye Doubao-Seedance-2.5 con el model ID doubao-seedance-2-5-260628. Lanzado el 2026-07-31, el modelo puede generar vídeos de hasta 30 segundos, aceptar hasta 50 recursos de referencia (30 imágenes, 10 vídeos y 10 clips de audio) y admitir referencias multimodales, edición y extensión de vídeo, así como generación en más de 10 idiomas. 260628 sigue siendo la etiqueta de versión del modelo. ChinaAPI aún no ha verificado esta ruta para llamadas de clientes, por lo que todavía no publica una página del modelo ni precios.

Video Not yet confirmed Fuente · console.volcengine.com
2026-07-31

DeepSeek actualizó la ruta API deepseek-v4-flash existente con un checkpoint sometido a un nuevo posentrenamiento. Mantiene la arquitectura y el tamaño del modelo Preview, pero refuerza las capacidades de programación y Agent. Con el máximo esfuerzo de razonamiento y un minimal harness aún no publicado, DeepSeek informa 82.7 en Terminal Bench 2.1, 54.4 en DeepSWE y 70.3 en Toolathlon Verified; son resultados del proveedor, no pruebas de ChinaAPI. La ruta oficial ahora admite de forma nativa Responses API y la integración con Codex; la web de DeepSeek, la aplicación móvil y V4-Pro API no formaron parte de esta actualización.

LLM ✓ On ChinaAPI confirmed Fuente · api-docs.deepseek.com
2026-07-25
Alibaba Cloud Qwen3.7-Flash Qwen3.7

Alibaba Cloud lanzó su modelo Flash nativo de visión y lenguaje, con contexto de 1M y salida de hasta 131K. Frente a Qwen3.6-Flash, mejora la comprensión multimodal, la percepción del mundo real y espacial, la ejecución de Search Agent y CI Agent y la programación multimodal. El modelo oficial admite texto, imágenes y vídeo y ofrece herramientas integradas mediante Responses API. Esta ruta todavía no figura en el gateway de ChinaAPI.

LLM Not yet confirmed Source · cn.aliyun.com
2026-07-16

Moonshot lanzó su 2.8T-parameter producto estrella con 1M contexto, razonamiento siempre activo y comprensión nativa de imágenes y videos. Los pesos de código abierto anunciados deben estar disponibles para July 27, 2026 .

LLM ✓ On ChinaAPI confirmed Fuente: kimi.com
2026-07-06
Tencent Hy3 Hunyuan

Tencent lanzó oficialmente Hy3 , un modelo híbrido de pensamiento rápido y lento con 256K-context que ofrece mayor estabilidad y eficiencia en costes.

LLM ✓ On ChinaAPI confirmed Fuente: tencent.com
2026-06-30

Meituan lanzó su modelo de razonamiento abierto MoE con un contexto 1M para agentes de codificación y uso de herramientas a largo plazo.

LLM ✓ On ChinaAPI confirmed Fuente: meituan.com
2026-06-28

Doubao Seed 2.1 el modelo insignia para el razonamiento multimodal, la codificación, el uso de herramientas y las tareas de agentes a largo plazo.

LLM ✓ On ChinaAPI confirmed Fuente: volcengine.com
2026-06-22

HappyHorse 1.1 es un modelo de puerta de enlace de texto a vídeo con comprensión semántica y control de cámara mejorados.

Video ✓ On ChinaAPI confirmed
2026-06-22

HappyHorse 1.1 es un modelo de puerta de enlace de referencia a vídeo para lograr coherencia en temas, escenas y estilos con múltiples referencias.

Video ✓ On ChinaAPI confirmed
2026-06-22

Modelo de puerta de enlace de imagen a vídeo HappyHorse 1.1 con mayor consistencia de textura e identidad.

Video ✓ On ChinaAPI confirmed
2026-06-16

Producto estrella de código abierto GLM con 1M contexto y flujos de trabajo de agentes y codificación de largo plazo más robustos.

LLM ✓ On ChinaAPI confirmed Fuente: huggingface.co
2026-06-12

Variante de puerta de enlace Kimi K2.7 de alta velocidad para tareas de codificación y agentes con menor latencia.

LLM ✓ On ChinaAPI confirmed
2026-06-12

Modelo de puerta de enlace Kimi centrado en la codificación para el trabajo con repositorios a largo plazo con soporte de visión artificial.

LLM ✓ On ChinaAPI confirmed
2026-06-02

Reconocimiento de voz MiMo para alternancia de códigos chino-inglés, cantonés, dialectos wu, minnan y sichuan, grabaciones ruidosas y de campo lejano, hablantes superpuestos y letras de canciones.

Audio ✓ On ChinaAPI confirmed Fuente: mimo.mi.com
2026-06-01

Modelo de puerta de enlace Qwen multimodal para análisis visual, planificación, archivos y uso de herramientas.

LLM ✓ On ChinaAPI confirmed
2026-06-01

Modelo multimodal nativo de la serie M con contexto 1M , atención MSA, codificación, agente, soporte para entrada de imágenes y vídeo.

LLM ✓ On ChinaAPI confirmed Fuente: minimax.io
2026-05-28

Modelo de puerta de enlace Fast StepFun con 256K de contexto, entrada visual, razonamiento y uso de herramientas.

LLM ✓ On ChinaAPI confirmed
2026-05-26
Meituan LongCat-Video-Avatar 1.5 LongCat Video

Lanzamiento técnico de vídeo con avatares controlados por audio, centrado en la sincronización labial, la coherencia de la identidad y la generación de vídeos de larga duración.

Video Not yet confirmed Fuente: arxiv.org
2026-05-21

Modelo insignia de Qwen para flujos de trabajo exigentes de agentes de análisis, codificación y producción.

LLM ✓ On ChinaAPI confirmed
2026-04-25

Convertidor de imagen a vídeo Wan 2.7 con control de primer/último fotograma, continuación, control de audio y salida 720P / 1080P .

Video ✓ On ChinaAPI confirmed Fuente · help.aliyun.com
2026-04-23

MiMo ofrece una función expresiva de conversión de texto a voz con voces integradas de alta calidad y control del lenguaje natural sobre el ritmo, la emoción, el tono, el dialecto y la interpretación de los personajes.

Audio ✓ On ChinaAPI confirmed Fuente: mimo.mi.com
2026-04-14

Modelo Kimi multimodal nativo abierto para codificación a largo plazo, diseño visual y flujos de trabajo basados en enjambres de agentes.

LLM ✓ On ChinaAPI confirmed Fuente: huggingface.co
2026-04-07
Zhipu AI GLM-5V-Turbo GLM

200K-context modelo de base de codificación multimodal para flujos de trabajo basados en imágenes, vídeo, archivos, GUI y herramientas.

LLM Not yet confirmed Fuente · docs.bigmodel.cn
2026-04-03

Wan 2.7 es un modelo de edición de vídeo en lenguaje natural para ediciones locales/globales y sustitución de elementos.

Video ✓ On ChinaAPI confirmed
2026-04-03

Modelo Wan 2.7 de conversión de texto a vídeo para la generación de vídeos a partir de indicaciones.

Video ✓ On ChinaAPI confirmed
2026-04-03

Modelo Wan 2.7 de referencia a vídeo para la generación controlada a partir de referencias visuales.

Video ✓ On ChinaAPI confirmed
2026-04-01

Modelo de imagen Wan 2.7 para conversión de texto a imagen, edición, generación de múltiples referencias y una representación de texto más robusta.

Image ✓ On ChinaAPI confirmed
2026-02-16
Alibaba Qwen3.5 Qwen

Versión nativa de Qwen con agente multimodal que precedió a los modelos de puerta de enlace Qwen 3.6 y 3.7 .

LLM Not yet confirmed Fuente: en.wikipedia.org
2026-02-01
StepFun Step-3.5-Flash Step

Modelo flash StepFun abierto con soporte para contexto de 256K y uso de herramientas.

LLM Not yet confirmed Fuente: huggingface.co
2026-01-28

Modelo de imagen Seedream 5.0-lite con creación y recuperación controlables, y mayor coherencia del sujeto.

Image ✓ On ChinaAPI confirmed
2026-01-28

Seedance 2.0 el modelo insignia de generación de vídeo, factura según la resolución de salida.

Video ✓ On ChinaAPI confirmed
2026-01-23

MiniMax lanzó Speech 2.8 con etiquetas de sonido nativas, clonación de voz mejorada, audio de calidad de estudio y reconocimiento de voz multilingüe; Turbo es su opción centrada en la velocidad.

Audio ✓ On ChinaAPI confirmed Fuente: minimax.io
2026-01-23

MiniMax lanzó Speech 2.8 con etiquetas de sonido nativas, clonación de voz mejorada, audio con calidad de estudio y reconocimiento de voz multilingüe; HD es su opción de alta fidelidad.

Audio ✓ On ChinaAPI confirmed Fuente: minimax.io
2026-01-01
Moonshot kimi-k2.5 Kimi

Modelo de agente Kimi multimodal nativo abierto con 256K contextos y entrenamiento en visión y lenguaje.

LLM Not yet confirmed Fuente: huggingface.co
2025-12-10
Zhipu AI GLM-ASR-2512 GLM Audio

Z.AI ha lanzado su modelo ASR multilingüe con soporte mejorado para diccionarios personalizados y reconocimiento de terminología especializada.

Audio Not yet confirmed Fuente · docs.z.ai
2025-12
Meituan LongCat-Image LongCat

Modelo pequeño de generación de imágenes que prioriza la calidad de los datos sobre el tamaño del modelo.

Image Not yet confirmed Fuente: en.wikipedia.org
2025-09-22

Alibaba lanzó Qwen3-TTS-Flash para la síntesis de voz sin conexión con voces expresivas, salida multilingüe y en diferentes dialectos, y acceso a la API de baja latencia.

Audio ✓ On ChinaAPI confirmed Fuente · help.aliyun.com
Release date not publicly confirmed

Texto a voz sensible al contexto con dirección global y en línea en lenguaje natural, entrega expresiva y salida directa OpenAI-compatible /v1/audio/speech .

Audio ✓ On ChinaAPI unknown Fuente: platform.stepfun.com
Release date not publicly confirmed

Síntesis de voz multilingüe rentable con voces oficiales y clonadas, mapeo de pronunciación y controles de estilo.

Audio ✓ On ChinaAPI unknown Fuente: platform.stepfun.com
Release date not publicly confirmed

Síntesis de voz expresiva con voces oficiales y clonadas, mapeo de pronunciación, controles de estilo y salida OpenAI-compatible .

Audio ✓ On ChinaAPI unknown Fuente: platform.stepfun.com
Release date not publicly confirmed

Síntesis de voz expresiva sensible al contexto con salida en tiempo real y controles de voz, velocidad y volumen.

Audio ✓ On ChinaAPI unknown Fuente · docs.bigmodel.cn