Muro de actualización del modelo

Novedades de la IA china.

Un feed conciso de lanzamientos de modelos de IA chinos, con enlaces a las fuentes y disponibilidad en ChinaAPI de un vistazo. Los datos de origen señalan 3 fechas estimadas y 5 fechas desconocidas.

Más recientes primero

Muro de liberación.

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 Fuente: mimo.mi.com
Xiaomi lanzó un tier de servicio de baja latencia que conserva la entrada omnimodal, la capacidad de razonamiento insignia, la 1M-token context window y el límite de salida de 128K de MiMo-V2.6-Pro. Xiaomi anuncia una velocidad de salida hasta 20 veces superior a la del servicio Pro estándar; RPM y TPM se ofrecen como servicio personalizado. El API model ID oficial es mimo-v2.6-pro-ultraspeed. ChinaAPI ya ofrece esta ruta para llamadas de clientes; consulta el catálogo en tiempo real para conocer el precio actual.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 Fuente: mimo.mi.com
Xiaomi lanzó su modelo insignia de razonamiento nativamente omnimodal para proyectos complejos, tareas de larga duración, ciberseguridad e investigación. MiMo-V2.6-Pro acepta texto, imágenes, vídeo y audio, devuelve texto, ofrece 1M-token context window y hasta 128K de salida, y admite deep thinking, tool calling, streaming, web search, structured output y context caching. El API model ID oficial es mimo-v2.6-pro. ChinaAPI ya ofrece esta route a los clientes; consulte el precio actual en el live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 Fuente: mimo.mi.com
Xiaomi lanzó un modelo de razonamiento nativamente omnimodal optimizado para llamadas frecuentes en trabajo profesional y tareas a escala con menor coste. MiMo-V2.6-Flash acepta texto, imágenes, vídeo y audio, devuelve texto, ofrece 1M-token context window y hasta 128K de salida, y admite deep thinking, tool calling, streaming, web search, structured output y context caching. El API model ID oficial es mimo-v2.6-flash. ChinaAPI ya ofrece esta route a los clientes; consulte el precio actual en el live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API Fuente: mimo.mi.com
Xiaomi lanzó inferencia asíncrona mediante Batch API para mimo-v2.6-pro y mimo-v2.6-flash al 50% del precio de su API en tiempo real. El servicio está diseñado para trabajos no interactivos como evaluación, etiquetado y generación masiva, acepta solicitudes JSONL y admite los formatos de solicitud OpenAI Chat Completions, OpenAI Responses y Anthropic Messages sin streaming. ChinaAPI ofrece las dos routes de modelo en tiempo real; eso no implica compatibilidad con la Batch API independiente de Xiaomi.
2026-09-22
Not on ChinaAPI confirmed
StepFun lanzó Step 5 Preview el 2026-09-20 como su modelo insignia para ingeniería de software, tareas Agent de larga duración, trabajo profesional especializado y finanzas. El sparse Mixture-of-Experts tiene 600B parámetros totales, activa 27B por token y admite un contexto de 1M tokens. El model ID oficial de la API es step-5-preview; acepta texto, imágenes y vídeo, devuelve texto y admite hasta 64K tokens de salida. La API también ofrece streaming, tool calling, JSON Mode, JSON Schema, niveles low/medium/high de reasoning effort y prompt caching. StepFun comunica 44 puntos en el Artificial Analysis Intelligence Index y resultados de benchmark de coding, Agent, finanzas y multimodal; son resultados del proveedor, no pruebas de ChinaAPI. StepFun prevé publicar los open weights el 2026-10-15. El live catalog de ChinaAPI ahora expone la route step-5-preview para los clientes al precio de lista del proveedor: input $1.00/M, output $2.70/M y prompt-cache read $0.05/M; el live Gateway sigue siendo la fuente oficial.
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image Fuente · github.com
Qwen publicó los pesos de Qwen-Image-2.1 el 2026-09-20. Su componente de generación visual de 7B parámetros reúne la generación de imágenes a partir de texto y la edición, con transparencia RGBA nativa, hasta 10 imágenes de referencia, ediciones locales y salida 2K. Son capacidades anunciadas por Qwen, no resultados de pruebas de ChinaAPI. Los pesos están sujetos a la Qwen Research License, que sin una licencia comercial independiente solo permite investigación y evaluación no comerciales. Alibaba Model Studio no ha publicado un API model ID ni un precio para Qwen-Image-2.1, y ChinaAPI no ofrece esta route; no hay página de modelo ni precio ChinaAPI publicados.
2026-09-20
Not on ChinaAPI confirmed
DeepSeek publicó DeepSeek-V4.1-Flash y abrió sus pesos el 2026-09-10. El modelo nativo de imagen y texto usa una arquitectura Causal Encoder-Decoder Mixture-of-Experts de 552B parámetros, con 8B activos durante el prefill de entrada y 16B durante el decode de salida, contexto de 1M y salida de hasta 384K. Según DeepSeek, sus evaluaciones superan V4 Pro y el nuevo KV Cache usa 1/4 de la HBM y 1/8 del almacenamiento SSD de la V4 Flash anterior; son afirmaciones del proveedor, no pruebas de ChinaAPI. El model ID de la API directa de DeepSeek es deepseek-flash. DeepSeek retiró los checkpoints independientes V4 Flash y Vision-Exp, pero asigna temporalmente sus model IDs heredados a V4.1 Flash. El live catalog de ChinaAPI ahora muestra el ID canónico deepseek-flash en lugar de los dos ID Flash heredados; las dos URL de marketing Flash retiradas redirigen a esa página canónica del modelo. Fuera de las horas punta, los precios son $0.15/M de entrada, $0.60/M de salida y $0.003/M de cache read; durante las horas punta laborables de Pekín son exactamente 2x: $0.30/M, $1.20/M y $0.006/M. El live ChinaAPI Gateway es la referencia oficial. DeepSeek también había anunciado que, después del 2026-09-14, las llamadas directas a deepseek-v4-pro se dirigirían a V4.1 Flash, pero luego renunció a ese plan: V4 Pro sigue disponible después de esa fecha con la misma facturación, y deepseek-v4-pro sigue siendo una ruta independiente de ChinaAPI.
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent Hunyuan abrió el código y los pesos de AuK y AuK-Flash el 2026-09-09. AuK es un modelo fundacional de generación y edición de voz con 1.5B parámetros, entrenado con 1.95M horas de supervisión efectiva en cinco familias de tareas: generación de voz, edición de contenido, mejora y separación, edición paralingüística y edición acústica. Una sola interfaz de instrucciones en lenguaje natural admite TTS zero-shot e instruction-based, edición de voz y letras de canciones, cambios de pitch, speed y volume, edición de emotion y timbre, eliminación de acento, sonidos no verbales, mejora de voz y separación de fuentes. AuK-Flash es una variante destilada de 4-step; el artículo informa una aceleración wall-clock de 4.5x frente a AuK en las mismas condiciones, pero es un resultado del proveedor y no una prueba de ChinaAPI. Los dos repositorios oficiales ofrecen pesos descargables bajo MIT y usan Qwen2.5-Omni-3B como encoder externo. El código oficial y SGLang-Omni documentan self-hosted inference, pero ChinaAPI no ofrece actualmente AuK como Route para clientes; por ello no hay precio de API ni Model Page publicados.
2026-09-09
Not on ChinaAPI confirmed

Tencent Hy Team abrió los pesos de Hy4 preview el 2026-08-28. El modelo Mixture-of-Experts tiene 770B parámetros en el backbone, con 49B activos por token, además de una capa MTP nativa de 10B para speculative decoding. El modelo de texto admite un contexto de 1M y se publica en dos repositorios oficiales de pesos: el checkpoint original y una variante FP8. Tencent documenta el servicio OpenAI-compatible con vLLM y SGLang; la matriz oficial de SGLang incluye FP8 en 8x B200 o 4x B300/GB300 y BF16 en 16x H200. Distribuido bajo Apache-2.0, el modelo está orientado a Software Engineering de larga duración, análisis de Office, Game Development y Scientific Research. Las evaluaciones publicadas son resultados del proveedor, no pruebas de ChinaAPI. ChinaAPI ofrece la Route hy4-preview para clientes, una Model Page dedicada y un análisis de Deployment y costes; el catálogo en tiempo real sigue siendo la referencia para los precios actuales.
2026-08-28
✓ On ChinaAPI confirmed
Z.ai lanzó y abrió los pesos de GLM-5.3-Flash (320B-A18B) el 2026-08-27 como el primer modelo multimodal nativo de la familia GLM-5. Acepta texto, imágenes, vídeo y archivos, con un contexto de 1M y una salida máxima de 128K. La API oficial Chat Completion mantiene activado el thinking y admite Function Calling, Context Caching y Structured Output. Su arquitectura de bajo coste combina Sparse Attention y Linear Attention con Manifold-Constrained Hyper-Connections. Según Z.ai, el modelo fue preentrenado con 30T tokens multimodales y, frente a GLM-5.3, reduce el cálculo de Attention 3,01 veces y el KV Cache medio por capa 4,44 veces. Z.ai también comunica 57 puntos en Artificial Analysis Intelligence Index y un rendimiento de Coding comparable con Claude Opus 4.8; son afirmaciones del proveedor, no pruebas de ChinaAPI. La API oficial La ruta glm-5.3-flash ya puede invocarse en ChinaAPI mediante endpoints OpenAI-compatible y Anthropic-compatible, con entrada de texto, imagen y vídeo.
2026-08-27
✓ On ChinaAPI confirmed
Qwen publicó Qwen3.8-Flash-Next el 2026-08-26 como preview multimodal Mixture-of-Experts de la arquitectura Qwen4. El modelo de lenguaje tiene un modelo principal de 125B parámetros, embeddings N-gram adicionales de 51B, un módulo MTP de 4B y activa 6B parámetros por token; su contexto nativo de 262K puede ampliarse a 1M mediante YaRN. Qwen publica checkpoints oficiales BF16 y FP8; Hugging Face indica unos 360GB y 186GB, mientras la receta de vLLM mide 335.28GiB y 172.78GiB. vLLM valida 2x GB300 como topología FP8 oficial mínima e informa unos 1,430 output tokens/s con concurrency 64 en 4x H100, descargando la tabla N-gram a memoria host, con carga aleatoria de 1,024 entrada/256 salida. Una receta NVFP4 de terceros también informa ejecución en un único DGX Spark de 128GB, pero usa un checkpoint 4-bit no oficial de Qwen y serving personalizado, por lo que no es el mínimo oficial. Qwen Community License 1.0 exige una licencia separada antes del uso comercial para MaaS o un negocio AI Work Assistant definido. ChinaAPI incluye qwen3.8-flash, el modelo production gestionado basado en Flash-Next, como route accesible para clientes; no afirma que sea byte-identical a los pesos preview descargables.
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision Fuente · api-docs.deepseek.com
DeepSeek lanzó DeepSeek-V4-Flash-Vision-Exp en su plataforma API el 2026-08-21 como un modelo independiente y experimental de comprensión visual. Se invoca con model='deepseek-v4-flash-vision-exp' y acepta entradas mixtas de texto e imagen mediante las API OpenAI-compatible Chat Completions y Responses, además de la API Messages compatible con Anthropic. Las imágenes JPEG, PNG, GIF y WebP pueden enviarse en base64, mediante una URL pública o como referencia de Files API. El modelo ofrece un contexto de 1M y una salida máxima de 384K; admite los modos thinking y non-thinking, JSON Output y Tool Calls, pero no FIM. Según DeepSeek, sus capacidades de Agent, razonamiento y conocimiento del mundo solo con texto igualan a las de DeepSeek-V4-Flash oficial, mientras que los resultados del Agent visual mejoran de forma considerable; estas comparaciones son afirmaciones del proveedor, no pruebas de ChinaAPI. Cada imagen se convierte en un máximo de 384 tokens y utiliza las tarifas oficiales de tokens de V4-Flash. La ruta deepseek-v4-flash-vision-exp se podía invocar en ChinaAPI cuando se publicó; después se retiró del live catalog en favor de deepseek-flash, y su antigua URL de marketing redirige a la página canónica.
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwen publicó dos especificaciones desplegables de Qwen3.8 y cuatro repositorios oficiales de pesos. Qwen3.8-27B y Qwen3.8-27B-FP8 son variantes de precisión de un mismo modelo denso nativo de visión y lenguaje. Qwen3.8-2.4T-A95B y su repositorio FP8 son variantes de un mismo modelo Mixture-of-Experts solo de texto con 95B parámetros activos. Ambas especificaciones admiten un contexto nativo de 262K y cuentan con rutas documentadas de alojamiento propio. La versión 27B usa Apache-2.0; la versión 2.4T usa la licencia personalizada Qwen3.8-Max License, con requisitos de atribución y condiciones para negocios MaaS o AI Work Assistant de altos ingresos. El catálogo en tiempo real de ChinaAPI incluye las rutas qwen3.8-27b y qwen3.8-2.4t-a95b para llamadas de clientes. Esto no implica que sean idénticas byte por byte a los pesos descargables. Consulta los precios actuales en el catálogo.
2026-08-14
✓ On ChinaAPI confirmed
Z.ai lanzó GLM-5.3 el 2026-08-14 y lo habilitó para todos los usuarios de GLM Coding Plan. Utiliza el mismo base model que GLM-5.2 y todas las mejoras proceden del post-training. Este modelo solo de texto admite un contexto de 1M y una salida de hasta 128K; el thinking está siempre activado, con niveles de reasoning_effort low, high y max. Z.ai informa de una mejora del 50% frente a GLM-5.2 en su Z.ai Code Bench interno y de mejores resultados en benchmarks públicos de programación y ciberseguridad; son afirmaciones del proveedor, no pruebas de ChinaAPI. La Model API oficial ya está disponible y la ruta glm-5.3 se puede invocar en ChinaAPI mediante acceso compatible con OpenAI. Al migrar desde una configuración que desactivaba el thinking, hay que activarlo y ajustar reasoning_effort a low antes de cambiar el model ID; la guía oficial advierte que, de lo contrario, la solicitud fallará (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
DeepSeek actualizó el alias de API deepseek-v4-pro existente para que sirva DeepSeek-V4-Pro-0813. El método de llamada y el model ID no cambian: las solicitudes que usan deepseek-v4-pro reciben la versión más reciente. La página oficial de inicio rápido también confirma que deepseek-v4-flash sigue asignado a DeepSeek-V4-Flash-0731. Fue un cambio de la versión servida, no una nueva ruta de API. Después, DeepSeek renunció al cambio previsto de deepseek-v4-pro a V4.1 Flash; V4 Pro sigue disponible después del 2026-09-14 con la misma facturación, por lo que las integraciones existentes de ChinaAPI pueden conservar el mismo model ID.
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloud lanzó qwen3.8-max el 2026-08-03 como el modelo insignia Qwen más capaz hasta la fecha. El modelo nativo de visión y lenguaje usa una arquitectura Mixture-of-Experts de 2.4T parámetros, admite razonamiento, generación de texto y comprensión visual y mejora significativamente frente a la serie Qwen3.7. La documentación oficial de Model Studio enumera acceso OpenAI-compatible, Anthropic-compatible y DashScope en Pekín y varias regiones globales. Esta ruta ya está disponible mediante ChinaAPI.
2026-08-03
✓ On ChinaAPI confirmed

MiniMax lanzó H3 (Hailuo 3.0). Las notas de lanzamiento oficiales lo describen como un modelo de vídeo multimodal de propósito general, abierto y de nueva generación, que entiende la intención creativa a partir del contexto de texto, imagen, vídeo y audio y ofrece generaciones más naturales y coherentes. ChinaAPI sirve la ruta para clips de 4 a 15 segundos en 768P y 2K con audio estéreo nativo en una sola pasada, facturados por segundo de salida y llamables a través del endpoint de vídeo OpenAI-compatible.
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
El catálogo de modelos Ark de Volcano Engine incluye Doubao-Seedance-2.5 con el model ID doubao-seedance-2-5-260628. Lanzado el 2026-07-31, el modelo puede generar vídeos de hasta 30 segundos, aceptar hasta 50 recursos de referencia (30 imágenes, 10 vídeos y 10 clips de audio) y admitir referencias multimodales, edición y extensión de vídeo, así como generación en más de 10 idiomas. 260628 sigue siendo la etiqueta de versión del modelo. ChinaAPI ya ofrece esta ruta para llamadas de clientes; consulta el catálogo en tiempo real para conocer el precio actual.
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash Fuente · api-docs.deepseek.com
DeepSeek actualizó la ruta API deepseek-v4-flash existente con un checkpoint sometido a un nuevo posentrenamiento. Mantiene la arquitectura y el tamaño del modelo Preview, pero refuerza las capacidades de programación y Agent. Con el máximo esfuerzo de razonamiento y un minimal harness aún no publicado, DeepSeek informa 82.7 en Terminal Bench 2.1, 54.4 en DeepSWE y 70.3 en Toolathlon Verified; son resultados del proveedor, no pruebas de ChinaAPI. La ruta oficial ahora admite de forma nativa Responses API y la integración con Codex; la web de DeepSeek, la aplicación móvil y V4-Pro API no formaron parte de esta actualización.
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloud lanzó su modelo Flash nativo de visión y lenguaje, con contexto de 1M y salida de hasta 131K. Frente a Qwen3.6-Flash, mejora la comprensión multimodal, la percepción del mundo real y espacial, la ejecución de Search Agent y CI Agent y la programación multimodal. El modelo oficial admite texto, imágenes y vídeo y ofrece herramientas integradas mediante Responses API. ChinaAPI ya ofrece qwen3.7-flash para llamadas de clientes; consulta el catálogo en tiempo real para conocer el precio actual.
2026-07-25
✓ On ChinaAPI confirmed
Moonshot lanzó su 2.8T-parameter producto estrella con 1M contexto, razonamiento siempre activo y comprensión nativa de imágenes y videos. Los pesos de código abierto anunciados deben estar disponibles para July 27, 2026 .
2026-07-16
✓ On ChinaAPI confirmed
Tencent lanzó oficialmente Hy3 , un modelo híbrido de pensamiento rápido y lento con 256K-context que ofrece mayor estabilidad y eficiencia en costes.
2026-07-06
✓ On ChinaAPI confirmed

Meituan lanzó su modelo de razonamiento abierto MoE con un contexto 1M para agentes de codificación y uso de herramientas a largo plazo.
2026-06-30
✓ On ChinaAPI confirmed
Doubao Seed 2.1 el modelo insignia para el razonamiento multimodal, la codificación, el uso de herramientas y las tareas de agentes a largo plazo.
2026-06-28
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 es un modelo de puerta de enlace de texto a vídeo con comprensión semántica y control de cámara mejorados.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 es un modelo de puerta de enlace de referencia a vídeo para lograr coherencia en temas, escenas y estilos con múltiples referencias.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Modelo de puerta de enlace de imagen a vídeo HappyHorse 1.1 con mayor consistencia de textura e identidad.
2026-06-22
✓ On ChinaAPI confirmed
Producto estrella de código abierto GLM con 1M contexto y flujos de trabajo de agentes y codificación de largo plazo más robustos.
2026-06-16
✓ On ChinaAPI confirmed
Variante de puerta de enlace Kimi K2.7 de alta velocidad para tareas de codificación y agentes con menor latencia.
2026-06-12
✓ On ChinaAPI confirmed
Modelo de puerta de enlace Kimi centrado en la codificación para el trabajo con repositorios a largo plazo con soporte de visión artificial.
2026-06-12
✓ On ChinaAPI confirmed
Reconocimiento de voz MiMo para alternancia de códigos chino-inglés, cantonés, dialectos wu, minnan y sichuan, grabaciones ruidosas y de campo lejano, hablantes superpuestos y letras de canciones.
2026-06-02
✓ On ChinaAPI confirmed
Modelo de puerta de enlace Qwen multimodal para análisis visual, planificación, archivos y uso de herramientas.
2026-06-01
✓ On ChinaAPI confirmed
Modelo multimodal nativo de la serie M con contexto 1M , atención MSA, codificación, agente, soporte para entrada de imágenes y vídeo.
2026-06-01
✓ On ChinaAPI confirmed

Modelo de puerta de enlace Fast StepFun con 256K de contexto, entrada visual, razonamiento y uso de herramientas.
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video Fuente: arxiv.org
Lanzamiento técnico de vídeo con avatares controlados por audio, centrado en la sincronización labial, la coherencia de la identidad y la generación de vídeos de larga duración.
2026-05-26
Not on ChinaAPI confirmed
Modelo insignia de Qwen para flujos de trabajo exigentes de agentes de análisis, codificación y producción.
2026-05-21
✓ On ChinaAPI confirmed

Convertidor de imagen a vídeo Wan 2.7 con control de primer/último fotograma, continuación, control de audio y salida 720P / 1080P .
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
Variante rápida de DeepSeek V4 para chat eficiente, asistencia en codificación y bucles de agentes.
2026-04-24
Not on ChinaAPI confirmed
MiMo ofrece una función expresiva de conversión de texto a voz con voces integradas de alta calidad y control del lenguaje natural sobre el ritmo, la emoción, el tono, el dialecto y la interpretación de los personajes.
2026-04-23
✓ On ChinaAPI confirmed
Modelo Kimi multimodal nativo abierto para codificación a largo plazo, diseño visual y flujos de trabajo basados en enjambres de agentes.
2026-04-14
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
200K-context modelo de base de codificación multimodal para flujos de trabajo basados en imágenes, vídeo, archivos, GUI y herramientas.
2026-04-07
Not on ChinaAPI confirmed
Wan 2.7 es un modelo de edición de vídeo en lenguaje natural para ediciones locales/globales y sustitución de elementos.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Modelo Wan 2.7 de conversión de texto a vídeo para la generación de vídeos a partir de indicaciones.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Modelo Wan 2.7 de referencia a vídeo para la generación controlada a partir de referencias visuales.
2026-04-03
✓ On ChinaAPI confirmed
Modelo de imagen Wan 2.7 para conversión de texto a imagen, edición, generación de múltiples referencias y una representación de texto más robusta.
2026-04-01
✓ On ChinaAPI confirmed

Alibaba Qwen3.5
Versión nativa de Qwen con agente multimodal que precedió a los modelos de puerta de enlace Qwen 3.6 y 3.7 .
2026-02-16
Not on ChinaAPI confirmed
StepFun Step-3.5-Flash
Modelo flash StepFun abierto con soporte para contexto de 256K y uso de herramientas. ChinaAPI ofrece step-3.5-flash para llamadas de clientes; consulta el catálogo en tiempo real para conocer el precio actual.
2026-02-01
✓ On ChinaAPI confirmed

Modelo de imagen Seedream 5.0-lite con creación y recuperación controlables, y mayor coherencia del sujeto.
2026-01-28
✓ On ChinaAPI confirmed
Seedance 2.0 el modelo insignia de generación de vídeo, factura según la resolución de salida.
2026-01-28
✓ On ChinaAPI confirmed
MiniMax lanzó Speech 2.8 con etiquetas de sonido nativas, clonación de voz mejorada, audio de calidad de estudio y reconocimiento de voz multilingüe; Turbo es su opción centrada en la velocidad.
2026-01-23
✓ On ChinaAPI confirmed
MiniMax lanzó Speech 2.8 con etiquetas de sonido nativas, clonación de voz mejorada, audio con calidad de estudio y reconocimiento de voz multilingüe; HD es su opción de alta fidelidad.
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
Modelo de agente Kimi multimodal nativo abierto con 256K contextos y entrenamiento en visión y lenguaje.
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio Fuente · docs.z.ai
Z.AI ha lanzado su modelo ASR multilingüe con soporte mejorado para diccionarios personalizados y reconocimiento de terminología especializada.
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
Image LongCat Fuente: en.wikipedia.org
Modelo pequeño de generación de imágenes que prioriza la calidad de los datos sobre el tamaño del modelo.
2025-12
Not on ChinaAPI confirmed

Alibaba lanzó Qwen3-TTS-Flash para la síntesis de voz sin conexión con voces expresivas, salida multilingüe y en diferentes dialectos, y acceso a la API de baja latencia.
2025-09-22
✓ On ChinaAPI confirmed

Texto a voz sensible al contexto con dirección global y en línea en lenguaje natural, entrega expresiva y salida directa OpenAI-compatible /v1/audio/speech .
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
Síntesis de voz multilingüe rentable con voces oficiales y clonadas, mapeo de pronunciación y controles de estilo.
Release date not publicly confirmed
Not on ChinaAPI unknown
Síntesis de voz expresiva con voces oficiales y clonadas, mapeo de pronunciación, controles de estilo y salida OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Síntesis de voz expresiva sensible al contexto con salida en tiempo real y controles de voz, velocidad y volumen.
Release date not publicly confirmed
✓ On ChinaAPI unknown