Painel de atualização do modelo

Novidades da IA chinesa.

Um feed conciso dos lançamentos de modelos de IA chineses, com links para as fontes e disponibilidade na ChinaAPI em um só olhar. Os dados de origem sinalizam 3 datas estimadas e 5 datas desconhecidas.

Mais recentes primeiro

Solte a parede.

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 Fonte · mimo.mi.com
A Xiaomi lançou um tier de serviço de baixa latência que preserva as entradas omnimodais, a capacidade de raciocínio principal, a 1M-token context window e o limite de saída de 128K do MiMo-V2.6-Pro. A Xiaomi anuncia velocidade de saída até 20 vezes maior que a do serviço Pro padrão; RPM e TPM são fornecidos como serviço personalizado. O API model ID oficial é mimo-v2.6-pro-ultraspeed. A ChinaAPI agora disponibiliza essa rota para chamadas de clientes; consulte o catálogo em tempo real para obter o preço atual.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 Fonte · mimo.mi.com
A Xiaomi lançou seu modelo de raciocínio principal nativamente omnimodal para projetos complexos, tarefas de longa duração, segurança cibernética e pesquisa. O MiMo-V2.6-Pro aceita texto, imagem, vídeo e áudio, retorna texto, oferece 1M-token context window e saída de até 128K, além de compatibilidade com deep thinking, tool calling, streaming, web search, structured output e context caching. O API model ID oficial é mimo-v2.6-pro. A ChinaAPI agora oferece essa route aos clientes; consulte o preço atual no live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 Fonte · mimo.mi.com
A Xiaomi lançou um modelo de raciocínio nativamente omnimodal otimizado para chamadas frequentes em trabalho profissional e tarefas em escala, com custo menor. O MiMo-V2.6-Flash aceita texto, imagem, vídeo e áudio, retorna texto, oferece 1M-token context window e saída de até 128K, além de compatibilidade com deep thinking, tool calling, streaming, web search, structured output e context caching. O API model ID oficial é mimo-v2.6-flash. A ChinaAPI agora oferece essa route aos clientes; consulte o preço atual no live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API Fonte · mimo.mi.com
A Xiaomi lançou inferência assíncrona pela Batch API para mimo-v2.6-pro e mimo-v2.6-flash a 50% do preço da API em tempo real. O serviço é voltado a trabalhos sem resposta em tempo real, como avaliação, rotulagem e geração em massa, aceita solicitações JSONL e suporta os formatos de solicitação OpenAI Chat Completions, OpenAI Responses e Anthropic Messages sem streaming. A ChinaAPI oferece as duas routes de modelo em tempo real; isso não implica suporte à Batch API separada da Xiaomi.
2026-09-22
Not on ChinaAPI confirmed
A StepFun lançou o Step 5 Preview em 2026-09-20 como seu modelo principal para engenharia de software, tarefas Agent de longa duração, trabalho profissional especializado e finanças. O sparse Mixture-of-Experts tem 600B parâmetros no total, ativa 27B por token e oferece contexto de 1M tokens. O model ID oficial da API é step-5-preview; o modelo recebe texto, imagens e vídeo, retorna texto e admite até 64K tokens de saída. A API também oferece streaming, tool calling, JSON Mode, JSON Schema, níveis low/medium/high de reasoning effort e prompt caching. A StepFun informa 44 pontos no Artificial Analysis Intelligence Index e resultados de benchmark em coding, Agent, finanças e multimodal; são resultados do fornecedor, não testes da ChinaAPI. A StepFun prevê publicar os open weights em 2026-10-15. O live catalog da ChinaAPI agora expõe a route step-5-preview para uso dos clientes pelo preço de tabela do fornecedor: input $1.00/M, output $2.70/M e prompt-cache read $0.05/M; o live Gateway continua sendo a fonte oficial.
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image Fonte · github.com
A Qwen publicou os pesos do Qwen-Image-2.1 em 2026-09-20. O componente de geração visual com 7B parâmetros reúne geração de imagens a partir de texto e edição, com transparência RGBA nativa, até 10 imagens de referência, edições locais e saída em 2K. Essas capacidades foram divulgadas pela Qwen e não são resultados de testes da ChinaAPI. Os pesos seguem a Qwen Research License, que, sem uma licença comercial separada, permite apenas pesquisa e avaliação não comerciais. A Alibaba Model Studio ainda não publicou um API model ID nem preço para Qwen-Image-2.1, e a ChinaAPI não oferece essa route; não há página de modelo nem preço ChinaAPI publicados.
2026-09-20
Not on ChinaAPI confirmed
A DeepSeek lançou o DeepSeek-V4.1-Flash e abriu seus pesos em 2026-09-10. O modelo nativo de imagem e texto usa uma arquitetura Causal Encoder-Decoder Mixture-of-Experts com 552B parâmetros, ativando 8B no prefill de entrada e 16B no decode de saída, com contexto de 1M e saída de até 384K. Segundo a DeepSeek, as avaliações do fornecedor superam o V4 Pro e o novo KV Cache usa 1/4 da HBM e 1/8 do armazenamento SSD exigidos pelo V4 Flash anterior; são afirmações do fornecedor, não testes da ChinaAPI. O model ID da API direta da DeepSeek é deepseek-flash. Os checkpoints independentes V4 Flash e Vision-Exp foram retirados, mas seus model IDs legados são temporariamente mapeados para V4.1 Flash. O live catalog da ChinaAPI agora expõe o ID canônico deepseek-flash no lugar dos dois IDs Flash legados; as duas URLs de marketing Flash desativadas redirecionam para essa página canônica do modelo. Fora do pico, os preços são $0.15/M de entrada, $0.60/M de saída e $0.003/M de cache read; no pico dos dias úteis no horário de Pequim, os preços são exatamente 2x: $0.30/M, $1.20/M e $0.006/M. O live ChinaAPI Gateway é a referência oficial. A DeepSeek também havia anunciado que, após 2026-09-14, chamadas diretas a deepseek-v4-pro seriam encaminhadas ao V4.1 Flash, mas depois desistiu desse plano: o DeepSeek V4 Pro continua disponível após essa data com cobrança inalterada, e deepseek-v4-pro segue como uma rota separada da ChinaAPI.
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
A Tencent Hunyuan abriu o código e os pesos do AuK e do AuK-Flash em 2026-09-09. O AuK é um modelo fundamental de geração e edição de fala com 1.5B parâmetros, treinado com 1.95M horas de supervisão efetiva em cinco grupos de tarefas: geração de fala, edição de conteúdo, aprimoramento e separação, edição paralinguística e edição acústica. Uma única interface de instruções em linguagem natural oferece zero-shot e instruction-based TTS, edição de fala e letras de músicas, mudanças de pitch, speed e volume, edição de emotion e timbre, remoção de sotaque, sons não verbais, aprimoramento de fala e separação de fontes. O AuK-Flash é uma variante destilada de 4-step; o artigo relata aceleração wall-clock de 4.5x sobre o AuK nas mesmas condições, mas esse é um resultado do fornecedor, não um teste da ChinaAPI. Os dois repositórios oficiais fornecem pesos sob MIT para download e usam o Qwen2.5-Omni-3B como encoder externo. O código oficial e o SGLang-Omni documentam self-hosted inference, mas a ChinaAPI atualmente não oferece o AuK como Route para clientes; por isso, não há preço de API nem Model Page publicados.
2026-09-09
Not on ChinaAPI confirmed

A Tencent Hy Team abriu os pesos do Hy4 preview em 2026-08-28. O modelo Mixture-of-Experts tem 770B parâmetros no backbone, com 49B ativos por token, além de uma camada MTP nativa de 10B para speculative decoding. O modelo de texto aceita contexto de 1M e é publicado em dois repositórios oficiais de pesos: o checkpoint original e uma variante FP8. A Tencent documenta o serviço OpenAI-compatible com vLLM e SGLang; a matriz oficial do SGLang inclui FP8 em 8x B200 ou 4x B300/GB300 e BF16 em 16x H200. Distribuído sob Apache-2.0, o modelo é voltado a Software Engineering de longa duração, análise de Office, Game Development e Scientific Research. As avaliações publicadas são resultados do fornecedor, não testes da ChinaAPI. A ChinaAPI oferece a Route hy4-preview para clientes, uma Model Page dedicada e uma análise de Deployment e custos; o catálogo em tempo real continua sendo a referência para os preços atuais.
2026-08-28
✓ On ChinaAPI confirmed
A Z.ai lançou e abriu os pesos do GLM-5.3-Flash (320B-A18B) em 2026-08-27, o primeiro modelo multimodal nativo da família GLM-5. Ele aceita texto, imagem, vídeo e arquivos, com contexto de 1M e saída de até 128K. A API oficial Chat Completion mantém o thinking ativado e oferece Function Calling, Context Caching e Structured Output. A arquitetura de baixo custo combina Sparse Attention e Linear Attention com Manifold-Constrained Hyper-Connections. Segundo a Z.ai, o modelo foi pré-treinado com 30T tokens multimodais e, em relação ao GLM-5.3, reduz o cálculo de Attention em 3,01 vezes e o KV Cache médio por camada em 4,44 vezes. A Z.ai também relata 57 pontos no Artificial Analysis Intelligence Index e desempenho de Coding comparável ao Claude Opus 4.8; são alegações do fornecedor, não testes da ChinaAPI. A API oficial A rota glm-5.3-flash agora pode ser chamada na ChinaAPI por endpoints OpenAI-compatible e Anthropic-compatible, com entrada de texto, imagem e vídeo.
2026-08-27
✓ On ChinaAPI confirmed
A Qwen lançou o Qwen3.8-Flash-Next em 2026-08-26 como preview multimodal Mixture-of-Experts da arquitetura Qwen4. O modelo de linguagem tem um modelo principal de 125B parâmetros, embeddings N-gram adicionais de 51B, módulo MTP de 4B e ativa 6B parâmetros por token, com contexto nativo de 262K expansível para 1M via YaRN. A Qwen publica checkpoints oficiais BF16 e FP8; o Hugging Face informa cerca de 360GB e 186GB, e a receita vLLM mede 335.28GiB e 172.78GiB. O vLLM valida 2x GB300 como topologia FP8 oficial mínima e relata cerca de 1,430 output tokens/s em concurrency 64 em 4x H100, com a tabela N-gram transferida para a memória host, usando carga aleatória de 1,024 entrada/256 saída. Uma receita NVFP4 de terceiros também relata execução em um único DGX Spark de 128GB, mas usa checkpoint 4-bit não oficial da Qwen e serving personalizado, portanto não é o mínimo oficial. A Qwen Community License 1.0 exige licença separada antes do uso comercial em MaaS ou em negócio AI Work Assistant definido. A ChinaAPI lista qwen3.8-flash, modelo production gerenciado baseado no Flash-Next, como route acessível ao cliente; não afirma que seja byte-identical aos pesos preview baixáveis.
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision Fonte · api-docs.deepseek.com
A DeepSeek lançou o DeepSeek-V4-Flash-Vision-Exp em sua plataforma de API em 2026-08-21 como um modelo independente e experimental de compreensão visual. Ele é chamado com model='deepseek-v4-flash-vision-exp' e aceita entradas mistas de texto e imagem pelas APIs OpenAI-compatible Chat Completions e Responses, além da API Messages compatível com Anthropic. Imagens JPEG, PNG, GIF e WebP podem ser enviadas em base64, por URL pública ou como referência da Files API. O modelo oferece contexto de 1M e saída de até 384K, suporta os modos thinking e non-thinking, JSON Output e Tool Calls, mas não oferece FIM. Segundo a DeepSeek, suas capacidades de Agent, raciocínio e conhecimento de mundo somente em texto equivalem às do DeepSeek-V4-Flash oficial, enquanto os resultados de Agent visual melhoraram substancialmente; essas comparações são alegações do fornecedor, não testes da ChinaAPI. Cada imagem é convertida em no máximo 384 tokens e usa as tarifas oficiais de token do V4-Flash. A rota deepseek-v4-flash-vision-exp podia ser chamada na ChinaAPI quando foi lançada; desde então, foi retirada do live catalog em favor de deepseek-flash, e sua antiga URL de marketing redireciona para a página canônica.
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
A Qwen publicou duas especificações implantáveis do Qwen3.8 e quatro repositórios oficiais de pesos. Qwen3.8-27B e Qwen3.8-27B-FP8 são variantes de precisão de um único modelo denso nativo de visão e linguagem. Qwen3.8-2.4T-A95B e seu repositório FP8 são variantes de um único modelo Mixture-of-Experts somente de texto com 95B parâmetros ativos. As duas especificações oferecem contexto nativo de 262K e caminhos documentados para hospedagem própria. A versão 27B usa Apache-2.0; a versão 2.4T usa a licença personalizada Qwen3.8-Max License, com exigências de atribuição e condições para negócios MaaS ou AI Work Assistant de alta receita. O catálogo em tempo real da ChinaAPI lista as rotas qwen3.8-27b e qwen3.8-2.4t-a95b para chamadas de clientes. Isso não significa que sejam idênticas, byte a byte, aos pesos disponíveis para download. Consulte os preços atuais no catálogo.
2026-08-14
✓ On ChinaAPI confirmed
A Z.ai lançou o GLM-5.3 em 2026-08-14 e o disponibilizou para todos os usuários do GLM Coding Plan. Ele usa o mesmo base model do GLM-5.2, com todos os avanços provenientes do post-training. O modelo somente de texto aceita contexto de 1M e saída de até 128K; o thinking fica sempre ativado, com níveis de reasoning_effort low, high e max. A Z.ai relata uma melhora de 50% sobre o GLM-5.2 no Z.ai Code Bench interno e resultados superiores em benchmarks públicos de programação e cibersegurança; são alegações do fornecedor, não testes da ChinaAPI. A Model API oficial já está ativa, e a rota glm-5.3 está disponível na ChinaAPI com acesso compatível com OpenAI. Ao migrar de uma configuração que desativava o thinking, ative-o e defina reasoning_effort como low antes de trocar o model ID; o guia oficial alerta que, caso contrário, a solicitação falhará (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
A DeepSeek atualizou o alias de API deepseek-v4-pro existente para servir o DeepSeek-V4-Pro-0813. O método de chamada e o model ID não mudaram: solicitações com deepseek-v4-pro recebem a versão mais recente. A página oficial de início rápido também confirma que deepseek-v4-flash continua mapeado para DeepSeek-V4-Flash-0731. Tratou-se de uma troca da versão servida, não de uma nova rota de API. Depois, a DeepSeek desistiu da troca planejada de deepseek-v4-pro para V4.1 Flash; o V4 Pro continua disponível após 2026-09-14 com cobrança inalterada, então as integrações existentes com a ChinaAPI podem manter o mesmo model ID.
2026-08-13
✓ On ChinaAPI confirmed
A Alibaba Cloud lançou qwen3.8-max em 2026-08-03 como o modelo principal Qwen mais capaz até hoje. O modelo nativo de visão e linguagem usa uma arquitetura Mixture-of-Experts com 2.4T parâmetros, oferece raciocínio, geração de texto e compreensão visual e traz melhorias significativas sobre a série Qwen3.7. A documentação oficial do Model Studio lista acesso OpenAI-compatible, Anthropic-compatible e DashScope em Pequim e em várias regiões globais. Esta rota agora está disponível pela ChinaAPI.
2026-08-03
✓ On ChinaAPI confirmed

A MiniMax lançou o H3 (Hailuo 3.0). As notas de lançamento oficiais o descrevem como um modelo de vídeo multimodal de uso geral, aberto e de nova geração, que entende a intenção criativa a partir de contexto de texto, imagem, vídeo e áudio e entrega gerações mais naturais e coerentes. A ChinaAPI atende a rota para clipes de 4 a 15 segundos em 768P e 2K com áudio estéreo nativo em uma única passada, cobrados por segundo de saída e chamáveis pelo endpoint de vídeo OpenAI-compatible.
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
Video Seedance 2.5 Fonte · console.volcengine.com
O catálogo de modelos Ark da Volcano Engine lista Doubao-Seedance-2.5 com o model ID doubao-seedance-2-5-260628. Lançado em 2026-07-31, o modelo pode gerar vídeos de até 30 segundos, aceitar até 50 materiais de referência (30 imagens, 10 vídeos e 10 clipes de áudio) e oferecer referência multimodal, edição e extensão de vídeo, além de geração em mais de 10 idiomas. 260628 continua sendo a etiqueta de versão do modelo. A ChinaAPI agora disponibiliza essa rota para chamadas de clientes; consulte o catálogo em tempo real para obter o preço atual.
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash Fonte · api-docs.deepseek.com
A DeepSeek atualizou a rota de API deepseek-v4-flash existente com um checkpoint submetido a novo pós-treinamento. A arquitetura e o tamanho do modelo Preview foram mantidos, com reforço nas capacidades de programação e Agent. Com esforço máximo de raciocínio e um minimal harness ainda não publicado, a DeepSeek informa 82.7 no Terminal Bench 2.1, 54.4 no DeepSWE e 70.3 no Toolathlon Verified; são resultados do fornecedor, não testes da ChinaAPI. A rota oficial agora oferece suporte nativo à Responses API e à integração com o Codex; web da DeepSeek, aplicativo móvel e V4-Pro API não fizeram parte desta atualização.
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
A Alibaba Cloud lançou seu modelo Flash nativo de visão e linguagem, com contexto de 1M e saída de até 131K. Em relação ao Qwen3.6-Flash, ele aprimora a compreensão multimodal, a percepção do mundo real e espacial, a execução de Search Agent e CI Agent e a programação multimodal. O modelo oficial aceita texto, imagem e vídeo e oferece ferramentas integradas pela Responses API. A ChinaAPI agora disponibiliza qwen3.7-flash para chamadas de clientes; consulte o catálogo em tempo real para obter o preço atual.
2026-07-25
✓ On ChinaAPI confirmed
Moonshot lançou seu 2.8T-parameter carro-chefe com 1M contexto, raciocínio sempre ativo e compreensão nativa de imagens e vídeos. Os pesos de código aberto anunciados devem ser disponibilizados até July 27, 2026 .
2026-07-16
✓ On ChinaAPI confirmed
A Tencent lançou oficialmente Hy3 , um modelo híbrido de pensamento rápido e lento com 256K-context que oferece maior estabilidade e custo-benefício.
2026-07-06
✓ On ChinaAPI confirmed

A Meituan lançou seu modelo de raciocínio MoE aberto com 1M contextos para agentes de codificação e uso de ferramentas de longo prazo.
2026-06-30
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 é um modelo de gateway de texto para vídeo com compreensão semântica aprimorada e controle de câmera.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 é um modelo de gateway de referência para vídeo que garante consistência em relação a assunto, cena e estilo em múltiplas referências.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Modelo de gateway de imagem para vídeo HappyHorse 1.1 com maior consistência de textura e identidade.
2026-06-22
✓ On ChinaAPI confirmed
Plataforma de código aberto de referência GLM com 1M contexto e fluxos de trabalho de codificação e agentes de longo prazo mais robustos.
2026-06-16
✓ On ChinaAPI confirmed
Variante de gateway Kimi K2.7 de alta velocidade para codificação de baixa latência e tarefas de agentes.
2026-06-12
✓ On ChinaAPI confirmed
Modelo de gateway Kimi focado em codificação para trabalho de repositório de longo prazo com suporte visual.
2026-06-12
✓ On ChinaAPI confirmed
Reconhecimento de fala para alternância de códigos MiMo -inglês, dialetos cantonês, wu, minnan e sichuan, gravações ruidosas e de campo distante, falantes sobrepostos e letras de músicas.
2026-06-02
✓ On ChinaAPI confirmed
Modelo de gateway multimodal Qwen para análise visual, planejamento, arquivos e uso de ferramentas.
2026-06-01
✓ On ChinaAPI confirmed
Modelo nativo multimodal da série M com suporte para 1M de contextos, atenção MSA, codificação, agentes, entrada de imagem e vídeo.
2026-06-01
✓ On ChinaAPI confirmed

Modelo de gateway Fast StepFun com 256K de contexto, entrada visual, raciocínio e uso de ferramentas.
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video Fonte · arxiv.org
Lançamento técnico de vídeo com avatar baseado em áudio, com foco em sincronização labial, consistência de identidade e geração de vídeos longos.
2026-05-26
Not on ChinaAPI confirmed
O principal modelo de gateway Qwen é voltado para fluxos de trabalho exigentes de análise, codificação e agentes de produção.
2026-05-21
✓ On ChinaAPI confirmed

Modelo MiMo omnimodal nativo com 1M de contextos e capacidade de compreender texto, imagem, vídeo e áudio.
2026-04-27
✓ On ChinaAPI confirmed
Conversão de imagem para vídeo Wan 2.7 com controle de primeiro/último quadro, continuação, condução de áudio e saída 720P / 1080P .
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
Variante rápida do DeepSeek V4 para bate-papo eficiente, assistência de codificação e loops de agentes.
2026-04-24
Not on ChinaAPI confirmed
MiMo: tecnologia expressiva de conversão de texto em fala com vozes premium integradas e controle de linguagem natural sobre ritmo, emoção, tom, dialeto e interpretação de personagens.
2026-04-23
✓ On ChinaAPI confirmed
Modelo Kimi multimodal nativo e aberto para codificação de longo prazo, design visual e fluxos de trabalho de enxame de agentes.
2026-04-14
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
Um modelo fundamental de codificação multimodal 200K-context para fluxos de trabalho orientados a imagens, vídeos, arquivos, agentes de GUI e ferramentas.
2026-04-07
Not on ChinaAPI confirmed
Modelo de edição de vídeo em linguagem natural Wan 2.7 para edições locais/globais e substituição de elementos.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Modelo de conversão de texto em vídeo Wan 2.7 para geração de vídeos guiados por instruções.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Modelo Wan 2.7 de referência a vídeo para geração controlada a partir de referências visuais.
2026-04-03
✓ On ChinaAPI confirmed
Wan 2.7 Pro oferece geração e edição de imagens com controle de cores da marca, consistência de múltiplas referências e saída de até 4096 × 4096 .
2026-04-01
✓ On ChinaAPI confirmed
Modelo de imagem Wan 2.7 para conversão de texto em imagem, edição, geração de múltiplas referências e renderização de texto mais robusta.
2026-04-01
✓ On ChinaAPI confirmed

Modelo MiniMax de peso aberto para bate-papo, programação, trabalho de escritório e tarefas de agentes.
2026-03
✓ On ChinaAPI estimated

Alibaba Qwen3.5
Versão do Qwen com agente multimodal nativo que precedeu os modelos de gateway Qwen 3.6 e 3.7 .
2026-02-16
Not on ChinaAPI confirmed
3.0 geração do Kling oferece opções de conversão de texto em vídeo, imagem em vídeo, áudio e resoluções de 720p a 4K .
2026-02-05
✓ On ChinaAPI confirmed
StepFun Step-3.5-Flash
Abra o modelo flash StepFun com suporte para contexto 256K e uso de ferramentas. A ChinaAPI disponibiliza step-3.5-flash para chamadas de clientes; consulte o catálogo em tempo real para obter o preço atual.
2026-02-01
✓ On ChinaAPI confirmed

Modelo de imagem Seedream 5.0-lite com criação e recuperação controláveis, além de maior consistência de assunto.
2026-01-28
✓ On ChinaAPI confirmed
O modelo de geração de vídeo carro-chefe da Seedance, 2.0 é cobrado pela resolução de saída.
2026-01-28
✓ On ChinaAPI confirmed
A MiniMax lançou o Speech 2.8 com tags de som nativas, clonagem de voz aprimorada, áudio com qualidade de estúdio e fala multilíngue; o Turbo é a opção focada em velocidade.
2026-01-23
✓ On ChinaAPI confirmed
A MiniMax lançou o Speech 2.8 com tags de som nativas, clonagem de voz aprimorada, áudio com qualidade de estúdio e fala multilíngue; HD é a opção de alta fidelidade.
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
Modelo de agente Kimi multimodal nativo aberto com 256K contextos e treinamento de visão e linguagem.
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio Fonte · docs.z.ai
A Z.AI lançou seu modelo ASR multilíngue com suporte aprimorado para dicionários personalizados e reconhecimento de terminologia especializada.
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
Modelo de geração de imagens de pequeno porte focado na qualidade dos dados em detrimento do tamanho do modelo.
2025-12
Not on ChinaAPI confirmed

A Alibaba lançou Qwen3-TTS-Flash para síntese de voz offline com vozes expressivas, saída multilíngue e em diferentes dialetos, além de acesso à API de baixa latência.
2025-09-22
✓ On ChinaAPI confirmed

Conversão de texto em fala sensível ao contexto, com direcionamento global e em linha para linguagem natural, expressão expressiva e /v1/audio/speech OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
Síntese de fala multilíngue com excelente custo-benefício, utilizando vozes oficiais e clonadas, mapeamento de pronúncia e controles de estilo.
Release date not publicly confirmed
Not on ChinaAPI unknown
Síntese de fala expressiva com vozes oficiais e clonadas, mapeamento de pronúncia, controles de estilo e saída OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Síntese de fala expressiva e sensível ao contexto, com saída em fluxo contínuo e controles para voz, velocidade e volume.
Release date not publicly confirmed
✓ On ChinaAPI unknown