Pesquisa e comparação orientadas por tarefas

Escolha um modelo de IA chinês com base na restrição que importa.

Comece com codificação, contexto, medição de latência, vídeo ou valor. Cada rota separa os fatos do modelo atual da decisão que você ainda precisa testar. As taxas de token são sincronizadas com o gateway e podem seguir os preços oficiais de tabela da China dos provedores, quando configurados. As linhas de mídia mostram taxas de serviço transparentes em USD; qualquer margem de serviço está incluída na taxa exibida.

Este é um centro de decisões, não um ranking de popularidade ou qualidade. Publicamos apenas informações atuais do catálogo: janela de contexto, preço em USD, modalidade e capacidades declaradas. Para benchmarks de qualidade independentes, consulte Artificial Analysis.

30Token-billed LLMs with current context, price, and capability facts.
13LLMs with 1M context windows in the current model data.
24Image and video generation models listed separately with media billing.

Comece pela decisão.

Cinco vias, um padrão de evidência.

Os roteiros de pesquisa indicam as evidências disponíveis, quando elas são úteis e onde terminam. Eles conduzem aos fatos relevantes do modelo e a um único caminho de registro com marcação UTM.

Codificação e agentes

Comece com modelos cujas descrições ou capacidades atuais mencionem explicitamente codificação, ferramentas, agentes, engenharia, planejamento ou trabalho estruturado.

  • Use-o quando: Use essa abordagem quando o gargalo estiver relacionado ao uso de ferramentas, à geração de código ou a um loop de agente.
  • Limite: As etiquetas de capacidade descrevem a adequação declarada; elas não são uma pontuação de qualidade de codificação mensurável.
Abra esta rota de decisão

Contexto longo

Utilize o campo de contexto atual para restringir os candidatos antes de avaliar a qualidade da recuperação, a estrutura do prompt e o custo total em tokens.

  • Use-o quando: Utilize este método para repositórios grandes, documentos extensos e trabalhos de conhecimento que envolvam várias etapas.
  • Limite: Uma janela de contexto maior não garante melhor recordação, raciocínio ou latência.
Abra esta rota de decisão

Baixa latência

A ChinaAPI ainda não publica um ranking de latência entre regiões. Esta rota oferece uma maneira repetível de medir sua própria latência, região e modo de streaming.

  • Use-o quando: Use esta rota quando o tempo de interação ou o tempo do primeiro token for um fator determinante para a liberação do token.
  • Limite: Não infira a latência a partir do preço listado, do contexto ou de uma solicitação individual.
Abra esta rota de decisão

Geração de vídeo

Compare as modalidades de vídeo atuais, as funcionalidades e os preços transparentes por unidade em USD do serviço antes de testar seu próprio prompt e duração.

  • Use-o quando: Utilize este caminho para requisitos de história, movimento, imagem de referência e áudio.
  • Limite: O catálogo não é uma classificação de qualidade visual ou de sucesso na execução de tarefas.
Abra esta rota de decisão

Valor

Utilize o preço de entrada listado como filtro de custo e, em seguida, teste o custo do resultado aceito com sua carga de trabalho, tentativas, comprimento da saída e restrições operacionais.

  • Use-o quando: Use essa opção quando o orçamento for uma restrição rígida e uma comparação direta de preços for útil.
  • Limite: O menor preço de entrada listado não representa uma garantia de qualidade, latência ou custo total.
Abra esta rota de decisão

Fatos do modelo por tarefa

Faça uma seleção com base em fatos e, em seguida, valide sua carga de trabalho.

Os modelos podem aparecer em mais de um grupo. Nessas tabelas compactas, as linhas são ordenadas primeiro pela janela de contexto maior e, em seguida, pelo preço de entrada listado menor.

Codificação e agentes

LLMs cujas descrições ou capacidades fazem referência a codificação, agentes, ferramentas, engenharia, planejamento ou trabalho de escritório. Trata-se de evidência de catálogo, não de uma classificação de qualidade mensurável.

ModeloFornecedorContextoEntrada $/ 1M
deepseek-v4-flashDeepSeek1M$0.14
mimo-v2.5Xiaomi1M$0.14
qwen3.6-flashAlibaba1M$0.1846
MiniMax-M3MiniMax1M$0.2877
LongCat-2.0Meituan1M$0.3
qwen3.7-plusAlibaba1M$0.3077
deepseek-v4-proDeepSeek1M$0.435
mimo-v2.5-proXiaomi1M$0.435
qwen3.6-plusAlibaba1M$0.5
glm-5.2Zhipu AI1M$1.4
qwen3.8-maxAlibaba1M$1.99
qwen3.7-maxAlibaba1M$2.5
kimi-k3Projeto Moonshot1M$2.7397
step-3.5-flashStepFun256K$0.1
step-3.5-flash-2603StepFun256K$0.1
hy3Tencent256K$0.1538
step-3.7-flashStepFun256K$0.2
doubao-seed-2-1-turbo-260628ByteDance256K$0.4615
doubao-seed-2-1-pro-260628ByteDance256K$0.9231
kimi-k2.6Projeto Moonshot256K$0.95
kimi-k2.7-codeProjeto Moonshot256K$0.95
kimi-k2.7-code-highspeedProjeto Moonshot256K$1.7808
MiniMax-M2.7MiniMax200K$0.2877
MiniMax-M2.7-highspeedMiniMax200K$0.5753
glm-5Zhipu AI200K$1
glm-5-turboZhipu AI200K$1.2
glm-5.1Zhipu AI200K$1.4
stepaudio-2.5-chatStepFun$1.5
step-1o-audioStepFun$3.85

Melhor para Raciocínio

LLMs marcado com Raciocínio na fonte de dados atual.

ModeloFornecedorContextoEntrada $/ 1M
deepseek-v4-flashDeepSeek1M$0.14
mimo-v2.5Xiaomi1M$0.14
qwen3.6-flashAlibaba1M$0.1846
MiniMax-M3MiniMax1M$0.2877
LongCat-2.0Meituan1M$0.3
qwen3.7-plusAlibaba1M$0.3077
deepseek-v4-proDeepSeek1M$0.435
mimo-v2.5-proXiaomi1M$0.435
qwen3.6-plusAlibaba1M$0.5
glm-5.2Zhipu AI1M$1.4
qwen3.8-maxAlibaba1M$1.99
qwen3.7-maxAlibaba1M$2.5
kimi-k3Projeto Moonshot1M$2.7397
step-3.5-flashStepFun256K$0.1
step-3.5-flash-2603StepFun256K$0.1
hy3Tencent256K$0.1538
step-3.7-flashStepFun256K$0.2
doubao-seed-2-1-turbo-260628ByteDance256K$0.4615
doubao-seed-2-1-pro-260628ByteDance256K$0.9231
kimi-k2.6Projeto Moonshot256K$0.95
kimi-k2.7-codeProjeto Moonshot256K$0.95
kimi-k2.7-code-highspeedProjeto Moonshot256K$1.7808
MiniMax-M2.7MiniMax200K$0.2877
MiniMax-M2.7-highspeedMiniMax200K$0.5753
glm-5Zhipu AI200K$1
glm-5-turboZhipu AI200K$1.2
glm-5.1Zhipu AI200K$1.4
stepaudio-2.5-chatStepFun$1.5

Contexto longo

Todos os LLMs com uma janela de contexto 1M , ordenados pelo menor preço de entrada listado.

ModeloFornecedorContextoEntrada $/ 1M
deepseek-v4-flashDeepSeek1M$0.14
mimo-v2.5Xiaomi1M$0.14
qwen3.6-flashAlibaba1M$0.1846
MiniMax-M3MiniMax1M$0.2877
LongCat-2.0Meituan1M$0.3
qwen3.7-plusAlibaba1M$0.3077
deepseek-v4-proDeepSeek1M$0.435
mimo-v2.5-proXiaomi1M$0.435
qwen3.6-plusAlibaba1M$0.5
glm-5.2Zhipu AI1M$1.4
qwen3.8-maxAlibaba1M$1.99
qwen3.7-maxAlibaba1M$2.5
kimi-k3Projeto Moonshot1M$2.7397

Multimodal

LLMs com visão=verdadeiraModelos que utilizam apenas texto não estão listados neste grupo.

ModeloFornecedorContextoEntrada $/ 1M
mimo-v2.5Xiaomi1M$0.14
qwen3.6-flashAlibaba1M$0.1846
MiniMax-M3MiniMax1M$0.2877
qwen3.7-plusAlibaba1M$0.3077
mimo-v2.5-proXiaomi1M$0.435
qwen3.6-plusAlibaba1M$0.5
qwen3.8-maxAlibaba1M$1.99
kimi-k3Projeto Moonshot1M$2.7397
step-3.7-flashStepFun256K$0.2
doubao-seed-2-1-turbo-260628ByteDance256K$0.4615
doubao-seed-2-1-pro-260628ByteDance256K$0.9231
kimi-k2.6Projeto Moonshot256K$0.95
kimi-k2.7-codeProjeto Moonshot256K$0.95
kimi-k2.7-code-highspeedProjeto Moonshot256K$1.7808
step-1o-turbo-visionStepFun32K$0.4

Da lista de finalistas à implementação

Escolha um modelo, verifique o caminho de instalação e, em seguida, registre-o.

Os cartões de modelo restringem o catálogo; os guias de integração fornecem a próxima etapa de configuração. Os links para os guias são exibidos apenas para ferramentas com um registro de verificação desatualizado, portanto, uma etiqueta de capacidade do catálogo nunca é apresentada como garantia de compatibilidade.

Continue com um guia de configuração verificado

Abra o guia de ferramentas que corresponde ao seu fluxo de trabalho e comece com um pequeno teste antes de encaminhar o tráfego de produção.

Validação de baixa latência

Meça o fluxo de trabalho que você realmente irá implementar.

Não publicamos um ranking de latência entre regiões porque o catálogo atual não contém um conjunto de dados de latência multirregional repetível. Mantenha o modelo, o prompt, o formato da requisição, a região, a concorrência e o modo de streaming fixos ao realizar os testes.

Uma verificação de latência repetível

Registre o tempo até o primeiro token e o tempo total de conclusão em várias execuções. Compare apenas as execuções com o mesmo prompt e limite de saída e, em seguida, mantenha as medições brutas com a data e a região do teste.

Limite: Uma única solicitação, uma especificação de provedor ou um preço listado não podem sustentar uma alegação de latência. Até que uma sonda documentada publique o tamanho da amostra e a região, este hub não rotulará nenhum modelo como a opção de menor latência.

Janela de contexto mais longa

Todos LLMs ordenados por contexto.

Ordenado por janela de contexto em ordem decrescente, seguido pelo preço de entrada em ordem crescente. O preço de saída é mostrado para modelos com cobrança por token.

ClassificaçãoModeloFornecedorContextoEntrada $/ 1MSaída $/ 1M
1deepseek-v4-flashDeepSeek1M$0.14$0.28
2mimo-v2.5Xiaomi1M$0.14$0.28
3qwen3.6-flashAlibaba1M$0.1846$1.1077
4MiniMax-M3MiniMax1M$0.2877$1.1507
5LongCat-2.0Meituan1M$0.3$1.2
6qwen3.7-plusAlibaba1M$0.3077$1.2308
7deepseek-v4-proDeepSeek1M$0.435$0.87
8mimo-v2.5-proXiaomi1M$0.435$0.87
9qwen3.6-plusAlibaba1M$0.5$3
10glm-5.2Zhipu AI1M$1.4$4.4
11qwen3.8-maxAlibaba1M$1.99$5.97
12qwen3.7-maxAlibaba1M$2.5$7.5
13kimi-k3Projeto Moonshot1M$2.7397$13.6986
14step-3.5-flashStepFun256K$0.1$0.3
15step-3.5-flash-2603StepFun256K$0.1$0.3
16hy3Tencent256K$0.1538$0.6154
17step-3.7-flashStepFun256K$0.2$1.15
18doubao-seed-2-1-turbo-260628ByteDance256K$0.4615$2.3077
19doubao-seed-2-1-pro-260628ByteDance256K$0.9231$4.6154
20kimi-k2.6Projeto Moonshot256K$0.95$3.9462
21kimi-k2.7-codeProjeto Moonshot256K$0.95$3.9462
22kimi-k2.7-code-highspeedProjeto Moonshot256K$1.7808$7.3973
23MiniMax-M2.7MiniMax200K$0.2877$1.1507
24MiniMax-M2.7-highspeedMiniMax200K$0.5753$2.3014
25glm-5Zhipu AI200K$1$3.6667
26glm-5-turboZhipu AI200K$1.2$4.4571
27glm-5.1Zhipu AI200K$1.4$4.4
28step-1o-turbo-visionStepFun32K$0.4$1.28
29stepaudio-2.5-chatStepFun$1.5$3.5
30step-1o-audioStepFun$3.85$9.24

Filtro de valor

LLMs ordenado pelo preço de entrada listado.

Ordenado pelo valor em USD por 1M de tokens, em ordem crescente. Use isso como um filtro de custo, não como um filtro de qualidade, latência ou classificação de custo por resultado aceito.

ClassificaçãoModeloFornecedorContextoEntrada $/ 1MSaída $/ 1M
1step-3.5-flashStepFun256K$0.1$0.3
2step-3.5-flash-2603StepFun256K$0.1$0.3
3deepseek-v4-flashDeepSeek1M$0.14$0.28
4mimo-v2.5Xiaomi1M$0.14$0.28
5hy3Tencent256K$0.1538$0.6154
6qwen3.6-flashAlibaba1M$0.1846$1.1077
7step-3.7-flashStepFun256K$0.2$1.15
8MiniMax-M3MiniMax1M$0.2877$1.1507
9MiniMax-M2.7MiniMax200K$0.2877$1.1507
10LongCat-2.0Meituan1M$0.3$1.2
11qwen3.7-plusAlibaba1M$0.3077$1.2308
12step-1o-turbo-visionStepFun32K$0.4$1.28
13deepseek-v4-proDeepSeek1M$0.435$0.87
14mimo-v2.5-proXiaomi1M$0.435$0.87
15doubao-seed-2-1-turbo-260628ByteDance256K$0.4615$2.3077
16qwen3.6-plusAlibaba1M$0.5$3
17MiniMax-M2.7-highspeedMiniMax200K$0.5753$2.3014
18doubao-seed-2-1-pro-260628ByteDance256K$0.9231$4.6154
19kimi-k2.6Projeto Moonshot256K$0.95$3.9462
20kimi-k2.7-codeProjeto Moonshot256K$0.95$3.9462
21glm-5Zhipu AI200K$1$3.6667
22glm-5-turboZhipu AI200K$1.2$4.4571
23glm-5.2Zhipu AI1M$1.4$4.4
24glm-5.1Zhipu AI200K$1.4$4.4
25stepaudio-2.5-chatStepFun$1.5$3.5
26kimi-k2.7-code-highspeedProjeto Moonshot256K$1.7808$7.3973
27qwen3.8-maxAlibaba1M$1.99$5.97
28qwen3.7-maxAlibaba1M$2.5$7.5
29kimi-k3Projeto Moonshot1M$2.7397$13.6986
30step-1o-audioStepFun$3.85$9.24

Modelos de geração de vídeo

Kling, Seedance, Hailuo, Wan e HappyHorse.

Os modelos de vídeo não possuem janelas de LLM na fonte de dados. A cobrança é feita em USD pela unidade mostrada abaixo. Teste o prompt, a duração, a resolução, as necessidades de controle de referência e o modo de falha antes de escolher uma rota de produção.

ModeloFornecedorCapacidadesCobrança
kling-3.0-turboKuaishouVídeo, Texto para Vídeo, Imagem para Vídeo, Áudio, Rápido$0.5556 por geração
MiniMax-H3MiniMaxVídeo, texto para vídeo, imagem para vídeo, referência para vídeo, áudio, pesos abertos$0.08 por segundo
doubao-seedance-2-5-260628ByteDanceVídeo, Texto para Vídeo, Imagem para VídeoPor geração
MiniMax-Hailuo-2.3MiniMaxVídeo, Texto para Vídeo, Imagem para Vídeo$0.2778 por geração
doubao-seedance-2-0-mini-260615ByteDanceVídeo, Texto para Vídeo, RápidoPor geração
kling-v3KuaishouVídeo, Texto para Vídeo, Imagem para Vídeo, Áudio$0.4799 por geração silenciosa de 5-second em 720
kling-v3-omniKuaishouVídeo, Referência a Vídeo, Edição$0.4167 por geração
MiniMax-Hailuo-02MiniMaxVídeo, Texto para Vídeo, Imagem para Vídeo$0.2778 por geração
doubao-seedance-2-0-260128ByteDanceVídeo, Texto para Vídeo, Imagem para VídeoPor geração
MiniMax-Hailuo-2.3-FastMiniMaxVídeo, conversão de imagem em vídeo, rápido$0.1875 por geração
doubao-seedance-2-0-fast-260128ByteDanceVídeo, Texto para Vídeo, Imagem para Vídeo, RápidoPor geração
happyhorse-1.1-t2vAlibabaVídeo, Texto para Vídeo$0.075 por segundo
happyhorse-1.1-r2vAlibabaVídeo, Referência a Vídeo$0.075 por segundo
happyhorse-1.1-i2vAlibabaVídeo, conversão de imagem em vídeo$0.075 por segundo
wan2.7-t2vAlibabaVídeo, Texto para Vídeo$0.1 por segundo
wan2.7-r2vAlibabaVídeo, Referência a Vídeo$0.35 por segundo
wan2.7-videoeditAlibabaVídeo, Edição de Vídeo$0.2 por segundo
wan2.7-i2vAlibabaVídeo, conversão de imagem em vídeo, áudio$0.1 por segundo

modelos de geração de imagens

Modelos de imagem Seedream e Wan.

Os modelos de imagem não possuem janelas de LLM na fonte de dados. A cobrança é feita por imagem em USD.

ModeloFornecedorCapacidadesCobrança
step-2x-largeStepFunImagem, texto para imagem$0.0155 por imagem
step-image-edit-2StepFunImagem, edição de imagem, rápido$0.0035 por imagem
image-01MiniMaxImagem, texto para imagem$0.0035 por imagem
doubao-seedream-5-0-260128ByteDanceImagem, Texto para Imagem, Imagem para Imagem, 4K$0.0306 por imagem
wan2.7-imageAlibabaImagem, Texto para Imagem, Edição de Imagem, Referência Múltipla$0.0278 por imagem
wan2.7-image-proAlibabaImagem, Texto para Imagem, Edição de Imagem, Múltiplas Referências, 4K$0.0694 por imagem

Como devo escolher um modelo de IA chinês?

Comece com a rota que corresponde à sua restrição e, em seguida, teste as candidatas com suas instruções e critérios de aceitação. Este hub publica dados atuais do catálogo, não um ranking universal de qualidade. Para benchmarks de qualidade independentes, use uma fonte de terceiros, como [exemplo de fonte]. Artificial Analysis.

Quais modelos têm o contexto mais extenso?

Os LLMs com contexto 1M nos dados atuais são deepseek-v4-flash, mimo-v2.5, qwen3.6-flash, MiniMax-M3, LongCat-2.0, qwen3.7-plus, deepseek-v4-pro, mimo-v2.5-pro, qwen3.6-plus, glm-5.2, qwen3.8-max, qwen3.7-max, kimi-k3.

Quais modelos são os mais baratos?

Entre os LLMs cobrados por token, step-3.5-flash e step-3.5-flash-2603 compartilham o menor preço de entrada listado, a $0.1 por 1M tokens de entrada. O próximo preço de entrada listado é deepseek-v4-flash a $0.14 por 1M tokens de entrada.

Qual modelo apresenta a menor latência?

A ChinaAPI não publica um ranking de latência entre regiões. Meça a latência no mesmo prompt, região, concorrência e modo de streaming antes de usá-la como critério para decisões em produção.

Comece os testes

Use as rotas de decisão como uma lista restrita e, em seguida, teste sua própria carga de trabalho.

Os dados do catálogo reduzem as opções. A escolha final do modelo ainda deve ser baseada nas suas solicitações, dados, necessidades de latência, critérios de aceitação e custo total por resultado aceito.

Experimente ChinaAPI

Comece com crédito grátis ou confira os preços em tempo real antes de direcionar o tráfego de produção.