ChinaAPI · Preços

Panorama de preços de APIs de IA na China — julho 2026

Quanto custam as APIs LLM de imagem e vídeo em 2026 — o $0.20 , o 1M-context , cálculos de vídeo por segundo versus por geração e qual escolher de acordo com a carga de trabalho.

ChinaAPI · 2026-07-06 2026-07-10 atualização

Os fabricantes chineses de modelos passaram o último trimestre competindo entre si em preços cada vez mais baixos, resultando no mercado adjacente API fronteira mais barato do mundo. Esta análise abrange atualmente [aqui falta informação sobre a análise]. 68 modelos estão disponíveis em nosso portal: 30 LLMs e 38 modelos de imagem/vídeo. Todos os preços abaixo são gerados a partir de nosso conjunto de dados de preços públicos em vez de serem copiados manualmente para este artigo. Revisão do conjunto de dados: 2026-08-10 ; impressão digital de preços: c59b3d55d9fea19c.

Uma ressalva sincera logo de início: Preço não é sinônimo de qualidade. Este artigo informa o custo das coisas; nossa série de benchmarks (taxas de conclusão de tarefas por modelo, medidas através deste mesmo portal) é o complemento que indica o seu valor.

A faixa de entrada abaixo de US $0.20

6 modelos cobram menos de $0.20 por milhão de tokens de entrada. A comparação importante dentro deste nível é o custo de saída: dois modelos com a mesma taxa de entrada barata podem divergir drasticamente quando começam a gerar respostas longas.

ModeloFornecedorEntrada / 1MSaída / 1MContexto
step-3.5-flashStepFun$0.1$0.3256K
step-3.5-flash-2603StepFun$0.1$0.3256K
deepseek-v4-flashDeepSeek$0.14$0.281M
mimo-v2.5Xiaomi$0.14$0.281M
hy3Tencent$0.1538$0.6154256K
qwen3.6-flashAlibaba$0.1846$1.10771M

Duas coisas se destacam. Primeiro, deepseek-v4-flash e Xiaomi 's mimo-v2.5 Atualmente, possuem as mesmas taxas de entrada e saída publicadas. Em segundo lugar, observe saída Preços, não apenas insumos: qwen3.6-flash situa-se no mesmo nível de baixo insumo, mas sua taxa de produção é $1.1077 , em comparação com $0.28 para deepseek-v4-flashEssa lacuna predomina em cargas de trabalho que exigem muita geração de dados.

O clube 1M-context

13 dos 30 LLMs no catálogo atual publicam uma 1M-token janela de contexto: qwen3.6-flash, qwen3.6-plus, qwen3.7-max, qwen3.7-plus, qwen3.8-max, deepseek-v4-flash, deepseek-v4-pro, LongCat-2.0, MiniMax-M3, kimi-k3, mimo-v2.5, mimo-v2.5-pro, glm-5.2Há um ano 1M contexto era um recurso premium; no mercado chinês, está se tornando um requisito básico.

A taxa de entrada mais barata publicada entre esses modelos de um milhão de contextos é representada por deepseek-v4-flash a $0.14 por milhão de tokens de entrada. A entrada de contexto longo mais interessante é a de Meituan LongCat-2.0: um modelo de raciocínio MoE aberto com entrada $0.3 / saída $1.2 e janela 1M completa — especificações de ponta a preços de nível flash.

Preços de referência por fornecedor

Considerando o preço mais alto publicado por cada fornecedor saída O preço no catálogo de textos atual, usado como um indicador consistente — e não como uma classificação de qualidade —, produz esta comparação:

FornecedorModelo de texto de preço mais elevadoEntrada / 1MSaída / 1MContexto
Projeto Moonshotkimi-k3$2.7397$13.69861M
StepFunstep-1o-audio$3.85$9.24
Alibabaqwen3.7-max$2.5$7.51M
ByteDancedoubao-seed-2-1-pro-260628$0.9231$4.6154256K
Zhipu AIglm-5-turbo$1.2$4.4571200K
MiniMaxMiniMax-M2.7-highspeed$0.5753$2.3014200K
MeituanLongCat-2.0$0.3$1.21M
DeepSeekdeepseek-v4-pro$0.435$0.871M
Xiaomimimo-v2.5-pro$0.435$0.871M
Tencenthy3$0.1538$0.6154256K

A linha de codificação de alta velocidade de Moonshot atualmente apresenta a maior taxa de produção nesta tabela, com $7.3973 por milhão de tokens. Tencent hy3 está na outra extremidade em $0.6154 . Essa diferença é uma alegação de preço dos fornecedores, não uma evidência da mesma disparidade de qualidade; somente os índices de conclusão de tarefas podem responder se o preço premium se justifica.

Tencent 's hy3 Merece destaque: um modelo de fornecedor principal com $0.1538 de entrada / $0.6154 de saída por milhão de tokens. A dificuldade de acesso fora da China é exatamente a lacuna que este gateway visa preencher.

Execute esses modelos você mesmo. Um único ponto de extremidade API key , OpenAI-compatible e preços transparentes em USD. Consulte a página de preços em tempo real para ver a taxa de câmbio atual.

Obtenha uma chave — crédito grátis de $2

Vídeo: por segundo versus por clipe, com cálculos reais

Os preços de vídeo se apresentam de duas formas, e compará-los exige cálculos que os fornecedores não fazem por você:

ModeloFornecedorCobrançaUm clipe representativo 5-second
happyhorse-1.1-t2vAlibaba$0.075 por segundo$0.375
wan2.7-t2vAlibaba$0.1 por segundo$0.5
MiniMax-Hailuo-2.3-FastMiniMax$0.1875 por geração$0.1875
MiniMax-Hailuo-2.3MiniMax$0.2778 por geração$0.2778
kling-v3Kuaishou$0.4799 por geração silenciosa de 5-second em 720$0.4799
kling-3.0-turboKuaishou$0.5556 por geração$0.5556

Para versões resumidas, por geração MiniMax-Hailuo-2.3-Fast é $0.1875 na configuração representativa do catálogo. A cobrança por segundo ( HappyHorse , Wan ) pode ser vantajosa quando você precisa de clipes muito curtos ou controle preciso da duração. A linha Seedance de ByteDance possui preços específicos da configuração, portanto, o conjunto de dados público marca intencionalmente as linhas sem um preço unitário representativo e aponta para os preços em tempo real.

O que escolher, de acordo com a carga de trabalho

Nossa posição, considerando apenas preços e especificações (os critérios de qualidade serão apresentados separadamente):

O que este artigo não lhe diz

Todos 68 modelos são executados por meio de um OpenAI-compatible endpoint com uma única chave. Baixe o JSON ou CSV, leia o metodologiae use o crédito gratuito $2 para verificar um preço publicado com uma solicitação real.

Experimente em ChinaAPI . Todos os modelos deste artigo estão disponíveis em um único ponto de acesso — não é necessário ter uma conta ou número de telefone da China continental, $2 você pode começar com um teste gratuito.

Comece grátis — crédito $2 Veja os preços em tempo real.
Method & data. Written by: ChinaAPI Research. Published 2026-07-06, last updated 2026-07-10. Data source: ChinaAPI public model-pricing dataset, generated from gateway-reconciled models-data.json. Token-model rates are synchronized from the gateway and may follow providers' official China list prices where configured. Media rates use the displayed billing unit and may include a service margin covering provider input/output billing, payment processing, chargeback exposure, and operations; any margin is included in the displayed rate and is not added separately. The página de preços ao vivo is authoritative.