ChinaAPI · Preços

Panorama de preços de APIs de IA na China — julho 2026

Quanto custam as APIs LLM de imagem e vídeo em 2026 — o $0.20 , o 1M-context , cálculos de vídeo por segundo versus por geração e qual escolher de acordo com a carga de trabalho.

ChinaAPI · 2026-07-06 2026-07-10 atualização

Os fabricantes chineses de modelos passaram o último trimestre competindo entre si em preços cada vez mais baixos, resultando no mercado adjacente API fronteira mais barato do mundo. Esta análise abrange atualmente [aqui falta informação sobre a análise]. 65 modelos ativos em nosso gateway: 33 LLMs e 32 modelos de imagem/vídeo. Todos os preços abaixo são gerados a partir de nosso conjunto de dados de preços públicos em vez de copiados manualmente para este artigo. Dataset revision: 2026-09-27; pricing fingerprint: 2ad46808ed81aa41.

Uma ressalva sincera logo de início: Preço não é sinônimo de qualidade. Este artigo informa o custo das coisas; nossa série de benchmarks (taxas de conclusão de tarefas por modelo, medidas através deste mesmo portal) é o complemento que indica o seu valor.

A faixa de entrada abaixo de US $0.20

6 modelos custam menos de $0.20 por milhão de tokens de entrada. A comparação importante nessa faixa é o custo de saída: dois modelos com a mesma entrada barata podem divergir muito ao gerar respostas longas.

ModeloFornecedorEntrada / 1MSaída / 1MContexto
step-3.5-flashStepFun$0.1$0.3256K
step-3.5-flash-2603StepFun$0.1$0.3256K
mimo-v2.5Xiaomi$0.14$0.281M
hy3Tencent$0.1481$0.5926256K
qwen3.8-flashAlibaba$0.15$0.471M
glm-5.3-flashZhipu AI$0.15$0.51M

Duas coisas se destacam. Primeiro, deepseek-v4-flash e Xiaomi 's mimo-v2.5 Atualmente, possuem as mesmas taxas de entrada e saída publicadas. Em segundo lugar, observe saída Preços, não apenas insumos: qwen3.6-flash situa-se no mesmo nível de baixo insumo, mas sua taxa de produção é $4 , em comparação com $1.2 para deepseek-v4-flashEssa lacuna predomina em cargas de trabalho que exigem muita geração de dados.

O clube 1M-context

18 dos 33 LLMs do catálogo atual publicam uma janela de contexto de 1M-token: qwen3.6-flash, qwen3.6-plus, qwen3.7-max, qwen3.7-plus, qwen3.8-flash, qwen3.8-max, deepseek-flash, deepseek-v4-pro, LongCat-2.0, MiniMax-M3, kimi-k3, step-5-preview, hy4-preview, mimo-v2.5, mimo-v2.5-pro, glm-5.2, glm-5.3, glm-5.3-flashHá um ano 1M contexto era um recurso premium; no mercado chinês, está se tornando um requisito básico.

A taxa de entrada mais barata publicada entre esses modelos de um milhão de contextos é representada por deepseek-v4-flash a $0.3 por milhão de tokens de entrada. A entrada de contexto longo mais interessante é a de Meituan LongCat-2.0: um modelo de raciocínio MoE aberto com entrada $0.3 / saída $1.2 e janela 1M completa — especificações de ponta a preços de nível flash.

Preços de referência por fornecedor

Considerando o preço mais alto publicado por cada fornecedor saída O preço no catálogo de textos atual, usado como um indicador consistente — e não como uma classificação de qualidade —, produz esta comparação:

FornecedorModelo de texto de preço mais elevadoEntrada / 1MSaída / 1MContexto
Projeto Moonshotkimi-k3$3$151M
Alibabaqwen3.7-max$2.5$7.51M
ByteDancedoubao-seed-2-1-pro-260628$0.8889$4.4444256K
Zhipu AIglm-5.1$1.4$4.4200K
DeepSeekdeepseek-v4-pro$1.32$3.961M
MiniMaxMiniMax-M3$0.9$3.61M
StepFunstepaudio-2.5-chat$1.5$3.5—
Tencenthy4-preview$0.8889$2.66671M
MeituanLongCat-2.0$0.3$1.21M
Xiaomimimo-v2.5-pro$0.435$0.871M

A linha de codificação de alta velocidade de Moonshot atualmente apresenta a maior taxa de produção nesta tabela, com $8 por milhão de tokens. Tencent hy3 está na outra extremidade em $0.5926 . Essa diferença é uma alegação de preço dos fornecedores, não uma evidência da mesma disparidade de qualidade; somente os índices de conclusão de tarefas podem responder se o preço premium se justifica.

Tencent 's hy3 Merece destaque: um modelo de fornecedor principal com $0.1481 de entrada / $0.5926 de saída por milhão de tokens. A dificuldade de acesso fora da China é exatamente a lacuna que este gateway visa preencher.

Execute esses modelos você mesmo. Um único ponto de extremidade API key , OpenAI-compatible e preços transparentes em USD. Consulte a página de preços em tempo real para ver a taxa de câmbio atual.

Obtenha uma chave — crédito grátis de $2

Vídeo: por segundo versus por clipe, com cálculos reais

Os preços de vídeo se apresentam de duas formas, e compará-los exige cálculos que os fornecedores não fazem por você:

ModeloFornecedorCobrançaUm clipe representativo 5-second
happyhorse-1.1-t2vAlibaba$0.075 por segundo$0.375
wan2.7-t2vAlibaba$0.1 por segundo$0.5
MiniMax-Hailuo-2.3-FastMiniMax$0.1875 por geração$0.1875
MiniMax-Hailuo-2.3MiniMax$0.2778 por geração$0.2778
kling-v3Kuaishou$0.4799 por geração silenciosa de 5-second em 720$0.4799
kling-3.0-turboKuaishou$0.5556 por geração$0.5556

Para versões resumidas, por geração MiniMax-Hailuo-2.3-Fast é $0.1875 na configuração representativa do catálogo. A cobrança por segundo ( HappyHorse , Wan ) pode ser vantajosa quando você precisa de clipes muito curtos ou controle preciso da duração. A linha Seedance de ByteDance possui preços específicos da configuração, portanto, o conjunto de dados público marca intencionalmente as linhas sem um preço unitário representativo e aponta para os preços em tempo real.

O que escolher, de acordo com a carga de trabalho

Nossa posição, considerando apenas preços e especificações (os critérios de qualidade serão apresentados separadamente):

O que este artigo não lhe diz

Todos os 65 modelos funcionam por um único endpoint OpenAI-compatible com uma única chave. Baixe: JSON ou CSV, leia o metodologiae use o crédito gratuito $2 para verificar um preço publicado com uma solicitação real.

Experimente em ChinaAPI . Todos os modelos deste artigo estão disponíveis em um único ponto de acesso — não é necessário ter uma conta ou número de telefone da China continental, $2 você pode começar com um teste gratuito.

Comece grátis — crédito $2 Veja os preços em tempo real.
Method & data. Written by: ChinaAPI Research. Published 2026-07-06, last updated 2026-07-10. Data source: ChinaAPI public model-pricing dataset, generated from gateway-reconciled models-data.json. Standard token-model rates follow providers' international list prices at 100%; some models have a separate Paid rate after the first top-up. Media rates use the displayed billing unit and may include a service margin covering provider input/output billing, payment processing, chargeback exposure, and operations; any margin is included in the displayed rate and is not added separately. The página de preços ao vivo is authoritative.