ChinaAPI · Preços
Panorama de preços de APIs de IA na China — julho 2026
Quanto custam as APIs LLM de imagem e vídeo em 2026 — o $0.20 , o 1M-context , cálculos de vídeo por segundo versus por geração e qual escolher de acordo com a carga de trabalho.
Os fabricantes chineses de modelos passaram o último trimestre competindo entre si em preços cada vez mais baixos, resultando no mercado adjacente API fronteira mais barato do mundo. Esta análise abrange atualmente [aqui falta informação sobre a análise]. 68 modelos estão disponíveis em nosso portal: 30 LLMs e 38 modelos de imagem/vídeo. Todos os preços abaixo são gerados a partir de nosso conjunto de dados de preços públicos em vez de serem copiados manualmente para este artigo. Revisão do conjunto de dados: 2026-08-10 ; impressão digital de preços: c59b3d55d9fea19c.
Uma ressalva sincera logo de início: Preço não é sinônimo de qualidade. Este artigo informa o custo das coisas; nossa série de benchmarks (taxas de conclusão de tarefas por modelo, medidas através deste mesmo portal) é o complemento que indica o seu valor.
A faixa de entrada abaixo de US $0.20
6 modelos cobram menos de $0.20 por milhão de tokens de entrada. A comparação importante dentro deste nível é o custo de saída: dois modelos com a mesma taxa de entrada barata podem divergir drasticamente quando começam a gerar respostas longas.
| Modelo | Fornecedor | Entrada / 1M | Saída / 1M | Contexto |
|---|---|---|---|---|
| step-3.5-flash | StepFun | $0.1 | $0.3 | 256K |
| step-3.5-flash-2603 | StepFun | $0.1 | $0.3 | 256K |
| deepseek-v4-flash | DeepSeek | $0.14 | $0.28 | 1M |
| mimo-v2.5 | Xiaomi | $0.14 | $0.28 | 1M |
| hy3 | Tencent | $0.1538 | $0.6154 | 256K |
| qwen3.6-flash | Alibaba | $0.1846 | $1.1077 | 1M |
Duas coisas se destacam. Primeiro, deepseek-v4-flash e Xiaomi 's mimo-v2.5 Atualmente, possuem as mesmas taxas de entrada e saída publicadas. Em segundo lugar, observe saída Preços, não apenas insumos: qwen3.6-flash situa-se no mesmo nível de baixo insumo, mas sua taxa de produção é $1.1077 , em comparação com $0.28 para deepseek-v4-flashEssa lacuna predomina em cargas de trabalho que exigem muita geração de dados.
O clube 1M-context
13 dos 30 LLMs no catálogo atual publicam uma 1M-token janela de contexto: qwen3.6-flash, qwen3.6-plus, qwen3.7-max, qwen3.7-plus, qwen3.8-max, deepseek-v4-flash, deepseek-v4-pro, LongCat-2.0, MiniMax-M3, kimi-k3, mimo-v2.5, mimo-v2.5-pro, glm-5.2Há um ano 1M contexto era um recurso premium; no mercado chinês, está se tornando um requisito básico.
A taxa de entrada mais barata publicada entre esses modelos de um milhão de contextos é representada por deepseek-v4-flash a $0.14 por milhão de tokens de entrada. A entrada de contexto longo mais interessante é a de Meituan LongCat-2.0: um modelo de raciocínio MoE aberto com entrada $0.3 / saída $1.2 e janela 1M completa — especificações de ponta a preços de nível flash.
Preços de referência por fornecedor
Considerando o preço mais alto publicado por cada fornecedor saída O preço no catálogo de textos atual, usado como um indicador consistente — e não como uma classificação de qualidade —, produz esta comparação:
| Fornecedor | Modelo de texto de preço mais elevado | Entrada / 1M | Saída / 1M | Contexto |
|---|---|---|---|---|
| Projeto Moonshot | kimi-k3 | $2.7397 | $13.6986 | 1M |
| StepFun | step-1o-audio | $3.85 | $9.24 | — |
| Alibaba | qwen3.7-max | $2.5 | $7.5 | 1M |
| ByteDance | doubao-seed-2-1-pro-260628 | $0.9231 | $4.6154 | 256K |
| Zhipu AI | glm-5-turbo | $1.2 | $4.4571 | 200K |
| MiniMax | MiniMax-M2.7-highspeed | $0.5753 | $2.3014 | 200K |
| Meituan | LongCat-2.0 | $0.3 | $1.2 | 1M |
| DeepSeek | deepseek-v4-pro | $0.435 | $0.87 | 1M |
| Xiaomi | mimo-v2.5-pro | $0.435 | $0.87 | 1M |
| Tencent | hy3 | $0.1538 | $0.6154 | 256K |
A linha de codificação de alta velocidade de Moonshot atualmente apresenta a maior taxa de produção nesta tabela, com $7.3973 por milhão de tokens. Tencent hy3 está na outra extremidade em $0.6154 . Essa diferença é uma alegação de preço dos fornecedores, não uma evidência da mesma disparidade de qualidade; somente os índices de conclusão de tarefas podem responder se o preço premium se justifica.
Tencent 's hy3 Merece destaque: um modelo de fornecedor principal com $0.1538 de entrada / $0.6154 de saída por milhão de tokens. A dificuldade de acesso fora da China é exatamente a lacuna que este gateway visa preencher.
Execute esses modelos você mesmo. Um único ponto de extremidade API key , OpenAI-compatible e preços transparentes em USD. Consulte a página de preços em tempo real para ver a taxa de câmbio atual.
Obtenha uma chave — crédito grátis de $2Vídeo: por segundo versus por clipe, com cálculos reais
Os preços de vídeo se apresentam de duas formas, e compará-los exige cálculos que os fornecedores não fazem por você:
| Modelo | Fornecedor | Cobrança | Um clipe representativo 5-second |
|---|---|---|---|
| happyhorse-1.1-t2v | Alibaba | $0.075 por segundo | $0.375 |
| wan2.7-t2v | Alibaba | $0.1 por segundo | $0.5 |
| MiniMax-Hailuo-2.3-Fast | MiniMax | $0.1875 por geração | $0.1875 |
| MiniMax-Hailuo-2.3 | MiniMax | $0.2778 por geração | $0.2778 |
| kling-v3 | Kuaishou | $0.4799 por geração silenciosa de 5-second em 720 | $0.4799 |
| kling-3.0-turbo | Kuaishou | $0.5556 por geração | $0.5556 |
Para versões resumidas, por geração MiniMax-Hailuo-2.3-Fast é $0.1875 na configuração representativa do catálogo. A cobrança por segundo ( HappyHorse , Wan ) pode ser vantajosa quando você precisa de clipes muito curtos ou controle preciso da duração. A linha Seedance de ByteDance possui preços específicos da configuração, portanto, o conjunto de dados público marca intencionalmente as linhas sem um preço unitário representativo e aponta para os preços em tempo real.
O que escolher, de acordo com a carga de trabalho
Nossa posição, considerando apenas preços e especificações (os critérios de qualidade serão apresentados separadamente):
- Extração em massa, classificação RAG pré-processamento:
deepseek-v4-flashoumimo-v2.5— ambos publicam atualmente $0.14 /M entrada com uma 1M janela. - Agentes de documentos longos com orçamento limitado:
LongCat-2.0— 1M contexto e raciocínio ajustados em $0.3 entrada / $1.2 saída. - Loops de agentes multimodais (entrada de imagem e vídeo):
MiniMax-M3— de acordo com as especificações publicadas pelos próprios fornecedores, é atualmente o único modelo 1M-context multimodal neste catálogo. - Rascunhos de vídeo de baixo custo entre as linhas representativas por geração:
MiniMax-Hailuo-2.3-Fast, atualmente $0.1875 por geração. - Codificação Premium: Moonshot 's
kimi-k2.7-codeA linha representa um valor discrepante. Compare-a com seu próprio repositório antes de efetuar o pagamento.
O que este artigo não lhe diz
- Qualidade. Um modelo barato que falha na sua tarefa duas vezes pode custar mais do que um modelo premium que a executa com sucesso apenas uma vez. Nosso parâmetro de conclusão de tarefas é o complemento perfeito para isso.
- Estabilidade sob carga. As APIs de fornecedores chineses variam em termos de limites de taxa e comportamento em horários de pico; contornamos parte disso na camada de gateway, mas ainda não publicamos os números.
- Preços de amanhã. Os vendedores renegociam os preços agressivamente (geralmente para baixo, ocasionalmente com promoções seguidas de reversão). Agora, registramos cada alteração de preço, portanto, as futuras edições deste artigo mostrarão linhas de tendência, e não apenas um instantâneo.
Todos 68 modelos são executados por meio de um OpenAI-compatible endpoint com uma única chave. Baixe o JSON ou CSV, leia o metodologiae use o crédito gratuito $2 para verificar um preço publicado com uma solicitação real.
Experimente em ChinaAPI . Todos os modelos deste artigo estão disponíveis em um único ponto de acesso — não é necessário ter uma conta ou número de telefone da China continental, $2 você pode começar com um teste gratuito.
Comece grátis — crédito $2 Veja os preços em tempo real.