Janela de contexto
1M
Modelo de API Zhipu / GLM
Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.
Especificações
Preços transparentes em USD. Não é necessário ter conta ou telefone na China continental. As taxas do modelo de token são sincronizadas com o gateway e podem seguir os preços oficiais de tabela dos provedores na China, quando configurados. Os preços em tempo real são definitivos.
1M
Entrada de texto, imagem e vídeo
$0.15
$0.5
OpenAI-compatible /v1/chat/completions
Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.
Preços
$0.15/M tokens de entrada e $0.5/M tokens de saída, pagos em USD. As tarifas dos modelos de tokens são sincronizadas pelo gateway e podem seguir os preços oficiais do provedor na China quando configurado. O preço ao vivo é a referência. Veja os preços em tempo real. Acertos automáticos de cache custam $0.0300 por 1M tokens de entrada; o preço padrão de entrada acima é a tarifa para falha de cache.
Início rápido
curl -X POST https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
]
}'
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["CHINAAPI_API_KEY"],
base_url="https://api.chinaapi.ai/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flash",
messages=[
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
],
)
print(response.choices[0].message.content)
Links internos
Use o glm-5.3-flash pela ChinaAPI com uma API key e o endpoint OpenAI-compatible mostrado acima.
O glm-5.3-flash custa $0.15/M tokens de entrada e $0.5/M tokens de saída, pagos em USD. A página de preços ao vivo é a referência; as tarifas são sincronizadas pelo gateway e podem seguir os preços oficiais do provedor na China quando configurado.
Não. A ChinaAPI oferece acesso sem necessidade de conta bancária ou número de telefone da China continental e inclui um período de teste gratuito de $2 Consulte os preços em tempo real para a taxa de câmbio em USD exibida.