Janela de contexto
1M
Modelo de API Zhipu / GLM
Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.
Especificações
Preços transparentes em USD. Não é preciso conta nem telefone da China continental. Os preços Standard dos modelos seguem 100% dos preços de tabela internacionais dos provedores; alguns modelos têm um preço Paid separado após a primeira recarga.
1M
Entrada de texto, imagem e vídeo
$0.15
$0.5
OpenAI-compatible /v1/chat/completions
Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.
Preços
$0.15/1M tokens de entrada, $0.5/1M tokens de saída. Pagamento em USD. Os preços Standard dos modelos seguem 100% dos preços de tabela internacionais dos provedores; alguns modelos têm um preço Paid separado após a primeira recarga. Veja os preços em tempo real. Acertos automáticos de cache custam $0.0300 por 1M tokens de entrada; o preço padrão de entrada acima é a tarifa para falha de cache.
Preço Paid após a primeira recarga (entrada / saída por 1M de tokens): $0.135 / $0.45 (−10%)
Início rápido
curl -X POST https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
]
}'
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["CHINAAPI_API_KEY"],
base_url="https://api.chinaapi.ai/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flash",
messages=[
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
],
)
print(response.choices[0].message.content)
Links internos
Use glm-5.3-flash por meio da ChinaAPI com uma API key e o endpoint OpenAI-compatible mostrado acima.
glm-5.3-flash custa $0.15/1M tokens de entrada, $0.5/1M tokens de saída, com pagamento em USD. A página de preços em tempo real é a referência oficial. Após a primeira recarga, o preço Paid é $0.135/1M tokens de entrada, $0.45/1M tokens de saída (−10%). Os preços Standard dos modelos seguem 100% dos preços de tabela internacionais dos provedores; alguns modelos têm um preço Paid separado após a primeira recarga.
Não. A ChinaAPI oferece acesso sem conta em um serviço da China continental ou número de telefone local e inclui $2 de crédito de teste gratuito. Consulte o preço do serviço em USD na página de preços atuais.