Modelo de API Zhipu / GLM

Zhipu: glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.

Especificações

Detalhes sobre preços e API.

Preços transparentes em USD. Não é preciso conta nem telefone da China continental. Os preços Standard dos modelos seguem 100% dos preços de tabela internacionais dos provedores; alguns modelos têm um preço Paid separado após a primeira recarga.

Janela de contexto

1M

Modalidades

Entrada de texto, imagem e vídeo

Entrada $/1M

$0.15

Saída $/1M

$0.5

Ponto final

OpenAI-compatible /v1/chat/completions

Sobre o glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.

Preços

Preços transparentes em USD.

glm-5.3-flash

$0.15/1M tokens de entrada, $0.5/1M tokens de saída. Pagamento em USD. Os preços Standard dos modelos seguem 100% dos preços de tabela internacionais dos provedores; alguns modelos têm um preço Paid separado após a primeira recarga. Veja os preços em tempo real. Acertos automáticos de cache custam $0.0300 por 1M tokens de entrada; o preço padrão de entrada acima é a tarifa para falha de cache.

Início rápido

Copiar e colar solicitação de API.

curl -X POST https://api.chinaapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $CHINAAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [
      {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ]
  }'

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["CHINAAPI_API_KEY"],
    base_url="https://api.chinaapi.ai/v1",
)

response = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[
        {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ],
)
print(response.choices[0].message.content)

Links internos

Páginas e guias relacionados ao modelo.

Como uso o glm-5.3-flash?

Use glm-5.3-flash por meio da ChinaAPI com uma API key e o endpoint OpenAI-compatible mostrado acima.

Quanto custa o glm-5.3-flash?

glm-5.3-flash custa $0.15/1M tokens de entrada, $0.5/1M tokens de saída, com pagamento em USD. A página de preços em tempo real é a referência oficial. Após a primeira recarga, o preço Paid é $0.135/1M tokens de entrada, $0.45/1M tokens de saída (−10%). Os preços Standard dos modelos seguem 100% dos preços de tabela internacionais dos provedores; alguns modelos têm um preço Paid separado após a primeira recarga.

Preciso de uma conta em um serviço chinês para usar glm-5.3-flash?

Não. A ChinaAPI oferece acesso sem conta em um serviço da China continental ou número de telefone local e inclui $2 de crédito de teste gratuito. Consulte o preço do serviço em USD na página de preços atuais.