Modelo de API Zhipu / GLM

Zhipu: glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.

Especificações

Detalhes sobre preços e API.

Preços transparentes em USD. Não é necessário ter conta ou telefone na China continental. As taxas do modelo de token são sincronizadas com o gateway e podem seguir os preços oficiais de tabela dos provedores na China, quando configurados. Os preços em tempo real são definitivos.

Janela de contexto

1M

Modalidades

Entrada de texto, imagem e vídeo

Entrada $/ 1M

$0.15

Saída $/ 1M

$0.5

Ponto final

OpenAI-compatible /v1/chat/completions

Sobre o glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.

Preços

Preços transparentes em USD.

glm-5.3-flash

$0.15/M tokens de entrada e $0.5/M tokens de saída, pagos em USD. As tarifas dos modelos de tokens são sincronizadas pelo gateway e podem seguir os preços oficiais do provedor na China quando configurado. O preço ao vivo é a referência. Veja os preços em tempo real. Acertos automáticos de cache custam $0.0300 por 1M tokens de entrada; o preço padrão de entrada acima é a tarifa para falha de cache.

Início rápido

Copiar e colar solicitação de API.

curl -X POST https://api.chinaapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $CHINAAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [
      {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ]
  }'

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["CHINAAPI_API_KEY"],
    base_url="https://api.chinaapi.ai/v1",
)

response = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[
        {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ],
)
print(response.choices[0].message.content)

Links internos

Páginas e guias relacionados ao modelo.

Como uso o glm-5.3-flash?

Use o glm-5.3-flash pela ChinaAPI com uma API key e o endpoint OpenAI-compatible mostrado acima.

Quanto custa o glm-5.3-flash?

O glm-5.3-flash custa $0.15/M tokens de entrada e $0.5/M tokens de saída, pagos em USD. A página de preços ao vivo é a referência; as tarifas são sincronizadas pelo gateway e podem seguir os preços oficiais do provedor na China quando configurado.

O glm-5.3-flash precisa de uma conta chinesa?

Não. A ChinaAPI oferece acesso sem necessidade de conta bancária ou número de telefone da China continental e inclui um período de teste gratuito de $2 Consulte os preços em tempo real para a taxa de câmbio em USD exibida.