<!-- GENERATED BY scripts/gen_localization_release.py; DO NOT EDIT; source: pt-br/models/glm-5.3-flash/index.html -->

# Zhipu: glm-5.3-flash

> Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto. 1M context. $0.15/M input, $0.5/M output tokens in USD. One OpenAI-compatible endpoint, $2 free trial.

- Canonical page: https://chinaapi.ai/pt-br/models/glm-5.3-flash/
- Human-readable page: https://chinaapi.ai/pt-br/models/glm-5.3-flash/
- Live pricing: https://dash.chinaapi.ai/pricing?lang=pt-br&utm_source=chinaapi&utm_medium=markdown&utm_campaign=glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.

[Comece grátis — crédito $2](https://dash.chinaapi.ai/register?lang=pt-br&utm_source=chinaapi&utm_medium=model&utm_campaign=glm-5.3-flash)

[Veja os preços em tempo real.](https://dash.chinaapi.ai/pricing?lang=pt-br&utm_source=chinaapi&utm_medium=model&utm_campaign=glm-5.3-flash)

## Detalhes sobre preços e API.

Preços transparentes em USD. Não é necessário ter conta ou telefone na China continental. As taxas do modelo de token são sincronizadas com o gateway e podem seguir os preços oficiais de tabela dos provedores na China, quando configurados. Os preços em tempo real são definitivos.

### Janela de contexto

1M

### Modalidades

Entrada de texto, imagem e vídeo

### Entrada $/ 1M

$0.15

### Saída $/ 1M

$0.5

### Ponto final

OpenAI-compatible `/v1/chat/completions`

## Sobre o glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primeiro modelo multimodal nativo da família GLM-5, voltado a programação visual e fluxos de agentes. Aceita entradas de texto, imagem, vídeo e arquivo, com contexto de 1M, saída de até 128K, raciocínio sempre ativo, chamada de funções, saída estruturada, streaming e cache de contexto.

## Preços transparentes em USD.

### glm-5.3-flash

$0.15/M tokens de entrada e $0.5/M tokens de saída, pagos em USD. As tarifas dos modelos de tokens são sincronizadas pelo gateway e podem seguir os preços oficiais do provedor na China quando configurado. O preço ao vivo é a referência. [Veja os preços em tempo real.](https://dash.chinaapi.ai/pricing?lang=pt-br&utm_source=chinaapi&utm_medium=model&utm_campaign=glm-5.3-flash) Acertos automáticos de cache custam $0.0300 por 1M tokens de entrada; o preço padrão de entrada acima é a tarifa para falha de cache.

## Copiar e colar solicitação de API.

```
curl -X POST https://api.chinaapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $CHINAAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [
      {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ]
  }'

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["CHINAAPI_API_KEY"],
    base_url="https://api.chinaapi.ai/v1",
)

response = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[
        {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ],
)
print(response.choices[0].message.content)
```

## Páginas e guias relacionados ao modelo.

[Diretório de modelos Veja todos os modelos](https://chinaapi.ai/pt-br/models/)

[Preços em tempo real Preços atuais do painel de controle](https://dash.chinaapi.ai/pricing?lang=pt-br&utm_source=chinaapi&utm_medium=model&utm_campaign=glm-5.3-flash)

[GLM API acesso Abrir guia](https://chinaapi.ai/pt-br/models/glm-5-2-api-access/)

[glm-5.1 200K contexto, $1.4 /M entrada, $4.4 /M tokens de saída](https://chinaapi.ai/pt-br/models/glm-5.1/)

[glm-5-turbo 200K contexto, $1.2 /M entrada, $4.4571 /M tokens de saída](https://chinaapi.ai/pt-br/models/glm-5-turbo/)

[glm-5.2 1M contexto, $1.4 /M entrada, $4.4 /M tokens de saída](https://chinaapi.ai/pt-br/models/glm-5.2/)

[glm-5.3 Contexto de 1M, $1.12/M entrada, $3.52/M saída tokens](https://chinaapi.ai/pt-br/models/glm-5.3/)

## Como uso o glm-5.3-flash?

Use o glm-5.3-flash pela ChinaAPI com uma API key e o endpoint OpenAI-compatible mostrado acima.

## Quanto custa o glm-5.3-flash?

O glm-5.3-flash custa $0.15/M tokens de entrada e $0.5/M tokens de saída, pagos em USD. A página de preços ao vivo é a referência; as tarifas são sincronizadas pelo gateway e podem seguir os preços oficiais do provedor na China quando configurado.

## O glm-5.3-flash precisa de uma conta chinesa?

Não. A ChinaAPI oferece acesso sem necessidade de conta bancária ou número de telefone da China continental e inclui um período de teste gratuito de $2 Consulte os preços em tempo real para a taxa de câmbio em USD exibida.

---

Markdown twin of https://chinaapi.ai/pt-br/models/glm-5.3-flash/ — generated from its canonical HTML by scripts/gen_localization_release.py. Full site reference: https://chinaapi.ai/llms-full.txt
