Modelo de API Zhipu/GLM

Zhipu: glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primer modelo multimodal nativo de la familia GLM-5, orientado a programación visual y flujos de agentes. Acepta entradas de texto, imagen, vídeo y archivo, con contexto de 1M, salida de hasta 128K, razonamiento siempre activo, llamada a funciones, salida estructurada, streaming y caché de contexto.

Especificaciones

Precios y detalles de la API.

Precios transparentes en USD. No necesitas cuenta ni teléfono de China continental. Los precios Standard de los modelos siguen el 100% de los precios de lista internacionales de los proveedores; algunos modelos tienen un precio Paid distinto tras la primera recarga.

Ventana de contexto

1M

Modalidades

Entrada de texto, imagen y vídeo

Entrada $/1M

$0.15

Salida $/1M

$0.5

Punto final

OpenAI-compatible /v1/chat/completions

Acerca de glm-5.3-flash

Zhipu GLM-5.3-Flash (320B-A18B) — primer modelo multimodal nativo de la familia GLM-5, orientado a programación visual y flujos de agentes. Acepta entradas de texto, imagen, vídeo y archivo, con contexto de 1M, salida de hasta 128K, razonamiento siempre activo, llamada a funciones, salida estructurada, streaming y caché de contexto.

Precios

Precios transparentes en USD.

glm-5.3-flash

$0.15/1M tokens de entrada, $0.5/1M tokens de salida. Pago en USD. Los precios Standard de los modelos siguen el 100% de los precios de lista internacionales de los proveedores; algunos modelos tienen un precio Paid distinto tras la primera recarga. Ver precios en tiempo real Los aciertos automáticos de caché cuestan $0.0300 por 1M tokens de entrada; el precio estándar de entrada anterior es la tarifa cuando no hay acierto de caché.

Inicio rápido

Copiar y pegar la solicitud de API.

curl -X POST https://api.chinaapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $CHINAAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5.3-flash",
    "messages": [
      {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ]
  }'

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["CHINAAPI_API_KEY"],
    base_url="https://api.chinaapi.ai/v1",
)

response = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[
        {"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
    ],
)
print(response.choices[0].message.content)

Enlaces internos

Páginas y guías de modelos relacionados.

¿Cómo uso glm-5.3-flash?

Usa glm-5.3-flash a través de ChinaAPI con una API key y el endpoint OpenAI-compatible indicado arriba.

¿Cuánto cuesta glm-5.3-flash?

glm-5.3-flash: $0.15/1M tokens de entrada, $0.5/1M tokens de salida, facturado en USD. La página de precios en vivo es la referencia oficial. Tras la primera recarga, el precio Paid es $0.135/1M tokens de entrada, $0.45/1M tokens de salida (−10%). Los precios Standard de los modelos siguen el 100% de los precios de lista internacionales de los proveedores; algunos modelos tienen un precio Paid distinto tras la primera recarga.

¿Necesito una cuenta en un servicio chino para usar glm-5.3-flash?

No. ChinaAPI ofrece acceso sin una cuenta en un servicio de China continental ni un número de teléfono local e incluye $2 de crédito de prueba gratuito. Consulta el precio del servicio mostrado en USD en la página de precios actuales.