Ventana de contexto
1M
Modelo de API Zhipu/GLM
Zhipu GLM-5.3-Flash (320B-A18B) — primer modelo multimodal nativo de la familia GLM-5, orientado a programación visual y flujos de agentes. Acepta entradas de texto, imagen, vídeo y archivo, con contexto de 1M, salida de hasta 128K, razonamiento siempre activo, llamada a funciones, salida estructurada, streaming y caché de contexto.
Especificaciones
Precios transparentes en USD. No se requiere cuenta ni teléfono en China continental. Las tarifas del modelo de token se sincronizan desde la pasarela de pago y, si están configuradas, pueden seguir los precios oficiales de la lista de China de los proveedores. Los precios en tiempo real son los que prevalecen.
1M
Entrada de texto, imagen y vídeo
$0.15
$0.5
OpenAI-compatible /v1/chat/completions
Zhipu GLM-5.3-Flash (320B-A18B) — primer modelo multimodal nativo de la familia GLM-5, orientado a programación visual y flujos de agentes. Acepta entradas de texto, imagen, vídeo y archivo, con contexto de 1M, salida de hasta 128K, razonamiento siempre activo, llamada a funciones, salida estructurada, streaming y caché de contexto.
Precios
$0.15/M tokens de entrada y $0.5/M tokens de salida, pagados en USD. Las tarifas de modelos de tokens se sincronizan desde el gateway y pueden seguir los precios oficiales del proveedor en China cuando se configuren. El precio en vivo es la referencia. Ver precios en tiempo real Los aciertos automáticos de caché cuestan $0.0300 por 1M tokens de entrada; el precio estándar de entrada anterior es la tarifa cuando no hay acierto de caché.
Inicio rápido
curl -X POST https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
]
}'
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["CHINAAPI_API_KEY"],
base_url="https://api.chinaapi.ai/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flash",
messages=[
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
],
)
print(response.choices[0].message.content)
Enlaces internos
Usa glm-5.3-flash mediante ChinaAPI con una API key y el endpoint OpenAI-compatible indicado arriba.
glm-5.3-flash cuesta $0.15/M tokens de entrada y $0.5/M tokens de salida, pagados en USD. La página de precios en vivo es la referencia; las tarifas se sincronizan desde el gateway y pueden seguir los precios oficiales del proveedor en China cuando se configuren.
No. ChinaAPI permite el acceso sin necesidad de una cuenta o número de teléfono de China continental e incluye una prueba gratuita de $2 . Consulta los precios en tiempo real para ver la tarifa en USD.