Fenêtre de contexte
1M
Modèle API Zhipu / GLM
Zhipu GLM-5.3-Flash (320B-A18B) — premier modèle multimodal natif de la famille GLM-5, destiné au code visuel et aux workflows d’agents. Il accepte le texte, les images, la vidéo et les fichiers, avec un contexte de 1 M, une sortie jusqu’à 128 K, le raisonnement toujours activé, l’appel de fonctions, la sortie structurée, le streaming et la mise en cache du contexte.
Specs
Tarifs transparents en USD. Aucun compte ni numéro chinois requis. Les tarifs Standard des modèles suivent à 100 % les prix catalogue internationaux des fournisseurs ; certains modèles ont un tarif Paid distinct après le premier rechargement.
1M
Entrées texte, image et vidéo
$0.15
$0.5
Compatible OpenAI /v1/chat/completions
Zhipu GLM-5.3-Flash (320B-A18B) — premier modèle multimodal natif de la famille GLM-5, destiné au code visuel et aux workflows d’agents. Il accepte le texte, les images, la vidéo et les fichiers, avec un contexte de 1 M, une sortie jusqu’à 128 K, le raisonnement toujours activé, l’appel de fonctions, la sortie structurée, le streaming et la mise en cache du contexte.
Tarifs
$0.15/1M tokens en entrée, $0.5/1M en sortie. Paiement en USD. Les tarifs Standard des modèles suivent à 100 % les prix catalogue internationaux des fournisseurs ; certains modèles ont un tarif Paid distinct après le premier rechargement. Voir les tarifs en direct Les accès au cache automatique sont facturés 0,0300 $ par million de tokens d'entrée ; le tarif d'entrée standard ci-dessus correspond à un cache manqué.
Prix Paid après le premier rechargement (entrée / sortie par million de tokens) : $0.135 / $0.45 (−10%)
Prise en main
curl -X POST https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
]
}'
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["CHINAAPI_API_KEY"],
base_url="https://api.chinaapi.ai/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flash",
messages=[
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
],
)
print(response.choices[0].message.content)
Liens utiles
Créez une clé API sur ChinaAPI et pointez vers l'endpoint compatible OpenAI indiqué sur cette page : glm-5.3-flash fonctionne immédiatement.
glm-5.3-flash : $0.15/1M tokens en entrée, $0.5/1M en sortie, facturé en USD. La page des tarifs en direct fait foi. Après le premier rechargement, le prix Paid est de $0.135/1M tokens en entrée, $0.45/1M en sortie (−10%). Les tarifs Standard des modèles suivent à 100 % les prix catalogue internationaux des fournisseurs ; certains modèles ont un tarif Paid distinct après le premier rechargement.
Non. ChinaAPI fonctionne sans compte ni numéro de téléphone chinois et offre 2 $ de crédit d'essai. Consultez le tarif USD affiché sur la page des tarifs en direct.