컨텍스트 창
1M
Zhipu/GLM API 모델
Zhipu GLM-5.3-Flash (320B-A18B) — GLM-5 제품군 최초의 네이티브 멀티모달 모델로, 비주얼 코딩과 에이전트 워크플로를 위해 설계되었습니다. 텍스트, 이미지, 동영상, 파일 입력을 지원하며 1M 컨텍스트 창, 최대 128K 출력, 상시 활성화된 추론, 함수 호출, 구조화 출력, 스트리밍, 컨텍스트 캐싱을 제공합니다.
명세서
투명한 USD 가격 책정. 중국 본토 계정이나 전화번호는 필요하지 않습니다. 토큰 모델 요금은 게이트웨이에서 동기화되며, 설정된 경우 제공업체의 공식 중국 정가표를 따릅니다. 실시간 가격이 가장 신뢰할 수 있습니다.
1M
텍스트, 이미지 및 비디오 입력
$0.15
$0.5
OpenAI-compatible /v1/chat/completions
Zhipu GLM-5.3-Flash (320B-A18B) — GLM-5 제품군 최초의 네이티브 멀티모달 모델로, 비주얼 코딩과 에이전트 워크플로를 위해 설계되었습니다. 텍스트, 이미지, 동영상, 파일 입력을 지원하며 1M 컨텍스트 창, 최대 128K 출력, 상시 활성화된 추론, 함수 호출, 구조화 출력, 스트리밍, 컨텍스트 캐싱을 제공합니다.
가격
입력 $0.15/M, 출력 $0.5/M tokens이며 USD로 결제합니다. 토큰 모델 요금은 게이트웨이에서 동기화되며 설정된 경우 제공업체의 중국 공식 가격을 따를 수 있습니다. 실시간 가격이 기준입니다. 실시간 가격 보기 자동 캐시 적중은 입력 1M tokens당 $0.0300로 과금되며, 위의 표준 입력 가격은 캐시 미스 요금입니다.
빠른 시작
curl -X POST https://api.chinaapi.ai/v1/chat/completions \
-H "Authorization: Bearer $CHINAAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3-flash",
"messages": [
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
]
}'
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["CHINAAPI_API_KEY"],
base_url="https://api.chinaapi.ai/v1",
)
response = client.chat.completions.create(
model="glm-5.3-flash",
messages=[
{"role": "user", "content": "Summarize the main tradeoffs for this API workload."}
],
)
print(response.choices[0].message.content)
내부 링크
API key와 위에 표시된 OpenAI-compatible 엔드포인트로 ChinaAPI에서 glm-5.3-flash를 사용합니다.
glm-5.3-flash는 입력 $0.15/M, 출력 $0.5/M tokens이며 USD로 결제합니다. 실시간 가격 페이지가 기준이며, 토큰 모델 요금은 게이트웨이에서 동기화되고 설정된 경우 제공업체의 중국 공식 가격을 따를 수 있습니다.
아니요. ChinaAPI는 중국 본토 계정이나 전화번호 없이도 접속할 수 있으며, $2 무료 체험판을 제공합니다. 표시된 미국 달러 환율은 실시간 가격 정보를 확인하세요.