ChinaAPI 인사이트 · 가격
중국 AI API 가격 현황 - 2026 7월
7월 2026 LLM 이미지 및 비디오 API 비용은 얼마일까요? $0.20 등급, 1M-context 등급, 초당 비용과 생성 1회당 비용 계산 방식, 그리고 작업 부하에 따라 어떤 API를 선택해야 할까요?
중국 모델 공급업체들은 지난 분기 동안 서로 가격 경쟁을 벌였고, 그 결과 세계에서 가장 저렴한 API 인접 시장이 형성되었습니다. 이 분석은 현재 다음을 포함합니다. 68 들은 저희 게이트웨이에 있습니다.: 30 LLMs 및 38 이미지/비디오 모델. 아래의 모든 가격은 다음을 기반으로 생성됩니다. 당사의 공개 가격 데이터 세트 수동으로 이 문서에 복사한 것이 아닙니다. 데이터셋 수정: 2026-08-10 ; 가격 정보: c59b3d55d9fea19c.
솔직히 미리 한 가지 주의사항을 말씀드리겠습니다. 가격이 품질을 보장하는 것은 아닙니다. 이 글에서는 각 항목의 가격을 알려드립니다. 저희 벤치마크 시리즈(동일한 게이트웨이를 통해 측정된 모델별 작업 완료율)는 해당 항목의 가치를 알려주는 자료입니다.
$0.20 미만 입력 단계
6 모델은 백만 입력 토큰당 $0.20 미만의 비용을 청구합니다. 이 등급 내에서 중요한 비교 기준은 출력 비용입니다. 입력 비용이 동일하게 저렴한 두 모델이라도 긴 답변을 생성하기 시작하면 성능 차이가 크게 발생할 수 있습니다.
| 모델 | 공급업체 | 입력 / 1M | 출력 / 1M | 문맥 |
|---|---|---|---|---|
| step-3.5-flash | StepFun | $0.1 | $0.3 | 256K |
| step-3.5-flash-2603 | StepFun | $0.1 | $0.3 | 256K |
| deepseek-v4-flash | DeepSeek | $0.14 | $0.28 | 1M |
| mimo-v2.5 | Xiaomi | $0.14 | $0.28 | 1M |
| hy3 | Tencent | $0.1538 | $0.6154 | 256K |
| qwen3.6-flash | Alibaba | $0.1846 | $1.1077 | 1M |
두 가지가 눈에 띕니다. 첫째, deepseek-v4-flash 그리고 Xiaomi 의 mimo-v2.5 현재 동일한 공개 입력 및 출력률을 가지고 있습니다. 둘째, 지켜보세요. 산출 가격, 단순히 투입량만이 아니라: qwen3.6-flash 동일한 저투입 계층에 속하지만 출력률은 $1.1077 이고, 의 출력률은 $0.28 입니다. deepseek-v4-flash그 격차는 생성 작업량이 많은 워크로드에서 두드러지게 나타납니다.
1M-context 클럽
현재 카탈로그의 13 중 30 LLMs 에 1M-token 창을 게시합니다. qwen3.6-flash, qwen3.6-plus, qwen3.7-max, qwen3.7-plus, qwen3.8-max, deepseek-v4-flash, deepseek-v4-pro, LongCat-2.0, MiniMax-M3, kimi-k3, mimo-v2.5, mimo-v2.5-pro, glm-5.21년 전만 1M 맥락은 프리미엄 기능이었지만, 중국 시장에서는 이제 기본 조건이 되고 있습니다.
백만 컨텍스트 모델 중에서 가장 저렴한 공개 입력률은 다음과 같습니다. deepseek-v4-flash 백만 개의 입력 토큰당 $0.14 입니다. 가장 흥미로운 장문맥 항목은 Meituan 의 것입니다. LongCat-2.0: 전체 1M 창을 사용하는 $0.3 입력/ $1.2 출력의 개방형 MoE 추론 모델 — 플래그십급 사양을 플래시급 가격으로 제공합니다.
벤더별 플래그십 제품 가격
각 공급업체의 최고 공개 가격을 기준으로 산출 현재 교재 목록에서 가격을 품질 순위가 아닌 일관된 지표로 사용하여 다음과 같은 비교를 수행했습니다.
| 공급업체 | 가장 비싼 텍스트 모델 | 입력 / 1M | 출력 / 1M | 문맥 |
|---|---|---|---|---|
| Moonshot | kimi-k3 | $2.7397 | $13.6986 | 1M |
| StepFun | step-1o-audio | $3.85 | $9.24 | — |
| Alibaba | qwen3.7-max | $2.5 | $7.5 | 1M |
| ByteDance | doubao-seed-2-1-pro-260628 | $0.9231 | $4.6154 | 256K |
| Zhipu AI | glm-5-turbo | $1.2 | $4.4571 | 200K |
| MiniMax | MiniMax-M2.7-highspeed | $0.5753 | $2.3014 | 200K |
| Meituan | LongCat-2.0 | $0.3 | $1.2 | 1M |
| DeepSeek | deepseek-v4-pro | $0.435 | $0.87 | 1M |
| Xiaomi | mimo-v2.5-pro | $0.435 | $0.87 | 1M |
| Tencent | hy3 | $0.1538 | $0.6154 | 256K |
Moonshot 의 고속 코딩 라인은 현재 이 표에서 백만 토큰당 $7.3973 의 가장 높은 출력 속도를 자랑합니다. Tencent 의 hy3 반대쪽 끝에는 $0.6154 있습니다. 그 차이는 판매자가 제시하는 가격일 뿐, 품질 차이가 동일하다는 증거는 아닙니다. 프리미엄이 유효한지 여부는 작업 완료 벤치마크를 통해서만 확인할 수 있습니다.
Tencent 's hy3 주목할 만한 점은 백만 토큰당 $0.1538 입력/ $0.6154 출력의 주요 공급업체 모델이라는 것입니다. 중국 외 지역에서의 접근성 문제는 바로 이 게이트웨이가 해결하고자 하는 격차입니다.
이 모델들을 직접 실행해 보세요. API key OpenAI-compatible 엔드포인트와 투명한 USD 가격 책정 방식을 제공합니다. 현재 표시되는 환율은 실시간 가격 페이지에서 확인하세요.
열쇠를 받으세요 — $2 무료 크레딧 제공동영상: 초당 vs 클립당, 실제 계산 결과 포함
영상 콘텐츠 가격은 두 가지 형태로 제공되며, 이를 비교하려면 업체에서 대신 계산해주지 않는 계산 작업이 필요합니다.
| 모델 | 공급업체 | 청구 | 5-second 대표적인 클립 |
|---|---|---|---|
| happyhorse-1.1-t2v | Alibaba | 초당 $0.075 | $0.375 |
| wan2.7-t2v | Alibaba | 초당 $0.1 | $0.5 |
| MiniMax-Hailuo-2.3-Fast | MiniMax | 생성 1회당 $0.1875 | $0.1875 |
| MiniMax-Hailuo-2.3 | MiniMax | 생성 1회당 $0.2778 | $0.2778 |
| kling-v3 | Kuaishou | 5-second 720p 무음 생성 1회당 $0.4799 | $0.4799 |
| kling-3.0-turbo | Kuaishou | 생성 1회당 $0.5556 | $0.5556 |
짧은 초안의 경우 생성별로 MiniMax-Hailuo-2.3-Fast 대표 카탈로그 구성에서 $0.1875 입니다. 초 단위 요금( HappyHorse , Wan )은 매우 짧은 클립이나 정확한 시간 제어가 필요한 경우에 유리할 수 있습니다. ByteDance 의 Seedance 라인은 구성별 가격이 적용되므로 공개 데이터 세트는 대표 단가가 없는 행을 의도적으로 표시하고 대신 실시간 가격을 가리킵니다.
업무량에 따라 무엇을 선택해야 할까요?
가격 및 사양만을 기준으로 한 저희의 입장은 다음과 같습니다(품질 기준은 별도로 제시됩니다).
- 대량 추출, 분류, RAG:
deepseek-v4-flash또는mimo-v2.5— 둘 다 현재 1M 창을 사용하여 $0.14 /M 입력을 게시합니다. - 예산이 부족한 장기 서류 담당 에이전트:
LongCat-2.0— 1M $0.3 / $1.2 출력에서 컨텍스트 및 추론에 맞춰 조정됩니다. - 다중 모달 에이전트 루프(이미지 및 비디오 입력):
MiniMax-M3— 제조사에서 공개한 사양에 따르면 현재 이 카탈로그에서 유일하게 1M-context 멀티모달 기능을 지원하는 모델입니다. - 생성별 대표 행 사이의 저비용 비디오 초안:
MiniMax-Hailuo-2.3-Fast현재 생성 1회당 $0.1875 입니다. - 프리미엄 코딩: Moonshot 's
kimi-k2.7-code해당 라인은 가격 이상치입니다. 지출을 확정하기 전에 자체 저장소에서 벤치마킹해 보세요.
이 기사가 알려주지 않는 것
- 품질. 작업을 두 번 실패하는 저가형 모델은 한 번 성공하는 고급형 모델보다 비용이 더 많이 들 수 있습니다. 저희의 작업 완료 벤치마크는 이러한 문제를 해결하는 데 도움을 주는 도구입니다.
- 하중을 받을 때의 안정성. 중국 업체 API는 사용량 제한 및 피크 시간대 동작 방식이 다양합니다. 저희는 게이트웨이 계층에서 이러한 차이를 일부 우회하고 있지만, 아직 구체적인 수치는 공개하지 않았습니다.
- 내일 가격. 판매업체들은 가격을 공격적으로 조정합니다(대개 인하하지만, 때때로 프로모션 후 원래 가격으로 되돌리기도 합니다). 이제 모든 가격 변동을 기록해 두었으므로, 향후 이 기사에서는 스냅샷뿐만 아니라 가격 추세선도 함께 보여줄 예정입니다.
모든 68 모델은 단일 키를 사용하는 하나의 OpenAI-compatible 엔드포인트 뒤에서 실행됩니다. 다운로드하세요. JSON 또는 CSV읽어보세요 방법론그리고 $2 무료 크레딧을 사용하여 실제 요청으로 게시된 가격을 검증해 보세요.
ChinaAPI 입어보세요. 이 기사에 소개된 모든 모델은 단일 엔드포인트에서 실행됩니다. 중국 본토 계정이나 전화번호는 필요하지 않으며, $2 체험으로 시작할 수 있습니다.
무료로 시작하세요 — $2 크레딧 실시간 가격 보기