모델 업데이트 벽

중국 AI의 새로운 출시 소식.

중국 AI 모델 출시를 출처 링크와 함께 간결하게 정리하고, ChinaAPI 제공 여부를 한눈에 보여줍니다. 소스 데이터에는 추정 날짜 3건과 미확인 날짜 5건이 표시되어 있습니다.

최신순

벽을 풀어주세요.

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 출처 · mimo.mi.com
Xiaomi는 MiMo-V2.6-Pro의 옴니모달 입력, 플래그십 추론 성능, 1M-token context window 및 128K 출력 한도를 유지하는 저지연 서비스 tier를 출시했습니다. Xiaomi는 표준 Pro 서비스보다 최대 20배 빠른 출력 속도를 제공한다고 밝히며, RPM과 TPM은 맞춤형 서비스로 제공됩니다. 공식 API model ID는 mimo-v2.6-pro-ultraspeed입니다. ChinaAPI는 이 경로를 고객 호출용으로 제공하고 있습니다. 현재 요금은 실시간 카탈로그를 확인하세요.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 출처 · mimo.mi.com
Xiaomi는 복잡한 프로젝트, 장기 작업, 사이버 보안 및 연구를 위한 네이티브 옴니모달 플래그십 추론 모델을 출시했습니다. MiMo-V2.6-Pro는 텍스트, 이미지, 비디오 및 오디오를 입력으로 받아 텍스트를 출력하며, 1M-token context window와 최대 128K 출력을 제공합니다. 또한 deep thinking, tool calling, streaming, web search, structured output 및 context caching을 지원합니다. 공식 API model ID는 mimo-v2.6-pro입니다. ChinaAPI는 이제 이 route를 고객에게 제공합니다. 현재 가격은 live catalog를 확인하세요.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 출처 · mimo.mi.com
Xiaomi는 전문 업무의 빈번한 호출과 대규모 작업을 더 낮은 비용으로 처리하도록 최적화한 네이티브 옴니모달 추론 모델을 출시했습니다. MiMo-V2.6-Flash는 텍스트, 이미지, 비디오 및 오디오를 입력으로 받아 텍스트를 출력하며, 1M-token context window와 최대 128K 출력을 제공합니다. 또한 deep thinking, tool calling, streaming, web search, structured output 및 context caching을 지원합니다. 공식 API model ID는 mimo-v2.6-flash입니다. ChinaAPI는 이제 이 route를 고객에게 제공합니다. 현재 가격은 live catalog를 확인하세요.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API 출처 · mimo.mi.com
Xiaomi는 mimo-v2.6-pro와 mimo-v2.6-flash를 위한 비동기 Batch API 추론을 실시간 API 가격의 50%로 출시했습니다. 이 서비스는 평가, 라벨링, 대량 생성과 같은 비실시간 작업을 위해 설계되었으며 JSONL 요청을 받고 streaming 없이 OpenAI Chat Completions, OpenAI Responses 및 Anthropic Messages 요청 형식을 지원합니다. ChinaAPI는 두 실시간 모델 route를 제공하지만, 이것이 Xiaomi의 별도 Batch API 지원을 의미하지는 않습니다.
2026-09-22
Not on ChinaAPI confirmed
StepFun은 2026-09-20 소프트웨어 엔지니어링, 장기 실행 Agent 작업, 전문 지식 업무와 금융을 위한 플래그십 모델 Step 5 Preview를 출시했습니다. 이 sparse Mixture-of-Experts 모델은 총 600B 파라미터 중 token당 27B를 활성화하며 1M-token 컨텍스트를 지원합니다. 공식 API model ID는 step-5-preview입니다. 텍스트·이미지·비디오를 입력하고 텍스트를 출력하며 최대 64K output tokens를 지원합니다. API는 streaming, tool calling, JSON Mode, JSON Schema, low/medium/high reasoning effort, prompt caching도 지원합니다. StepFun은 Artificial Analysis Intelligence Index 44점과 coding, Agent, 금융, multimodal benchmark 결과를 공개했지만, 이는 ChinaAPI 실측이 아닌 벤더 결과입니다. StepFun은 2026-10-15 open weights 공개를 예고했습니다. ChinaAPI live catalog는 이제 고객이 호출할 수 있는 step-5-preview route를 벤더 정가인 input $1.00/M, output $2.70/M, prompt-cache read $0.05/M에 제공합니다. 최신 가격은 live Gateway를 기준으로 합니다.
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image 출처 · github.com
Qwen은 2026-09-20에 Qwen-Image-2.1 가중치를 공개했습니다. 7B 매개변수의 이미지 생성 구성 요소는 텍스트 기반 이미지 생성과 이미지 편집을 통합하며, 기본 RGBA 투명도, 최대 10장의 참조 이미지, 국소 편집, 2K 출력을 지원합니다. 이는 Qwen이 발표한 기능이며 ChinaAPI의 자체 시험 결과는 아닙니다. 가중치에는 Qwen Research License가 적용되어 별도의 상업용 라이선스가 없으면 비상업적 연구와 평가에만 사용할 수 있습니다. Alibaba Model Studio는 Qwen-Image-2.1의 API model ID와 요금을 발표하지 않았고 ChinaAPI도 이 경로를 제공하지 않으므로 ChinaAPI 모델 페이지와 가격은 없습니다.
2026-09-20
Not on ChinaAPI confirmed
DeepSeek는 2026-09-10 DeepSeek-V4.1-Flash를 출시하고 가중치를 공개했습니다. 네이티브 이미지·텍스트 모델은 552B 파라미터 Causal Encoder-Decoder Mixture-of-Experts 아키텍처를 사용하며 입력 prefill에서 8B, 출력 decode에서 16B를 활성화하고 1M 컨텍스트와 최대 384K 출력을 지원합니다. DeepSeek는 벤더 평가에서 V4 Pro를 앞서며 새 KV Cache가 이전 V4 Flash 대비 HBM 1/4, SSD 저장공간 1/8만 사용한다고 밝혔습니다. 이는 ChinaAPI 실측이 아닌 벤더 주장입니다. DeepSeek 직접 API의 model ID는 deepseek-flash입니다. 독립형 V4 Flash와 Vision-Exp checkpoint는 종료됐지만 기존 model IDs는 V4.1 Flash에 임시 매핑됩니다. ChinaAPI의 live catalog는 이제 기존 Flash ID 2개 대신 canonical deepseek-flash ID를 제공하며, 폐기된 Flash 마케팅 URL 2개는 해당 canonical 모델 페이지로 리디렉션됩니다. 비피크 가격은 입력 $0.15/M, 출력 $0.60/M, cache read $0.003/M이며 베이징 시간 평일 피크 가격은 정확히 2배인 입력 $0.30/M, 출력 $1.20/M, cache read $0.006/M입니다. live ChinaAPI Gateway가 기준입니다. DeepSeek는 또한 2026-09-14 이후 직접 deepseek-v4-pro 호출을 V4.1 Flash로 전환한다고 발표했으나, 이후 이 계획을 철회했습니다. DeepSeek V4 Pro는 그 이후에도 과금 방식 변경 없이 계속 제공되며, deepseek-v4-pro는 ChinaAPI에서 별도 경로로 유지됩니다.
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent Hunyuan은 2026-09-09 AuK와 AuK-Flash의 소스 코드와 가중치를 공개했습니다. AuK는 1.5B 파라미터의 음성 생성·편집 기반 모델로, 음성 생성, 콘텐츠 편집, 향상·분리, 준언어 편집, 음향 편집의 5개 작업군에 걸친 유효 감독 데이터 1.95M 시간으로 학습되었습니다. 하나의 자연어 지시 인터페이스에서 zero-shot 및 instruction-based TTS, 음성·가사 편집, pitch·speed·volume 변경, emotion·timbre 편집, de-accent, 비언어 음향 편집, 음성 향상, 소스 분리를 지원합니다. AuK-Flash는 증류된 4-step 변형이며, 논문은 동일 조건에서 AuK보다 wall-clock 기준 4.5x 빠르다고 보고하지만 이는 ChinaAPI 테스트가 아닌 벤더 결과입니다. 두 공식 저장소 모두 MIT 라이선스의 다운로드 가능한 가중치를 제공하며 외부 encoder로 Qwen2.5-Omni-3B를 사용합니다. 공식 코드와 SGLang-Omni는 self-hosted inference를 문서화하지만, ChinaAPI는 현재 고객이 호출할 수 있는 AuK Route를 제공하지 않으므로 API 가격과 Model Page를 게시하지 않았습니다.
2026-09-09
Not on ChinaAPI confirmed

Tencent Hy Team은 2026-08-28에 Hy4 preview 가중치를 공개했습니다. 이 Mixture-of-Experts 모델은 770B 백본 파라미터 중 token당 49B를 활성화하고, speculative decoding용 네이티브 10B MTP 계층을 포함합니다. 텍스트 모델은 1M 컨텍스트를 지원하며 원본 checkpoint와 FP8 변형, 두 공식 가중치 저장소로 제공됩니다. Tencent는 vLLM 및 SGLang을 통한 OpenAI-compatible 서빙을 문서화했으며, 공식 SGLang 매트릭스에는 8x B200 또는 4x B300/GB300의 FP8과 16x H200의 BF16 구성이 포함됩니다. Apache-2.0으로 배포되며 장기 Software Engineering, Office 분석, Game Development 및 Scientific Research를 대상으로 합니다. 공개 평가는 공급업체 결과이며 ChinaAPI 테스트가 아닙니다. ChinaAPI는 고객이 호출할 수 있는 hy4-preview Route, 전용 Model Page 및 Deployment·비용 분석을 제공합니다. 현재 가격의 기준은 실시간 카탈로그입니다.
2026-08-28
✓ On ChinaAPI confirmed
Z.ai는 2026-08-27 GLM-5 계열 최초의 네이티브 멀티모달 모델인 GLM-5.3-Flash(320B-A18B)를 출시하고 오픈소스로 공개했습니다. 텍스트, 이미지, 비디오, 파일 입력을 지원하며 컨텍스트는 1M, 최대 출력은 128K입니다. 공식 Chat Completion API에서는 thinking이 항상 활성화되며 Function Calling, Context Caching, Structured Output을 지원합니다. 저비용 아키텍처는 Sparse Attention과 Linear Attention을 Manifold-Constrained Hyper-Connections와 결합합니다. Z.ai에 따르면 30T 멀티모달 tokens로 사전 학습했으며 GLM-5.3 대비 Attention 연산량을 3.01배, 레이어당 평균 KV Cache를 4.44배 줄였습니다. Z.ai는 Artificial Analysis Intelligence Index 57점과 Claude Opus 4.8에 견줄 만한 Coding 성능도 발표했지만, 이는 ChinaAPI의 테스트가 아니라 공급업체 주장입니다. 공식 glm-5.3-flash 경로는 이제 ChinaAPI에서 OpenAI-compatible 및 Anthropic-compatible 엔드포인트를 통해 텍스트, 이미지, 동영상 입력으로 호출할 수 있습니다.
2026-08-27
✓ On ChinaAPI confirmed
Qwen은 2026-08-26 Qwen4 아키텍처의 멀티모달 Mixture-of-Experts 프리뷰인 Qwen3.8-Flash-Next를 공개했습니다. 언어 모델은 125B 파라미터 메인 모델, 51B 추가 N-gram 임베딩, 4B MTP 모듈로 구성되며 token당 6B 파라미터가 활성화됩니다. 기본 컨텍스트는 262K이고 YaRN으로 1M까지 확장할 수 있습니다. Qwen은 공식 BF16 및 FP8 체크포인트를 공개하며 Hugging Face 크기는 약 360GB와 186GB, vLLM 레시피 측정치는 335.28GiB와 172.78GiB입니다. vLLM은 공식 FP8 최소 구성으로 2x GB300을 검증했고, N-gram 테이블을 호스트 메모리로 오프로드한 4x H100에서 무작위 입력 1,024/출력 256, 동시성 64 조건으로 약 1,430 output tokens/s를 보고합니다. 제3자 NVFP4 레시피는 단일 128GB DGX Spark 구동도 보고하지만 Qwen 공식이 아닌 4-bit 체크포인트와 사용자 정의 서빙 작업을 사용하므로 공식 최소 구성은 아닙니다. Qwen Community License 1.0은 MaaS 또는 정의된 AI Work Assistant 사업의 상업적 이용 전에 별도 라이선스를 요구합니다. ChinaAPI는 Flash-Next 기반 관리형 프로덕션 모델 qwen3.8-flash를 고객 호출 가능 route로 제공하지만, 다운로드 가능한 프리뷰 웨이트와 byte-identical하다고 표시하지 않습니다.
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision 출처 · api-docs.deepseek.com
DeepSeek는 2026-08-21에 API 플랫폼에서 독립형 실험 시각 이해 모델 DeepSeek-V4-Flash-Vision-Exp를 출시했습니다. model='deepseek-v4-flash-vision-exp'로 호출하며, OpenAI-compatible Chat Completions와 Responses API 및 Anthropic 호환 Messages API를 통해 텍스트와 이미지를 함께 입력할 수 있습니다. JPEG, PNG, GIF, WebP 이미지는 base64, 공개 URL 또는 Files API로 전달할 수 있습니다. 컨텍스트는 1M, 최대 출력은 384K이며 thinking·non-thinking 모드, JSON Output, Tool Calls를 지원하지만 FIM은 지원하지 않습니다. DeepSeek에 따르면 텍스트 전용 Agent, 추론 및 세계 지식 능력은 정식 DeepSeek-V4-Flash와 같고 시각 Agent 결과는 크게 향상됐습니다. 이는 ChinaAPI 테스트가 아닌 공급업체 주장입니다. 이미지 한 장은 최대 384 tokens로 변환되며 공식 V4-Flash 토큰 요금이 적용됩니다. deepseek-v4-flash-vision-exp 경로는 출시 당시 ChinaAPI에서 호출할 수 있었지만, 이후 live catalog에서 폐기되고 deepseek-flash로 대체되었습니다. 기존 마케팅 URL은 canonical 페이지로 리디렉션됩니다.
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwen은 배포 가능한 Qwen3.8 모델 사양 2종과 공식 가중치 저장소 4개를 공개했습니다. Qwen3.8-27B와 Qwen3.8-27B-FP8은 하나의 dense 네이티브 비전-언어 모델에 대한 정밀도 변형입니다. Qwen3.8-2.4T-A95B와 해당 FP8 저장소는 활성 파라미터 95B인 하나의 텍스트 전용 Mixture-of-Experts 모델 변형입니다. 두 사양 모두 네이티브 262K 컨텍스트와 문서화된 자체 호스팅 경로를 지원합니다. 27B 릴리스는 Apache-2.0을 사용하고, 2.4T 릴리스는 표시 의무와 고매출 MaaS 또는 AI Work Assistant 사업 조건이 포함된 맞춤형 Qwen3.8-Max License를 사용합니다. ChinaAPI의 실시간 카탈로그에는 고객이 호출할 수 있는 qwen3.8-27b 및 qwen3.8-2.4t-a95b 경로가 등록되어 있습니다. 이는 다운로드 가능한 가중치와 바이트 단위로 동일하다는 뜻이 아닙니다. 현재 요금은 실시간 가격표를 확인하세요.
2026-08-14
✓ On ChinaAPI confirmed
Z.ai는 2026-08-14에 GLM-5.3을 출시하고 모든 GLM Coding Plan 사용자에게 배포했습니다. GLM-5.2와 같은 base model을 사용하며 모든 개선은 post-training에서 나왔습니다. 텍스트 전용 모델로 1M 컨텍스트와 최대 128K 출력을 지원하고, thinking은 항상 활성화되며 reasoning_effort는 low, high, max 중에서 선택할 수 있습니다. Z.ai는 내부 Z.ai Code Bench에서 GLM-5.2보다 50% 향상되고 공개 코딩·사이버 보안 benchmark에서도 더 나은 결과를 냈다고 밝혔습니다. 이는 ChinaAPI 테스트가 아닌 공급업체 주장입니다. 공식 Model API는 현재 이용 가능하며 glm-5.3 경로는 ChinaAPI에서 OpenAI 호환 방식으로 호출할 수 있습니다. thinking을 비활성화했던 설정에서 이전할 때는 model ID를 바꾸기 전에 thinking을 활성화하고 reasoning_effort를 low로 설정해야 하며, 그렇지 않으면 요청이 실패한다고 공식 가이드는 경고합니다 (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
DeepSeek는 기존 deepseek-v4-pro API 별칭이 DeepSeek-V4-Pro-0813을 제공하도록 업데이트했습니다. 호출 방식과 model ID는 그대로이며, deepseek-v4-pro를 사용하는 요청은 최신 버전을 받습니다. 공식 빠른 시작 페이지는 deepseek-v4-flash가 계속 DeepSeek-V4-Flash-0731에 매핑됨도 확인합니다. 이는 새 API 경로가 아니라 제공 버전의 전환이었습니다. DeepSeek는 이후 deepseek-v4-pro를 V4.1 Flash로 전환하려던 계획을 철회했습니다. V4 Pro는 2026-09-14 이후에도 과금 방식 변경 없이 계속 제공되므로 기존 ChinaAPI 통합은 동일한 model ID를 계속 사용할 수 있습니다.
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloud는 2026-08-03에 qwen3.8-max를 현재까지 가장 강력한 Qwen 플래그십 모델로 출시했습니다. 이 네이티브 비전-언어 모델은 2.4T 파라미터 Mixture-of-Experts 아키텍처를 사용하며 추론, 텍스트 생성, 시각 이해를 지원하고 Qwen3.7 시리즈보다 크게 향상되었습니다. 공식 Model Studio 문서에는 베이징과 여러 글로벌 리전에서 OpenAI-compatible, Anthropic-compatible, DashScope 액세스가 명시되어 있습니다. 이 경로는 이제 ChinaAPI에서 사용할 수 있습니다.
2026-08-03
✓ On ChinaAPI confirmed

MiniMax가 H3(Hailuo 3.0)를 출시했습니다. 공식 릴리스 노트는 텍스트·이미지·비디오·오디오 컨텍스트에서 창작 의도를 이해해 더 자연스럽고 일관된 생성 결과를 제공하는 차세대 오픈 범용 멀티모달 비디오 모델로 소개합니다. ChinaAPI는 768P와 2K에서 네이티브 스테레오 오디오를 단일 패스로 포함하는 4~15초 클립 생성 경로를 제공하며, 출력 초 단위로 과금되고 OpenAI-compatible 비디오 엔드포인트로 호출할 수 있습니다.
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
Volcano Engine의 Ark 모델 카탈로그에는 Doubao-Seedance-2.5가 model ID doubao-seedance-2-5-260628로 등록되어 있습니다. 2026-07-31에 출시된 이 영상 모델은 최대 30초의 영상을 생성하고, 최대 50개의 참조 자료(이미지 30장, 동영상 10개, 오디오 클립 10개)를 입력할 수 있으며, 멀티모달 참조, 영상 편집·연장, 10개 이상의 언어로 생성을 지원합니다. 260628은 모델 버전 태그입니다. ChinaAPI는 이 경로를 고객 호출용으로 제공하고 있습니다. 현재 요금은 실시간 카탈로그를 확인하세요.
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash 출처 · api-docs.deepseek.com
DeepSeek는 기존 deepseek-v4-flash API 경로를 재후처리 학습한 체크포인트로 업그레이드했습니다. Preview와 동일한 아키텍처와 모델 크기를 유지하면서 코딩 및 에이전트 기능을 강화했습니다. DeepSeek는 최대 추론 노력과 아직 공개되지 않은 최소 harness를 사용해 Terminal Bench 2.1 82.7, DeepSWE 54.4, Toolathlon Verified 70.3을 보고했습니다. 이는 ChinaAPI 테스트가 아닌 공급업체 결과입니다. 공식 경로는 이제 Responses API와 Codex 통합을 기본 지원하며, DeepSeek 웹·모바일 앱과 V4-Pro API는 이번 업데이트 대상이 아닙니다.
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloud는 1M 컨텍스트와 최대 131K 출력을 지원하는 네이티브 비전-언어 Flash 모델을 출시했습니다. Qwen3.6-Flash 대비 멀티모달 이해, 현실 세계 및 공간 인식, Search Agent와 CI Agent 실행, 멀티모달 코딩을 강화했습니다. 공식 모델은 텍스트, 이미지, 비디오 입력을 지원하고 Responses API를 통해 내장 도구를 제공합니다. ChinaAPI는 qwen3.7-flash를 고객 호출용으로 제공하고 있습니다. 현재 요금은 실시간 카탈로그를 확인하세요.
2026-07-25
✓ On ChinaAPI confirmed
Moonshot 1M 컨텍스트, 상시 추론 및 네이티브 이미지 및 비디오 이해 기능을 갖춘 2.8T-parameter 플래그십 제품을 출시했습니다. 발표된 오픈 소스 가중치는 July 27, 2026 까지 제공될 예정입니다.
2026-07-16
✓ On ChinaAPI confirmed
Tencent 공식적으로 Hy3 출시했습니다. 256K-context 향상된 안정성과 비용 효율성을 갖춘 빠르고 느린 사고방식의 하이브리드 모델입니다.
2026-07-06
✓ On ChinaAPI confirmed

Meituan 는 에이전트 코딩 및 장기적인 도구 사용을 위한 컨텍스트 1M 포함하는 개방형 MoE 추론 모델을 출시했습니다.
2026-06-30
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 텍스트-비디오 게이트웨이 모델은 의미 이해 및 카메라 제어 기능이 향상되었습니다.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 다중 참조 대상, 장면 및 스타일 일관성을 위한 참조-비디오 게이트웨이 모델입니다.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 이미지-비디오 게이트웨이 모델은 텍스처 및 아이덴티티 일관성이 더욱 강화되었습니다.
2026-06-22
✓ On ChinaAPI confirmed
오픈소스 플래그십 GLM 은 1M 컨텍스트와 더욱 강력한 장기적인 코딩 및 에이전트 워크플로를 제공합니다.
2026-06-16
✓ On ChinaAPI confirmed
지연 시간이 짧은 코딩 및 에이전트 작업을 위한 고속 Kimi K2.7 게이트웨이 변형입니다.
2026-06-12
✓ On ChinaAPI confirmed
비전 지원을 통해 장기적인 저장소 작업을 위한 코딩 중심의 Kimi 게이트웨이 모델.
2026-06-12
✓ On ChinaAPI confirmed
MiMo 음성 인식 기술은 중국어-영어 코드 스위칭, 광둥어, 우어, 민난어, 쓰촨어 방언, 잡음이 많고 원거리 녹음, 화자 중복, 가사 등을 지원합니다.
2026-06-02
✓ On ChinaAPI confirmed
시각적 분석, 계획, 파일 및 도구 사용을 위한 멀티모달 Qwen 게이트웨이 모델.
2026-06-01
✓ On ChinaAPI confirmed
1M 컨텍스트, MSA 어텐션, 코딩, 에이전트, 이미지 및 비디오 입력을 지원하는 네이티브 멀티모달 M 시리즈 모델입니다.
2026-06-01
✓ On ChinaAPI confirmed

256K 컨텍스트, 비전 입력, 추론 및 도구 사용을 지원하는 빠른 StepFun 게이트웨이 모델.
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video 출처 · arxiv.org
음성 기반 아바타 비디오 기술 릴리스는 립싱크, 정체성 일관성 및 장편 비디오 생성에 중점을 두었습니다.
2026-05-26
Not on ChinaAPI confirmed
Qwen의 플래그십 게이트웨이 모델로, 까다로운 분석, 코딩 및 프로덕션 에이전트 워크플로우에 최적화되어 있습니다.
2026-05-21
✓ On ChinaAPI confirmed

1M 컨텍스트를 사용하는 1.02T-parameter MiMo 에이전트 모델은 까다로운 코딩 및 장기 작업에 적합합니다.
2026-04-27
✓ On ChinaAPI confirmed
1M 컨텍스트를 지원하는 네이티브 옴니모달 MiMo 모델로 텍스트, 이미지, 비디오 및 오디오를 이해합니다.
2026-04-27
✓ On ChinaAPI confirmed
첫 프레임/마지막 프레임 제어, 연속 재생, 오디오 구동 및 720 1080 P 출력을 지원하는 Wan -비디오 변환 2.7 .
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
빠른 DeepSeek V4 변형으로 효율적인 채팅, 코딩 지원 및 상담원 루프를 제공합니다.
2026-04-24
Not on ChinaAPI confirmed
MiMo는 고급 내장 음성 및 자연어 제어 기능을 통해 속도, 감정, 어조, 방언 및 캐릭터 연기를 조절할 수 있는 표현력 풍부한 텍스트 음성 변환 기능을 제공합니다.
2026-04-23
✓ On ChinaAPI confirmed
장기적인 코딩, 시각 디자인 및 에이전트 스웜 워크플로우를 위한 개방형 네이티브 멀티모달 Kimi 모델입니다.
2026-04-14
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
이미지, 비디오, 파일, GUI 에이전트 및 도구 기반 워크플로우를 위한 200K-context 멀티모달 코딩 기반 모델.
2026-04-07
Not on ChinaAPI confirmed
Wan 2.7 로컬/글로벌 편집 및 요소 교체를 위한 자연어 기반 비디오 편집 모델입니다.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
프롬프트 기반 비디오 생성을 위한 Wan 2.7 비디오 모델.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
2.7 참조로부터 제어된 생성을 위한 Wan 참조 모델.
2026-04-03
✓ On ChinaAPI confirmed
Wan 2.7 Pro는 브랜드 색상 제어, 다중 참조 일관성 및 최대 4096 × 4096 출력 기능을 갖춘 이미지 생성 및 편집 도구입니다.
2026-04-01
✓ On ChinaAPI confirmed
Wan 2.7 이미지 모델은 텍스트를 이미지로 변환, 편집, 다중 참조 생성 및 더욱 강력한 텍스트 렌더링 기능을 제공합니다.
2026-04-01
✓ On ChinaAPI confirmed

Alibaba Qwen3.5
Qwen 3.6 및 3.7 게이트웨이 모델 출시 이전에 배포된 네이티브 멀티모달 에이전트 Qwen 버전입니다.
2026-02-16
Not on ChinaAPI confirmed
Kling 3.0 은 텍스트를 비디오로, 이미지를 비디오로, 오디오를 변환하고 720p 에서 4K 까지 출력하는 기능을 제공합니다.
2026-02-05
✓ On ChinaAPI confirmed
StepFun Step-3.5-Flash
256K 컨텍스트 및 도구 사용 지원을 통해 StepFun 플래시 모델을 엽니다. ChinaAPI는 step-3.5-flash를 고객 호출용으로 제공하고 있습니다. 현재 요금은 실시간 카탈로그를 확인하세요.
2026-02-01
✓ On ChinaAPI confirmed

Seedream 5.0-lite 이미지 모델은 이미지 생성 및 검색을 제어할 수 있으며 피사체 일관성이 더욱 강화되었습니다.
2026-01-28
✓ On ChinaAPI confirmed
Seedance 2.0 플래그십 비디오 세대 모델은 출력 해상도로 가격이 책정되었습니다.
2026-01-28
✓ On ChinaAPI confirmed
MiniMax는 네이티브 사운드 태그, 향상된 음성 복제, 스튜디오급 오디오 및 다국어 음성 기능을 갖춘 Speech 2.8 출시했으며, Turbo는 속도에 중점을 둔 옵션입니다.
2026-01-23
✓ On ChinaAPI confirmed
MiniMax는 네이티브 사운드 태그, 향상된 음성 복제, 스튜디오급 오디오 및 다국어 음성 기능을 갖춘 Speech 2.8 출시했으며, HD는 고음질 옵션입니다.
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
256K 컨텍스트와 시각-언어 학습 데이터를 제공하는 오픈 소스 멀티모달 Kimi 에이전트 모델입니다.
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio 출처 · docs.z.ai
Z.AI는 사용자 지정 사전 지원 및 전문 용어 인식 기능이 향상된 다국어 자동 음성 인식(ASR) 모델을 출시했습니다.
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
데이터 품질에 중점을 둔 소형 이미지 생성 모델 (모델 크기보다 데이터 품질에 초점).
2025-12
Not on ChinaAPI confirmed

표현력이 풍부한 음성, 다국어 및 방언 출력, 저지연 API 를 지원하는 오프라인 음성 합성 Qwen3-TTS-Flash 위해 출시 Alibaba .
2025-09-22
✓ On ChinaAPI confirmed

전역 및 인라인 자연어 방향 설정, 표현력 있는 전달, 직접적인 OpenAI-compatible /v1/audio/speech 출력을 지원하는 문맥 인식 텍스트 음성 변환 기능.
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
공식 음성 및 복제 음성, 발음 매핑, 스타일 제어 기능을 갖춘 비용 효율적인 다국어 음성 합성 솔루션입니다.
Release date not publicly confirmed
Not on ChinaAPI unknown
공식 음성 및 복제 음성, 발음 매핑, 스타일 제어, OpenAI-compatible 출력 기능을 갖춘 표현력 있는 음성 합성.
Release date not publicly confirmed
✓ On ChinaAPI unknown
문맥 인식을 통한 표현력 있는 음성 합성 기능으로 스트리밍 출력이 가능하며, 음성, 속도, 볼륨을 조절할 수 있습니다.
Release date not publicly confirmed
✓ On ChinaAPI unknown