モデル更新壁

中国AIの最新リリース。

中国AIモデルのリリースを出典リンク付きで簡潔にまとめ、ChinaAPIでの提供状況もひと目で確認できます。推定日3件、公開日未確認5件をソースデータで明示しています。

新しい順

壁を解放する。

Xiaomi MiMo-V2.6-Pro-UltraSpeed
LLM MiMo V2.6 出典:mimo.mi.com
Xiaomiは、MiMo-V2.6-Proのオムニモーダル入力、旗艦推論性能、1M-tokenコンテキスト、128K出力上限を維持する低遅延サービスを公開しました。Xiaomiによれば、出力速度は標準Proサービスの最大20倍で、RPMとTPMはカスタムサービスとして提供されます。公式API model IDはmimo-v2.6-pro-ultraspeedです。ChinaAPIではmimo-v2.6-pro-ultraspeedを顧客向けに提供しています。最新料金はライブカタログをご確認ください。
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
LLM MiMo V2.6 出典:mimo.mi.com
Xiaomiは、複雑なプロジェクト、長期タスク、サイバーセキュリティ、研究向けのネイティブ・オムニモーダル旗艦推論モデルを公開しました。MiMo-V2.6-Proはテキスト、画像、動画、音声を入力し、テキストを出力します。コンテキストは1M tokens、最大出力は128Kで、deep thinking、tool calling、streaming、web search、structured output、context cachingに対応します。公式API model IDはmimo-v2.6-proです。ChinaAPIではこのrouteを顧客向けに提供しています。現在の価格はlive catalogをご確認ください。
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
LLM MiMo V2.6 出典:mimo.mi.com
Xiaomiは、高頻度の専門業務と大規模タスクを低コストで処理するネイティブ・オムニモーダル推論モデルを公開しました。MiMo-V2.6-Flashはテキスト、画像、動画、音声を入力し、テキストを出力します。コンテキストは1M tokens、最大出力は128Kで、deep thinking、tool calling、streaming、web search、structured output、context cachingに対応します。公式API model IDはmimo-v2.6-flashです。ChinaAPIではこのrouteを顧客向けに提供しています。現在の価格はlive catalogをご確認ください。
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API 出典:mimo.mi.com
Xiaomiはmimo-v2.6-proとmimo-v2.6-flash向けの非同期Batch APIを公開し、リアルタイムAPI価格の50%で提供します。評価、ラベリング、一括生成などの非リアルタイム処理向けで、JSONL requestを受け付け、streamingなしでOpenAI Chat Completions、OpenAI Responses、Anthropic Messagesのrequest formatに対応します。ChinaAPIは両モデルのリアルタイムrouteを提供していますが、Xiaomi独自のBatch APIへの対応を意味するものではありません。
2026-09-22
Not on ChinaAPI confirmed
StepFunは2026-09-20、ソフトウェアエンジニアリング、長期実行型Agentタスク、専門知識業務、金融向けのフラッグシップモデルとしてStep 5 Previewを公開しました。600B総パラメータのsparse Mixture-of-Expertsモデルで、tokenごとに27Bをアクティブ化し、1M-tokenのコンテキストに対応します。公式API model IDはstep-5-previewです。テキスト、画像、動画を入力し、テキストを出力でき、最大出力は64K tokensです。streaming、tool calling、JSON Mode、JSON Schema、low/medium/highのreasoning effort、prompt cachingにも対応します。StepFunはArtificial Analysis Intelligence Indexで44を報告し、coding、Agent、金融、multimodalの各benchmark結果も公表していますが、これらはChinaAPIの実測ではなくベンダー公表値です。StepFunは2026-10-15にopen weightsを公開する予定です。現在、ChinaAPIのlive catalogではstep-5-previewを顧客向けrouteとして提供しており、ベンダー定価どおり入力$1.00/M、出力$2.70/M、prompt-cache read $0.05/Mです。正式な価格はlive Gatewayを確認してください。
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Image Qwen-Image 出典 · github.com
Qwenは2026-09-20にQwen-Image-2.1の重みを公開しました。7Bパラメータの画像生成部分は文生図と画像編集を統合し、ネイティブのRGBA透過、最大10枚の参照画像、局所編集、2K出力に対応します。これらはQwenの公表内容で、ChinaAPIの実測ではありません。重みにはQwen Research Licenseが適用され、別途商用ライセンスがなければ非商用の研究・評価に限られます。Alibaba Model StudioはQwen-Image-2.1のAPI model IDと料金を公開しておらず、ChinaAPIもこのルートを提供していないため、ChinaAPIのモデルページと料金はありません。
2026-09-20
Not on ChinaAPI confirmed
DeepSeekは2026-09-10、DeepSeek-V4.1-Flashを公開し、オープンウェイトとして提供しました。ネイティブに画像とテキストを扱う552B Mixture-of-Expertsモデルで、新しいCausal Encoder-Decoderアーキテクチャにより、入力prefillでは8B、出力decodeでは16Bのパラメータをアクティブ化し、1Mコンテキストと最大384K出力に対応します。DeepSeekによれば、ベンダー評価ではV4 Proを上回り、新しいKV Cacheは従来のV4 Flashと比べてHBMを1/4、SSDストレージを1/8に削減します。これらはChinaAPIの実測ではなく、ベンダー公表値です。DeepSeek直結APIのmodel IDはdeepseek-flashです。DeepSeekは独立したV4 FlashとVision-Exp checkpointを終了しましたが、旧model IDsをV4.1 Flashへ一時的に転送しています。ChinaAPIのlive catalogでは現在、2つの旧Flash IDに代わって正式なdeepseek-flash IDを公開しており、廃止した2つのFlashマーケティングURLはこの正式モデルページへリダイレクトします。オフピークは入力$0.15/M、出力$0.60/M、cache read $0.003/Mで、北京時間の平日ピークは正確に2倍の入力$0.30/M、出力$1.20/M、cache read $0.006/Mです。正式な価格はlive ChinaAPI Gatewayを確認してください。DeepSeekはさらに、2026-09-14以降deepseek-v4-proの直接呼び出しをV4.1 Flashへ転送すると発表していましたが、その後この計画を撤回しました。V4 Proは同日以降も課金方式を変えずに提供され、deepseek-v4-proはChinaAPIでも独立したルートとして引き続き利用できます。
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent Hunyuanは2026-09-09、AuKとAuK-Flashのソースコードとウェイトを公開しました。AuKは1.5Bパラメータの音声生成・編集基盤モデルで、音声生成、コンテンツ編集、強調・分離、パラ言語編集、音響編集の5タスク群にまたがる実効1.95M時間の教師データで学習されています。単一の自然言語指示インターフェースで、zero-shotおよびinstruction-based TTS、音声・歌詞編集、pitch・speed・volume変更、emotion・timbre編集、de-accent、非言語音編集、音声強調、音源分離を扱います。AuK-Flashは蒸留された4-step版で、論文は同条件でAuK比4.5xのwall-clock高速化を報告していますが、これはChinaAPIの実測ではなくベンダー結果です。2つの公式リポジトリはいずれもMITでダウンロード可能なウェイトを提供し、外部encoderとしてQwen2.5-Omni-3Bを使用します。公式コードとSGLang-Omniはself-hosted inferenceを文書化していますが、ChinaAPIは現在顧客が呼び出せるAuK Routeを提供していないため、API価格とModel Pageは公開していません。
2026-09-09
Not on ChinaAPI confirmed

Tencent Hy Teamは2026-08-28、Hy4 previewをオープンソース化しました。バックボーンは総770B、tokenごとに49Bをアクティブ化するMixture-of-Expertsで、投機的デコーディング用のネイティブ10B MTP層も備えます。テキストモデルは1Mコンテキストに対応し、オリジナル版と公式FP8版という2つのウェイトリポジトリで公開されています。TencentはvLLMとSGLangによるOpenAI-compatibleな配信手順を公開しており、公式SGLang構成表にはFP8の8x B200または4x B300/GB300、BF16の16x H200が含まれます。Apache-2.0で提供され、長期的なSoftware Engineering、Office分析、Game Development、Scientific Research向けとされています。公開評価はベンダー結果であり、ChinaAPIの実測ではありません。ChinaAPIではhy4-previewを顧客が呼び出せるRouteとして掲載し、専用Model PageとDeployment・Cost Analysisも公開しました。現在の価格はリアルタイムカタログが正式情報です。
2026-08-28
✓ On ChinaAPI confirmed
Z.ai(Z.AI) は2026-08-27、GLM-5ファミリー初のネイティブマルチモーダルモデルとしてGLM-5.3-Flash(320B-A18B)を公開し、オープンソース化しました。テキスト、画像、動画、ファイルを入力でき、コンテキストは1M、最大出力は128Kです。公式Chat Completion APIでは思考が常時有効で、Function Calling、Context Caching、Structured Outputに対応します。低コスト向けのアーキテクチャはSparse AttentionとLinear AttentionをManifold-Constrained Hyper-Connectionsと組み合わせています。Z.ai によれば、30Tのマルチモーダルtokensで事前学習し、GLM-5.3比でAttention計算量を3.01倍、各層の平均KV Cacheを4.44倍削減しました。Z.ai はArtificial Analysis Intelligence Indexで57点、Coding性能はClaude Opus 4.8相当とも公表していますが、これらはChinaAPIの実測ではなくベンダー公表値です。公式glm-5.3-flash Routeは現在、ChinaAPIでOpenAI-compatibleおよびAnthropic-compatible Endpointからテキスト、画像、動画を入力して呼び出せます。
2026-08-27
✓ On ChinaAPI confirmed
Qwenは2026-08-26、Qwen4アーキテクチャのマルチモーダルMixture-of-ExpertsプレビューとしてQwen3.8-Flash-Nextを公開しました。言語モデルは125Bパラメータのメインモデル、51Bの追加N-gram埋め込み、4BのMTPモジュールを持ち、tokenごとに6Bパラメータを有効化します。ネイティブコンテキストは262Kで、YaRNにより1Mまで拡張できます。Qwenは公式BF16・FP8チェックポイントを公開しており、Hugging Faceでは約360GB・186GB、vLLMレシピでは335.28GiB・172.78GiBとされています。vLLMは公式FP8の最小構成として2x GB300を検証し、N-gram表をホストメモリへオフロードした4x H100で、ランダムな入力1,024/出力256、同時実行64の条件において約1,430 output tokens/sを報告しています。第三者のNVFP4レシピでは単一128GB DGX Sparkでの実行も報告されていますが、Qwen非公式の4-bitチェックポイントと独自の配信作業を使うため、公式最小構成ではありません。Qwen Community License 1.0では、MaaSまたは定義対象のAI Work Assistant事業で商用利用する前に別途ライセンスが必要です。ChinaAPIはFlash-Nextを基盤とするマネージド本番モデルqwen3.8-flashを顧客が呼び出せるrouteとして掲載していますが、ダウンロード可能なプレビューweightとbyte-identicalとは表現していません。
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision 出典 · api-docs.deepseek.com
DeepSeekは2026-08-21、独立した実験的な視覚理解モデルDeepSeek-V4-Flash-Vision-ExpをAPIプラットフォームで公開しました。model='deepseek-v4-flash-vision-exp'で呼び出し、OpenAI-compatible Chat CompletionsとResponses API、Anthropic互換のMessages APIからテキストと画像を混在入力できます。画像はJPEG、PNG、GIF、WebPに対応し、base64、公開URL、Files APIで渡せます。コンテキストは1M、最大出力は384Kで、思考・非思考モード、JSON Output、Tool Callsに対応しますが、FIMには対応しません。DeepSeekによれば、テキストのみのAgent、推論、世界知識能力は正式版DeepSeek-V4-Flashと同等で、視覚Agentの結果は大幅に向上していますが、これはChinaAPIの実測ではなくベンダー公表値です。画像1枚は最大384 tokensに換算され、公式V4-Flashと同じトークン単価が適用されます。deepseek-v4-flash-vision-expは公開時にはChinaAPIで呼び出せましたが、その後live catalogから退役し、後継はdeepseek-flashになりました。旧マーケティングURLは正式ページへリダイレクトします。
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwenは、デプロイ可能なQwen3.8のモデル仕様2種と公式ウェイトリポジトリ4件を公開しました。Qwen3.8-27BとQwen3.8-27B-FP8は、ネイティブ視覚言語の密モデル1種に対する精度違いのバリエーションです。Qwen3.8-2.4T-A95BとそのFP8リポジトリは、アクティブパラメータ95Bのテキスト専用Mixture-of-Expertsモデル1種のバリエーションです。両仕様ともネイティブ262Kコンテキストと文書化されたセルフホスティング経路に対応します。27B版はApache-2.0、2.4T版は独自のQwen3.8-Max Licenseで、表示義務および高売上のMaaSまたはAI Work Assistant事業に関する条件があります。ChinaAPIのライブカタログには、顧客が呼び出せるqwen3.8-27bとqwen3.8-2.4t-a95bが掲載されています。これはダウンロード可能なウェイトとバイト単位で同一であることを意味しません。最新料金はライブカタログをご確認ください。
2026-08-14
✓ On ChinaAPI confirmed
Z.aiは2026-08-14にGLM-5.3を公開し、GLM Coding Planの全ユーザーに展開しました。GLM-5.2と同じベースモデルを使い、改善はすべてポストトレーニングによるものです。テキスト専用モデルは1Mのコンテキストと最大128Kの出力に対応し、思考は常時有効でreasoning_effortはlow、high、maxから選択できます。Z.aiは社内Z.ai Code BenchでGLM-5.2比50%向上し、公開コーディングおよびサイバーセキュリティベンチマークでも改善したと報告していますが、これはChinaAPIの実測ではなくベンダー公表値です。公式Model APIは現在利用可能で、glm-5.3ルートはChinaAPIからOpenAI互換で呼び出せます。思考を無効にしていた設定から移行する場合、公式ガイドの警告どおり、先に思考を有効化してreasoning_effortをlowに設定してからmodel IDを切り替えてください。そうしないとリクエストが失敗します。 (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
DeepSeekは既存のdeepseek-v4-pro APIエイリアスをDeepSeek-V4-Pro-0813へ更新しました。呼び出し方法とmodel IDは変わらず、deepseek-v4-proを指定すれば最新バージョンを利用できます。公式クイックスタートには、deepseek-v4-flashが引き続きDeepSeek-V4-Flash-0731を指すことも記載されています。これは新しいAPIルートではなく配信バージョンの更新でした。DeepSeekはその後、deepseek-v4-proをV4.1 Flashへ切り替える計画を撤回しました。V4 Proは2026-09-14以降も課金方式を変えずに提供されるため、既存のChinaAPI連携は同じmodel IDを継続して使用できます。
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloudは2026-08-03、Qwen史上最も高性能なフラッグシップモデルとしてqwen3.8-maxを公開しました。ネイティブ視覚言語モデルは2.4TパラメータのMixture-of-Expertsアーキテクチャを採用し、推論、テキスト生成、視覚理解に対応し、Qwen3.7シリーズから大幅に向上しています。公式Model Studio文書には、北京および複数の海外リージョンでOpenAI-compatible、Anthropic-compatible、DashScopeによるアクセスが記載されています。このルートは現在ChinaAPIで利用できます。
2026-08-03
✓ On ChinaAPI confirmed

MiniMaxはH3(Hailuo 3.0)を公開しました。公式リリースノートによると、テキスト・画像・動画・音声のコンテキストから創作意図を理解し、より自然で一貫性のある生成を実現する新型のオープン汎用マルチモーダル動画モデルです。ChinaAPIは768Pおよび2Kで4〜15秒のクリップをネイティブステレオ音声付きでワンパス生成するルートを提供し、出力秒数ごとの課金でOpenAI-compatibleの動画エンドポイントから呼び出せます。
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
Volcano EngineのArkモデルカタログには、Doubao-Seedance-2.5がmodel ID doubao-seedance-2-5-260628として掲載されています。2026-07-31にリリースされたこの動画モデルは、最大30秒の動画生成、最大50件の参照素材(画像30枚、動画10本、音声10本)、マルチモーダル参照、動画編集・延長、10以上の言語での生成に対応します。260628はモデルのバージョンタグです。ChinaAPIではこのルートを顧客向けに提供しています。最新料金はライブカタログをご確認ください。
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
LLM DeepSeek V4 Flash 出典 · api-docs.deepseek.com
DeepSeekは既存のdeepseek-v4-flash APIルートを再ポストトレーニング済みチェックポイントへ更新しました。プレビュー版と同じアーキテクチャとモデル規模を維持しながら、コーディングとエージェント能力を強化しています。DeepSeekは最大推論強度と未公開の最小ハーネスを使い、Terminal Bench 2.1で82.7、DeepSWEで54.4、Toolathlon Verifiedで70.3と報告していますが、これはChinaAPIによる実測ではなくベンダー公表値です。公式ルートはResponses APIとCodex連携にネイティブ対応し、DeepSeekのWeb版、アプリ版、V4-Pro APIは今回の更新対象外です。
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloudは、1Mコンテキストと最大131K出力を備えたネイティブ視覚言語Flashモデルを公開しました。Qwen3.6-Flashに比べ、マルチモーダル理解、現実世界と空間の認識、Search AgentとCI Agentの実行、マルチモーダルコーディングを強化しています。公式モデルはテキスト、画像、動画を入力でき、Responses API経由で内蔵ツールを利用できます。ChinaAPIではqwen3.7-flashを顧客向けに提供しています。最新料金はライブカタログをご確認ください。
2026-07-25
✓ On ChinaAPI confirmed
Moonshot 、 1Mコンテキスト、常時オンの推論、ネイティブの画像およびビデオ理解機能を備えた2.8T-parameterフラッグシップをリリースしました。発表されたオープンソースの重みはJuly 27, 2026までに提供される予定です。
2026-07-16
✓ On ChinaAPI confirmed
Tencent 256K-context安定性とコスト効率が向上した、高速思考と低速思考を組み合わせたハイブリッドモデルHy3を正式にリリースしました。
2026-07-06
✓ On ChinaAPI confirmed

Meituanは、エージェントのコーディングや長期的なツール利用のために、 1Mコンテキストを含むオープンなMoE推論モデルを公開しました。
2026-06-30
✓ On ChinaAPI confirmed
マルチモーダル推論、コーディング、およびプロダクションエージェントのワークフロー向けに、低遅延のDoubao Seed 2.1モデルを提供します。
2026-06-28
✓ On ChinaAPI confirmed
マルチモーダル推論、コーディング、ツール使用、および長期的なエージェントタスクのための、Doubao Seed 2.1フラッグシップモデル。
2026-06-28
✓ On ChinaAPI confirmed
Video HappyHorse
意味理解とカメラ制御機能が向上した、HappyHorse 1.1テキスト・トゥ・ビデオ ゲートウェイ モデル。
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1 、複数の参照対象、シーン、スタイルの一貫性を確保するための、参照からビデオへのゲートウェイモデルです。
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
HappyHorse 1.1画像から動画へのゲートウェイモデル。テクスチャとアイデンティティの一貫性が強化されています。
2026-06-22
✓ On ChinaAPI confirmed
オープンソースのフラッグシップ製品でGLM 1Mとより強力な長期的なコーディングおよびエージェントワークフローを備えています。
2026-06-16
✓ On ChinaAPI confirmed
低遅延のコーディングおよびエージェントタスク向けに設計された、高速Kimi K2.7ゲートウェイの派生モデル。
2026-06-12
✓ On ChinaAPI confirmed
コーディングに特化した、長期的なリポジトリ作業のためのKimiゲートウェイモデル(画像認識機能付き)。
2026-06-12
✓ On ChinaAPI confirmed
MiMo音声認識は、中国語と英語のコードスイッチング、広東語、呉語、閩南語、四川語の方言、ノイズの多い録音や遠距離録音、複数の話者が同時に話す場合、歌詞の認識に対応しています。
2026-06-02
✓ On ChinaAPI confirmed
視覚分析、計画、ファイル、およびツール利用のためのマルチモーダルQwenゲートウェイモデル。
2026-06-01
✓ On ChinaAPI confirmed
1Mコンテキスト、MSAアテンション、コーディング、エージェント、画像、ビデオ入力をサポートするネイティブなマルチモーダルMシリーズモデル。
2026-06-01
✓ On ChinaAPI confirmed

256Kコンテキスト、画像入力、推論、およびツール使用機能を備えた高速StepFunゲートウェイモデル。
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video 出典:arxiv.org
音声駆動型アバター動画に関する技術リリース。リップシンク、アイデンティティの一貫性、および長尺動画の生成に重点を置いています。
2026-05-26
Not on ChinaAPI confirmed
高度な分析、コーディング、およびプロダクションエージェントのワークフローに対応する、Qwen社のフラッグシップゲートウェイモデル。
2026-05-21
✓ On ChinaAPI confirmed

Qwen 3.6 、視覚的推論、ファイル、およびエージェントワークフローのための高速な視覚言語モデルです。
2026-04-27
✓ On ChinaAPI confirmed
高度なコーディングと長期タスクに対応する、 1Mコンテキストを持つ1.02T-parameter MiMoエージェントモデル。
2026-04-27
✓ On ChinaAPI confirmed
1Mコンテキストと、テキスト、画像、ビデオ、音声の理解機能を備えたネイティブなオムニモーダルMiMoモデル。
2026-04-27
✓ On ChinaAPI confirmed
Wan 2.7最初/最後のフレーム制御、継続、駆動オーディオ、および720 P/ 1080 P 出力による画像からビデオへの変換。
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
チャット、コーディング支援、エージェントループを効率的に処理するための高速DeepSeek V4バージョン。
2026-04-24
Not on ChinaAPI confirmed
MiMoは、高品質な内蔵音声と、ペース、感情、トーン、方言、キャラクターの演技を自然言語で制御できる、表現力豊かなテキスト読み上げ機能を提供します。
2026-04-23
✓ On ChinaAPI confirmed
長期的なコーディング、ビジュアルデザイン、およびエージェント群ワークフローのための、オープンなネイティブマルチモーダルKimiモデル。
2026-04-14
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
画像、動画、ファイル、GUIエージェント、ツール駆動型ワークフローに対応した、 200K-contextマルチモーダル符号化基盤モデル。
2026-04-07
Not on ChinaAPI confirmed
Wan 2.7 、ローカル/グローバル編集および要素置換のための自然言語ビデオ編集モデルです。
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Wan 2.7プロンプト駆動型ビデオ生成のためのテキストビデオモデル。
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Wan 2.7視覚参照からの制御された生成のための参照ビデオモデル。
2026-04-03
✓ On ChinaAPI confirmed
より長期的なタスク、コーディングエージェント、およびハイブリッド推論に対応したGLMのアップデート。
2026-04-03
✓ On ChinaAPI confirmed
Wan 2.7 Proは、ブランドカラー制御、マルチリファレンスの一貫性、最大4096 × 4096ピクセルの出力に対応した画像生成および編集ソフトウェアです。
2026-04-01
✓ On ChinaAPI confirmed
テキストから画像Wanの変換、編集、複数参照の生成、およびより強力なテキストレンダリングのための2.7モデル。
2026-04-01
✓ On ChinaAPI confirmed

チャット、コーディング、オフィスワーク、およびエージェントタスク向けのオープンウェイトMiniMaxモデル。
2026-03
✓ On ChinaAPI estimated

Alibaba Qwen3.5
Qwen 3.6および3.7ゲートウェイモデルの提供に先立つ、ネイティブなマルチモーダルエージェントQwenリリース。
2026-02-16
Not on ChinaAPI confirmed
Kling 3.0世代は、テキストからビデオへの変換、画像からビデオへの変換、オーディオ、および720pから4Kまでの出力レベルに対応しています。
2026-02-05
✓ On ChinaAPI confirmed
StepFun Step-3.5-Flash
256Kコンテキストとツール利用をサポートするオープンなStepFun Flashモデルです。 ChinaAPIではstep-3.5-flashを顧客向けに提供しています。最新料金はライブカタログをご確認ください。
2026-02-01
✓ On ChinaAPI confirmed

Seedream 5.0-liteイメージモデルは、作成、検索を制御でき、被写体の一貫性が向上しています。
2026-01-28
✓ On ChinaAPI confirmed
コスト効率の良い動画クリップを作成するための、高速なSeedance 2.0動画生成オプション。
2026-01-28
✓ On ChinaAPI confirmed
Seedance 2.0主力ビデオ生成モデルは、出力解像度に応じて課金されます。
2026-01-28
✓ On ChinaAPI confirmed
MiniMaxは、ネイティブサウンドタグ、改良された音声クローン機能、スタジオグレードのオーディオ、多言語音声に対応したSpeech 2.8リリースしました。Turboは、速度重視のオプションです。
2026-01-23
✓ On ChinaAPI confirmed
MiniMaxは、ネイティブサウンドタグ、改良された音声クローニング、スタジオグレードのオーディオ、多言語音声に対応したSpeech 2.8リリースしました。HDは高忠実度オプションです。
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
256Kコンテキストと視覚言語学習機能を備えた、オープンなネイティブマルチモーダルKimiエージェントモデル。
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Audio GLM Audio 出典 · docs.z.ai
Z.AIカスタム辞書のサポートと専門用語の認識機能を改善した多言語対応ASRモデルをリリースしました。
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
モデルサイズよりもデータ品質を重視した、小型の画像生成モデル。
2025-12
Not on ChinaAPI confirmed

Alibaba表現力豊かな音声、多言語および方言出力、低遅延APIアクセスを備えたオフライン音声合成のためにQwen3-TTS-Flashをリリースしました。
2025-09-22
✓ On ChinaAPI confirmed

文脈を考慮したテキスト読み上げ、グローバルおよびインラインの自然言語指示、表現力豊かな配信、およびOpenAI-compatible /v1/audio/speech出力。
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
公式音声とクローン音声、発音マッピング、スタイル制御機能を備えた、コスト効率の高い多言語音声合成。
Release date not publicly confirmed
Not on ChinaAPI unknown
公式音声とクローン音声による表現力豊かな音声合成、発音マッピング、スタイル制御、およびOpenAI-compatible出力。
Release date not publicly confirmed
✓ On ChinaAPI unknown
状況認識型表現力豊かな音声合成機能。ストリーミング出力に加え、音声、速度、音量の調整機能も備えています。
Release date not publicly confirmed
✓ On ChinaAPI unknown