モデル更新壁

中国におけるAIモデルのリリーススケジュール。

中国のAIモデルリリースに関するデータに基づいた情報ウォール。日付はリンク先のベンダーソースから取得。ChinaAPIの利用可否は各エントリに二次ステータスとして表示。ソースデータには、推定日付が3 、日付不明が5記載されています。

新しい順

壁を解放する。

2026-08-03

Alibaba Cloudは2026-08-03、Qwen史上最も高性能なフラッグシップモデルとしてqwen3.8-maxを公開しました。ネイティブ視覚言語モデルは2.4TパラメータのMixture-of-Expertsアーキテクチャを採用し、推論、テキスト生成、視覚理解に対応し、Qwen3.7シリーズから大幅に向上しています。公式Model Studio文書には、北京および複数の海外リージョンでOpenAI-compatible、Anthropic-compatible、DashScopeによるアクセスが記載されています。このルートは現在ChinaAPIで利用できます。

LLM ✓ On ChinaAPI confirmed 出典 · help.aliyun.com
2026-07-31

MiniMaxはH3(Hailuo 3.0)を公開しました。公式リリースノートによると、テキスト・画像・動画・音声のコンテキストから創作意図を理解し、より自然で一貫性のある生成を実現する新型のオープン汎用マルチモーダル動画モデルです。ChinaAPIは768Pおよび2Kで4〜15秒のクリップをネイティブステレオ音声付きでワンパス生成するルートを提供し、出力秒数ごとの課金でOpenAI-compatibleの動画エンドポイントから呼び出せます。

Video ✓ On ChinaAPI confirmed 出典 · platform.minimax.io
2026-07-31
ByteDance Doubao-Seedance-2.5 Seedance 2.5

Volcano EngineのArkモデルカタログには、Doubao-Seedance-2.5がmodel ID doubao-seedance-2-5-260628として掲載されています。2026-07-31にリリースされたこの動画モデルは、最大30秒の動画生成、最大50件の参照素材(画像30枚、動画10本、音声10本)、マルチモーダル参照、動画編集・延長、10以上の言語での生成に対応します。260628はモデルのバージョンタグです。ChinaAPIでは顧客向け呼び出しをまだ検証できていないため、モデルページや料金は公開していません。

Video Not yet confirmed 出典 · console.volcengine.com
2026-07-31

DeepSeekは既存のdeepseek-v4-flash APIルートを再ポストトレーニング済みチェックポイントへ更新しました。プレビュー版と同じアーキテクチャとモデル規模を維持しながら、コーディングとエージェント能力を強化しています。DeepSeekは最大推論強度と未公開の最小ハーネスを使い、Terminal Bench 2.1で82.7、DeepSWEで54.4、Toolathlon Verifiedで70.3と報告していますが、これはChinaAPIによる実測ではなくベンダー公表値です。公式ルートはResponses APIとCodex連携にネイティブ対応し、DeepSeekのWeb版、アプリ版、V4-Pro APIは今回の更新対象外です。

LLM ✓ On ChinaAPI confirmed 出典 · api-docs.deepseek.com
2026-07-25
Alibaba Cloud Qwen3.7-Flash Qwen3.7

Alibaba Cloudは、1Mコンテキストと最大131K出力を備えたネイティブ視覚言語Flashモデルを公開しました。Qwen3.6-Flashに比べ、マルチモーダル理解、現実世界と空間の認識、Search AgentとCI Agentの実行、マルチモーダルコーディングを強化しています。公式モデルはテキスト、画像、動画を入力でき、Responses API経由で内蔵ツールを利用できます。現在、ChinaAPIのゲートウェイにはこのルートは掲載されていません。

LLM Not yet confirmed Source · cn.aliyun.com
2026-07-16

Moonshot 、 1Mコンテキスト、常時オンの推論、ネイティブの画像およびビデオ理解機能を備えた2.8T-parameterフラッグシップをリリースしました。発表されたオープンソースの重みはJuly 27, 2026までに提供される予定です。

LLM ✓ On ChinaAPI confirmed 出典:kimi.com
2026-07-06
Tencent Hy3 Hunyuan

Tencent 256K-context安定性とコスト効率が向上した、高速思考と低速思考を組み合わせたハイブリッドモデルHy3を正式にリリースしました。

LLM ✓ On ChinaAPI confirmed 出典:tencent.com
2026-06-30

Meituanは、エージェントのコーディングや長期的なツール利用のために、 1Mコンテキストを含むオープンなMoE推論モデルを公開しました。

LLM ✓ On ChinaAPI confirmed 出典:meituan.com
2026-06-28

マルチモーダル推論、コーディング、およびプロダクションエージェントのワークフロー向けに、低遅延のDoubao Seed 2.1モデルを提供します。

LLM ✓ On ChinaAPI confirmed 出典:volcengine.com
2026-06-28

マルチモーダル推論、コーディング、ツール使用、および長期的なエージェントタスクのための、Doubao Seed 2.1フラッグシップモデル。

LLM ✓ On ChinaAPI confirmed 出典:volcengine.com
2026-06-22

意味理解とカメラ制御機能が向上した、HappyHorse 1.1テキスト・トゥ・ビデオ ゲートウェイ モデル。

Video ✓ On ChinaAPI confirmed
2026-06-22

HappyHorse 1.1 、複数の参照対象、シーン、スタイルの一貫性を確保するための、参照からビデオへのゲートウェイモデルです。

Video ✓ On ChinaAPI confirmed
2026-06-22

HappyHorse 1.1画像から動画へのゲートウェイモデル。テクスチャとアイデンティティの一貫性が強化されています。

Video ✓ On ChinaAPI confirmed
2026-06-16

オープンソースのフラッグシップ製品でGLM 1Mとより強力な長期的なコーディングおよびエージェントワークフローを備えています。

LLM ✓ On ChinaAPI confirmed 出典 · huggingface.co
2026-06-12

低遅延のコーディングおよびエージェントタスク向けに設計された、高速Kimi K2.7ゲートウェイの派生モデル。

LLM ✓ On ChinaAPI confirmed
2026-06-12

コーディングに特化した、長期的なリポジトリ作業のためのKimiゲートウェイモデル(画像認識機能付き)。

LLM ✓ On ChinaAPI confirmed
2026-06-02

MiMo音声認識は、中国語と英語のコードスイッチング、広東語、呉語、閩南語、四川語の方言、ノイズの多い録音や遠距離録音、複数の話者が同時に話す場合、歌詞の認識に対応しています。

Audio ✓ On ChinaAPI confirmed 出典:mimo.mi.com
2026-06-01

視覚分析、計画、ファイル、およびツール利用のためのマルチモーダルQwenゲートウェイモデル。

LLM ✓ On ChinaAPI confirmed
2026-06-01

1Mコンテキスト、MSAアテンション、コーディング、エージェント、画像、ビデオ入力をサポートするネイティブなマルチモーダルMシリーズモデル。

LLM ✓ On ChinaAPI confirmed 出典 · minimax.io
2026-05-28

256Kコンテキスト、画像入力、推論、およびツール使用機能を備えた高速StepFunゲートウェイモデル。

LLM ✓ On ChinaAPI confirmed
2026-05-26
Meituan LongCat-Video-Avatar 1.5 LongCat Video

音声駆動型アバター動画に関する技術リリース。リップシンク、アイデンティティの一貫性、および長尺動画の生成に重点を置いています。

Video Not yet confirmed 出典:arxiv.org
2026-05-21

高度な分析、コーディング、およびプロダクションエージェントのワークフローに対応する、Qwen社のフラッグシップゲートウェイモデル。

LLM ✓ On ChinaAPI confirmed
2026-04-27

Qwen 3.6 、視覚的推論、ファイル、およびエージェントワークフローのための高速な視覚言語モデルです。

LLM ✓ On ChinaAPI confirmed 出典:en.wikipedia.org
2026-04-27

高度なコーディングと長期タスクに対応する、 1Mコンテキストを持つ1.02T-parameter MiMoエージェントモデル。

LLM ✓ On ChinaAPI confirmed 出典 · huggingface.co
2026-04-27

1Mコンテキストと、テキスト、画像、ビデオ、音声の理解機能を備えたネイティブなオムニモーダルMiMoモデル。

LLM ✓ On ChinaAPI confirmed 出典 · huggingface.co
2026-04-25

Wan 2.7最初/最後のフレーム制御、継続、駆動オーディオ、および720 P/ 1080 P 出力による画像からビデオへの変換。

Video ✓ On ChinaAPI confirmed 出典 · help.aliyun.com
2026-04-23

MiMoは、高品質な内蔵音声と、ペース、感情、トーン、方言、キャラクターの演技を自然言語で制御できる、表現力豊かなテキスト読み上げ機能を提供します。

Audio ✓ On ChinaAPI confirmed 出典:mimo.mi.com
2026-04-14

長期的なコーディング、ビジュアルデザイン、およびエージェント群ワークフローのための、オープンなネイティブマルチモーダルKimiモデル。

LLM ✓ On ChinaAPI confirmed 出典 · huggingface.co
2026-04-07
Zhipu AI GLM-5V-Turbo GLM

画像、動画、ファイル、GUIエージェント、ツール駆動型ワークフローに対応した、 200K-contextマルチモーダル符号化基盤モデル。

LLM Not yet confirmed ソース · docs.bigmodel.cn
2026-04-03

Wan 2.7 、ローカル/グローバル編集および要素置換のための自然言語ビデオ編集モデルです。

Video ✓ On ChinaAPI confirmed
2026-04-03

Wan 2.7プロンプト駆動型ビデオ生成のためのテキストビデオモデル。

Video ✓ On ChinaAPI confirmed
2026-04-03

Wan 2.7視覚参照からの制御された生成のための参照ビデオモデル。

Video ✓ On ChinaAPI confirmed
2026-04-03

より長期的なタスク、コーディングエージェント、およびハイブリッド推論に対応したGLMのアップデート。

LLM ✓ On ChinaAPI confirmed 出典 · huggingface.co
2026-04-01

Wan 2.7 Proは、ブランドカラー制御、マルチリファレンスの一貫性、最大4096 × 4096ピクセルの出力に対応した画像生成および編集ソフトウェアです。

Image ✓ On ChinaAPI confirmed 出典 · help.aliyun.com
2026-04-01

テキストから画像Wanの変換、編集、複数参照の生成、およびより強力なテキストレンダリングのための2.7モデル。

Image ✓ On ChinaAPI confirmed
2026-03

チャット、コーディング、オフィスワーク、およびエージェントタスク向けのオープンウェイトMiniMaxモデル。

LLM ✓ On ChinaAPI estimated 出典 · minimax.io
2026-02-16
Alibaba Qwen3.5 Qwen

Qwen 3.6および3.7ゲートウェイモデルの提供に先立つ、ネイティブなマルチモーダルエージェントQwenリリース。

LLM Not yet confirmed 出典:en.wikipedia.org
2026-02-05

Kling 3.0世代は、テキストからビデオへの変換、画像からビデオへの変換、オーディオ、および720pから4Kまでの出力レベルに対応しています。

Video ✓ On ChinaAPI confirmed 出典:en.wikipedia.org
2026-02-01
StepFun Step-3.5-Flash Step

StepFunのFlashモデルを256Kコンテキストとツール使用サポート付きで開きます。

LLM Not yet confirmed 出典 · huggingface.co
2026-01-28

Seedream 5.0-liteイメージモデルは、作成、検索を制御でき、被写体の一貫性が向上しています。

Image ✓ On ChinaAPI confirmed
2026-01-28

コスト効率の良い動画クリップを作成するための、高速なSeedance 2.0動画生成オプション。

Video ✓ On ChinaAPI confirmed
2026-01-28

Seedance 2.0主力ビデオ生成モデルは、出力解像度に応じて課金されます。

Video ✓ On ChinaAPI confirmed
2026-01-23

MiniMaxは、ネイティブサウンドタグ、改良された音声クローン機能、スタジオグレードのオーディオ、多言語音声に対応したSpeech 2.8リリースしました。Turboは、速度重視のオプションです。

Audio ✓ On ChinaAPI confirmed 出典 · minimax.io
2026-01-23

MiniMaxは、ネイティブサウンドタグ、改良された音声クローニング、スタジオグレードのオーディオ、多言語音声に対応したSpeech 2.8リリースしました。HDは高忠実度オプションです。

Audio ✓ On ChinaAPI confirmed 出典 · minimax.io
2026-01-01
Moonshot kimi-k2.5 Kimi

256Kコンテキストと視覚言語学習機能を備えた、オープンなネイティブマルチモーダルKimiエージェントモデル。

LLM Not yet confirmed 出典 · huggingface.co
2025-12-10
Zhipu AI GLM-ASR-2512 GLM Audio

Z.AIカスタム辞書のサポートと専門用語の認識機能を改善した多言語対応ASRモデルをリリースしました。

Audio Not yet confirmed 出典 · docs.z.ai
2025-12
Meituan LongCat-Image LongCat

モデルサイズよりもデータ品質を重視した、小型の画像生成モデル。

Image Not yet confirmed 出典:en.wikipedia.org
2025-09-22

Alibaba表現力豊かな音声、多言語および方言出力、低遅延APIアクセスを備えたオフライン音声合成のためにQwen3-TTS-Flashをリリースしました。

Audio ✓ On ChinaAPI confirmed 出典 · help.aliyun.com
Release date not publicly confirmed

文脈を考慮したテキスト読み上げ、グローバルおよびインラインの自然言語指示、表現力豊かな配信、およびOpenAI-compatible /v1/audio/speech出力。

Audio ✓ On ChinaAPI unknown 出典 · platform.stepfun.com
Release date not publicly confirmed

公式音声とクローン音声、発音マッピング、スタイル制御機能を備えた、コスト効率の高い多言語音声合成。

Audio ✓ On ChinaAPI unknown 出典 · platform.stepfun.com
Release date not publicly confirmed

公式音声とクローン音声による表現力豊かな音声合成、発音マッピング、スタイル制御、およびOpenAI-compatible出力。

Audio ✓ On ChinaAPI unknown 出典 · platform.stepfun.com
Release date not publicly confirmed

状況認識型表現力豊かな音声合成機能。ストリーミング出力に加え、音声、速度、音量の調整機能も備えています。

Audio ✓ On ChinaAPI unknown ソース · docs.bigmodel.cn