Обновление модели стены

Что нового вышло в китайском ИИ.

Краткая лента релизов китайских AI-моделей со ссылками на источники и статусом доступности в ChinaAPI. В исходных данных отмечены 3 оценочные даты и 5 неподтверждённых дат.

Новейшие первыми

Освободите стену.

Xiaomi MiMo-V2.6-Pro-UltraSpeed
Xiaomi выпустила низколатентный режим обслуживания, сохраняющий омнимодальный ввод, флагманские возможности рассуждения, контекст 1M tokens и предел вывода 128K модели MiMo-V2.6-Pro. По заявлению Xiaomi, скорость вывода достигает 20-кратного уровня стандартного сервиса Pro; лимиты RPM и TPM предоставляются как индивидуальная услуга. Официальный API model ID — mimo-v2.6-pro-ultraspeed. ChinaAPI предоставляет маршрут mimo-v2.6-pro-ultraspeed для клиентских вызовов; актуальные цены указаны в каталоге.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Pro
Xiaomi выпустила нативную омнимодальную флагманскую модель рассуждений для сложных проектов, длительных задач, кибербезопасности и исследований. MiMo-V2.6-Pro принимает текст, изображения, видео и аудио, возвращает текст, поддерживает контекст 1M tokens и вывод до 128K, а также deep thinking, tool calling, streaming, web search, structured output и context caching. Официальный API model ID — mimo-v2.6-pro. ChinaAPI предоставляет этот маршрут клиентам; актуальные цены смотрите в live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi MiMo-V2.6-Flash
Xiaomi выпустила нативную омнимодальную модель рассуждений, оптимизированную для частых вызовов в профессиональной работе и масштабных задач при более низкой стоимости. MiMo-V2.6-Flash принимает текст, изображения, видео и аудио, возвращает текст, поддерживает контекст 1M tokens и вывод до 128K, а также deep thinking, tool calling, streaming, web search, structured output и context caching. Официальный API model ID — mimo-v2.6-flash. ChinaAPI предоставляет этот маршрут клиентам; актуальные цены смотрите в live catalog.
2026-09-22
✓ On ChinaAPI confirmed
Xiaomi Batch API for MiMo-V2.6
LLM MiMo Batch API Источник · mimo.mi.com
Xiaomi запустила асинхронный Batch API для mimo-v2.6-pro и mimo-v2.6-flash по цене 50% от стоимости API реального времени. Сервис предназначен для нерегулярных по времени задач — оценки, разметки и массовой генерации, принимает запросы JSONL и без streaming поддерживает форматы OpenAI Chat Completions, OpenAI Responses и Anthropic Messages. ChinaAPI предоставляет оба маршрута реального времени, но это не означает поддержку отдельного Batch API Xiaomi.
2026-09-22
Not on ChinaAPI confirmed
2026-09-20 StepFun выпустила Step 5 Preview как флагманскую модель для разработки ПО, длительных Agent-задач, профессиональной аналитической работы и финансов. Sparse Mixture-of-Experts-модель содержит 600B параметров, активирует 27B на token и поддерживает контекст 1M tokens. Официальный API model ID — step-5-preview; модель принимает текст, изображения и видео, возвращает текст и поддерживает до 64K tokens на выходе. Также доступны streaming, tool calling, JSON Mode, JSON Schema, уровни reasoning effort low/medium/high и prompt caching. StepFun сообщает 44 балла в Artificial Analysis Intelligence Index и публикует результаты benchmark по программированию, Agent-задачам, финансам и multimodal-сценариям; это данные поставщика, а не тесты ChinaAPI. StepFun планирует опубликовать open weights 2026-10-15. Теперь live catalog ChinaAPI предоставляет клиентский маршрут step-5-preview по цене поставщика: $1.00/M на вход, $2.70/M на выход и $0.05/M за чтение prompt cache; актуальные данные live Gateway имеют приоритет.
2026-09-20
✓ On ChinaAPI confirmed
Alibaba Qwen Qwen-Image-2.1 open weights
Qwen опубликовала веса Qwen-Image-2.1 2026-09-20. Компонент генерации изображений с 7B параметров объединяет генерацию по тексту и редактирование; заявлена поддержка прозрачности RGBA, до 10 референсных изображений, локальных правок и вывода в разрешении 2K. Это заявленные Qwen возможности, а не результаты испытаний ChinaAPI. Веса распространяются по Qwen Research License: без отдельной коммерческой лицензии разрешены только некоммерческие исследования и оценка. Alibaba Model Studio не опубликовала API model ID и цену для Qwen-Image-2.1, а ChinaAPI не предоставляет этот маршрут; страница модели и цена ChinaAPI не опубликованы.
2026-09-20
Not on ChinaAPI confirmed
2026-09-10 DeepSeek выпустила DeepSeek-V4.1-Flash и открыла её веса. Нативная модель для изображений и текста построена как 552B Mixture-of-Experts на новой архитектуре Causal Encoder-Decoder: при входном prefill активируются 8B параметров, при выходном decode — 16B; поддерживаются контекст 1M и вывод до 384K. По данным DeepSeek, результаты поставщика превосходят V4 Pro, а новый KV Cache требует 1/4 объёма HBM и 1/8 SSD по сравнению с предыдущей V4 Flash. Это заявления поставщика, а не тесты ChinaAPI. ID прямого DeepSeek API — deepseek-flash. Отдельные checkpoint V4 Flash и Vision-Exp прекращены, но прежние model IDs временно перенаправляются на V4.1 Flash. В live catalog ChinaAPI теперь вместо двух прежних Flash ID доступен канонический ID deepseek-flash, а два выведенных из эксплуатации маркетинговых URL Flash перенаправляются на его каноническую страницу. Вне пика ввод стоит $0.15/M, вывод $0.60/M и cache read $0.003/M; в пиковые часы по будням в Пекине цена ровно вдвое выше: $0.30/M, $1.20/M и $0.006/M соответственно. Актуальным источником остаётся live ChinaAPI Gateway. DeepSeek также объявляла, что после 2026-09-14 прямые вызовы deepseek-v4-pro будут направляться на V4.1 Flash, но затем отказалась от этого плана: DeepSeek V4 Pro остаётся доступной и после этой даты с прежней тарификацией, а deepseek-v4-pro остаётся отдельным маршрутом ChinaAPI.
2026-09-10
✓ On ChinaAPI confirmed
Tencent Hunyuan AuK and AuK-Flash open source
Tencent Hunyuan открыла исходный код и веса AuK и AuK-Flash 2026-09-09. AuK — базовая модель генерации и редактирования речи с 1.5B параметров, обученная на 1.95M часах эффективной разметки в пяти группах задач: генерация речи, редактирование контента, улучшение и разделение, паралингвистическое редактирование и акустическое редактирование. Единый интерфейс инструкций на естественном языке поддерживает zero-shot и instruction-based TTS, редактирование речи и текстов песен, изменение pitch, speed и volume, редактирование emotion и timbre, устранение акцента, невербальные звуки, улучшение речи и разделение источников. AuK-Flash — дистиллированная 4-step версия; статья сообщает об ускорении wall-clock в 4.5x относительно AuK в одинаковых условиях, но это результат поставщика, а не тест ChinaAPI. Оба официальных репозитория предлагают скачиваемые веса под MIT и используют Qwen2.5-Omni-3B как внешний encoder. Официальный код и SGLang-Omni описывают self-hosted inference, однако сейчас ChinaAPI не предоставляет клиентский AuK Route, поэтому цены API и Model Page не опубликованы.
2026-09-09
Not on ChinaAPI confirmed

2026-08-28 Tencent Hy Team открыла веса Hy4 preview. Это Mixture-of-Experts-модель с 770B параметров в основной сети и 49B активных параметров на token, дополненная нативным MTP-слоем на 10B для спекулятивного декодирования. Текстовая модель поддерживает контекст 1M и опубликована в двух официальных репозиториях весов: исходном и FP8. Tencent документирует OpenAI-compatible развёртывание через vLLM и SGLang; официальная матрица SGLang включает FP8 на 8x B200 или 4x B300/GB300 и BF16 на 16x H200. Модель распространяется по Apache-2.0 и позиционируется для длительных задач Software Engineering, офисного анализа, Game Development и Scientific Research. Опубликованные оценки принадлежат поставщику и не воспроизводились ChinaAPI. В ChinaAPI маршрут hy4-preview доступен для вызова клиентами, а также опубликованы отдельная Model Page и анализ Deployment и стоимости; актуальная цена определяется живым каталогом в реальном времени.
2026-08-28
✓ On ChinaAPI confirmed
2026-08-27 Z.ai выпустила и открыла веса GLM-5.3-Flash (320B-A18B), первой нативной мультимодальной модели семейства GLM-5. Она принимает текст, изображения, видео и файлы, поддерживает контекст 1M и вывод до 128K. В официальном Chat Completion API режим рассуждений всегда включён; доступны Function Calling, Context Caching и Structured Output. Архитектура для снижения стоимости сочетает Sparse Attention и Linear Attention с Manifold-Constrained Hyper-Connections. По данным Z.ai, модель предобучена на 30T мультимодальных tokens, а относительно GLM-5.3 объём вычислений Attention снижен в 3,01 раза и средний KV Cache на слой — в 4,44 раза. Z.ai также сообщает 57 баллов в Artificial Analysis Intelligence Index и Coding на уровне Claude Opus 4.8; это заявления поставщика, а не тесты ChinaAPI. Официальный API Route glm-5.3-flash теперь доступен в ChinaAPI через OpenAI-compatible и Anthropic-compatible Endpoint с вводом текста, изображений и видео.
2026-08-27
✓ On ChinaAPI confirmed
Qwen выпустила Qwen3.8-Flash-Next 2026-08-26 как мультимодальный Mixture-of-Experts preview архитектуры Qwen4. Языковая модель включает основную модель на 125B параметров, дополнительные N-gram embeddings на 51B, модуль MTP на 4B и активирует 6B параметров на token; нативный контекст 262K расширяется до 1M через YaRN. Qwen публикует официальные checkpoint BF16 и FP8: Hugging Face указывает около 360GB и 186GB, рецепт vLLM измеряет 335.28GiB и 172.78GiB. vLLM подтверждает 2x GB300 как минимальную официальную топологию FP8 и сообщает примерно 1,430 output tokens/s при concurrency 64 на 4x H100 с выгрузкой N-gram-таблицы в память host на случайной нагрузке 1,024 вход/256 выход. Сторонний рецепт NVFP4 также сообщает о запуске на одном DGX Spark 128GB, но использует неофициальный для Qwen 4-bit checkpoint и собственную serving-настройку, поэтому это не официальный минимум. Qwen Community License 1.0 требует отдельной лицензии до коммерческого использования для MaaS или определённого бизнеса AI Work Assistant. ChinaAPI предлагает qwen3.8-flash — управляемую production-модель на базе Flash-Next — как доступный клиентам route, не заявляя byte-identical соответствие загружаемым preview-весам.
2026-08-26
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-Vision-Exp
LLM DeepSeek V4 Flash Vision Источник · api-docs.deepseek.com
2026-08-21 DeepSeek запустила на своей API-платформе отдельную экспериментальную модель визуального понимания DeepSeek-V4-Flash-Vision-Exp. Она вызывается через model='deepseek-v4-flash-vision-exp' и принимает смешанный текстово-графический ввод через OpenAI-compatible Chat Completions и Responses API, а также Anthropic-совместимый Messages API. Изображения JPEG, PNG, GIF и WebP можно передавать в base64, по публичному URL или через Files API. Контекст составляет 1M, максимальный вывод — 384K; поддерживаются режимы с рассуждением и без него, JSON Output и Tool Calls, но не FIM. По заявлению DeepSeek, текстовые возможности Agent, рассуждения и знания о мире соответствуют официальной DeepSeek-V4-Flash, а результаты визуального Agent значительно улучшены; это данные поставщика, а не тесты ChinaAPI. Одно изображение преобразуется не более чем в 384 tokens и тарифицируется по официальным ставкам V4-Flash. На момент релиза маршрут deepseek-v4-flash-vision-exp был доступен в ChinaAPI; позднее его вывели из live catalog в пользу deepseek-flash, а старый маркетинговый URL перенаправляет на каноническую страницу.
2026-08-21
Not on ChinaAPI confirmed
Alibaba Qwen Qwen3.8 open weights: 27B and 2.4T-A95B
Qwen опубликовала две развёртываемые спецификации Qwen3.8 и четыре официальных репозитория весов. Qwen3.8-27B и Qwen3.8-27B-FP8 — варианты точности одной плотной нативной визуально-языковой модели. Qwen3.8-2.4T-A95B и её FP8-репозиторий — варианты одной текстовой Mixture-of-Experts-модели с 95B активных параметров. Обе спецификации поддерживают нативный контекст 262K и документированные пути самостоятельного размещения. Версия 27B распространяется по Apache-2.0, а версия 2.4T — по специальной Qwen3.8-Max License с требованиями об указании модели и условиями для высокодоходных сервисов MaaS или AI Work Assistant. В действующем каталоге ChinaAPI доступны для клиентских вызовов маршруты qwen3.8-27b и qwen3.8-2.4t-a95b; это не означает побайтового совпадения с опубликованными весами. Актуальные цены указаны в каталоге.
2026-08-14
✓ On ChinaAPI confirmed
Z.ai выпустила GLM-5.3 2026-08-14 и развернула модель для всех пользователей GLM Coding Plan. Она использует ту же базовую модель, что и GLM-5.2, а все улучшения получены на этапе постобучения. Текстовая модель поддерживает контекст 1M и вывод до 128K; режим рассуждений всегда включён, доступны уровни reasoning_effort low, high и max. Z.ai сообщает о приросте на 50% относительно GLM-5.2 во внутреннем тесте Z.ai Code Bench и об улучшениях в публичных тестах программирования и кибербезопасности; это заявления поставщика, а не тесты ChinaAPI. Официальный Model API теперь доступен, а маршрут glm-5.3 можно вызывать через ChinaAPI по OpenAI-совместимому интерфейсу. При переходе с конфигурации, где рассуждение было отключено, официальный справочник рекомендует сначала включить его и установить reasoning_effort=low, а затем менять model ID; иначе запрос завершится ошибкой (OpenAI-compatible).
2026-08-14
✓ On ChinaAPI confirmed
DeepSeek обновила существующий API-псевдоним deepseek-v4-pro: теперь он обслуживает DeepSeek-V4-Pro-0813. Способ вызова и model ID не изменились — запросы с deepseek-v4-pro получают последнюю версию. Официальная страница быстрого старта также подтверждает, что deepseek-v4-flash по-прежнему указывает на DeepSeek-V4-Flash-0731. Это было обновление обслуживаемой версии, а не новый API-маршрут. Позднее DeepSeek отказалась от запланированного переключения deepseek-v4-pro на V4.1 Flash; V4 Pro остаётся доступной и после 2026-09-14 с прежней тарификацией, поэтому существующие интеграции ChinaAPI могут сохранить прежний model ID.
2026-08-13
✓ On ChinaAPI confirmed
Alibaba Cloud выпустила qwen3.8-max 2026-08-03 как самую мощную на сегодняшний день флагманскую модель Qwen. Нативная визуально-языковая модель использует архитектуру Mixture-of-Experts с 2.4T параметров, поддерживает рассуждение, генерацию текста и визуальное понимание и значительно превосходит серию Qwen3.7. Официальная документация Model Studio указывает доступ через OpenAI-compatible, Anthropic-compatible и DashScope в Пекине и нескольких глобальных регионах. Теперь этот маршрут доступен через ChinaAPI.
2026-08-03
✓ On ChinaAPI confirmed

MiniMax выпустила H3 (Hailuo 3.0). В официальных заметках о релизе модель описана как открытая универсальная мультимодальная видеомодель нового поколения, которая понимает творческий замысел по контексту из текста, изображений, видео и аудио и даёт более естественную, связную генерацию. ChinaAPI обслуживает маршрут для клипов длиной 4–15 секунд в 768P и 2K с нативным стереозвуком за один проход; тарификация — за секунду вывода, вызов — через видеоэндпоинт OpenAI-compatible.
2026-07-31
✓ On ChinaAPI confirmed
ByteDance Doubao-Seedance-2.5
В каталоге моделей Ark от Volcano Engine модель Doubao-Seedance-2.5 указана с model ID doubao-seedance-2-5-260628. Выпущенная 2026-07-31 видеомодель создаёт видео длительностью до 30 секунд, принимает до 50 референсных материалов (30 изображений, 10 видео и 10 аудиоклипов), поддерживает мультимодальные референсы, редактирование и продление видео, а также генерацию более чем на 10 языках. 260628 остаётся тегом версии модели. ChinaAPI предоставляет этот маршрут для клиентских вызовов; актуальные цены указаны в каталоге.
2026-07-31
✓ On ChinaAPI confirmed
DeepSeek DeepSeek-V4-Flash-0731
DeepSeek обновила существующий API-маршрут deepseek-v4-flash, установив повторно дообученную контрольную точку с прежней архитектурой и размером Preview-версии, но с усиленными возможностями программирования и агентов. При максимальной глубине рассуждений и ещё не опубликованном minimal harness DeepSeek сообщает 82.7 в Terminal Bench 2.1, 54.4 в DeepSWE и 70.3 в Toolathlon Verified; это результаты поставщика, а не тесты ChinaAPI. Официальный маршрут получил нативную поддержку Responses API и интеграции с Codex; веб-приложение DeepSeek, мобильное приложение и V4-Pro API в это обновление не входили.
2026-07-31
Not on ChinaAPI confirmed
Alibaba Cloud Qwen3.7-Flash
Alibaba Cloud выпустила нативную визуально-языковую Flash-модель с контекстом 1M и выходом до 131K. По сравнению с Qwen3.6-Flash улучшены мультимодальное понимание, восприятие реального мира и пространства, выполнение задач Search Agent и CI Agent, а также мультимодальное программирование. Официальная модель принимает текст, изображения и видео и предоставляет встроенные инструменты через Responses API. ChinaAPI предоставляет qwen3.7-flash для клиентских вызовов; актуальные цены указаны в каталоге.
2026-07-25
✓ On ChinaAPI confirmed
Moonshot выпустила свой 2.8T-parameter продукт с 1M , постоянно работающим логическим выводом и встроенным пониманием изображений и видео. Анонсированные весовые коэффициенты с открытым исходным кодом должны появиться к July 27, 2026
2026-07-16
✓ On ChinaAPI confirmed
Компания Tencent официально выпустила Hy3 — гибридную модель обработки 256K-context , сочетающую в себе быстроту и медленное мышление, с улучшенной стабильностью и экономической эффективностью.
2026-07-06
✓ On ChinaAPI confirmed

Компания Meituan выпустила свою открытую модель рассуждений MoE с 1M контекстов для агентов кодирования и использования инструментов в долгосрочной перспективе.
2026-06-30
✓ On ChinaAPI confirmed
Модель Doubao Seed 2.1 с низкой задержкой для многомодального рассуждения, кодирования и рабочих процессов производственных агентов.
2026-06-28
✓ On ChinaAPI confirmed
Флагманская модель Doubao Seed 2.1 для многомодального мышления, кодирования, использования инструментов и решения задач агента в долгосрочной перспективе.
2026-06-28
✓ On ChinaAPI confirmed
Video HappyHorse
Модель шлюза HappyHorse 1.1 для преобразования текста в видео с улучшенным семантическим пониманием и управлением камерой.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Модель шлюза HappyHorse 1.1 для связи с видеоисточниками обеспечивает согласованность по темам, сценам и стилям при использовании нескольких источников.
2026-06-22
✓ On ChinaAPI confirmed
Video HappyHorse
Модель шлюза преобразования изображений в видео HappyHorse 1.1 с более выраженной согласованностью текстуры и идентичности.
2026-06-22
✓ On ChinaAPI confirmed
Флагманский GLM с 1M исходным кодом, обладающий контекстом и более надежной долгосрочной стратегией программирования и рабочими процессами агентов.
2026-06-16
✓ On ChinaAPI confirmed
Модель Fast Seedance 2.0 для создания коротких видеороликов по более низкой цене.
2026-06-15
✓ On ChinaAPI confirmed
Высокоскоростной шлюзовой вариант Kimi K2.7 для задач кодирования и работы с агентами с низкой задержкой.
2026-06-12
✓ On ChinaAPI confirmed
Ориентированная на программирование модель шлюза Kimi для работы с репозиториями в долгосрочной перспективе с поддержкой компьютерного зрения.
2026-06-12
✓ On ChinaAPI confirmed
Система распознавания речи MiMo подходит для распознавания речи при переключении кодов между китайским и английским языками, кантонского, уского, миньнаньского и сычуаньского диалектов, зашумленных и удаленных записей, наложения голосов говорящих и текста песен.
2026-06-02
✓ On ChinaAPI confirmed
Мультимодальная модель шлюза Qwen для визуального анализа, планирования, работы с файлами и использования инструментов.
2026-06-01
✓ On ChinaAPI confirmed
Встроенная мультимодальная модель M-серии с контекстом 1M , механизмом внимания MSA, поддержкой кодирования, агентами, изображениями и видеовходом.
2026-06-01
✓ On ChinaAPI confirmed

Быстрая модель шлюза StepFun с контекстом 256K , вводом визуальной информации, логическим выводом и использованием инструментов.
2026-05-28
✓ On ChinaAPI confirmed
Meituan LongCat-Video-Avatar 1.5
Video LongCat Video Источник · arxiv.org
Технический релиз видеоролика с аватарами, управляемый звуком, с упором на синхронизацию губ, согласованность идентичности и создание длинных видеороликов.
2026-05-26
Not on ChinaAPI confirmed
Флагманская модель шлюза Qwen для сложных задач анализа, программирования и работы с производственными агентами.
2026-05-21
✓ On ChinaAPI confirmed

Qwen 3.6 быстрая модель обработки визуальной информации и языка для визуального анализа, работы с файлами и рабочих процессов агентов.
2026-04-27
✓ On ChinaAPI confirmed
Модель агента MiMo с 1.02T-parameter и 1M контекстом для сложных задач кодирования и задач с длительным горизонтом планирования.
2026-04-27
✓ On ChinaAPI confirmed
Встроенная всенаправленная модель MiMo с пониманием контекста 1M ), текста, изображений, видео и аудио.
2026-04-27
✓ On ChinaAPI confirmed
Wan 2.7 Преобразование изображения в видео с управлением первым/последним кадром, продолжением, управляющим звуком и 720 P/ 1080 P выходом.
2026-04-25
✓ On ChinaAPI confirmed
DeepSeek deepseek-v4-flash
Быстрый вариант DeepSeek V4 для эффективного чата, помощи в программировании и работы с агентами.
2026-04-24
Not on ChinaAPI confirmed
MiMo — это выразительная система преобразования текста в речь с высококачественными встроенными голосами и возможностью управления темпом, эмоциями, тоном, диалектом и манерой речи персонажей на естественном языке.
2026-04-23
✓ On ChinaAPI confirmed
Открытая нативная многомодальная модель Kimi для долгосрочного программирования, визуального дизайна и рабочих процессов с использованием роя агентов.
2026-04-14
✓ On ChinaAPI confirmed
Zhipu AI GLM-5V-Turbo
Базовая модель 200K-context кодирования для рабочих процессов, управляемых изображениями, видео, файлами, GUI и инструментами.
2026-04-07
Not on ChinaAPI confirmed
Модель видеомонтажа Wan 2.7 основанная на естественном языке, для локального/глобального редактирования и замены элементов.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Модель Wan 2.7 для преобразования текста в видео, предназначенная для генерации видео по подсказкам.
2026-04-03
✓ On ChinaAPI confirmed
Video Wan
Модель Wan 2.7 , использующая видео в качестве эталона для управляемой генерации на основе визуальных эталонов.
2026-04-03
✓ On ChinaAPI confirmed
Обновление GLM для задач с более длительным горизонтом планирования, кодирующих агентов и гибридного мышления.
2026-04-03
✓ On ChinaAPI confirmed
Wan 2.7 Pro — программа для создания и редактирования изображений с контролем цвета в соответствии с фирменными стандартами, обеспечением согласованности нескольких эталонных изображений и выводом до 4096 × 4096 пикселей.
2026-04-01
✓ On ChinaAPI confirmed
Модель 2.7 для преобразования текста Wan изображение, редактирования, генерации множественных ссылок и более эффективного отображения текста.
2026-04-01
✓ On ChinaAPI confirmed

Модель MiniMax с открытым исходным кодом для чата, программирования, офисной работы и задач, выполняемых агентами.
2026-03
✓ On ChinaAPI estimated

Alibaba Qwen3.5
Нативная версия Qwen с многомодальным агентом, предшествовавшая моделям шлюзов Qwen 3.6 и 3.7 , предназначенным для обслуживания.
2026-02-16
Not on ChinaAPI confirmed
Вариант Kling 3.0 Omni предназначен для рабочих процессов, связанных с видеомонтажом и редактированием.
2026-02-05
✓ On ChinaAPI confirmed
Kling 3.0 — это технология с поддержкой преобразования текста в видео, изображений в видео, аудио и вывода изображения в разрешение 720p и 4K .
2026-02-05
✓ On ChinaAPI confirmed
StepFun Step-3.5-Flash
Открытая flash-модель StepFun с контекстом 256K и поддержкой использования инструментов. ChinaAPI предоставляет step-3.5-flash для клиентских вызовов; актуальные цены указаны в каталоге.
2026-02-01
✓ On ChinaAPI confirmed

Модель изображений Seedream 5.0-lite с контролируемым созданием, поиском и более высокой согласованностью тематики.
2026-01-28
✓ On ChinaAPI confirmed
Быстрая функция генерации видео Seedance 2.0 для экономичного создания видеороликов.
2026-01-28
✓ On ChinaAPI confirmed
В рамках флагманской модели генерации видео Seedance 2.0 оплата производится в зависимости от разрешения выходного изображения.
2026-01-28
✓ On ChinaAPI confirmed
Компания MiniMax выпустила Speech 2.8 с встроенными звуковыми метками, улучшенным клонированием голоса, студийным качеством звука и поддержкой кроссъязыковой речи; Turbo — это вариант, ориентированный на скорость.
2026-01-23
✓ On ChinaAPI confirmed
Компания MiniMax выпустила Speech 2.8 с встроенными звуковыми метками, улучшенным клонированием голоса, студийным качеством звука и поддержкой кроссъязыковой речи; HD — это вариант с высоким качеством звука.
2026-01-23
✓ On ChinaAPI confirmed
Moonshot kimi-k2.5
Открытая нативная мультимодальная агентная модель Kimi с 256K контекстов и обучением на основе визуально-языковых данных.
2026-01-01
Not on ChinaAPI confirmed

Zhipu AI GLM-ASR-2512
Z.AI выпустила свою ASR модель с улучшенной поддержкой пользовательских словарей и распознаванием специализированной терминологии.
2025-12-10
Not on ChinaAPI confirmed
Meituan LongCat-Image
Небольшая модель генерации изображений, ориентированная на качество данных, а не на размер модели.
2025-12
Not on ChinaAPI confirmed

Hailuo 2.3 улучшает воспроизведение сложных движений, физических действий, стилизацию и микровыражения.
2025-10-28
✓ On ChinaAPI confirmed

Компания Alibaba выпустила Qwen3-TTS-Flash — систему синтеза речи в автономном режиме с выразительными голосами, многоязычным и диалектным выводом, а также доступом к API с низкой задержкой.
2025-09-22
✓ On ChinaAPI confirmed

Контекстно-зависимая система преобразования текста в речь с глобальным и встроенным управлением естественной речью, выразительной подачей и OpenAI-compatible /v1/audio/speech .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Быстрая потоковая транскрипция 4B для китайско-английских аудиозаписей с нормализацией ITN и маршрутом OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
StepFun Step TTS Mini
Экономически эффективная многоязычная система синтеза речи с использованием официальных и клонированных голосов, сопоставлением произношения и управлением стилем.
Release date not publicly confirmed
Not on ChinaAPI unknown
Выразительный синтез речи с использованием официальных и клонированных голосов, сопоставление произношения, управление стилем и вывод в формате OpenAI-compatible .
Release date not publicly confirmed
✓ On ChinaAPI unknown
Контекстно-ориентированный выразительный синтез речи с потоковым выводом и элементами управления голосом, скоростью и громкостью.
Release date not publicly confirmed
✓ On ChinaAPI unknown