Аналитика ChinaAPI · Ценообразование
Ценовая политика в отношении API для искусственного интеллекта в Китае — июль 2026
Стоимость LLM API для обработки изображений и видео в 2026 — $0.20 , 1M-context , расчеты за секунду и за одну генерацию видео, а также что выбрать в зависимости от рабочей нагрузки.
Китайские производители моделей в течение последнего квартала снижали цены друг на друга, и в результате образовался самый дешевый в мире рынок, находящийся на границе между развивающимися API . Данный анализ в настоящее время охватывает 65 модель, доступная через наш шлюз: 33 LLM и 32 моделей изображений/видео. Все цены ниже генерируются из наш общедоступный набор данных о ценах а не копируются в эту статью вручную. Dataset revision: 2026-09-27; pricing fingerprint: 2ad46808ed81aa41.
Сразу оговорюсь: Цена не определяет качество. В этой статье рассказывается о стоимости товаров и услуг; наша серия сравнительных показателей (показатели выполнения задач по каждой модели, измеренные через тот же шлюз) — это дополнение, которое покажет вам их реальную ценность.
Входной уровень ниже $0.20
6 моделей стоят менее $0.20 за миллион входных tokens. Внутри этого уровня важно сравнивать стоимость вывода: при одинаково дешёвом вводе расходы могут сильно разойтись на длинных ответах.
| Модель | Продавец | Вход / 1M | Выход / 1M | Контекст |
|---|---|---|---|---|
| step-3.5-flash | StepFun | $0.1 | $0.3 | 256K |
| step-3.5-flash-2603 | StepFun | $0.1 | $0.3 | 256K |
| mimo-v2.5 | Xiaomi | $0.14 | $0.28 | 1M |
| hy3 | Tencent | $0.1481 | $0.5926 | 256K |
| qwen3.8-flash | Alibaba | $0.15 | $0.47 | 1M |
| glm-5.3-flash | Zhipu AI | $0.15 | $0.5 | 1M |
Два момента бросаются в глаза. Во-первых, deepseek-v4-flash и Xiaomi 's mimo-v2.5 В настоящее время опубликованы одинаковые показатели входящего и исходящего трафика. Во-вторых, следите за выход цены, а не только затраты: qwen3.6-flash находится в том же низкопроизводительном сегменте, но его выходная скорость равна $4 , в отличие от $1.2 для deepseek-v4-flashЭтот разрыв является доминирующим фактором в задачах, требующих интенсивной генерации данных.
Клуб 1M-context
18 из 33 LLM текущего каталога публикуют окно контекста 1M-token: qwen3.6-flash, qwen3.6-plus, qwen3.7-max, qwen3.7-plus, qwen3.8-flash, qwen3.8-max, deepseek-flash, deepseek-v4-pro, LongCat-2.0, MiniMax-M3, kimi-k3, step-5-preview, hy4-preview, mimo-v2.5, mimo-v2.5-pro, glm-5.2, glm-5.3, glm-5.3-flashГод назад 1M был первостепенной характеристикой; на китайском рынке он становится обязательным условием.
Самая низкая опубликованная ставка входных данных среди этих моделей с миллионом контекстов представлена следующим образом: deepseek-v4-flash по $0.3 за миллион входных токенов. Наиболее интересная запись в длинном контексте — это Meituan 's LongCat-2.0: открытая модель рассуждений MoE на $0.3 / $1.2 с полным 1M — характеристики флагманского класса по цене уровня Flash.
Флагманские цены от поставщика
Берется наивысшая опубликованная цена каждого поставщика. выход Цена в текущем текстовом каталоге, используемая в качестве последовательного показателя, а не рейтинга качества, позволяет получить следующее сравнение:
| Продавец | Самая дорогая текстовая модель | Вход / 1M | Выход / 1M | Контекст |
|---|---|---|---|---|
| Moonshot | kimi-k3 | $3 | $15 | 1M |
| Alibaba | qwen3.7-max | $2.5 | $7.5 | 1M |
| ByteDance | doubao-seed-2-1-pro-260628 | $0.8889 | $4.4444 | 256K |
| Zhipu AI | glm-5.1 | $1.4 | $4.4 | 200K |
| DeepSeek | deepseek-v4-pro | $1.32 | $3.96 | 1M |
| MiniMax | MiniMax-M3 | $0.9 | $3.6 | 1M |
| StepFun | stepaudio-2.5-chat | $1.5 | $3.5 | — |
| Tencent | hy4-preview | $0.8889 | $2.6667 | 1M |
| Meituan | LongCat-2.0 | $0.3 | $1.2 | 1M |
| Xiaomi | mimo-v2.5-pro | $0.435 | $0.87 | 1M |
Высокоскоростная линия кодирования Moonshot в настоящее время обеспечивает самую высокую производительность в этой таблице — $8 на миллион токенов. Tencent 's hy3 На другом конце находится $0.5926 . Этот разброс цен — это утверждение поставщиков о существенной разнице в качестве, а не доказательство аналогичного разрыва в качестве; только показатели выполнения задач могут ответить на вопрос, оправдана ли эта разница.
Tencent 's hy3 Заслуживает особого внимания: модель крупного поставщика с $0.1481 входом / $0.5926 выходом на миллион токенов. Проблемы с доступом за пределами Китая — это именно тот пробел, который призван закрыть этот шлюз.
Запустите эти модели самостоятельно. Одна API key OpenAI-compatible и прозрачное ценообразование в долларах США. Актуальный курс можно посмотреть на странице с текущими ценами.
Получите ключ — $2 бесплатного кредитаВидео: в секунду против в клипе, с реальными математическими расчетами.
Цены на видеоуслуги бывают двух типов, и для их сравнения не требуется никаких сложных вычислений, которые поставщики услуг за вас не делают:
| Модель | Продавец | Выставление счетов | 5-second показательный фрагмент |
|---|---|---|---|
| happyhorse-1.1-t2v | Alibaba | $0.075 в секунду | $0.375 |
| wan2.7-t2v | Alibaba | $0.1 в секунду | $0.5 |
| MiniMax-Hailuo-2.3-Fast | MiniMax | $0.1875 за одну генерацию | $0.1875 |
| MiniMax-Hailuo-2.3 | MiniMax | $0.2778 за одну генерацию | $0.2778 |
| kling-v3 | Kuaishou | $0.4799 за 5-секундную бесшумную генерацию 720p | $0.4799 |
| kling-3.0-turbo | Kuaishou | $0.5556 за одну генерацию | $0.5556 |
Для коротких черновиков, за одну генерацию MiniMax-Hailuo-2.3-Fast Параметр $0.1875 используется в конфигурации репрезентативного каталога. Посекундная оплата ( HappyHorse , Wan ) может быть предпочтительнее, когда вам нужны очень короткие клипы или точный контроль длительности. В строке ByteDance Seedance указана цена, зависящая от конфигурации, поэтому в общедоступном наборе данных намеренно отмечаются строки без одной репрезентативной цены за единицу и вместо этого указывается цена в реальном времени.
Что выбрать в зависимости от объема работы
Наша позиция, основанная исключительно на ценах и технических характеристиках (критерии качества приводятся отдельно):
- Массовое извлечение, классификация, RAG обработка:
deepseek-v4-flashилиmimo-v2.5— В настоящее время оба приложения публикуют входные данные $0.3 /M с окном 1M . - Агенты по оформлению длинных документов с ограниченным бюджетом:
LongCat-2.0— 1M и рассуждения настроены на $0.3 / $1.2 . - Многомодальные агентные циклы (ввод изображений и видео):
MiniMax-M3— Согласно опубликованным производителем техническим характеристикам, в настоящее время это единственная 1M-context многомодальная модель в этом каталоге. - Недорогие видеочерновики среди репрезентативных строк за одну генерацию:
MiniMax-Hailuo-2.3-FastВ настоящее время $0.1875 на одну генерацию. - Премиум-кодирование: Moonshot 's
kimi-k2.7-codeЭта строка представляет собой ценовой аномалию. Проведите сравнительный анализ на собственном репозитории, прежде чем принимать решение о расходах.
Чего эта статья не рассказывает
- Качество. Дешевая модель, которая дважды не справляется с задачей, может стоить дороже, чем премиальная модель, которая справляется с ней один раз. Наш эталон выполнения задач — это дополнение к этому.
- Устойчивость под нагрузкой. API китайских поставщиков различаются по ограничениям скорости и поведению в часы пик; мы обходим некоторые из этих ограничений на уровне шлюза, но пока не опубликовали конкретные данные.
- Цены завтрашнего дня. Продавцы агрессивно пересматривают цены (обычно в сторону понижения, иногда с акциями и последующим возвратом к прежнему уровню). Теперь мы фиксируем каждое изменение цены, поэтому в будущих выпусках этой статьи будут показаны трендовые линии, а не только моментальный снимок.
Все 65 модель доступны через один OpenAI-compatible Endpoint с единым ключом. Скачать: JSON или CSV, прочитайте методологияи используйте $2 кредит, чтобы проверить опубликованную цену, отправив реальный запрос.
Попробуйте на ChinaAPI . Все модели, описанные в этой статье, работают через одну точку доступа — не требуется учетная запись или номер телефона в материковом Китае, $2 бесплатная пробная версия для начала.
Начните бесплатно — кредит в $2 Посмотреть актуальные цены