Входные данные
Текст, а также встроенный голос или элементы управления для создания/клонирования голоса, поддерживаемые определенным образом.
центр аудио-речевых возможностей
Сравните TTS по типу конечного устройства, управлению голосом, единице выставления счетов, рабочему процессу вывода и исполняемому запросу речи.
Договор
Текст, а также встроенный голос или элементы управления для создания/клонирования голоса, поддерживаемые определенным образом.
Аудиозапись речи в формате, поддерживаемом моделью, или аудиополе в ответе чата.
POST /v1/audio/speech or POST /v1/chat/completions, according to api_mode
Синхронный режим. Сохраните двоичный аудиоответ или декодируйте аудиополе, возвращаемое режимом чата.
Поддерживаемые задачи
преобразование текста в речь, клонирование голоса, разработка голоса
Лимит: Идентификация голоса, согласие на клонирование, языковой охват, потоковая передача, ограничения по количеству символов и форматы вывода зависят от модели устройства.
Соответствующий каталог
Неизвестные возможности опускаются и никогда не определяются по названию модели. В примерах цен используются синхронизированные общедоступные данные; актуальные цены Dash Pricing остаются авторитетными.
Xiaomi MiMo-V2.5-TTS — выразительный многоязычный синтез речи со встроенными голосами, инструкциями по стилю речи на естественном языке, управлением эмоциями, темпом, тоном, диалектом и символикой.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/chat/completions
Пример расчета стоимости: 1 10k символов × $0 = $0 .
StepAudio 2.5 TTS — контекстный синтез речи с встроенным управлением естественной речью, выразительной подачей, встроенными голосами и OpenAI-compatible аудиовыходом.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.85k символов × $0.85 = $0.85 .
GLM-TTS — контекстно-зависимый синтез речи с выразительной подачей, потоковым выводом, быстрым первым аудиосигналом и элементами управления голосом, скоростью и громкостью.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.307692k символов × $0.307692 = $0.307692 .
Qwen3-TTS-Flash — Многоязычный синтез речи с низкой задержкой, поддержкой ввода на разных языках, встроенными голосами, автоматическим сопоставлением языков и указанием символов.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.123077k символов × $0.123077 = $0.123077 .
MiniMax Speech 2.8 HD — высококачественный синтез речи с естественной передачей эмоций, улучшением речи, управлением голосом и поддержкой аудиоформатов.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.538462k символов × $0.538462 = $0.538462 .
MiniMax Speech 2.8 Turbo — синтез речи с упором на скорость, естественным звучанием, управлением эмоциями, улучшением речи и поддержкой распространенных аудиоформатов.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.307692k символов × $0.307692 = $0.307692 .
Шаг TTS 2 — выразительный синтез речи с использованием официальных и клонированных голосов, регулировка скорости и громкости, сопоставление произношения и несколько форматов вывода.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.4k символов × $0.4 = $0.4 .
Step TTS — экономичный инструмент для выразительного синтеза речи на китайском, английском, японском, кантонском и сычуаньском языках, с использованием официальных и клонированных голосов.
Задачи: видео со звуком, преобразование текста в речь
Конечная точка: POST /v1/audio/speech
Пример расчета стоимости: 1 10.15k символов × $0.15 = $0.15 .
Рассчитайте API · Сгенерируйте curl, Python или JavaScript. · Установите рецепт агента Seedance 2
Источник и метод: общедоступный набор данных о ценообразовании моделей, обновлено 2026-08-08 . Ограничения указаны выше; претензии третьих лиц остаются рядом со страницами моделей, на которые они ссылаются.