Официальный партнер BytePlusРаботает на BytePlus, официальной ИИ-платформе ByteDance
Многоязычный синтез речи
Многоязычный синтез речи на 24 языках
KreatorFlow говорит на 24 языках и с разными акцентами. Audio Generation озвучивает каждый из них по текстовому промпту, а Text to Speech предлагает 45 голосов на 14 языках, если нужен постоянный голос для повторного использования.
- 24 языка в Audio Generation
- 14 языков с готовыми голосами
- 45 голосов в Text to Speech
Два способа говорить на разных языках
Audio Generation: 24 языка
Вы выбираете язык, и студия просит модель говорить на нем. Голос описывается в промпте, а не выбирается из списка, поэтому результат может отличаться от генерации к генерации. Промпт может содержать до 3 000 символов, а клип стоит 1 кредит за каждые начатые 10 секунд аудио.
Text to Speech: 14 языков
45 голосов, у каждого свой язык, поэтому один и тот же голос всегда звучит одинаково. Сценарий может содержать до 5 000 символов и стоит 2 кредита за каждые 1 000 символов.
Доступные языки
Audio Generation (24, по промпту)
- Английский
- Американский английский
- Индийский английский
- Мандаринский китайский
- Кантонский
- Испанский
- Мексиканский испанский
- Французский
- Немецкий
- Итальянский
- Португальский
- Бразильский португальский
- Японский
- Корейский
- Русский
- Арабский
- Индонезийский
- Малайский
- Тайский
- Вьетнамский
- Хинди
- Нидерландский
- Турецкий
- Польский
Text to Speech (14, готовые голоса)
- Английский
- Мандаринский китайский
- Японский
- Испанский
- Португальский
- Индонезийский
- Французский
- Немецкий
- Корейский
- Арабский
- Русский
- Итальянский
- Вьетнамский
- Тайский
Готовые голоса по языкам
По одному готовому голосу на каждый язык Text to Speech, под тем же именем, что и в студии.
Что выбрать?
Выбирайте Text to Speech, когда нужен один и тот же голос во многих клипах, например голос бренда или серии. Выбирайте Audio Generation для языков и акцентов без готовых голосов, таких как кантонский, хинди, нидерландский, турецкий или польский, и для выразительных сцен, которые хочется описать словами.
Вопросы о многоязычном синтезе речи
Сколько языков поддерживается?
24 языка в Audio Generation и 14 языков в Text to Speech, где 45 голосов распределены по языкам, на которых они говорят.
Говорит ли каждый готовый голос на всех языках?
Нет. Каждый готовый голос относится к одному языку. Для языка без готового голоса используйте Audio Generation и опишите голос в промпте.
Что значит «по промпту»?
В Audio Generation вы выбираете язык и описываете голос и интонацию словами. Постоянного голоса для языка нет, поэтому две генерации одного промпта могут звучать по-разному.
Сколько это стоит?
Синтез речи стоит 2 кредита за каждые начатые 1 000 символов, минимум 2 кредита за клип. Audio Generation стоит 1 кредит за каждые начатые 10 секунд созданного аудио, минимум 2 кредита за клип. Студия показывает стоимость или ее оценку до генерации.
Можно ли перевести запись на другой язык?
Да, с помощью Live Interpretation: он переводит голосовой клип на один из языков (всего 11 языков) за 3 кредита в минуту аудио.
На какой платформе работает аудиостудия?
Работает на BytePlus, официальной ИИ-платформе ByteDance. KreatorFlow является официальным партнером BytePlus; аудиостудия и ее цены в кредитах принадлежат самой KreatorFlow.
Говорите с каждой аудиторией
Создайте голос на 24 языках по промпту или выберите один из готовых голосов (всего 45 голосов).