Partenaire officiel de BytePlusBasé sur BytePlus, la plateforme d'IA officielle de ByteDance

Synthèse vocale multilingue

Synthèse vocale multilingue en 24 langues

KreatorFlow parle 24 langues et accents. Audio Generation donne une voix à chacune d'elles à partir d'un prompt écrit, et la synthèse vocale propose 45 voix prédéfinies en 14 langues pour une voix fixe et réutilisable.

  • 24 langues dans Audio Generation
  • 14 langues avec voix prédéfinies
  • 45 voix prédéfinies

Deux façons de parler plusieurs langues

Audio Generation : 24 langues

Vous choisissez une langue et le studio demande au modèle de la parler. La voix se décrit dans votre prompt au lieu d'être choisie dans une liste, donc le résultat peut varier d'une génération à l'autre. Les prompts acceptent jusqu'à 3 000 caractères, et un clip coûte 1 crédit par tranche de 10 secondes d'audio entamée.

Synthèse vocale : 14 langues

45 voix prédéfinies, chacune dans la langue qu'elle parle, donc la même voix sonne pareil à chaque fois. Les scripts acceptent jusqu'à 5 000 caractères et coûtent 1 crédit pour 1 000 caractères.

Langues disponibles

Audio Generation (24, guidé par le prompt)

  • Anglais
  • Anglais américain
  • Anglais indien
  • Mandarin
  • Cantonais
  • Espagnol
  • Espagnol mexicain
  • Français
  • Allemand
  • Italien
  • Portugais
  • Portugais brésilien
  • Japonais
  • Coréen
  • Russe
  • Arabe
  • Indonésien
  • Malais
  • Thaï
  • Vietnamien
  • Hindi
  • Néerlandais
  • Turc
  • Polonais

Synthèse vocale (14, voix prédéfinies)

  • Anglais
  • Mandarin
  • Japonais
  • Espagnol
  • Portugais
  • Indonésien
  • Français
  • Allemand
  • Coréen
  • Arabe
  • Russe
  • Italien
  • Vietnamien
  • Thaï

Voix prédéfinies par langue

Une voix prédéfinie pour chaque langue de la synthèse vocale, sous son vrai nom dans le studio.

Lequel choisir ?

Utilisez la synthèse vocale quand vous avez besoin de la même voix sur de nombreux clips, comme une voix de marque ou une série. Utilisez Audio Generation pour les langues et accents sans voix prédéfinie, comme le cantonais, le hindi, le néerlandais, le turc ou le polonais, et pour les scènes expressives que vous voulez décrire avec des mots.

Questions sur la synthèse vocale multilingue

Combien de langues sont prises en charge ?

24 dans Audio Generation et 14 dans la synthèse vocale, où 45 voix prédéfinies sont classées chacune dans la langue qu'elle parle.

Chaque voix prédéfinie parle-t-elle toutes les langues ?

Non. Chaque voix prédéfinie est classée dans une seule langue. Pour une langue sans voix prédéfinie, utilisez Audio Generation et décrivez la voix dans votre prompt.

Que signifie « guidé par le prompt » ?

Dans Audio Generation, vous choisissez la langue et décrivez la voix et l'intonation avec des mots. Il n'y a pas de voix fixe par langue, donc deux générations du même prompt peuvent sonner différemment.

Combien ça coûte ?

La synthèse vocale coûte 1 crédit par tranche de 1 000 caractères entamée, avec un minimum de 1 crédit par clip. Audio Generation coûte 1 crédit par tranche de 10 secondes entamée de l'audio généré, avec un minimum de 2 crédits par clip. Le studio affiche le coût, ou une estimation, avant la génération.

Puis-je traduire un enregistrement dans une autre langue ?

Oui, avec Live Interpretation, qui traduit un clip vocal vers l'une des 11 langues pour 3 crédits par minute d'audio.

Sur quelle plateforme fonctionne le studio audio ?

Basé sur BytePlus, la plateforme d'IA officielle de ByteDance. KreatorFlow est un partenaire officiel de BytePlus ; le studio audio et ses tarifs en crédits sont propres à KreatorFlow.

Parlez à chaque public

Générez une voix en 24 langues à partir d'un prompt, ou choisissez l'une des 45 voix prédéfinies.

Continuer la visite