Choisir son modèle : Rapide ou Qualité
Mis à jour le
Deux modèles, deux usages
Le module Voix off vous laisse choisir entre deux modèles de synthèse vocale. Ce choix influe sur le naturel de la voix, sur la vitesse de génération, sur la prise en charge des balises d'expression et sur le coût en tokens.
Rapide (Turbo v2.5)
Le modèle Rapide privilégie la vitesse. Il génère votre voix off avec une latence réduite et un coût en tokens un peu plus faible. C'est le bon choix quand vous produisez beaucoup de voix off, quand vous itérez sur un texte ou quand une lecture claire et neutre suffit. En revanche, il ignore les balises d'expression.
Qualité (Eleven v3)
Le modèle Qualité vise le rendu le plus naturel, avec des intonations plus riches. C'est aussi le seul modèle qui interprète les balises d'expression comme [happily], [whispers] ou [pause], pour jouer une émotion, une livraison ou une pause. Il consomme un peu plus de tokens que le modèle Rapide. Réservez-le aux narrations soignées : présentation commerciale, spot audio, podcast, message qui doit transmettre une émotion.
Quand choisir l'un ou l'autre
- Choisissez Rapide pour des volumes importants, des tests, ou une lecture neutre et efficace.
- Choisissez Qualité pour un rendu expressif, une intention émotionnelle, ou dès que vous voulez utiliser les balises d'expression.
Impact sur le coût
La Voix off se facture au caractère, et le modèle Qualité coûte plus de tokens que le modèle Rapide pour un même texte. Le coût estimé s'affiche en direct pendant la saisie, ce qui vous permet de comparer les deux modèles avant de générer. Voir la facturation au caractère.
Aller plus loin
Une fois votre modèle choisi, sélectionnez une voix parmi les douze voix françaises natives : voir choisir sa voix. Pour l'ensemble du cycle, revenez à générer une voix off. Si vous hésitez encore entre les modules de Modik, voyez quel module choisir. La Voix off est disponible dès la formule M5 : voir la page des tarifs.
Questions fréquentes
Quelle est la différence entre Rapide et Qualité ?
Rapide (Turbo v2.5) privilégie la vitesse de génération. Qualité (Eleven v3) offre un rendu plus naturel et interprète les balises d'expression. Le modèle Qualité consomme un peu plus de tokens.
Les balises d'expression fonctionnent-elles avec les deux modèles ?
Non. Les balises d'expression comme [happily] ou [whispers] ne sont interprétées que par le modèle Qualité. Le modèle Rapide les ignore.
Quel modèle choisir pour un long texte ?
Pour un long texte sans besoin d'expressivité particulière, le modèle Rapide est un bon choix : il reste efficace et coûte moins de tokens. Pour une narration soignée, préférez Qualité.
Puis-je changer de modèle après avoir écouté un échantillon ?
Oui. Vous pouvez écouter un échantillon de la voix pour chaque modèle avant de générer, et ajuster votre choix librement.
Une question sur Modik ? Le plus simple est encore d'essayer.
Ouvrir Modik