Écouter les 81 voix françaises
Écoutez les 81 voix françaises de France lire le même texte. Filtrez les voix féminines, masculines ou neutres, puis marquez vos favoris pour les comparer.
Voice, voix locale de synthèse à comparer
Voice est notre moteur de synthèse vocale, basé sur Piper, un réseau de neurones qui tourne sur nos serveurs. Il est gratuit à l'usage et sans quota ; aucun texte n'est envoyé à un service tiers ni à une IA générative en ligne. Au débit par défaut, certaines fins de mots et syllabes sont avalées, et l'expressivité reste en dessous des voix Gemini. Le travail d'amélioration continue ; la version et la date affichées permettent d'en suivre les progrès dans le temps.
Cette voix de synthèse neuronale est générée localement.
Lecteur de votre ordinateur Windows, macOS…
Le même texte, lu cette fois par le lecteur vocal de votre ordinateur : sous Windows, ce sont les voix Microsoft installées avec le système. Rien n'est enregistré ni envoyé par cette page ; le résultat dépend de votre système et de votre navigateur.
Ces voix de synthèse sont générées par IA avec Google Gemini et signalées comme telles dans les métadonnées ID3 des fichiers. Google ajoute un filigrane SynthID inaudible dans l'audio.
Lire le texte prononcé
Diriger les voix
Vous pouvez aussi diriger les voix Gemini, selon une logique différente de Voice. La direction passe par une consigne de style fournie à côté du texte.
La grammaire disponible
Voici les six leviers de cette grammaire : consigne de style, balise <short pause>, pause entre paragraphes, format de sortie, volume et effets en post-production.
| Levier | Ce qu'il fait | Exemple |
|---|---|---|
| Consigne de style | Oriente l'interprétation, fournie à côté du texte. | narrateur de démonstration logicielle, posé, clair |
Balise <short pause> | Marque une pause brève au sein du texte. | Voilà. <short pause> Passons à l'écran suivant. |
| Pause entre paragraphes | Règle le silence de 0 à 5 000 ms. | 800 ms |
| Format de sortie | MP3, ou WAV 48 kHz pour le montage. | mp3 · wav |
| Volume | Normalisation à -16 LUFS par défaut. | -16 LUFS |
| Effets en post-production | Ajoutés par Synapx sur demande, jamais par Gemini. | talkie-walkie, radio, filtrage, souffle |
Gemini TTS et Voice : deux façons de diriger
| Ce que vous voulez | Voice (local) | Gemini TTS |
|---|---|---|
| Une pause | [pause=500ms] dans le texte | <short pause>, ou silence entre paragraphes |
| Chuchoter | [chuchote]… dans le texte | consigne de style : « chuchoté » |
| Une émotion | [joie], [calme], [mystere]… dans le texte | consigne de style, pour tout le texte |
| Changer de voix en cours de texte | [voix=jessica]…[/voix] | non : une seule voix par rendu |
| Un effet d'espace | [fx=reverb], [fx=telephone], [fx=radio] | en post-production, sur demande |
| Une ambiance sonore | [ambiance=pluie]…[/ambiance] | en post-production, sur demande |
Les limites
- Un seul locuteur est possible par rendu, sans dialogue à deux voix.
- Le style peut modifier la hauteur de voix : gardez-le identique sur une série.
- Le rendu n'est pas déterministe ; le premier résultat est conservé en cache.
- Les textes sont découpés à 1 500 caractères au plus, dans une limite de 20 000 caractères par envoi.
- Le texte transite chez Google et l'audio porte un filigrane SynthID inamovible.
- Un quota Google limite le nombre de requêtes par jour.
Choisissez Voice pour une grammaire complète directement dans le texte, ou contactez Synapx pour des effets de post-production sur demande.
Comment choisir sa voix
- Choisissez une voix selon la personne à qui vous vous adressez.
- Comparez plusieurs voix sur le même texte.
- Testez le ton avec votre propre contenu.
- Conservez vos voix favorites avant de produire vos audios.
Gemini TTS ou Voice (local) ?
Voice fonctionne entièrement sur nos serveurs, avec le moteur Piper : aucun texte n'en sort. Gemini TTS transmet le texte aux serveurs de Google ; pour un usage public en Europe, seule l'offre payante de Google est autorisée. En échange, le catalogue Google propose davantage de voix et d'expressivité. Le choix dépend de la sensibilité des textes, de vos contraintes de diffusion et du besoin de variété vocale.
Le texte lu : la présentation d'Adliss
Le texte des démonstrations est la présentation d'Adliss. Adliss est un ERP français pour TPE et PME, édité par la même équipe, qui réunit devis, factures, caisse, stocks, e-mails et agenda. Il est proposé à partir de 49 € HT par mois, et un compte gratuit se crée en 2 minutes.
Créer mon compte Adliss gratuitUne voix pour votre projet ?
Le service Gemini TTS de Synapx est privé : l'accès s'ouvre sur demande. Décrivez le texte, le format audio et la diffusion envisagée.
Parler de mon projet vocalQuestions fréquentes
Combien de voix françaises Google Gemini TTS propose-t-il ?
Le catalogue Google compte 149 voix en français : 81 voix de France et 68 voix du Québec. Parmi les voix de France, 48 sont féminines, 28 masculines et 5 neutres.
Gemini TTS peut-il lire un texte Markdown mot pour mot ?
Notre micro-service accepte du texte ou du Markdown. Le modèle lit le texte mot pour mot, tandis que la consigne de ton est transmise séparément.
Mes textes restent-ils en France avec Gemini TTS ?
Non. Gemini TTS envoie le texte aux serveurs de Google. Pour qu'aucun texte ne sorte de nos serveurs, Voice fonctionne entièrement en local avec Piper.
À qui appartiennent les audios générés avec Google Gemini TTS ?
Selon les conditions de Google, les audios générés appartiennent à l'utilisateur qui les a produits. Ils doivent être signalés comme générés par IA.