Texte en voix avec l’IA

Une voix naturelle à partir de n’importe quel texte, pour vos vidéos, podcasts, livres audio et messages. Des voix prêtes en français, ou un clone de votre voix à partir d’un enregistrement.

Les modèles qui parlent français

  • Gemini 3.8 Flash TTS, Gemini 3.8 Flash Lite TTS et Gemini 3.1 Flash TTS de Google. Avec les modèles 3.8, vous réglez la manière de parler : calme, joyeuse, chuchotée, façon présentateur.
  • MiniMax Speech 2.8 HD et MiniMax Speech 2.8 Turbo.
  • Fish Audio S2.1 Pro, S2 Pro et S1. Fish Audio S2.1 Pro clone aussi les voix.
  • Voxtral Mini TTS de Mistral, MAI-Voice-2 et MAI-Voice-2-Flash de Microsoft, Aura-2 de Deepgram, Kokoro 82M.
  • Grok Voice de xAI.
  • Seed Audio 1.0 de ByteDance ne parle pas français, seulement anglais et chinois, mais il clone une voix à partir de plusieurs échantillons.

Clonage de voix

Dans l’onglet « Clonage de voix », ajoutez 3 à 30 secondes de voix claire, sans musique (mp3, wav, m4a ou mp4) : le modèle lit un nouveau texte avec cette voix. Pour un texte en français, choisissez Fish Audio S2.1 Pro. Vous pouvez cloner votre voix ou celle d’une personne qui y a consenti.

Combien coûte la synthèse vocale

La synthèse vocale se paie en crédits, par tranche de 1 000 caractères. Par exemple : Gemini 3.8 Flash TTS, 3 crédits pour 1 000 caractères ; Voxtral Mini TTS, 2 crédits pour 1 000 caractères ; Fish Audio S2.1 Pro, 5 crédits pour 1 000 caractères ; MiniMax Speech 2.8 HD, 10 crédits pour 1 000 caractères. Le prix de tout le texte s’affiche sur le bouton « Générer la voix » avant le lancement.

Pour commencer

  1. Ouvrez l’onglet « Synthèse vocale » et choisissez un modèle qui parle français.
  2. Collez le texte et choisissez une voix.
  3. Appuyez sur « Générer la voix » : le prix s’affiche sur le bouton.

Prix

Seed Audio 1.021 crédits pour 1 000 caractères
Fish Audio S2.1 Pro5 crédits pour 1 000 caractères
MiniMax Speech 2.8 HD10 crédits pour 1 000 caractères
Gemini 3.8 Flash TTS3 crédits pour 1 000 caractères
Qwen-Audio-3.0-TTS Plus2 crédits pour 1 000 caractères
Gemini 3.1 Flash TTS6 crédits pour 1 000 caractères
Fish Audio S2 Pro5 crédits pour 1 000 caractères
MAI-Voice-23 crédits pour 1 000 caractères
Grok Voice2 crédits pour 1 000 caractères
MiniMax Speech 2.8 Turbo6 crédits pour 1 000 caractères
Aura-23 crédits pour 1 000 caractères
Deepgram Flux TTS5 crédits pour 1 000 caractères

Prix en crédits. Le total de la génération s’affiche sur le bouton avant le lancement.

Prix et fonctions vérifiés dans le catalogue du studio le 07/10/2026

Questions fréquentes

Peut-on faire une synthèse vocale gratuite ?
Non : la synthèse vocale coûte des crédits avec tous les forfaits. Les crédits viennent des forfaits payants et des packs dès 300 ₽ (≈ 3,51 $).
Quelle longueur de texte en une seule fois ?
Cela dépend du modèle : jusqu’à 20 000 caractères pour Gemini 3.8 Flash TTS, jusqu’à 5 000 pour MiniMax Speech 2.8 HD. Un long livre se lit plus facilement chapitre par chapitre.
Peut-on choisir l’intonation et la vitesse ?
Le ton se règle dans Gemini 3.8 Flash TTS, Gemini 3.8 Flash Lite TTS, MAI-Voice-2 et MAI-Voice-2-Flash. La vitesse se règle dans MAI-Voice-2 et MAI-Voice-2-Flash, qui parlent français, anglais, espagnol et allemand.
Peut-on lire un texte avec sa propre voix ?
Oui, dans l’onglet « Clonage de voix ». Il faut un enregistrement de 3 à 30 secondes de voix claire. Pour un texte en français : Fish Audio S2.1 Pro.
Peut-on utiliser la voix dans des vidéos ?
AstraGPT ne revendique aucun droit sur le résultat. Si la voix est celle de quelqu’un d’autre, il faut l’accord de cette personne.