edge-tts
Toutes les narrations audio des articles de ce blog sont générées avec edge-tts : il exploite le même moteur de synthèse vocale que Microsoft Edge, accessible gratuitement en ligne de commande, sans compte ni facturation à la minute. C'est le choix retenu après comparaison avec des API payantes (Google Cloud TTS, ElevenLabs) : qualité suffisante pour une narration d'article, coût nul, aucun risque de dépassement de facture.

Avantages clés
- Entièrement gratuit, aucune clé API requise
- Plus de 300 voix dans des dizaines de langues
- Qualité correcte pour de la narration, pas seulement du texte robotique
Pour qui, pour quoi
Créateurs de contenu qui veulent une version audio de leurs articles sans budget dédié à la synthèse vocale.
- Narration audio d'articles de blog
- Prototypage rapide de voix off avant un choix d'outil payant
- Génération de contenu audio en plusieurs langues
Comment démarrer
- 1Installer via pip : `pip install edge-tts` (ou `pipx install edge-tts` pour un usage isolé en ligne de commande).
- 2Générer un audio : `edge-tts --text "Bonjour le monde" --voice fr-FR-HenriNeural --write-media sortie.mp3`.
- 3Pour une lecture immédiate avec sous-titres : `edge-playback --text "..."` (nécessite le lecteur `mpv`, sauf sous Windows).
Points de vigilance
- Repose sur le moteur de synthèse vocale de Microsoft Edge via une API non officielle et non documentée par Microsoft : un changement côté Microsoft peut casser l'outil sans préavis.
- Pas de garantie de service ni de support : c'est un projet communautaire gratuit, pas une API commerciale avec SLA.
- Qualité correcte pour de la narration d'article, mais en dessous des voix haut de gamme payantes (ElevenLabs et équivalents) sur l'expressivité fine.
Questions fréquentes
edge-tts est-il vraiment gratuit, sans limite ?
Oui, aucune clé API ni facturation : il réutilise le moteur vocal public de Microsoft Edge. La contrepartie est l'absence de garantie de service dans la durée.
Combien de voix et de langues sont disponibles ?
Plusieurs centaines de voix couvrant des dizaines de langues, dont plusieurs voix françaises de qualité correcte comme fr-FR-HenriNeural.
Peut-on l'utiliser en production pour un produit commercial ?
Rien ne l'interdit techniquement, mais s'appuyer sur une API non officielle pour un produit commercial critique est un risque à assumer consciemment ; pour un usage éditorial comme la narration d'articles de blog, le compromis est raisonnable.
Outils similaires
À explorer aussi
Google Cloud Text-to-Speech
L'API officielle de synthèse vocale de Google, avec un tier gratuit généreux et des voix Neural2/Studio nettement plus naturelles qu'un moteur gratuit classique.
Playwright
Le framework de test et d'automatisation navigateur de Microsoft, utilisé ici pour capturer des captures d'écran réelles.
Obsidian
Une application de prise de notes en Markdown local, avec un écosystème de plugins communautaires très actif.