Voicemaker avis 2026 : tarifs, voix, réglages et limites

Voicemaker ia
Dernière vérification : 
Synthèse vocale, clonage, Speech-to-Speech et API

Voicemaker est une plateforme de synthèse vocale en ligne qui transforme un texte en fichier audio tout en laissant un contrôle précis sur la voix, la vitesse, la hauteur, le volume, les pauses, les effets et le format de sortie.

Dans cet avis, nous examinons ce qui distingue réellement Voicemaker : ses nombreux modèles vocaux, ses réglages techniques, ses formats audio, ses fonctions Speech-to-Speech et de clonage, ses licences commerciales ainsi que ses quotas par caractères.

Notre verdict en bref

Voicemaker convient particulièrement aux utilisateurs qui veulent davantage de contrôle technique qu’avec un générateur vocal minimaliste. Le service permet de produire rapidement une voix off, mais aussi de préparer un fichier adapté à la vidéo, au podcast, au téléphone ou au post-traitement audio.

Son principal point faible est la lisibilité de l’offre. Les voix, modèles et fonctions ne consomment pas tous les caractères de la même manière, et certaines options avancées sont réparties entre les abonnements Web, le forfait audiobook, l’API et les services de clonage professionnel.

1 000+ voix par défaut
140 langues payantes
MP3, WAV, OGG, AAC et OPUS
Speech-to-Speech
Clonage vocal
API REST

Comment avons-nous analysé Voicemaker ?

Cette analyse repose sur la grille tarifaire, la documentation de l’API, le centre d’aide, le journal des mises à jour et les conditions d’utilisation publiés officiellement par Voicemaker à la date indiquée en haut de l’article.

Nous avons vérifié les quotas par caractères, les limites par conversion, les formats audio, les droits commerciaux, les fonctions récentes et les différences entre le service Web, l’API et les offres spécialisées.

Usage principal
TTS configurable
Création de voix off avec choix du modèle, de la voix, des paramètres et du format audio.

Facturation
Caractères
Chaque conversion consomme le nombre de caractères saisis, avec un multiplicateur possible pour certaines voix.

Formats
Média et téléphonie
MP3, WAV, OGG, AAC, OPUS et formats 8 kHz destinés aux usages téléphoniques.

Public adapté
Créateurs et développeurs
Vidéos, podcasts, e-learning, publicités, applications, IVR et contenus longs.

Qu’est-ce que Voicemaker ?

Voicemaker est un outil Web de conversion texte-vers-parole. L’utilisateur saisit un texte, choisit une langue, une voix et un modèle, puis génère un fichier audio téléchargeable.

La plateforme ne repose pas sur un moteur unique. Elle propose plusieurs familles de voix standards, neurales et premium, avec des niveaux différents de naturel, d’expressivité, de couverture linguistique et de consommation de crédits.

Choix des langues et des voix dans Voicemaker
Voicemaker permet de choisir une langue, une voix et un modèle avant chaque conversion.

Point important : le nombre de voix affiché dépend de la formule. Le plan gratuit annonce plus de 750 voix par défaut, tandis que les plans payants donnent accès à plus de 1 000 voix par défaut et à plus de 500 voix professionnelles.

À qui Voicemaker convient-il réellement ?

Créateurs vidéo
Voix off
Pour produire des narrations, présentations, tutoriels, démonstrations et contenus destinés aux réseaux sociaux.

Podcast et audio long
Narration
Pour transformer des scripts, chapitres ou articles en fichiers audio avec une formule adaptée au volume.

E-learning
Multilingue
Pour narrer des modules, procédures et supports avec plusieurs langues et formats de sortie.

Développement
API REST
Pour intégrer le TTS, le Speech-to-Speech ou la transcription dans une application ou un workflow.

Voicemaker est particulièrement intéressant si vous :

  • voulez régler précisément la vitesse, la hauteur, le volume, les pauses et les effets ;
  • avez besoin de formats audio adaptés au Web, au montage ou à la téléphonie ;
  • travaillez dans plusieurs langues ou avec plusieurs accents ;
  • souhaitez comparer plusieurs modèles vocaux au sein d’un même service ;
  • produisez des dialogues avec plusieurs voix ;
  • avez besoin d’une API facturée à l’usage.

Voicemaker est moins adapté si vous :

  • cherchez uniquement un lecteur de documents ou de pages Web ;
  • voulez un studio vidéo complet avec avatars et montage visuel avancé ;
  • préférez une offre très simple sans modèles ni multiplicateurs de crédits ;
  • avez besoin d’un long texte en une seule conversion avec l’abonnement mensuel d’entrée de gamme ;
  • souhaitez une garantie de rendu identique entre toutes les langues et toutes les voix.

Voix, langues et moteurs de synthèse

Le plan gratuit annonce plus de 750 voix par défaut et 120 langues. Les formules payantes affichent plus de 1 000 voix par défaut, plus de 500 voix professionnelles et 140 langues.

Les voix les plus avancées peuvent consommer deux ou quatre fois plus de caractères. Il ne suffit donc pas de comparer le quota mensuel : il faut aussi regarder le modèle choisi pour estimer le volume réellement générable.

Voix gratuites
750+
Catalogue limité aux familles AI1, AI2 et AI3 selon la grille officielle.

Voix payantes
1 000+ et 500+
Plus de 1 000 voix par défaut et plus de 500 voix professionnelles avec les plans payants.

Langues payantes
140
La disponibilité exacte des voix et des styles varie selon la langue et le modèle.

Modèles avancés
Pro et ProPlus
Voix plus expressives ou performantes, mais parfois facturées avec un multiplicateur de caractères.

Le français est-il disponible ?

Oui. La documentation de l’API cite notamment le français de France et le français canadien. Le catalogue réel doit néanmoins être vérifié dans l’interface, car le nombre de voix et de modèles disponibles peut varier selon la variante linguistique.

Conseil de comparaison : testez un même paragraphe avec une voix standard, une voix neurale et une voix professionnelle. Mesurez le naturel, la stabilité sur les phrases longues et la consommation réelle de caractères.

Les réglages qui font la différence

Voicemaker permet de modifier plusieurs caractéristiques sans réécrire entièrement le script. Selon la voix et le modèle, l’utilisateur peut ajuster le volume, la vitesse, la hauteur, les pauses, l’emphase et certains effets.

Vitesse
Rythme
Permet de ralentir une formation ou d’accélérer une narration informative.

Hauteur
Tonalité
Modifie la perception générale de la voix sans changer le texte.

Pauses
Respiration
Aide à structurer les titres, énumérations, dialogues et transitions.

Prononciation
Corrections
Le plan Premium ajoute un éditeur destiné aux noms, marques, acronymes et termes spécialisés.

SSML
Contrôle balisé
Permet d’ajouter une structure plus précise lorsque la voix et le moteur prennent en charge les balises utilisées.

VoxFX
Effets vocaux
Bibliothèque d’effets destinée à transformer ou styliser le rendu vocal.

Prévisualisation et dialogues à plusieurs voix

La mise à jour de mai 2026 a ajouté une prévisualisation des 30 premières secondes avant la conversion finale. Elle a également introduit un mode multi-intervenants permettant d’attribuer différentes voix aux lignes d’un dialogue.

Cette prévisualisation réduit le risque de consommer des caractères sur un mauvais choix de voix ou de prononciation. Elle ne remplace cependant pas l’écoute complète d’un fichier long avant publication.

Formats audio et qualité d’export

La formule gratuite est limitée au MP3 ou à l’OGG en 128 kb/s. Les formules payantes ajoutent le MP3 et l’OGG jusqu’à 192 kb/s, le WAV 16 bits à 48 kHz ainsi que les sorties destinées à la téléphonie.

La documentation de l’API mentionne également OPUS, AAC et les formats PCM, μ-law et a-law selon les usages et les endpoints.

Format Usage recommandé À retenir
MP3 Web, vidéo, podcast et partage Fichier léger, largement compatible et suffisant pour de nombreux usages
WAV Montage et post-production Format non compressé mieux adapté au traitement audio ultérieur
OGG ou OPUS Applications et diffusion Web Formats efficaces pour réduire le poids selon l’environnement technique
AAC Vidéo et appareils mobiles Format compressé courant dans les workflows multimédias
8 kHz téléphonie IVR, centres d’appels et SIP Qualité adaptée aux contraintes téléphoniques, pas à une production musicale

Choix pratique : utilisez le WAV lorsque vous prévoyez un traitement audio, un mixage ou plusieurs réencodages. Pour une publication directe sur le Web, un MP3 correctement encodé est souvent suffisant.

Speech-to-Speech, transcription et VoxStudio

Speech-to-Speech

La fonction Speech-to-Speech transforme un enregistrement existant avec une autre voix tout en conservant une partie de son rythme et de son expression. Elle fonctionne avec les voix ProPlus et les voix personnalisées compatibles.

Cette approche est différente du TTS classique : l’utilisateur fournit une performance vocale de référence au lieu de seulement saisir un texte.

Speech-to-Text

Le plan Premium ajoute une fonction de transcription annoncée avec plus de 90 langues. Elle peut servir à récupérer un script, préparer des sous-titres ou créer une base de travail avant une nouvelle génération vocale.

VoxStudio et projets

Les formules Premium et Business donnent accès à des outils de projet permettant de combiner plusieurs voix, fichiers audio et musiques dans un même environnement. Cette fonction rapproche Voicemaker d’un studio léger sans remplacer un logiciel de montage audio complet.

Clonage vocal : fonctionnement et consentement

Les abonnements Starter, Premium et Business incluent actuellement des emplacements de clonage personnalisé. La grille affiche cinq voix avec Starter et dix avec Premium ou Business.

Voicemaker propose aussi un clonage professionnel distinct, réalisé à partir d’environ 30 minutes d’enregistrement et disponible sur devis. Cette offre vise une meilleure qualité et une intégration possible par API.

Ce que les conditions imposent

  • soumettre uniquement votre propre voix ou celle d’une personne ayant explicitement accepté le clonage ;
  • obtenir un consentement couvrant la création et l’utilisation de la voix synthétique ;
  • ne pas envoyer d’enregistrement contenant une personne non consentante ;
  • contrôler les personnes ayant accès à la voix clonée et aux fichiers générés ;
  • retirer la voix lorsque l’autorisation n’est plus valable.

Données de clonage : les conditions précisent que les enregistrements de formation peuvent être utilisés à des fins de recherche après anonymisation, avec une possibilité d’opposition par contact au support. Cette règle est distincte du traitement annoncé pour les simples textes et audios générés.

Droits commerciaux, diffusion et propriété

Les plans payants incluent des droits personnels et commerciaux sur les voix off générées. Le plan gratuit est présenté comme réservé à un usage personnel.

Les droits de diffusion pour la radio, la télévision ou les publicités en ligne sont explicitement associés au plan Business. Un utilisateur qui prépare une campagne publicitaire doit donc distinguer l’usage commercial général des droits de diffusion plus larges.

Points à vérifier avant publication

  • utiliser une formule payante pour un projet commercial ;
  • vérifier si une campagne publicitaire nécessite les droits de diffusion du plan Business ;
  • posséder les droits sur le texte, la musique et les autres éléments incorporés ;
  • ne pas utiliser une voix clonée sans consentement ;
  • conserver les preuves d’abonnement et d’autorisation associées au projet ;
  • vérifier le résultat final avant de publier une affirmation ou une prononciation erronée.

Tarifs de Voicemaker en 2026

Voicemaker propose quatre formules principales, auxquelles s’ajoutent un forfait audiobook, une plateforme API facturée à l’usage et un service de clonage professionnel.

Formule Prix mensuel Quota mensuel Limite par conversion
Free 0 $ Conversions limitées, jusqu’à 100 par semaine 250 caractères
Starter 5 $ 200 000 caractères, soit environ 4 heures annoncées 3 000 caractères
Premium 10 $ 500 000 caractères, soit environ 10 heures annoncées 5 000 caractères
Business 20 $ 1 million de caractères, soit environ 20 heures annoncées 10 000 caractères

La facturation annuelle est présentée avec une réduction de 20 %. Certaines voix ProPlus consomment deux ou quatre fois plus de caractères, ce qui réduit le volume réel disponible.

Présentation des tarifs et quotas de Voicemaker
Le prix mensuel doit être comparé au quota, à la limite par conversion et au multiplicateur du modèle vocal.

Offre Audiobook et Podcast

Voicemaker affiche un forfait annuel à 25 dollars comprenant un million de caractères sur l’année, une limite de 100 000 caractères par conversion, plus de 1 000 voix, 140 langues, 10 Go de stockage et des droits commerciaux.

Cette offre est intéressante pour les textes longs occasionnels, mais son quota annuel d’environ 20 heures doit être comparé aux besoins réels d’un podcast régulier ou d’une collection de livres audio.

Tarification de l’API

La plateforme développeur affiche actuellement un tarif de 20 dollars par million de caractères. Elle propose une facturation à l’usage, des endpoints REST et plusieurs formats audio.

Quel plan choisir ?

Découverte
Free
Pour écouter quelques voix et comprendre les principaux réglages sans usage commercial.

Production légère
Starter
Pour des voix off courtes, du clonage personnalisé et une utilisation commerciale limitée en volume.

Création régulière
Premium
Pour les projets, la prononciation, le stockage, la transcription et un quota plus confortable.

Équipe et publicité
Business
Pour le million de caractères, le partage, les équipes annuelles et les droits de diffusion.

Conseil budgétaire : calculez votre consommation avec la voix réellement choisie. Un quota de 500 000 caractères ne représente pas le même volume lorsque le modèle applique un multiplicateur de deux ou quatre.

Les limites de Voicemaker à connaître

1. La formule gratuite est très restrictive

La limite de 250 caractères par conversion convient à une démonstration, mais pas à une narration structurée ou à un projet commercial.

2. Le nombre de modèles complique la comparaison

Deux voix appartenant à des familles différentes peuvent avoir une qualité, une expressivité et un coût en caractères très différents.

3. Les limites par conversion restent basses sur les plans mensuels

Un script long doit être découpé avec Starter, Premium ou Business, sauf à utiliser le forfait spécialisé qui accepte jusqu’à 100 000 caractères par conversion.

4. Les droits de diffusion ne sont pas inclus partout

Les abonnements payants autorisent l’usage commercial, mais la diffusion publicitaire étendue est explicitement associée à Business.

5. Le clonage vocal demande une gestion rigoureuse du consentement

Les voix personnalisées peuvent créer des risques juridiques et réputationnels si l’autorisation, l’accès ou le contexte d’utilisation ne sont pas clairement définis.

6. Certaines informations publiques méritent une vérification au moment de l’achat

Voicemaker développe rapidement de nouvelles fonctions. Le nombre de langues, les modèles, les multiplicateurs et les quotas peuvent donc changer entre deux mises à jour de l’article.

Comment créer une voix off avec Voicemaker ?

  1. Préparez un script avec des phrases courtes, une ponctuation claire et des nombres écrits sans ambiguïté.
  2. Choisissez la langue et vérifiez que la variante régionale correspond au public visé.
  3. Comparez une voix standard, une voix neurale et une voix professionnelle sur le même extrait.
  4. Utilisez la prévisualisation avant de lancer une conversion longue.
  5. Réglez la vitesse, la hauteur, le volume et les pauses sans exagérer les paramètres.
  6. Corrigez les noms propres, sigles et marques avec l’éditeur de prononciation ou une écriture phonétique.
  7. Choisissez le format MP3 pour un usage direct ou WAV pour un traitement audio ultérieur.
  8. Vérifiez la consommation de caractères et le multiplicateur du modèle avant la conversion finale.
  9. Écoutez le fichier complet afin de détecter les ruptures, répétitions et erreurs de diction.
  10. Conservez le texte et les paramètres utilisés pour reproduire facilement une correction.
Bonne pratique : validez toujours un extrait représentatif avant de convertir un texte long. Une mauvaise voix ou une prononciation incorrecte consomme des caractères à chaque nouvelle conversion.

Quelles alternatives à Voicemaker examiner ?

Voicemaker se distingue par ses réglages, ses formats et sa tarification par caractères. Les alternatives pertinentes dépendent donc de la priorité du projet.

Priorité Outil à comparer Différence principale
Réalisme vocal et clonage ElevenLabs Approche centrée sur les modèles vocaux avancés, le clonage et les outils créatifs
Studio pour équipes Murf AI Workflow orienté présentations, formations, collaboration et production professionnelle
API et génération vocale PlayHT Alternative à comparer pour les voix, l’intégration et la production à grande échelle
Voix, vidéo et émotions Typecast Studio créatif associant voix expressives, avatars et montage vidéo simplifié
Lecture de documents Speechify Outil conçu principalement pour écouter des PDF, articles et documents

Questions fréquentes sur Voicemaker

Voicemaker possède-t-il une formule gratuite ?

Oui. Le plan gratuit permet jusqu’à 100 conversions par semaine, avec une limite de 250 caractères par conversion, plus de 750 voix par défaut et 120 langues. Il est présenté pour un usage personnel.

Combien coûte Voicemaker ?

Les prix mensuels affichés sont de 5 dollars pour Starter, 10 dollars pour Premium et 20 dollars pour Business. Une réduction de 20 % est annoncée avec le paiement annuel.

Voicemaker autorise-t-il une utilisation commerciale ?

Oui. Les plans payants incluent des droits personnels et commerciaux. Les droits de diffusion pour la radio, la télévision ou certaines publicités en ligne sont explicitement associés au plan Business.

Quels formats audio Voicemaker prend-il en charge ?

Voicemaker propose notamment MP3, WAV, OGG, AAC et OPUS, ainsi que des formats 8 kHz pour les applications téléphoniques. Les formats disponibles dépendent de la formule et de l’interface utilisée.

Voicemaker prend-il en charge le français ?

Oui. Le service prend en charge le français, notamment les variantes de France et du Canada dans sa documentation API. Le nombre exact de voix dépend du modèle et de l’abonnement.

Peut-on cloner une voix avec Voicemaker ?

Oui. Les plans payants incluent des emplacements de clonage personnalisé, et une offre de clonage professionnel est disponible séparément. Le consentement explicite de la personne enregistrée est obligatoire.

Comment les caractères sont-ils comptés ?

Les caractères sont débités au moment de chaque conversion, et non lors du téléchargement. Certaines voix avancées appliquent un multiplicateur de deux ou quatre. Les caractères chinois, japonais et coréens sont également comptés différemment selon la grille officielle.

Voicemaker propose-t-il une API ?

Oui. La plateforme développeur fournit des API REST pour la synthèse vocale, le Speech-to-Speech et la transcription. Le tarif affiché est actuellement de 20 dollars par million de caractères.

Conclusion : notre avis sur Voicemaker

Voicemaker est une solution solide pour les utilisateurs qui veulent contrôler la production vocale jusque dans les paramètres techniques et le format d’export.

Ses prix d’entrée restent accessibles, mais la comparaison des plans demande de regarder au-delà du montant mensuel. Le quota de caractères, la limite par conversion, le modèle vocal et les droits de diffusion déterminent la valeur réelle de chaque formule.

Avant de souscrire, testez les voix françaises avec votre propre texte, vérifiez le multiplicateur du modèle et calculez le volume mensuel en caractères. Pour un besoin principalement créatif ou collaboratif, comparez aussi ElevenLabs, Typecast, Murf AI et PlayHT.

Sources officielles vérifiées

Retour en haut