ForHosting KIT · Audio et voix

Convertir un texte en voix

La synthèse vocale transforme un texte écrit en voix parlée, restituée dans un fichier audio prêt à télécharger. Vous collez votre texte, choisissez une voix, et l’outil génère un enregistrement au format MP3. Utile pour écouter un rapport en marchant, sonoriser une vidéo ou enregistrer un message d’accueil téléphonique.

● Stablepar requête + par 1 000 caractères$0.005
Utilisez-le depuis WebAPIE-mailApp bientôtTelegram bientôt

Exécutez cette tâche sur nos serveurs, avec votre compte. Les outils gratuits tournent dans votre navigateur ; celui-ci est facturé sur votre solde KIT au prix affiché ci-dessus.

Du texte à la voix, concrètement

Vous saisissez ou collez le texte à lire, puis vous lancez la génération. L’outil découpe naturellement les phrases, respecte la ponctuation pour marquer les pauses et prononce les mots français avec leurs liaisons habituelles. Au bout de quelques secondes, un fichier MP3 est prêt : vous l’écoutez directement dans la page, puis vous le téléchargez. Un texte d’une page se lit en une piste continue, sans montage ni logiciel à installer.

Choisir une voix adaptée

Plusieurs voix sont disponibles, du timbre posé pour une lecture de document à un ton plus dynamique pour un contenu marketing. Le choix dépend de l’usage : une notice se prête à une voix neutre et claire, un message d’accueil à une intonation plus chaleureuse. Pensez aussi à la longueur des phrases dans votre texte : des phrases courtes et bien ponctuées donnent un débit plus naturel qu’un long paragraphe sans respiration.

Le tarif, aux mille caractères

Le service se paie à l’usage, en dollars US : $0.005 par requête, puis $0.008 par tranche de mille caractères convertie. Un texte de deux mille caractères — l’équivalent d’une page bien remplie — revient donc à environ $0.021. Le décompte porte sur le texte réellement synthétisé, sans abonnement ni forfait à souscrire. Vous payez une génération, vous récupérez son fichier, et l’affaire est close.

Réutiliser le fichier obtenu

Le MP3 produit s’intègre là où vous en avez besoin : piste voix d’une vidéo, podcast, borne d’accueil, serveur vocal d’une TPE ou simple écoute personnelle. Comme c’est un fichier audio standard, il s’ouvre partout, se coupe et se combine avec d’autres pistes dans n’importe quel logiciel de montage. Pour une diffusion publique, vérifiez simplement que le texte de départ vous appartient ou que vous avez le droit de le publier.

Message d’accueil téléphonique

Atelier Garnier SARL enregistre son message de répondeur — « Vous êtes bien à l’atelier, nous vous rappelons dès l’ouverture » — sans studio ni comédien, en générant la voix à partir du texte.

Écouter un long document

Thomas Rousseau transforme un rapport de vingt pages en piste audio pour l’écouter en déplacement, plutôt que de le lire sur un écran de téléphone.

Voix off d’une vidéo

Studio Lumen SAS génère la narration d’une vidéo de présentation et l’ajoute au montage, en gardant la main sur le texte jusqu’au dernier mot.

Accessibilité d’un contenu

Une association propose la version audio d’un article de son site pour les personnes qui préfèrent écouter, à partir du même texte publié à l’écrit.

Quelles voix et quelles langues sont proposées ?

Plusieurs voix françaises sont disponibles, avec des timbres et des tonalités différents. Le français est la langue principale de cet outil ; pour une voix espagnole dédiée, une capacité distincte existe et donne un résultat plus naturel qu’une voix française lisant de l’espagnol.

Dans quel format le fichier est-il livré ?

La voix est restituée en MP3, un format lisible partout et facile à intégrer dans un montage vidéo, un podcast ou un serveur vocal. Vous l’écoutez dans la page avant de le télécharger.

Puis-je utiliser la voix générée pour un usage commercial ?

Oui, à condition de détenir les droits sur le texte que vous faites lire. La voix produite peut servir dans une vidéo, une publicité ou un message professionnel.

Combien coûte la synthèse d’une page de texte ?

Le tarif est de $0.005 par requête plus $0.008 par tranche de mille caractères. Une page d’environ deux mille caractères revient à près de $0.021, en dollars US et sans abonnement.

Mon texte est-il conservé après la génération ?

Non. Le texte est traité sur nos serveurs le temps de produire l’audio, par un transfert chiffré, puis il est effacé avec le fichier temporaire. Nous ne constituons pas d’archive de vos contenus.

Faut-il créer un compte pour générer une voix ?

Non. L’outil se lance depuis cette page, sans inscription, et se règle à l’usage. Pour automatiser des générations en série, une API prend le relais.

Tout sur cette page est disponible par programmation. Cette section s'adresse aux équipes qui veulent l'intégrer à leurs systèmes ; les autres peuvent simplement utiliser l'outil ci-dessus.

POSThttps://api.kit.forhosting.com/voice/tts

Authentification par jeton Bearer : un seul POST met la tâche en file d’attente, et le résultat vous parvient par webhook ou lien signé.

curl -X POST https://api.kit.forhosting.com/voice/tts \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"text":"Hola, este es un mensaje de prueba."}'
{
  "text": "Hola, este es un mensaje de prueba."
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "voice.tts",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L’API est asynchrone : chaque appel renvoie un task_id immédiatement, puis vous interrogez l’état à raison d’une requête par seconde.

par requête$0.005
par 1 000 caractères$0.008

Le prix est publié, sans tokens ni crédits. Une tâche qui échoue n’est pas facturée.

max_mb200
max_minutes180
HTTPCodeSignification
401unauthorizedClé API absente ou invalide : vérifiez l’en-tête Authorization.
402insufficient_balanceSolde insuffisant : rechargez votre compte pour lancer cette tâche.
404unknown_typeType de tâche inconnu : vérifiez le champ type de votre requête.
429rate_limitedTrop de requêtes : ralentissez la cadence, puis réessayez.

Consulter la documentation complète du KIT →