Transformar texto em áudio
A síntese de voz transforma texto escrito em narração falada com som natural. Você envia o texto por API e recebe o áudio pronto para usar em vídeo, curso, aviso ou atendimento. É para quem precisa de locução rápida sem agendar estúdio, contratar locutor nem depender da própria voz.
Rode online
Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.
Da caixa de texto para a caixa de som
Escrever é rápido; gravar é lento. Quem produz conteúdo sabe que a locução é o gargalo: exige silêncio, microfone decente, regravação a cada erro. A síntese de voz corta essa etapa — o texto que você já escreveu vira narração em uma chamada de API. A voz sintética atual passou longe daquele tom metálico de GPS antigo: frases inteiras saem com entonação e pausas plausíveis, boas o bastante para vídeo informativo, curso e aviso sonoro.
Quanto custa narrar um texto inteiro
A conta é simples e pública: US$ 0,005 por chamada mais US$ 0,008 por bloco de mil caracteres. Um artigo de blog de 5.000 caracteres vira áudio por US$ 0,045. Um e-book de 200.000 caracteres — um livro curto inteiro — sai por US$ 1,605. Compare com o custo de uma diária de estúdio e fica claro para quem essa ferramenta existe: quem precisa de volume, constância e orçamento previsível, pagando por uso e em dólar americano.
Integração: uma chamada, um áudio
O fluxo é assíncrono: seu sistema envia o texto, recebe a confirmação da tarefa e busca o áudio quando estiver pronto. Isso permite automatizar de verdade — publicou o artigo, gerou a versão narrada; cadastrou o produto, gerou o áudio de descrição. Não há painel obrigatório nem etapa manual no meio. Os limites publicados da categoria são 200 MB e 180 minutos por tarefa, mais do que suficiente para qualquer texto que se pretenda ouvir de uma vez.
Uma escolha de projeto: menos etapas, mais automação
Ferramentas de texto-para-voz com painel bonito existem aos montes; o diferencial aqui é ser uma peça de encaixe. Como tudo acontece por API, a narração deixa de ser tarefa de alguém e vira parte do fluxo: o texto entra de um lado, o áudio sai do outro, todos os dias, sem cliques. Para quem publica uma vez por mês, talvez seja exagero; para quem publica toda semana, é a diferença entre manter ou abandonar a versão em áudio do conteúdo.
Onde a voz sintética funciona bem — e onde não
Sendo honesto: síntese de voz brilha em conteúdo informativo — aulas, avisos, notícias, descrições, atendimento. Onde ela ainda não substitui gente é na emoção dramática: dublagem de personagem, poesia, propaganda que depende de carisma vocal. Se o seu projeto é desse segundo tipo, contrate um ator de voz e use a síntese para o rascunho, o storyboard sonoro e os testes. Usada no lugar certo, ela libera o orçamento humano para onde ele realmente rende.
Casos de uso
Canal educativo que publica três vídeos por semana
O criador escreve os roteiros, mas não tem estúdio nem constância de voz. Cada roteiro vira narração por API e o vídeo é montado em cima — a publicação semanal deixa de depender de garganta e microfone.
Apostila que os alunos ouvem no ônibus
A professora Juliana Nascimento converte o material do cursinho em áudio e distribui pelo grupo da turma. Quem passa duas horas por dia no transporte transforma trajeto em revisão.
Aviso sonoro da loja, sem gravar na loja
A Padaria Pão Dourado troca a promoção da semana toda segunda-feira. O texto do aviso vira áudio na hora e toca na caixa de som — sem pedir para o funcionário mais desinibido gravar de novo a cada semana.
Versão em áudio dos artigos do site
Um portal de notícias locais oferece o botão “ouvir matéria”. Cada artigo publicado dispara uma chamada de síntese e o player aparece minutos depois — acessibilidade real para quem enxerga mal ou está dirigindo.
Perguntas frequentes
A voz parece de robô?
Bem menos do que você imagina — a síntese atual tem entonação natural na maior parte das frases. Como voz é questão de gosto, o caminho honesto é gerar um trecho curto do seu próprio texto e ouvir: custa centavos e tira a dúvida de verdade.
Posso enviar texto em português?
Pode — a síntese trabalha com o texto que você enviar. Antes de produzir em escala, gere um parágrafo de teste e confira como a voz soa no seu idioma e no seu tipo de conteúdo.
Quanto custa transformar um e-book inteiro em áudio?
Um e-book de 200.000 caracteres custa US$ 0,005 de chamada mais US$ 1,60 pelos caracteres: US$ 1,605 no total. A cobrança é por uso, em dólar americano, sem assinatura.
Texto longo demais: posso dividir em partes?
Pode, e às vezes convém — capítulos ou seções em chamadas separadas ficam mais fáceis de organizar. O preço por mil caracteres é o mesmo; muda apenas o valor de base de cada chamada, US$ 0,005.
O texto que eu envio fica armazenado?
O texto é enviado ao servidor para ser sintetizado — é assim que a narração é gerada. Ele não é publicado em lugar nenhum. Se o material for confidencial, fale com a gente antes e tire suas dúvidas sobre o tratamento dos dados.
Como pago se não existe conta?
A compra é direta, sem cadastro: pagamento via PayPal, e o atendimento pelo WhatsApp ou e-mail resolve qualquer situação fora do padrão. Quem responde é humano, em espanhol ou inglês — português escrito também é bem-vindo.
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/voice/tts \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"text":"Hola, este es un mensaje de prueba."}'const res = await fetch("https://api.kit.forhosting.com/voice/tts", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"text": "Hola, este es un mensaje de prueba."
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/voice/tts",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"text": "Hola, este es un mensaje de prueba."
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/voice/tts", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"text":"Hola, este es un mensaje de prueba."}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"text":"Hola, este es un mensaje de prueba."}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/voice/tts", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"text": "Hola, este es un mensaje de prueba."
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "voice.tts",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
max_mb | 200 |
max_minutes | 180 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |