Só o texto, sem as tags
Cole um HTML — página salva, e-mail, trecho de código — e receba só o texto, sem tags, sem scripts, sem marcação. Sobra o conteúdo legível, pronto para contar palavras, revisar, arquivar ou alimentar outra ferramenta. Grátis, sem cadastro, processado inteiramente no seu navegador.
Executar grátis
Roda direto no seu navegador. Grátis, sem cadastro — seus dados não são enviados para lugar nenhum.
Quando você só quer o conteúdo
Tem hora que a marcação só atrapalha: para contar as palavras de uma página, revisar o texto de um e-mail, guardar o teor de uma mensagem no histórico do cliente ou preparar material para análise, as tags são ruído. Copiar da tela traz formatação escondida; abrir o código-fonte traz tudo menos o texto. A extração corta o nó: entra HTML, sai o conteúdo em texto puro.
Extrair em segundos
Cole o código ou envie o arquivo. A ferramenta remove tags, scripts e estilos e preserva a organização de leitura — parágrafos separados, quebras onde o HTML indicava blocos e itens de lista em suas linhas. O resultado aparece pronto para copiar ou baixar como .txt. Do texto de dentro das tags, nada se perde; da marcação em volta, nada sobra.
Texto puro em escala, via API
Para processar muitos documentos — e-mails armazenados, páginas coletadas, HTML gerado por sistemas —, a extração roda via API a US$ 0,002 por chamada, com arquivos de até 25 MB. É o passo clássico de preparação: primeiro tira-se a marcação, depois o texto segue para busca, análise ou arquivamento. Na página, o uso individual é grátis, ilimitado e sem cadastro.
Casos de uso
Contar as palavras do texto de uma página
Para saber o tamanho real do texto de um concorrente ou de uma página própria, Ana Paula Ferreira extrai o texto puro e conta — sem menu, rodapé e código inflando o número.
Arquivar e-mails no histórico do cliente
O sistema de atendimento guarda o teor de cada mensagem. Extraído do HTML, o texto do e-mail entra limpo no histórico — pesquisável e sem a sopa de tabelas que os e-mails carregam.
Preparar conteúdo para análise
Antes de mandar páginas e mensagens para uma análise de sentimento ou classificação, o fluxo da empresa extrai o texto via API — o modelo recebe conteúdo, não marcação.
Perguntas frequentes
A extração mantém parágrafos e quebras de linha?
Mantém a estrutura de leitura: parágrafos separados e quebras onde o HTML marcava blocos e listas. O que desaparece é a marcação, não a organização do texto.
Links viram o quê?
Fica o texto do link; o endereço não acompanha. Se você precisa preservar os endereços e a estrutura, a conversão para Markdown é o caminho mais adequado.
Serve para e-mail em HTML?
Sim — é um dos usos mais comuns: colar o corpo do e-mail e ficar só com o que foi escrito, sem o emaranhado de tabelas e estilos que as mensagens de marketing trazem.
É pago?
Na página, não: uso grátis, ilimitado, sem cadastro. Via API — para extrair texto de muitos documentos num fluxo —, US$ 0,002 por chamada.
O HTML que eu colo vai para onde?
Para lugar nenhum: tudo acontece no seu navegador. Conteúdo interno e e-mails continuam só com você.
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/data/html-to-text \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/data/html-to-text", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/data/html-to-text",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/data/html-to-text", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/data/html-to-text", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"input": "…"
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "data.html_to_text",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
max_mb | 25 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |