PDF para Markdown
Esta ferramenta converte PDF em Markdown usando IA que enxerga o layout da página: títulos viram títulos, listas viram listas, tabelas viram tabelas. O resultado é texto estruturado, ideal para wikis, documentação e para alimentar sistemas de IA — que entendem Markdown muito melhor do que texto corrido.
Rode online
Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.
Por que Markdown, afinal
Markdown é o formato comum da documentação moderna: wikis, plataformas de notas, repositórios de código e ferramentas de IA falam Markdown nativamente. Converter um PDF para esse formato liberta o conteúdo do arquivo fechado — dá para editar, versionar, buscar e reaproveitar cada seção. E quando o destino é um assistente de IA, a diferença é prática: um texto com hierarquia de títulos e tabelas marcadas produz respostas bem melhores do que um bloco corrido de palavras.
A diferença de uma IA que enxerga a página
Extração comum lê o texto na ordem em que foi gravado, e o resultado sofre com colunas, quadros e tabelas. Aqui a conversão é feita por um modelo de IA que interpreta a página visualmente, como um leitor humano: reconhece que aquela linha grande é um título, que os itens alinhados são uma lista, que a grade é uma tabela. Por interpretar a imagem da página, também lida com documentos escaneados legíveis — coisa que a extração tradicional não alcança.
O custo na ponta do lápis
US$ 0,010 por chamada mais US$ 0,0575 por página — o preço reflete o trabalho de IA página a página. Um manual de 20 páginas custa US$ 1,16; um relatório de 5 páginas, US$ 0,30. Compensa onde a estrutura vale dinheiro: base de conhecimento, documentação viva, análise de editais. Para texto simples sem estrutura, uma extração comum resolve por muito menos.
Limites e boas práticas
Arquivos de até 25 MB e 200 páginas. Antes de converter um acervo inteiro, rode um documento representativo e confira o resultado — cada acervo tem suas manhas de diagramação. Páginas com carimbos sobrepostos, rasuras ou digitalização torta podem sair imperfeitas; documentos nativos digitais saem melhor. A conversão devolve o Markdown pronto para você revisar e publicar onde quiser.
Casos de uso
Manuais internos migrando para a wiki
A TecnoSul mantinha manuais de procedimento em PDF que ninguém atualizava. Convertidos em Markdown, entraram na wiki interna com títulos e listas intactos — agora a equipe edita e o histórico fica registrado.
Base de conhecimento para chatbot
Uma empresa de SaaS converteu apostilas e políticas em Markdown para alimentar o assistente de suporte. Com a hierarquia preservada, o bot cita a seção certa em vez de responder com um parágrafo perdido.
Edital de licitação dissecado
Uma consultoria converte editais em Markdown para comparar exigências entre versões e montar checklists por seção. Tabelas de prazos e valores chegam como tabelas — não como sopa de números.
Apostila que vira curso online
Um professor transformou a apostila de 80 páginas em módulos de plataforma de ensino. Cada capítulo do Markdown virou uma aula, sem redigitar títulos nem refazer listas de exercícios.
Perguntas frequentes
Por que custa mais do que uma extração de texto comum?
Porque cada página passa por um modelo de IA que interpreta o layout visualmente. É esse trabalho que preserva títulos, listas e tabelas — a extração comum custa menos justamente porque devolve texto sem estrutura.
Funciona com documento escaneado?
Sim, desde que a digitalização seja legível: o modelo lê a página como imagem. Escaneamentos tortos, borrados ou de baixa resolução degradam o resultado — vale testar com uma amostra antes do lote.
O que acontece com as imagens do PDF?
O foco da conversão é o conteúdo textual e estrutural: títulos, parágrafos, listas e tabelas. Fotos e gráficos não são reconstruídos dentro do Markdown — se elas são essenciais, mantenha o PDF original como anexo de referência.
Quanto custa converter um documento de 50 páginas?
US$ 0,010 da chamada mais 50 × US$ 0,0575 = US$ 2,89. O preço é por uso e está publicado; sem assinatura, sem franquia mínima.
Tabelas muito complexas saem perfeitas?
Tabelas regulares saem bem. Células mescladas, cabeçalhos em vários níveis e quadros dentro de quadros são o limite honesto de qualquer conversão — revise essas páginas antes de publicar.
Meu documento é confidencial. Como ele é tratado?
É processado exclusivamente para gerar o Markdown que devolvemos a você — sem retenção para outros fins, sem uso em treinamento, sem repasse. Finalidade única e minimização de dados, conforme a LGPD.
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/pdf/to-markdown \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"pdf":"https://ejemplo.com/documento.pdf"}'const res = await fetch("https://api.kit.forhosting.com/pdf/to-markdown", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"pdf": "https://ejemplo.com/documento.pdf"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/to-markdown",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"pdf": "https://ejemplo.com/documento.pdf"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/to-markdown", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"pdf":"https://ejemplo.com/documento.pdf"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"pdf":"https://ejemplo.com/documento.pdf"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/to-markdown", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"pdf": "https://ejemplo.com/documento.pdf"
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.to_markdown",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
max_mb | 25 |
max_pages | 200 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |
413 | input_too_large | A entrada passou do tamanho máximo desta tarefa. Confira os limites publicados. |
422 | task_failed | A tarefa falhou do nosso lado. Você não paga nada por ela. |