Raspagem com seletor CSS
Ferramenta para raspar dados de site com seletor CSS: você indica a URL e o seletor do elemento — o preço, o título, a célula da tabela — e recebe o conteúdo daquele ponto em JSON. A página abre em navegador real, então sites que montam o conteúdo com JavaScript também funcionam.
Rode online
Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.
Aponte e extraia
O princípio é simples: todo dado visível em uma página mora em um elemento HTML, e todo elemento pode ser apontado por um seletor CSS. A chamada leva URL e seletor; o navegador renderiza a página, localiza o elemento e devolve o conteúdo dele em JSON, pela via assíncrona de sempre — task_id, status, resultado. É raspagem determinística: o mesmo seletor, na mesma página, devolve sempre o mesmo ponto.
Achando o seletor certo
Abra a página no navegador, clique com o botão direito sobre o dado e escolha “Inspecionar”: o painel mostra o elemento e o caminho até ele. Prefira ids (#preco-vista) e classes com nome estável (.titulo-produto); desconfie de classes geradas automaticamente, aquelas com sequências aleatórias, porque mudam a cada publicação do site e quebram a raspagem. Um seletor bem escolhido sobrevive meses sem manutenção.
Seletor ou IA: quando usar cada um
O seletor é imbatível em custo e previsibilidade quando a página é estável: você sabe exatamente o que vem e paga o preço mínimo. Quando o layout muda toda hora, ou quando cada página formata o dado de um jeito diferente, o seletor vira manutenção constante — e aí a raspagem com IA, que entende o pedido em vez de decorar a posição, costuma compensar o preço maior. Regra prática: comece pelo seletor; migre para IA onde ele doer.
Preço e limites
US$ 0,040 por chamada mais US$ 0,001 por URL — acompanhar um preço uma vez por dia custa cerca de US$ 1,23 por mês. Cada página tem até 30 segundos para renderizar, e o acesso é o de um visitante comum, sem login. O preço está publicado e a cobrança é por uso: nenhuma assinatura envolvida.
Casos de uso
Preço do insumo na planilha
A Padaria Pão Dourado acompanha o preço do fardo de farinha no site do atacadista: um seletor no card do produto, uma chamada por dia, e o valor cai na planilha de custos. Quando o preço sobe, a dona fica sabendo antes de fazer o pedido.
Conferência da página de vagas
O RH de uma empresa em Curitiba raspa os títulos das vagas publicadas na própria página de carreiras depois de cada atualização do sistema, para conferir se todas subiram — sem abrir a página e contar na mão.
Indicador público no painel interno
Uma equipe financeira puxa diariamente um indicador publicado em uma página pública e injeta o valor no painel interno da empresa. O seletor mira a célula exata; o resto da página não interessa.
Perguntas frequentes
O que acontece se o site mudar o layout?
O seletor pode deixar de encontrar o elemento — nesse caso a tarefa retorna erro avisando, em vez de entregar um dado errado em silêncio. Você inspeciona a página de novo, ajusta o seletor e segue.
Raspar dados de site é permitido?
Ler dados públicos para uso legítimo é prática corrente, mas os termos de uso do site e a LGPD continuam valendo — especialmente se houver dados pessoais no meio. A ferramenta executa o que você pede; a responsabilidade pelo uso do dado é sua. Na dúvida sobre um caso sensível, consulte quem entende.
Funciona com conteúdo carregado por JavaScript?
Sim — a página renderiza em navegador real antes da extração, então o seletor enxerga o elemento mesmo que ele só exista depois dos scripts rodarem.
Quanto custa vigiar um preço todos os dias?
Cada chamada sai por US$ 0,041. Trinta dias de coleta diária ficam em cerca de US$ 1,23 — e você pode parar quando quiser, porque não existe contrato.
Preciso configurar proxy ou navegador?
Não. O navegador roda do nosso lado; da sua parte vão apenas a URL e o seletor, e volta o JSON com o dado.
O que é feito com os dados raspados?
São devolvidos a você como resultado da tarefa — e é só isso. Não reaproveitamos, não agregamos, não revendemos o que as suas chamadas produzem.
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/web/scrape-selector \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}'const res = await fetch("https://api.kit.forhosting.com/web/scrape-selector", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com",
"selectors": {
"titulo": "h1",
"precio": ".price"
}
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/scrape-selector",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com",
"selectors": {
"titulo": "h1",
"precio": ".price"
}
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/scrape-selector", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/scrape-selector", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"url": "https://ejemplo.com",
"selectors": {
"titulo": "h1",
"precio": ".price"
}
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.scrape_selector",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
timeout_sec | 30 |
max_crawl_pages | 25 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |
422 | task_failed | A tarefa falhou do nosso lado. Você não paga nada por ela. |