Extraia os dados de qualquer página de produto
Você informa a URL de uma página de produto e recebe um JSON estruturado com o que ela exibe: nome, preço, imagens, descrição, marca e atributos como cor e tamanho. A leitura combina um navegador real com IA — funciona em lojas diferentes sem configurar seletor nenhum.
Rode online
Rode nos nossos servidores com a sua conta. As ferramentas grátis rodam no seu navegador; esta aqui é descontada do seu saldo do KIT pelo preço acima.
Da página bagunçada ao JSON previsível
Cada loja virtual organiza a ficha de produto do seu jeito: o preço num canto, a variação de tamanho num menu, a descrição escondida atrás de uma aba. Para uma pessoa, tudo óbvio; para um script tradicional, um pesadelo de manutenção. A extração devolve isso em campos previsíveis — nome, preço, moeda, imagens, descrição, atributos — independentemente do layout de origem. O que a página não exibe vem vazio, sem preenchimento inventado: se a loja não publica a marca, o campo de marca não aparece do nada.
Navegador real e IA, sem seletores para manter
Por dentro, a página é aberta num navegador de verdade, com JavaScript executado — preço que carrega depois, galeria montada na hora, tudo renderizado como um cliente veria. Sobre a página pronta, a IA faz a leitura como uma pessoa faria: entende o que é preço, o que é parcelamento, o que é avaliação. É isso que dispensa os seletores CSS dos raspadores clássicos, aqueles que quebram toda vez que a loja troca uma classe no HTML. Mudou o layout? A leitura continua, porque ela nunca dependeu do layout.
Quanto custa cada extração
O preço é US$ 0,046 por solicitação, mais US$ 0,0145 por URL processada — cerca de US$ 0,06 por página de produto, já com navegador e IA incluídos na conta. Extrair um catálogo de 100 fichas custa perto de US$ 6,05, sem servidor para manter, sem proxy para gerenciar e sem raspador para consertar toda semana. Para quem já tentou manter scraping próprio de e-commerce, a comparação de custo total costuma ser rápida.
Uso responsável
A extração lê páginas públicas — o mesmo conteúdo que qualquer visitante vê. Ainda assim, responsabilidade importa: respeite os termos de uso dos sites que você consulta, prefira frequências moderadas em vez de marteladas, e lembre que dados extraídos de terceiros têm dono. Para catálogo próprio, fornecedores parceiros e monitoramento de mercado em volume razoável, você está exatamente no uso pretendido da ferramenta.
Casos de uso
Catálogo de fornecedor direto na planilha
A Distribuidora Horizonte Verde recebe tabela de preços em PDF, mas a ficha completa dos produtos só existe no site dos fornecedores. A extração transforma cada URL em uma linha estruturada — nome, preço, atributos — e a planilha de compras se monta sem digitação.
Migração de plataforma sem redigitar a loja
Um lojista trocando de plataforma tinha 340 produtos cadastrados só no sistema antigo, sem exportação decente. Extraindo as fichas do próprio site antigo, remontou o catálogo na plataforma nova em um fim de semana — descrição, imagens e variações incluídas.
Comparador regional de preços
Um estudante de Belo Horizonte mantém um comparador de material de construção entre lojas da cidade. O sistema extrai as fichas das páginas públicas de cada loja e normaliza tudo em uma base só — sem escrever um raspador para cada site.
Vigiar como os revendedores anunciam seu produto
Uma fabricante confere como seus produtos aparecem nos sites dos revendedores autorizados: descrição desatualizada, foto errada ou nome fora do padrão da marca. A extração em lote das páginas dos parceiros vira relatório mensal de conformidade.
Perguntas frequentes
Preciso configurar seletores CSS para cada loja?
Não — essa é a diferença central. A IA lê a página renderizada e identifica os campos pelo significado, não pela posição no HTML. A mesma chamada funciona em lojas de layouts completamente diferentes.
Funciona com preço que só aparece depois do carregamento?
Sim. A página roda num navegador real com JavaScript, com até 30 segundos de carregamento — o que um cliente vê na tela é o que a extração lê.
O preço vem em reais?
Vem como a página anuncia: em loja brasileira, o JSON traz o valor e indica a moeda (R$). O preço do serviço, esse sim, é sempre em dólares — US$ 0,046 por solicitação mais US$ 0,0145 por URL.
E se a página não tiver algum campo?
O campo volta vazio. A extração não inventa marca, não estima preço e não completa descrição — devolve o que a página publica, e só.
Posso extrair de qualquer site?
Tecnicamente, de qualquer página pública de produto. Legalmente, a responsabilidade pelo uso é sua: respeite os termos dos sites e use frequência razoável. Auditoria de catálogo próprio e monitoramento moderado de mercado são os usos para os quais a ferramenta existe.
Como pago sem criar conta?
Compra direta via PayPal, com o preço publicado — sem cadastro e sem assinatura. Dúvida de cobrança? Uma pessoa responde, em espanhol ou inglês (português escrito também chega bem).
Para desenvolvedores — acesso via API
Tudo nesta página está disponível via API. Esta seção é para equipes que querem integrar a ferramenta aos próprios sistemas; quem não precisa disso pode simplesmente usar a ferramenta acima.
Endpoint
Autenticação por token Bearer. Um único POST coloca a tarefa na fila; o resultado chega por webhook ou link assinado.
Chame do seu código
curl -X POST https://api.kit.forhosting.com/web/product-extract \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com"}'const res = await fetch("https://api.kit.forhosting.com/web/product-extract", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/product-extract",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/product-extract", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/product-extract", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Exemplo de requisição
{
"url": "https://ejemplo.com"
}Exemplo de resposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.product_extract",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}A API é assíncrona: cada chamada devolve um task_id na hora. Se preferir polling, consulte o status a até 1 requisição por segundo.
Preço
Preço publicado, sem tokens nem créditos escondidos. Tarefa que falha não é cobrada.
Limites
timeout_sec | 30 |
max_crawl_pages | 25 |
Erros
| HTTP | Código | O que significa |
|---|---|---|
401 | unauthorized | Token ausente ou inválido. Confira o header Authorization. |
402 | insufficient_balance | Saldo insuficiente para esta tarefa. Faça uma recarga e tente de novo. |
404 | unknown_type | Esse tipo de tarefa não existe. Confira o campo type no catálogo. |
429 | rate_limited | Muitas requisições em pouco tempo. Espere um instante e tente de novo. |
422 | task_failed | A tarefa falhou do nosso lado. Você não paga nada por ela. |