Estrai un dato preciso da una pagina
Uno strumento che preleva da una pagina web solo l’elemento che indichi, tramite il suo selettore CSS. Dai l’indirizzo e il selettore — per esempio la classe del prezzo o dell’titolo — e il KIT ti restituisce esattamente quel valore, testo o attributo. È l’estrazione chirurgica: prendi il dato preciso, non tutta la pagina.
Esegui online
Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.
Il dato esatto, non tutta la pagina
Quando sai già dove si trova quello che ti serve, non ha senso estrarre l’intera pagina e cercarci dentro. Con il selettore CSS punti dritto all’elemento: il prezzo dentro una certa classe, il titolo dentro un certo tag, il numero di disponibilità in un certo box. Lo strumento apre la pagina, trova ciò che combacia col selettore e ti dà il valore. È preciso e, soprattutto, ripetibile: lo stesso selettore funziona su tutte le pagine costruite allo stesso modo.
Come si trova il selettore
Il selettore CSS lo ricavi con lo strumento “ispeziona” del browser: tasto destro sull’elemento, e leggi la classe (per esempio .prezzo) o l’id (per esempio #titolo) che lo identifica. Incolli quel selettore insieme all’URL e avvii. Puoi chiedere il testo dell’elemento oppure un suo attributo, come l’indirizzo di un link. Se il selettore combacia con più elementi, lo strumento può restituirteli tutti in elenco: comodo per prendere, per esempio, tutti i titoli di una lista.
Quando conviene questo e quando l’IA
Il selettore è la scelta giusta quando la struttura della pagina è stabile e la conosci: è economico e prevedibile. Se invece la pagina cambia spesso o non sai indicare l’elemento, nel KIT c’è l’estrazione con l’IA, dove descrivi a parole cosa vuoi. Questo strumento costa $0.040 a richiesta più $0.001 per URL, circa quattro centesimi a pagina; l’estrazione con l’IA costa di più perché ragiona sul contenuto. Paghi a consumo, con PayPal, senza abbonamento.
Casi d'uso
Il prezzo di un prodotto, sempre nello stesso punto
Rossi & Figli S.r.l. controlla il prezzo di un articolo su una pagina fornitore. Il prezzo sta sempre nella stessa classe: con quel selettore l’estrazione restituisce solo il valore, pronto da confrontare.
Tutti i titoli di un elenco
Un redattore di Torino vuole l’elenco dei titoli degli articoli di una pagina. Indica il selettore dei titoli e ottiene la lista completa, senza copiarli uno per uno.
Un dato ripetuto su pagine gemelle
Uno Studio di Bologna deve prelevare lo stesso campo da venti schede costruite con lo stesso modello. Riusa lo stesso selettore su tutti gli indirizzi via API e raccoglie i valori in automatico.
Domande frequenti
Cos’è esattamente un selettore CSS?
È il modo di indicare un elemento in una pagina: una classe come .prezzo, un id come #titolo, o un tag. Lo trovi col tasto destro e “ispeziona” nel browser. Serve un po’ di dimestichezza con l’HTML, ma nella maggior parte dei casi è una singola classe.
Posso estrarre più elementi in una volta?
Sì. Se il selettore combacia con più elementi, lo strumento può restituirteli tutti in elenco — utile per prendere tutti i titoli, tutti i prezzi o tutte le righe di una lista in un colpo solo.
Prende solo il testo o anche i link?
Puoi chiedere il testo dell’elemento oppure un suo attributo, come l’indirizzo di un link o il riferimento di un’immagine. Lo indichi insieme al selettore.
E se non so trovare il selettore?
Prova l’estrazione con l’IA del KIT: lì descrivi a parole cosa ti serve, senza selettori. Costa un po’ di più perché ragiona sul contenuto, ma non richiede di conoscere l’HTML.
Quanto costa?
$0.040 a richiesta più $0.001 per URL, circa quattro centesimi a pagina. Nessun abbonamento; si paga a consumo con PayPal, senza account.
La pagina viene conservata?
No. L’indirizzo si apre solo per prelevare il dato e poi viene scartato: non conserviamo né la pagina né il valore estratto.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/web/scrape-selector \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}'const res = await fetch("https://api.kit.forhosting.com/web/scrape-selector", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com",
"selectors": {
"titulo": "h1",
"precio": ".price"
}
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/scrape-selector",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com",
"selectors": {
"titulo": "h1",
"precio": ".price"
}
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/scrape-selector", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/scrape-selector", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"url": "https://ejemplo.com",
"selectors": {
"titulo": "h1",
"precio": ".price"
}
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.scrape_selector",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
timeout_sec | 30 |
max_crawl_pages | 25 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |
422 | task_failed | L'attività non è andata a buon fine: non ti viene addebitato nulla. |