ForHosting KIT · Lettura e monitoraggio di siti web

Estrai un dato preciso da una pagina

Uno strumento che preleva da una pagina web solo l’elemento che indichi, tramite il suo selettore CSS. Dai l’indirizzo e il selettore — per esempio la classe del prezzo o dell’titolo — e il KIT ti restituisce esattamente quel valore, testo o attributo. È l’estrazione chirurgica: prendi il dato preciso, non tutta la pagina.

● Stabileper richiesta + per URL$0.040
Usalo da WebAPIEmailApp prestoTelegram presto

Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.

Il dato esatto, non tutta la pagina

Quando sai già dove si trova quello che ti serve, non ha senso estrarre l’intera pagina e cercarci dentro. Con il selettore CSS punti dritto all’elemento: il prezzo dentro una certa classe, il titolo dentro un certo tag, il numero di disponibilità in un certo box. Lo strumento apre la pagina, trova ciò che combacia col selettore e ti dà il valore. È preciso e, soprattutto, ripetibile: lo stesso selettore funziona su tutte le pagine costruite allo stesso modo.

Come si trova il selettore

Il selettore CSS lo ricavi con lo strumento “ispeziona” del browser: tasto destro sull’elemento, e leggi la classe (per esempio .prezzo) o l’id (per esempio #titolo) che lo identifica. Incolli quel selettore insieme all’URL e avvii. Puoi chiedere il testo dell’elemento oppure un suo attributo, come l’indirizzo di un link. Se il selettore combacia con più elementi, lo strumento può restituirteli tutti in elenco: comodo per prendere, per esempio, tutti i titoli di una lista.

Quando conviene questo e quando l’IA

Il selettore è la scelta giusta quando la struttura della pagina è stabile e la conosci: è economico e prevedibile. Se invece la pagina cambia spesso o non sai indicare l’elemento, nel KIT c’è l’estrazione con l’IA, dove descrivi a parole cosa vuoi. Questo strumento costa $0.040 a richiesta più $0.001 per URL, circa quattro centesimi a pagina; l’estrazione con l’IA costa di più perché ragiona sul contenuto. Paghi a consumo, con PayPal, senza abbonamento.

Il prezzo di un prodotto, sempre nello stesso punto

Rossi & Figli S.r.l. controlla il prezzo di un articolo su una pagina fornitore. Il prezzo sta sempre nella stessa classe: con quel selettore l’estrazione restituisce solo il valore, pronto da confrontare.

Tutti i titoli di un elenco

Un redattore di Torino vuole l’elenco dei titoli degli articoli di una pagina. Indica il selettore dei titoli e ottiene la lista completa, senza copiarli uno per uno.

Un dato ripetuto su pagine gemelle

Uno Studio di Bologna deve prelevare lo stesso campo da venti schede costruite con lo stesso modello. Riusa lo stesso selettore su tutti gli indirizzi via API e raccoglie i valori in automatico.

Cos’è esattamente un selettore CSS?

È il modo di indicare un elemento in una pagina: una classe come .prezzo, un id come #titolo, o un tag. Lo trovi col tasto destro e “ispeziona” nel browser. Serve un po’ di dimestichezza con l’HTML, ma nella maggior parte dei casi è una singola classe.

Posso estrarre più elementi in una volta?

Sì. Se il selettore combacia con più elementi, lo strumento può restituirteli tutti in elenco — utile per prendere tutti i titoli, tutti i prezzi o tutte le righe di una lista in un colpo solo.

Prende solo il testo o anche i link?

Puoi chiedere il testo dell’elemento oppure un suo attributo, come l’indirizzo di un link o il riferimento di un’immagine. Lo indichi insieme al selettore.

E se non so trovare il selettore?

Prova l’estrazione con l’IA del KIT: lì descrivi a parole cosa ti serve, senza selettori. Costa un po’ di più perché ragiona sul contenuto, ma non richiede di conoscere l’HTML.

Quanto costa?

$0.040 a richiesta più $0.001 per URL, circa quattro centesimi a pagina. Nessun abbonamento; si paga a consumo con PayPal, senza account.

La pagina viene conservata?

No. L’indirizzo si apre solo per prelevare il dato e poi viene scartato: non conserviamo né la pagina né il valore estratto.

Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.

POSThttps://api.kit.forhosting.com/web/scrape-selector

Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.

curl -X POST https://api.kit.forhosting.com/web/scrape-selector \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url":"https://ejemplo.com","selectors":{"titulo":"h1","precio":".price"}}'
{
  "url": "https://ejemplo.com",
  "selectors": {
    "titulo": "h1",
    "precio": ".price"
  }
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "web.scrape_selector",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.

per richiesta$0.040
per URL$0.001

Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.

timeout_sec30
max_crawl_pages25
HTTPCodiceSignificato
401unauthorizedChiave API mancante o non valida: controlla l'header Authorization.
402insufficient_balanceCredito esaurito: ricarica per continuare a eseguire attività.
404unknown_typeTipo di attività sconosciuto: controlla il campo type della richiesta.
429rate_limitedTroppe richieste in poco tempo: rallenta e riprova tra qualche secondo.
422task_failedL'attività non è andata a buon fine: non ti viene addebitato nulla.

Leggi la documentazione completa del KIT →