Da pagina web a JSON
Uno strumento che estrae da una pagina web i dati in un JSON dalla forma che decidi tu. Indichi l’indirizzo e definisci i campi — nome, prezzo, disponibilità, valuta — e il KIT, con l’aiuto dell’IA, riempie esattamente quello schema. Ricevi sempre la stessa struttura, pronta per un foglio di calcolo o un gestionale.
Esegui online
Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.
Tu definisci lo schema, l’IA lo riempie
La differenza con un’estrazione libera è che qui decidi in anticipo la forma dei dati: elenchi i campi che ti servono e i loro nomi, e ogni pagina restituisce esattamente quei campi, nello stesso ordine. Serve quando i dati devono finire in un sistema che si aspetta una struttura fissa — un foglio, un database, un gestionale. Non ti ritrovi risultati diversi da una pagina all’altra: se un campo manca nella pagina, resta vuoto, ma lo schema non cambia. È l’estrazione pensata per essere ripetibile e automatizzabile.
Cos’è il JSON e perché conviene
Il JSON è il formato standard con cui i programmi si scambiano dati strutturati: coppie di nome e valore, facili da leggere per un sistema. Avere i dati di una pagina già in JSON, con i campi che hai deciso, significa poterli caricare subito altrove senza pulire né riformattare. È la forma ideale quando l’estrazione è un passaggio di un flusso più grande — per esempio popolare un catalogo interno con i dati di più pagine prodotto.
Prezzo e uso
Costa $0.046 a richiesta più $0.0145 per ogni pagina analizzata, come l’estrazione con l’IA: è un’elaborazione con un modello, quindi più onerosa del semplice prelievo. Si paga a consumo con PayPal, senza abbonamento. Dalla pagina definisci lo schema e ricevi il JSON; chi estrae gli stessi campi da molte pagine — decine di schede uguali — riusa lo stesso schema via API e raccoglie tutto in automatico.
Casi d'uso
Popolare un catalogo interno
Rossi & Figli S.r.l. importa dati da più pagine prodotto di un fornitore. Definisce uno schema con nome, codice, prezzo e valuta: ogni pagina restituisce lo stesso JSON, pronto da caricare nel gestionale senza sistemare i campi a mano.
Una tabella di annunci sempre uguale
Uno Studio di Milano raccoglie da varie pagine i dati di alcuni annunci. Con uno schema fisso — titolo, luogo, prezzo, data — ottiene righe coerenti, che si incolonnano perfettamente in un foglio di calcolo.
Dati che alimentano un altro strumento
Un’azienda di Verona usa l’estrazione come primo passo di un flusso automatico. Lo schema JSON garantisce che i campi arrivino sempre nella stessa forma, così il passaggio successivo non si rompe mai.
Domande frequenti
Che differenza c’è con l’estrazione con l’IA a parole?
L’estrazione a parole restituisce i dati che ha trovato, nella forma che ritiene migliore. Qui invece imponi tu lo schema: definisci in anticipo i campi e i loro nomi, e ogni pagina risponde esattamente con quella struttura, pagina dopo pagina.
Cosa succede se un campo non c’è nella pagina?
Quel campo resta vuoto, ma lo schema non cambia: ricevi comunque la stessa struttura con tutti i campi previsti. Così i dati restano coerenti anche quando alcune pagine sono incomplete.
In che formato ricevo i dati?
In JSON, il formato standard con cui i programmi si scambiano dati strutturati. È pronto da caricare in un foglio, un database o un gestionale senza riformattarlo.
Quanto costa?
$0.046 a richiesta più $0.0145 per pagina analizzata, come l’estrazione con l’IA. Nessun abbonamento; si paga a consumo con PayPal.
I dati sono sempre affidabili?
L’IA riempie lo schema con grande precisione, ma nessuna estrazione automatica è perfetta: su pagine ambigue un campo può essere interpretato male. Un controllo veloce è consigliato quando i dati contano davvero.
La pagina viene conservata?
No. L’indirizzo si apre solo per riempire lo schema e poi viene scartato; il contenuto viene elaborato e non conservato. Il JSON resta a te.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/web/scrape-schema \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://ejemplo.com"}'const res = await fetch("https://api.kit.forhosting.com/web/scrape-schema", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"url": "https://ejemplo.com"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/web/scrape-schema",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"url": "https://ejemplo.com"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/web/scrape-schema", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"url":"https://ejemplo.com"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"url":"https://ejemplo.com"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/web/scrape-schema", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"url": "https://ejemplo.com"
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "web.scrape_schema",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
timeout_sec | 30 |
max_crawl_pages | 25 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |
422 | task_failed | L'attività non è andata a buon fine: non ti viene addebitato nulla. |