Indicizza i tuoi documenti
index_document legge un PDF pagina per pagina — testo, tabelle, anche scansioni — e costruisce un indice interrogabile per significato. Utile per contratti, manuali o archivi tecnici lunghi, quando aprire ogni file uno a uno per trovare una clausola diventa impossibile da gestire a mano.
Esegui online
Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.
Cosa legge davvero il motore
A differenza di una semplice estrazione di testo, index_document usa un modello capace di interpretare il layout della pagina: tabelle, intestazioni, note a piè pagina. Anche un PDF scansionato senza testo selezionabile viene letto e indicizzato, non solo quello nativo. Il risultato è un indice dove ogni voce sa da quale pagina proviene, così puoi risalire subito al documento originale.
Dal PDF isolato all'archivio cercabile
Puoi indicizzare un solo contratto oppure un intero archivio di manuali tecnici caricandoli uno dopo l'altro: ogni pagina diventa una voce collegata al file di provenienza esatto. Una volta costruito l'indice, la ricerca semantica o quella con risposte del KIT possono interrogarlo per trovare la clausola giusta o il paragrafo tecnico corretto, senza riaprire nulla manualmente né sfogliare pagina per pagina come si faceva prima.
Prezzo per pagina, non a forfait
Il costo è $0.010 a richiesta più $0.059 a pagina indicizzata, in dollari: un contratto di dieci pagine costa meno di un caffè al bar, un manuale di duecento pagine ha un prezzo proporzionato al lavoro reale svolto dal motore, che legge davvero ogni pagina invece di limitarsi a estrarre testo grezzo come farebbe uno strumento più semplice ed economico.
Dove lo lanci
Dalla pagina del KIT carichi il PDF e ricevi l'indice pronto in pochi istanti; via API lo colleghi a un archivio che cresce ogni settimana, così i nuovi documenti vengono indicizzati automaticamente non appena arrivano nel tuo sistema gestionale, senza alcun intervento manuale richiesto. Presto sarà disponibile anche da altri canali oltre al browser e all'API, come l'app mobile in arrivo.
Casi d'uso
I capitolati di Tecnoedil Verona
Tecnoedil Verona S.n.c. indicizza i capitolati tecnici dei cantieri per trovare in secondi la specifica di un materiale, anche dentro tabelle scansionate da vecchi fascicoli cartacei.
I contratti dello Studio Commercialista Bianchi
Lo studio di Bologna indicizza i contratti dei clienti per rispondere subito a domande tipo “quale clausola prevede il recesso”, senza riaprire ogni PDF una alla volta.
I manuali di un rivenditore di elettrodomestici
Un negozio a Bari indicizza i manuali tecnici dei prodotti venduti per rispondere rapidamente ai clienti che chiedono una specifica sepolta a pagina ottanta.
Domande frequenti
Legge anche i PDF scansionati senza testo selezionabile?
Sì: il motore interpreta la pagina come immagine quando serve, quindi funziona anche con scansioni, non solo con PDF nativi già testuali.
Come si calcola il prezzo di un PDF lungo?
In base al numero di pagine effettivamente indicizzate: $0.059 a pagina più $0.010 fissi a richiesta, in dollari. Il prezzo lo vedi prima di confermare, nella pagina dello strumento.
Posso indicizzare più file insieme?
Sì, puoi caricare più PDF in sequenza: ognuno resta identificabile nell'indice, così una risposta rimanda sempre al documento e alla pagina giusti.
Che fine fa il PDF dopo l'indicizzazione?
Viene elaborato per estrarre il contenuto e poi eliminato dal server: resta solo l'indice interrogabile, non il file originale conservato altrove.
Funziona con documenti italiani, tipo una fattura elettronica stampata in PDF?
Sì, legge senza problemi importi, date italiane e diciture come partita IVA o codice fiscale presenti nel documento.
Devo registrarmi per provarlo?
No: si acquista direttamente, senza account. Paghi con PayPal o carta e ricevi subito l'indice del documento caricato.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/search/index-document \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/search/index-document", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/search/index-document",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/search/index-document", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/search/index-document", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"input": "…"
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "search.index_document",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
max_chunks | 10000 |
max_tokens | 20000 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |
413 | input_too_large | Il file o il testo inviato supera il limite di questo strumento. |
422 | task_failed | L'attività non è andata a buon fine: non ti viene addebitato nulla. |