Metadati di un PDF
Ogni PDF porta con sé una scheda nascosta: autore, titolo, date di creazione e modifica e il software che l’ha prodotto. Questo strumento legge quei metadati e te li restituisce ordinati, pronti per il tuo gestionale. Serve per catalogare documenti, verificare l’origine di un file o controllare cosa esce dallo studio.
Esegui online
Esegui questo sui nostri server con il tuo account. Gli strumenti gratuiti girano nel tuo browser; questo viene addebitato sul tuo saldo KIT al prezzo indicato sopra.
Cosa c’è scritto dentro il tuo PDF
Oltre al contenuto che leggi a schermo, il PDF conserva uno strato di informazioni su sé stesso: titolo, autore, oggetto, parole chiave, data di creazione, data dell’ultima modifica e nome del programma che l’ha generato. Sono campi invisibili per chi apre il file, ma qualsiasi software li consulta in un istante. Ecco perché un documento apparentemente anonimo può rivelare il nome di chi l’ha scritto o la data reale dell’ultima modifica.
Come avviene la lettura
Carichi il PDF e ricevi i metadati già organizzati, pronti da salvare nel tuo database o da mostrare nel gestionale. Non devi aprire il file in nessun programma: la lettura è automatica e vale sia per un singolo documento sia per un intero archivio. Il file originale non viene toccato — l’operazione è di sola lettura — e il risultato arriva strutturato, campo per campo.
Un esempio concreto
Lo Studio Commercialista Bianchi di Bologna riceve decine di PDF al mese: bilanci, contratti, ricevute. Leggendo i metadati di ogni file all’arrivo, il gestionale registra quando ciascun documento è stato creato e con quale programma, e segnala i file con una data di modifica sospetta. Un contratto datato 2023 che risulta modificato la settimana scorsa merita un secondo sguardo prima di finire nella cartella del cliente.
Prezzo e limiti
Ogni lettura costa $0.002, meno di un centesimo di dollaro a documento. Il file può arrivare fino a 25 MB e 200 pagine. Niente abbonamento, niente registrazione: paghi solo quello che usi, al prezzo pubblicato qui. Puoi usarlo qui sul sito o via API per elaborare un intero archivio, un file per volta, e sommare i centesimi a fine mese.
Casi d'uso
Controllo prima di pubblicare
Rossi & Figli S.r.l. di Milano pubblica manuali e preventivi sul sito. Prima di caricare ogni PDF verifica i metadati e controlla che il campo autore non esponga il nome di un dipendente: un dettaglio che in passato ha già creato imbarazzo con un cliente.
Smistamento in studio
Un commercialista di Verona riceve documenti da 40 clienti tra email e PEC. Leggendo i metadati all’arrivo li ordina per data di creazione e capisce da quale gestionale è stato emesso ciascun file, senza aprire niente a mano.
Verifica di versione nei contratti
Un’agenzia immobiliare di Torino controlla la data di modifica dei contratti che riceve: se il PDF firmato a gennaio risulta modificato dopo, il documento torna in revisione prima di andare dal notaio.
Catalogo automatico dei documenti
Un portale di formazione conserva migliaia di dispense in PDF. Il titolo e le parole chiave dei metadati alimentano da soli la ricerca interna del sito, senza compilare schede a mano.
Domande frequenti
Lo strumento modifica il mio PDF?
No. L’operazione è di sola lettura: analizziamo il file e ti restituiamo le informazioni trovate. Il documento resta identico a come l’hai caricato.
Quali campi trovo nella risposta?
Titolo, autore, oggetto, parole chiave, date di creazione e modifica e il programma che ha creato il file, quando presenti. I campi non compilati arrivano segnati come vuoti: non tutti i PDF portano la scheda completa.
Funziona con un PDF protetto da password?
Se il file è cifrato, i metadati possono non essere accessibili. In quel caso ricevi un errore chiaro invece di un risultato incompleto: prima togli la protezione, poi leggi la scheda.
Quanto costa e c’è un abbonamento?
$0.002 a documento, prezzo pubblicato qui, senza abbonamento né canone. Non è tra gli strumenti gratuiti del KIT: questo si paga a consumo, ma parliamo di frazioni di centesimo per file.
Dove finisce il file che carico? Rispettate il GDPR?
Il documento viene elaborato solo per estrarre i metadati e restituirti la risposta, poi eliminato. Non lo usiamo per altro né lo cediamo a terzi: trattiamo il minimo necessario per eseguire il compito, come chiede il GDPR.
Posso integrarlo nel gestionale della mia azienda?
Sì. Oltre alla pagina web, lo strumento è disponibile via API con prezzo a chiamata pubblicato, e a breve anche da app e altri canali. Se hai dubbi scrivici: ti risponde una persona vera, in inglese o spagnolo. Scrivi pure in italiano, ci capiamo.
Per sviluppatori — accesso via API
Tutto quello che vedi in questa pagina è disponibile anche via API. Questa sezione è per i team che vogliono integrarlo nei propri sistemi; chi non ne ha bisogno può semplicemente usare lo strumento qui sopra.
Endpoint
Autenticazione con Bearer token: un POST mette in coda l'attività e il risultato arriva via webhook o link firmato.
Chiamala dal tuo stack
curl -X POST https://api.kit.forhosting.com/pdf/metadata-read \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"pdf":"https://ejemplo.com/documento.pdf"}'const res = await fetch("https://api.kit.forhosting.com/pdf/metadata-read", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"pdf": "https://ejemplo.com/documento.pdf"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/metadata-read",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"pdf": "https://ejemplo.com/documento.pdf"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/metadata-read", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"pdf":"https://ejemplo.com/documento.pdf"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"pdf":"https://ejemplo.com/documento.pdf"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/metadata-read", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Esempio di richiesta
{
"pdf": "https://ejemplo.com/documento.pdf"
}Esempio di risposta
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.metadata_read",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}L'API è asincrona: ricevi subito un task_id e puoi fare polling fino a 1 richiesta al secondo.
Prezzi
Prezzo pubblicato, senza token né crediti. Se l'attività fallisce, non paghi.
Limiti
max_mb | 25 |
max_pages | 200 |
Errori
| HTTP | Codice | Significato |
|---|---|---|
401 | unauthorized | Chiave API mancante o non valida: controlla l'header Authorization. |
402 | insufficient_balance | Credito esaurito: ricarica per continuare a eseguire attività. |
404 | unknown_type | Tipo di attività sconosciuto: controlla il campo type della richiesta. |
429 | rate_limited | Troppe richieste in poco tempo: rallenta e riprova tra qualche secondo. |
413 | input_too_large | Il file o il testo inviato supera il limite di questo strumento. |