PDF-Metadaten auslesen
Diese Funktion liest die verborgenen Metadaten einer PDF-Datei vollständig aus: Autor, Titel, Thema, Stichwörter, Erstellungs- und Änderungsdatum sowie die Software, mit der das Dokument erzeugt wurde. So sehen Sie auf einen Blick, welche Angaben eine Datei über ihre Herkunft verrät, bevor Sie sie archivieren, weiterleiten oder veröffentlichen.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Was in einer PDF-Datei mitreist
Eine PDF-Datei enthält mehr als ihre sichtbaren Seiten. Im Hintergrund speichert sie ein Dokumentinfo-Wörterbuch mit Autor, Titel, Betreff, Stichwörtern sowie Erstellungs- und Änderungsdatum, dazu Angaben zur Produzent-Software – oft ein Office-Programm oder ein PDF-Werkzeug mit Versionsnummer. Wer eine Datei weitergibt, gibt diese Angaben ungefragt mit, auch wenn niemand sie im Text liest. Für ein Bewerbungsschreiben, ein Angebot oder eine Rechnung kann das mehr über die Arbeitsweise verraten, als beabsichtigt.
Eine Momentaufnahme, kein Eingriff
Das Auslesen verändert nichts an der Datei: Sie erhalten lediglich eine strukturierte Übersicht der gespeicherten Felder, während das Dokument selbst unangetastet bleibt. Das eignet sich, um vor der Weitergabe zu prüfen, was eine Datei preisgibt, oder um bei einem empfangenen PDF nachzuvollziehen, mit welcher Software und wann es erstellt wurde – etwa zur Einordnung eines Angebots oder einer eingescannten Rechnung.
Preis und Zugang
Die Abfrage kostet $0.002 pro Anfrage, in US-Dollar, ohne Abonnement und ohne Mindestumsatz. Sie nutzen die Funktion direkt auf dieser Seite für eine einzelne Datei oder über die API (Alias /pdf/metadata-read), wenn Sie mehrere Dokumente automatisiert prüfen möchten – etwa beim Eingang von Belegen in der Buchhaltung. Verarbeitet werden Dateien bis 25 MB und 200 Seiten. Eine Rechnung für Ihre eigene Buchhaltung stellen wir auf Wunsch per E-Mail aus.
Anwendungsfälle
Vor dem Versand einer Bewerbung prüfen
Jonas Weber bewirbt sich extern und möchte vor dem Versand wissen, ob seine PDF-Bewerbungsunterlagen noch den Namen eines früheren Arbeitgebers im Feld Autor tragen. Die Abfrage zeigt ihm die Angaben, bevor die Datei das Haus verlässt.
Herkunft eines eingegangenen Angebots prüfen
Schneider IT-Systeme GmbH & Co. KG erhält ein PDF-Angebot ohne erkennbaren Absender im Text. Die Metadaten zeigen, mit welcher Software und an welchem Datum das Dokument erstellt wurde – ein Hinweis für die interne Prüfung.
Dokumentation vor der Archivierung
Eine Kanzlei liest vor dem GoBD-konformen Archivieren die Metadaten jeder eingehenden PDF-Rechnung aus, um Erstellungsdatum und Produzent-Software im eigenen Prüfprotokoll festzuhalten.
Häufige Fragen
Welche Angaben werden konkret angezeigt?
Autor, Titel, Betreff, Stichwörter, Erstellungs- und Änderungsdatum sowie die Software, mit der die PDF-Datei erzeugt wurde – alle Felder, die der PDF-Standard für Metadaten vorsieht, soweit sie in der Datei gesetzt sind.
Verändert das Auslesen meine Datei?
Nein. Es handelt sich um eine reine Leseoperation. Die Datei, die Sie hochladen, bleibt unverändert; Sie erhalten zusätzlich eine Übersicht der gefundenen Felder.
Was passiert mit meiner Datei nach der Abfrage?
Sie wird verschlüsselt übertragen, ausschließlich für diese Abfrage verwendet und anschließend gelöscht. Niemand liest den Inhalt manuell mit.
Was kostet die Abfrage genau?
$0.002 pro Anfrage, in US-Dollar, bezahlt per PayPal ohne Konto und ohne Abonnement. Eine Rechnung stellen wir auf Anfrage aus.
Gibt es eine Größenbeschränkung?
Ja, bis 25 MB und 200 Seiten pro Datei. Größere Dokumente teilen Sie vorher auf.
Fehlen Angaben, wenn ein Feld nie gesetzt wurde?
Ja. Nicht jede PDF-Datei füllt alle Metadatenfelder. Fehlt ein Feld im Original, bleibt es auch in der Übersicht leer – wir erfinden keine Angaben.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/pdf/metadata-read \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"pdf":"https://ejemplo.com/documento.pdf"}'const res = await fetch("https://api.kit.forhosting.com/pdf/metadata-read", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"pdf": "https://ejemplo.com/documento.pdf"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/metadata-read",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"pdf": "https://ejemplo.com/documento.pdf"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/metadata-read", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"pdf":"https://ejemplo.com/documento.pdf"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"pdf":"https://ejemplo.com/documento.pdf"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/metadata-read", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"pdf": "https://ejemplo.com/documento.pdf"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.metadata_read",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_mb | 25 |
max_pages | 200 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |
413 | input_too_large | Die Eingabe überschreitet das Größenlimit dieser Aufgabe – die genaue Grenze steht auf der Seite. |