ForHosting KIT · Dokumente & PDF

PDF-Metadaten auslesen

Diese Funktion liest die verborgenen Metadaten einer PDF-Datei vollständig aus: Autor, Titel, Thema, Stichwörter, Erstellungs- und Änderungsdatum sowie die Software, mit der das Dokument erzeugt wurde. So sehen Sie auf einen Blick, welche Angaben eine Datei über ihre Herkunft verrät, bevor Sie sie archivieren, weiterleiten oder veröffentlichen.

● Stabilpro Anfrage + pro Dokument$0.002
Nutzen Sie es über WebAPIE-MailApp baldTelegram bald

Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.

Was in einer PDF-Datei mitreist

Eine PDF-Datei enthält mehr als ihre sichtbaren Seiten. Im Hintergrund speichert sie ein Dokumentinfo-Wörterbuch mit Autor, Titel, Betreff, Stichwörtern sowie Erstellungs- und Änderungsdatum, dazu Angaben zur Produzent-Software – oft ein Office-Programm oder ein PDF-Werkzeug mit Versionsnummer. Wer eine Datei weitergibt, gibt diese Angaben ungefragt mit, auch wenn niemand sie im Text liest. Für ein Bewerbungsschreiben, ein Angebot oder eine Rechnung kann das mehr über die Arbeitsweise verraten, als beabsichtigt.

Eine Momentaufnahme, kein Eingriff

Das Auslesen verändert nichts an der Datei: Sie erhalten lediglich eine strukturierte Übersicht der gespeicherten Felder, während das Dokument selbst unangetastet bleibt. Das eignet sich, um vor der Weitergabe zu prüfen, was eine Datei preisgibt, oder um bei einem empfangenen PDF nachzuvollziehen, mit welcher Software und wann es erstellt wurde – etwa zur Einordnung eines Angebots oder einer eingescannten Rechnung.

Preis und Zugang

Die Abfrage kostet $0.002 pro Anfrage, in US-Dollar, ohne Abonnement und ohne Mindestumsatz. Sie nutzen die Funktion direkt auf dieser Seite für eine einzelne Datei oder über die API (Alias /pdf/metadata-read), wenn Sie mehrere Dokumente automatisiert prüfen möchten – etwa beim Eingang von Belegen in der Buchhaltung. Verarbeitet werden Dateien bis 25 MB und 200 Seiten. Eine Rechnung für Ihre eigene Buchhaltung stellen wir auf Wunsch per E-Mail aus.

Vor dem Versand einer Bewerbung prüfen

Jonas Weber bewirbt sich extern und möchte vor dem Versand wissen, ob seine PDF-Bewerbungsunterlagen noch den Namen eines früheren Arbeitgebers im Feld Autor tragen. Die Abfrage zeigt ihm die Angaben, bevor die Datei das Haus verlässt.

Herkunft eines eingegangenen Angebots prüfen

Schneider IT-Systeme GmbH & Co. KG erhält ein PDF-Angebot ohne erkennbaren Absender im Text. Die Metadaten zeigen, mit welcher Software und an welchem Datum das Dokument erstellt wurde – ein Hinweis für die interne Prüfung.

Dokumentation vor der Archivierung

Eine Kanzlei liest vor dem GoBD-konformen Archivieren die Metadaten jeder eingehenden PDF-Rechnung aus, um Erstellungsdatum und Produzent-Software im eigenen Prüfprotokoll festzuhalten.

Welche Angaben werden konkret angezeigt?

Autor, Titel, Betreff, Stichwörter, Erstellungs- und Änderungsdatum sowie die Software, mit der die PDF-Datei erzeugt wurde – alle Felder, die der PDF-Standard für Metadaten vorsieht, soweit sie in der Datei gesetzt sind.

Verändert das Auslesen meine Datei?

Nein. Es handelt sich um eine reine Leseoperation. Die Datei, die Sie hochladen, bleibt unverändert; Sie erhalten zusätzlich eine Übersicht der gefundenen Felder.

Was passiert mit meiner Datei nach der Abfrage?

Sie wird verschlüsselt übertragen, ausschließlich für diese Abfrage verwendet und anschließend gelöscht. Niemand liest den Inhalt manuell mit.

Was kostet die Abfrage genau?

$0.002 pro Anfrage, in US-Dollar, bezahlt per PayPal ohne Konto und ohne Abonnement. Eine Rechnung stellen wir auf Anfrage aus.

Gibt es eine Größenbeschränkung?

Ja, bis 25 MB und 200 Seiten pro Datei. Größere Dokumente teilen Sie vorher auf.

Fehlen Angaben, wenn ein Feld nie gesetzt wurde?

Ja. Nicht jede PDF-Datei füllt alle Metadatenfelder. Fehlt ein Feld im Original, bleibt es auch in der Übersicht leer – wir erfinden keine Angaben.

Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.

POSThttps://api.kit.forhosting.com/pdf/metadata-read

Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.

curl -X POST https://api.kit.forhosting.com/pdf/metadata-read \
  -H "Authorization: Bearer $KIT_KEY" \
  -H "Content-Type: application/json" \
  -d '{"pdf":"https://ejemplo.com/documento.pdf"}'
{
  "pdf": "https://ejemplo.com/documento.pdf"
}
{
  "task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
  "type": "pdf.metadata_read",
  "status": "queued",
  "_links": {
    "result": "/tasks/tsk_…/result"
  }
}

Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.

pro Anfrage$0.002

Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.

max_mb25
max_pages200
HTTPCodeBedeutung
401unauthorizedDer API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer).
402insufficient_balanceIhr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht.
404unknown_typeUnbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog.
429rate_limitedZu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt.
413input_too_largeDie Eingabe überschreitet das Größenlimit dieser Aufgabe – die genaue Grenze steht auf der Seite.

Vollständige KIT-Dokumentation lesen →