Tabellen aus PDF abtippen?
Eine Tabelle aus einem PDF in Excel weiterzurechnen bedeutet normalerweise, jede Zahl von Hand abzutippen. Dieser Dienst erkennt Tabellen im PDF – auch aus gescannten Kontoauszügen oder Preislisten – und liefert eine XLSX-Datei mit Zahlen in echten Zellen statt in Bildform.
Online ausführen
Führen Sie dies mit Ihrem Konto auf unseren Servern aus. Kostenlose Tools laufen in Ihrem Browser; dieses wird zum oben genannten Preis von Ihrem KIT-Guthaben abgebucht.
Wie aus einem Bild eine Tabelle mit Zellen wird
Anders als beim einfachen Kopieren von Text erkennt dieser Dienst Spalten, Zeilen und Zellgrenzen und ordnet jede Zahl der richtigen Zeile und Spalte zu – auch wenn die Tabelle im PDF nur als Bild vorliegt. Ein KI-gestütztes Bildverständnis übernimmt dabei die Arbeit, die sonst Auge und Tastatur Zahl für Zahl erledigen müssten. Das Ergebnis ist eine XLSX-Datei, in der sich sofort weiterrechnen lässt.
Kontoauszüge und Preislisten als typischer Anwendungsfall
Ein als PDF verschickter Kontoauszug, eine eingescannte Preisliste eines Lieferanten, eine Bestandsaufnahme aus einem alten Bericht: Überall, wo Zahlen in Tabellenform in einem PDF gefangen sind, aber in Excel weiterverarbeitet werden sollen, übernimmt die Umwandlung den mühsamen Teil. Bei mehreren Tabellen auf einer Seite wird jede einzeln erkannt und getrennt ausgegeben. Auch handschriftlich ausgefüllte Formulartabellen werden erkannt, wenn auch mit geringerer Trefferquote als bei gedrucktem Text.
Wo die Genauigkeit an Grenzen stößt
Bei sauber gedruckten Tabellen mit klaren Linien liegt die Trefferquote hoch. Bei sehr eng gedruckten Zahlenkolonnen, schräg gescannten Seiten oder Tabellen ohne sichtbare Linien steigt das Risiko einzelner Zuordnungsfehler. Bei finanziell wichtigen Zahlen empfehlen wir Ihnen deshalb einen kurzen Abgleich der Summen mit dem Original, bevor Sie mit der XLSX-Datei weiterrechnen. Ein zweiter, schärferer Scan hilft in solchen Grenzfällen oft mehr als jede nachträgliche Korrektur von Hand.
Preis und Verfügbarkeit
Abgerechnet wird $0.010 pro Anfrage plus $0.0575 pro Seite – deutlich mehr als bei einer einfachen Umwandlung, weil ein Bildverständnis-Modell jede Seite einzeln auswertet. Ein einseitiger Kontoauszug kostet $0.0675, ein fünfseitiger Bericht $0.2975. Diese Funktion ist bereits nutzbar, befindet sich aber noch in der Beta-Phase. Die Grenze liegt bei 25 MB und 200 Seiten. Wer viele Seiten auf einmal verarbeitet, zahlt die Grundgebühr nur einmal pro Anfrage, nicht pro Seite.
Anwendungsfälle
Kontoauszug für die Buchhaltung erfassen
Ein Kleinunternehmer aus Stuttgart erhält seinen Kontoauszug als PDF von der Bank und wandelt die Umsatzliste in Excel um, statt jede Zeile von Hand in die Buchhaltungssoftware zu übertragen.
Preisliste eines Lieferanten übernehmen
Weber Metallbau GmbH bekommt eine neue Preisliste als eingescanntes PDF vom Stahllieferanten. Die Umwandlung nach Excel erlaubt es, die Preise direkt mit der eigenen Kalkulation zu vergleichen.
Alte Bestandsliste digital weiterverarbeiten
Eine Distributorin findet eine jahrealte Bestandsliste nur noch als PDF-Bericht. Nach der Umwandlung lassen sich die Zahlen in Excel filtern und mit dem aktuellen Lager abgleichen.
Tabellen aus einem Marktbericht auswerten
Ein Analyst kopiert Tabellen aus einem 30-seitigen Marktbericht als PDF nach Excel, statt jede Zahl einzeln zu übertragen, und baut daraus eine eigene Auswertung.
Häufige Fragen
Funktioniert das auch mit einer eingescannten Tabelle?
Ja, das Bildverständnis erkennt auch Tabellen, die nur als Foto oder Scan im PDF vorliegen, nicht nur maschinenlesbaren Text.
Wie zuverlässig sind die erkannten Zahlen?
Bei sauber gedruckten Tabellen mit klaren Linien hoch. Bei schrägen Scans oder sehr engen Zahlenkolonnen steigt das Risiko einzelner Fehler; ein Abgleich der Summen ist bei wichtigen Zahlen ratsam.
Warum ist diese Umwandlung teurer als andere PDF-Funktionen?
Weil ein Bildverständnis-Modell jede Seite einzeln auswertet, statt nur eingebetteten Text auszulesen. Der Preis liegt bei $0.010 pro Anfrage plus $0.0575 pro Seite.
Was kostet die Umwandlung eines fünfseitigen Berichts?
$0.010 Grundgebühr plus 5 × $0.0575 = $0.2975, abgerechnet pro Anfrage in US-Dollar.
Werden die Zahlen aus meinem Kontoauszug gespeichert?
Nein, die Datei wird nur für die Verarbeitung genutzt und danach gelöscht, ohne Auswertung für andere Zwecke.
Kann ich das schon nutzen oder ist es noch in Vorbereitung?
Die Funktion ist bereits nutzbar, direkt auf dieser Seite oder über die API, befindet sich aber noch in der Beta-Phase.
Für Entwickler — API-Zugang
Alles auf dieser Seite ist auch per API verfügbar. Dieser Abschnitt richtet sich an Teams, die es in ihre eigenen Systeme einbinden möchten; alle anderen nutzen einfach das Tool oben.
Endpunkt
Authentifizierung per Bearer-Token. Ein einziger POST stellt die Aufgabe in die Warteschlange; das Ergebnis erhalten Sie per Webhook oder über einen signierten Link.
Aufruf aus Ihrem Stack
curl -X POST https://api.kit.forhosting.com/doc/pdf-to-excel \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"input":"…"}'const res = await fetch("https://api.kit.forhosting.com/doc/pdf-to-excel", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"input": "…"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/doc/pdf-to-excel",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"input": "…"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/doc/pdf-to-excel", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"input":"…"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"input":"…"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/doc/pdf-to-excel", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)Beispiel-Anfrage
{
"input": "…"
}Beispiel-Antwort
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "doc.pdf_to_excel",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}Die API arbeitet asynchron: Sie erhalten sofort eine task_id. Polling ist mit 1 Anfrage pro Sekunde erlaubt.
Preis
Der Preis steht auf der Seite – keine Tokens, keine Credits. Fehlgeschlagene Aufgaben werden nicht berechnet.
Limits
max_mb | 25 |
max_pages | 200 |
Fehler
| HTTP | Code | Bedeutung |
|---|---|---|
401 | unauthorized | Der API-Schlüssel fehlt oder ist ungültig – prüfen Sie den Authorization-Header (Bearer). |
402 | insufficient_balance | Ihr Guthaben reicht für diese Aufgabe nicht aus – Aufladungen verfallen nicht. |
404 | unknown_type | Unbekannter Aufgabentyp – prüfen Sie das Feld „type“ gegen den Katalog. |
429 | rate_limited | Zu viele Anfragen – warten Sie kurz; Polling ist mit 1 Anfrage pro Sekunde erlaubt. |
413 | input_too_large | Die Eingabe überschreitet das Größenlimit dieser Aufgabe – die genaue Grenze steht auf der Seite. |
422 | task_failed | Die Aufgabe ist fehlgeschlagen und wird nicht berechnet. |