入力済みPDFフォームからデータ抽出
回答済みのPDFフォームに入力された各項目の値を読み取り、構造化データとして取り出すツールです。紙の代わりに集めたPDFフォームの集計に使います。
オンラインで実行
アカウントでログインし、当社のサーバー上で実行します。無料ツールはブラウザ内で動作しますが、これは上記の料金がKIT残高から差し引かれます。
入力欄の値をそのまま取り出す
AcroForm形式のPDFフォームに入力された各項目の値を、項目名と対になったデータとして読み取ります。氏名欄には氏名、金額欄には金額というように、フォームの構造を保ったまま取り出されます。
回収した申込書の集計に
取引先や従業員から回収したPDFフォームを、1件ずつ目で確認しながら転記するのは手間がかかります。この機能を使えば、回収した複数のPDFから項目の値をまとめて取り出し、表計算ソフトなどに読み込める形にできます。
入力もれチェックにも
必須項目が空欄のまま提出されたPDFフォームがないかを確認したいときにも使えます。読み取った項目に空欄が残っていれば、提出者に差し戻す判断がしやすくなります。
料金は1件$0.002
料金は1件$0.002の固定です。項目数による追加料金はありません。複数件をまとめて処理する場合はAPI経由の利用が向いています。
活用例
回収した申込書の集計
イベントの参加申込書PDFを回収したあと、この機能で全件分の入力データを取り出し、表計算ソフトに集計しています。
入力もれの確認
人事担当が、提出された同意書PDFの必須項目に空欄がないかをまとめて確認しています。
アンケート結果の数値化
合同会社みどりデザインが、紙で配ったアンケートをPDFフォーム化し、回収後にデータとして取り出して集計しています。
名簿データとの突き合わせ
回収した申込書PDFのデータを取り出し、既存の顧客名簿と照合する作業に使っています。
よくある質問
読み取った後のPDFは保存されますか
読み取り処理のためだけに使用し、処理後は削除されます。恒久的な保存はしていません。
対応しているファイルサイズは
1ファイル25MB、200ページまでのPDFに対応しています。
日本語でのサポートはありますか
日本語でのサポートは行っておりません。サポートは英語またはスペイン語で、担当者が直接対応します。
料金はいくらですか
1件$0.002の固定料金です。PayPalから直接お支払いいただけます。
入力欄のないPDFからもデータを取り出せますか
AcroFormの入力欄を持たないPDFには対応していません。手書きスキャンからの読み取りにはOCR機能をご利用ください。
複数件をまとめて処理できますか
このページでは1件ずつの処理です。複数件をまとめて処理したい場合はAPI経由でのご利用をおすすめします。
開発者向け — APIアクセス
このページの機能はすべてAPIからも利用できます。自社システムに組み込みたいチーム向けのセクションです。それ以外の方は上のツールをそのままお使いください。
エンドポイント
Bearerトークンで認証し、POST1回でタスクをキューに登録します。結果はWebhookまたは署名付きリンクで受け取れます。
お使いのスタックから呼び出す
curl -X POST https://api.kit.forhosting.com/pdf/form-read \
-H "Authorization: Bearer $KIT_KEY" \
-H "Content-Type: application/json" \
-d '{"pdf":"https://ejemplo.com/documento.pdf"}'const res = await fetch("https://api.kit.forhosting.com/pdf/form-read", {
method: "POST",
headers: {
"Authorization": `Bearer ${process.env.KIT_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
"pdf": "https://ejemplo.com/documento.pdf"
})
});
const { task_id } = await res.json();import os, requests
res = requests.post(
"https://api.kit.forhosting.com/pdf/form-read",
headers={"Authorization": f"Bearer {os.environ['KIT_KEY']}"},
json={
"pdf": "https://ejemplo.com/documento.pdf"
},
)
task_id = res.json()["task_id"]<?php
$res = file_get_contents("https://api.kit.forhosting.com/pdf/form-read", false, stream_context_create([
"http" => [
"method" => "POST",
"header" => "Authorization: Bearer " . getenv("KIT_KEY") . "\r\nContent-Type: application/json",
"content" => '{"pdf":"https://ejemplo.com/documento.pdf"}',
],
]));
$task = json_decode($res, true);body := bytes.NewBufferString(`{"pdf":"https://ejemplo.com/documento.pdf"}`)
req, _ := http.NewRequest("POST", "https://api.kit.forhosting.com/pdf/form-read", body)
req.Header.Set("Authorization", "Bearer "+os.Getenv("KIT_KEY"))
req.Header.Set("Content-Type", "application/json")
res, _ := http.DefaultClient.Do(req)リクエスト例
{
"pdf": "https://ejemplo.com/documento.pdf"
}レスポンス例
{
"task_id": "tsk_a1b2c3d4e5f6a1b2c3d4e5f6",
"type": "pdf.form_read",
"status": "queued",
"_links": {
"result": "/tasks/tsk_…/result"
}
}非同期APIです。task_idは即時に返ります。ポーリングは1秒あたり1リクエストまでです。
料金
単価はすべて公開しています。トークン換算や独自クレジットはありません。失敗したタスクは課金されません。
制限
max_mb | 25 |
max_pages | 200 |
エラー
| HTTP | コード | 意味 |
|---|---|---|
401 | unauthorized | APIキーが無効か、指定されていません。Authorizationヘッダーを確認してください。 |
402 | insufficient_balance | 残高が不足しています。チャージ後に再度お試しください。 |
404 | unknown_type | 指定されたタスクタイプは存在しません。タイプ名を確認してください。 |
429 | rate_limited | リクエストが多すぎます。しばらく待ってから再度お試しください。 |
413 | input_too_large | 入力データが上限を超えています。サイズを小さくして再度お試しください。 |