作業レシピ
スキャンPDFから文字を取り出して整える
スキャン書類や画像だけのPDFから必要なページをOCRで読み取り、検索・置換で確認して、必要な場合はMarkdown表へ変換するワークフローです。
作業をここから進める
0 / 3 完了
PDFから文字を抽出する
現在スキャンPDFの対象ページをOCRで読み取り、結果を原本と照合します。
表記ゆれを整える
未着手余分な文字、改行、特定語句を検索・置換して、後続作業に使いやすくします。
表に変換する
未着手整理したテキストをMarkdown表にして、ドキュメントやメモへ貼り付けやすくします。
この流れが向いている場面
- 01
スキャン書類や画像PDFを再入力せず使いたいとき
- 02
必要なページだけOCRで読み取りたいとき
- 03
抽出後の文章を表や資料整理に使いたいとき
完了前に確認すること
まず上のツール工程を実際に完了してください。ページを開いただけでは、確認項目を完了にできません。
保存するのは確認項目数と確認時刻だけです。項目文、入力内容、ファイル、ファイル名は保存しません。
よくある質問
文字を選択できるPDFにもOCRが必要ですか?
文字を選択できるPDFは通常のPDF文字抽出の方が速く、元の文字を保持しやすいです。この手順はスキャンPDFや画像だけのPDF向けです。
OCR後のテキストはそのまま使えますか?
OCRには読み間違いと読む順番のずれがあるため、必ず原本と照合し、検索・置換で必要な箇所を修正してください。
PDFや抽出文字はアップロードされますか?
PDFとOCR処理はブラウザ内に留まります。対応Agentへ文字を返す場合も、ページ上で明示的に許可するまで共有しません。