PDFをOCRして文字を抽出・コピー

スキャンPDFや画像中心のPDFをページごとに読み取り、検索・コピーできるテキストへ変換します。

PDFを選ぶとページ数を確認できます。

スキャンPDFにも使えます

PDF内にテキスト情報がなくても、ページを画像として描画してOCRするため、紙をスキャンしたPDFや写真から作ったPDFの文字起こしにも使えます。

ページ数が多いPDFは処理時間とメモリ使用量が増えるため、必要なページ範囲だけを指定してください。1回の処理は最大20ページに制限しています。

通常PDFは文字情報を直接抽出し、文字情報が十分にないページだけOCRへ自動フォールバックします。PDF解析・OCRはブラウザ内で行い、PDF本体や認識結果はumeboのサーバーへアップロードしません。PDF.js・OCR本体・言語データだけ外部CDN等から読み込みます。