PDF OCR
AI搭載のOCRでスキャンしたPDFや画像からテキストを抽出。無料、100%プライベート — ブラウザ内で直接動作。
📁 Drop scanned PDF or image here or
PDF, JPG, PNG, WEBP — any scanned document
ℹ️ First use: Downloads ~12MB OCR language model. Subsequent uses are instant (cached). One-time setup per language.
About PDF OCR
OCR(光学文字認識)は、Tesseract.jsとLSTMニューラルネットワークを使用して、スキャンした文書、画像、検索可能でないPDFからテキストを抽出します。14言語に対応。すべての処理はブラウザ内で行われます。
AI搭載の認識
Tesseract OCRエンジンとLSTMニューラルネットワークを使用し、スキャンから高精度にテキストを抽出します。
14言語対応
英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語、ポーランド語、ロシア語、日本語、中国語、韓国語、アラビア語、ヒンディー語。
複数ページ対応
PDFのすべてのページを自動的に処理します。結果は1つのテキスト出力にまとめられます。
100%プライベート
すべてのOCR処理はTesseract.jsを使用してブラウザ内で行われます。ドキュメントがデバイスから送信されることはありません。言語データ(約12MB)は初回使用後にキャッシュされます。