スキャン済みの画像ベースPDFからブラウザ内でローカルにテキストを認識 — 多言語対応、ページ範囲指定、TXT書き出し。サーバーへのアップロード不要、完全無料、登録不要。
使い方
1
スキャンしたPDFをアップロード
スキャン済みまたは画像ベースのPDFをアップロードし、言語とページ範囲を選択してください
2
ローカル認識
ページはブラウザ内で1枚ずつレンダリングおよびOCR処理されます。アップロードは一切なく、進捗はリアルタイムで表示されます
3
コピーまたはダウンロード
結果はプレビューにストリーミング表示されます。TXTとしてコピーまたはダウンロードでき、ログインは不要です
よくある質問
なぜ各ページに5〜15秒かかるのですか?
OCRエンジンは完全にブラウザ内で動作します(サーバーは関与しません)。各ページにはレンダリング、前処理、認識が必要なため、速度はお使いのデバイスに依存します。言語の初回実行時には、その言語データも一度ダウンロードされます(その後キャッシュされます)。
これはPDFからテキストへの変換とどう違いますか?
PDFからテキストへの変換はファイルに組み込まれたテキストレイヤーを読み取るため即座に処理されますが、スキャンにはテキストレイヤーがありません。このツールはOCRでページ画像を読み取るため、スキャン済みや撮影された文書向けに作られています。2つのツールは互いに補完し合います。
精度はどのくらいですか?
きれいな印刷文字は良好に認識されます。手書き、ぼやけた写真、複雑な表は精度が下がります。適切な言語を選び、300 DPIでスキャンし、重要な数字や名前は後で必ず確認してください。
ファイルはサーバーにアップロードされますか?
いいえ。レンダリングと認識はすべてブラウザ内で行われます。ファイルがデバイスから離れることはなく、メモリは更新時にクリアされます。制限:1ファイルあたり30 MB、30ページまで。
次に開発するツールをあなたが決めますウィッシュを送信 →