扫描件、图片型 PDF 在浏览器本地识别文字,支持中英日韩等多语言,页码范围可选,导出 TXT。不上传服务器,完全免费、免登录。
使用步骤
1
上传扫描 PDF
上传扫描件或图片型 PDF,选择识别语言与页码范围
2
本地识别
浏览器逐页渲染并 OCR 识别,文件不上传服务器,进度实时可见
3
复制或下载
识别结果实时预览,可一键复制或下载 TXT,免登录
常见问题
为什么每页要 5-15 秒?
OCR 引擎完全在你的浏览器里运行(不占用任何服务器),每页需要渲染、图像预处理和文字识别三个步骤,速度取决于你的设备性能。首次使用某语言还需下载一次语言包(之后有缓存)。
和 PDF 转文字工具有什么区别?
PDF 转文字读取的是文件自带的文本层,秒出结果,但扫描件没有文本层;本工具通过 OCR「看图识字」,专门处理扫描件、拍照件,两者互补。
识别准确率怎么样?
清晰印刷体准确率高;手写字、模糊照片、复杂表格会下降。建议选对语言、用 300 DPI 扫描,识别后快速校对关键数字与人名。
文件会上传到服务器吗?
不会。渲染与识别全部在浏览器本地完成,文件不离开设备,刷新即清除。单文件最大 30 MB、最多 30 页。
想要什么工具,你说了算提交需求 →