PDF OCR 识别
免费 本地处理免费在线 PDF OCR 文字识别工具,将 PDF 每页渲染为图片后用 tesseract.js 识别文字。 支持简繁中文、英文、日文、韩文、法文、德文、西班牙文等 10+ 种语言,可指定页码范围。 文件不上传服务器,全部在浏览器中处理,保护您的隐私。
拖拽文件到此处,或
单个最大 100.0 MB
选项
使用方法
- 1 选择一个 PDF 文件
- 2 选择识别语言(支持简繁中文、英文、日韩法德西俄阿拉伯等 10+ 种语言)
- 3 可选:填写页码范围(如 1-3),留空识别全部页
- 4 点击"PDF OCR 识别"按钮,等待识别完成后查看/复制文字
FAQ
Q: 为什么这么慢?
OCR 需要先把每页渲染成高分辨率图片,再逐页识别文字,计算量大。页数越多、分辨率越高越慢。建议先用"页码范围"只识别需要的页,或关闭其他占用内存的标签页。
Q: 识别准确率不高怎么办?
准确率取决于 PDF 的清晰度。扫描件清晰、字体规整时识别较好;模糊、倾斜或手写字效果较差。可选择更匹配的语言(纯英文选"仅英文"可能更准)。
Q: 文件会上传到服务器吗?
不会。所有渲染和识别都在你的浏览器中完成,文件不会离开你的设备,完全保护隐私。