对PDF应用OCR – 免费且私密
将扫描文档转换为可搜索、可选择的 PDF。该页面看起来仍然完全相同——您现在可以搜索、选择和复制其文本。
将 PDF 文件拖放到此处
或从您的设备中选择文件
文件在您的浏览器中本地处理 — 不会上传任何内容使用方法
1
上传您的扫描版 PDF
将 PDF 文件拖放到上面的框中,或单击以浏览您的设备。
2
OCR 自动运行
每个页面都会在浏览器中进行分析并识别其文本 - 对于较长的文档,这可能需要一些时间。
3
下载可搜索的 PDF
您的文件看起来相同,但其文本现在可供选择、搜索和复制。
为什么选择 PDFHome?
您的文档保持私密
文本识别完全使用 WebAssembly 在浏览器中运行 - 您的 PDF 本身永远不会上传到任何地方。 (第一次运行从 CDN 下载一个小型英语数据文件。)
保留了原来的外观
可见页面未受影响——OCR 仅在顶部添加了一个不可见的、可搜索的文本层。
搜索并选择文本
处理后,您可以在 PDF 中搜索、选择和复制文本以及使用屏幕阅读器。
适用于任何设备
PDFHome 可在台式机、平板电脑或移动设备上的任何现代浏览器中运行。
免费,无需帐户
OCR PDF 完全免费,无需注册。
常见问题
OCR(光学字符识别)分析文本图像并识别其中的实际字母和单词,因此软件可以将图片视为真实的可搜索文本。
否 — 可见页面图像完全保持原样。 OCR 在顶部添加了一个不可见的文本层,因此内容可以选择和搜索,而无需任何视觉变化。
准确性在很大程度上取决于扫��质量——干净、光线充足、高分辨率的打印文本扫描可以很好地识别,而手写、倾斜的页面或低分辨率图像会出现更多错误。
文本识别是计算密集型的,并且完全在您的设备上运行 - 较长的文档和较高的页数相应地需要更长的时间,因为没有服务器并行执行该工作。
是的。整个过程(渲染页面和识别文本)发生在您自己的设备上的浏览器中。
当前的工具可以识别英文文本。计划在未来的更新中支持其他语言。