pdfhelp.ru 全部工具
无需注册。服务器与数据处理均位于俄罗斯

OCR 识别扫描件

识别俄文和英文扫描文档中的文字。输出为 Word、TXT 或支持搜索和复制的 PDF。

文件在服务器内存中处理,返回结果后立即删除

今天需要做什么?

即将上线
付费访问 — 每次会话最多 500 个文件,单个文件最大 200 MB,文档不带标注 服务开发期间可免费使用:每次会话最多 50 个文件,单个文件最大 30 MB。此为临时限制。

其他工具

从 PDF 转换

转换为 PDF

页面与文件

优化

排版标注

安全

带文本层的 PDF

“可搜索 PDF”模式保留扫描件的外观,并在图像下方添加不可见的识别文字:文档可以搜索,也可以从中复制文字。

如何提升识别效果

300 dpi 及以上的扫描件识别效果最佳。服务会自动旋转颠倒的页面并校正倾斜。

常见问题

可识别哪些语言?

俄文和英文,也支持同一文档中两种语言混排。

可以识别多少页?

每次最多 30 页。长文档请在“页面”字段中指定范围,分批识别。

为什么文字有错误?

识别质量取决于扫描件。最佳效果为 300 dpi、页面平整、无阴影和反光。手写文字无法识别。

什么是“可搜索 PDF”?

即在原扫描件图像下方附加不可见的识别文字。文档外观不变,但可以搜索和复制。