跳转到主要内容

校正扫描件方向

VellumPDF 会识别每一页的阅读方向,并建议旋转。

您的文件始终不会离开您的设备

请把您扫描的 PDF 放到这里

或点击浏览您的文件

如何校正扫描的 PDF,一步一步来

VellumPDF 首先根据文字行来寻找正确的阅读方向,只有在这样还不够的时候,才会借助字符识别。

  1. 放入扫描的 PDF

    分析会立刻开始,逐页进行,带有可以取消的进度条。

  2. 让 VellumPDF 测量文字的结构

    如果文字行给出了明确的信号,旋转轴(0°/180° 对 90°/270°)就能在不借助 OCR 的情况下确定。

  3. 如有需要,让 OCR 来判断方向

    如果仍有歧义(0° 或 180°,90° 或 270°),内置的文字识别会朝两个方向读取页面中央的一条区域,并采用置信度更高的结论。

  4. 浏览缩略图网格

    每一页都会显示所采用的角度和所用的方法:文字行、OCR,或者“未发现文字”。

  5. 如有需要,手动更正某一页

    点击一张缩略图,会让它再多转四分之一圈,与自动判断的结果无关。

  6. 点击“校正 N 页”

    然后下载更正后的文档。

没有文字的页面——照片、插图、空白页——没有可以测量的内容,保持不变:需要您自己手动旋转它。所应用的旋转只是写入 PDF 的一条显示指令,绝不是栅格化。

常见问题

VellumPDF 如何判断扫描页面的方向?

分两步。它首先测量墨迹在页面上的分布:横排的文字,会让有墨迹的行与空白的行距交替出现,这样无需识别任何内容,就能区分竖放的页面和横放的页面。然后,为了区分正着的页面和倒着的页面,文字识别会朝两个方向读取页面中央的一条区域,并采用更有把握的那个方向——这是在试验中唯一被证明可靠的方法。如果无法使用文字识别,VellumPDF 只会校正轴向,让页面保持原样,而不是去猜测。

旋转会降低扫描件的质量吗?

不会。旋转是作为一条显示指令写入 PDF 的:页面的内容既不会被逐像素旋转,也不会被栅格化或重新压缩。原有的清晰度得以保留,文字仍可选中,而且这项操作可以通过应用相反的旋转来撤销。

为什么有些页面保持不变?

因为它们没有什么可以测量的。整页的照片、插图、纯色块或空白页,都没有文字行:VellumPDF 会在缩略图上标明这一点,并让页面保持原样,而不是随意去猜。您仍然可以点击它,自己旋转它。

文字识别会下载什么东西吗?

不会。识别引擎及其语言模型,与 VellumPDF 的 OCR 工具一样,是由您的设备提供的,而且只有当某一页确实需要时,才会加载。对于仅凭文字行就能判断的文档——这是常见的情形——识别从不会启动。