这类请求不停出现——一份签好字的表格、地址证明、护照页、报销用的发票——而且用的总是同一个词:扫描件。如今几乎没人还留着扫描仪。几乎每个人都有一部内置真正文档扫描器的手机,而大多数人从未打开过它,因为它不在相机应用里,主屏幕上也没有任何提示。
这个区别比听上去更重要。一张纸的照片和同一张纸的扫描件,差别远不止文件名。前者是在房间里恰好有的那点光线下、以略微倾斜的角度拍下的文件影像;后者是经过校正、摊平、归一化的复制品,人或自动系统都能真正处理。本文讲清两个平台的内置扫描器、决定成品的技术选择,以及拿到 PDF 之后该做什么。
为什么给纸拍照不等于扫描
把手机举在纸的上方,你无法让它既完全平行又完全居中。你总会偏离轴线一点,于是纸张的矩形落到照片里就成了梯形——靠近的一边宽,远端的一边窄。你的眼睛会自动纠正,所以照片在你看来没问题。在收件人看来有问题,在需要读取它的软件看来则糟糕得多。
扫描模式会修好拍照留下的四处破损:
- 透视。它识别纸张的四个角,把画面反向拉伸,直到页面重新变回真正的矩形。这是肉眼可见的最大差别。
- 裁切。它去掉桌面、桌布、你的手,以及画面边缘的阴影,只留下纸张本身。
- 光照。它把曝光在整页上拉匀,让靠窗那一角不再过曝,同时对角也不至于发灰。
- 对比度。它把纸推向白、把墨推向黑——这正是文字变得锐利而非发糊的原因,也是之后字符识别能够奏效的前提。
实际后果是:扫描页一眼看去干净利落,打印出来也站得住;而拍照页会立刻暴露自己是手机随手一拍。对房东或招生办来说,这只是显得不专业。对保险理赔或法律文书而言,它可能构成退回的理由。
在 iPhone 或 iPad 上扫描
从 iOS 11 起,iOS 就有了真正的文档扫描器,藏在没人会去找的「备忘录」App 里。另有一条经由「文件」App 的路径,如果你只想要一份 PDF,那条更好。
经由「文件」App(直接生成 PDF)
打开「文件」,进入想要的文件夹
打开 「文件」 App,导航到成品文件该存放的位置——「我的 iPhone」,或 iCloud 云盘里的某个文件夹——然后点按右上角的 ⋯ 菜单。
选择「扫描文稿」
点按 「扫描文稿」。相机会以扫描模式打开,实时浮层会在识别到边缘时把纸张高亮出来。把手机大致与纸面保持平行,识别稳定后它会自动拍摄;若你更想自己决定时机,也可以手动按快门。
拍完所有页面,然后存储
每次拍摄都会叠进这一叠里。持续到每一页都扫完,若某页裁切出错,点按缩略图修正,然后点按 「存储」。「文件」会写出一份多页 PDF,而不是一个装满图片的文件夹。
经由「备忘录」(扫描件要与其他材料放在一起时更合适)
打开 「备忘录」,新建或打开一条备忘录,点按键盘上方的相机图标,选择 「扫描文稿」。拍摄体验完全相同,差别在于结果去了哪里:扫描件嵌进备忘录,而不是存成文件。要取出 PDF,点按扫描件,然后 「共享」→「存储到文件」。当扫描件属于一组更大的笔记时用这条路;只想要文件本身时用「文件」。
在 Android 手机上扫描
Android 上最可靠的扫描器在 Google 云端硬盘里,它几乎预装在每一部设备上,也不依赖厂商自家的相机软件。
打开云端硬盘,点按 + 按钮
打开 Google 云端硬盘,点按右下角的 + 按钮,选择 「扫描」。较新版本还提供一个云端硬盘扫描的快捷小组件,可以放到主屏幕上,省去层层进入的麻烦。
拍下页面并检查裁切
拍下纸张,然后在下一屏检查识别出的裁切范围,若切掉了某条边或框进了一角桌面,就拖动四角的手柄调整。云端硬盘在这里也提供滤镜选项——自动、彩色、灰度、黑白。对大多数文件来说,自动是对的。
继续加页,然后保存
点按 + 把后续页面加进同一份文件,然后点按 「保存」。云端硬盘会把它作为单个 PDF 上传。若需要本地副本,在云端硬盘里长按该文件选择「下载」;若要直接发出去,选择「共享」。
三星、小米、一加和 Pixel 设备往往在自家相册或相机应用里也带扫描功能,Google 相册还能在取景框里识别文档。这些都能用,但它们在不同版本和不同定制系统之间挪来挪去,而且其中好几个保存的是图片而不是 PDF。云端硬盘是在每一部 Android 手机上表现都一致的那条路——这正是它值得记住的原因。
决定质量的五件事
透视和对比度交给软件。剩下的全是物理层面的事,值得花三十秒准备,因为没有任何后期处理救得回一次糟糕的拍摄。
| 因素 | 该怎么做 | 否则会出什么问题 |
|---|---|---|
| 光线 | 漫射、均匀的光。靠近窗边,不要直射阳光。室内顶灯即可。 | 硬光会把你自己的影子投到纸上;直射阳光会烧掉一个角 |
| 角度 | 手机放平、与纸面平行,正对页面中心上方 | 斜着拍会迫使系统做大幅透视校正,而这会把远端边缘的文字抹糊 |
| 背景 | 白纸下面垫一块深色、平整的表面 | 白纸放在白桌上:边缘识别无处着力 |
| 平整度 | 先把折痕抚平;容易卷边的纸把四角压住 | 弯曲的页面无法校正——文字会沿着弧度一直变形 |
| 稳定性 | 撑住手肘,或者把手机架在一摞书上 | 像素级的抖动模糊。在手机屏幕上看着还行,放到原尺寸就垮了 |
有一个习惯比这五条加起来还管用:发送前把成品放到最大倍率检查一遍。放大到页面上最小的那行字。如果在你自己的屏幕上都读不舒服,收件人读不了,任何被要求处理它的软件也读不了。重扫一次十五秒;被要求重新提交要一个星期。
多页文件与页面顺序
两个内置扫描器都会一直往同一份文件里追加页面,直到你叫停——这是正确的行为,也是该用它们而不是用相机的理由。六页的合同应当作为一份六页的 PDF 送达。六个分开的文件,就是收件人可能弄丢的六样东西,何况许多上传表单本来也只接受一个附件。
按阅读顺序扫描,这个问题就根本不会发生。万一还是弄出了顺序错乱的页面,或者某页扫了两遍,用 整理 PDF 修正即可——它能重新排序、旋转和删除单页,而不必重建整份文件。如果你最后得到了几份本该是一份的 PDF,合并 PDF 会按你设定的顺序把它们接起来。
如果你全程都在拍照而不是扫描,相册现在塞满了 JPG,你并没有被困住:图片转 PDF 可以一次接收多张图片,让你把它们拖到正确顺序,输出为一份文件。透视校正是事后补不回来的那部分,所以成品比不上真正的扫描——但结构会是对的。这种情形的完整做法见 如何把图片转成 PDF。
让扫描件可被搜索
这是几乎所有人都会跳过的一步,而它正是「只是存在的 PDF」与「真正好用的 PDF」之间的分界。扫描件是文字的照片,不是文字。你没法选中一句话、搜一个名字、复制一个账号。对你的电脑而言,它就是一张图片,含义并不比一张海滩照片更多。
光学字符识别解决了这件事:它读出图像中的字符,并在其下方写入一层不可见的文本。页面看上去分毫不差,行为却完全不同——可搜索、可选中、可复制,也能被屏幕阅读器朗读。把完成的扫描件送进 OCR PDF,几秒钟就好。
即使没人要求也值得做的三个理由:两年后你会想把这份文件找出来,那时你会搜索其中的某个词,而不是回忆文件名;收件人经常需要复制一个参考编号,而不是重新敲一遍;而且越来越多的机构上传系统会直接拒收纯图片的 PDF,因为它们自己的处理流程读不了。
OCR 的准确率几乎完全取决于拍摄质量,这正是上文技术那一节重要的原因。干净、对比分明、摆正了的文字,识别准确率非常高。同一页面若拍得昏暗又倾斜,得到的文本层将满是错误——比没有还糟,因为此后搜索会在那些看上去明明存在的词上悄无声息地落空。
文件大到传不上去时
手机传感器产出的数据量相当大。十页的扫描件轻易就落在 20 到 50 MB 之间,超过多数邮箱服务的附件上限,也远超许多政府和高校上传表单所能接受的范围。
第一处补救在拍摄环节:如果文件是白纸黑字,就用黑白或灰度滤镜,而不是彩色。一页文字的双色调扫描,体积可能只有彩色版的十分之一,而你在意的东西一点没少。彩色留给颜色本身承载信息的场合——印章、蓝色墨水的签名、划了重点的段落、照片。
对已经保存好的文件,把它送进 压缩 PDF,它会重新编码内嵌图片而不动页面结构。一般目标是压到 10 MB 以下,面对较老的机构门户则压到 5 MB 以下——那些系统往往比它们自己说明的更严格。如果仍然放不下,拆分 PDF 会把它切成可以分别发送的几份。
有一个顺序上的细节值得记住:OCR 要在大幅压缩之前做,而不是之后。激进的压缩恰好会磨软识别所依赖的字符边缘,所以同一页、同样的扫描,被压过之后 OCR 效果更差。先扫描,再 OCR,最后压缩。
什么时候手机不够用
手机扫描确实已经做得很好,面对绝大多数日常请求,它与平板式扫描并无分别。仍有一些场合它是错的工具:
- 装订成册的书和厚文件。页面朝书脊方向弯下去,没有任何校正算法能重建那道沟槽里的文字。把书压平的平板扫描仪是唯一好答案。
- 大批量。五十页一张张来,是真真切切二十分钟的煎熬。带走纸器的扫描仪能无人值守地完成。
- 任何要求认证复制件的场合。某些法律和医疗流程明确规定扫描仪输出及其分辨率,手机拍摄无论看起来多好都不满足要求。
- 精细细节与档案工作。照片、美术作品、工程图纸,以及任何讲究细腻层次过渡的对象,都需要真实的光学分辨率和可控的光源。
而对于一份签好字的表格、一张水电账单、一张收据、一份证书或一份合同——人家要的几乎总是这些——你口袋里的手机就是对的工具,而且已经当了好几年。
常见问题
在 iPhone 上打开「文件」App,点按 ⋯ 菜单选择「扫描文稿」,逐页拍摄后点按「存储」,就会写出一份多页 PDF。在 Android 上打开 Google 云端硬盘,点按 + 按钮选择「扫描」,逐页添加后保存。两者用的都是真正的扫描模式:识别纸张边缘、校正透视、拉匀光照——正是这些让成品成为扫描件,而不是一张纸的照片。
对日常文件——表格、账单、收据、合同、证书——比得上,而且已经比得上好几年了。内置扫描模式对透视和对比度的校正足够到位,成品很难与平板式扫描区分开。真正的扫描仪仍然在装订书籍上占优(页面会朝书脊弯下去),在大批量作业上占优,以及在要求特定光学分辨率的档案或认证复制工作上占优。
几乎总是抖动模糊或光线不均。撑住手肘,或把手机架在什么东西上,别徒手悬空;拍摄时选择窗边的漫射光,而不是一盏把你影子投到纸上的硬光台灯。发送前在自己的屏幕上放到最大倍率检查:如果最小的那行字在那里都读不舒服,它在别处也不会更好读。
让它过一遍 OCR。扫描件是文字的图像,因此在光学字符识别读出字符、并在其下方写入不可见文本层之前,你无法搜索、选中或复制。OCR PDF 工具几秒钟就能完成,页面之后看上去毫无变化。要在压缩之前做,而不是之后——大幅压缩会磨软识别所依赖的字符边缘。
如果文件只有文字,就用灰度或黑白重新扫一遍——一页文字的双色调扫描,体积可能只有彩色版的十分之一,而且没有可察觉的损失。对已有的文件,压缩 PDF 会重新编码内嵌图片而不改变页面结构。一般压到 10 MB 以下,较老的机构门户压到 5 MB 以下。若仍放不下,拆分 PDF 会把它切成几份。
在同一次扫描过程中继续拍摄。iOS 和 Android 的扫描器都会把每一张新页面追加到当前文件里,直到你点按「存储」,所以六页的合同就成了一份六页的 PDF。如果已经弄成了分开的文件,合并 PDF 会按你选定的顺序把它们接起来,之后再用整理 PDF 重新排序、旋转或删除单页。