这类请求不停出现——一份签好字的表格、地址证明、护照页、报销用的发票——而且用的总是同一个词:扫描件。如今几乎没人还留着扫描仪。几乎每个人都有一部内置真正文档扫描器的手机,而大多数人从未打开过它,因为它不在相机应用里,主屏幕上也没有任何提示。

这个区别比听上去更重要。一张纸的照片和同一张纸的扫描件,差别远不止文件名。前者是在房间里恰好有的那点光线下、以略微倾斜的角度拍下的文件影像;后者是经过校正、摊平、归一化的复制品,人或自动系统都能真正处理。本文讲清两个平台的内置扫描器、决定成品的技术选择,以及拿到 PDF 之后该做什么。

为什么给纸拍照不等于扫描

把手机举在纸的上方,你无法让它既完全平行又完全居中。你总会偏离轴线一点,于是纸张的矩形落到照片里就成了梯形——靠近的一边宽,远端的一边窄。你的眼睛会自动纠正,所以照片在你看来没问题。在收件人看来有问题,在需要读取它的软件看来则糟糕得多。

扫描模式会修好拍照留下的四处破损:

实际后果是:扫描页一眼看去干净利落,打印出来也站得住;而拍照页会立刻暴露自己是手机随手一拍。对房东或招生办来说,这只是显得不专业。对保险理赔或法律文书而言,它可能构成退回的理由。

在 iPhone 或 iPad 上扫描

从 iOS 11 起,iOS 就有了真正的文档扫描器,藏在没人会去找的「备忘录」App 里。另有一条经由「文件」App 的路径,如果你只想要一份 PDF,那条更好。

经由「文件」App(直接生成 PDF)

1

打开「文件」,进入想要的文件夹

打开 「文件」 App,导航到成品文件该存放的位置——「我的 iPhone」,或 iCloud 云盘里的某个文件夹——然后点按右上角的 菜单。

2

选择「扫描文稿」

点按 「扫描文稿」。相机会以扫描模式打开,实时浮层会在识别到边缘时把纸张高亮出来。把手机大致与纸面保持平行,识别稳定后它会自动拍摄;若你更想自己决定时机,也可以手动按快门。

3

拍完所有页面,然后存储

每次拍摄都会叠进这一叠里。持续到每一页都扫完,若某页裁切出错,点按缩略图修正,然后点按 「存储」。「文件」会写出一份多页 PDF,而不是一个装满图片的文件夹。

经由「备忘录」(扫描件要与其他材料放在一起时更合适)

打开 「备忘录」,新建或打开一条备忘录,点按键盘上方的相机图标,选择 「扫描文稿」。拍摄体验完全相同,差别在于结果去了哪里:扫描件嵌进备忘录,而不是存成文件。要取出 PDF,点按扫描件,然后 「共享」→「存储到文件」。当扫描件属于一组更大的笔记时用这条路;只想要文件本身时用「文件」。

遇到难拍的页面,关掉自动拍摄是值得的。扫描界面顶角有「自动 / 手动」切换。自动模式一旦认为抓到了纸张就会按下快门——在铜版纸上,或页面上印有照片时,这往往意味着边缘识别很差却已经提前拍了。手动模式让你把构图稳住、有意识地按下快门。它只花两秒,却省掉了绝大多数重拍。

在 Android 手机上扫描

Android 上最可靠的扫描器在 Google 云端硬盘里,它几乎预装在每一部设备上,也不依赖厂商自家的相机软件。

1

打开云端硬盘,点按 + 按钮

打开 Google 云端硬盘,点按右下角的 + 按钮,选择 「扫描」。较新版本还提供一个云端硬盘扫描的快捷小组件,可以放到主屏幕上,省去层层进入的麻烦。

2

拍下页面并检查裁切

拍下纸张,然后在下一屏检查识别出的裁切范围,若切掉了某条边或框进了一角桌面,就拖动四角的手柄调整。云端硬盘在这里也提供滤镜选项——自动、彩色、灰度、黑白。对大多数文件来说,自动是对的。

3

继续加页,然后保存

点按 + 把后续页面加进同一份文件,然后点按 「保存」。云端硬盘会把它作为单个 PDF 上传。若需要本地副本,在云端硬盘里长按该文件选择「下载」;若要直接发出去,选择「共享」。

三星、小米、一加和 Pixel 设备往往在自家相册或相机应用里也带扫描功能,Google 相册还能在取景框里识别文档。这些都能用,但它们在不同版本和不同定制系统之间挪来挪去,而且其中好几个保存的是图片而不是 PDF。云端硬盘是在每一部 Android 手机上表现都一致的那条路——这正是它值得记住的原因。

手上已经是照片而不是扫描件?

把 JPG、PNG、HEIC 或 WebP 图片按你指定的顺序合成一份 PDF。免费、无需注册,文件 2 小时后删除。

打开图片转 PDF →

决定质量的五件事

透视和对比度交给软件。剩下的全是物理层面的事,值得花三十秒准备,因为没有任何后期处理救得回一次糟糕的拍摄。

因素该怎么做否则会出什么问题
光线漫射、均匀的光。靠近窗边,不要直射阳光。室内顶灯即可。硬光会把你自己的影子投到纸上;直射阳光会烧掉一个角
角度手机放平、与纸面平行,正对页面中心上方斜着拍会迫使系统做大幅透视校正,而这会把远端边缘的文字抹糊
背景白纸下面垫一块深色、平整的表面白纸放在白桌上:边缘识别无处着力
平整度先把折痕抚平;容易卷边的纸把四角压住弯曲的页面无法校正——文字会沿着弧度一直变形
稳定性撑住手肘,或者把手机架在一摞书上像素级的抖动模糊。在手机屏幕上看着还行,放到原尺寸就垮了

有一个习惯比这五条加起来还管用:发送前把成品放到最大倍率检查一遍。放大到页面上最小的那行字。如果在你自己的屏幕上都读不舒服,收件人读不了,任何被要求处理它的软件也读不了。重扫一次十五秒;被要求重新提交要一个星期。

要扫护照、身份证或过塑的东西?塑料反光就是全部问题所在。关掉闪光灯——一律关掉——并且倾斜文件本身几度,而不是倾斜手机,好让光源的反射落到页面之外。必要时略微偏离正中心;比起照片上横着一块白斑,透视校正处理一个小角度要轻松得多。

多页文件与页面顺序

两个内置扫描器都会一直往同一份文件里追加页面,直到你叫停——这是正确的行为,也是该用它们而不是用相机的理由。六页的合同应当作为一份六页的 PDF 送达。六个分开的文件,就是收件人可能弄丢的六样东西,何况许多上传表单本来也只接受一个附件。

按阅读顺序扫描,这个问题就根本不会发生。万一还是弄出了顺序错乱的页面,或者某页扫了两遍,用 整理 PDF 修正即可——它能重新排序、旋转和删除单页,而不必重建整份文件。如果你最后得到了几份本该是一份的 PDF,合并 PDF 会按你设定的顺序把它们接起来。

如果你全程都在拍照而不是扫描,相册现在塞满了 JPG,你并没有被困住:图片转 PDF 可以一次接收多张图片,让你把它们拖到正确顺序,输出为一份文件。透视校正是事后补不回来的那部分,所以成品比不上真正的扫描——但结构会是对的。这种情形的完整做法见 如何把图片转成 PDF

让扫描件可被搜索

这是几乎所有人都会跳过的一步,而它正是「只是存在的 PDF」与「真正好用的 PDF」之间的分界。扫描件是文字的照片,不是文字。你没法选中一句话、搜一个名字、复制一个账号。对你的电脑而言,它就是一张图片,含义并不比一张海滩照片更多。

光学字符识别解决了这件事:它读出图像中的字符,并在其下方写入一层不可见的文本。页面看上去分毫不差,行为却完全不同——可搜索、可选中、可复制,也能被屏幕阅读器朗读。把完成的扫描件送进 OCR PDF,几秒钟就好。

即使没人要求也值得做的三个理由:两年后你会想把这份文件找出来,那时你会搜索其中的某个词,而不是回忆文件名;收件人经常需要复制一个参考编号,而不是重新敲一遍;而且越来越多的机构上传系统会直接拒收纯图片的 PDF,因为它们自己的处理流程读不了。

OCR 的准确率几乎完全取决于拍摄质量,这正是上文技术那一节重要的原因。干净、对比分明、摆正了的文字,识别准确率非常高。同一页面若拍得昏暗又倾斜,得到的文本层将满是错误——比没有还糟,因为此后搜索会在那些看上去明明存在的词上悄无声息地落空。

文件大到传不上去时

手机传感器产出的数据量相当大。十页的扫描件轻易就落在 20 到 50 MB 之间,超过多数邮箱服务的附件上限,也远超许多政府和高校上传表单所能接受的范围。

第一处补救在拍摄环节:如果文件是白纸黑字,就用黑白或灰度滤镜,而不是彩色。一页文字的双色调扫描,体积可能只有彩色版的十分之一,而你在意的东西一点没少。彩色留给颜色本身承载信息的场合——印章、蓝色墨水的签名、划了重点的段落、照片。

对已经保存好的文件,把它送进 压缩 PDF,它会重新编码内嵌图片而不动页面结构。一般目标是压到 10 MB 以下,面对较老的机构门户则压到 5 MB 以下——那些系统往往比它们自己说明的更严格。如果仍然放不下,拆分 PDF 会把它切成可以分别发送的几份。

有一个顺序上的细节值得记住:OCR 要在大幅压缩之前做,而不是之后。激进的压缩恰好会磨软识别所依赖的字符边缘,所以同一页、同样的扫描,被压过之后 OCR 效果更差。先扫描,再 OCR,最后压缩。

什么时候手机不够用

手机扫描确实已经做得很好,面对绝大多数日常请求,它与平板式扫描并无分别。仍有一些场合它是错的工具:

而对于一份签好字的表格、一张水电账单、一张收据、一份证书或一份合同——人家要的几乎总是这些——你口袋里的手机就是对的工具,而且已经当了好几年。

常见问题

在 iPhone 上打开「文件」App,点按 ⋯ 菜单选择「扫描文稿」,逐页拍摄后点按「存储」,就会写出一份多页 PDF。在 Android 上打开 Google 云端硬盘,点按 + 按钮选择「扫描」,逐页添加后保存。两者用的都是真正的扫描模式:识别纸张边缘、校正透视、拉匀光照——正是这些让成品成为扫描件,而不是一张纸的照片。

对日常文件——表格、账单、收据、合同、证书——比得上,而且已经比得上好几年了。内置扫描模式对透视和对比度的校正足够到位,成品很难与平板式扫描区分开。真正的扫描仪仍然在装订书籍上占优(页面会朝书脊弯下去),在大批量作业上占优,以及在要求特定光学分辨率的档案或认证复制工作上占优。

几乎总是抖动模糊或光线不均。撑住手肘,或把手机架在什么东西上,别徒手悬空;拍摄时选择窗边的漫射光,而不是一盏把你影子投到纸上的硬光台灯。发送前在自己的屏幕上放到最大倍率检查:如果最小的那行字在那里都读不舒服,它在别处也不会更好读。

让它过一遍 OCR。扫描件是文字的图像,因此在光学字符识别读出字符、并在其下方写入不可见文本层之前,你无法搜索、选中或复制。OCR PDF 工具几秒钟就能完成,页面之后看上去毫无变化。要在压缩之前做,而不是之后——大幅压缩会磨软识别所依赖的字符边缘。

如果文件只有文字,就用灰度或黑白重新扫一遍——一页文字的双色调扫描,体积可能只有彩色版的十分之一,而且没有可察觉的损失。对已有的文件,压缩 PDF 会重新编码内嵌图片而不改变页面结构。一般压到 10 MB 以下,较老的机构门户压到 5 MB 以下。若仍放不下,拆分 PDF 会把它切成几份。

在同一次扫描过程中继续拍摄。iOS 和 Android 的扫描器都会把每一张新页面追加到当前文件里,直到你点按「存储」,所以六页的合同就成了一份六页的 PDF。如果已经弄成了分开的文件,合并 PDF 会按你选定的顺序把它们接起来,之后再用整理 PDF 重新排序、旋转或删除单页。

把你的扫描件收好尾

用 OCR 让它可被搜索、压到上传限制以内,或者把一整个相册文件夹变成一份干净的 PDF。免费、无需注册,文件 2 小时后删除。

打开 OCR PDF →
P
PdfDocShift Team
发布于 2026 年 7 月 30 日 · 来自 PdfDocShift 团队的教程和技巧