PDF 文字识别与重排阅读
把 PDF 转成可重排的文本来读,扫描版也能先用 OCR 识别文字;介绍四种识别引擎的区别、配置和会员限制,以及识别不准、纸质书、PDF 转 TXT 和合并的问题。
重排阅读是什么
重排阅读会把 PDF 的内容提取出来,用普通电子书的阅读页打开。转换后可以:
- 像 EPUB、TXT 一样调整字号、行距、主题和排版
- 全文搜索
- 选中文字划线、写备注
- 听书
重排不会改动原文件,随时可以切回原始 PDF。
重排的效果取决于 PDF 本身。表格、公式、多栏这类复杂版面,不一定能完全还原。
什么时候需要文字识别
PDF 分两种:
- 文字型 PDF:页面里有真正的文字,在 PDF 阅读页能选中、能搜索。重排时直接提取这些文字,不需要识别。
- 扫描版 PDF:每一页其实是一张图片,选不中文字,也搜不到。重排时需要先用 OCR(文字识别)把图片里的字认出来。
识别引擎默认是「禁用」。没有选择引擎时,扫描页在重排后只会显示成原页图片,读不到文字。
会员限制
重排阅读(应用里也叫「PDF 转码阅读」)是高级会员功能:
- 免费用户可以试用 3 本书。已经试用过的书可以一直用下去。
- 试用用完后,再打开新书的重排阅读会弹出会员开通页面。
识别引擎的设置本身不收费。在线引擎的调用费用和额度由对应服务方决定。
切换到重排阅读
- 手机和平板:在 PDF 阅读页点屏幕中间呼出菜单,点菜单上方的「切换到重排阅读」按钮。
- 桌面端:点顶部工具栏的「切换到重排阅读」按钮。
回到原始 PDF:
- 手机和平板:在重排阅读页呼出菜单,点「切换到原始 PDF」按钮。
- 桌面端:点顶部工具栏的「切换到原始 PDF」按钮。
重排打开失败时,错误提示下方也有「切换到原始 PDF」。
选择识别引擎
入口:
- 手机和平板:PDF 阅读页的设置 →「更多设置」→「阅读工具」→「PDF 文字识别」。
- 桌面端:PDF 阅读页顶部工具栏的设置 →「PDF 文字识别」。
在「识别引擎」里选一个。设置对所有 PDF 生效。
四种引擎对比
| 引擎 | 在哪识别 | 要不要配置 | 支持的设备 | 识别方式 |
|---|---|---|---|---|
| 系统 | 本机,无需联网 | 不用 | iPhone、iPad、Mac、安卓、鸿蒙 | 边读边逐页识别 |
| Paddle | 本机 | 先下载识别模型 | 安卓、鸿蒙、iPhone、iPad、Mac、Windows、Linux | 边读边逐页识别 |
| Paddle Online | 在线服务 | 填 Access Token | 所有设备 | 整本上传,一次转换 |
| MinerU | 在线服务 | 填 API Token | 所有设备 | 默认整本转换,也可改成逐页识别 |
当前设备不支持的引擎不会出现在列表里。比如 Windows 和 Linux 上没有「系统」。
怎么选:
- 只想认出文字、不想联网:选「系统」或「Paddle」。
- 版面复杂,想保留段落、表格、公式和图片:选「Paddle Online」或「MinerU」。
- 在线引擎会把 PDF 或页面图片发送到你配置的服务。介意隐私的书不要用。
系统
使用设备内置的识别能力,在本机完成,不需要联网,也没有额外设置。
Paddle
使用 PP-OCRv5 Mobile 模型在本机识别。
第一次使用前,在设置里点「下载」,等状态变成「已下载」。模型没下载好时,扫描页会显示成原页图片。
Paddle Online
在线解析复杂版面,可保留段落、表格、公式和图片。PDF 会整本上传到你配置的服务。
需要填写:
- 「Access Token」:填入你的 AI Studio Access Token。
- 「服务地址」:通常不用改。
- 「解析模型」:可选「PaddleOCR-VL-1.6(推荐)」或「PP-StructureV3」。
MinerU
适合复杂版面,可识别段落、表格和公式。识别内容会发送到你配置的服务。
需要填写:
- 「API Token」:点「获取 Token」打开 MinerU 的说明页申请,再粘贴进来。
- 「服务地址」:通常不用改,只在使用自定义服务时填写。
可以调整:
- 「识别模式」:「全文模式」一次完成整本转换;「单页模式」边读边识别,读到哪页识别哪页。默认是全文模式。
- 「解析模型」:「VLM(推荐)」或「Pipeline」。
- 「识别语言」:中英文、英文、日文、韩文、繁体中文、拉丁语系。
- 「表格识别」「公式识别」:分别还原表格和数学公式。
转换过程
逐页识别(系统、Paddle、MinerU 单页模式)
点「切换到重排阅读」后直接打开。读到哪一页,识别哪一页。
- 页面本来有文字的,直接用原文字,不做识别。
- 识别失败的页面会显示成原页图片,不会整本打不开。
- 识别过的页面会保存下来,下次打开不用再认。
整本转换(Paddle Online、MinerU 全文模式)
点「切换到重排阅读」后会弹出「PDF 转换」窗口,依次显示准备、上传、解析、下载等进度,完成后自动打开。
- 转换中可以取消。失败时窗口里会显示原因,可以点「重试」。
- 还没填好 Token 时会提示「请先完成识别服务配置」。
- 用 MinerU 转换超过 200 页的 PDF 时,会自动分批识别,再合并成一本。
- 转换结果会保存下来。同一本书再次打开重排,不用重新转换。
常见失败提示:
| 提示 | 处理 |
|---|---|
| Access Token 无效或已过期 | 重新获取 Token 填入 |
| 请求过于频繁或今日额度已用完 | 稍后再试,或检查服务方的额度 |
| PDF 超出识别服务允许的大小 | 文件太大,服务方不接受 |
| 无法连接识别服务,请检查网络或代理设置 | 检查网络和代理 |
识别结果保存在哪
在线引擎(Paddle Online、MinerU)的识别结果保存在本机,可以在「存储管理」里看到「PDF OCR 数据」这一项。
- 它不参与一键清理,避免误删后重复付费。
- 手动清理后,相关 PDF 需要重新识别,在线引擎可能再次产生服务费用。
- 修改了服务地址、解析模型、识别语言、表格或公式识别等参数后,会当成新的转换重新识别。
常见问题
原始 PDF 阅读页里还是搜不到扫描版的文字?
识别结果只用在重排阅读里。PDF 阅读页仍然显示原来的页面,扫描页照样选不中、搜不到。要搜索,请切换到重排阅读。
重排后有些页面还是图片?
可能是:
- 识别引擎是「禁用」
- 选了 Paddle 但模型还没下载
- 这一页识别失败,比如网络中断
先检查识别引擎的设置,再重新打开重排阅读。
识别出来错字多、乱码?
先换一个引擎试试。「系统」「Paddle」在本机识别,适合字迹清楚、版面简单的页面;版面复杂、字迹不清时,换「Paddle Online」或「MinerU」。一个引擎认不好,就换另一个。
换引擎后要重新打开重排阅读。整本转换的引擎换了参数,会当成新的转换重新识别。
纸质书能识别吗?
Reeden 不能直接拍照识别。先用手机上的扫描类 App 把书扫成 PDF,导入 Reeden 后按扫描版 PDF 处理:选好识别引擎,再切换到重排阅读。
能把 PDF 转成 TXT 或 EPUB 吗?
可以导出成 TXT,不能直接导出成 EPUB:
- 在书架上打开这本 PDF 的书籍菜单,点「导出」(手机、平板和 Mac 上也可以点「分享」)。
- 「导出格式」选 TXT。
- 想在 Reeden 里当普通电子书读,把导出的 TXT 再导入书架。它是一本新书,阅读记录不会带过去。需要 EPUB 的,再从这本 TXT 导出成 EPUB。
导出 TXT 用的文字和重排阅读一样:
- 文字型 PDF 直接取页面里的文字。
- 扫描版要先选好识别引擎。选了「系统」「Paddle」或 MinerU 单页模式时,导出时会逐页识别,页数多会比较慢;用整本转换的引擎(Paddle Online、MinerU 全文模式),要先在重排阅读里转换完成再导出。
- 识别引擎是「禁用」时,扫描页导不出文字。
导出的只有文字,图片、表格和原来的版面不会保留。
PDF 能合并吗?
不能。章节管理里的「从其他书籍合并」只支持本地 TXT,见 自定义章节管理。
重排后排版和原书不一样?
重排会按阅读设置重新排版,页面位置、分栏和原书不同是正常的。需要看原始版面时,切回原始 PDF。
Reeden