ReedenReeden
阅读与排版

PDF 文字识别与重排阅读

把 PDF 转成可重排的文本来读,扫描版也能先用 OCR 识别文字;介绍四种识别引擎的区别、配置和会员限制,以及识别不准、纸质书、PDF 转 TXT 和合并的问题。

重排阅读是什么

重排阅读会把 PDF 的内容提取出来,用普通电子书的阅读页打开。转换后可以:

  • 像 EPUB、TXT 一样调整字号、行距、主题和排版
  • 全文搜索
  • 选中文字划线、写备注
  • 听书

重排不会改动原文件,随时可以切回原始 PDF。

重排的效果取决于 PDF 本身。表格、公式、多栏这类复杂版面,不一定能完全还原。

什么时候需要文字识别

PDF 分两种:

  • 文字型 PDF:页面里有真正的文字,在 PDF 阅读页能选中、能搜索。重排时直接提取这些文字,不需要识别。
  • 扫描版 PDF:每一页其实是一张图片,选不中文字,也搜不到。重排时需要先用 OCR(文字识别)把图片里的字认出来。

识别引擎默认是「禁用」。没有选择引擎时,扫描页在重排后只会显示成原页图片,读不到文字。

会员限制

重排阅读(应用里也叫「PDF 转码阅读」)是高级会员功能:

  • 免费用户可以试用 3 本书。已经试用过的书可以一直用下去。
  • 试用用完后,再打开新书的重排阅读会弹出会员开通页面。

识别引擎的设置本身不收费。在线引擎的调用费用和额度由对应服务方决定。

切换到重排阅读

  • 手机和平板:在 PDF 阅读页点屏幕中间呼出菜单,点菜单上方的「切换到重排阅读」按钮。
  • 桌面端:点顶部工具栏的「切换到重排阅读」按钮。

回到原始 PDF:

  • 手机和平板:在重排阅读页呼出菜单,点「切换到原始 PDF」按钮。
  • 桌面端:点顶部工具栏的「切换到原始 PDF」按钮。

重排打开失败时,错误提示下方也有「切换到原始 PDF」。

选择识别引擎

入口:

  • 手机和平板:PDF 阅读页的设置 →「更多设置」→「阅读工具」→「PDF 文字识别」。
  • 桌面端:PDF 阅读页顶部工具栏的设置 →「PDF 文字识别」。

在「识别引擎」里选一个。设置对所有 PDF 生效。

四种引擎对比

引擎在哪识别要不要配置支持的设备识别方式
系统本机,无需联网不用iPhone、iPad、Mac、安卓、鸿蒙边读边逐页识别
Paddle本机先下载识别模型安卓、鸿蒙、iPhone、iPad、Mac、Windows、Linux边读边逐页识别
Paddle Online在线服务填 Access Token所有设备整本上传,一次转换
MinerU在线服务填 API Token所有设备默认整本转换,也可改成逐页识别

当前设备不支持的引擎不会出现在列表里。比如 Windows 和 Linux 上没有「系统」。

怎么选:

  • 只想认出文字、不想联网:选「系统」或「Paddle」。
  • 版面复杂,想保留段落、表格、公式和图片:选「Paddle Online」或「MinerU」。
  • 在线引擎会把 PDF 或页面图片发送到你配置的服务。介意隐私的书不要用。

系统

使用设备内置的识别能力,在本机完成,不需要联网,也没有额外设置。

Paddle

使用 PP-OCRv5 Mobile 模型在本机识别。

第一次使用前,在设置里点「下载」,等状态变成「已下载」。模型没下载好时,扫描页会显示成原页图片。

Paddle Online

在线解析复杂版面,可保留段落、表格、公式和图片。PDF 会整本上传到你配置的服务。

需要填写:

  • 「Access Token」:填入你的 AI Studio Access Token。
  • 「服务地址」:通常不用改。
  • 「解析模型」:可选「PaddleOCR-VL-1.6(推荐)」或「PP-StructureV3」。

MinerU

适合复杂版面,可识别段落、表格和公式。识别内容会发送到你配置的服务。

需要填写:

  • 「API Token」:点「获取 Token」打开 MinerU 的说明页申请,再粘贴进来。
  • 「服务地址」:通常不用改,只在使用自定义服务时填写。

可以调整:

  • 「识别模式」:「全文模式」一次完成整本转换;「单页模式」边读边识别,读到哪页识别哪页。默认是全文模式。
  • 「解析模型」:「VLM(推荐)」或「Pipeline」。
  • 「识别语言」:中英文、英文、日文、韩文、繁体中文、拉丁语系。
  • 「表格识别」「公式识别」:分别还原表格和数学公式。

转换过程

逐页识别(系统、Paddle、MinerU 单页模式)

点「切换到重排阅读」后直接打开。读到哪一页,识别哪一页。

  • 页面本来有文字的,直接用原文字,不做识别。
  • 识别失败的页面会显示成原页图片,不会整本打不开。
  • 识别过的页面会保存下来,下次打开不用再认。

整本转换(Paddle Online、MinerU 全文模式)

点「切换到重排阅读」后会弹出「PDF 转换」窗口,依次显示准备、上传、解析、下载等进度,完成后自动打开。

  • 转换中可以取消。失败时窗口里会显示原因,可以点「重试」。
  • 还没填好 Token 时会提示「请先完成识别服务配置」。
  • 用 MinerU 转换超过 200 页的 PDF 时,会自动分批识别,再合并成一本。
  • 转换结果会保存下来。同一本书再次打开重排,不用重新转换。

常见失败提示:

提示处理
Access Token 无效或已过期重新获取 Token 填入
请求过于频繁或今日额度已用完稍后再试,或检查服务方的额度
PDF 超出识别服务允许的大小文件太大,服务方不接受
无法连接识别服务,请检查网络或代理设置检查网络和代理

识别结果保存在哪

在线引擎(Paddle Online、MinerU)的识别结果保存在本机,可以在「存储管理」里看到「PDF OCR 数据」这一项。

  • 它不参与一键清理,避免误删后重复付费。
  • 手动清理后,相关 PDF 需要重新识别,在线引擎可能再次产生服务费用。
  • 修改了服务地址、解析模型、识别语言、表格或公式识别等参数后,会当成新的转换重新识别。

常见问题

原始 PDF 阅读页里还是搜不到扫描版的文字?

识别结果只用在重排阅读里。PDF 阅读页仍然显示原来的页面,扫描页照样选不中、搜不到。要搜索,请切换到重排阅读。

重排后有些页面还是图片?

可能是:

  • 识别引擎是「禁用」
  • 选了 Paddle 但模型还没下载
  • 这一页识别失败,比如网络中断

先检查识别引擎的设置,再重新打开重排阅读。

识别出来错字多、乱码?

先换一个引擎试试。「系统」「Paddle」在本机识别,适合字迹清楚、版面简单的页面;版面复杂、字迹不清时,换「Paddle Online」或「MinerU」。一个引擎认不好,就换另一个。

换引擎后要重新打开重排阅读。整本转换的引擎换了参数,会当成新的转换重新识别。

纸质书能识别吗?

Reeden 不能直接拍照识别。先用手机上的扫描类 App 把书扫成 PDF,导入 Reeden 后按扫描版 PDF 处理:选好识别引擎,再切换到重排阅读。

能把 PDF 转成 TXT 或 EPUB 吗?

可以导出成 TXT,不能直接导出成 EPUB:

  1. 在书架上打开这本 PDF 的书籍菜单,点「导出」(手机、平板和 Mac 上也可以点「分享」)。
  2. 「导出格式」选 TXT。
  3. 想在 Reeden 里当普通电子书读,把导出的 TXT 再导入书架。它是一本新书,阅读记录不会带过去。需要 EPUB 的,再从这本 TXT 导出成 EPUB。

导出 TXT 用的文字和重排阅读一样:

  • 文字型 PDF 直接取页面里的文字。
  • 扫描版要先选好识别引擎。选了「系统」「Paddle」或 MinerU 单页模式时,导出时会逐页识别,页数多会比较慢;用整本转换的引擎(Paddle Online、MinerU 全文模式),要先在重排阅读里转换完成再导出。
  • 识别引擎是「禁用」时,扫描页导不出文字。

导出的只有文字,图片、表格和原来的版面不会保留。

PDF 能合并吗?

不能。章节管理里的「从其他书籍合并」只支持本地 TXT,见 自定义章节管理。

重排后排版和原书不一样?

重排会按阅读设置重新排版,页面位置、分栏和原书不同是正常的。需要看原始版面时,切回原始 PDF。