Dkphhh

Read PDF Aloud 支持的文件格式

Read PDF Aloud 支持的远不止 PDF,从电子书到 Office 文档,一文了解所有可上传收听的文件格式。

虽然名字里带 PDF,但 Read PDF Aloud 并不只能读 PDF 文件。它支持多种文档格式,几乎你手头的任何阅读材料都能变成语音。

以下是所有可上传的格式:

  • PDF.pdf):标准 PDF 文档和扫描版 PDF
  • EPUB.epub):开放电子书格式
  • MOBI.mobi):Amazon Kindle 早期电子书格式
  • AZW3 / KF8.azw3.kf8):Amazon Kindle Format 8
  • Word.docx):Microsoft Word 文档
  • PowerPoint.pptx):Microsoft PowerPoint 演示文稿
  • OpenDocument Text.odt):LibreOffice / OpenOffice 文本文档
  • OpenDocument Presentation.odp):LibreOffice / OpenOffice 幻灯片
  • Rich Text Format.rtf):跨平台富文本文档
  • 纯文本.txt):纯文本文件
  • Markdown.md):Markdown 文档

此外,Read PDF Aloud 还提供文本输入模式,直接粘贴任意文字即可朗读,无需上传文件。

PDF

PDF 文档会逐页解析并提取文本,尽量保留原始排版。每一页都作为独立单元保留,因此播放时按页跳转依然符合原文档的结构。

扫描版 PDF 的 OCR 识别

对于扫描版 PDF(即没有内嵌文本的图片型文档),Read PDF Aloud 提供由 AI 驱动的 OCR(光学字符识别)。检测到扫描版 PDF 时,会提示你开启 OCR。这是一项高级功能,限制如下:

  • 最大文件大小:50 MB
  • 最大页数:1,000 页

OCR 结果会按页整理成结构化文本返回。

扫描版 PDF 的判定方式

Read PDF Aloud 会计算 PDF 的文本密度,也就是平均每页的字符数。如果密度低于某个阈值(每页 50 个字符),文档就会被判定为扫描版 PDF。这样可以避免在几乎没有可提取文本的文档上浪费资源。

电子书格式

电子书文件(EPUB、MOBI、AZW3/KF8)会按章节处理。每一章的原始 HTML 内容会被提取并转换为纯文本,让你能以清晰的结构和节奏收听电子书。

AZW3 和 KF8 指的是同一种格式(Amazon Kindle Format 8),处理方式完全相同。

Office 文档

Office 文档(DOCX、PPTX、ODT、ODP、RTF)会被解析成纯文本。由于这些格式不像 PDF 那样有内建的分页概念,提取出的文本会按每 20 行一组分成逻辑段落,保证播放流畅。

Office 解析器按需加载,只有在你真正上传 Office 文件时才会启用,不影响平时的浏览体验。

纯文本与 Markdown

纯文本文件和 Markdown 文档处理起来最简单。它们会逐行读取,去掉空行和多余空白,再分组为逻辑段落用于播放。

处理流程

无论输入什么格式,所有文件都经过同一套流程:

  1. 格式检测:根据文件扩展名判断
  2. 文本提取:使用对应格式的解析逻辑
  3. 哈希生成:计算 SHA-256 哈希,用于去重和缓存
  4. 本地存储:提取的文本和元数据保存在你的浏览器本地

所有文本处理都在你的设备本地完成,文档始终私密安全。

标签
pdftts格式,指南,文件类型