Dkphhh

Read PDF Aloud が対応するファイル形式

Read PDF Aloud は PDF だけではありません。電子書籍から Office 文書まで、アップロードして聴けるすべてのファイル形式を紹介します。

名前に反して、Read PDF Aloud は PDF ファイルだけに限定されません。幅広い文書形式に対応しており、ほとんどあらゆる読み物を扱える汎用的な音声読み上げツールです。

アップロードできる形式は次のとおりです。

  • PDF.pdf)— 標準的な PDF 文書とスキャン PDF
  • EPUB.epub)— オープンな電子書籍形式
  • MOBI.mobi)— Amazon Kindle の旧電子書籍形式
  • AZW3 / KF8.azw3.kf8)— Amazon Kindle Format 8
  • Word.docx)— Microsoft Word 文書
  • PowerPoint.pptx)— Microsoft PowerPoint プレゼンテーション
  • OpenDocument テキスト.odt)— LibreOffice / OpenOffice の文書
  • OpenDocument プレゼンテーション.odp)— LibreOffice / OpenOffice のスライド
  • リッチテキスト形式.rtf)— クロスプラットフォームのリッチテキスト文書
  • プレーンテキスト.txt)— テキストファイル
  • Markdown.md)— Markdown 文書

さらに Read PDF Aloud にはテキスト入力モードがあり、ファイルをアップロードしなくても、テキストを直接貼り付けて読み上げさせられます。

PDF

PDF 文書はページ単位でテキストを抽出し、元のレイアウトをできる限り保ったまま解析されます。各ページは独立した単位として扱われるため、再生中のページ移動も元の文書構造に沿って行えます。

スキャン PDF の OCR

スキャン PDF(テキストが埋め込まれていない画像ベースの文書)の場合、Read PDF Aloud は AI による OCR(光学文字認識)を提供しています。スキャン PDF を検出すると、OCR を有効にするかどうか尋ねられます。これはプレミアム機能で、次の制限があります。

  • 最大ファイルサイズ:50 MB
  • 最大ページ数:1,000 ページ

OCR の結果は、ページごとに整理された構造化テキストとして返されます。

スキャン PDF の検出方法

Read PDF Aloud は PDF のテキスト密度、つまりページあたりの平均文字数を計算します。この密度が一定のしきい値(1 ページあたり 50 文字)を下回ると、その文書はスキャン PDF と判定されます。これにより、意味のあるテキストを抽出できない文書にリソースを無駄遣いするのを防いでいます。

電子書籍形式

電子書籍ファイル(EPUB、MOBI、AZW3/KF8)は章ごとに処理されます。各章の元の HTML コンテンツを抽出してプレーンテキストに変換するため、適切な構造と間隔のまま電子書籍を聴けます。

なお、AZW3 と KF8 は同じ形式(Amazon Kindle Format 8)を指すため、まったく同じ方法で処理されます。

Office 文書

Office 文書(DOCX、PPTX、ODT、ODP、RTF)はプレーンテキストに解析されます。これらの形式には PDF のようなページ割りの概念が組み込まれていないため、抽出したテキストは 20 行ずつの論理的なセグメントにまとめられ、滑らかに再生されます。

Office パーサーは必要なときに読み込まれます。Office ファイルを実際にアップロードするまで、ブラウジングには影響しません。

プレーンテキストと Markdown

プレーンテキストファイルと Markdown 文書は最も処理が簡単です。行ごとに読み込み、空行や余白を取り除いたうえで、再生用に論理的なセグメントへまとめられます。

処理の流れ

入力形式にかかわらず、すべてのファイルは同じ流れで処理されます。

  1. 形式の判定 — 拡張子に基づいて行われます
  2. テキスト抽出 — 形式ごとの解析ロジックを使用します
  3. ハッシュ生成 — 重複排除とキャッシュのために SHA-256 ハッシュを計算します
  4. ローカル保存 — 抽出したテキストとメタデータはブラウザ内にローカル保存されます

テキスト処理はすべて端末内で行われるため、文書のプライバシーと安全性が保たれます。

タグ
PDFTTSファイル形式,ガイド,拡張子