Dkphhh

Unterstützte Dateiformate in Read PDF Aloud

Read PDF Aloud unterstützt weit mehr als PDF. Erfahren Sie, welche Dateiformate Sie hochladen und anhören können, von E-Books bis zu Office-Dokumenten.

Der Name täuscht: Read PDF Aloud ist nicht auf PDF-Dateien beschränkt. Das Tool unterstützt eine Vielzahl von Dokumentformaten und ist damit ein vielseitiges Text-to-Speech-Tool für nahezu jedes Lesematerial.

Hier sind alle Formate, die Sie hochladen können:

  • PDF (.pdf) — Standard-PDF-Dokumente und gescannte PDFs
  • EPUB (.epub) — offenes E-Book-Format
  • MOBI (.mobi) — älteres Amazon-Kindle-E-Book-Format
  • AZW3 / KF8 (.azw3, .kf8) — Amazon Kindle Format 8
  • Word (.docx) — Microsoft-Word-Dokumente
  • PowerPoint (.pptx) — Microsoft-PowerPoint-Präsentationen
  • OpenDocument Text (.odt) — LibreOffice-/OpenOffice-Textdokumente
  • OpenDocument Presentation (.odp) — LibreOffice-/OpenOffice-Folien
  • Rich Text Format (.rtf) — plattformübergreifende Rich-Text-Dokumente
  • Klartext (.txt) — einfache Textdateien
  • Markdown (.md) — Markdown-Dokumente

Außerdem bietet Read PDF Aloud einen Texteingabe-Modus, in dem Sie beliebigen Text direkt einfügen und vorlesen lassen können, ganz ohne Datei-Upload.

PDF

PDF-Dokumente werden seitenweise analysiert, um den Text zu extrahieren, wobei das ursprüngliche Layout so genau wie möglich erhalten bleibt. Jede Seite bleibt eine eigene Einheit, sodass die Navigation per Seite während der Wiedergabe der Struktur des Originaldokuments folgt.

OCR für gescannte PDFs

Für gescannte PDFs (bildbasierte Dokumente ohne eingebetteten Text) bietet Read PDF Aloud eine KI-gestützte OCR (Optical Character Recognition) an. Wird ein gescanntes PDF erkannt, werden Sie aufgefordert, OCR zu aktivieren. Diese Premium-Funktion hat folgende Grenzen:

  • Maximale Dateigröße: 50 MB
  • Maximale Seitenzahl: 1.000 Seiten

Die OCR-Ergebnisse werden als strukturierter Text zurückgegeben, nach Seiten gegliedert.

Wie gescannte PDFs erkannt werden

Read PDF Aloud berechnet die Textdichte einer PDF, also die durchschnittliche Zeichenanzahl pro Seite. Liegt die Dichte unter einem bestimmten Schwellenwert (50 Zeichen pro Seite), wird das Dokument als gescanntes PDF eingestuft. So werden keine Ressourcen für Dokumente verschwendet, aus denen sich kein sinnvoller Text extrahieren lässt.

E-Book-Formate

E-Book-Dateien (EPUB, MOBI, AZW3/KF8) werden kapitelweise verarbeitet. Der ursprüngliche HTML-Inhalt jedes Kapitels wird extrahiert und in Klartext umgewandelt, sodass Sie Ihre E-Books mit richtiger Struktur und gutem Lesefluss anhören können.

AZW3 und KF8 bezeichnen dasselbe Format (Amazon Kindle Format 8) und werden daher identisch verarbeitet.

Office-Dokumente

Office-Dokumente (DOCX, PPTX, ODT, ODP, RTF) werden in Klartext zerlegt. Da diese Formate kein eingebautes Seitenumbruch-Konzept wie PDF haben, wird der extrahierte Text in logische Abschnitte von je 20 Zeilen gruppiert, damit die Wiedergabe flüssig bleibt.

Der Office-Parser wird bei Bedarf nachgeladen. Er beeinträchtigt Ihr Browsererlebnis nicht, bis Sie tatsächlich eine Office-Datei hochladen.

Klartext und Markdown

Einfache Textdateien und Markdown-Dokumente lassen sich am einfachsten verarbeiten. Sie werden Zeile für Zeile gelesen, wobei Leerzeilen und überflüssige Leerzeichen entfernt und der Text anschließend in logische Abschnitte für die Wiedergabe gruppiert wird.

Verarbeitungsablauf

Unabhängig vom Eingabeformat durchlaufen alle Dateien denselben Ablauf:

  1. Formaterkennung — anhand der Dateiendung
  2. Textextraktion — mit formatspezifischer Parselogik
  3. Hash-Erzeugung — ein SHA-256-Hash wird für Deduplizierung und Caching berechnet
  4. Lokale Speicherung — extrahierter Text und Metadaten werden lokal in Ihrem Browser gespeichert

Die gesamte Textverarbeitung findet lokal auf Ihrem Gerät statt. Ihre Dokumente bleiben dadurch privat und sicher.

Tags
pdfttsformateanleitungdateitypen