Các định dạng tệp được hỗ trợ trong Read PDF Aloud
Read PDF Aloud hỗ trợ nhiều hơn cả PDF. Khám phá mọi định dạng tệp bạn có thể tải lên và nghe, từ sách điện tử đến tài liệu Office.
Dù có tên như vậy, Read PDF Aloud không chỉ giới hạn ở tệp PDF. Công cụ hỗ trợ nhiều định dạng tài liệu, trở thành công cụ chuyển văn bản thành giọng nói linh hoạt cho hầu hết mọi loại tài liệu bạn có.
Dưới đây là tất cả các định dạng bạn có thể tải lên:
- PDF (
.pdf) — tài liệu PDF tiêu chuẩn và PDF quét - EPUB (
.epub) — định dạng sách điện tử mở - MOBI (
.mobi) — định dạng sách điện tử cũ của Amazon Kindle - AZW3 / KF8 (
.azw3,.kf8) — Amazon Kindle Format 8 - Word (
.docx) — tài liệu Microsoft Word - PowerPoint (
.pptx) — bài thuyết trình Microsoft PowerPoint - OpenDocument Text (
.odt) — tài liệu văn bản LibreOffice / OpenOffice - OpenDocument Presentation (
.odp) — trang trình bày LibreOffice / OpenOffice - Rich Text Format (
.rtf) — tài liệu văn bản định dạng đa nền tảng - Plain Text (
.txt) — tệp văn bản thuần - Markdown (
.md) — tài liệu Markdown
Ngoài ra, Read PDF Aloud còn có chế độ nhập văn bản, cho phép bạn dán trực tiếp bất kỳ đoạn văn bản nào và nghe nó được đọc to, không cần tải tệp lên.
Tài liệu PDF được phân tích để trích xuất văn bản từng trang, giữ nguyên bố cục gốc ở mức tối đa có thể. Mỗi trang được giữ như một đơn vị riêng, nên việc điều hướng theo trang khi phát bám theo cấu trúc tài liệu gốc.
OCR cho PDF quét
Với PDF quét (tài liệu dạng ảnh không có văn bản nhúng), Read PDF Aloud cung cấp OCR (Nhận dạng ký tự quang học) được hỗ trợ bởi AI. Khi phát hiện PDF quét, bạn sẽ được nhắc bật OCR. Đây là tính năng trả phí với các giới hạn sau:
- Dung lượng tệp tối đa: 50 MB
- Số trang tối đa: 1.000 trang
Kết quả OCR được trả về dưới dạng văn bản có cấu trúc, sắp xếp theo từng trang.
Cách phát hiện PDF quét
Read PDF Aloud tính mật độ văn bản của tệp PDF, tức số ký tự trung bình trên mỗi trang. Nếu mật độ thấp hơn một ngưỡng nhất định (50 ký tự mỗi trang), tài liệu sẽ được đánh dấu là PDF quét. Cách này tránh lãng phí tài nguyên vào những tài liệu không có văn bản đáng kể để trích xuất.
Định dạng sách điện tử
Tệp sách điện tử (EPUB, MOBI, AZW3/KF8) được xử lý theo từng chương. Nội dung HTML gốc của mỗi chương được trích xuất và chuyển thành văn bản thuần, nên bạn có thể nghe sách điện tử với cấu trúc và nhịp đọc chuẩn.
Lưu ý AZW3 và KF8 thực chất là cùng một định dạng (Amazon Kindle Format 8), nên chúng được xử lý giống hệt nhau.
Tài liệu Office
Tài liệu Office (DOCX, PPTX, ODT, ODP, RTF) được phân tích thành văn bản thuần. Vì các định dạng này không có khái niệm phân trang như PDF, văn bản trích xuất được nhóm thành các đoạn logic, mỗi đoạn 20 dòng, để phát mượt mà.
Bộ phân tích Office được tải theo yêu cầu, nghĩa là nó sẽ không ảnh hưởng đến trải nghiệm duyệt web của bạn cho đến khi bạn thực sự tải lên một tệp Office.
Văn bản thuần và Markdown
Tệp văn bản thuần và tài liệu Markdown là những định dạng dễ xử lý nhất. Chúng được đọc theo từng dòng, loại bỏ dòng trống và khoảng trắng thừa, rồi nhóm thành các đoạn logic để phát.
Quy trình xử lý
Bất kể định dạng đầu vào là gì, tất cả tệp đều đi qua cùng một quy trình:
- Nhận dạng định dạng — dựa trên phần mở rộng của tệp
- Trích xuất văn bản — dùng logic phân tích riêng cho từng định dạng
- Tạo mã băm — một mã băm SHA-256 được tính để khử trùng lặp và lưu cache
- Lưu trữ cục bộ — văn bản trích xuất và dữ liệu mô tả được lưu ngay trên trình duyệt của bạn
Toàn bộ quá trình xử lý văn bản diễn ra ngay trên thiết bị của bạn, đảm bảo tài liệu luôn riêng tư và an toàn.