รูปแบบไฟล์ที่ Read PDF Aloud รองรับ
Read PDF Aloud รองรับมากกว่าแค่ PDF รู้จักรูปแบบไฟล์ทั้งหมดที่อัปโหลดและฟังได้ ตั้งแต่หนังสืออิเล็กทรอนิกส์ไปจนถึงเอกสาร Office
แม้จะมีชื่ออย่างนี้ แต่ Read PDF Aloud ไม่ได้จำกัดอยู่แค่ไฟล์ PDF เครื่องมือนี้รองรับรูปแบบเอกสารหลากหลาย ทำให้เป็นเครื่องมือ text-to-speech อเนกประสงค์สำหรับสื่อการอ่านแทบทุกชนิดที่คุณมี
นี่คือรูปแบบไฟล์ทั้งหมดที่อัปโหลดได้:
- PDF (
.pdf) — เอกสาร PDF มาตรฐานและ PDF แบบสแกน - EPUB (
.epub) — รูปแบบหนังสืออิเล็กทรอนิกส์แบบเปิด - MOBI (
.mobi) — รูปแบบหนังสืออิเล็กทรอนิกส์รุ่นเก่าของ Amazon Kindle - AZW3 / KF8 (
.azw3,.kf8) — Amazon Kindle Format 8 - Word (
.docx) — เอกสาร Microsoft Word - PowerPoint (
.pptx) — งานนำเสนอ Microsoft PowerPoint - OpenDocument Text (
.odt) — เอกสารข้อความ LibreOffice / OpenOffice - OpenDocument Presentation (
.odp) — สไลด์ LibreOffice / OpenOffice - Rich Text Format (
.rtf) — เอกสารรูปแบบข้อความหลากหลายข้ามแพลตฟอร์ม - Plain Text (
.txt) — ไฟล์ข้อความล้วน - Markdown (
.md) — เอกสาร Markdown
นอกจากนี้ Read PDF Aloud ยังมี โหมดป้อนข้อความ ให้คุณวางข้อความใดก็ได้ลงไปโดยตรงแล้วให้อ่านออกเสียง โดยไม่ต้องอัปโหลดไฟล์
เอกสาร PDF จะถูกแยกวิเคราะห์เพื่อดึงข้อความทีละหน้า โดยคงรูปแบบเดิมไว้ให้มากที่สุดเท่าที่จะทำได้ แต่ละหน้าจะถูกเก็บเป็นหน่วยแยกกัน ทำให้การเลื่อนดูทีละหน้าระหว่างการเล่นยังคงตามโครงสร้างเอกสารต้นฉบับ
OCR สำหรับ PDF แบบสแกน
สำหรับไฟล์ PDF แบบสแกน (เอกสารที่เป็นรูปภาพและไม่มีข้อความฝังอยู่) Read PDF Aloud มีบริการ OCR (Optical Character Recognition) ที่ขับเคลื่อนด้วย AI เมื่อตรวจพบไฟล์ PDF แบบสแกน ระบบจะแจ้งให้คุณเปิดใช้ OCR ซึ่งเป็นฟีเจอร์พรีเมียมที่มีข้อจำกัดดังนี้:
- ขนาดไฟล์สูงสุด: 50 MB
- จำนวนหน้าสูงสุด: 1,000 หน้า
ผลลัพธ์ OCR จะส่งกลับมาเป็นข้อความแบบมีโครงสร้าง จัดเรียงตามหน้า
วิธีที่ระบบตรวจจับ PDF แบบสแกน
Read PDF Aloud คำนวณความหนาแน่นของข้อความในไฟล์ PDF คือจำนวนอักขระเฉลี่ยต่อหน้า ถ้าความหนาแน่นต่ำกว่าเกณฑ์ที่กำหนด (50 อักขระต่อหน้า) เอกสารจะถูกตีความว่าเป็น PDF แบบสแกน วิธีนี้ช่วยไม่ให้เสียทรัพยากรไปกับเอกสารที่ไม่มีข้อความที่มีความหมายให้ดึงออกมา
รูปแบบหนังสืออิเล็กทรอนิกส์
ไฟล์หนังสืออิเล็กทรอนิกส์ (EPUB, MOBI, AZW3/KF8) จะถูกประมวลผลทีละบท เนื้อหา HTML เดิมของแต่ละบทจะถูกดึงออกและแปลงเป็นข้อความล้วน ทำให้คุณฟังหนังสืออิเล็กทรอนิกส์ได้อย่างมีโครงสร้างและจังหวะที่ถูกต้อง
โปรดทราบว่า AZW3 และ KF8 คือรูปแบบเดียวกัน (Amazon Kindle Format 8) จึงถูกจัดการแบบเดียวกันทั้งคู่
เอกสาร Office
เอกสาร Office (DOCX, PPTX, ODT, ODP, RTF) จะถูกแยกวิเคราะห์เป็นข้อความล้วน เนื่องจากรูปแบบเหล่านี้ไม่มีแนวคิดเรื่องการแบ่งหน้าแบบ PDF ข้อความที่ดึงออกมาจึงถูกจัดกลุ่มเป็นส่วน ๆ ละ 20 บรรทัด เพื่อให้เล่นได้ต่อเนื่องราบรื่น
ตัวแยกวิเคราะห์ Office จะโหลดเมื่อจำเป็นเท่านั้น จึงไม่กระทบประสบการณ์การใช้งานของคุณจนกว่าคุณจะอัปโหลดไฟล์ Office จริง
ข้อความล้วนและ Markdown
ไฟล์ข้อความล้วนและเอกสาร Markdown ประมวลผลได้ง่ายที่สุด ระบบจะอ่านทีละบรรทัด ตัดบรรทัดว่างและช่องว่างออก แล้วจัดกลุ่มเป็นส่วน ๆ เพื่อเล่นให้ต่อเนื่อง
กระบวนการประมวลผล
ไม่ว่าไฟล์จะอยู่ในรูปแบบใด ทุกไฟล์จะผ่านกระบวนการเดียวกัน:
- ตรวจจับรูปแบบไฟล์ — จากนามสกุลไฟล์
- ดึงข้อความ — ด้วยตรรกะการแยกวิเคราะห์เฉพาะของแต่ละรูปแบบ
- สร้างแฮช — คำนวณแฮช SHA-256 เพื่อใช้ในการตรวจสอบไฟล์ซ้ำและแคช
- จัดเก็บในเครื่อง — ข้อความที่ดึงออกและข้อมูลเมตาจะถูกบันทึกไว้ในเบราว์เซอร์ของคุณ
การประมวลผลข้อความทั้งหมดเกิดขึ้นในเครื่องของคุณเอง ทำให้เอกสารของคุณยังคงเป็นส่วนตัวและปลอดภัย