Dkphhh

รูปแบบไฟล์ที่ Read PDF Aloud รองรับ

Read PDF Aloud รองรับมากกว่าแค่ PDF รู้จักรูปแบบไฟล์ทั้งหมดที่อัปโหลดและฟังได้ ตั้งแต่หนังสืออิเล็กทรอนิกส์ไปจนถึงเอกสาร Office

แม้จะมีชื่ออย่างนี้ แต่ Read PDF Aloud ไม่ได้จำกัดอยู่แค่ไฟล์ PDF เครื่องมือนี้รองรับรูปแบบเอกสารหลากหลาย ทำให้เป็นเครื่องมือ text-to-speech อเนกประสงค์สำหรับสื่อการอ่านแทบทุกชนิดที่คุณมี

นี่คือรูปแบบไฟล์ทั้งหมดที่อัปโหลดได้:

  • PDF (.pdf) — เอกสาร PDF มาตรฐานและ PDF แบบสแกน
  • EPUB (.epub) — รูปแบบหนังสืออิเล็กทรอนิกส์แบบเปิด
  • MOBI (.mobi) — รูปแบบหนังสืออิเล็กทรอนิกส์รุ่นเก่าของ Amazon Kindle
  • AZW3 / KF8 (.azw3, .kf8) — Amazon Kindle Format 8
  • Word (.docx) — เอกสาร Microsoft Word
  • PowerPoint (.pptx) — งานนำเสนอ Microsoft PowerPoint
  • OpenDocument Text (.odt) — เอกสารข้อความ LibreOffice / OpenOffice
  • OpenDocument Presentation (.odp) — สไลด์ LibreOffice / OpenOffice
  • Rich Text Format (.rtf) — เอกสารรูปแบบข้อความหลากหลายข้ามแพลตฟอร์ม
  • Plain Text (.txt) — ไฟล์ข้อความล้วน
  • Markdown (.md) — เอกสาร Markdown

นอกจากนี้ Read PDF Aloud ยังมี โหมดป้อนข้อความ ให้คุณวางข้อความใดก็ได้ลงไปโดยตรงแล้วให้อ่านออกเสียง โดยไม่ต้องอัปโหลดไฟล์

PDF

เอกสาร PDF จะถูกแยกวิเคราะห์เพื่อดึงข้อความทีละหน้า โดยคงรูปแบบเดิมไว้ให้มากที่สุดเท่าที่จะทำได้ แต่ละหน้าจะถูกเก็บเป็นหน่วยแยกกัน ทำให้การเลื่อนดูทีละหน้าระหว่างการเล่นยังคงตามโครงสร้างเอกสารต้นฉบับ

OCR สำหรับ PDF แบบสแกน

สำหรับไฟล์ PDF แบบสแกน (เอกสารที่เป็นรูปภาพและไม่มีข้อความฝังอยู่) Read PDF Aloud มีบริการ OCR (Optical Character Recognition) ที่ขับเคลื่อนด้วย AI เมื่อตรวจพบไฟล์ PDF แบบสแกน ระบบจะแจ้งให้คุณเปิดใช้ OCR ซึ่งเป็นฟีเจอร์พรีเมียมที่มีข้อจำกัดดังนี้:

  • ขนาดไฟล์สูงสุด: 50 MB
  • จำนวนหน้าสูงสุด: 1,000 หน้า

ผลลัพธ์ OCR จะส่งกลับมาเป็นข้อความแบบมีโครงสร้าง จัดเรียงตามหน้า

วิธีที่ระบบตรวจจับ PDF แบบสแกน

Read PDF Aloud คำนวณความหนาแน่นของข้อความในไฟล์ PDF คือจำนวนอักขระเฉลี่ยต่อหน้า ถ้าความหนาแน่นต่ำกว่าเกณฑ์ที่กำหนด (50 อักขระต่อหน้า) เอกสารจะถูกตีความว่าเป็น PDF แบบสแกน วิธีนี้ช่วยไม่ให้เสียทรัพยากรไปกับเอกสารที่ไม่มีข้อความที่มีความหมายให้ดึงออกมา

รูปแบบหนังสืออิเล็กทรอนิกส์

ไฟล์หนังสืออิเล็กทรอนิกส์ (EPUB, MOBI, AZW3/KF8) จะถูกประมวลผลทีละบท เนื้อหา HTML เดิมของแต่ละบทจะถูกดึงออกและแปลงเป็นข้อความล้วน ทำให้คุณฟังหนังสืออิเล็กทรอนิกส์ได้อย่างมีโครงสร้างและจังหวะที่ถูกต้อง

โปรดทราบว่า AZW3 และ KF8 คือรูปแบบเดียวกัน (Amazon Kindle Format 8) จึงถูกจัดการแบบเดียวกันทั้งคู่

เอกสาร Office

เอกสาร Office (DOCX, PPTX, ODT, ODP, RTF) จะถูกแยกวิเคราะห์เป็นข้อความล้วน เนื่องจากรูปแบบเหล่านี้ไม่มีแนวคิดเรื่องการแบ่งหน้าแบบ PDF ข้อความที่ดึงออกมาจึงถูกจัดกลุ่มเป็นส่วน ๆ ละ 20 บรรทัด เพื่อให้เล่นได้ต่อเนื่องราบรื่น

ตัวแยกวิเคราะห์ Office จะโหลดเมื่อจำเป็นเท่านั้น จึงไม่กระทบประสบการณ์การใช้งานของคุณจนกว่าคุณจะอัปโหลดไฟล์ Office จริง

ข้อความล้วนและ Markdown

ไฟล์ข้อความล้วนและเอกสาร Markdown ประมวลผลได้ง่ายที่สุด ระบบจะอ่านทีละบรรทัด ตัดบรรทัดว่างและช่องว่างออก แล้วจัดกลุ่มเป็นส่วน ๆ เพื่อเล่นให้ต่อเนื่อง

กระบวนการประมวลผล

ไม่ว่าไฟล์จะอยู่ในรูปแบบใด ทุกไฟล์จะผ่านกระบวนการเดียวกัน:

  1. ตรวจจับรูปแบบไฟล์ — จากนามสกุลไฟล์
  2. ดึงข้อความ — ด้วยตรรกะการแยกวิเคราะห์เฉพาะของแต่ละรูปแบบ
  3. สร้างแฮช — คำนวณแฮช SHA-256 เพื่อใช้ในการตรวจสอบไฟล์ซ้ำและแคช
  4. จัดเก็บในเครื่อง — ข้อความที่ดึงออกและข้อมูลเมตาจะถูกบันทึกไว้ในเบราว์เซอร์ของคุณ

การประมวลผลข้อความทั้งหมดเกิดขึ้นในเครื่องของคุณเอง ทำให้เอกสารของคุณยังคงเป็นส่วนตัวและปลอดภัย

แท็ก
pdfttsรูปแบบไฟล์คู่มือประเภทไฟล์