Dkphhh

صيغ الملفات المدعومة في Read PDF Aloud

يدعم Read PDF Aloud أكثر من PDF بكثير، تعرّف على جميع صيغ الملفات التي يمكنك رفعها والاستماع إليها، من الكتب الإلكترونية إلى مستندات Office.

رغم الاسم، فإن Read PDF Aloud لا يقتصر على ملفات PDF. يدعم مجموعة واسعة من صيغ المستندات، ما يجعله أداة تحويل نص إلى كلام متعددة الاستخدامات لأي مادة قراءة لديك تقريبًا.

إليك جميع الصيغ التي يمكنك رفعها:

  • PDF (.pdf) — مستندات PDF القياسية وملفات PDF الممسوحة ضوئيًا
  • EPUB (.epub) — صيغة الكتب الإلكترونية المفتوحة
  • MOBI (.mobi) — صيغة الكتب الإلكترونية القديمة من Amazon Kindle
  • AZW3 / KF8 (.azw3, .kf8) — صيغة Amazon Kindle Format 8
  • Word (.docx) — مستندات Microsoft Word
  • PowerPoint (.pptx) — عروض Microsoft PowerPoint التقديمية
  • OpenDocument Text (.odt) — مستندات نصية من LibreOffice / OpenOffice
  • OpenDocument Presentation (.odp) — شرائح LibreOffice / OpenOffice
  • Rich Text Format (.rtf) — مستندات نصية منسقة متعددة المنصات
  • نص عادي (.txt) — ملفات النص العادي
  • Markdown (.md) — مستندات Markdown

بالإضافة إلى ذلك، يوفر Read PDF Aloud وضع إدخال النص حيث يمكنك لصق أي نص مباشرة وسماعه بصوت عالٍ، دون الحاجة إلى رفع أي ملف.

PDF

تُحلَّل مستندات PDF لاستخراج النص صفحة بصفحة، مع الحفاظ على التنسيق الأصلي قدر الإمكان. تُعامل كل صفحة كوحدة مستقلة، لذا فإن التنقل بين الصفحات أثناء التشغيل يتبع بنية المستند الأصلية.

التعرف الضوئي على الحروف لملفات PDF الممسوحة

بالنسبة لملفات PDF الممسوحة ضوئيًا (المستندات المصوّرة التي لا تحتوي على نص مدمج)، يوفر Read PDF Aloud تقنية OCR (التعرف الضوئي على الحروف) مدعومة بالـ AI. عند اكتشاف ملف PDF ممسوح ضوئيًا، سيُطلب منك تفعيل OCR. هذه ميزة مدفوعة بحدود التالية:

  • الحد الأقصى لحجم الملف: 50 MB
  • الحد الأقصى لعدد الصفحات: 1,000 صفحة

تُعاد نتائج OCR كنص منظم حسب الصفحة.

كيف يتم اكتشاف ملفات PDF الممسوحة

يحسب Read PDF Aloud كثافة النص في ملف PDF، أي متوسط عدد الأحرف في الصفحة. إذا انخفضت الكثافة عن حد معين (50 حرفًا في الصفحة)، يُصنَّف المستند كملف PDF ممسوح ضوئيًا. هذا يمنع إهدار الموارد على المستندات التي لا تحتوي على نص ذي معنى لاستخراجه.

صيغ الكتب الإلكترونية

تُعالَج ملفات الكتب الإلكترونية (EPUB وMOBI وAZW3/KF8) فصلًا بفصل. يُستخرج محتوى HTML الأصلي لكل فصل ويُحوَّل إلى نص عادي، لتتمكن من الاستماع إلى كتبك الإلكترونية ببنية وإيقاع سليمين.

لاحظ أن AZW3 وKF8 يشيران إلى الصيغة نفسها (Amazon Kindle Format 8)، لذا تُعالَج بالطريقة نفسها.

مستندات Office

تُحلَّل مستندات Office (DOCX وPPTX وODT وODP وRTF) إلى نص عادي. ولأن هذه الصيغ لا تحتوي على مفهوم ترقيم صفحات مدمج مثل PDF، يُقسَّم النص المستخرج إلى مقاطع منطقية من 20 سطرًا لكل منها لضمان تشغيل سلس.

يُحمَّل محلل Office عند الطلب، فلن يؤثر على تجربة التصفح حتى ترفع ملف Office فعليًا.

النص العادي وMarkdown

ملفات النص العادي ومستندات Markdown هي الأسهل في المعالجة. تُقرأ سطرًا بسطر، مع إزالة الأسطر الفارغة والمسافات الزائدة، ثم تُقسَّم إلى مقاطع منطقية للتشغيل.

مسار المعالجة

بغض النظر عن صيغة الإدخال، تمر جميع الملفات بالمسار نفسه:

  1. اكتشاف الصيغة — بناءً على امتداد الملف
  2. استخراج النص — باستخدام منطق تحليل خاص بكل صيغة
  3. توليد البصمة — يُحسب تجزئة SHA-256 لإزالة التكرار والتخزين المؤقت
  4. التخزين المحلي — يُحفظ النص المستخرج والبيانات الوصفية محليًا في متصفحك

تتم جميع عمليات معالجة النص محليًا على جهازك، ما يضمن بقاء مستنداتك خاصة وآمنة.

الوسوم
pdfttsصيغدليلأنواع-الملفات