تاريخ التجربة: 2026-07-24 → 2026-07-27
المصدر: pdf/hidayat_alquran_alkarim.pdf — كتاب عربي مصوّر من 623 صفحة
المخرجات: md/hidayat_alquran_alkarim.md · word/hidayat_alquran_alkarim.docx
مستودع التجربة: مشروع OCR Workflow — فرع hidayat_alquran_alkarim
1. ملخص التجربة
هدفت التجربة إلى تحويل كتاب هداية القرآن الكريم، وهو كتاب عربي مصوّر يجمع بين الآيات القرآنية والتفسير، إلى نص رقمي قابل للبحث والتحرير، ثم إنتاج نسخة منسقة بصيغة Word.
لم تكن التجربة معالجة عادية لملف نصي، بل كانت اختباراً واسعاً لقدرة سير العمل على التعامل مع كتاب كبير ومعقد. فقد بلغ عدد صفحات الكتاب 623 صفحة، وتنوعت فيه أشكال الصفحات بين النصوص ذات العمود الواحد والأعمدة المتعددة، إضافة إلى الهوامش والملاحظات الجانبية والنصوص العربية الكثيفة.
كما احتوى الكتاب على آيات قرآنية مكتوبة بالرسم العثماني، مع علامات الآيات ﴿ و﴾. لذلك شملت التجربة اختبار وضوح النص، وترتيب الصفحات، والحفاظ على مواضع الآيات، والتعامل مع الأخطاء التي قد تظهر أثناء معالجة كتاب بهذا الحجم.
2. طبيعة الاختبار
اعتُبرت هذه التجربة اختباراً لحالة قصوى في معالجة الوثائق العربية، للأسباب الآتية:
- حجم كبير بلغ 623 صفحة.
- صفحات ممسوحة ضوئياً وليست نصوصاً رقمية جاهزة.
- اختلاف واضح في تخطيط الصفحات.
- وجود أعمدة متعددة وهوامش وملاحظات جانبية.
- نصوص عربية تفسيرية كثيفة وصغيرة الحجم.
- آيات قرآنية بالرسم العثماني تحتاج إلى عناية خاصة.
- الحاجة إلى معالجة الكتاب على مراحل مع الحفاظ على ترتيب الصفحات.
- احتمال ظهور أخطاء بعد المعالجة، مما يتطلب مراجعة وإعادة تشغيل بعض الأجزاء.
وبذلك لم يكن الهدف إنتاج نص سريع فحسب، بل اختبار قدرة سير العمل على الاستمرار والتعافي من الأخطاء في مشروع طويل ومتنوع.
3. بيئة التجربة والنماذج المستخدمة
استُخدم Claude Code لإدارة خطوات التجربة وتنظيم مراحل القراءة والكتابة والمراجعة. وتم الاتصال بنماذج MiniMax من خلال واجهة MiniMax المتوافقة مع Anthropic.
في هذا الإعداد، كانت أسماء opus وsonnet وhaiku تشير إلى مستويات تشغيل داخل Claude Code، وليس إلى أن نماذج Anthropic نفسها هي التي قامت بالمعالجة.
| مستوى المهمة | الاسم المستخدم في Claude Code | نموذج MiniMax | حالة الاستخدام في التجربة |
| قوي | opus | MiniMax M3 | اختُبر في المقارنة الأولية بين مساري المعالجة |
| متوسط | sonnet | MiniMax M2.7 | اختُبر واستُخدم في المعالجة الرئيسية |
| بسيط | haiku | MiniMax M2.5 | أُعدّ ضمن الإعداد، لكنه لم يُختبر في هذه التجربة |
جاء هذا التوزيع بهدف مقارنة مستوى قوي بمستوى متوسط، مع الاحتفاظ بمستوى أصغر للمهام البسيطة أو المستقبلية.
4. مسارات المعالجة التي جرى اختبارها
تم اختبار مسارين رئيسيين للتعامل مع الكتاب:
المسار الأول: قراءة ملفات PDF مباشرة
في هذا المسار، جرى التعامل مع أجزاء الكتاب بصيغة PDF مباشرة. كان هذا المسار مناسباً للبدء السريع، لكنه أظهر بعض المشكلات في قراءة الصفحات المصوّرة، مثل ظهور صفحات غير واضحة أو صعوبة التعامل مع بعض العناصر البصرية.
المسار الثاني: تحويل الصفحات إلى صور
في هذا المسار، جرى تحويل صفحات الكتاب إلى صور واضحة، ثم قراءة الصور على دفعات صغيرة. أظهر هذا الأسلوب نتائج أفضل في الصفحات التي تحتوي على أعمدة متعددة، وهوامش، وآيات قرآنية، كما منح النموذج صورة أوضح عن شكل الصفحة الحقيقي.
نتيجة المقارنة
أظهر المسار القائم على الصور تفوقاً واضحاً في هذه التجربة:
- كان أكثر وضوحاً في قراءة الصفحات المصوّرة.
- حافظ بصورة أفضل على علامات الآيات والصفحات.
- قلل من ادعاءات عدم وضوح الصفحات.
- كان أسرع بنحو الضعف في المقارنة المباشرة على بعض الأجزاء.
وبناءً على ذلك، اختير مسار الصور لاستكمال المعالجة الرئيسية للكتاب.
5. مراحل تنفيذ التجربة
المرحلة الأولى — تجهيز الكتاب
تم التأكد من عدد الصفحات، وتقسيم الكتاب إلى 32 جزءاً، بواقع 20 صفحة تقريباً لكل جزء، باستثناء الجزء الأخير الذي كان أقصر. كما أزيلت بقايا محاولات سابقة حتى تبدأ التجربة من حالة نظيفة.
المرحلة الثانية — اختبار ملفات PDF المباشرة
بدأت المعالجة باستخدام ملفات PDF المباشرة. ظهرت في البداية بعض المهام التي توقفت أو أعادت نتائج غير صحيحة، بما في ذلك نتائج تدّعي أن الصفحات غير قابلة للقراءة رغم أن الملفات كانت واضحة.
بعد تقليل عدد المهام المتوازية وتشديد تعليمات القراءة، نجحت معالجة الأجزاء الأولى بصورة أفضل.
المرحلة الثالثة — الانتقال إلى الصور
تم تحويل جميع الصفحات إلى صور خلال نحو ثلاث دقائق. وأكد اختبار مباشر لإحدى الصور وضوح الآيات القرآنية بالرسم العثماني، وظهور أعمدة التفسير، ووضوح بعض العناصر الموجودة في الهوامش.
المرحلة الرابعة — مقارنة النموذج والمسار
اختُبر MiniMax M3، وهو المستوى القوي، على مساري PDF المباشر والصور. استغرقت معالجة جزء باستخدام PDF المباشر نحو 31 دقيقة، بينما استغرق جزء مماثل باستخدام الصور نحو 14 دقيقة، مع وضوح أفضل للآيات في المسار الثاني.
كما شملت التجربة MiniMax M2.7، وهو المستوى المتوسط، الذي استُخدم لاحقاً في المعالجة الرئيسية. أما MiniMax M2.5 فكان معداً ضمن الإعداد، لكنه لم يدخل في الاختبار العملي.
المرحلة الخامسة — المعالجة الرئيسية
بعد أن واجه MiniMax M3 حدّاً متعلقاً بالاستخدام، انتقلت المعالجة الرئيسية إلى MiniMax M2.7 باستخدام مسار الصور. وتم تنفيذ العمل على دفعات صغيرة لتقليل التوقفات والمشكلات الناتجة عن إرسال عدد كبير من الصور دفعة واحدة.
المرحلة السادسة — المراجعة والإصلاح
ظهرت أثناء العمل بعض الحالات التي احتاجت إلى إعادة معالجة، من أبرزها:
- اعتبار مجموعة من الصفحات المليئة بآيات سورتي الشعراء والنمل صفحات فارغة.
- تجاوز عدد الصور المرسلة في إحدى الدفعات الحد المناسب.
- تكرار علامة إحدى الصفحات في جزء واحد من النص.
تم اكتشاف هذه الحالات أثناء المراجعة، ثم حُذفت الأجزاء المتأثرة وأعيدت معالجتها بتعليمات أوضح.
المرحلة السابعة — التحقق والدمج
بعد الإصلاح، اجتازت الأجزاء الـ32 عملية التحقق. ثم دُمجت الأجزاء في ملف Markdown واحد، وأُنشئت منه نسخة Word مضبوطة باتجاه الكتابة من اليمين إلى اليسار.
6. النتائج النهائية
أسفرت التجربة عن النتائج الآتية:
- معالجة الكتاب كاملاً، وعدد صفحاته 623 صفحة.
- تقسيم العمل إلى 32 جزءاً.
- نجاح التحقق من الأجزاء الـ32 بعد إصلاح المشكلات.
- وجود 623 علامة للصفحات في النص النهائي.
- وجود 1,408 علامة ختامية للآيات القرآنية.
- إنتاج ملف Markdown بحجم يقارب 1.4 ميغابايت.
- إنتاج ملف Word صالح للفتح بحجم يقارب 366 كيلوبايت.
- الحفاظ على اتجاه الكتابة من اليمين إلى اليسار في نسخة Word.
- عدم اكتشاف صفحات رئيسية مفقودة أو محتوى كبير مختلق أثناء المراجعة.
7. الصعوبات التي ظهرت أثناء التجربة
الصفحات التي عُدّت فارغة بالخطأ
في أحد الأجزاء، اعتُبرت 15 صفحة صفحات بيضاء، رغم أنها كانت تحتوي على نصوص قرآنية وتفسيرية. أُعيدت المعالجة بعد إضافة تعليمات تمنع اعتبار الصفحة فارغة إلا إذا كانت بيضاء فعلاً، وتم الحصول على نتيجة صحيحة في المحاولة الثانية.
كثرة الصور في الدفعة الواحدة
أظهرت التجربة أن إرسال عدد كبير من الصور في دفعة واحدة قد يؤدي إلى رفض الطلب. لذلك استُخدمت دفعات أصغر، بحيث تُرسل الصور على مجموعتين من عشر صور تقريباً.
تكرار علامة الصفحة
ظهر رقم إحدى الصفحات مرتين في جزء واحد. تم اكتشاف التكرار بواسطة أداة التحقق، ثم أزيل الجزء الزائد من دون فقدان المحتوى.
تحويل Markdown إلى Word
ظهرت مشكلة في أحد سكربتات التحويل، إذ استُخدم امتداد مؤقت جعل برنامج التحويل يتعامل مع الملف كأنه HTML بدلاً من DOCX. تم تجاوز المشكلة باستخدام أمر التحويل الصحيح مباشرة، ثم التحقق من أن ملف Word النهائي صالح.
8. حدود النتيجة النهائية
رغم اكتمال الكتاب من حيث الصفحات والتنظيم العام، لا ينبغي اعتبار النص خالياً من الأخطاء.
- الآيات وعلامات الصفحات كانت أكثر استقراراً من فقرات التفسير الكثيفة.
- بقيت بعض الاستبدالات الإملائية في الجمل العربية الطويلة والصغيرة الحجم.
- قد تظهر أحياناً أخطاء في ترتيب الكلمات أو بعض علامات القوائم.
- بعض أوصاف الصور والعناصر الزخرفية بقيت وصفية، ولم تتحول إلى صور مضمّنة داخل النص.
- ظهرت ملاحظات محدودة مرتبطة بتكرار بعض أرقام الحواشي، لكنها لم تمنع فتح الملفات أو قراءة النص.
وعليه، فالنتيجة مناسبة كنص رقمي قابل للبحث والمراجعة، لكنها لا تغني عن المراجعة البشرية إذا كان المطلوب نشر نسخة نهائية دقيقة حرفياً.
9. مقترحات لتحديث مهارة OCR
مشكلات مؤكدة تحتاج إلى إصلاح
- تحسين سكربت تحويل Word: يجب التأكد من أن برنامج التحويل يعرف أن المخرج المطلوب هو DOCX، لا مجرد ملف مؤقت بامتداد مختلف.
- الحفاظ على سجل التقدم: يجب ألا يؤدي الانتقال من مسار PDF إلى مسار الصور إلى فقدان حالة الأجزاء التي أُنجزت سابقاً.
- حماية الملفات السابقة: ينبغي منع تشغيل التجربة على ملفات أو سجلات تقدم تخص مصدراً مختلفاً من دون تنبيه واضح.
تحسينات مقترحة
- إضافة إعدادات مستقلة لمستويات النماذج: قوي، متوسط، وبسيط، بدلاً من ربط المهام بأسماء نماذج ثابتة.
- إضافة تحذيرات تلقائية عند التعامل مع ملفات كبيرة أو صفحات مصوّرة أو تخطيطات متعددة الأعمدة.
- جعل النظام يقترح مسار الصور للكتب المصوّرة قبل بدء المعالجة.
- تقسيم الصور تلقائياً إلى دفعات آمنة لتجنب تجاوز حدود الخدمة.
- توفير خيار واضح لإعادة التشغيل من البداية، وخيار آخر للاستكمال من آخر جزء مكتمل.
- إضافة فحوصات خاصة للكتب العربية التي تحتوي على آيات قرآنية أو نصوص بالرسم العثماني.
10. الخلاصة
أثبتت هذه التجربة أن تحويل كتاب عربي مصوّر من 623 صفحة إلى نص رقمي ممكن باستخدام أدوات الذكاء الاصطناعي، حتى عندما يجمع الكتاب بين الآيات القرآنية والتفسير والأعمدة المتعددة والهوامش والملاحظات الجانبية.
وكانت التجربة مفيدة لأنها لم تختبر مساراً واحداً أو نموذجاً واحداً فقط، بل قارنت بين PDF المباشر والصور، واختبرت MiniMax M3 وMiniMax M2.7، مع إعداد MiniMax M2.5 للمهام الصغيرة من دون استخدامه فعلياً في هذه الجولة.
وأظهرت النتائج أن تحويل الصفحات إلى صور كان الخيار الأفضل لهذا الكتاب، بينما قدم MiniMax M2.7 توازناً عملياً بين السرعة والقدرة على إكمال المعالجة الطويلة. وفي الوقت نفسه، أكدت التجربة أن جودة النتائج لا تعتمد على قوة النموذج وحدها، بل تحتاج أيضاً إلى تقسيم مناسب، ودفعات صغيرة، ومراجعة مستمرة، وخطة واضحة للتعامل مع الأخطاء.
وتبقى هذه النتيجة خطوة عملية مهمة نحو رقمنة الكتب العربية الكبيرة، مع ضرورة إبقاء المراجعة البشرية جزءاً من أي مشروع يهدف إلى إنتاج نسخة منشورة أو مرجعية عالية الدقة.