نورا عبدالعظيم
وعليكم السلام ورحمة الله، وجزاك الله خيرًا على السؤال والدعاء.
التقنيةُ في أصلها ليست من عندنا — بل من الأخ عبد الله (obadx) جزاه الله خيرًا:
١ — نموذج quran-muaalem
نموذجُ نطقٍ قرآنيٍّ يحوّل الصوتَ إلى فونيمات (وحداتٍ صوتيّة) لا إلى كلمات.
٢ — ومكتبة quran-transcript
تولّد الفونيماتِ المتوقَّعةَ من نصّ الآية.
فالمقارنةُ عندنا تجري بين تسلسلين من الفونيمات: ما نُطِق، وما كان ينبغي.
والذي بنيناه فوقهما
(١) المرجعُ معلومٌ سلفًا — فلا بحث.
النظامُ لا يسأل «أيَّ آيةٍ قرأ؟» — بل يُعطى السورةَ والآية، ثمّ يسأل «كيف قرأها؟»
وهذا فرقٌ عمليٌّ مهمّ: أنظمةُ البحث تسقط عند الخطأ (لا تجد الآية فتُخفق)، ومسارُنا لا يسقط — لأنّه لا يبحث أصلًا.
(٢) توطينُ الخطأ بالكلمة.
المكتبةُ تُخرِج موضعَ الخطأ بدقّة الحرف في النصّ العثمانيّ — فبنينا طبقةً تحوّله إلى الكلمة المخطوءة بعينها.
(٣) طبقةُ حكمٍ فوق النموذج.
وهذا أكثرُ ما بذلنا فيه. فالنموذجُ يُخرِج فروقًا صوتيّةً خامًا، ويحتاج تصنيفًا وكبحًا:
تمييزُ إسقاط كلمة من إسقاط حرف (والشدّةُ حرفٌ لا حركة).
كبحُ الإنذار الكاذب — فخوارزميّةُ كشف الإسقاط تنكسر عند خطأ الحركة، فيظهر إسقاطٌ لا وجودَ له.
وغفرانُ أطراف الآية — لأنّ الرسمَ الصوتيَّ يفترض الابتداءَ بأوّل الكلمات والوقوفَ على آخرها.
وقرارٌ حاكم
الأداةُ تكشف اللحنَ الجليَّ وحده — كلماتٍ وحروفًا وحركات. وأحكامُ التجويد خارج نطاقها عمدًا، لأنّها اجتهاديّةٌ تختلف بها المؤسّسات في ترتيب المطالبة بها.
والأصلُ الذي لا نتجاوزه: الآلةُ تُرشِّح، والمدرّسُ يُقرّ.
وحدودُها منشورةٌ بالأرقام
لا نخفيها: تغييرُ الحرف يُكشَف ٣ من ٩ في تجاربنا، والعلّةُ لم تُحسَم بعد. والزيادةُ تتأثّر بجودة التسجيل.
والكودُ والوثيقةُ والنتائجُ الخامُ منشورةٌ كلُّها:
https://huggingface.co/datasets/omar-abu-hfs-siraj/tasmee3-muaalem-findings
والوثيقةُ فيها تسعةَ عشرَ بابًا — كلُّ نتيجةٍ بأرقامها وحدودِها معها.
وأسأل الله أن ينفع به، وأرحّب بكلّ ملاحظةٍ أو تصويب.