@علي ملص جزاك الله خيراً أخي علي على هذه الملاحظات الدقيقة والتجربة المفيدة.
اكتشاف الأخطاء الواضحة وتغيير الحركات (اللحن الجلي) هو الأساس، ولديك كل الحق في التأكيد عليه.
هذا السلوك يرجع جزئياً إلى طبقة التطبيق ومعايير المطابقة والتفاوت (tolerances) في الحزمة المستخدمة، وجزئياً إلى حاجة النموذج لبيانات نطق سلبية (negative pronunciation data).
ونحن لا نطلب من أحد تلاوة القرآن بأخطاء متعمدة، بل نعمل على معالجة هذه النقطة مباشرة من خلال نموذج توليد الصوت (TTS) الداخلي لتوليد أخطاء نطق اصطناعية، مدعوماً بمشروع SAWT الذي نعمل فيه بجهد لبناء أفضل نموذج عام لمعالجة وترميم الصوت (Speech Restoration) في العالم ليتفوق على Miipher 2. هذا يتيح لنا تدريب النموذج على هذه الأخطاء الصوتية بدقة دون الاعتماد على تسجيلات بشرية غير صحيحة.
ممتنون جداً لعرضك المساعدة، ومثل هذه الملاحظات والتجارب الدقيقة هي ما يساعدنا في تحسين الإصدارات القادمة بإذن الله.