Anas Ahmed
ماشاء الله بارك الله لك في مشروعك
فقط بعض الأسئلة حتى نفهم بالضبط سبب البطء
- ما هي البنية الحالية للـ backend؟ (Python FastAPI / Flask / Node.js / غيره؟)
- كيف يتم إرسال الصوت من الـ frontend؟ (WebSocket / HTTP chunks / رفع ملف كامل؟)
- ما هو النموذج المستخدم في التفريغ الصوتي؟ (Whisper / نموذج مخصص / wav2vec2؟)
بشكل عام، مشكلة البطء في الـ live transcription
تكون في
النموذج نفسه : لو يعمل على CPU بدل GPU، أو حجمه كبير
إدارة الـ audio chunks حجم الـ chunk وتوقيت الإرسال
البنية التقنية: HTTP requests لكل chunk بدل WebSocket
أسرع حل مؤقت لو تستخدم Whisper: جرب faster-whisper مع int8 quantization، يكون أسرع من الأصلي على نفس الجهاز والله اعلم