كمال ياسر
وإياكم يا رب.
الصيغتين PNG و JPEG مناسبتين. وبخصوص الإعدادات، فهناك إعدادات مفضلة، فالدقة المثلى 300 DPI ويمكن تحويل الصورة إلى التدرج الرمادي (الأبيض والأسود) لتقليل حجم البيانات المرسلة للذكاء الاصطناعي.
وبخصوص التحويل فيمكن استخدام مكتبة pdf2image في بايثون، حيث يمكن تحويل كامل الكتاب إلى صور، ثم إرسال الصور بشكل متوازي إلى الذكاء الاصطناعي، مثلًا كل صورتين أو 3 في طلب، لكن يجب أن تلاحظ هنا أن خوادم الذكاء الاصطناعي قد لا تقبل باستقبال عدد كبير من الصور من IP واحد أو من نفس الـ API في نفس الوقت، لذلك يجب تحقيق توازن هنا بحيث مثلًا يتم إرسال 12 صورة في 4 طلبات بشكل متوازي ثم عند اكتمال معالجتها يتم إرسال الدفعة التالية وهكذا.
ويمكن أن تطلب من الذكاء الاصطناعي النتيجة على شكل HTML لضمان تطابق تنسيق الـ PDF مع التنسيق المخرج حيث يمكن إضافته في برنامج وورد مثلًا، أو يمكنك الاعتماد على نفس الطريقة التي تعتمدها حاليًا أي استخدام Pandoc لتحويل Markdown إلى Word.