AI Voice Conversion System using Deep Learning
تفاصيل العمل
وصف المشروع: تصميم وتنفيذ نظام ذكاء اصطناعي لتحويل الصوت (Voice Conversion) يقوم بتحويل أي كلام صوتي إلى صوت شخص آخر مع الحفاظ على المحتوى الأصلي للكلام. يعتمد النظام على نماذج حديثة في معالجة الصوت مثل wav2vec2 لاستخراج هوية المتحدث، وSpeechT5 لتحويل الكلام، وHiFiGAN لتوليد صوت عالي الجودة، مع تقييم دقة التحويل باستخدام cosine similarity. المميزات: تحويل صوت Zero-shot بدون تدريب إضافي الحفاظ على محتوى الكلام الأصلي إخراج صوت بجودة عالية قياس دقة التشابه بين الأصوات التقنيات المستخدمة: Python, PyTorch, Hugging Face, wav2vec2, SpeechT5, HiFiGAN, Resemblyzer
مهارات العمل