مشروع للتعرّف على المشاعر في الصوت باستخدام الشبكات العصبية العميقة (LSTM + CNN).
يهدف النظام إلى تحليل نغمة الصوت وتوقّع الشعور (سعيد، غاضب، حزين، خائف...) بدقة عالية.
تم تدريب النموذج على أكثر من 4 مجموعات بيانات صوتية عالمية لزيادة التنوّع والدقة.
المميزات:
استخراج الخصائص الصوتية (MFCC + Delta).
استخدام مزيج من CNN و BiLSTM لتحليل الصوت زمنيًا وخصائصيًا.
معالجة مشكلة عدم توازن البيانات باستخدام أوزان الفئات.
تحقيق دقة تتجاوز 85%.