تفاصيل العمل

نظام ذكي لتحويل اللكنة في الكلام باستخدام الذكاء الاصطناعي (AI-Powered Speech Accent Conversion System)

مشروع يهدف إلى تحسين وضوح وفهم مقاطع الفيديو التعليمية التي تحتوي على متحدثين بلكنات إنجليزية مختلفة، مع الحفاظ على هوية المتحدث وأسلوبه في الكلام والإيقاع الطبيعي للصوت. يعتمد النظام على خط معالجة متكامل يبدأ باستخراج الصوت من الفيديو، ثم تحويله إلى نص باستخدام نموذج Whisper Large-v3 Turbo، وتحسين النص باستخدام نماذج اللغة الكبيرة (LLMs)، ثم إعادة توليد الصوت باستخدام تقنية Voice Cloning عبر MiniMax Speech 2.8، وأخيرًا دمج الصوت الجديد مع الفيديو مع الحفاظ على التزامن الزمني وفترات التوقف الطبيعية. حقق المشروع نتائج متميزة من حيث دقة التعرف على الكلام وجودة الصوت المُولد، وأسهم في تحسين قابلية فهم المحتوى التعليمي، مما يجعله حلًا واعدًا لتطبيقات التعليم الإلكتروني وإتاحة المحتوى الرقمي.

ملفات مرفقة

بطاقة العمل

اسم المستقل
عدد الإعجابات
0
تاريخ الإضافة
تاريخ الإنجاز
المهارات