مشروع يهدف إلى فرز وتصنيف كميات ضخمة من البيانات الرقمية بناءً على خوارزميات التجميع (Clustering). تم استخدام Python لمعالجة الداتا وتقسيمها إلى مجموعات متجانسة ومنظمة، مما يسهل إدارة الملفات وقراءتها بشكل إحصائي دقيق