
منصة المؤشرات لتقييم النماذج اللغوية الضخمة العربية(LLM)
تهدف المنصة إلى دعم تطوير وتوفير مجموعات بيانات عربية متخصصة تُستخدم في تقييم أداء نماذج اللغة الضخمة عبر مهام متنوعة لتطويرها وتحسين جودة المحتوى العربي.
ابدأ رحلتك الآن
استكشف المؤشرات والمهام
تعرف على أنواع المؤشرات والمهام المتاحة لتقييم أداء النماذج
تصفّح لوحة المتصدرين
تصفّح أفضل النماذج وتعرف على أدائها عبر تقارير وبيانات مرئية
قيّم نموذجك
حمّل نموذجك، اختر المؤشر والمهمة، وابدأ التقييم
انضم إلى المجتمع
ناقش، تعلّم، وشارك المعرفة مع الآخرين
أبرز المؤشرات
عرض الكل
مؤشر تقييم قدرات الذكاء الاصطناعي
مؤشر لقياس وتقييم قدرات نماذج الذكاء الاصطناعي في مجموعة متنوعة من المهام، تشمل فهم المعرفة العامة والاستدلال، بالإضافة إلى توليد النصوص وتلخيصها، باستخدام مقاييس تقييم موضوعية ونماذج التحكيم.
تصفح المؤشر

مؤشر ساحة نماذج اللغة العربية
مؤشر ساحة نماذج اللغة العربية
تصفح المؤشر
أرقام منصة المؤشرات
جهة مشاركة
مهمة مغطاة
سؤال
مجموعة بيانات