تخطَّ إلى المحتوى الرئيسي
ToolPotion

قائمة المتصدرين في CVE-Bench

تقيّم قائمة المتصدرين في CVE-Bench قدرة وكلاء الذكاء الاصطناعي على استغلال ثغرات الويب بشكل مستقل باستخدام مجموعة بيانات تحتوي على 40 ثغرة حرجة. تقدم إعدادين للتقييم: يوم واحد مع أوصاف الثغرات وصفر يوم بدون أوصاف.

زيارة الرابط
قائمة المتصدرين في CVE-Bench screenshot

الوصف

تعتبر قائمة المتصدرين في CVE-Bench منصة مصممة لتقييم قدرة وكلاء الذكاء الاصطناعي على استغلال ثغرات الويب بشكل مستقل. يعتمد التقييم على مجموعة بيانات تحتوي على 40 ثغرة حرجة من الثغرات الشائعة (CVEs) التي أعلنت عنها NIST بين 1 مايو 2024 و14 يونيو 2024. تشمل هذه الثغرات مجموعة واسعة من الاستغلالات عالية المخاطر، بما في ذلك تنفيذ التعليمات البرمجية عن بُعد، حقن SQL، وتصعيد الامتيازات.

توفر المنصة إعدادين واقعيين للتقييم: إعداد اليوم الواحد، حيث يتم تقديم أوصاف الثغرات، وإعداد صفر اليوم، حيث لا تتوفر الأوصاف. يتيح ذلك تقييمًا شاملاً لقدرة وكيل الذكاء الاصطناعي على التعامل مع الثغرات المعروفة وغير المعروفة.

تتضمن قائمة المتصدرين وكلاء مختلفين، مثل الوكيل الافتراضي المدمج مع Claude Opus 4.6، الذي حقق معدل Pass@1 بنسبة 32.5% بتكلفة متوسطة قدرها 0.31 دولار لكل مهمة. مثال آخر هو T-Agent المدمج مع GPT-4o، الذي لديه معدل Pass@1 بنسبة 8.0% بتكلفة متوسطة قدرها 1.70 دولار لكل مهمة.

تعتبر CVE-Bench مفيدة بشكل خاص للمنظمات والباحثين المهتمين بفهم فعالية الذكاء الاصطناعي في مجال الأمن السيبراني. توفر رؤى حول نقاط القوة والضعف لوكلاء الذكاء الاصطناعي المختلفين في التعامل مع ثغرات الويب، مما يجعلها أداة قيمة لتحسين حلول الأمان المدفوعة بالذكاء الاصطناعي.

الميزات الأساسية لـ قائمة المتصدرين في CVE-Bench

  • تقييم وكلاء الذكاء الاصطناعي على ثغرات الويب

  • مجموعة بيانات تحتوي على 40 ثغرة حرجة

  • تشمل تنفيذ التعليمات البرمجية عن بُعد، حقن SQL

  • إعداد تقييم ليوم واحد

  • إعداد تقييم لصفر يوم

  • مقياس أداء Pass@1

  • تحليل التكلفة لكل مهمة

  • تتبع إصدار المعيار

كيفية استخدام قائمة المتصدرين في CVE-Bench؟

  1. اختر إعداد التقييم: اختر يوم واحد أو صفر يوم

  2. قم بتشغيل وكيل الذكاء الاصطناعي: نفذ الوكيل على الثغرات المختارة

  3. تحليل النتائج: راجع مقاييس Pass@1 والتكلفة

  4. تحسين الوكيل: تحسين بناءً على بيانات الأداء

حالات استخدام قائمة المتصدرين في CVE-Bench

  • تقييم ثغرات الذكاء الاصطناعي
  • بحث في الأمن السيبراني
  • تحسين وكيل الذكاء الاصطناعي
  • تطوير حلول الأمان
  • تقييم أدوات الذكاء الاصطناعي

الأسئلة الشائعة من قائمة المتصدرين في CVE-Bench

تقييمات قائمة المتصدرين في CVE-Bench

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل قائمة المتصدرين في CVE-Bench

تطبيقات الذكاء الاصطناعي

ماسح ثغرات المواقع على الإنترنت مع محلل ذكاء اصطناعي مدمج يقوم بتنظيم أدوات الصناعة مثل OWASP ZAP وNuclei وNmap وWPScan وsqlmap، ثم يحول النتائج الخام إلى تقرير واحد ذي أولوية مع…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

تقدم Horizon3 اختبار اختراق مستقل لمساعدة المؤسسات في تحديد وإصلاح الثغرات قبل أن يتمكن المهاجمون من استغلالها. مع محاكاة الهجمات الواقعية، تمكن من التحقق المستمر من الأمان وتحديد…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

تقدم Equixly اختبار اختراق مستمر لواجهات برمجة التطبيقات (APIs) باستخدام مخترق ذكاء اصطناعي عميلي (Agentic AI Hacker). يكتشف ويختبر واجهات برمجة التطبيقات بشكل مستقل على مدار…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

Aptori هي منصة أمان تطبيقات أصلية بالذكاء الاصطناعي تتحقق باستمرار من سلوك وقت التشغيل، وتثبت قابلية الاستغلال، وتحدد أولويات المخاطر الحقيقية. إنها تسرع عملية الإصلاح، وتتحقق من…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

تقدم Adversa AI منصة مستقلة لاختبار الاختراق المستمر للذكاء الاصطناعي، مصممة خصيصًا لوكلاء الذكاء الاصطناعي، ونماذج اللغات الكبيرة (LLMs)، وتطبيقات الذكاء الاصطناعي التوليدي…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

تقدم Mindgard اختبارات أمان واختبارات فريق أحمر آلية لاكتشاف وتقييم نماذج وعوامل وتطبيقات الذكاء الاصطناعي والدفاع عنها. تعمل كفريق أحمر مستقل، حيث ترسم سطح هجوم الذكاء الاصطناعي…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

CyberSanctus هي شركة متخصصة في الأمن السيبراني تقدم اختبارات اختراق مدفوعة بالتهديدات، فرق حمراء، وتقييمات للثغرات، بالإضافة إلى CodeHound، أداة تدقيق العقود الذكية المدعومة…

أدوات الأمن السيبراني بالذكاء الاصطناعي

تطبيقات الذكاء الاصطناعي

White Hat هو روبوت محادثة للأمن السيبراني مدعوم بالذكاء الاصطناعي مصمم للمتسللين الأخلاقيين. يوفر استراتيجيات وموارد ذكية وشخصية وفي الوقت الفعلي لمساعدة المستخدمين على تحصين…

أدوات الأمن السيبراني بالذكاء الاصطناعي