ستستعين Anthropic بـ Accenture لإجراء مراجعة مستقلة لمخاطر نماذج الذكاء الاصطناعي

29 سبتمبر 20269 الآراء

تعتزم الشركتان استثمار ما لا يقل عن $2 مليار على مدى خمس سنوات في تقييم النماذج المتقدمة، بما في ذلك اختبارات الفريق الأحمر والتحقق من آليات الحماية. وسيحصل متخصصو Accenture Faculty على إمكانية الوصول إلى العمليات الداخلية لدى Anthropic، لتحديد الثغرات وتقييم مدى الوفاء بالالتزامات المتعلقة بالسلامة.

ستستعين Anthropic بـ Accenture لإجراء مراجعة مستقلة لمخاطر نماذج الذكاء الاصطناعي

حجم الاستثمار والغرض منه

تخطط Anthropic وAccenture لاستثمار ما لا يقل عن 2 مليار دولار على مدى خمس سنوات في التقييم المستقل، والاختبار الهجومي، والتحقق من سلامة نماذج الذكاء الاصطناعي المتقدمة.

تعتزم كل شركة تخصيص ما لا يقل عن مليار دولار لتطوير قدرات اختبار سلامة الذكاء الاصطناعي والإشراف عليه. هذه خطط استثمارية، وليست تأكيدًا على إنفاق الأموال بالفعل.

تتمثل المؤشرات الرئيسية للمبادرة في الحد الأدنى المعلن للاستثمار، وفترة السنوات الخمس، ومجال توجيه الاستثمارات.

آلية التقييم المستقل

اختار الشريكان نهج التقييم المدمج: سيعمل المقيّمون المستقلون داخل Anthropic، وسيكون مستوى وصولهم مماثلًا لمستوى وصول الموظفين.

سيتمكن المقيّمون من:

  • التحقق من أعمال الشركة ومدى التزامها بتعهداتها المتعلقة بالسلامة؛
  • تحديد النقاط العمياء والإبلاغ عن الحوادث؛
  • تزويد الجمهور بصورة أكثر استنارة عن الفوائد والمخاطر.

المعيار العملي لهذا التقييم لا يقتصر على مشاركة مقيّمين خارجيين، بل يشمل أيضًا إمكانية وصولهم إلى أعمال الشركة.

مهام Accenture Faculty

ستتولى Accenture Faculty، وهي وحدة أعمال متخصصة في الذكاء الاصطناعي تابعة لـ Accenture، قيادة الشراكة. وستقيّم نماذج Anthropic وتُجري لها اختبارات هجومية.

كما ستشمل مهامها تقييمات الامتثال واختبار آليات الحماية في النماذج. وهذا يحدد مجال العمل المحدد لـ Accenture Faculty ضمن الشراكة.

لماذا لا يزال النهج قيد التطوير

تصف Anthropic التقييم المدمج بأنه مجال آخذ في التطور. وتناقش الشركة مشاريع تجريبية مع منظمة التقييم غير الربحية METR ومنظمات أخرى.

وتتوقع Anthropic أن تظهر معايير مشتركة بمرور الوقت ضمن منظومة أوسع للتقييم. وقد نشأت الشراكة في ظل تزايد اهتمام الجهات التنظيمية والباحثين وقطاع الأعمال بحماية النماذج الأكثر قوة.

وتُطرح المعايير المشتركة هنا بوصفها توجهًا متوقعًا، لا نتيجة تحققت بالفعل.

الأسئلة المتكررة

المواد ذات الصلة

جميع المواد
ستستعين Anthropic بـ Accenture لإجراء مراجعة مستقلة لمخاطر نماذج الذكاء الاصطناعي