أعلنت شركة Anthropic رسميًا عن تعاونها مع Accenture لإجراء تقييم مستقل للذكاء الاصطناعي المتقدم. هذه خطوة مهمة لتحقيق الالتزام الذي قدمه الرئيس التنفيذي في مقاله "يجب أن نواكب المتقدم"، والذي يهدف إلى دمج المقيّمين داخل Anthropic.
سيقود التعاون فريق AI المتخصص من Accenture
سيقود هذا التعاون قسم الذكاء الاصطناعي المتخصص Faculty من Accenture، والذي سيشمل تقييم النماذج واختبارات الفرق الحمراء، وإجراء تقييمات التوافق، واختبار أمان النماذج. تساعد Accenture الشركات والحكومات في عدة صناعات على نشر الذكاء الاصطناعي، وفهمها لكيفية استخدام الشركات للذكاء الاصطناعي سيساهم في منهجيتها لتقييم الأمان، وسيتم دمج هذه الرؤية في تقييم نماذج Anthropic.
تخطط الأطراف لاستثمار ما لا يقل عن 1 مليار دولار خلال خمس سنوات
تتوقع كل من Anthropic وAccenture استثمار ما لا يقل عن 1 مليار دولار في هذا المجال خلال السنوات الخمس المقبلة. التقييم المدمج هو مفهوم جديد، ولا تزال العديد من التفاصيل قيد الإعداد. على عكس المقيّمين الخارجيين الحاليين، سيعمل المقيّمون المدمجون داخل الشركة، ولديهم صلاحيات وصول مماثلة للموظفين. هذه الصلاحيات تتيح لهم مراقبة تشكيل النماذج خلال عملية التدريب، وتتبع عملية اتخاذ القرار، والتواصل مباشرة مع الموظفين. من هذه الزاوية، يمكن للمقيّمين المدمجين تقييم عمليات الشركة، والتحقق من التزامها بتعهدات الأمان، وتحديد النقاط العمياء.
“المقيّمون المستقلون المدمجون لا يقللون من مسؤوليتنا، بل يساعدون في جعلها أكثر قابلية للتحقق. أمان نماذجنا لا يزال مسؤوليتنا.”
Anthropic
سيتم إنشاء نظام تقييم مشترك للمعايير في المستقبل
حتى الآن، لا توجد معايير تحدد المعلومات التي يجب أن يحصل عليها المقيّمون المدمجون أو كيفية الإبلاغ عن اكتشافاتهم. على المدى الطويل، تعتقد Anthropic أن التمويل يجب أن يأتي من موارد مركزية أو حكومية، كما دعونا في إطار الذكاء الاصطناعي المتقدم في يونيو. نظرًا لعدم وجود أي من هذين الأمرين حاليًا، تخطط Anthropic للتعاون مع مقيّمين مختلفين تحت ترتيبات تمويل مختلفة.
نظرًا لأهمية هذه المهمة وضرورتها، ستقوم Anthropic بتمويل عمل Accenture مباشرة. نحن أيضًا في حوار مع METR ومقيّمين غير ربحيين آخرين لاستخدام أموالهم الخاصة لتجربة بعض عناصر التقييم المدمج. في النهاية، نعتقد أن الذكاء الاصطناعي المتقدم يحتاج إلى نظام تقييم يعمل وفق معايير مشتركة.
علاوة على ذلك، تتوقع Anthropic أن تتعاون مختبرات الذكاء الاصطناعي المتقدم مع عدة منظمات في نفس الوقت. شراكاتنا ليست حصرية، وستتعاون Anthropic مع مقيّمين آخرين، وسنعلن عن شركاء آخرين في الأسابيع المقبلة، بينما ستتعاون Accenture أيضًا مع مطورين آخرين للذكاء الاصطناعي بنفس الطريقة.
سنواصل تدريب وإصدار نماذج متقدمة، ونأمل أن يتمكن المقيّمون المستقلون من العمل جنبًا إلى جنب معنا. نحن نشارك هذه الجهود المبكرة الآن حتى يتمكن الناس ومطورو الذكاء الاصطناعي الآخرون من فهم عملياتنا. نتوقع أنه مع نضوج هذا المجال، ستتطور منهجيتنا باستمرار، وسنشارك المزيد من المعلومات عند بدء العمل وإدخال المزيد من المقيّمين.
إطلاق برنامج التحقق من علوم الحياة
يوفر برنامج التحقق من علوم الحياة (LSVP) للمتخصصين في علوم الحياة الوصول إلى نماذج Claude Mythos وOpus وSonnet، ويأتي مع تدابير أمان أكثر مرونة لتسهيل الأعمال المتعلقة بالبيولوجيا.
بينما نعمل مع العملاء على تطوير تدابير أمان متقدمة للشركات، نحن أيضًا نعمل على تحسين تنسيقنا وأعمال الأمان لدينا. في 30 يوليو، أبلغنا عن ثلاث حالات من وصول غير مصرح به لنموذج Claude إلى أنظمة الكمبيوتر الفعلية. نحن نقوم بتحليل عميق لهذه الحوادث، ونخطط للتعاون مع METR لإجراء مراجعة مستقلة. في الوقت نفسه، سنشارك بعض التغييرات التي تم إجراؤها خلال الشهر الماضي.
مصدر المعلومات: الإعلان الرسمي من Anthropic
اقرأ المقال الأصلي على techritual.com (بالصينية التقليدية) →
The TechRitual editorial desk in Hong Kong. Articles on TechRitual World are translated from the Traditional Chinese originals on techritual.com.

