ملخص
- شركة Anthropic تخفف من تعهدها بالسلامة.
- الوقف الصارم السابق للشركة على التطوير تم استبداله بوعد بزيادة الشفافية.
- هذه الخطوة قد تخفض معايير السلامة في الصناعة.
تراجعت شركة Anthropic، صانعة وكيل الذكاء الاصطناعي Claude (أحد أدوات الإنتاجية المفضلة لدينا)، عن أحد مميزاتها الرئيسية – تعهدها الصارم بالسلامة. في منشور مدونة، حددت الشركة سياستها للتوسع المسؤول (RSP) والتغييرات المضمنة في الإصدار 3.0.
روابط سريعة
ما هي سياسة السلامة القديمة لـ Anthropic؟
وضعت الشركة معيارًا صناعيًا لضمانات السلامة
لفهم التغييرات التي تجريها Anthropic، تحتاج إلى فهم سياسة التوسع المسؤول (RSP) الأصلية. في عام 2023، تعهدت Anthropic بالتوقف عن تدريب نماذج الذكاء الاصطناعي إذا تجاوزت قدراتها قدرة الشركة على إثبات أنها آمنة. تضمنت علامات التحذير الحمراء للسلامة التي قد تؤدي إلى هذا التوقف ما يلي:
- نماذج يمكن أن تساعد في إنشاء أو نشر أسلحة كيميائية أو بيولوجية أو نووية.
- نماذج يمكن أن تحسن نفسها بدرجة مفرطة.
- نماذج يمكن أن تساعد في الهجمات الإلكترونية.
- نماذج يمكن أن تتصرف بطرق معينة دون تدخل بشري، مثل “الهروب” من بيئاتها لتجنب الإغلاق.
فرضت سياسة التوسع المسؤول (RSP) وقفًا صارمًا على هذه النماذج – ستتوقف Anthropic عن التطوير حتى لو كان ذلك يعني تجاوزها من قبل المنافسين. لقد كان موقفًا جريئًا في صناعة يبدو أن الجميع يتسابق فيها بسرعة فائقة.
سياسة التوسع المسؤول (RSP) الجديدة لـ Anthropic
الإصدار 3.0 يخفف القواعد بشكل كبير
لا تزال Anthropic لديها سياسة للتوسع المسؤول، ولكن مع الإصدار 3.0، ستوقف الشركة التطوير فقط إذا كانت تعتقد أنها تتمتع بالفعل بتقدم كبير على المنافسين. تم استبدال الوعد الملزم بالتوقف بوعد بالشفافية حول ما إذا كانت الشركة تحقق أهداف السلامة الخاصة بها وبمضاهاة أو تجاوز سلامة المنافسين. بعبارة أخرى، فقد تعهد السلامة بشكل أساسي.
ما هي دوافع هذه التغييرات؟ تقول Anthropic أن التعهد الأصلي للسلامة (RSP) لم يحقق التأثير الذي كانت تأمله. كان الهدف من RSP هو أن تقدم Anthropic مثالًا في مجال السلامة تتبعه الشركات الأخرى. لسوء الحظ، لم يلتفت المنافسون إلى هذه الإشارة. وتشعر الشركة أنه من خلال تقييد نفسها، فإنها تسمح بشكل أساسي للمنافسين الأقل اهتمامًا بالسلامة بقيادة السوق وتحديد وتيرة التطوير.
ماذا يعني هذا بالنسبة للصناعة؟
خطوة كبيرة إلى الوراء
لسوء الحظ، قد تؤدي هذه التغييرات إلى خلق سابقة سيئة في مجال الذكاء الاصطناعي. كانت Anthropic هي المعيار الذهبي لممارسات السلامة، ومع هذه التغييرات، انخفض السقف بشكل كبير. قد يرسل هذا رسالة إلى المنافسين مفادها أن السلامة تأتي في المرتبة الثانية بعد الابتكار. في حين أن ذلك قد يساعد Claude على اللحاق بـ ChatGPT، إلا أنه لا يزال يبدو وكأنه خطوة في الاتجاه الخاطئ.
في نهاية المطاف، إذا أردنا تجنب مخاوف المتشائمين بشأن الذكاء الاصطناعي، فإن تعهد السلامة من شركة واحدة لن يكون كافيًا – يجب على الصناعة بأكملها أن تتحد وترسم خطًا في الرمال. في هذه المرحلة، يبدو من غير المرجح على نحو متزايد أن يحدث هذا.