تخطَّ إلى المحتوى
العربية
محتوى FikirPilot

يشعر الباحثون بالقلق من وقوع كارثة تتعلق بالسلامة قبل إصدار Astra من OpenAI

حُدِّث: 2026-09-06 · 2 دقيقة قراءة · 384 كلمة

نُشر: · وصلنا الخبر: · مدة المعالجة: 81 ساعة 32 دقيقة

يشعر الباحثون بالقلق من وقوع كارثة تتعلق بالسلامة قبل إصدار Astra من OpenAI
ممر في مركز بيانات مضاء بالضوء الأزرق

من المتوقع أن يكون إطلاق Astra، الذي يُنتظر أن يكون أقوى نموذج ذكاء اصطناعي لدى OpenAI، قد تأجل لأسابيع بهدف تعزيز بروتوكولات السلامة. وبعد وقت قصير من قرار التأجيل، أفادت The Information بأن النموذج يُظهر عملية «التفكير» بدرجة أقل بكثير مقارنةً بأنظمة الذكاء الاصطناعي الرائدة الأخرى. وأثار ذلك مخاوف من أن يجعل تتبّع Astra واكتشاف سلوكياته الخطرة أكثر صعوبة.

تستخدم العديد من نماذج الذكاء الاصطناعي المتقدمة اليوم نهج «chain of thought»، الذي يجعل خطوات الاستدلال ظاهرة أثناء توليد الإجابات. ويتيح ذلك للباحثين تتبّع خطط النماذج للكذب أو تجاوز إجراءات السلامة. ووفقًا لتقرير The Information، المستند إلى مصدر لم تُكشف هويته، يستخدم Astra تقنية أكثر انغلاقًا تُعرف باسم «recurrent depth» أو «looped transformer»، إذ تعالج المعلومات بصورة دورية بين الطبقات الداخلية. وبينما قد تعزز هذه الطريقة الأداء، فإنها قد تجعل عملية تفكير النموذج أقل وضوحًا، ما يصعّب تحديد التهديدات.

وأُفيد بأن OpenAI قيّدت استخدام هذه التقنية واتخذت تدابير إضافية لتمكين الباحثين من تتبّع الاستدلال. وأعلنت الشركة أنها ستطرح Astra للاستخدام مع «chain-of-thought monitoring»، وأنها ستكتشف الأفعال غير المتوافقة وتحد منها بسرعة؛ لكنها لم تؤكد البنية التحتية التقنية للنموذج.

وقال Ryan Greenblatt، كبير العلماء في Redwood Research، إن البنية الأكثر انغلاقًا قد تكون أسوأ تطور حتى الآن من ناحية «AI security/safety». وحذّر Greenblatt وخبراء آخرون من أن توجه الشركات بشكل متزايد نحو أنظمة أكثر غموضًا بسبب المنافسة قد يؤدي إلى «race to the bottom» في مجال الإشراف على الذكاء الاصطناعي.

أما Jakub Pachocki، كبير العلماء في OpenAI، فأوضح أن عمق الحوسبة الداخلية في Astra يقع ضمن نطاق يقل عن ضعفي عمق GPT-4. ولم تؤكد الشركة ما إذا كانت تستخدم looped transformer.

لماذا هذا مهم

لا يؤثر تأجيل Astra في الجدول الزمني لطرحها في السوق فحسب، بل يؤثر أيضًا في النقاش المتعلق بكيفية الإشراف على أنظمة الذكاء الاصطناعي المتقدمة. ولم يتأكد الادعاء بأن النموذج يستخدم بنية تجعل آلية عمله الداخلية أقل وضوحًا؛ لكن هذا الادعاء يزيد مخاوف الباحثين الأمنيين بشأن قدرتهم على رصد محاولات النموذج للكذب أو تجاوز تدابير السلامة. ولا يزيل إعلان OpenAI أنها تخطط لاتخاذ تدابير إضافية للمراقبة والتقييد التوتر القائم بين الأداء وقابلية الإشراف. ويبقى السؤال الأساسي المطروح هو ما إذا كانت بروتوكولات السلامة لدى الشركة ستكون كافية لتحديد السلوكيات الخطرة في الوقت المناسب داخل نظام غامض.

الخلفية

لا يُعد OpenAI اسمًا جديدًا في أرشيف FikirPilot: فقد نشرنا خلال آخر 90 يومًا 19 خبرًا ورد فيه هذا الاسم؛ وكان أحدثها بتاريخ 6 سبتمبر 2026.

المصدر: The Verge