مقدمة
كشفت Generalist AI عن نموذج GEN-1.5، الذي يهدف إلى تمكين الروبوتات من تعلم مهام جسدية جديدة من عرض توضيحي واحد. ويمكن للنموذج تقييم عروض تتراوح مدتها بين 3 و12 ثانية إلى جانب بيانات المستشعرات والفيديو واللغة والموقع والحركة، ثم تنفيذها من دون ضبط دقيق أو تحديث للتدرج. ويستخدم GEN-1.5 نافذة سياق مدتها 30 ثانية، ويُنتج 100 أمر حركة في الثانية.
التطورات
حقق GEN-1.5 معدل نجاح بلغ في المتوسط 59% من خلال عرض توضيحي واحد في 10 مهام معالجة قصيرة المدة. وارتفعت هذه النسبة إلى 83% باستخدام بيانات مدتها خمس دقائق تتضمن نحو 50 عرضًا توضيحيًا لكل مهمة، و10 خطوات تدرج.
التفاصيل
وبلغ معدل النجاح 66.5% باستخدام بيانات مدتها دقيقة واحدة وخطوة تدرج واحدة.
ويستطيع النموذج إنشاء تسلسلات طويلة من المهام عبر دمج عروض توضيحية مختلفة، وتطوير الحركات الوسيطة بنفسه، ونقل العروض التوضيحية من المحاكاة إلى الروبوت الحقيقي من دون أمثلة. وأُشير إلى أن بعض قدرات النموذج على التعلم ضمن السياق والارتجال ظهرت تلقائيًا خلال عملية تدريبه المسبق، التي تتواصل منذ أكثر من ثمانية أشهر.