عصر البطولات في الروبوتات المفتوحة: LingBot-VLA 2.0 يصبح النموذج الأساس الجديد لـOpenRoboto
نموذج Robbyant للرؤية واللغة والفعل برخصة Apache 2.0 صار أساس بطولة مجتمعية على OpenRoboto: الجميع يضبط ويقاس في ظروف متطابقة، ولا يصبح أساسا جديدا إلا نموذج أفضل بشكل قاطع.
وصل تعاون لافت إلى جبهة الروبوتات مفتوحة المصدر: أعلن نموذج LingBot-VLA 2.0، نموذج الرؤية واللغة والفعل (VLA) مفتوح الأوزان من Robbyant، النموذج الأساس الجديد على منصة المجتمع OpenRoboto. يأتي النموذج ذو الستة مليارات معامل برخصة Apache 2.0، وجرى الإطلاق بتصفيق متبادل؛ إذ شكرت OpenRoboto فريق Robbyant "لإطلاقه عملا كانت معظم المختبرات ستحتفظ به لنفسها".
مجموعة البيانات خلفه من الأوسع في المجال: 50 ألف ساعة من مسارات روبوتات حقيقية عبر 20 تكوينا روبوتيا، تضاف إليها 10 آلاف ساعة من فيديو بشري بمنظور الشخص الأول. والادعاء الحقيقي هو العمومية: فضاء فعل موحد واحد يقود الأذرع والقابضات والأيدي الماهرة والخصور والرؤوس والقواعد المتحركة. ومن بين الأجسام العشرين المدعومة أسماء مألوفة مثل Unitree G1 وFourier GR-2 وFranka وAgiBot، وقد نشر الفريق المنهج على arXiv.
أحدث ما في الخبر ليس الرخصة بل الآلية: تدير OpenRoboto الأمر كله كبطولة. يسحب المطورون النموذج ويضبطونه ويقاسون في ظروف متطابقة وينشرون النتائج علنا؛ ولا يصبح النموذج التالي أساسا إلا إذا كان أفضل بشكل قاطع. هكذا ينتقل كل مكسب إلى الجذع بدل أن ينسى في تفرع. يقولون إن قيمة النموذج المفتوح بما يفعله الناس به لاحقا؛ وهذا التصميم يحول تلك الجملة إلى نظام.
الصورة الأكبر: غطينا هذا الأسبوع انتقال Kimi K3 إلى بنية تحتية قابلة للاستئجار؛ ودفتر التطور المفتوح الذي نجح في نماذج اللغة يجري تركيبه الآن للروبوتات. بيانات مفتوحة وأوزان مفتوحة وقياس مشترك؛ ومختبرات الروبوتات المغلقة أمام منافس موزع.