MarkTechPost→ المصدر

قدمت Ant Group نموذج LingBot-VLA 2.0 — نموذج مفتوح للتحكم في الروبوتات من أي تصميم

أطلقت Robbyant، جزء من Ant Group، نموذج LingBot-VLA 2.0، وهو نموذج رؤية-لغة-عمل مفتوح للتحكم في الروبوتات عبر الأنصات. تم تدريب النموذج البالغ 6 مليارات معامل على 60 ألف ساعة من البيانات: 50 ألف ساعة من الفيديو من 20 تكوين روبوت و 10 آلاف ساعة من فيديو بمنظور الشخص الأول. يربط أي روبوت بفضاء عمل موحد بـ 55 بُعد للأذرع والمقابض الدالية والجذوع والقواعد المتنقلة. على معيار GM-100، يتفوق LingBot-VLA 2.0 على π0.5 والإصدار 1.0.

معالج بواسطة الذكاء الاصطناعي من MarkTechPost؛ بتحرير Hamidun News
قدمت Ant Group نموذج LingBot-VLA 2.0 — نموذج مفتوح للتحكم في الروبوتات من أي تصميم
المصدر: MarkTechPost. كولاج: Hamidun News.
◐ استمع للمقال

أطلقت Robbyant، قسم الروبوتيكا في Ant Group، LingBot-VLA 2.0 في 8 يوليو 2026 — نموذج مفتوح رؤية-لغة-إجراء بـ 6 مليارات معامل للتحكم في الروبوتات ذات التصاميم المختلفة تحت رخصة Apache 2.0.

ما البيانات التي تم تدريب النموذج عليها

تم التدريب المسبق لـ LingBot-VLA 2.0 على حوالي 60000 ساعة من البيانات، وفقاً لـ MarkTechPost. من هذه، 50000 ساعة هي مسارات الروبوتات المجمعة عبر 20 تكوين روبوت مختلف، و10000 ساعة أخرى هي فيديو متمركز حول الذات للأشخاص مصورة من منظور الشخص الأول أثناء أداء الإجراءات المنزلية والتلاعبية.

  • المطور — Robbyant، قسم الروبوتيكا في Ant Group؛ حدث الإطلاق في 8 يوليو 2026
  • الرخصة — Apache 2.0، نقطة تفتيش النموذج مفتوحة للتحميل
  • حجم النموذج — 6 مليارات معامل (6B)
  • حجم بيانات التدريب المسبق — حوالي 60000 ساعة (50000 ساعة من مسارات الروبوتات عبر 20 تكوين روبوت + 10000 ساعة من الفيديو مع الأشخاص)
  • مساحة الإجراء الموحدة — 55 بُعداً لجميع أنواع الروبوتات

كيف يتحكم النموذج بروبوتات مختلفة

يحول LingBot-VLA 2.0 التحكم بأي روبوت إلى مساحة إجراء قانونية موحدة بـ 55 بُعداً تشمل الذراعين والقابضات الماهرة والخصر والرأس والمنصات المتحركة، يشرح MarkTechPost. يحل هذا النهج المشكلة الرئيسية للنماذج عبر الأجساد: في السابق، لكل بناء روبوت — مع أعداد مختلفة من المفاصل أو نوع القابض أو وجود قاعدة متحركة — كان عليك تدريب نموذج تحكم منفصل، ومساحة الإجراء الموحدة تسمح لنقطة التفتيش نفسها بالعمل عبر 20 تكوين.

تساعد وحدة الإجراء على مستوى الرمز المستندة إلى Mixture-of-Experts على توسيع نطاق النموذج دون فقدان الجودة، مما يتجاوز الحاجة إلى دالة خسارة مساعدة لموازنة الحمل بين الخبراء. هذا يسمح بزيادة سعة النموذج دون إضافة حد إضافي لدالة الخسارة، الذي عادة ما يبطئ ويعقد تدريب هذه البنى.

من أين يحصل النموذج على الهندسة والزمن

تضيف التقطير بالاستعلام المزدوج من نماذج LingBot-Depth و DINO-Video إشرافاً هندسياً وزمنياً، مما يساعد LingBot-VLA 2.0 على حساب حالة المشهد المستقبلية عند اختيار إجراء، وفقاً لـ MarkTechPost. بعبارة أخرى، يفهم النموذج مسبقاً كيف ستتغير هندسة المشهد وأوضاع الأشياء بعد تنفيذ الخطوة الحالية، بدلاً من مجرد الرد على إطار ثابت.

إلى أي مدى يتفوق LingBot-VLA 2.0 على المنافسين

على مجموعة الاختبار GM-100 لوكلاء الروبوتات الشاملة، تفوقت LingBot-VLA 2.0 على نموذج π0.5 والإصدار السابق LingBot-VLA-1.0 على كلا منصات الروبوتات المختبرة، وفقاً لـ MarkTechPost. الأداء المتفوقة على السلف والنموذج الجهة الثالثة π0.5 على نفس المعيار يؤكد أن التحسينات — مساحة الإجراء الموحدة ووحدة MoE والتقطير بالاستعلام المزدوج — توفر مكاسب في الجودة يمكن قياسها، وليس فقط زيادة العدد الإجمالي للمعاملات.

ما يعنيه هذا

نموذج مفتوح بـ 6 مليارات معامل يعمل بشكل متساوٍ عبر 20 تكوين روبوت مختلف يخفض حاجز الدخول للفرق التي تريد تدريب وكلاء روبوتات عالميين دون جمع مجموعات بيانات منفصلة لكل تصميم روبوت محدد.

أسئلة متكررة

ماذا تعني اختصار VLA في اسم النموذج؟

VLA تعني vision-language-action — النموذج يعالج الصورة والتعليمات النصية وينتج إجراء روبوت في خطوة واحدة.

هل يمكن استخدام LingBot-VLA 2.0 مجاناً؟

نعم، يتم إطلاق النموذج بموجب رخصة Apache 2.0، التي تسمح بالاستخدام الحر والتعديل والتطبيق التجاري لنقطة التفتيش، بما في ذلك التكامل في منتجات الروبوتيكا الملكية.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…