المصطلحات

Vision-Language-Action Model

نموذج يجمع بين الرؤية واللغة والفعل، ويمكن استخدام مخرجات نموذج الأفعال الكامنة في تطويره.

أحدث التغطيات

CN
Destro AI تجمع 8 ملايين دولار لبناء طبقة تنسّق الروبوتات والعمال في المستودعات

Destro AI تجمع 8 ملايين دولار لبناء طبقة تنسّق الروبوتات والعمال في المستودعات

خرجت Destro AI من وضع التخفي بجولة تمويل أولية قدرها 8 ملايين دولار، بعد تطوير نظامي Vision وMothership لتنسيق الروبوتات والعاملين والشاحنات في عمليات المناولة اللوجستية. وتوسّع الشركة تجربة أولية مع Yusen Logistics إلى 26 روبوتاً، مع تجربة أخرى تضم 17 روبوتاً في جنوب كاليفورنيا.

CN
برنامج GENIAC الياباني يوسّع تمويل نماذج الذكاء الاصطناعي للروبوتات

برنامج GENIAC الياباني يوسّع تمويل نماذج الذكاء الاصطناعي للروبوتات

أعلن برنامج GENIAC الياباني المدعوم من وزارة الاقتصاد والصناعة وNEDO عن نتائج وتمويل مشروعات لتطوير نماذج أساسية للروبوتات وبناء منظومة بيانات للذكاء الاصطناعي المتجسد. وتشمل المبادرات 13 جهة في مجال نماذج الروبوتات وتسع جهات في مشروع منظومة البيانات.

CN
هل يصبح نموذج السلوك الكبير LBM البنية الأساسية التالية للقيادة الذاتية؟

هل يصبح نموذج السلوك الكبير LBM البنية الأساسية التالية للقيادة الذاتية؟

تستعرض MONOist انتقال الاهتمام في الذكاء الاصطناعي للروبوتات والمركبات ذاتية القيادة من نماذج VLA إلى نموذج السلوك الكبير LBM، الذي يركز على توليد السلوك مباشرة في العالم المادي. وتبرز Toyota Research Institute وXPeng كأمثلة على توظيف هذا الاتجاه، مع بقاء جدواه العملية الواسعة قيد الاختبار.

CN
Ricoh تطور تقنية Physical AI لتعليم الروبوتات من صور أفعال البشر

Ricoh تطور تقنية Physical AI لتعليم الروبوتات من صور أفعال البشر

أعلنت Ricoh تطوير تقنية تعتمد على نموذج Latent Action Model لتعليم الروبوتات أفعالاً مثل الإمساك بالأشياء وتحريكها من بيانات الصور والفيديو، من دون الاعتماد الكامل على بنية روبوت محددة. واختبرت الشركة التقنية في بيئة محاكاة مبنية على ظروف مادية، مستفيدة من خدمات AWS لتقليل كلفة جمع البيانات وتدريب النماذج.