أعلنت World Labs عن Atlas، وهو نموذج جديد تصفه الشركة بأنه «نموذج عالمي» للذكاء المكاني. يجمع Atlas النصوص والصور والفيديو وبيانات ثلاثية الأبعاد ضمن بنية واحدة، بهدف فهم العلاقات المكانية بين العناصر بدلاً من الاكتفاء بإنتاج صور أو مقاطع فيديو منفصلة.
تشارك Fei-Fei Li، الباحثة في الذكاء الاصطناعي، في تأسيس World Labs التي أُنشئت عام 2024 للتركيز على تمكين أنظمة الذكاء الاصطناعي من فهم العالم الفيزيائي والعلاقات ثلاثية الأبعاد. وتقول الشركة إن Atlas دُرّب مسبقاً من الصفر، ويعتمد تقنياً على بنية تجمع بين نموذج انتشاري ذاتي الانحدار ومتعدد الوسائط ومحوّل (Transformer).
ما الذي يقدمه Atlas؟
يستطيع النموذج دمج أنواع مختلفة من المدخلات في سياق مكاني مشترك، ما يتيح له تقدير الأجزاء غير المرئية من المشهد بالاستناد إلى البنية ثلاثية الأبعاد للأجسام والبيئات. ومن أبرز خصائصه التعامل مع موقع الكاميرا ومسار حركتها كمدخلات مباشرة، بدلاً من الاكتفاء بوصف حركة الكاميرا عبر أوامر نصية.
وبالاستناد إلى صورة مرجعية واحدة إلى ست صور ومسارات كاميرا محددة مسبقاً، يمكن لـAtlas إنشاء فيديو بدقة 1440p وبمدة تصل إلى دقيقة واحدة. كما يمكنه تقدير شكل جسم أو بيئة من زوايا مختلفة انطلاقاً من صورة واحدة، وتوسيع المشهد ليشمل أجزاء غير ظاهرة في الصورة الأصلية. وتتيح الأداة كذلك وضع صور غير مترابطة في مواقعها ضمن فضاء ثلاثي الأبعاد وإنشاء انتقالات بينها داخل بيئة واحدة.
إعادة بناء العالم الحقيقي
تقول World Labs إن Atlas يمكن استخدامه لإعادة بناء مساحات حقيقية بصيغة ثلاثية الأبعاد. وقد تكفي صورتان أو ثلاث صور لإعادة إنشاء كثير من المشاهد، بينما يؤدي توفير عشرات الصور أو أكثر من مئة صورة إلى تقليل الحاجة لتخمين المناطق غير المرئية وزيادة قرب النتيجة من البيئة الأصلية.
ولا تقتصر المخرجات على الصور والفيديو؛ إذ يستطيع النموذج إنتاج سحب نقاط ثلاثية الأبعاد وملفات بصيغة «3D Gaussian splat»، وهي مخرجات يمكن توظيفها في الألعاب والتصميم والمؤثرات البصرية والروبوتات.
المحاكاة الروبوتية والقيود الحالية
يمكن أيضاً استخدام تسجيلات هاتفية لبيئة حقيقية لإنشاء محاكاة ثلاثية الأبعاد، ثم توليد البيانات التي قد تراها كاميرات روبوت افتراضي ومستشعرات العمق أثناء الحركة. وتسمح المحاكاة بتغيير مواقع الأجسام والإضاءة والخلفية وحركة الروبوت لإنشاء سيناريوهات متعددة للتدريب والاختبار.
لماذا يهم هذا الإعلان؟ يربط Atlas بين توليد المحتوى وفهم المكان والمحاكاة، ما يجعله أقرب إلى أداة لبناء بيئات قابلة للاستكشاف والاستخدام في أنظمة الروبوتات، لا مجرد نموذج لتوليد الفيديو. وتقول World Labs إن النموذج سيشكل أساس منصة Marble لإنشاء العوالم ثلاثية الأبعاد ومنتجات أخرى للشركة.
مع ذلك، لا يزال Atlas في مرحلة وصول مبكر لشركاء مختارين. ولم تكشف الشركة عن السعر أو موعد الإتاحة العامة أو حجم النموذج أو القدرة الحاسوبية المستخدمة في تدريبه. كما أن ادعاء تفوقه في إعادة البناء ثلاثي الأبعاد من صور متفرقة على بعض النماذج مفتوحة المصدر المتخصصة يستند إلى اختبارات الشركة ولم يتحقق منه باحثون مستقلون بعد.
وكانت World Labs قد جمعت في فبراير 2026 تمويلاً بقيمة مليار دولار بمشاركة AMD وAutodesk وNvidia وFidelity ومستثمرين آخرين، ليرتفع إجمالي تمويلها إلى نحو 1.23 مليار دولار.
كيف أعددنا هذا الخبر؟
اعتمد الخبر على المصدر الأصلي الموضح أعلاه. قد نستخدم أدوات آلية للمساعدة في الاستخراج والتصنيف والصياغة،
لكن النشر يخضع لقواعد تمنع المحتوى المكرر والقصير أو الروتيني منخفض القيمة.
اقرأ سياستنا التحريرية.