تقنيات

خبراء Google DeepMind يشرحون إمكانات نموذج Gemini Omni وما يحمّسهم بشأنه

تستعرض Google رؤية ثلاثة من أعضاء فريق DeepMind العاملين على Gemini Omni، وهو نموذج يتيح إنشاء المحتوى من أي مدخل. ويركز الإصدار الأول Gemini Omni Flash على إنشاء مقاطع الفيديو وتحريرها عبر محادثة.

13 أغسطس 2026
2 دقائق قراءة
خبراء Google DeepMind يشرحون إمكانات نموذج Gemini Omni وما يحمّسهم بشأنه

تسلّط Google الضوء على Gemini Omni، نموذجها الجديد الذي يتيح إنشاء محتوى متنوع انطلاقاً من أي نوع من المدخلات، مع تركيز الإصدار الأول Gemini Omni Flash على جعل إنشاء مقاطع الفيديو وتحريرها ممكناً عبر محادثة.

ولشرح رؤية النموذج وإمكاناته، أجرت الشركة مقابلة مع ثلاثة من أعضاء فريق Google DeepMind المشاركين في العمل عليه: عالم الأبحاث Mohammad Babaeizadeh، ومدير المنتجات Anish Nangia، ومهندسة الأبحاث Sarah Xu.

لماذا بدأ Omni بالفيديو؟

تحدث أعضاء الفريق عن الأسباب التي دفعتهم إلى البدء بإنشاء الفيديو، وشرحوا كيف يمكن للنموذج أن يكون مفيداً للمبدعين. ووفق المادة، يتيح Gemini Omni Flash إنشاء مقاطع الفيديو وتعديلها بطريقة تفاعلية تعتمد على المحادثة، بدلاً من الاقتصار على أدوات تحرير منفصلة.

إمكانات واسعة للمبدعين

خلال المقابلة، استعرض المشاركون أمثلة تخيلية على ما يمكن للنموذج فعله، مثل تغيير تسريحات شعرهم، أو تحويلهم إلى حيوانات الكسلان، أو إظهار قطة Sarah Xu على الطاولة أمامهم. وقال Mohammad Babaeizadeh إن إمكانات النموذج لا سقف لها.

كما أشار الفريق إلى أن Gemini Omni لا يزال في بداية تطوره. وقالت Sarah Xu إن النموذج سيواصل التحسن، فيما دعت Google إلى مشاهدة المقابلة الكاملة للتعرف إلى مزيد من التفاصيل حول Omni.

من نفس التصنيف

مقالات قد تهمك

عرض جميع المقالات