نموذج تضمين متعدد الوسائط من Google يربط النصوص والصور والصوت والفيديو والشيفرة ضمن فضاء تمثيل موحد، ومصمم للتشغيل المحلي على الأجهزة.
أعلنت Google عن EmbeddingGemma 2، وهو نموذج مفتوح بقدرات تضمين متعددة الوسائط للنصوص والصور والصوت والفيديو ضمن فضاء موحد، ومصمم للعمل محلياً على الأجهزة. يضم النموذج 740 مليون معامل، ويدعم سياقاً يصل إلى 8 آلاف رمز، مع إمكانات لتقليل استهلاك التخزين والذاكرة.