نموذج من Google لتحويل الكلام إلى نص للنسخ الفوري والتسجيلات، مع دعم تنسيق النص والتعرف إلى المتحدثين والطوابع الزمنية.
أعلنت Google إتاحة Gemini 3.8 Live وGemini 3.8 Live Extended Thinking وGemini 3.5 Transcribe للمطورين عبر Gemini API وGoogle AI Studio. تستهدف النماذج بناء وكلاء صوتيين قادرين على متابعة الحوار وتنفيذ المهام، إلى جانب تحويل الكلام إلى نص بأخطاء منخفضة عبر أكثر من 85 لغة.
استعرضت Google مجموعة من تحديثات الذكاء الاصطناعي التي أعلنتها خلال أغسطس 2026، بدءاً من Gemini 3.7 Flash وGemini 3.5 Transcribe، وصولاً إلى دمج Gemini في أجهزة Pixel 11 وأدوات البحث والإنتاجية. وتقول الشركة إن تطبيق Gemini تجاوز مليار مستخدم شهرياً، مع توسع الاستخدامات لتشمل البرمجة والتعليم وتوليد الوسائط والتنبؤات الجوية.
أعلنت Google عن Gemini 3.5 Transcribe، وهو نموذج لتحويل الكلام إلى نص يستهدف النسخ الفوري والملفات المسجلة مع معالجة الترددات، وتنسيق النص، والتعرف إلى المتحدثين. يتوفر النموذج في معاينة عامة عبر Gemini API ومنصات Google للمطورين والمؤسسات، مع دمجه تدريجياً في تطبيقات Google.