نمط تفاعل صوتي يعالج فيه النظام الكلام ويرد صوتياً مباشرة بدلاً من الاعتماد على سلسلة منفصلة لتحويل الكلام إلى نص ثم توليد الصوت.
أعلنت Google إتاحة Gemini 3.8 Live وGemini 3.8 Live Extended Thinking وGemini 3.5 Transcribe للمطورين عبر Gemini API وGoogle AI Studio. تستهدف النماذج بناء وكلاء صوتيين قادرين على متابعة الحوار وتنفيذ المهام، إلى جانب تحويل الكلام إلى نص بأخطاء منخفضة عبر أكثر من 85 لغة.