Следите за последними материалами, объяснениями и связанными технологическими историями.
Google объявила о двух новых моделях преобразования текста в речь, которые позволяют создавать пользовательские голоса, управлять подачей построчно и создавать многоголосые диалоги более чем на 100 языках. Gemini 3.8 Flash TTS доступна разработчикам через Gemini API и Google AI Studio, тогда как Flash-Lite ориентирована на широкомасштабные аудиоприложения.