Suivez les dernières actualités, explications et histoires technologiques associées.
Google a annoncé la mise à disposition de Gemini 3.8 Live, Gemini 3.8 Live Extended Thinking et Gemini 3.5 Transcribe pour les développeurs via Gemini API et Google AI Studio. Ces modèles visent à créer des agents vocaux capables de suivre la conversation et d’exécuter des tâches, ainsi qu’à convertir la parole en texte avec un faible taux d’erreur dans plus de 85 langues.
Google a présenté un ensemble de mises à jour de l’intelligence artificielle annoncées en août 2026, de Gemini 3.7 Flash et Gemini 3.5 Transcribe à l’intégration de Gemini dans les appareils Pixel 11 ainsi que dans les outils de recherche et de productivité. L’entreprise affirme que l’application Gemini a dépassé le milliard d’utilisateurs mensuels, tandis que ses usages s’étendent à la programmation, à l’éducation, à la génération de médias et aux prévisions météorologiques.
Google a annoncé Gemini 3.5 Transcribe, un modèle de conversion de la parole en texte destiné à la transcription instantanée et aux fichiers enregistrés, avec traitement des hésitations, mise en forme du texte et identification des locuteurs. Le modèle est disponible en aperçu public via Gemini API et les plateformes Google pour les développeurs et les entreprises, avec une intégration progressive dans les applications Google.