Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
Google hat Gemini 3.8 Live, Gemini 3.8 Live Extended Thinking und Gemini 3.5 Transcribe über die Gemini API und Google AI Studio für Entwickler verfügbar gemacht. Die Modelle zielen auf die Entwicklung von Sprachagenten ab, die Gespräche weiterführen und Aufgaben ausführen können, sowie auf eine fehlerarme Umwandlung von Sprache in Text in mehr als 85 Sprachen.
Google hat eine Reihe von KI-Updates vorgestellt, die das Unternehmen im August 2026 angekündigt hatte – von Gemini 3.7 Flash und Gemini 3.5 Transcribe bis zur Integration von Gemini in die Pixel-11-Geräte sowie in Such- und Produktivitätstools. Das Unternehmen gibt an, dass die Gemini-App mehr als eine Milliarde monatliche Nutzer überschritten hat. Die Einsatzbereiche reichen inzwischen von Programmierung und Bildung über die Mediengenerierung bis hin zu Wettervorhersagen.
Google hat Gemini 3.5 Transcribe angekündigt, ein Modell zur Umwandlung von Sprache in Text, das auf Echtzeittranskription und aufgezeichnete Dateien abzielt und dabei Frequenzbereinigung, Textformatierung und Sprechererkennung unterstützt. Das Modell ist als öffentliche Vorschau über die Gemini API sowie Google-Plattformen für Entwickler und Unternehmen verfügbar und wird schrittweise in Google-Anwendungen integriert.