Google hat eine Übersicht der wichtigsten KI-Ankündigungen veröffentlicht, die das Unternehmen im August 2026 vorgestellt hatte. Die Zusammenstellung umfasst neue Modelle, Verbrauchergeräte sowie Tools für Studierende, Entwickler und Forschende. Dies steht im Einklang mit dem Bestreben des Unternehmens, Gemini von einem Konversationsassistenten zu einer integrierten Ebene in Geräten, der Suche und Arbeitswerkzeugen weiterzuentwickeln.
Kostengünstigere Modelle und präzisere Sprachaufgaben
Google hat die Einführung von Gemini 3.7 Flash angekündigt, einem Modell, das auf Programmierung, den Aufbau von Softwareagenten, Wissens-Workflows und Webentwicklung ausgerichtet ist. Nach Angaben des Unternehmens erschien das Modell nur drei Wochen nach Gemini 3.6 Flash, bei einem Einführungspreis von der Hälfte der Kosten des Vorgängermodells pro eine Million Token. Dieser Punkt ist für Entwickler wichtig, die zwischen Modellqualität und den Betriebskosten wiederkehrender Aufgaben abwägen. Der Artikel liefert jedoch keine unabhängigen Vergleichszahlen zur Leistung und keine vollständigen Angaben zur Dauer des Einführungspreises.
Google stellte außerdem Gemini 3.5 Transcribe vor, ein Modell zur Echtzeit-Umwandlung von Sprache in Text, das auf Sprachagenten, Live-Untertitel und Analysen nach Gesprächen abzielt. Nach Angaben des Unternehmens kommt das Modell mit Störgeräuschen und Fachbegriffen zurecht, indem es Roh-Audio in einen genaueren und kontextsensibleren Text umwandelt.
Gemini zieht in Geräte und Arbeitswerkzeuge ein
Auf der Veranstaltung Made by Google 2026 stellte das Unternehmen Pixel 11, Pixel 11 Pro, Pixel 11 Pro XL und Pixel 11 Pro Fold vor. Die Geräte enthalten den Chip Google Tensor G6, der das neueste Modell Gemini Nano ausführt, sowie Verbesserungen bei Kameras und Robustheit. Google zufolge wurde die Serie entwickelt, um das bereitzustellen, was das Unternehmen „Gemini Intelligence“ nennt – eine persönliche Assistenz, die in das Smartphone-Erlebnis integriert ist.
In Gemini Live hat Google Tools wie Personal Intelligence, Daily Brief, Spark und die freihändige Verwaltung des E-Mail-Postfachs hinzugefügt. In der Praxis spiegeln diese Ergänzungen den Übergang der Anwendung von der Beantwortung von Fragen zur Ausführung oder Organisation alltäglicher Aufgaben wider. Die Verfügbarkeit der Funktionen bleibt jedoch je nach Land, Sprache und Abonnement unterschiedlich.
Bildung und Mediengenerierung
Google erklärte, dass das Unternehmen weltweit berechtigten Studierenden ein Jahr lang kostenlos den Google-AI-Tarif anbietet, außerdem ein Studierendenzentrum und Tools für Lehrkräfte sowie eine Funktion zur Vorbereitung auf den SAT. Die Suche wurde um KI-gestützte Bildungsfunktionen erweitert, darunter interaktive visuelle Erklärungen, die Erstellung von Übungstests für SAT, ACT, GRE und LSAT, schrittweises Lernen über Lens sowie die Organisation von Inhalten in Notizbüchern.
Das Unternehmen kündigte außerdem Gemini Omni 1.1 Flash zur Videogenerierung mit umfassenderer Steuerung an, einschließlich der Verlängerung von Szenen, der Interpolation zwischen dem ersten und letzten Einzelbild, der Hochskalierung auf 4K-Auflösung und einer Beschleunigung der Prototypenerstellung. Das Modell ist in Google Flow, Google AI Studio, der Google AI Studio und Gemini Enterprise Agent Platform sowie in der Gemini-App verfügbar.
Von einer Milliarde Nutzern zu wissenschaftlichen Anwendungen
Google zufolge hat die Gemini-App mehr als eine Milliarde monatliche Nutzer überschritten. 63 % der Nutzer sprechen direkt mit ihr, während die Anwendung täglich mehr als 150 Millionen Bilder erzeugt. Das Unternehmen erklärt außerdem, dass kleine Unternehmen Tools zur Erstellung von Bildern, Videos und Audio verwenden, um Marketingmaterial zu produzieren.
Außerhalb der Verbraucherprodukte verwies Google auf mehr als eine Milliarde Downloads der Open-Source-Modelle von Gemma. Die Einsatzbereiche reichen von Smartphones und Edge-Infrastrukturen bis zum Weltraum. Außerdem stellte das Unternehmen das Projekt Operation Blue Skies vor, das gemeinsam mit der britischen Regierung und der Luftfahrtbranche umgesetzt wird, um Vorhersagen zur Anpassung von Flugrouten und zur Vermeidung der Entstehung von Kondensstreifen einzusetzen. Im Klimabereich erklärte das Unternehmen, eine Veröffentlichung in Nature habe die Fähigkeit von WeatherNext 2 gezeigt, Flugbahnen und Intensität von Hurrikanen sowie die Windstruktur vorherzusagen. Zudem kündigte Google an, das Modell Forschenden als Open Source zugänglich zu machen.
Warum ist diese Nachricht wichtig?
Diese Übersicht zeigt, dass sich der Wettbewerb nicht nur um ein einzelnes Modell dreht, sondern auch um die Senkung der Nutzungskosten, die Verbindung von KI mit Geräten und Diensten sowie ihre Ausweitung auf Bildung, Medien und Wissenschaft. Die meisten genannten Zahlen und Ergebnisse stammen jedoch von Google selbst. Außerdem unterscheidet sich die Verfügbarkeit der Funktionen je nach Land, Sprache und Alter; einige Funktionen können ein Abonnement oder höhere Nutzungslimits erfordern. Daher müssen unabhängige Vergleiche und tatsächliche Leistungstests gesondert geprüft werden.