Zurück zur Übersicht
Die neuen Modelle sollen während laufender Gespräche komplexe Aufgaben planen und externe Werkzeuge aufrufen. Damit verschiebt sich der Schwerpunkt von Sprachdialogen hin zur Steuerung mehrstufiger Prozesse.
Google hat am 15. September 2026 Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking vorgestellt. Die Modelle sollen Sprachagenten ermöglichen, während eines Gesprächs Aufgaben zu planen, externe Werkzeuge im Hintergrund aufzurufen und den Dialog ohne längere Unterbrechung fortzusetzen.
Neben Audio verarbeiten die Modelle Text, Bilder und Video. Die Variante Extended Thinking ist laut Google für mehrstufige Aufgaben ausgelegt und kann während der laufenden Sprachausgabe asynchrone Werkzeugaufrufe verarbeiten.
Verfügbar sind die Modelle unter anderem über die Gemini API, Google AI Studio, Google Cloud und die Gemini App. Die erweiterte Variante soll außerdem in Google Workspace zum Einsatz kommen. Die entscheidende Hürde liegt damit nicht mehr nur in der Qualität der Antworten, sondern in der zuverlässigen Steuerung laufender Prozesse.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.
Weiterlesen
Das neue KI-Modell erstellt globale Wetterprognosen im Stundentakt und erreicht laut Google bei wichtigen Bodenvariablen eine Auflösung von bis zu fünf Kilometern. Die Daten sollen unter anderem in Google Search, Gemini, Maps und Earth Engine einfließen.
Demis Hassabis konzentriert sich künftig auf die wissenschaftliche Strategie von Alphabet und die langfristige AGI-Forschung. Koray Kavukcuoglu übernimmt als Senior Vice President das Tagesgeschäft des KI-Labors.
Demis Hassabis gibt die operative Leitung von Google DeepMind an Koray Kavukcuoglu ab und wechselt in eine wissenschaftlichere Rolle. Gleichzeitig verlässt Googles Chefwissenschaftler Jeff Dean den Konzern nach 27 Jahren.
Die neue Modellfamilie soll Ganzkörpersteuerung, feinere Greifbewegungen und mehrstufige Aufgabenplanung ermöglichen. Teile der Systeme sind zunächst für Early Access vorgesehen.