Zurück zur Übersicht
Google kündigte am 24. Juni 2026 an, dass „computer use“ nun als eingebautes Tool in Gemini 3.5 Flash verfügbar ist. Das Modell kann Bildschirme erfassen, navigieren und Aktionen in Browser-, Mobil- und Desktop-Umgebungen ausführen.
Gemini 3.5 Flash unterstützt jetzt nativ die sogenannten Computer-Use-Funktionen, die zuvor als separates Gemini-2.5-Modell angeboten wurden. Google nennt als Einsatzgebiete unter anderem kontinuierliches Software-Testing und komplexe Wissensarbeiten, bei denen ein Agent mehrere Anwendungen steuern muss.
Die Funktion ist über die Gemini API und die Gemini Enterprise Agent Platform verfügbar. Google nennt zwei optionale Enterprise-Safeguards: explizite Nutzerbestätigung für kritische Aktionen und automatische Stopps bei erkannten Prompt-Injection-Risiken. Zudem weist Google auf Sandbox- und Zugriffskontrollen hin.
Externe Berichterstattung stellt fest, dass die Integration von Wahrnehmung und Aktion in ein Produktionsmodell den Aufwand für Modell-Routing verringern und Agent-Workflows vereinheitlichen kann, zugleich aber neue Anforderungen an Governance und Sicherheitsprüfungen stellt.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.
Weiterlesen