Anzeige
Skip to content

Gemini 3.5 Flash kann jetzt Computer, Browser und Smartphones selbstständig steuern

Google hat die Funktion "Computer Use" direkt in Gemini 3.5 Flash integriert. Damit kann das KI-Modell Computer, Browser und mobile Geräte eigenständig bedienen, also sehen, verstehen und Aktionen ausführen. Zuvor war diese Fähigkeit nur als separates Gemini-2.5-Modell verfügbar.

Gemini 3.5 Flash beherrscht bereits Funktionsaufrufe sowie eingebaute Tools wie Suche und Maps. Mit der nativen Computer-Use-Fähigkeit können Entwickler laut Google nun Agenten bauen, die über Browser-, Mobil- und Desktop-Umgebungen hinweg agieren, etwa für kontinuierliches Software-Testing oder Wissensarbeit.

Im OSWorld-Benchmark erreicht Gemini 3.5 Flash einen Wert von 78,4 und übertrifft damit das Vorgängermodell Gemini 3 Flash (65,1) sowie GPT-5.4 mini (72,1). Knapp dahinter liegt GPT-5.5 mit 78,7, während Anthropics Opus 4.8 mit 83,4 den Spitzenwert hält.

Gegen Prompt-Injection-Angriffe setzt Google auf spezielles Training und zwei optionale Sicherheitssysteme, die etwa bei kritischen Aktionen eine Nutzerbestätigung verlangen. Die Funktion ist über die Gemini API und die Gemini Enterprise Agent Platform verfügbar. Eine Demo-Umgebung und eine Referenz-Implementierung stehen bereit.

Anzeige
DEC_D_Incontent-1

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.

Quelle: Google