Gemini lernt intelligentes Video-Sehen: 88 Prozent weniger Token-Verbrauch

Google Gemini analysiert Videos jetzt agentisch und spart bis zu 88 Prozent Token
7/10 The Decoder (DE) 02.09.2026 Agenten & Tool-Use Frontier-Modelle Produkt-Launch

Google hat für die Gemini-Modelle 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite eine neue agentische Videoanalysefunktion eingeführt. Statt Videos blind Bild für Bild zu verarbeiten, kann das Modell nun eigenständig entscheiden, welche Sequenzen es sich ansieht und in welcher Auflösung – ähnlich wie ein Mensch, der bei langen Videos schnell durchschaltet und nur bei interessanten Momenten genauer hinsieht. Das spart Google zufolge bis zu 88 Prozent Token ein und verbessert gleichzeitig die Genauigkeit, besonders bei stundenlangem Videomaterial. Ein wichtiger Schritt zu effizienteren KI-Systemen, die Ressourcen intelligenter einsetzen.

Zum Originalartikel