Google hat für die Gemini-Modelle 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite eine neue agentische Videoanalysefunktion eingeführt. Statt Videos blind Bild für Bild zu verarbeiten, kann das Modell nun eigenständig entscheiden, welche Sequenzen es sich ansieht und in welcher Auflösung – ähnlich wie ein Mensch, der bei langen Videos schnell durchschaltet und nur bei interessanten Momenten genauer hinsieht. Das spart Google zufolge bis zu 88 Prozent Token ein und verbessert gleichzeitig die Genauigkeit, besonders bei stundenlangem Videomaterial. Ein wichtiger Schritt zu effizienteren KI-Systemen, die Ressourcen intelligenter einsetzen.