Google, Gemini modellerine 'ajanssal video anlama' yeteneğini ekledi. Gemini 3.7 Flash, 3.6 Flash ve 3.5 Flash-Lite artık videoları kare kare bölmek yerine, hangi kısımların izleneceğini ve hangi hızda işleneceğini kendisi karar vererek analiz edebiliyor. Özellik şu an Gemini API ve Google AI Studio üzerinden sunuluyor.

Yeni yöntem token kullanımını %88'e kadar azaltıyor ve doğruluğu %7'ye kadar artırıyor. Gemini artık çok saatlik videolardaki saniyelik değişiklikleri tespit edebiliyor, fiziksel hareketleri sayıp takip edebiliyor, görsel artefaktları inceleyebiliyor ve ses, transkript ya da kareler arasında seçim yaparak karmaşık soruları yanıtlayabiliyor.

Özellik henüz Gemini uygulamasına ve YouTube'un 'Ask YouTube' fonksiyonuna entegre edilmedi; Google bu entegrasyonun 'yakında' geleceğini belirtiyor. Mevcut erişim yalnızca geliştiriciler ve kurumsal platform kullanıcıları için API üzerinden sağlanıyor.