Changelog Update
Comprensión de video con agentes: Se lanzó la comprensión de video con agentes para Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite en las APIs de Interactions y GenerateContent. El modelo navega de forma dinámica por las líneas de tiempo de los videos y solicita transcripciones, fotogramas o pistas de audio según sea necesario. Este enfoque utiliza hasta un 88% menos de tokens para el contenido de formato largo en comparación con el procesamiento estático.
Para comenzar, consulta la guía Comprensión de video agentiva.