Noticias, guías y tendencias en tecnología
Análisis agéntico en Gemini: Google optimiza la comprensión de video y reduce el uso de tokens
Inteligencia Artificial

🚨 Google Gemini mejora análisis de video con modo agéntico que reduce costos y tokens

2 de septiembre de 2026 • • 2 min de lectura

En SmartBytes analizamos las claves de esta novedad tecnológica.


Google ha introducido una innovadora función de análisis agéntico de video en sus modelos Gemini 3.5, 3.6 y 3.7 Flash, diseñada para optimizar la comprensión de contenido audiovisual y minimizar el consumo de tokens durante el procesamiento. A diferencia del método tradicional que analiza videos extrayendo fotogramas a una frecuencia fija, esta tecnología permite que la IA navegue dinámicamente por la línea de tiempo del video, seleccionando solo los fragmentos relevantes para responder consultas específicas.

Este enfoque adaptable permite ajustar la frecuencia de muestreo y la resolución en tiempo real, así como seleccionar selectivamente entre fotogramas, audio o transcripciones según la naturaleza de la pregunta. De esta manera, se reducen significativamente los recursos computacionales y los costos asociados, especialmente en videos de larga duración donde analizar todo el contenido sería ineficiente y costoso.

Google reporta que esta modalidad puede disminuir hasta un 88 % el consumo de tokens y reducir costos hasta un 66 %, además de mejorar la precisión en las respuestas hasta en un 7 %. Aunque estas cifras provienen de pruebas internas, representan una mejora sustancial para aplicaciones que demandan análisis detallados de videos extensos, como la detección de eventos específicos, conteo de objetos o el estudio de reuniones y tutoriales.

La función está disponible para desarrolladores a través de la API de Gemini en Google AI Studio y en la plataforma Gemini Enterprise Agent, aunque actualmente se encuentra en versión preliminar y desactivada por defecto. Su uso no implica cargos adicionales más allá de la tarifa estándar por tokens. Además, Google planea integrar esta capacidad próximamente en la aplicación Gemini y en la función Ask YouTube, ampliando así su accesibilidad para usuarios y empresas.

Este avance representa un paso importante en el procesamiento inteligente de video, facilitando análisis más económicos y precisos, lo que puede beneficiar a sectores que manejan grandes volúmenes de contenido audiovisual y requieren respuestas rápidas y específicas.