Saltar al contenido principal
EN VIVO
BTC: $76,584.06ETH: $2,380.00SOL: $98.12USD/BCV: 801.18 BsEUR/BCV: 929.09 BsBTC: $76,584.06ETH: $2,380.00SOL: $98.12USD/BCV: 801.18 BsEUR/BCV: 929.09 BsBTC: $76,584.06ETH: $2,380.00SOL: $98.12USD/BCV: 801.18 BsEUR/BCV: 929.09 BsBTC: $76,584.06ETH: $2,380.00SOL: $98.12USD/BCV: 801.18 BsEUR/BCV: 929.09 Bs
Inteligencia Artificial

Google Gemini añade análisis agéntico de video y reduce costos hasta un 66%

Añadir como fuente preferida en Google
Google Gemini añade análisis agéntico de video y reduce costos hasta un 66%

Google anunció el lanzamiento del análisis agéntico de video para sus modelos Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite, una función que permite escanear fragmentos específicos de un archivo en lugar de procesarlo de forma estática. Esta actualización reduce el consumo de tokens hasta en un 88% y disminuye los costos operativos hasta un 66%, al mismo tiempo que incrementa la precisión técnica en un 7%. El sistema ya se encuentra disponible para desarrolladores a través de la API de Gemini en Google AI Studio y en la plataforma Gemini Enterprise Agent Platform.

Cómo funciona el análisis agéntico de video en Gemini

A diferencia del procesamiento tradicional que analiza los clips a una tasa fija de fotogramas por segundo (por defecto 1 FPS), esta función utiliza las herramientas nativas del modelo para buscar, inspeccionar y reexaminar segmentos concretos a través de imágenes, audio y transcripciones. Esta integración técnica se conecta de forma directa con los avances mostrados previamente durante el lanzamiento de Google Gemini 3.7 Flash en el área de desarrollo con agentes.

Al asumir un rol activo guiado por un objetivo, la Inteligencia Artificial invoca bucles internos que cargan únicamente las partes relevantes del archivo de video. Esto elimina la necesidad de que los programadores configuren scripts manuales para recortar o filtrar el material multimedia.

Capacidades técnicas y casos de uso en producción

El uso de este sistema agéntico optimiza el procesamiento en videos de larga duración, como conferencias o grabaciones de varias horas, donde el análisis estático resultaba costoso o perdía detalles críticos. Entre las funciones principales que habilita destacan:

  • Búsqueda de precisión subsegundo: Identifica cambios de estado o cortes rápidos que suelen pasar desapercibidos en lecturas de 1 FPS.
  • Búsqueda de información específica: Responde consultas complejas en archivos de larga extensión sin consumir millones de tokens.
  • Detección de anomalías: Reexamina ventanas de tiempo a mayor velocidad de fotogramas para inspeccionar movimientos acelerados.
  • Conteo de objetos y acciones: Rastrea movimientos físicos repetitivos y objetos únicos a lo largo de la línea de tiempo.

Disponibilidad y despliegue comercial

El análisis agéntico de video no tiene un costo adicional sobre la tarifa estándar por token de la API de Gemini. Para activar la función, los usuarios solo deben ajustar el parámetro de procesamiento a «agentic» en la configuración de la API, según detallan Rohan Doshi y Mario Lučić de Google DeepMind en el comunicado oficial.

Google confirmó que esta tecnología también se integrará de forma progresiva en la aplicación de Gemini para los modelos Flash y Flash-Lite. Además, en los próximos meses impulsará la función ‘Ask YouTube’ en la página de visualización de videos de la plataforma.

Comunidad Arepa

Únete a nuestros canales principales

Comentarios

Relacionados

Ver más