Compréhension agentique de la vidéo dans Gemini logo

Compréhension agentique de la vidéo dans Gemini

Analyse vidéo agentique pour des insights Gemini plus rapides et plus intelligents

Informations de la fiche

Fiche d’annuaire HiCyou

Répertorié
Site web répertorié
blog.google
Fiche d’annuaire créée
7 sept. 2026
Dernière mise à jour de la fiche
8 sept. 2026

Informations incluses dans la fiche

  • Présentation
  • 6 fonctionnalités clés
  • 3 cas d’usage

Cette page décrit la fiche d’annuaire HiCyou. Elle ne constitue pas une certification de sécurité, de propriété ou de qualité du produit.

Vérifiez le site externe avant de partager des informations sensibles ou d’effectuer un achat.

Compréhension agentique de la vidéo dans Gemini preview

Qu'est-ce que Compréhension agentique de la vidéo dans Gemini

La compréhension agentique de la vidéo est un nouveau mode de traitement pour les modèles Gemini de Google (notamment 3.7 Flash, 3.6 Flash et 3.5 Flash-Lite) qui permet au modèle de décider dynamiquement quoi regarder, à quelle vitesse et via quelle modalité, plutôt que de traiter la vidéo à une fréquence d'images fixe. Selon Google, elle réduit la consommation de tokens jusqu'à 88 %, diminue les coûts jusqu'à 66 % et améliore la précision jusqu'à 7 %, avec les plus grands gains sur les vidéos longues. Elle est disponible dès maintenant via l'API Gemini dans AI Studio et la Gemini Enterprise Agent Platform au tarif standard, sans frais supplémentaires.

Fonctionnalités clés

Mode de traitement agentique où le modèle décide quoi regarder, à quelle vitesse et via quelle modalité
Jusqu'à 88 % de réduction de la consommation de tokens par rapport au traitement à fréquence d'images fixe
Jusqu'à 66 % de réduction des coûts sur l'analyse vidéo
Jusqu'à 7 % d'amélioration de la précision, avec les plus grands gains sur les vidéos longues
Disponible via l'API Gemini dans AI Studio et la Gemini Enterprise Agent Platform
Activé en définissant le traitement sur « agentic », sans frais supplémentaires

Cas d'utilisation

  • Analyser plus efficacement du contenu vidéo de longue durée
  • Réduire la surcharge de tokens et de coûts pour les applications d'IA basées sur la vidéo
  • Créer des fonctionnalités sensibles à la vidéo sur les modèles Gemini Flash via l'API

Pourquoi les startups ont-elles besoin de cet outil ?

Les startups qui développent des produits d'IA capables d'analyser la vidéo peuvent réduire considérablement les coûts d'inférence et la consommation de tokens tout en améliorant la précision, en particulier sur les vidéos longues, sans changer de palier tarifaire ni ajouter de nouveaux frais.

Questions fréquentes

Alternatives à Compréhension agentique de la vidéo dans Gemini

OpenAI GPT-4o
Anthropic Claude
Twelve Labs