Geminiにおけるエージェンティックな動画理解 logo

Geminiにおけるエージェンティックな動画理解

より速く、よりスマートなGeminiのインサイトのためのエージェンティックな動画分析

掲載情報

HiCyou の掲載記録

掲載中
掲載先サイト
blog.google
掲載記録の作成日
2026/09/07
記録の最終更新
2026/09/08

掲載されている情報

  • 概要
  • 主な機能 6 件
  • ユースケース 3 件

このページは HiCyou の掲載記録を示すものであり、セキュリティ、所有権、または製品品質を認証するものではありません。

機密情報を共有したり購入したりする前に、外部サイトを確認してください。

Geminiにおけるエージェンティックな動画理解 preview

Geminiにおけるエージェンティックな動画理解とは

エージェンティックな動画理解(Agentic Video Understanding)は、GoogleのGeminiモデル(3.7 Flash、3.6 Flash、3.5 Flash-Liteを含む)向けの新しい処理モードであり、固定フレームレートで動画を処理するのではなく、モデルが何を・どの速度で・どのモダリティで視聴するかを動的に決定できるようにするものです。Googleによると、トークン使用量を最大88%削減し、コストを最大66%削減し、精度を最大7%向上させます。長尺動画で最も大きな効果が得られます。現在、AI StudioのGemini APIおよびGemini Enterprise Agent Platformを通じて、追加料金なしの標準価格で利用可能です。

主な機能

モデルが何を・どの速度で・どのモダリティで視聴するかを決定するエージェンティック処理モード
固定フレームレート処理と比較してトークン使用量を最大88%削減
動画分析のコストを最大66%削減
精度が最大7%向上、長尺動画で最大の効果
AI StudioのGemini APIおよびGemini Enterprise Agent Platform経由で利用可能
processingを「agentic」に設定することで有効化、追加料金なし

ユースケース

  • 長尺動画コンテンツをより効率的に分析する
  • 動画ベースのAIアプリケーションにおけるトークンとコストのオーバーヘッドを削減する
  • API経由でGemini Flashモデル上に動画対応機能を構築する

スタートアップにこのツールが必要な理由

動画対応のAI製品を構築するスタートアップは、料金プランを変更したり新たな費用を追加したりすることなく、特に長尺動画において、精度を向上させながら推論コストとトークン消費を大幅に削減できます。

よくある質問

Geminiにおけるエージェンティックな動画理解の代替ツール

OpenAI GPT-4o
Anthropic Claude
Twelve Labs