グーグルはGeminiインテリジェンスのビデオ理解機能を発表しました:最大で88%のトークン消費を削減可能です。
Google DeepMindは、Geminiのインテリジェントエージェントのビデオ理解機能を発表しました。この機能は、Gemini 3.7 Flash、3.6 Flash、および3.5 Flash-Liteモデル向けに公開されています。この機能により、動的検索、スキャン、およびビデオクリップの検査を通じて、長いビデオの分析効率と正確性が向上します。
従来の固定フレームレート処理方式と比較して、最大で88%のトークン消費を削減し、分析コストを66%低下させ、最大7%の正確性を向上させることができます。この機能は現在、Gemini APIを通じてGoogle AI StudioおよびGemini Enterprise Agent Platformで提供されており、今後はGeminiアプリケーションやYouTubeの「Ask YouTube」機能にも適用される予定です。
関連タグ






