Gemini Agentic Video 正式推出:影片分析 Token 最多降 88%,成本最高省 66%

約 5 分鐘閱讀 更新:2026.09.02

30 秒快速摘要

Google 於 2026 年 9 月 1 日推出 Gemini Agentic Video Understanding,支援 Gemini 3.7 Flash、3.6 Flash 與 3.5 Flash-Lite。官方測試顯示影片分析 Token 最多可減少 88%、成本最高降低 66%,準確度最高提升 7%。本文整理功能、原理、支援模型、適用情境與啟用方式。

更新日期:2026 年 9 月 2 日

Google 於 2026 年 9 月 1 日正式推出 Agentic Video Understanding。這項能力讓 Gemini 不再以固定影格率從頭到尾處理影片,而是根據問題主動搜尋、掃描與重新檢視真正需要的影片片段。Google 官方測試顯示,這種方式可讓影片分析的 Token 使用量最多降低 88%、成本最高降低 66%,同時讓準確度最高提升 7%。

30 秒快速摘要

  • 支援 Gemini 3.7 Flash、Gemini 3.6 Flash、Gemini 3.5 Flash-Lite。
  • 目前可透過 Gemini API,在 Google AI Studio 與 Gemini Enterprise Agent Platform 使用。
  • 支援影片上傳與 YouTube 影片。
  • Token 使用量最多降低 88%,分析成本最高降低 66%,準確度最高提升 7%。
  • 不另外收 Agentic Video 功能費,沿用標準 Gemini API Token 計價。
  • 未來也將逐步導入 Gemini App,並用於 YouTube 的 Ask YouTube 功能。

Gemini Agentic Video Understanding 是什麼?

傳統影片理解通常按照固定 FPS 取樣。Google 說明,Gemini 的新 Agentic Video Understanding 會依照使用者問題動態決定要看哪些時間區段、以什麼速度檢查,以及應該使用影格、音訊或逐字稿哪一種訊號。

換句話說,模型不必把整段長影片以相同密度處理,而能先搜尋可能相關的位置,再針對關鍵片段提高檢查密度。對數十分鐘到數小時的長影片尤其有意義。

支援哪些 Gemini 模型?

模型 Agentic Video 定位
Gemini 3.7 Flash 支援 官方測試中整體品質與成本效率最佳
Gemini 3.6 Flash 支援 高速影片理解
Gemini 3.5 Flash-Lite 支援 偏低成本、高效率處理

實際改善有多大?

依 Google 公布的標準影片分析 benchmark 結果,Agentic Video Understanding 可將 Token 消耗最多降低 88%、成本最高降低 66%,同時讓準確度最高提升 7%。這些是官方測試中的最高改善幅度,不代表所有影片與問題都會得到相同比例。

Google 特別指出,效益在長影片更明顯,例如 10 分鐘教學影片、90 分鐘課程甚至數小時錄影。過去固定取樣容易在成本與細節之間取捨;新的 agentic 方法則可以把運算集中在真正相關的時間區段。

Agentic Video 可以做什麼?

精準尋找瞬間事件

模型可以重新掃描短時間區段並提高取樣頻率,因此更適合尋找快速狀態改變、剪輯點或短暫事件。

長影片內容搜尋

面對數小時影片,Gemini 可以先定位與問題有關的區段,而不是讓整部影片都維持高密度處理。

異常偵測

當模型發現值得注意的時間窗口,可以重新以更高 FPS 檢查快速動作或細微視覺變化。

動作與物件計數

Google 展示的案例包括重新觀看高速動作,藉由不同取樣頻率提高重複動作與物件計數的準確度。

如何使用 Gemini Agentic Video?

目前開發者可以透過 Gemini API 使用,在影片輸入的 API 設定中將 processing 設為 agentic。Google 表示此功能可在 Google AI Studio 與 Gemini Enterprise Agent Platform 使用,並支援影片檔案及 YouTube 影片。

這項功能沒有額外的 Agentic Video 附加費,而是依使用模型採用標準 Gemini API Token 計價。因此真正的成本差異主要來自模型能否減少不必要的影片 Token 處理。

對 AI 影片工具市場有什麼影響?

這次更新和單純的 AI 影片生成不同,它瞄準的是「理解既有影片」。對需要大量處理課程、會議、監控影片、影音素材庫、體育影片或長篇 YouTube 內容的應用而言,成本下降可能比單純提高 benchmark 更重要。

如果你關注的是 AI 影片生成,可以延伸閱讀本站的 Runway AI 教學與費用Pika AI 評測,以及 Kaiber AI 評測

FAQ

Gemini Agentic Video 已經可以使用了嗎?

可以。Google 於 2026 年 9 月 1 日宣布開放開發者透過 Gemini API 使用,入口包括 Google AI Studio 與 Gemini Enterprise Agent Platform。

哪些模型支援 Agentic Video?

目前官方列出的模型包括 Gemini 3.7 Flash、3.6 Flash 與 3.5 Flash-Lite。

Agentic Video 需要另外付費嗎?

Google 表示不收額外功能費,使用標準 Gemini API Token 定價。

為什麼可以降低 Token?

因為模型不必以固定取樣率完整處理所有影片內容,而能根據任務動態搜尋、掃描並重新檢視相關片段。

一般 Gemini App 使用者可以用了嗎?

Google 表示將逐步把相關效率與品質改善帶到 Gemini App 的 Flash 與 Flash-Lite 模型,因此現階段應以官方實際帳號介面顯示為準。

延伸閱讀

官方來源

本文主要依據 Google 於 2026 年 9 月 1 日發布的「Introducing agentic video understanding with Gemini」官方公告與 Gemini 開發文件整理。數據為 Google 官方 benchmark 結果,實際成本與準確度會依影片、模型與任務而異。

Comments

No comments yet. Why don’t you start the discussion?

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *