Gemini API:更新日志·· 2026-09-01精选AI 评分61
Gemini API 为 Gemini 3.7 Flash 等模型推出 Agentic 视频理解
September 1, 2026
AI 导读
Gemini API 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出 Agentic 视频理解,覆盖 Interactions 和 GenerateContent 两个 API。模型可动态导航视频时间线,按需请求转写、帧或音频轨,长视频内容相比静态处理最多节省 88% 的 token。
推荐理由
官方说明动态按需取用转写、帧和音频的机制,读者可据此评估长视频处理的 token 成本变化。
正文 · AI 翻译
智能体视频理解:为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 在 Interactions 和 GenerateContent API 上发布了智能体视频理解功能。该模型可动态浏览视频时间线,按需请求转录文本、帧或音轨。与静态处理相比,这种方法对长内容使用的 token 最多减少 88%。
要开始使用,请参阅 智能体视频理解指南。
来源:Gemini API:更新日志 · ai.google.dev