Google DeepMind 宣布在 Gemini 3.7 Flash、3.6 Flash 与 3.5 Flash-Lite 上线代理式视频理解:模型可按目标动态检索画面、音频与字幕,而不是固定帧率吞整段视频。官方称标准评测上最高可减 88% Token、约降 66% 分析成本,并提升最多约 7% 准确率;已通过 Gemini API、Google AI Studio 与 Enterprise Agent Platform 开放,按标准 Token 计价、无额外功能费。
核心要点速览 (Key Takeaways)
- ✓覆盖 Gemini 3.7 Flash / 3.6 Flash / 3.5 Flash-Lite,API 配置 processing=agentic 即可启用。
- ✓长视频分析:Token 最多省 88%,成本约降 66%,准确率最高约 +7%。
- ✓支持上传视频与 YouTube;亚秒级片段检索、异常检测与精确计数等能力面向开发者工具链。