Gemini 推出智能体视频理解,Token 消耗最多降 88%

指南2026年9月1日5 分钟阅读
Gemini 推出智能体视频理解,Token 消耗最多降 88%
Google DeepMind 今日发布智能体视频理解(Agentic Video Understanding),在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中上线。与传统的固定帧率处理不同,该功能通过动态搜索和扫描视频片段,将分析成本降低最高 66%,Token 消耗减少最高 88%,同时准确率提升最多 7%。
本文编译自 Introducing agentic video understanding with Gemini,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

在 macOS 上,让 coding agent(如 ChatGPT Codex)使用 Blender 非常简单:装好官方应用,用自然语言下达指令,模型就能通过 Blender 的 Python API 生成可编辑的场景、渲染图像,甚至输出电影短片。

指南Simon Willison·9月5日·1 分钟

Cloudflare 宣布邀请制新服务 Vulnerability Discovery and Remediation,通过结合生产流量和安全信号,优先排序漏洞,并自动建议代码补丁和 WAF 自定义规则,帮助团队先修复最关键威胁。该服务利用 OpenAI Daybreak 模型(GPT-5.6 Cyber)进行侦察和验证,但一切由客户决定是否实施。

指南·9月3日·6 分钟

评论