标签
Google 的智能体视频理解能力正被三家公司利用,通过 Gemini Flash 模型在视频处理任务中降低成本并提升准确性。
Gemini 现已提供代理视频理解功能,支持迭代导航和自适应处理,以减少 token 使用和成本,同时提高视频分析的准确性。