Gemini的88%视频令牌减少功能率先应用于3.7 Flash,而非3.8版本
摘要
谷歌对Gemini 3.7 Flash的更新引入了高达88%的视频令牌减少功能,显著降低成本,但准确性提升存在疑问。
谷歌于9月1日向Gemini 3.7 Flash、3.6 Flash和3.5 Flash-Lite推出了代理视频理解功能,随后于次日发布了3.8 Flash。大家都在讨论3.8及其吞吐量。但我认为这是错误的关注点。视频功能的改变才是真正影响资金的关键。该模型不再以固定速率采样每一帧,而是选择查看哪些片段,以及是否读取帧、音频或转录文本。谷歌声称在相同API定价下,令牌减少高达88%,成本降低高达66%。这将视频流审查从预算项目变成了几乎可以忽略不计的开支。我敢打赌,准确性声称是薄弱环节。一个选择跳过内容的模型应该会遗漏固定扫描能捕捉到的东西,而且'高达7%更高的准确性'并未说明在哪些方面。有人在已知内容的长视频上测试过这个功能吗?
相似文章
Gemini 3.5 Flash (Low)(1分钟阅读)
Google 推出了 Gemini 3.5 Flash (Low),这是一种新模型变体,在 SWE 任务上比旧版 Gemini 3 Flash (High) 表现更优,同时相比 Medium 版本使用的 token 减少了约 45%。他们还重置了所有付费计划的配额。
@Saboo_Shubham_: 使用 Gemini 3.7 Flash 的智能体视频理解意义重大。只需降低成本、减少令牌并提高准确性。没什么大不了的…
该推文强调,使用 Gemini 3.7 Flash 的智能体视频理解显著降低成本、减少令牌使用量并提高准确性。
Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber
Google 推出 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber 模型,提升了 token 效率、降低了延迟,并为智能体工作流带来更优性能。其中,3.6 Flash 减少了 17% 的输出 token 用量,并在编程和知识任务中表现出色。
谷歌表示其新Gemini 3.8 Flash模型'更努力工作'但可能成本更高
谷歌推出了Gemini 3.8 Flash,这是一款AI模型,执行更多推理步骤和工具迭代,提高了基准性能,但可能因更高的token使用量而增加成本。
Gemini 3.5 Flash在Artificial Analysis上的表现比其表面数据更糟
比较显示,Gemini 3.5 Flash在Artificial Analysis基准测试中得分略低于Gemini 3.1 Pro,且尽管每token API定价更低,但其总基准测试成本却更高。