视频理解
-
Gemini系列新增智能体视频理解,视频分析从识别走向主动执行
谷歌在Gemini 3.7 Flash等模型中上线智能体视频理解功能,模型可主动搜索视觉帧、音频和转录文本,Token消耗最多降低88%,分析成本最多下降66%,准确率最高提升7%,且不额外收费,支持亚秒级检索、长视频搜索、异常检测等能力。
谷歌在Gemini 3.7 Flash等模型中上线智能体视频理解功能,模型可主动搜索视觉帧、音频和转录文本,Token消耗最多降低88%,分析成本最多下降66%,准确率最高提升7%,且不额外收费,支持亚秒级检索、长视频搜索、异常检测等能力。