Video-DeepResearch(Video-DR)将多模态智能体从静态图像扩展到连续视频流,提出解耦感知-探索流水线与分阶段工具解锁,以应对模态偏差和参数知识泄漏两大瓶颈。
查看原文:https://arxiv.org/abs/2608.03979
来源:HuggingFace Daily Papers(社区热门论文)
暂无数据
扫码关注
联系我们
回顶部
微信扫码分享