首页 > 计算机科学

别再让AI“只看不搜”,真正解决问题需要它自己去查资料

数据派THU 2026-01-28 17:00
文章摘要
背景:现有的多模态模型在视频问答任务中通常局限于视频内容本身,缺乏结合外部信息进行深度推理的能力,这与人类“观看-搜索-综合”的真实问题解决模式存在差距。研究目的:为了评估AI模型结合视频线索与网络搜索进行多跳推理的能力,研究团队推出了首个视频深度研究评测基准VideoDR,旨在推动能进行开放网络深度研究的智能视频代理的发展。结论:评测显示,Gemini-3-pro-preview和GPT-5.2等闭源模型表现领先,但“端到端”的代理模式并非万能,在长视频或复杂任务中易出现目标漂移和记忆衰退;工作流模式因具有显式中间文本作为外部记忆而展现出优势。未来的视频智能体需在保持长程视觉一致性上取得突破。
别再让AI“只看不搜”,真正解决问题需要它自己去查资料
本站注明稿件来源为其他媒体的文/图等稿件均为转载稿,本站转载出于非商业性的教育和科研之目的,并不意味着赞同其观点或证实其内容的真实性。如转载稿涉及版权等问题,请作者速来电或来函联系。
最新文章
别再让AI“只看不搜”,真正解决问题需要它自己去查资料
别再让AI“只看不搜”,真正解决问题需要它自己去查资料
来源:新智元本文约1000字,建议阅读5分钟本文介绍了首个视频深度研究评测基准VideoDR,评测AI结合视频与网络搜索进行多跳推理的能力。[ 导读 ] 现有的多模态模型往往被困在「视频」的孤岛里——
11小时前
祝贺 | Apache IoTDB 入选2025年度国家重点研发计划高新技术成果产业化试点名单
祝贺 | Apache IoTDB 入选2025年度国家重点研发计划高新技术成果产业化试点名单
导读工业和信息化部近日公布2025年度国家重点研发计划高新技术成果产业化试点名单,包含67个试点成果和108个试点单位。本批试点实施周期为自名单公布之日起两年。各试点单位要及时完善试点实施方案,按照方
11小时前
大数据能力提升项目|学生成果展系列之四
大数据能力提升项目|学生成果展系列之四
导读为了发挥清华大学多学科优势,搭建跨学科交叉融合平台,创新跨学科交叉培养模式,培养具有大数据思维和应用创新的“π”型人才,由清华大学研究生院、清华大学大数据研究中心及相关院系共同设计组织的“清华大学
2026-01-27
RAG 检索模型如何学习:三种损失函数的机制解析
RAG 检索模型如何学习:三种损失函数的机制解析
来源:DeepHub IMBA本文约1000字,建议阅读5分钟哪种方法最好?要看具体场景、数据量和算力。Agent 系统发展得这么快那么检索模型还重要吗?RAG 本身都已经衍生出 Agentic RA
2026-01-27
Book学术官方微信
Book学术文献互助
Book学术文献互助群
群 号:604180095
Book学术
文献互助 智能选刊 最新文献 互助须知 联系我们:info@booksci.cn
Book学术提供免费学术资源搜索服务,方便国内外学者检索中英文文献。致力于提供最便捷和优质的服务体验。
Copyright © 2023 Book学术 All rights reserved.
ghs 京公网安备 11010802042870号 京ICP备2023020795号-1