AI Insight Hub
图片转PPT
Image2PPT
图片转PPT神器
首页
分类
关于
管理后台
首页
分类
关于
管理后台
来源:ArXiv AI
2026-08-03 04:00
翻译成中文
ViSAGE:为长格式视频理解构建自我纠正记忆
记忆
ViSAGE
代理
实体
构建
arXiv:2607.28678v1 公告类型:新 摘要:在长视野环境中运行的多模式代理必须构建并不断更新多媒体存储器,以支持实体一致、基于时间的推理。然而,现有的代理记忆方法经常在积极的压缩和分段处理下丢弃细粒度的身份线索。他们还严重依赖向量相似性检索,这可以显示语义相关但身份不匹配的证据,导致实体混乱、错误传播和幻觉答案。 我们提出了 ViSAGE,一种多模式代理记忆框架,可构建自我纠正、以实体为中心的记忆。具体来说,ViSAGE 通过长时间范围内的跨模式绑定来锚定实体身份。然后,它应用双向记忆细化来传播延迟的身份证据,追溯统一历史记录并改进未来推理。我们还引入多代理交叉验证来评估在身份证据对齐约束下检索到的证据,从而在证据缺失时启用弃权而不是不受支持的答案。大量结果表明,ViSAGE 始终优于最强的基线,准确率提高了 5.9%。
查看原始链接
相关文章推荐
特朗普的人工智能保护主义针对机器人
2026-08-03
从几周到几分钟:Formula 1® 如何使用 AWS 上的代理 AI 来加速数据运营
2026-08-03
Amazon Bedrock 中的自动推理策略细化
2026-08-03
返回首页