R-C2: Cycle-Consistent Reinforcement Learning Improves Multimodal Reasoning
R-C2:循环一致性强化学习提升多模态推理
机构 * Rutgers University(罗格斯大学) ; Columbia University(哥伦比亚大学) ; University of Chicago(芝加哥大学)
AI总结 R-C2通过循环一致性强化学习解决多模态推理中的内部冲突,提升推理准确率7.6个百分点。
高校专区
R-C2:循环一致性强化学习提升多模态推理
机构 * Rutgers University(罗格斯大学) ; Columbia University(哥伦比亚大学) ; University of Chicago(芝加哥大学)
AI总结 R-C2通过循环一致性强化学习解决多模态推理中的内部冲突,提升推理准确率7.6个百分点。
ByteStorm:一种多步骤数据驱动方法用于热带气旋检测与追踪
机构 * CMCC Foundation - Euro-Mediterranean Center on Climate Change(CMCC基金会 - 欧洲-地中海气候变化中心) ; University of Salento, Department of Engineering for Innovation(萨伦托大学创新工程系) ; Department of Earth and Environmental Engineering, Columbia University(哥伦比亚大学地球与环境工程系)
AI总结 本文提出ByteStorm方法,利用深度学习检测气旋中心并追踪,实现高效、准确的气旋追踪。
Comments 26 pages, 17 figures
系统提示是攻击面:LLM代理配置如何影响安全并创造可利用的漏洞
机构 * Independent Researcher(独立研究员) ; Columbia University(哥伦比亚大学)
AI总结 研究探讨了LLM邮件代理中系统提示配置对安全性和漏洞的影响,发现提示模型交互是关键安全变量,通过不同配置可使钓鱼检测率从低于1%到97%波动,同时提出Safetility指标以平衡检测、可用性和对抗鲁棒性。
Comments 32 pages, 4 figures, 6 tables
重新思考健康代理:从孤立AI到协作决策调解者
机构 * University of Washington(华盛顿大学) ; Columbia University(哥伦比亚大学) ; Seattle Children’s Hospital(西雅图儿童医院)
AI总结 本文提出一种新的健康代理框架,通过临床验证的病例研究,展示孤立AI在协作医疗中的不足,并提出设计能整合上下文信息、协调认知模型的AI协作方案。
Comments Accepted in CHI '26 Workshop on Human-Agent Collaboration
注视模式预测成对AI图像评估中的偏好和信心
机构 * Columbia University(哥伦比亚大学)
AI总结 研究通过眼动追踪揭示成对AI图像评估中的偏好形成过程,发现注视模式能预测二元选择和信心,表明眼动数据能提供与偏好注释质量相关的隐含信号。
Comments This paper has been accepted to ACM ETRA 2026