arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Fudan University(复旦大学)

2026-04-09 至 2026-04-09 共收录 7
2604.06714 2026-04-09 cs.AI cs.CL cs.CV cs.LG

Steering the Verifiability of Multimodal AI Hallucinations

操控多模态AI幻觉的可验证性

Jianhong Pang, Ruoxi Cheng, Ziyi Ye, Xingjun Ma, Zuxuan Wu, Xuanjing Huang, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究所) Shanghai Key Laboratory of Multimodal Embodied AI(上海市多模态具身人工智能重点实验室)

AI总结 本文研究多模态AI幻觉的可验证性差异,提出基于激活空间的干预方法,通过区分明显和隐秘幻觉,实现对模型可验证性的精细控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06663 2026-04-09 cs.CY cs.AI

Restoring Heterogeneity in LLM-based Social Simulation: An Audience Segmentation Approach

在基于大语言模型的社会模拟中恢复异质性:一种受众细分方法

Xiaoyou Qin, Zhihong Li, Xiaoxiao Cheng

机构 * School of Journalism, Fudan University(复旦大学新闻学院) College of Media and International Culture, Zhejiang University(浙江大学传媒与国际文化学院)

AI总结 本文提出通过受众细分方法恢复基于大语言模型的社会模拟中的异质性,利用美国气候意见调查数据,比较不同细分配置在两个大语言模型上的表现,发现适度细化能提升性能,但过度细化可能损害结构和预测忠实度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06393 2026-04-09 cs.CL

ART: Attention Replacement Technique to Improve Factuality in LLMs

ART:通过注意力替换技术提升大语言模型的事实性

Ziqin Luo, Yihao Quan, Xiaofeng Zhang, Xiaosong Yuan, Chen Shen

机构 * Department of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知系) Fudan University(复旦大学) Alibaba Cloud Computing(阿里云计算)

AI总结 本文提出ART技术,通过替换大语言模型浅层的均匀注意力模式为局部注意力模式,减少幻觉问题,适用于多种LLM架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22220 2026-04-09 cs.IR cs.AI cs.CL

What Makes an Ideal Quote? Recommending "Unexpected yet Rational" Quotations via Novelty

什么使引用成为理想引用?通过新颖性的新型引用推荐

Bowei Zhang, Jin Xiao, Guanglei Yue, Qianyu He, Yanghua Xiao, Deqing Yang, Jiaqing Liang

机构 * School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Key Laboratory of Data Science, College of Computer Science and Artificial Intelligence(上海市数据科学重点实验室,计算机科学与人工智能学院)

AI总结 本文提出通过新颖性推荐'意外却合理'的引用,通过多维深度意义标签和新颖性估计器提升引用推荐质量。

Comments Accepted to ACL 2026 main conference ; Code available at <https://github.com/Chang-pw/NoQuote>

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20886 2026-04-09 cs.CV

V$^{2}$-SAM: Marrying SAM2 with Multi-Prompt Experts for Cross-View Object Correspondence

V$^{2}$-SAM:融合SAM2与多提示专家以实现跨视角物体对应

Jiancheng Pan, Runze Wang, Tianwen Qian, Mohammad Mahdi, Yanwei Fu, Xiangyang Xue, Xiaomeng Huang, Luc Van Gool, Danda Pani Paudel, Yuqian Fu

机构 * INSAIT, Sofia University “St. Kliment Ohridski”(INSAIT,索非亚大学) Tsinghua University(清华大学) Fudan University(复旦大学) East China Normal University(华东师范大学)

AI总结 本文提出V2-SAM框架,通过两个互补的提示生成器将SAM2从单视角分割适应到跨视角对应,引入多专家设计和PCCS选择器,实现跨视角物体一致性的新方法。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08409 2026-04-09 cs.AI

Faithful-First Reasoning, Planning, and Acting for Multimodal LLMs

多模态大语言模型中的忠实优先推理、规划与行动

Junxian Li, Xinyue Xu, Sai Ma, Di Zhang, Sichao Li

机构 * Shanghai Jiao Tong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学) The Australian National University(澳大利亚国立大学) Fudan University(复旦大学) University of Sydney(悉尼大学)

AI总结 本文提出Faithful-First RPA框架,通过逐步监督提升多模态推理的忠实度,实验表明其在多个基准上提升了24%的感知忠实度,且不降低任务准确性。

Comments Accepted by ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07335 2026-04-09 cs.RO

TAMEn: Tactile-Aware Manipulation Engine for Closed-Loop Data Collection in Contact-Rich Tasks

TAMEn:用于接触密集任务闭环数据收集的触觉感知操作引擎

Longyan Wu, Jieji Ren, Chenghang Jiang, Junxi Zhou, Shijia Peng, Ran Huang, Guoying Gu, Li Chen, Hongyang Li

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) OpenDriveLab at The University of Hong Kong(香港大学OpenDriveLab) Shanghai Jiao Tong University(上海交通大学) East China University of Science and Technology(华东理工大学)

AI总结 本文提出TAMEn,通过双模采集管道和触觉-视觉学习框架,提升机器人双臂操作任务的闭环策略优化效果,实验表明任务成功率从34%提升至75%。

详情

展开后加载摘要…

URL PDF HTML 收藏