arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

National University of Singapore(新加坡国立大学)

2026-03-20 至 2026-03-20 共收录 15
2603.19191 2026-03-20 cs.AI

OS-Themis: A Scalable Critic Framework for Generalist GUI Rewards

OS-Themis:一种可扩展的通用GUI奖励批评框架

Zehao Li, Zhenyu Wu, Yibo Zhao, Bowen Yang, Jingjing Xie, Zhaoyang Liu, Zhoumianze Liu, Kaiming Jin, Jianze Liang, Zonglin Li, Feng Wu, Bowen Zhou, Zun Wang, Zichen Ding

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多模态实验室) The Hong Kong University of Science and Technology(香港科学大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出OS-Themis框架,通过分解轨迹为可验证里程碑并采用审核机制,提升GUI奖励的可扩展性和准确性,实验表明其在AndroidWorld中提升了在线强化学习和轨迹验证的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19149 2026-03-20 cs.CL cs.LG

Optimal Splitting of Language Models from Mixtures to Specialized Domains

从混合数据中语言模型的最优分割以专用于特定领域

Skyler Seto, Pierre Ablin, Anastasiia Filippova, Jiayuan Ye, Louis Bethune, Angelos Katharopoulos, David Grangier

机构 * Apple(苹果公司) National University of Singapore(新加坡国立大学)

AI总结 本文提出了一种方法,通过独立预训练多个模型并利用缩放定律确定预训练和继续预训练之间的最佳计算分配,从而提升不同模型大小和计算预算下的常识知识和推理基准性能。

Comments 26 pages, 11 tables, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19074 2026-03-20 cs.RO cs.AI

CAMO: A Conditional Neural Solver for the Multi-objective Multiple Traveling Salesman Problem

CAMO:一种用于多目标多旅行商问题的条件神经求解器

Fengxiaoxiao Li, Xiao Mao, Mingfeng Fan, Yifeng Zhang, Yi Li, Tanishq Duhan, Guillaume Sartoretti

机构 * National University of Singapore(新加坡国立大学) China Unicom Shenzhen Branch(中国unicom深圳分公司) Central South University(中南大学)

AI总结 CAMO提出一种条件神经求解器,解决多目标多旅行商问题,通过融合偏好和协作解码器实现多目标权衡,实验显示其在求解帕累托前沿方面表现优异。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18773 2026-03-20 cs.LG cs.AI

Automatic Configuration of LLM Post-Training Pipelines

大语言模型后训练流程的自动配置

Channe Chwa, Xinle Wu, Yao Lu

机构 * National University of Singapore(新加坡国立大学)

AI总结 本文提出AutoPipe框架,通过学习历史运行数据和贝叶斯优化,有效配置大语言模型后训练流程,减少计算成本并提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09255 2026-03-20 cs.CL

DSPO: Stable and Efficient Policy Optimization for Agentic Search and Reasoning

DSPO:用于代理搜索和推理的稳定高效策略优化

Chenyang Gu, Yewen Pu, Bruce Yang, Xiaofan Li, Huan Gao

机构 * Sapiens AI Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 DSPO通过序列级优化和动态样本过滤提升代理训练稳定性,使7B模型在多个问答基准上超越前作34.1%,在复杂多跳问答中甚至超越14B模型9个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18753 2026-03-20 cs.CV

CrossHOI-Bench: A Unified Benchmark for HOI Evaluation across Vision-Language Models and HOI-Specific Methods

CrossHOI-Bench: 一个统一的HOI评估基准,涵盖视觉-语言模型和特定HOI方法

Qinqian Lei, Bo Wang, Robby T. Tan

机构 * National University of Singapore(新加坡国立大学) University of Mississippi(密西西比大学) ASUS Intelligent Cloud Services(ASUS智能云服务)

AI总结 本文提出CrossHOI-Bench,通过显式正例和 curated 负例,统一评估VLM和HOI方法,揭示两者在多任务和细粒度交互上的互补优劣。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18571 2026-03-20 cs.AI cs.CE q-bio.QM

CAPSUL: A Comprehensive Human Protein Benchmark for Subcellular Localization

CAPSUL:一个全面的人类蛋白质基准用于亚细胞定位

Yicheng Hu, Xinyu Lin, Shulin Li, Wenjie Wang, Fengbin Zhu, Fuli Feng

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学)

AI总结 CAPSUL基准通过整合多样化3D结构表示和精细亚细胞定位注释,推动结构基模型在亚细胞定位任务中的应用,展示了结构特征的重要性,并通过高尔基体案例研究揭示了α-螺旋在定位中的关键作用。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18103 2026-03-20 cs.CR cs.LG cs.SD

STEP: Detecting Audio Backdoor Attacks via Stability-based Trigger Exposure Profiling

STEP:通过基于稳定性的触发暴露分析检测音频后门攻击

Kun Wang, Meng Chen, Junhao Wang, Yuli Wu, Li Lu, Chong Zhang, Peng Cheng, Jiaheng Zhang, Kui Ren

机构 * Zhejiang University(浙江大学) Xi’an Jiaotong University(西安交通大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出STEP方法,通过分析触发器在语义破坏扰动下的异常稳定性与语义保持扰动下的异常脆弱性,实现无训练的音频后门检测,实验显示其在多个攻击场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18086 2026-03-20 cs.CV

SSP-SAM: SAM with Semantic-Spatial Prompt for Referring Expression Segmentation

SSP-SAM:基于语义-空间提示的SAM用于指代表达分割

Wei Tang, Xuejing Liu, Yanpeng Sun, Zechao Li

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) NExT++ Lab, School of Computing, National University of Singapore(新加坡国立大学计算机学院NExT++实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

AI总结 本文提出SSP-SAM,通过整合语义-空间提示编码器提升SAM在指代表达分割中的性能,实验验证其在RES和GRES任务中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11239 2026-03-20 cs.AI

Reversible Lifelong Model Editing via Semantic Routing-Based LoRA

基于语义路由的LoRA的可逆终身模型编辑

Haihua Luo, Xuming Ran, Tommi Kärkkäinen, Zhonghua Chen, Jiangrong Shen, Qi Xu, Fengyu Cong

机构 * Faculty of Information Technology, University of Jyväskylä, Jyväskylä, Finland(于韦斯屈埃lys大学信息科技学院) National University of Singapore, Singapore(新加坡国立大学)

AI总结 本文提出SoLA框架,通过语义路由实现可逆的终身模型编辑,解决持续更新导致的语义漂移和知识遗忘问题,支持精确撤销特定编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09909 2026-03-20 cs.AI

MedMASLab: A Unified Orchestration Framework for Benchmarking Multimodal Medical Multi-Agent Systems

MedMASLab:多模态医疗多智能体系统的统一协调框架

Yunhang Qian, Xiaobin Hu, Jiaquan Yu, Siyang Xin, Xiaokun Chen, Jiangning Zhang, Peng-Tao Jiang, Jiawei Liu, Hongwei Bran Li

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Zhejiang University(浙江大学) vivo Stanford University(斯坦福大学)

AI总结 本文提出MedMASLab框架,解决医疗多智能体系统中多模态整合碎片化问题,通过标准化通信协议、自动化评估器和大规模基准测试,揭示领域特定性能差距,为未来自主临床系统建立新基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13647 2026-03-20 cs.IR cs.AI

SF-RAG: Structure-Fidelity Retrieval-Augmented Generation for Academic Question Answering

SF-RAG:用于学术问答的结构保真检索增强生成

Rui Yu, Tianyi Wang, Ruixia Liu, Yinglong Wang

机构 * Qilu University of Technology (Shandong Academy of Sciences)(齐鲁工业大学(山东科学院)) National University of Singapore(新加坡国立大学)

AI总结 SF-RAG通过保留学术论文的层级结构,提高检索和生成的效率与准确性,减少碎片化并提升答案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11052 2026-03-20 cs.RO

AdaptPNP: Integrating Prehensile and Non-Prehensile Skills for Adaptive Robotic Manipulation

AdaptPNP: 集成抓取与非抓取技能以实现适应性机器人操控

Jinxuan Zhu, Chenrui Tie, Xinyi Cao, Yuran Wang, Jingxiang Guo, Zixuan Chen, Haonan Chen, Junting Chen, Yangyu Xiao, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) RoboScience(机器人科学) East China Normal University(华东师范大学) Peking University(北京大学) Nanjing University(南京大学)

AI总结 本文提出AdaptPNP框架,通过视觉-语言模型整合抓取与非抓取技能,实现复杂机器人操控任务的规划与执行。

Journal ref ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20579 2026-03-20 cs.CV cs.AI cs.MM

Open-o3-Video: Grounded Video Reasoning with Explicit Spatio-Temporal Evidence

Open-o3-Video: 基于显式时空证据的视频推理

Jiahao Meng, Xiangtai Li, Haochen Wang, Yue Tan, Tao Zhang, Lingdong Kong, Yunhai Tong, Anran Wang, Zhiyang Teng, Yujing Wang, Zhuochen Wang

机构 * PKU(北京大学) ByteDance(字节跳动) CASIA(CASIA研究院) WHU(武汉大学) NUS(新加坡国立大学)

AI总结 本文提出Open-o3-Video,通过显式时空证据提升视频推理的可追溯性与可验证性,基于STGR数据集和冷启动强化学习策略,在V-STAR基准上取得SOTA性能,并支持置信度感知的测试时扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16344 2026-03-20 cs.RO cs.AI

Manual2Skill++: Connector-Aware General Robotic Assembly from Instruction Manuals via Vision-Language Models

Manual2Skill++: 通过视觉语言模型实现连接器感知的指令手册驱动机器人装配

Chenrui Tie, Shengxiang Sun, Yudi Lin, Yanbo Wang, Zhongrui Li, Zhouhan Zhong, Jinxuan Zhu, Yiman Pang, Haonan Chen, Junting Chen, Ruihai Wu, Lin Shao

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) University of Toronto(多伦多大学) Zhejiang University(浙江大学) Peking University(北京大学)

AI总结 本文提出Manual2Skill++框架,通过视觉语言模型从指令手册中提取结构化连接信息,构建层次化图表示,实现连接器为核心的装配任务理解与执行。

Journal ref ICRA2026

详情

展开后加载摘要…

URL PDF HTML 收藏