arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-05-14 至 2026-05-14 共收录 17
2605.13821 2026-05-14 cs.AI cs.LG

Harnessing Agentic Evolution

利用代理进化

Jiayi Zhang, Yongfeng Gu, Jianhao Ruan, Maojia Song, Yiran Peng, Zhiguang Han, Jinyu Xiang, Zhitao Wang, Caiyin Yang, Yixi Ouyang, Bang Liu, Chenglin Wu, Yuyu Luo

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) DeepWisdom Singapore University of Technology and Design(新加坡科技设计大学) Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Université de Montréal & Mila(蒙特利尔大学及Mila)

AI总结 本文提出AEvo框架,通过统一接口整合程序和代理进化,提升长周期搜索性能,在多个基准测试中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13737 2026-05-14 cs.AI cs.CL

Senses Wide Shut: A Representation-Action Gap in Omnimodal LLMs

宽视角闭合:多模态大语言模型中的表征-行动鸿沟

Trung Nguyen Quang, Yiming Gao, Fanyi Pu, Kaichen Zhang, Shuo Sun, Ziwei Liu

机构 * Nanyang Technological University(南洋理工大学) LMMs-Lab Team(多模态大模型实验室团队) Johns Hopkins University(约翰霍普金斯大学)

AI总结 研究发现多模态大语言模型在感知与行动之间存在鸿沟,通过IMAVB基准测试揭示模型在处理冲突信息时的不足,提出PGLA方法提升拒绝行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13583 2026-05-14 cs.CV

Phy-CoSF: Physics-Guided Continuous Spectral Fields Reconstruction and Super-Resolution for Snapshot Compressive Imaging

Phy-CoSF:基于物理的连续光谱场重建与超分辨率方法用于快照压缩成像

Wudi Chen, Zhiyuan Zha, Xin Yuan, Shigang Wang, Bihan Wen, Jiantao Zhou, Gang Yan, Zipei Fan, Ce Zhu

机构 * College of Communication Engineering, Jilin University, Changchun 130012, China. School of Engineering, Westlake University, Hangzhou, Zhejiang 310024, China. School of Electrical \& Electronic Engineering, Nanyang Technological University, Singapore 639798. Department of Computer Information Science, University of Macau, Macau 999078, China. College of Computer Science Technology, Jilin University, Changchun 130012, China. College of Artificial Intelligence, Jilin University, Changchun 130012, China. School of Information Communication Engineering, University of Electronic Science

AI总结 本文提出Phy-CoSF,结合深度展开网络与隐式神经表示,实现CASSI的连续光谱重建与超分辨率,通过双阶段架构和连续光谱场模块提升高保真HIS生成。

Comments 15 pages, 10 figures, accepted by ICML 2026!

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02753 2026-05-14 cs.CV

DeCo-DETR: Decoupled Cognition DETR for efficient Open-Vocabulary Object Detection

DeCo-DETR:解耦认知DETR用于高效的开放词汇目标检测

Siheng Wang, Yanshu Li, Bohan Hu, Zhengdao Li, Haibo Zhan, Linshan Li, Weiming Liu, Ruizhi Qian, Guangxin Wu, Hao Zhang, Jifeng Shen, Piotr Koniusz, Zhengtao Yao, Junhao Dong, Qiang Sun

机构 * Jiangsu University(江苏大学) Brown University(布朗大学) Nanyang Technological University(南洋理工大学) MBZUAI University of New South Wales(新南威尔士大学) USC University of Toronto(多伦多大学) Data61 CSIRO

AI总结 DeCo-DETR通过统一解耦范式解决开放词汇目标检测中的计算开销与训练目标冲突问题,构建层次化语义原型空间并解耦语义推理与定位,提升推理效率。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17555 2026-05-14 cs.CV

GraphThinker: Reinforcing Temporally Grounded Video Reasoning with Event Graph Thinking

GraphThinker: 通过事件图思维强化时间感知的视频推理

Zixu Cheng, Da Li, Jian Hu, Yuhang Zang, Ziquan Liu, Shaogang Gong, Wei Li

机构 * Queen Mary University of London(伦敦玛丽女王大学) Samsung AI Centre Cambridge(剑桥三星人工智能中心) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学)

AI总结 本文提出GraphThinker,通过构建结构化事件表示并强化视觉 grounding,减少视频推理中的时间幻觉。在RexTime和VidHalluc数据集上取得显著提升。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12876 2026-05-14 cs.LG

Certified Robustness under Heterogeneous Perturbations via Hybrid Randomized Smoothing

通过混合随机平滑实现异质扰动下的认证鲁棒性

Blaise Delattre, Hengyu Wu, Paul Caillon, Wei Yang Bryan Lim, Yang Cao

机构 * Department of Computer Science, School of Computing, Institute of Science Tokyo, Tokyo, Japan(东京科学研究所计算机科学系) College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院) PSL University, Paris, France(巴黎高等师范学院)

AI总结 本文提出统一的混合随机平滑框架,针对混合离散-连续输入,基于可解析的Neyman-Pearson联合最坏情况问题,提供闭式一维证书,扩展了高斯和离散随机平滑,应用于多模态安全过滤。

Comments ICML 2026. Code: https://github.com/tdsai-lab/hybrid-randomized-smoothing

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12862 2026-05-14 cs.NI cs.LG

NeuroRisk: Physics-Informed Neural Optimization for Risk-Aware Traffic Engineering

NeuroRisk:基于物理的神经优化用于风险感知的交通工程

Yingming Mao, Ximeng Liu, Jingyi Cheng, Xiyuan Liu, Jiashuai Liu, Yike Liu, Zhen Yao, Yuzhou Zhou, Siyuan Feng, Qiaozhu Zhai, Shizhen Zhao

机构 * Xi’an Jiaotong University(西安交通大学) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) Huawei(华为) Shanghai Innovation Institute(上海创新研究院)

AI总结 针对WAN中相关故障导致的可用性损失问题,NeuroRisk通过物理引导的深度展开优化器,在风险目标上实现高利用率,同时在运算尺度上实现显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11679 2026-05-14 cs.AI

Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion

通过偏好维度扩展解释并打破安全与有益性天花板

ShiYing Huang, Liang Lin, Yuer Li, Kaiwen Luo, Zhenhong Zhou, An Zhang, Junhao Dong, Kun Wang, Zhigang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) Chongqing University(重庆大学)

AI总结 本文提出MORA方法,通过多维奖励整合解决多目标对齐中的安全与有益性矛盾,实验显示在序列对齐中提升5%-12.4%,同时对齐中整体奖励提升4.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07433 2026-05-14 cs.LG cs.CV

Data Agent: Learning to Select Data via End-to-End Dynamic Optimization

数据代理:通过端到端动态优化学习数据选择

Suorong Yang, Fangjian Su, Hai Gan, Ziqi Ye, Jie Li, Baile Xu, Furao Shen, Soujanya Poria

机构 * National University of Singapore(新加坡国立大学) Nanjing University(南京大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出数据代理框架,通过端到端动态优化解决数据选择问题,提升训练效率并保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18951 2026-05-14 cs.LG

Benchmarking Attribute Discrimination in Infant-Scale Vision-Language Models

对婴儿级视觉-语言模型属性辨别能力的基准测试

Patrick Batsell, Satoshi Tsutsui, Bihan Wen

机构 * Rice University(里士大学) ROSE Lab(ROSE实验室) School of EEE, Nanyang Technological University(南洋理工大学电子工程学院)

AI总结 研究通过合成渲染对比颜色、尺寸和纹理属性,评估婴儿训练模型在属性辨别上的能力,发现其在视觉和语言属性信息上存在差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10265 2026-05-14 cs.CL

Backdoor Collapse: Eliminating Unknown Threats via Known Backdoor Aggregation in Language Models

后门崩溃:通过已知后门聚合消除未知威胁

Liang Lin, Miao Yu, Moayad Aloqaily, Zhenhong Zhou, Kun Wang, Linsey Pang, Prakhar Mehrotra, Qingsong Wen

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Science and Technology of China(中国科学技术大学) United Arab Emirates University(阿联酋大学) PayPal Inc(PayPal公司) Walmart Labs(沃尔玛实验室) Squirrel Ai Learning(Squirrel Ai学习) Nanyang Technological University(南洋理工大学)

AI总结 本文提出一种无需提前了解触发器设置的防御框架,通过后门表示聚合和恢复微调,有效降低攻击成功率并保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01908 2026-05-14 cs.CV

Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning

基于推理的编辑:基于假设指令的图像编辑与视觉推理

Qingdong He, Xueqin Chen, Chaoyi Wang, Yanjie Pan, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Xiangtai Li, Jiangning Zhang

机构 * Tencent Youtu Lab(腾讯云图实验室) Sichuan University(四川大学) University of the Chinese Academy of Sciences(中国科学院大学) Fudan University(复旦大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Reason50K数据集和ReasonBrain框架,通过多模态大语言模型和扩散模型实现复杂隐含指令的图像编辑,提升视觉推理能力。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12876 2026-05-14 cs.LG

MaskPro: Linear-Space Probabilistic Learning for Strict (N:M)-Sparsity on LLMs

MaskPro: 用于LLMs上严格(N:M)-稀疏性的线性空间概率学习

Yan Sun, Qixin Zhang, Zhiyuan Yu, Xikun Zhang, Li Shen, Dacheng Tao

机构 * School of Computer Science Faculty of Engineering The University of Sydney(悉尼大学计算机科学与工程学院) Generative AI Lab College of Computing and Data Science Nanyang Technological University(南洋理工大学生成人工智能实验室) University of Science and Technology of China(中国科学技术大学) RMIT University(皇家理工大学) School of Cyber Science and Technology Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区网络科学与技术学院)

AI总结 MaskPro通过学习每个M连续权重的先验分类分布,在N-way采样中生成(N:M)-稀疏性,解决了现有方法在误差和训练成本上的问题,同时提升内存效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15621 2026-05-14 cs.LG cs.CR

Convergent Differential Privacy Analysis for General Federated Learning

联邦学习与差分隐私的收敛差分隐私分析

Yan Sun, Qixin Zhang, Li Shen, Dacheng Tao

机构 * School of Computer Science Faculty of Engineering(计算机科学学院工程学院) University of Sydney(悉尼大学) Generative AI Lab(生成式人工智能实验室) College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学) School of Cyber Science and Technology(网络安全科学与技术学院) Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)

AI总结 本文基于非凸和平滑目标,利用f-差分隐私分析评估了两种经典方法的最坏隐私情况,证明Noisy-FedAvg具有紧收敛界,Noisy-FedProx具有稳定常数下界,为FL-DP框架的可靠性提供了理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11247 2026-05-14 cs.CV cs.RO

Compact 3D Gaussian Splatting For Dense Visual SLAM

紧凑的3D高斯散射用于密集视觉SLAM

Tianchen Deng, Chang Nie, Shuhong Liu, Wenhua Wu, Jianfei Yang, Shenghai Yuan, Jiuming Liu, Danwei Wang, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) The University of Tokyo(东京大学) Harvard University(哈佛大学) University of Cambridge(剑桥大学)

AI总结 本文提出紧凑的3D高斯散射SLAM系统,通过滑动窗口遮罩策略和几何代码本压缩高斯参数,提升训练和渲染速度,保持高质量场景表示。

Comments Accepted by IJCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12571 2026-05-14 cs.CV cs.AI

VideoSEAL: Mitigating Evidence Misalignment in Agentic Long Video Understanding by Decoupling Answer Authority

VideoSEAL: 通过解耦答案权威性来缓解代理长视频理解中的证据错位

Chenhao Qiu, Yechao Zhang, Xin Luo, Shien Song, Xusheng Liu

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 本文提出VideoSEAL框架,通过解耦规划与答案权威性,解决长视频理解中证据错位问题,提升回答准确性和证据对齐度,实验结果显示在多个基准上表现优异。

Comments Accepted to ICML 2026. 33 pages, 13 figures. Code and models are available at https://github.com/Echochef/VideoSEAL

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12570 2026-05-14 cs.CV

M3Net: A Macro-to-Meso-to-Micro Clinical-inspired Hierarchical 3D Network for Pulmonary Nodule Classification

M3Net:一种受临床诊断流程启发的宏-中-微三级层次3D网络用于肺结节分类

Jinyue Li, Yuzhou Yu, Jingjing Yang, Meng Fu, Yani Zhang, Shuyao He, Dianlong Ge, Xin Ning, Yannan Chu, Qiankun Li

机构 * Hefei Cancer Hospital of CAS, Institute of Health and Medical Technology, Hefei Institutes of Physical Science, Chinese Academy of Sciences(中国科学院合肥医疗健康研究院、健康与医疗技术研究所、物理研究所) University of Science and Technology of China(中国科学技术大学) Graduate School, Bengbu Medical College(蚌埠医疗学院研究生院) Department of Pulmonary and Critical Care Medicine, The First Affiliated Hospital of USTC, Division of Life Sciences and Medicine, University of Science and Technology of China (USTC)(中国科学技术大学附属第一医院呼吸与危重症医学科、生命科学与医学学院) Northeastern University(东北大学) Institute of Semiconductors, Chinese Academy of Sciences(中国科学院半导体研究所) College of Computing and Data Science (CCDS), Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 本文提出M3Net,通过多尺度上下文信息整合,提升肺结节分类的准确性和可解释性,在LIDC-IDRI和USTC-FHLN数据集上取得最佳性能。

Comments Published in Information Fusion (2026), 15 pages, 5 figures

Journal ref Information Fusion, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏