arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Nanyang Technological University(南洋理工大学)

2026-04-17 至 2026-04-17 共收录 13
2604.15093 2026-04-17 cs.AI cs.CL cs.CV cs.HC

OpenMobile: Building Open Mobile Agents with Task and Trajectory Synthesis

OpenMobile: 通过任务和轨迹合成构建开放移动代理

Kanzhi Cheng, Zehao Li, Zheng Ma, Nuo Chen, Jialin Cao, Qiushi Sun, Zichen Ding, Fangzhi Xu, Hang Yan, Jiajun Chen, Anh Tuan Luu, Jianbing Zhang, Lewei Lu, Dahua Lin

机构 * Nanjing University(南京大学) SenseTime(秒速) Nanyang Technological University(南洋理工大学) Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出OpenMobile框架,通过可扩展的任务合成管道和策略切换策略生成高质量任务指令和轨迹,实现移动代理在AndroidWorld等基准测试中取得显著成绩。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15023 2026-04-17 cs.RO

DockAnywhere: Data-Efficient Visuomotor Policy Learning for Mobile Manipulation via Novel Demonstration Generation

DockAnywhere: 通过新颖的示范生成实现移动操作的数据高效视觉-运动策略学习

Ziyu Shan, Yuheng Zhou, Gaoyuan Wu, Ziheng Ji, Zhenyu Wu, Ziwei Wang

机构 * Nanyang Technological University, Singapore(新加坡南洋理工大学) Beijing University of Posts and Telecommunications, Beijing, China(北京邮电大学)

AI总结 本文提出DockAnywhere方法,通过解耦基座运动与不变的 manipulation 技能,提升移动操作在不同 docking 点下的视角泛化能力,实验表明其显著提高了策略成功率和泛化能力。

Comments Accepted to RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07449 2026-04-17 cs.IR cs.AI

RLPO: Residual Listwise Preference Optimization for Long-Context Review Ranking

RLPO:长上下文评论排序的残差列表偏好优化

Hao Jiang, Zhi Yang, Annan Wang, Yichi Zhang, Weisi Lin

机构 * Nanyang Technological University(南洋理工大学) Peking University(北京大学) Independent Researcher(独立研究员)

AI总结 本文提出RLPO,通过残差列表级优化提升长上下文评论排序,解决传统方法在长上下文下的效率与准确性矛盾,实验显示其在NDCG@k上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14805 2026-04-17 cs.CV

From Boundaries to Semantics: Prompt-Guided Multi-Task Learning for Petrographic Thin-section Segmentation

从边界到语义:基于提示的多任务学习用于岩片分割

Yili Ren, Shiqi Wen, Li Hou, Dingwen Xiao, Weiming Zhang, Caleb Chen Cao, Lin Wang, Zilu Zheng, Qianxiao Su, Mingjun Zhao, Lei Chen

机构 * Research Institute of Petroleum Exploration and Development(石油勘探开发研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Petro-SAM框架,通过整合多角度偏振视图和颜色熵先验,解决岩片分割中的领域差距和细粒边界问题,实现高精度的粒边分割和岩性语义分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14627 2026-04-17 cs.AI

A Parallel Approach to Counting Exact Covers Based on Decomposability Property

基于可分解性质的精确覆盖计数并行方法

Liangda Fang, Yaohui Luo, Delong Li, Xuanxiang Huang, Quanlong Guan

机构 * Jinan University(济南大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出一种基于决策-ZDNNF的并行算法DXD,通过动态更新连通组件提升精确覆盖计数效率,实验表明其优于现有方法。

Comments Submitted to SAT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14604 2026-04-17 cs.CR cs.AI cs.SD

Hijacking Large Audio-Language Models via Context-Agnostic and Imperceptible Auditory Prompt Injection

通过上下文无关且不可察觉的音频提示注入劫持大型音频-语言模型

Meng Chen, Kun Wang, Li Lu, Jiaheng Zhang, Tianwei Zhang

机构 * The State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出AudioHijack框架,通过生成不可察觉的对抗性音频劫持LALMs,实验显示在6种恶意行为中平均成功率达79%-96%。

Comments Accepted by IEEE S&P 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14353 2026-04-17 cs.RO

RoSLAC: Robust Simultaneous Localization and Calibration of Multiple Magnetometers

RoSLAC:基于交替优化的多磁力计同时定位与校准

Qiyang Lyu, Zhenyu Wu, Wei Wang, Hongming Shen, Danwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

AI总结 针对磁力计校准与定位精度问题,本文提出RoSLAC方法,通过交替优化高效估计平台姿态和校准参数,实现在高保真仿真和真实环境中高精度定位与低计算成本的校准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14259 2026-04-17 q-bio.TO cs.LG eess.IV

Continual Learning for fMRI-Based Brain Disorder Diagnosis via Functional Connectivity Matrices Generative Replay

基于功能性连接矩阵生成性重放的fMRI脑部疾病诊断持续学习

Qianyu Chen, Shujian Yu

机构 * Nanyang Technological University(南洋理工大学) VU Amsterdam(阿姆斯特丹大学) UiT The Arctic University of Norway(北欧大学)

AI总结 本文提出首个针对异构临床站点的fMRI诊断持续学习框架,通过生成对抗网络生成真实功能性连接矩阵,并结合多级知识蒸馏策略和分层上下文老虎机方案,有效缓解灾难性遗忘问题。

Comments manuscript accepted by CVPR 2026, code is available from \url{https://github.com/4me808/FORGE}

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03307 2026-04-17 cs.CV cs.AI

V-Reflection: Transforming MLLMs from Passive Observers to Active Interrogators

V-Reflection:将多模态大语言模型从被动观察者转变为主动提问者

Jiazhou Zhou, Yucheng Chen, Hongyang Li, Qing Jiang, Hu Zhou, Ying-Cong Chen, Lei Zhang

机构 * AI Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)人工智能方向) International Digital Economy Academy(国际数字经济学院) MedVisAI Lab, Lee Kong Chian School of Medicine, Nanyang Technological University, and Centre of AI in Medicine(医学视觉人工智能实验室,南洋理工大学Lee Kong Chian医学院,以及人工智能在医学中的中心) South China University of Technology(华南理工大学) Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(香港理工大学电子与电气工程系)

AI总结 本文提出V-Reflection框架,通过'思考后再观察'的视觉反思机制,使多模态大语言模型能主动提问视觉特征空间,提升细粒度任务的感知能力。

Comments Main paper 14 pages with supplementary 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03416 2026-04-17 cs.CV

GAMBIT: A Gamified Jailbreak Framework for Multimodal Large Language Models

GAMBIT:一种用于多模态大语言模型的游戏化突破框架

Xiangdong Hu, Yangyang Jiang, Qin Hu, Xiaojun Jia

机构 * Georgia State University(佐治亚州立大学) Shandong University(山东大学) Nanyang Technological University, Singapore(新加坡南洋理工大学)

AI总结 本文提出GAMBIT框架,通过分解重组有害视觉语义并构建游戏化场景,使模型在探索和重建意图中主动完成突破,提升攻击成功率。

Comments Accepted to the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026), Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04578 2026-04-17 cs.CL

LexGenius: An Expert-Level Benchmark for Large Language Models in Legal General Intelligence

LexGenius:一种大型语言模型在法律通用智能方面的专家级基准

Wenjin Liu, Haoran Luo, Xin Feng, Xiang Ji, Lijuan Zhou, Rui Mao, Jiapu Wang, Shirui Pan, Erik Cambria

机构 * Hainan University(海南大学) Nanyang Technological University(南洋理工大学) Nanjing University of Science and Technology(南京理工大学) Griffith University(格里菲斯大学)

AI总结 本文提出LexGenius,一个涵盖七个维度、十一项任务和二十项能力的中文法律基准,用于评估大型语言模型的法律通用智能,发现LLM在法律智能能力上存在显著差异,甚至优于人类法律专业人士。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01016 2026-04-17 cs.CL

Prompt-R1: Collaborative Automatic Prompting Framework via End-to-end Reinforcement Learning

Prompt-R1: 通过端到端强化学习实现的协作自动提示框架

Wenjin Liu, Haoran Luo, Xueyuan Lin, Haoming Liu, Tiesunlong Shen, Jiapu Wang, Rui Mao, Erik Cambria

机构 * Hainan University(海南大学) Nanyang Technological University(南洋理工大学) Hithink Research(慧思研究) HKUST (Guangzhou)(香港科技大学(广州)) IDEA Research(IDEA研究院) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Nanjing University of Science and Technology(南京理工大学)

AI总结 本文提出Prompt-R1框架,通过小规模LLM与大规模LLM协作,利用强化学习提升复杂问题解决能力,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21970 2026-04-17 cs.CV

Q-MambaIR: Accurate Quantized Mamba for Efficient Image Restoration

Q-MambaIR:用于高效图像修复的准确量化Mamba

Yujie Chen, Haotong Qin, Zhang Zhang, Michelo Magno, Luca Benini, Yawei Li

机构 * ETH Zürich(苏黎世联邦理工学院) Shenzhen Automotive Research Institute(深圳汽车研究院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Q-MambaIR,通过动态平衡可学习标量和范围浮动灵活分配器,有效缓解极值截断损失,提升图像修复任务的压缩效率与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏