arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-08-11 至 2026-08-11 共收录 10
2608.09745 2026-08-11 cs.LG cs.AI stat.ML 新提交

SR-OPSD: Self-Referenced On-Policy Self-Distillation

SR-OPSD:自引用同策略自蒸馏

Zhuo Sun, Entong Li, Yanlong Zhao, Xiaoyuan Cheng, Wenxuan Yuan, Kaiyu Li, Che Liu, Huihang Liu, Harrison Bo Hua Zhu, Li Zeng

机构 * Shanghai University of Finance and Economics(上海财经大学) Imperial College London(伦敦帝国学院) University of Science and Technology of China(中国科学技术大学) University College London(伦敦大学学院) Nanyang Technological University(南洋理工大学) Technical University of Denmark(丹麦技术大学) University of Copenhagen(哥本哈根大学) Peking University(北京大学)

AI总结 该研究针对同策略自蒸馏的优化不稳定问题,提出SR-OPSD方法,通过几何插值结合Rényi散度优化蒸馏目标,在多任务大语言模型实验中取得最优或竞争性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09666 2026-08-11 cs.AI 新提交

Open Evaluation Agent: Efficient and Promptable Evaluation of Visual Generative Models

开放评估智能体:视觉生成模型的高效且可提示的评估

Shulin Tian, Ziqi Huang, Fan Zhang, Hongyuan Zhu, Yu Qiao, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S-Lab) Agency for Science, Technology and Research (A*STAR)(科学、技术与研究局(A*STAR)) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 该研究提出Evaluation Agent框架及基于其构建的Open-EA,可高效评估视觉生成模型,将评估时间减至传统方法的10%,还通过EA-CoT-10K和EA-3B减少对专有骨干的依赖,验证了其在多基准及跨家族的有效性。

Comments Journal extension of our ACL 2025 paper (arXiv:2412.09645). 12 pages. Code: https://github.com/Vchitect/Evaluation-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09580 2026-08-11 cs.AI 新提交

CoRCi: Cross-Reconstruction of Coherent Interests Modeling in Cross-Domain Sequential Recommendation

CoRCi:跨域序列推荐中连贯兴趣建模的跨重建方法

Qingtian Bian, Tieying Li, Marcus de Carvalho, Jiaxing Xu, Hui Fang, Yiping Ke

机构 * Nanyang Technological University(南洋理工大学) Northeastern University(东北大学) Shanghai University of Finance and Economics(上海财经大学)

AI总结 针对跨域序列推荐中域差异破坏兴趣连贯性的问题,本文提出CoRCi框架,通过跨重建方法和FocalNCE损失实现域不变兴趣对齐,在四个数据集上性能优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09286 2026-08-11 cs.LG cs.AI 新提交

VeinCast: Physics-Guided Dynamic Field Graphs with Graph-Conditioned Fusion for Global Medium-Range Weather Forecasting

VeinCast:用于全球中期天气预报的物理引导动态场图与图条件融合框架

Zhisheng Chen, Jinhan Li, Yuxuan Li, Yuan Gao, Hao Wu, Zheng Lu, Jinlong Du, Kun Wang, Bo An

机构 * Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) Peking University(北京大学) Tongji University(同济大学)

AI总结 本文提出VeinCast框架,通过物理引导动态场图与图条件融合,在1.5° ERA5基准上,于14天提前期的69个气象场预报任务中取得与主流模型相当的竞争力,证实关系级物理引导的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09158 2026-08-11 cs.SD cs.AI 新提交

From Inaudible Inputs to Model Failures: Low-Frequency Safety Risks in LALMs

从不可听输入到模型失效:LALMs中的低频安全风险

Yuanhe Zhang, Weiliu Wang, Jie Ren, Liang Lin, Zhenhong Zhou, Haoran Gao, Kun Wang, Chen Li, Li Sun, Sen Su

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Nanyang Technological University(南洋理工大学) JIUTIAN Research(九天研究院) Tencent ARC Lab(腾讯ARC实验室) Chongqing University of Posts and Telecommunications(重庆邮电大学)

AI总结 本文提出不可听红队测试方法ILL评估LALMs的低频安全风险,发现其可降低LALMs准确率达67个百分点,同时提出DRG防护方法可提升受攻击后的准确率,明确了LALMs此前被忽视的安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09146 2026-08-11 cs.CV 新提交

Multi-Submap Implicit Neural SLAM with Local-to-Global Loop Closure for Large-Scale Scene Reconstruction

面向大规模场景重建的结合局部到全局回环检测的多子图隐式神经SLAM

Tianchen Deng, Chongdi Wang, Nailin Wang, Lei Zhao, Ziqi Ma, Tianjun Zhang, Zhe Liu, Danwei Wang, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Carnegie Mellon University(卡内基梅隆大学) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)

AI总结 本文提出一种带多子图架构与双层回环检测机制的神经SLAM系统,结合渐进式建图、光流跟踪、局部到全局回环及子图间在线蒸馏算法,在大规模场景重建性能上优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08832 2026-08-11 cs.CV 新提交

Visual Token Codec: Unleashing Spatial Redundancy for ViT Feature Coding

视觉令牌编解码器:为ViT特征编码释放空间冗余

Donghui Feng, Fengxi Zhang, Changsheng Gao, Wenhan Yang, Qi Wang, Qunshan Gu, Hongwei Hu, Zhengxue Cheng, Li Song

机构 * School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University(上海交通大学电子信息与电气工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Pengcheng Laboratory(鹏城实验室) Ant Group(蚂蚁集团)

AI总结 针对ViT特征编码忽略二维补丁网格结构的问题,提出双路径视觉令牌编解码器VTC,在DINOv2、SAM3的分类等任务上,码率降低15.7-37.4倍且性能达未压缩的90%,表现优于基线。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08585 2026-08-11 cs.CV 新提交

EvTrajGS: Accurate and Efficient 3D Gaussian Splatting from Unposed Event Streams

EvTrajGS:基于无姿态事件流的精确高效3D高斯溅射(Gaussian Splatting)方法

Zixuan Chen, Jiakai Zhang, Junhao Dong, Guangcong Wang, Jianhuang Lai, Yew-Soon Ong, Xiaohua Xie

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Guangdong Province Key Laboratory of Information Security Technology(广东省信息安全技术重点实验室) Key Laboratory of Machine Intelligence and Advanced Computing, Ministry of Education(机器智能与先进计算教育部重点实验室) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Computing and Information Technology, Great Bay University(大湾区大学计算与信息技术学院)

AI总结 本文提出EvTrajGS框架,针对无姿态事件流实现精确高效的3D高斯溅射,通过连续时间轨迹参数化、时间耦合姿态更新及损失加权事件采样,在提升重建与姿态精度的同时降低计算开销,性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08199 2026-08-11 cs.AI 新提交

Persuasive and Compliant Tendencies Predict Group Decision-Making in Humans and Language Models

说服倾向与顺从倾向预测人类及语言模型的群体决策

Wenwen He, Wenke Huang, Wei Yang Bryan Lim, Dacheng Tao

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 该研究引入DecisionQE框架,以狼人杀为测试平台,发现顺从倾向强的LLM在群体决策中合作优势更稳定,且顺从兼具支持合作与提升对抗角色隐藏能力的双重效应,为LLM安全评估提供了新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07558 2026-08-11 cs.RO cs.CV 新提交

Learning Physical Interaction: A Survey of Tactile- and Force-aware Robot Learning

学习物理交互:触觉与力感知机器人学习综述

Shilin Shan, Chuhao Zhou, Ruize Wang, Xinyan Chen, Xiangyu Chen, Xinyu Zhou, Boyu Ma, Iris Yuxuan Hu, Jingliang Li, Celeste Yuxuan Hu, Geng Li, Guohao Chen, Tianrui Zhu, Zhe Li, Yanjie Ze, Haoran Geng, Zhiyang Dou, Jianxin Bi, Yuejiang Liu, Jianshu Zhou, Jiachen Li, Paul Liang, Tatsuya Harada, Robert Katzschmann, Harold Soh, Na Li, Edward Johns, Danica Kragic, Jan Peters, Wojciech Matusik, Masayoshi Tomizuka, Jitendra Malik, Jianfei Yang

机构 * Nanyang Technological University(南洋理工大学) Stanford University(斯坦福大学) University of California, Berkeley(加利福尼亚大学伯克利分校) Massachusetts Institute of Technology(麻省理工学院) National University of Singapore(新加坡国立大学) Georgia Institute of Technology(佐治亚理工学院) The University of Tokyo(东京大学) ETH Zurich(苏黎世联邦理工学院) Harvard University(哈佛大学) Imperial College London(伦敦帝国学院) KTH Royal Institute of Technology(瑞典皇家理工学院) Technical University of Darmstadt(达姆施塔特工业大学)

AI总结 本综述针对力与触觉感知机器人学习研究的空白,提出TF-ART分类法,整合多模态感知与多阶段系统设计视角,兼具算法与实践意义。

Comments 53 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏