arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-05-04 至 2026-05-04 共收录 9
2605.00638 2026-05-04 cs.LG cs.DS

Unlearning Offline Stochastic Multi-Armed Bandits

撤销离线随机多臂老虎机

Zichun Ye, Runqi Wang, Xuchuang Wang, Xutong Liu, Shuai Li, Mohammad Hajiesmaili

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) University of Washington, Tacoma, United States(华盛顿大学 Tacoma 分校) University of Massachusetts Amherst, Massachusetts, United States(马萨诸塞大学阿姆赫斯特分校)

AI总结 本文首次研究离线随机多臂老虎机中的撤销问题,提出适应性算法并在两种数据生成模型下建立性能保证和下界。

Comments First two authors made an equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00517 2026-05-04 cs.CV

PhysiGen: Integrating Collision-Aware Physical Constraints for High-Fidelity Human-Human Interaction Generation

PhysiGen:整合碰撞感知的物理约束以生成高保真的人-人交互

Nan Lei, Yuan-Ming Li, Ling-An Zeng, Liang Xu, Zhi-Wei Xia, Hui-Wen Huang, Fa-Ting Hong, Wei-Shi Zheng

机构 * Sun Yat-sen University(中山大学) The Hong Kong University of Science and Technology(香港科学与技术大学) Shanghai Jiao Tong University(上海交通大学) Guilin University of Electronic Technology(桂林电子科技大学)

AI总结 本文提出PhysiGen方法,通过简化人体网格和优化碰撞区域,提升多人体交互生成的现实感和物理合理性。

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00020 2026-05-04 cs.LG cs.AI cs.IT eess.SP math.IT

AirFM-DDA: Air-Interface Foundation Model in the Delay-Doppler-Angle Domain for AI-Native 6G

AirFM-DDA:用于AI原生6G的延迟-多普勒-角度域空气接口基础模型

Kejia Bian, Meixia Tao, Jianhua Mo, Zhiyong Chen, Leyan Chen

机构 * School of Information Science and Electronic Engineering, Shanghai Jiao Tong University, Shanghai, 200240, China(上海交通大学信息科学与电子工程学院,上海,200240,中国) Shanghai Innovation Institute, Shanghai 200231, China(上海创新研究院,上海200231,中国)

AI总结 本文提出AirFM-DDA,一种在延迟-多普勒-角度域运作的空气接口基础模型,用于物理层任务,通过重新参数化CSI并引入帧结构感知位置编码,提升零样本泛化能力与计算效率。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28158 2026-05-04 cs.AI

Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists

Intern-Atlas:一种方法论进化图作为人工智能科学家的研究基础设施

Yujun Wu, Dongxu Zhang, Xinchen Li, Jinhang Xu, Yiling Duan, Yumou Liu, Jiabao Pan, Qiyuan Zhu, Xuanhe Zhou, Jingxuan Wei, Siyuan Li, Jintao Chen, Conghui He, Cheng Tan

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Peking University(北京大学) Xi'an Jiaotong University(西安交通大学) Zhejiang University(浙江大学) East China Normal University(华东师范大学) Hunan University(湖南大学) Shanghai Jiao Tong University(上海交通大学) Shanghai University(上海大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 Intern-Atlas通过构建方法论进化图,自动识别方法实体,推断方法间的关系,并捕捉驱动创新过渡的瓶颈,为AI研究提供因果网络支持。

Comments 25 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24496 2026-05-04 cs.LG cs.AI

LLM DNA: Tracing Model Evolution via Functional Representations

LLM DNA:通过功能表示追溯模型进化

Zhaomin Wu, Haodong Zhao, Ziyang Wang, Jizhou Guo, Qian Wang, Bingsheng He

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Zhiyuan College, Shanghai Jiao Tong University(上海交通大学智远学院)

AI总结 本文提出LLM DNA概念,通过低维生物利普希茨表示捕捉模型功能行为,解决现有方法的局限性,实验显示其在模型关系分析和进化树构建中的有效性。

Comments ICLR 2026 (Oral)

Journal ref International Conference on Learning Representations 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24276 2026-05-04 cs.AI

G-reasoner: Foundation Models for Unified Reasoning over Graph-structured Knowledge

G-reasoner:用于统一图结构知识推理的基础模型

Linhao Luo, Zicheng Zhao, Junnan Liu, Zhangchi Qiu, Junnan Dong, Serge Panev, Chen Gong, Thuy-Trang Vu, Gholamreza Haffari, Dinh Phung, Alan Wee-Chung Liew, Shirui Pan

机构 * Monash University(莫纳什大学) Nanjing University of Science and Technology(南京理工大学) Griffith University(格里菲斯大学) Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室) NVIDIA(英伟达)

AI总结 G-reasoner通过整合图与语言基础模型,实现对多样化图结构知识的高效推理,采用标准化四层抽象QuadGraph统一异构知识源,并通过混合精度训练和分布式消息传递提升效率与泛化能力。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23330 2026-05-04 cs.CL

Structured In-context Environment Scaling for Large Language Model Reasoning

结构化上下文环境扩展用于大语言模型推理

Peng Yu, Zeyuan Zhao, Shao Zhang, Luoyi Fu, Xinbing Wang, Ying Wen

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出SIE框架,通过自动构建结构化数据环境提升大语言模型的推理能力,实现可扩展性、通用性和可验证性,实验显示其在结构化推理和跨领域逻辑推理中的有效性。

Comments Title modified for greater clarity and better alignment with the paper's focus

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23723 2026-05-04 cs.CL cs.AI cs.LG

ML-Agent: Reinforcing LLM Agents for Autonomous Machine Learning Engineering

ML-Agent: 通过强化学习增强大语言模型代理以实现自主机器学习工程

Zexi Liu, Jingyi Chai, Xinyu Zhu, Shuo Tang, Rui Ye, Bo Zhang, Lei Bai, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文提出基于强化学习的代理机器学习框架,通过探索增强微调、分步强化学习和专用奖励模块,训练出性能媲美大模型但成本更低的ML-Agent,实现跨任务泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18015 2026-05-04 cs.CR cs.CV cs.LG

DiffMI: Breaking Face Recognition Privacy via Diffusion-Driven Training-Free Model Inversion

DiffMI:通过扩散驱动的无训练模型逆向攻击破解人脸识别隐私

Hanrui Wang, Shuo Wang, Chun-Shien Lu, Isao Echizen

机构 * Echizen Lab, National Institute of Informatics (NII)(筑前实验室,日本国立信息学研究所) Shanghai Jiao Tong University(上海交通大学) Institute of Information Science, Academia Sinica(学术院信息科学研究所)

AI总结 本文提出DiffMI,一种基于扩散的无训练模型逆向攻击方法,通过鲁棒潜在码初始化、对抗性细化策略和统计学基础的优化目标,实现对未知目标身份和人脸识别模型的有效攻击,具有更高的适应性和更低的计算开销。

Comments IEEE Transactions on Information Forensics and Security

Journal ref IEEE Transactions on Information Forensics and Security, vol. 21, 2026. 4275-4290

详情

展开后加载摘要…

URL PDF HTML 收藏