arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

2026-06-04 至 2026-06-04 共收录 6
2606.04492 2026-06-04 cs.LG cs.GT

Episodic Memory Temporal Consistency for Cooperative Multi-Agent Reinforcement Learning

面向合作多智能体强化学习的 episodic 记忆时间一致性

Zicheng Zhao, Yu Lan, Chengzhengxu Li, Zhaohan Zhang, Xiaoming Liu

机构 * Xi’an Jiaotong University(西安交通大学) Queen Mary University of London(伦敦玛丽女王大学)

AI总结 针对合作多智能体强化学习中的奖励稀疏和探索瓶颈,提出 Episodic Memory Temporal Consistency (EMTC) 框架,通过时间一致性语义嵌入器和门控机制,防止表示崩溃并过滤伪成功轨迹,理论保证误差界,在 SMAC 和 GRF 基准上显著优于现有方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04483 2026-06-04 cs.CL

Off-Distribution Voices: Fanfiction Subgenres as Universal Vernacular Jailbreaks for Aligned LLMs

分布外声音:同人小说子类型作为对齐LLM的通用白话越狱

Zhongze Luo, Ruihe Shi, Zhenshuai Yin, Haoyue Liu, Weixuan Wan, Xiaoying Tang

机构 * School of Science and Engineering, The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)科学与工程学院) The Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来网络智能研究院) The Guangdong Provincial Key Laboratory of Future Networks of Intelligence(广东省未来网络智能重点实验室) School of Microelectronics, Xi’an Jiaotong University(西安交通大学微电子学院)

AI总结 本文发现安全训练覆盖不足的自然人类写作语域是对齐LLM的真正失败模式,并提出首个利用真实同人小说子类型作为通用攻击载体的越狱方法,显著提升攻击成功率。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18577 2026-06-04 cs.AI

MedForge: Interpretable Medical Deepfake Detection via Forgery-aware Reasoning

MedForge:基于伪造感知推理的可解释医学深度伪造检测

Zhihui Chen, Kai He, Qingyuan Lei, Bin Pu, Jian Zhang, Yuling Xu, Mengling Feng

机构 * National University of Singapore(新加坡国立大学) The Chinese University of Hong Kong(香港中文大学) Hunan University(湖南大学) Xi’an Jiaotong University(西安交通大学) Guangdong Provincial People’s Hospital(广东省人民医院)

AI总结 提出MedForge框架,通过构建大规模基准数据集MedForge-90K和局部-分析推理方法,实现可解释的医学图像伪造检测,在准确性和专家对齐解释上达到最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22601 2026-06-04 cs.LG

\textsc{Lethe}: Principled Dual-Stream Update for Persistent Knowledge Erasure in Federated Unlearning

\textsc{Lethe}: 用于联邦遗忘中持久知识擦除的原则性双流更新

Wentai Wu, Hanwei Tan, Yijun Quan, Haixia Peng, Ligang He, Bin Yang, C. L. Philip Chen

机构 * Department of Computer Science, College of Information Science and Technology, Jinan University(计算机科学系,信息科学与技术学院,暨南大学) WMG, University of Warwick(沃森盖尔学院,沃里克大学) School of Information and Communications Engineering, Xi’an Jiaotong University(信息与通信工程学院,西安交通大学) Department of Computer Science, University of Warwick(计算机科学系,沃里克大学) School of Data Science and Engineering, East China Normal University(数据科学与工程学院,华东师范大学) School of Computer Science and Engineering, South China University of Technology(计算机科学与工程学院,华南理工大学)

AI总结 针对联邦遗忘后继续训练导致已遗忘知识重新浮现的问题,提出Lethe方法,通过遗忘流和保留流的反对齐更新实现持久知识擦除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01192 2026-06-04 cs.CL

DEER: Disentangled Mixture of Experts with Instance-Adaptive Routing for Generalizable Machine-Generated Text Detection

DEER: 面向可泛化机器生成文本检测的实例自适应路由解耦专家混合模型

Guoxin Ma, Xiaoming Liu, Hongyang Chen, Chengzhengxu Li, Zhaohan Zhang, Shengchao Liu, Yu Lan, Cong Wang, Chao Shen

机构 * Faculty of Electronic and Information Engineering, Xi’an Jiaotong University(电子与信息工程学院,西安交通大学) China Mobile Group(中国移动集团) Queen Mary University of London(伦敦大学玛丽女王学院) City University of Hong Kong(香港城市大学)

AI总结 提出DEER框架,通过解耦领域局部与领域不变知识为专门专家模块,并利用强化学习驱动的路由器基于实例级检测奖励选择专家路径,解决机器生成文本检测中的领域偏移问题,在域内和域外数据集上均取得优于现有方法的性能。

Comments ARR Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08647 2026-06-04 cs.CL cs.AI

Can Reasoning Path still be Effective as Input? Bridging Post-Reasoning to Chain-of-Thought Compression

推理路径作为输入仍然有效吗?将后推理与思维链压缩连接起来

Chengzhengxu Li, Xiaoming Liu, Zhaohan Zhang, Shengchao Liu, Guoxin Ma, Yu Lan, Cong Wang, Chao Shen

机构 * Faculty of Electronic and Information Engineering, Xi’an Jiaotong University(西安交通大学电子与信息工程学院) Queen Mary University of London(伦敦大学玛丽女王学院) City University of Hong Kong(香港城市大学)

AI总结 提出后推理范式,通过将思维链作为上下文输入来简化推理任务,并设计UCoT框架训练轻量级压缩器生成软令牌形式的上下文思维链,从而在保持推理能力的同时显著压缩输出长度。

Comments ACL 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏