arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-08-04 至 2026-08-04 共收录 5
2608.02181 2026-08-04 cs.LG 新提交

Start Classifying: Categorical Critics for LLM Reinforcement Learning

开始分类:用于大语言模型强化学习的分类式评判器

Zhijian Zhou, Long Li, Xuan Zhang, Zongkai Liu, Yulei Qin, Ke Li, Xing Sun, Xiaoyu Tan, Chao Qu, Yuan Qi

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Tencent YoutuLab(腾讯优图实验室) Griffith University(格里菲斯大学) Shanghai Academy of Artificial Intelligence for Science(上海科学人工智能研究院)

AI总结 该研究提出HL-Gauss PPO,将PPO的标量评判器改为分类式预测器,在多任务及Qwen2.5、Qwen3主干上均优于PPO、DAPO基线,可改进评判器信号与优势估计。

Comments Accepted at COLM 2026. 26 pages, 9 figures. Code: https://github.com/ZhijianZhou/HL-guass-ppo

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02110 2026-08-04 cs.CL cs.AI 新提交

IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations

IACM-RL:动态意图波动下复杂工具调用的意图感知上下文管理与强化学习

Dingwei Zhu, Jiahan Li, Chengjun Pan, Yunxian Yang, Yunbin Zhao, Yunke Zhang, Zhonghang Lu, Zhuohui Sheng, Chenhao Huang, Jiahang Lin, Yajie Yang, Junlin Shang, Shichun Liu, Yuhui Wang, Honglin Guo, Junjie Ye, Xin Guo, Jiazheng Zhang, Ming Zhang, Shihan Dou, Zhiheng Xi, Tao Gui, Qi Zhang, Xipeng Qiu, Xuanjing Huang

机构 * Fudan University(复旦大学) Honor Device Co Ltd.(荣耀设备有限公司) Peking University(北京大学)

AI总结 针对动态意图波动下长程工具调用的意图偏差与无限API循环问题,提出IACM-RL框架,结合DynamicIntent流水线与BeliefState上下文管理器,在多基准上实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02091 2026-08-04 cs.LG 新提交

One QK Channel, Many Sources: Guarding Low-Precision Attention Collapse

一个QK通道,多个源:防范低精度注意力崩溃

Shuxiao Xie, Shuyang Xie, Yuan Cao, Dezhi Ran, Wei Yang, Tao Xie

机构 * Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)(北京通明湖信息技术应用创新中心(TLAIC)) Fudan University Institute of Systems for Advanced Computing(复旦大学先进计算系统研究所) Harbin Institute of Technology(哈尔滨工业大学) Peking University(北京大学) Shanghai Institute of Systems for Open Computing(上海开放计算系统研究所)

AI总结 本研究针对bfloat16变换器的低精度注意力崩溃问题,通过定位故障源与通道的分离关系,提出QK-Guard方法,可有效抑制注意力失控,支持在共享QK位点进行干预。

Comments 22 pages, 4 figures. Code and research artifacts: https://github.com/xieTwim/one-qk-channel-artifact

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01334 2026-08-04 cs.CV 新提交

SphereVideo: Prototype-anchored Hyperspherical Boundary for Continual AI-generated Video Detection

SphereVideo:用于持续AI生成视频检测的原型锚定超球面边界

Fei Li, Yue Yu, Yuran Wang, Xinghan Li, Jingjing Chen, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Peking University(北京大学)

AI总结 针对AI生成视频检测中持续学习框架不足的问题,提出SphereVideo框架,以超球面原型锚定与多尺度时序建模提升泛化性,在已见和未见数据上均优于现有方法

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00677 2026-08-04 cs.CL 新提交

OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution

OpenART:通过开放式环境演化扩展智能体红队演练规模

Yunhao Chen, Xin Wang, Yixu Wang, Yi Liu, Jie Li, Yan Teng, Xingjun Ma, Xia Hu, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) XSafeAI

AI总结 本研究针对现有智能体安全基准无法捕捉累积风险的问题,推出开放式智能体红队演练平台OpenART,并提出EMHA攻击方法,在75种智能体模型配置上实现85.0%的汇总攻击成功率,为复杂环境下的智能体安全研究提供可扩展基础。

详情

展开后加载摘要…

URL PDF HTML 收藏