arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 2226
2603.18636 2026-05-11 cs.CV

Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering

注意力稀疏性是输入稳定的:通过离线稀疏性分析和在线QK共聚类实现训练自由的视频生成稀疏注意力

Jiayi Luo, Jiayu Chen, Jiankun Wang, Cong Wang, Hanxin Zhu, Qingyun Sun, Chen Gao, Zhibo Chen, Jianxin Li

机构 * SKLCCSE, School of Computer Science and Engineering, Beihang University(软件学院,北京航空航天大学) Beihang University(北京航空航天大学) School of Computer Science, Peking University(北京大学计算机学院) the State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,中国科学院自动化研究所) School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) BNRist, Tsinghua University(北京理工大学,清华大学) Zhongguancun Academy(中关村学院)

AI总结 本文提出SVOO框架,通过离线层间稀疏性分析和在线双向共聚类实现训练自由的视频生成稀疏注意力,解决传统方法中层异质性和查询-键耦合问题,提升生成质量与速度的平衡。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15356 2026-05-11 eess.IV cs.AI

Q-Probe: Scaling Image Quality Assessment to High Resolution via Context-Aware Agentic Probing

Q-Probe:通过上下文感知代理探测扩展图像质量评估至高分辨率

Xiang Li, Xueheng Li, Yu Wang, Xuanhua He, Zhangchi Hu, Weiwei Yu, Chengjun Xie

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学) The Hong Kong University of Science and Technology(香港科学与技术大学) Institute of Intelligent Machines, Chinese Academy of Sciences(中国科学院智能 Machines 研究所)

AI总结 Q-Probe通过上下文感知探测方法解决高分辨率图像质量评估中的局部退化捕捉问题,提出Vista-Bench基准和三阶段训练框架,实现高分辨率下的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20909 2026-05-11 cs.CV eess.IV

Dino U-Net: Exploiting High-Fidelity Dense Features from Foundation Models for Medical Image Segmentation

Dino U-Net:利用基础模型的高保真密集特征进行医学图像分割

Haoyue Li, Yifan Gao, Feng Yuan, Xiaosong Wang, Xin Gao

机构 * School of Biomedical Engineering (Suzhou), Division of Life Science and Medicine, University of Science and Technology of China, Hefei, China(生物医学工程学院(苏州),生命科学与医学系,中国科学技术大学,合肥,中国) Suzhou Institute of Biomedical Engineering and Technology, Chinese Academy of Sciences, Suzhou, China(苏州生物医学工程与技术研究所,中国科学院,苏州,中国) Shanghai Innovation Institute, Shanghai, China(上海创新研究院,上海,中国) Medical School of Tianjin University, Tianjin, China(天津大学医学院,天津,中国) Jinan Guoke Medical and Technology Development Co., Ltd., Pharmaceutical Valley New Drug Creation Platform, Jinan, China(济南国科医药科技发展有限公司,药谷新药创制平台,济南,中国)

AI总结 本文提出Dino U-Net,通过融合DINOv3模型的语义特征与低层空间细节,提升医学图像分割精度,实验表明其在多种影像模态中均优于现有方法。

Comments MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06592 2026-05-08 cs.CV cs.AI cs.LG

DINORANKCLIP: DINOv3 Distillation and Injection for Vision-Language Pretraining with High-Order Ranking Consistency

DINORANKCLIP:基于DINOv3蒸馏与注入的视觉-语言预训练高阶排名一致性方法

Shuyang Jiang, Nan Yu, Yiming Zhang, Zenghui Ding, Zhenyu Wu

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Aimaikj(阿米亚克j) HFIPS, Chinese Academy of Sciences(中国科学院HFIPS) University of Science and Technology of China(中国科学技术大学) Chinese Academy of Sciences(中国科学院) National University of Defense Technology(国防科技大学)

AI总结 DINORANKCLIP通过融合DINOv3教师模型与高阶排名一致性损失,改进CLIP在视觉-语言预训练中的表现,提升细粒度和分布外推理能力。

Comments 18 pages, 7 figures, 9 tables. Code will be made publicly available upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06326 2026-05-08 cs.CL

Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning

教授思考模型进行工具推理:一种完整的全管道配方用于工具集成推理

Qianjia Cheng, Yuchen Zhang, Zhilin Wang, Yuxin Zuo, Shunkai Zhang, Yuchen Fan, Yu Qiao, Bowen Zhou, Ning Ding, Yu Cheng, Yun Luo, Ganqu Cui

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出一种全管道配方,通过注入自然工具使用行为提升强思考模型的工具集成推理能力,同时保持文本推理能力,展示在Qwen3模型上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06192 2026-05-08 cs.CV cs.AI cs.RO

EA-WM: Event-Aware Generative World Model with Structured Kinematic-to-Visual Action Fields

EA-WM:事件感知生成世界模型与结构运动-视觉动作场

Zhaoyang Yang, Yurun Jin, Lizhe Qi, Cong Huang, Kai Chen

机构 * Fudan University(复旦大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) University of Science and Technology of China(中国科学技术大学) DeepCybo(深瞳)

AI总结 EA-WM通过结构化运动-视觉动作场闭环连接运动控制与视觉感知,提升机器人空间几何和细粒度交互动态的生成精度。

Comments Preprint. 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06121 2026-05-08 cs.CV

Pest-Thinker: Learning to Think and Reason like Entomologists via Reinforcement Learning

Pest-Thinker: 通过强化学习学习像昆虫学家一样思考和推理

Xueheng Li, Yu Wang, Tao Hu, Ji Huang, Ke Cao, Qize Yang, Rui Li, Jie Zhang, Chengjun Xie

机构 * Institute of Intelligent Machines, Hefei Institute of Physical Science, Chinese Academy of Sciences(智能机器研究所、合肥物理科学研究所、中国科学院) University of Science and Technology of China(中国科学技术大学) Zhongke Hefei Institute of Technology Innovation Engineering(中科创新合肥科技研究院) Hefei University of Technology(合肥工业大学)

AI总结 本文提出Pest-Thinker框架,通过强化学习提升多模态大语言模型对害虫形态的细粒度理解,构建了两个高精度害虫基准数据集,并通过监督微调和GRPO优化提升模型在农业害虫识别中的表现。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15270 2026-05-08 cs.CL cs.AI

From Documents to Spans: Scalable Supervision for Evidence-Based ICD Coding with LLMs

从文档到跨度:基于LLM的证据导向ICD编码可扩展监督方法

Xu Zhang, Wenxin Ma, Chenxu Wu, Rongsheng Wang, Zhiyang He, Xiaodong Tao, Kun Zhang, S. Kevin Zhou

机构 * School of Biomedical Engineering, Division of Life Sciences and Medicine, USTC(生物医学工程学院,生命科学与医学系,中国科学技术大学) MIRACLE Center, Suzhou Institute for Advance Research, USTC(MIRACLE中心,苏州先进研究院,中国科学技术大学) Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology(江苏省多模态数字孪生技术重点实验室) State Key Laboratory of Precision and Intelligent Chemistry, USTC(精密与智能化学国家重点实验室)

AI总结 本文提出Span-Centric Learning框架,通过局部跨度学习提升ICD编码能力,以更低成本实现宏F1提升8.2点,并提供明确证据支持预测代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05854 2026-05-08 cs.AI

AirQualityBench: A Realistic Evaluation Benchmark for Global Air Quality Forecasting

AirQualityBench:一个用于全球空气质量预报的现实评估基准

Xing Xu, Xu Wang, Yudong Zhang, Huilin Zhao, Zhengyang Zhou, Yang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Suzhou Institute for Advanced Research(苏州先进研究院) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出AirQualityBench,一个全球多污染物基准,用于评估在现实条件下(如不均匀覆盖、缺失数据等)的空气质量预报模型,揭示了在标准化数据集上表现良好的模型在真实场景中可能不适用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05832 2026-05-08 cs.AI

MolRecBench-Wild: A Real-World Benchmark for Optical Chemical Structure Recognition

MolRecBench-Wild:光学化学结构识别的现实世界基准

Haote Yang, Hui Wang, Chen Zhu, Jingchao Wang, Linye Li, Hongbin Lai, Huijie Ao, Yongxuan Lyu, Jiang Wu, Jiaxing Sun, Lua Chen, Yuanyuan Cao, Ruijie Zhang, Shengxin Lu, Lijun Wu, Bin Wang, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) King’s College London(伦敦国王学院) East China University of Science and Technology(东华大学) East China Normal University(东华师范大学) Tongji University(同济大学) Peking University(北京大学) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出MolRecBench-Wild基准,包含5029个化学结构,覆盖真实出版物中的难度范围,通过CARBON表示语言和双轨评估协议提升语义评估能力,揭示现有专利基准与现实学术场景间的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04719 2026-05-08 cs.CL

Every Step Counts: Step-Level Credit Assignment for Tool-Integrated Text-to-SQL

每一步都重要:面向工具集成文本到SQL的步骤级信用分配

Yaxun Dai, Baolin Sun, Junying Wang, Pengfei Wang, Yingqi Gao, Xuemei Dong, Mengdie Chu, Xiang Qi, Pingfu Chao

机构 * Institute of Computer Science and Technology, Soochow University, China(苏州大学计算机科学与技术学院) Ant Digital Technologies, Ant Group(蚂蚁集团数字技术部) School of Management, University of Science and Technology of China(中国科学技术大学管理学院)

AI总结 本文提出FineStep框架,通过独立过程奖励设计和步骤级信用分配机制,解决文本到SQL中粗粒度监督导致的信用分配问题,提升模型效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23629 2026-05-08 cs.AI cond-mat.dis-nn cond-mat.stat-mech cs.LG physics.soc-ph

Emergent Slow Thinking in LLMs as Inverse Tree Freezing

大语言模型中涌现的慢思考作为逆树冻结

Sihan Hu, Xiansheng Cai, Yuan Huang, Zhiyuan Yao, Linfeng Zhang, Pan Zhang, Youjin Deng, Kun Chen

机构 * Hefei National Laboratory, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室) Hefei National Laboratory for Physical Sciences at the Microscale and Department of Modern Physics, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室和现代物理系) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所) School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院基础物理与数学科学学院) DP Technology(DP技术) Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics, Lanzhou University(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科省重点实验室、兰州大学) AI for Science Institute, Beijing(北京人工智能科学研究院)

AI总结 本文通过统计物理视角揭示大语言模型中慢思考的涌现机制,提出逆树冻结结构,并提出Annealed-RLVR方法提升模型性能。

Comments 34 pages, 17 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11659 2026-05-08 cs.NE cs.AI cs.LG q-bio.NC

Toward Practical Equilibrium Propagation: Brain-inspired Recurrent Neural Network with Feedback Regulation and Residual Connections

迈向实用的平衡传播:受大脑启发的具有反馈调节和残差连接的循环神经网络

Zhuo Liu, Tao Chen

机构 * School of Microelectronics University of Science and Technology of China(微电子学院 中国科学技术大学)

AI总结 本文提出一种受大脑启发的反馈调节残差循环神经网络(FRE-RNN),通过减少谱半径加速收敛,显著降低计算成本,性能与反向传播相当,同时缓解深度RNN中梯度消失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21938 2026-05-08 cs.LG cs.AI cs.CR

Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection

针对随机带隙的实用对抗攻击:通过伪造数据注入

Qirun Zeng, Eric He, Richard Hoffmann, Xuchuang Wang, Jinhang Zuo

机构 * University of Science and Technology of China(中国科学技术大学) California Institute of Technology(加州理工学院) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) City University of Hong Kong(香港城市大学)

AI总结 本文提出一种更实际的对抗模型,通过有限的伪造反馈样本误导带隙算法,分析了在现实约束下对抗攻击的可行性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01479 2026-05-05 cs.CV

CSGuard: Toward Forgery-Resistant Watermarking in Diffusion Models via Compressed Sensing Constraint

CSGuard:通过压缩感知约束实现扩散模型中的抗伪造水印技术

Jiewei Lai, Lan Zhang, Chen Tang, Pengcheng Sun, Zhaopeng Zhang, Yunhao Wang, Hui Jin

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(人工智能研究所,合肥国家科学中心) Lenovo Research(联想研究院)

AI总结 CSGuard通过压缩感知约束实现扩散模型的抗伪造水印技术,确保只有持有秘密矩阵的用户才能正确嵌入或验证图像水印,有效防止伪造攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01298 2026-05-05 cs.CR cs.CV

Checkerboard: A Simple, Effective, Efficient and Learning-free Clean Label Backdoor Attack with Low Poisoning Budget

Checkerboard:一种简单、有效、高效且无需学习的清洁标签后门攻击,具有低污染预算

Yi Yang, Jinyang Huang, Binbin Liu, Feng-Qi Cui, Xiaokang Zhou, Zhi Liu, Jie Zhang, Meng Li

机构 * School of Computer Science and Information Engineering(计算机科学与信息工程学院) Hefei University of Technology(合肥工业大学) School of Information Science and Technology(信息科学与技术学院) University of Science and Technology of China(中国科学技术大学) Faculty of Business Data Science(商务数据科学学院) Kansai University(大阪大学) RIKEN Center for Advanced Intelligence Project(日本RIKEN先进人工智能研究中心) The University of Electro-Communications(电通大学) Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR))

AI总结 Checkerboard提出一种无需学习的清洁标签后门攻击方法,通过线性可分性公式推导出检查板触发器,无需代理模型训练和触发器优化,在低污染预算下实现高攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10101 2026-05-05 cs.RO

Robo3R: Enhancing Robotic Manipulation with Accurate Feed-Forward 3D Reconstruction

Robo3R:通过精确的前馈3D重建增强机器人操作

Sizhe Yang, Linning Xu, Hao Li, Juncheng Mu, Jia Zeng, Dahua Lin, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学)

AI总结 Robo3R通过前馈3D重建模型,直接从RGB图像和机器人状态实时预测高精度场景几何,提升机器人操作的精度与一致性。

Comments Published at Robotics: Science and Systems (RSS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25020 2026-05-05 cs.LG

Deep Thinking by Markov Chain of Continuous Thoughts

基于连续思维的马尔可夫链深度思考

Jiayu Liu, Zhenya Huang, Xuan Yang, Tianyun Ji, Anya Sims, Hao Xu, Enhong Chen, Yee Whye Teh, Ning Miao

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学) Department of Statistics, University of Oxford(牛津大学统计系) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系) Hong Kong Institute of AI for Science, City University of Hong Kong(香港人工智能科学研究院,香港城市大学)

AI总结 本文提出MarCos模型,通过连续表示实现多步推理,提升数学任务处理速度,实现并行思维。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21214 2026-05-04 cs.CL cs.LG

Scaling Reasoning Hop Exposes Weaknesses: Demystifying and Improving Hop Generalization in Large Language Models

推理步扩展揭示弱点:解密和改进大语言模型中的推理泛化

Zhaoyi Li, Jiatong Li, Gangwei Jiang, Linqi Song, Defu Lian, Ying Wei

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Zhejiang University(浙江大学) City University of Hong Kong, Shenzhen Research Institute(香港城市大学深圳研究院)

AI总结 本文通过多领域任务研究发现,推理错误集中在少数关键错误类型的位置,而非均匀分布。提出在推理过程中动态识别并禁用错误处理头,从而提升推理步泛化能力。

Comments 52 pages, accepted by ICLR 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00702 2026-05-04 cs.CL

Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory

学习如何和记忆什么:受认知启发的两阶段优化用于进化记忆

Derong Xu, Shuochen Liu, Pengfei Luo, Pengyue Jia, Yingyi Zhang, Yi Wen, Yimin Deng, Wenlin Zhang, Enhong Chen, Xiangyu Zhao, Tong Xu

机构 * University of Science and Technology of China & State Key Laboratory of Cognitive Intelligence(中国科学技术大学 & 认知智能国家重点实验室) City University of Hong Kong(香港城市大学) Dalian University of Technology(大连理工大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出MemCoE框架,通过两阶段优化学习记忆组织方式和更新内容,提升长期个性化记忆的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00500 2026-05-04 cs.LG

Scaling Federated Linear Contextual Bandits via Sketching

通过降维实现联邦线性上下文老虎机的扩展

Hantao Yang, Hong Xie, Xutong Liu, Defu Lian

机构 * University of Science and Technology of China(中国科学技术大学) University of Washington Tacoma(华盛顿大学塔可姆分校)

AI总结 本文提出FSCLB算法,通过SVD和双降维策略降低联邦线性上下文老虎机的计算和通信开销,理论分析证明其在降维后仍能保持最优 regret 绑定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00342 2026-05-04 cs.CL

Making Every Verified Token Count: Adaptive Verification for MoE Speculative Decoding

让每个验证的标记都值得:MoE推测解码的自适应验证

Lehan Pan, Ziyang Tao, Ruoyu Pang, Xiao Wang, Jianjun Zhao, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Tianyijiaotong Technology Ltd.(天翼教育科技有限公司)

AI总结 本文提出EVICT方法,通过截断草案树和保留成本有效的前缀,提升MoE推测解码效率,实验表明其在速度和减少专家激活方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26848 2026-05-04 cs.RO

STARRY: Spatial-Temporal Action-Centric World Modeling for Robotic Manipulation

STARRY:面向机器人操作的时空动作中心世界建模

Yuxuan Tian, Yurun Jin, Bin Yu, Yukun Shi, Hao Wu, Chi Harold Liu, Kai Chen, Cong Huang

机构 * Beijing Institute of Technology(北京理工大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学) East China Normal University(华东师范大学) DeepCybo

AI总结 STARRY通过统一扩散过程联合去噪未来时空潜在表示和动作,提升机器人操作中时空协调的精度与成功率。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27840 2026-05-01 cs.LG cs.AI

CastFlow: Learning Role-Specialized Agentic Workflows for Time Series Forecasting

CastFlow:学习用于时间序列预测的角色专用代理工作流

Bokai Pan, Mingyue Cheng, Zhiding Liu, Shuo Yu, Xiaoyu Tao, Yuchong Wu, Qi Liu, Defu Lian, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

AI总结 CastFlow通过动态代理框架实现多视角时间模式提取和多轮上下文特征获取,提升时间序列预测的准确性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27747 2026-05-01 cs.IR cs.AI

Position-Aware Drafting for Inference Acceleration in LLM-Based Generative List-Wise Recommendation

基于位置感知的drafting用于LLM生成列表式推荐的推理加速

Jiaju Chen, Chongming Gao, Chenxiao Fan, Haoyan Liu, Qingpeng Cai, Peng Jiang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学) Zhongguancun Academy(中关村学院) Independent Researcher(独立研究员)

AI总结 本文提出PAD-Rec,通过引入位置感知drafting机制,提升生成式推荐的推理效率,实验显示在四个真实数据集上达到3.1倍的时钟速度提升,并保持推荐质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19322 2026-05-01 cs.NI cs.AI cs.DC

Enabling Reconfiguration-Communication Overlap for Collective Communication in Optical Networks

使集体通信在光网络中实现重配置-通信重叠

Changbo Wu, Zhuolong Yu, Gongming Zhao, Hongli Xu

机构 * School of Computer Science and Technology, University of Science and Technology of China (USTC)(科学技术大学计算机科学与技术学院) Shanghai Innovation Institute(上海创新研究院) Suzhou Institute for Advanced Research, USTC(先进研究院,USTC)

AI总结 本文提出SWOT框架,通过动态对齐网络资源与集体通信流量模式,减少通信完成时间达89.7%,提升光网络在分布式机器学习中的效率。

Comments Accepted at ACM CoNEXT '26. To be published in Proceedings of the ACM on Networking (PACMNET), Volume 4, CoNEXT2, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07180 2026-05-01 cs.CL cs.AI cs.CV

Flattery in Motion: Benchmarking and Analyzing Sycophancy in Video-LLMs

视频中的奉承:视频大语言模型中奉承行为的基准测试与分析

Wenrui Zhou, Mohamed Hendy, Shu Yang, Qingsong Yang, Zikun Guo, Yuyu Luo, Lijie Hu, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证负责任人工智能与数据 analytics 实验室) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹科学与技术大学) HKUST(香港科技大学) MBZUAI(穆罕默德·本·拉希德人工智能研究所) University of Science and Technology of China(中国科学技术大学) Kyungpook National University(庆尚国立大学)

AI总结 本文提出VISE基准,用于评估视频大语言模型在面对误导性输入时的奉承行为,通过多类型分析和两种无训练缓解策略提升模型可靠性。

Comments 27 Pages, Accepted by ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27725 2026-05-01 cs.HC cs.AI

AgentEconomist: An End-to-end Agentic System Translating Economic Intuitions into Executable Computational Experiments

AgentEconomist:一个端到端的代理系统,将经济直觉转化为可执行的计算实验

Jiaju Chen, Jinghua Piao, Xia Xu, Songwei Li, Tong Xia, Xiangnan He, Yong Li

机构 * Zhongguancun Academy(中关村学院) University of Science and Technology of China(中国科学技术大学) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Vanke School of Public Health, Tsinghua University(清华大学万科公共卫生学院)

AI总结 AgentEconomist通过模块化多阶段架构,将经济直觉转化为可执行的计算实验,通过文献基础假设生成、实验设计和执行阶段,结合人类与AI协作,提升研究创新性与文献相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02845 2026-05-01 cs.CL cs.AI

TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents

TiMem:用于长时域对话代理的时序-层次记忆巩固

Kai Li, Xuanqing Yu, Ziyi Ni, Yi Zeng, Yao Xu, Zheqing Zhang, Xin Li, Jitao Sang, Xiaogang Duan, Xuelei Wang, Chengbao Liu, Jie Tan

机构 * Institute of Automation, CAS(中国科学院自动化研究所) School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) AI Lab, AIGility Cloud Innovation(AIGility云创新AI实验室) North China Electric Power University(华北电力大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Gaoling School of Artificial Intelligence, RUC(中国人民大学高陵人工智能学院) School of Biomedical Engineering, USTC(中国科学技术大学生物医学工程学院) Suzhou Institute for Advance Research, USTC(中国科学技术大学苏州市先进研究院) School of Computer Science and Technology, BJTU(北京理工大学计算机科学与技术学院) Hunan Central South Intelligent Equipment Co., Ltd.(湖南中南智能装备有限公司)

AI总结 TiMem通过时序记忆树实现对话记忆的系统性巩固,提升长时域个性化效果,实现75.30%和76.88%的基准测试准确率。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15549 2026-05-01 cs.CL

M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets

M-DaQ:用于指令微调数据集的多语言多样性与质量样本检索

Chunguang Zhao, Yilun Liu, Pufan Zeng, Yuanchang Luo, Shimin Tao, Minggui He, Weibin Meng, Song Xu, Chen Liu, Hongxia Ma, Li Zhang, Boxing Chen, Daimeng Wei

机构 * Huawei Technologies Ltd.(华为技术有限公司) University of Science and Technology of China(中国科学技术大学)

AI总结 M-DaQ通过联合优化指令-响应质量与跨语言语义多样性,构建高质量平衡训练数据,验证了多语言设置下的Superficial Alignment Hypothesis,并在18种语言上展示出超过60%的胜率。

Comments Accepted by SIGIR 2026 Short

详情

展开后加载摘要…

URL PDF HTML 收藏