arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Tsinghua University(清华大学)

共收录 4536
2508.12628 2026-05-26 cs.CV

Creative4U: MLLMs-based Advertising Creative Image Selector with Comparative Reasoning

Creative4U: 基于MLLMs的广告创意图像选择器与比较推理

Yukang Lin, Xiang Zhang, Shichang Jia, Bowen Wan, Chenghan Fu, Xudong Ren, Yueran Liu, Wanxian Guan, Pengji Wang, Jian Xu, Bo Zheng, Baolin Liu

机构 * Tsinghua University(清华大学) Alibaba Group(阿里巴巴集团)

AI总结 提出基于多模态大语言模型的创意图像评估与选择范式,通过构建比较推理数据集CreativePair和强化学习方法Creative4U,实现可解释的创意选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12538 2026-05-26 cs.CR cs.AI cs.SE

MCPXKIT: The Unified Toolkit for Analyzing Model Context Protocol Security

MCPXKIT:分析模型上下文协议安全性的统一工具包

Yongjian Guo, Puzhuo Liu, Wanlun Ma, Zehang Deng, Xiaogang Zhu, Peng Di, Xi Xiao, Sheng Wen

机构 * Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(深圳国际研究生院,清华大学,深圳,中国) Ant Group, Hangzhou, China(蚂蚁集团,杭州,中国) Swinburne University of Technology, Melbourne, Australia(斯威本科技大学,墨尔本,澳大利亚) The University of Adelaide, Adelaide, Australia(阿德莱德大学,阿德莱德,澳大利亚) UNSW Sydney, Australia(悉尼大学,澳大利亚)

AI总结 本文提出MCPXKIT工具包,分类实现了31种攻击方法,通过定量实验揭示了MCP在工具描述依赖、文件攻击、链攻击及数据命令区分等方面的漏洞,并提供了安全增强建议。

Comments Accepted by IEEE Transactions on Dependable and Secure Computing (TDSC). $\href{https://ieeexplore.ieee.org/abstract/document/11531012}{Official \ version}$

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18190 2026-05-26 eess.SP cs.AI cs.LG

PhySense: Sensor Placement Optimization for Accurate Physics Sensing

PhySense:面向精确物理感知的传感器布局优化

Yuezhou Ma, Haixu Wu, Hang Zhou, Huikun Weng, Jianmin Wang, Mingsheng Long

机构 * School of Software, BNRist, Tsinghua University(软件学院,BNRist,清华大学)

AI总结 提出PhySense两阶段框架,通过流生成模型和投影梯度下降联合优化传感器布局与物理场重建,实现高精度物理感知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08155 2026-05-26 cs.AI

Efficient and Scalable Neural Symbolic Search for Knowledge Graph Complex Query Answering

高效且可扩展的神经符号搜索用于知识图谱复杂查询回答

Weizhi Fei, Zihao Wang, hang Yin, Shukai Zhao, Wei Zhang, Yangqiu Song

机构 * Department of Mathematical Sciences, Tsinghua University(清华大学数学科学系) Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港理工大学计算机科学与工程系) Department of Computer Sciences, University of Rochester(罗切斯特大学计算机科学系)

AI总结 提出一种结合约束策略和局部搜索的神经符号方法,以降低数据复杂度和近似解决NP难的循环查询,实现高效可扩展的复杂查询回答。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04545 2026-05-26 cs.LG math.ST stat.TH

Branch Scaling Manifests as Implicit Architectural Regularization for Improving Generalization in Overparameterized ResNets

分支缩放表现为隐式架构正则化以改善过参数化ResNet的泛化能力

Zixiong Yu, Guhan Chen, Jianfa Lai, Bohan Li, Songtao Tian

机构 * Huawei Large Model Data Technology Lab, Shenzhen(华为大模型数据技术实验室,深圳) Tsinghua University, Beijing(清华大学,北京) Kyoto University, Kyoto(京都大学,京都)

AI总结 本文研究残差网络中分支缩放因子对过参数化ResNet泛化性能的影响,通过理论分析证明快速深度衰减的缩放因子结合早停可实现极小极大最优泛化率,并利用神经正切核(NTK)近似解释其机制。

Comments Accepted by ICML. This version incorporates content from the preprint arXiv:2305.18506. The contributors of the relevant content have consented to its inclusion and have been listed as authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14853 2026-05-26 math.OC cs.LG

Near-Optimal Nonconvex-Strongly-Convex Bilevel Optimization with Fully First-Order Oracles

基于全一阶Oracle的近似最优非凸强凸双层优化

Lesi Chen, Yaohua Ma, Jingzhao Zhang

机构 * IIIS, Tsinghua University(清华大学人工智能院) Shanghai Qi Zhi Institute(上海启智研究院) Shanghai AI Lab(上海人工智能实验室)

AI总结 针对下层问题强凸的双层优化,提出一种两时间尺度更新的一阶方法,在确定性设置下达到近最优的$\tilde{\mathcal{O}}(\varepsilon^{-2})$一阶Oracle复杂度,并扩展到随机和高阶光滑场景。

Comments JMLR 2025; fix a bug in the proof in Appendix E compared to the journal version

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24969 2026-05-26 cs.LG cs.AI

OSDTW: Optimal Shared Depth and Task Weighting for Long-Tailed Recognition

OSDTW:长尾识别的最优共享深度与任务加权

Chang Chu, Qingyue Zhang, Shao-Lun Huang, Junxiong Zheng

机构 * Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,中国深圳) Shenzhen Zkosemi Semiconductor Technology Co., Ltd(深圳卓芯半导体科技有限公司)

AI总结 提出OSDTW框架,通过分解任务、共享编码器与任务特定解码器,并基于Fisher信息矩阵推导泛化误差的偏置-方差分解,以优化共享深度和任务权重,解决长尾识别中头部-尾部性能权衡问题。

Comments ICIC 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24922 2026-05-26 cs.RO

MuJoCoUni:Persistent Batched Runtime Primitives for MuJoCo

MuJoCoUni:MuJoCo的持久化批处理运行时原语

Yufei Jia, Junzhe Wu

机构 * Tsinghua University(清华大学)

AI总结 提出MuJoCoUni,一个用于在线机器人学习和批处理物理评估的MuJoCo下游发行版,通过BatchEnvPool提供有状态环境执行的运行时原语,支持高吞吐并行执行并保持上游语义。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24675 2026-05-26 cs.CV cs.AI

VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Translation

VaaWIT: 面向多语言网页图像翻译的大语言模型视觉感知适配

Bo Li, Ronghao Chen, Ningyuan Deng, Huacan Wang, Shaolin Zhu, Lijie Wen

机构 * The Hong Kong University of Science(香港科技大学) Tianjin University(天津大学) Tsinghua University(清华大学)

AI总结 针对网页图像翻译中视觉表示差距问题,提出VaaWIT框架,通过双流注意力模块和视觉感知适配器,实现大语言模型对细粒度视觉特征的动态融合,在多个基准上超越开源模型并接近闭源模型性能。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24652 2026-05-26 cs.AI cs.CV cs.MM cs.SD

AVBench: Human-Aligned and Automated Evaluation Benchmark for Audio-Video Generative Models

AVBench:面向音视频生成模型的人类对齐与自动化评估基准

Jialiang Yang, Bin Xia, Ruihang Chu, Dingdong Wang, Wanke Xia, Zhun Mou, Tianyang Zhong, Yiting Zhao, Wenming Yang

机构 * Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 提出AVBench,通过细粒度人类中心指标和偏好学习训练的专业评估器,实现音视频生成的自动化、准确评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24639 2026-05-26 cs.CV cs.AI

DisDop: Distillation with Domain Priors for Open-Vocabulary Aerial Object Detection

DisDop: 基于领域先验蒸馏的开放词汇航空目标检测

Ruihao Xu, Yong Liu, Yansong Tang, Sule Bai, Xubing Ye, Bingyao Yu, Yutao Guo, Jiwen Lu, Jie Zhou

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Tsinghua University(清华大学)

AI总结 提出DisDop框架,通过从遥感基础模型(RemoteCLIP和DINOv3)中系统蒸馏多级领域先验知识到轻量级检测器,实现开放词汇航空目标检测的最新性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24593 2026-05-26 cs.CV

Self-supervised Dynamic Heterogeneous Degradation Modeling for Unified Zero-Shot Image Restoration

自监督动态异质退化建模用于统一零样本图像恢复

XiaoWan Hu, Jing Yang, HeNan Liu, HuaQiu Li, Mai Xu

机构 * Beihang University(北航) Tsinghua University(清华大学)

AI总结 提出统一物理零样本图像恢复框架,通过将异质退化重参数化为同质分布并引入动态质量细化策略,实现单/混合退化下的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24539 2026-05-26 cs.AI

DemoEvolve: Overcoming Sparse Feedback in Agentic Harness Evolution with Demonstrations

DemoEvolve:利用演示克服智能体框架演化中的稀疏反馈

Lirong Che, Yuzhe yang, Peiwen lin, Chuang wang, Xueqian wang, Jian su

机构 * Tsinghua University(清华大学) AgiBot

AI总结 提出DemoEvolve方法,通过人类演示引导框架演化,解决长时域随机环境中自生成轨迹因稀疏反馈和高方差导致的脆弱性问题,在Liar's Dice和Balatro任务中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19430 2026-05-26 cs.RO

Neuromorphic Control of a Flapping-Wing Robot on Resource-Constrained Hardware

资源受限硬件上扑翼机器人的神经形态控制

Rim El Filali, Chenrui Feng, Chao Gao, Weibin Gu

机构 * Institute for AI Industry Research (AIR)(人工智能产业研究院) Tsinghua University(清华大学) Department of Computer Science and Technology(计算机科学与技术系) Xinchen Qihang Inc.(新晨科技有限公司)

AI总结 针对重量小于30克的蝴蝶仿生扑翼机器人,提出一种层次化神经形态控制框架,在低成本ESP32微控制器上部署两个轻量级脉冲神经网络实现状态估计与控制,通过模仿学习训练,在无系留飞行中实现稳定俯仰和航向跟踪,相比传统人工神经网络延迟降低36%、功耗降低18%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05226 2026-05-26 cs.LG cs.AI cs.CL

Internalizing Outcome Supervision into Process Supervision: A New Paradigm for Reinforcement Learning for Reasoning

将结果监督内化为过程监督:推理强化学习的新范式

Fei Ding, Yongkang Zhang, Runhao Liu, Yuhao Liao, Zijian Zeng, Sibo wang, Huiming Yang

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 提出一种监督内化方法,使模型在仅结果监督下自动提取过程级学习信号,实现细粒度策略优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17328 2026-05-26 cs.LG cs.AI

Rethinking the Comparison Unit in Sequence-Level Reinforcement Learning: An Equal-Length Paired Training Framework from Loss Correction to Sample Construction

重新思考序列级强化学习中的比较单元:从损失校正到样本构建的等长配对训练框架

Fei Ding, Yongkang Zhang, Runhao Liu, Yuhao Liao, Zijian Zeng, Huiming Yang, Sibo wang, Linglin Liao

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 本文提出序列级相对强化学习中的长度问题本质是比较单元构建问题,并基于此提出等长配对训练框架EqLen,通过双轨同步生成、前缀继承和段掩码构建可比较的训练样本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02474 2026-05-26 cs.CL cs.AI cs.LG

MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents

MemSkill:面向自进化智能体的可学习与进化记忆技能

Haozhen Zhang, Quanyu Long, Jianzhu Bao, Tao Feng, Weizhi Zhang, Haodong Yue, Wenya Wang

机构 * Nanyang Technological University(南洋理工大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Tsinghua University(清华大学)

AI总结 提出MemSkill框架,将记忆操作转化为可学习和可进化的技能,通过控制器选择技能、执行器生成记忆、设计者进化技能集,形成闭环提升LLM智能体任务性能。

Comments Code is available at https://github.com/ViktorAxelsen/MemSkill

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05181 2026-05-26 cs.IR cs.AI cs.DL cs.LG

Lightweight and Direct Document Relevance Optimization for Generative Information Retrieval

轻量级直接文档相关性优化用于生成式信息检索

Kidist Amde Mekonnen, Yubao Tang, Maarten de Rijke

机构 * Institute for Clarity in Documentation(文档清晰度研究所) Inria Paris-Rocquencourt(巴黎- Rocquencourt 国家信息与自动化所) Rajiv Gandhi University(拉朱·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) University of Amsterdam(阿姆斯特丹大学)

AI总结 提出直接文档相关性优化(DDRO)方法,通过成对排序直接对齐令牌级文档ID生成与文档级相关性估计,无需显式奖励建模和强化学习,在MS MARCO和Natural Questions上分别提升MRR@10 7.4%和19.9%。

Comments 12 pages, 3 figures. SIGIR '25 Proceedings of the 48th International ACM SIGIR Conference on Research and Development in Information Retrieval July 13--18, 2025 Padua, Italy. Code and pretrained models available at: https://github.com/kidist-amde/ddro/

Journal ref Proceedings of the 48th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR '25), pages 1327-1338, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23670 2026-05-26 cs.CV

Learning Bijective Surface Parameterization for Inferring Signed Distance Functions from Sparse Point Clouds with Grid Deformation

学习双射曲面参数化以通过网格变形从稀疏点云推断符号距离函数

Takeshi Noda, Chao Chen, Junsheng Zhou, Weiqi Zhang, Yu-Shen Liu, Zhizhong Han

机构 * School of Software, Tsinghua University, Beijing, China(清华大学软件学院,北京,中国) Department of Computer Science, Wayne State University, Detroit, USA(韦恩州立大学计算机科学系,底特律,美国)

AI总结 提出一种动态变形网络结合双射曲面参数化和网格变形优化的方法,从稀疏点云端到端预测符号距离函数,显著优于现有方法。

Comments Accepted by Conference on Computer Vision and Pattern Recognition (CVPR) 2025. Project page:https://takeshie.github.io/Bijective-SDF

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10652 2026-05-26 q-bio.QM cs.LG

Querying structural and functional niches on spatial transcriptomics data

查询空间转录组数据中的结构和功能生态位

Mo Chen, Minsheng Hao, Xinquan Liu, Lin Deng, Peng Liu, Chen Li, Dongfang Wang, Kui Hua, Liang Guo, Xuegong Zhang, Lei Wei

机构 * MOE Key Laboratory of Bioinformatics and Bioinformatics Division of BNRIST, Department of Automation, Tsinghua University(生物信息学教育部重点实验室和北京理工大学生物信息学分部,自动化系,清华大学) Center for Synthetic and Systems Biology, School of Life Sciences and School of Medicine, Tsinghua University(合成与系统生物学中心,生命科学学院和医学学院,清华大学) Department of Thoracic Surgery, National Cancer Center/National Clinical Research Center for Cancer/Cancer Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(胸外科部门,国家癌症中心/国家癌症临床研究中心/癌症医院,中国医学科学院和北京协和医学院) Peking Union Medical College, Chinese Academy of Medical Sciences(北京协和医学院,中国医学科学院) Biomedical Pioneering Innovation Center (BIOPIC), Peking University(生物医学前瞻性创新中心(BIOPIC),北京大学) Cancer Research UK Cambridge Institute, University of Cambridge(英国癌症研究Cambridge研究所,剑桥大学) Department of Immunology, School of Basic Medical Sciences, Harbin Medical University(免疫学部门,基础医学学院,哈尔滨医科大学) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国) Zhongguancun Institute of Artificial Intelligence, Beijing, China(中关村人工智能研究院,北京,中国)

AI总结 提出QueST方法,通过子图建模和对比学习查询空间转录组样本中的相似生态位,有效捕捉异质环境中的生态位结构并跨平台泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24508 2026-05-26 cs.CV

FDDet: Achieving Data-Efficient Food Defect Detection Under Real-World Scenarios

FDDet: 实现真实场景下的数据高效食品缺陷检测

Ruihao Xu, Yong Liu, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

AI总结 针对食品缺陷检测中数据稀缺和缺乏统一基准的问题,提出了包含48种缺陷类别的FDD-48数据集,并设计了半监督框架FDDet,通过BBoxMixUp数据增强和CGPC伪标签校准方法,在数据有限场景下显著优于主流检测器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24503 2026-05-26 cs.CV cs.AI

FoodMonitor: Benchmarking MLLMs for Explainable Compliance Analysis

FoodMonitor:用于可解释合规性分析的多模态大语言模型基准测试

Ruihao Xu, Xingming Shui, Jingxuan Niu, Yiqin Wang, Jilin Yu, Haoji Zhang, Yansong Tang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

AI总结 针对现有视频异常检测缺乏规则驱动可解释性的问题,提出FoodMonitor基准,包含双通道违规标注和两阶段匹配评估协议,揭示当前多模态大语言模型在空间定位和细粒度规则理解上的瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24457 2026-05-26 eess.SY cs.LG cs.SY

Asymmetric Adaptation-based Real-time Fault Diagnosis Under Transitional Operating Conditions

基于非对称自适应的过渡工况实时故障诊断

Hongshuo Zhao, Zeyi Liu, Xiao He

机构 * MCC5 Group Shanghai Co. LTD(MCC5集团上海有限公司) Tsinghua University(清华大学)

AI总结 针对离线训练未覆盖的过渡工况导致分布偏移问题,提出一种结合离线域泛化与在线测试时自适应的非对称自适应故障诊断方法,通过周期原型重投影和不对称学习率策略实现快速适应并保持判别能力。

Comments 6 pages, 3 figures, Accepted by ICAIS & ISAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24423 2026-05-26 cs.AI

Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork

临时团队协作中上下文强化学习的极限基准测试

Yuheng Jing, Kai Li, Ziwen Zhang, Jiajun Zhang, Zeyao Ma, Jiaxi Yang, Lei Zhang, Zhe Wu, Jinmin He, Junliang Xing, Jian Cheng

机构 * C$^{2}$DL, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所C²DL实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) University of Science and Technology of China(中国科学技术大学) Qwen Team, Alibaba Group(阿里集团Qwen团队)

AI总结 提出ICRL4AHT基准,基于Overcooked-V2评估上下文强化学习在临时团队协作中的表现,发现算法在未见队友和布局下常不如随机基线,凸显多智能体环境下的适应挑战。

Comments 41 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24390 2026-05-26 cs.LG

Learning Laplacian Eigenspace with Mass-Aware Neural Operators on Point Clouds

学习拉普拉斯特征空间:基于质量感知神经算子的点云处理

Zherui Yang, Tao Du, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海智院) Laoshan Laboratory(崂山实验室)

AI总结 提出神经特征空间算子(NEO),通过预测稳定不变的低频子空间而非特征向量,结合质量感知神经算子和瑞利-里兹精化,实现点云上拉普拉斯-贝尔特拉米算子的快速谱分解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24350 2026-05-26 cs.RO cs.HC

PACT: Proactive Asking for Continual Task Assistance in Human-Robot Collaboration

PACT:人机协作中持续任务辅助的主动询问

Chengbo He, Sheng Li, Chenyang Ma, Bochao Zou, Li Sun, Jiansheng Chen, Junliang Xing, Yuanchun Shi, Huimin Ma

机构 * University of Science and Technology Beijing(北京科技大学) University of Oxford(牛津大学) Tsinghua University(清华大学)

AI总结 提出PACT框架,通过强化学习在部分观测下决定何时主动询问用户以澄清任务,从而在跨日人机协作中逐步提高辅助准确性和澄清效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24110 2026-05-26 cs.AI

EvoCode-Bench: Evaluating Coding Agents in Multi-Turn Iterative Interactions

EvoCode-Bench:评估多轮迭代交互中的编码智能体

Haiyang Shen, Xuanzhong Chen, Wendong Xu, Yun Ma, Liang Chen, Kuan Li

机构 * UniPat AI Peking University(北京大学) Tsinghua University(清华大学) HKU(香港大学)

AI总结 提出EvoCode-Bench基准,通过多轮状态化任务和累积测试评估编码智能体在需求变化下维持代码库工作的能力,发现多轮指标远低于单轮指标,且最强智能体多轮成功率仅约50%。

Comments Work in Progress; 32 pages, 10 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23960 2026-05-26 q-bio.BM cs.LG

Learning Protein Structure-Function Relationships through Knowledge-guided Representation Decomposition

通过知识引导的表示分解学习蛋白质结构-功能关系

Mingqing Wang, Zhiwei Nie, Athanasios V. Vasilakos, Yonghong He, Zhixiang Ren

机构 * Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院) Pengcheng Laboratory, Shenzhen, China(鹏城实验室) School of Electronic and Computer Engineering, Peking University, Shenzhen, China(北京大学电子与计算机工程学院) CAIR, University of Agder, Norway(阿格德大学CAIR) Shanghai Smart Logic Technology Co. Ltd., Shanghai, China(上海智略科技有限公司)

AI总结 提出知识引导的框架ProtDiS,基于信息瓶颈原理分解预训练的蛋白质微环境嵌入,得到更特异、独立和信息高效的结构特征,在12个下游任务上取得一致改进。

Comments 28 pages, 17 figures, icml 2026 regular

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23934 2026-05-26 cs.AI quant-ph

Practical Quantum CIM Empowerment via All-Domestic-Core Agentic Large Model

实用量子CIM赋能:基于全自主核心智能体大模型

Wang Rui, Lu Diannan

机构 * Department of Chemical Engineering, Tsinghua University(清华大学化学工程系)

AI总结 本研究将飞秒激光泵浦的相干伊辛机与LLM驱动的智能体系统结合,实现QUBO/Ising模型校准、约束权重决策迭代和文献方案快速验证,并完全基于国产大模型和硬件完成,同时发现智能体辅助量子计算迭代可反向增强智能体问题解决能力的新范式。

Comments 21 pages 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16302 2026-05-26 cs.LG cs.AI cs.CL

Reducing Credit Assignment Variance via Counterfactual Reasoning Paths

通过反事实推理路径减少信用分配方差

Fei Ding, Yongkang Zhang, Youwei Wang, Zijian Zeng

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 提出反事实比较框架,通过采样多条推理轨迹并利用差异隐式估计过程级优势,将稀疏终端奖励转化为步骤敏感信号,从而改进大语言模型多步推理的信用分配,并引入隐式行为策略优化(IBPO)提升训练稳定性和性能上限。

详情

展开后加载摘要…

URL PDF HTML 收藏