arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2510.03323 2026-04-23 cs.CL

Enhancing Agentic Textual Graph Retrieval with Synthetic Stepwise Supervision

通过合成的分步监督增强代理文本图检索

Ge Chang, Jinbo Su, Jiacheng Liu, Pengfei Yang, Yuhao Shang, Huiwen Zheng, Hongli Ma, Yan Liang, Yuanchun Li, Yunxin Liu

机构 * Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR),清华大学) Peking University(北京大学) School of Information, Renmin University of China(中国人民大学信息学院) Harbin Institute of Technology(哈尔滨工业大学) North China Electric Power University(华北电力大学) GDS Holdings Limited(GDS控股有限公司)

AI总结 本文提出一种基于LLM的文本图检索框架,通过合成分步监督优化检索过程,提升复杂图基问答任务的准确性和F1分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20208 2026-04-23 cs.LG cs.AI

Unlock the Potential of Large Language Models for Predictive Tabular Tasks in Data Science with Table-Specific Pretraining

解锁大型语言模型在数据科学中预测表格任务的潜力:通过表格特定预训练

Yazheng Yang, Yuqi Wang, Yaxuan Li, Sankalok Sen, Lei Li, Lin Qiu, Qi Liu

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Department of Information Systems and Management Engineering, Southern University of Science and Technology(南方科技大学信息 systems 和管理工程系)

AI总结 本文通过表格特定预训练方法提升LLM在表格预测任务中的表现,验证了定制化训练对提升表格智能的有效性。

Comments 10 pages; Accepted by TKDE

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20806 2026-04-23 cs.CV cs.AI cs.CL

OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model

OMIBench:用于大型视觉-语言模型在奥林匹克级多图像推理中的基准测试

Qiguang Chen, Chengyu Luan, Jiajun Wu, Qiming Yu, Yi Yang, Yizhuo Li, Jingqi Tong, Xiachong Feng, Libo Qin, Wanxiang Che

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究室) Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学) Fudan University(复旦大学) The University of Hong Kong(香港大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Text Computing and Cognitive Intelligence Ministry of Education Engineering Research Center(教育部文本计算与认知智能工程研究中心) Guizhou University(贵州大学)

AI总结 OMIBench旨在评估多图像推理能力,包含生物、化学、数学和物理奥林匹克问题,提供精确和语义答案匹配的评估协议,实验显示现有模型性能存在显著差距。

Comments ACL 2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20748 2026-04-23 cs.CV

Amodal SAM: A Unified Amodal Segmentation Framework with Generalization

多模态SAM:一种统一的多模态分割框架与泛化能力

Bo Zhang, Zhuotao Tian, Xin Tao, Songlin Tang, Jun Yu, Wenjie Pei

机构 * Department of Computer Science, Harbin Institute of Technology at Shenzhen(哈尔滨工业大学(深圳)计算机科学部) Kuaishou Technology(快手科技)

AI总结 本文提出Amodal SAM,一种结合SAM模型的多模态分割框架,通过轻量级空间完成适配器、目标感知遮挡合成和新学习目标,实现多模态分割的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19548 2026-04-22 cs.CL cs.AI cs.CY

Taming Actor-Observer Asymmetry in Agents via Dialectical Alignment

通过辩证对齐平息代理中的行动者-观察者不对称性

Bobo Li, Rui Wu, Zibo Ji, Meishan Zhang, Hao Fei, Min Zhang, Mong-Li Lee, Wynne Hsu

机构 * National University of Singapore(国立新加坡大学) Sichuan University(四川大学) University of Minnesota Twin Cities(明尼苏达大学双城分校) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校) University of Oxford(牛津大学)

AI总结 本文提出ReTAS模型,通过辩证对齐方法减少代理中的行动者-观察者不对称性,提升故障解决能力。

Comments ACL 2026 Main Conference. Project page: https://unikcc.github.io/ReTAS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19536 2026-04-22 cs.RO

LiveVLN: Breaking the Stop-and-Go Loop in Vision-Language Navigation

LiveVLN: 突破视觉语言导航中的停止与前进循环

Xiangchen Wang, Weiye Zhu, Teng Wang, TianTian Geng, Zekai Zhang, Zhiyuan Qi, Jinyu Yang, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Spatialtemporal AI(时空AI)

AI总结 LiveVLN通过增强预训练视觉语言导航器,实现更连续的具身导航,减少等待时间并提升动作可用性,实验证明在真实部署中显著提升执行效率。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19488 2026-04-22 cs.AI

CoDA: Towards Effective Cross-domain Knowledge Transfer via CoT-guided Domain Adaptation

CoDA:通过引导式推理的领域适应实现有效的跨领域知识迁移

Jianzhi Yan, Le Liu, Buzhou Tang, Yang Xiang, Dongning Sun, Zhiming Li

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室)

AI总结 针对跨领域知识迁移中领域分布偏移问题,CoDA通过轻量适配器和基于特征的知识蒸馏结合MMD分布匹配,有效对齐源域与目标域的潜在推理表示,提升逻辑推理任务性能。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19406 2026-04-22 cs.CV cs.AI

HP-Edit: A Human-Preference Post-Training Framework for Image Editing

HP-Edit:一种用于图像编辑的人类偏好后训练框架

Fan Li, Chonghuinan Wang, Lina Lei, Yuping Qiu, Jiaqi Xu, Jiaxiu Jiang, Xinran Qin, Zhikai Chen, Fenglong Song, Zhixin Wang, Renjing Pei, Wangmeng Zuo

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Harbin Institute of Technology(哈尔滨工业大学) Nankai University(南开大学)

AI总结 本文提出HP-Edit框架和RealPref-50K数据集,通过少量人类偏好评分数据和预训练视觉大语言模型开发自动评估器,提升图像编辑模型对人类偏好的契合度。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19262 2026-04-22 cs.CL cs.AI

CulturALL: Benchmarking Multilingual and Multicultural Competence of LLMs on Grounded Tasks

CulturALL:基于 grounded 任务的 LLM 多语言和多文化能力基准测试

Peiqin Lin, Chenyang Lyu, Wenjiang Luo, Haotian Ye, Md Mehrab Hossain, Chunlan Ma, Shaoxiong Ji, Younes Samih, Bo Zeng, Fan Jiang, Yuanbin Cao, Dilda Duisenbek, Adrian Neo Sau Xun, Daria Pozdniakova, Liubou Misevich, Nevena Marinković, Ngoc Gia Linh Nguyen, Thi Khanh Linh Do, Sarakmatak Sophy, Baotian Hu, Guanhua Chen, Gongbo Tang, Alham Fikri Aji, Longyue Wang, Weihua Luo

机构 * Alibaba Group(阿里巴巴集团) Beijing Language and Culture University(北京语言大学) LMU Munich(慕尼黑大学) ELLIS Institute Finland(芬兰ELLIS研究所) University of Turku(图尔库大学) IBM Research AI, UAE(阿联酋IBM人工智能研究) MBZUAI Harbin Institute of Technology, Shenzhen(深圳哈尔滨工业大学) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出 CulturALL 基准测试,评估 LLM 在 grounded 任务中的多语言和多文化能力,包含 14 种语言 51 个地区 16 个主题的 2610 个样本,实验显示最佳 LLM 准确率仅 44.48%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18982 2026-04-22 cs.AI

SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attribution

SAVOIR:通过基于Shapley的奖励归因学习社交能力

Xiachong Feng, Yi Jiang, Xiaocheng Feng, Deyi Yin, Libo Qin, Yangfan Ye, Lei Huang, Weitao Ma, Yuxuan Gu, Chonghan Qin, Bing Qin, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 本文提出SAVOIR框架,基于合作博弈理论解决语言代理训练中的信用分配问题,通过预期效用转移和Shapley值实现公平奖励分配,实验显示其在SOTOPIA基准上达到新状态-of-the-art性能。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18665 2026-04-22 cs.SD

APRVOS: 1st Place Winner of 5th PVUW MeViS-Audio Track

APRVOS:第五届PVUW MeViS-Audio赛道第一名获奖作品

Deshui Miao, Yameng Gu, Chao Yang, Xin Li, Haijun Zhang, Ming-Hsuan Yang

机构 * Pengcheng Laboratory(鹏城实验室) Harbin Institute of Technology(哈尔滨工业大学) University of California at Merced(加州大学默塞德分校)

AI总结 本文提出针对MeViS_Audio任务的音频感知视频目标分割框架,通过语音转录和视觉存在验证提升分割精度,结合Sa2VA和SAM3实现粗分割与精修,分阶段处理音频到视频分割问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14726 2026-04-22 cs.LG cs.AI

Catching Every Ripple: Enhanced Anomaly Awareness via Dynamic Concept Adaptation

捕捉每一个涟漪:通过动态概念适应提升异常意识

Jiaqi Zhu, Shaofeng Cai, Jie Chen, Fang Deng, Beng Chin Ooi, Wenqiao Zhang

机构 * School of Automation and the National Key Laboratory of Autonomous Intelligent Unmanned Systems, Beijing Institute of Technology(自动化学院和自主智能无人系统国家重点实验室,北京理工大学) School of Computing, National University of Singapore(computing 学院,新加坡国立大学) Harbin Institute of Technology(哈尔滨工业大学) Digital Media Computing & Design Lab, Zhejiang University(数字媒体计算与设计实验室,浙江大学)

AI总结 本文提出DyMETER框架,通过动态概念适应机制提升在线异常检测的适应性与效率,采用超网络生成实例感知参数位移,并引入轻量级进化控制器和动态阈值优化模块以实现鲁棒和可解释的适应。

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01455 2026-04-22 cs.CV cs.AI cs.CL cs.IR cs.MM

From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents

从逐字到概要:基于语义信息瓶颈的金字塔多模态记忆压缩用于长视界视频智能体

Niu Lian, Yuting Wang, Hanshu Yao, Jinpeng Wang, Bin Chen, Yaowei Wang, Min Zhang, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出MM-Mem架构,通过金字塔多模态记忆压缩,结合语义信息瓶颈目标,实现长视界视频理解中的高效记忆组织与任务相关信息保留。

Comments Accepted by ACL 2026 Main. 17 pages, 7 figures, 8 tables. TL;DR: We propose MM-Mem, a cognition-inspired, dual-trace hierarchical memory framework for long-horizon video understanding grounded in Fuzzy-Trace Theory. It features adaptive memory compression via the Information Bottleneck and employs an entropy-driven top-down retrieval to access fine-grained details only when necessary

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18019 2026-04-21 cs.CV

Multi-View Hierarchical Graph Neural Network for Sketch-Based 3D Shape Retrieval

多视图分层图神经网络用于基于草图的3D形状检索

Hang Cheng, Muyan He, Mingyu Fan, Chengfeng Xie, Xi Cheng, Long Zeng

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Control and Simulation Center, Harbin Institute of Technology(哈尔滨工业大学控制仿真中心)

AI总结 本文提出MV-HGNN框架,通过多视图图神经网络和视图选择器提升3D形状检索的表示能力,结合CLIP文本嵌入实现类别无关对齐,实验表明在类别级和零样本场景中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17982 2026-04-21 cs.CV cs.CL

Mitigating Multimodal Hallucination via Phase-wise Self-reward

通过分阶段自奖励缓解多模态幻觉

Yu Zhang, Chuyang Sun, Kehai Chen, Xuefeng Bai, Yang Xiang, Min Zhang

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Shenzhen(深圳) China(中国)

AI总结 本文提出PSRD框架,通过分阶段自奖励信号在推理时动态抑制幻觉,有效降低LLaVA-1.5-7B的幻觉率50%,在多个基准上优于现有方法。

Comments Self-reward for vision hallucination mitigation

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17914 2026-04-21 cs.CV

Beyond Binary Contrast: Modeling Continuous Skeleton Action Spaces with Transitional Anchors

超越二元对比:通过过渡锚点建模连续骨架动作空间

Yingjie Feng, Yi Wang, Jiaze Wang, Anfeng Liu, Zhuotao Tian

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Central South University(中南大学) FitX Technology (Hong Kong) Limited(FitX科技(香港)有限公司)

AI总结 本文提出TranCLR框架,通过过渡锚点建模连续骨架动作空间,提升动作识别的连续性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15586 2026-04-21 cs.CL

Learning to Extract Rational Evidence via Reinforcement Learning for Retrieval-Augmented Generation

通过强化学习学习提取理性证据以增强检索增强生成

Xinping Zhao, Shouzheng Huang, Yan Zhong, Xinshuo Hu, Meishan Zhang, Baotian Hu, Min Zhang

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院) Peking University(北京大学)

AI总结 本文提出EviOmni,通过推理先提取证据,结合证据推理与提取,利用强化学习优化生成质量,实验表明其在多个基准数据集上表现优异,提升下游任务准确率。

Comments 23 pages, 8 Figures, 18 Tables; Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17696 2026-04-21 cs.AI

Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play

战略:通过轨迹调节的游戏自我对战学习可转移的推理

Xiachong Feng, Deyi Yin, Xiaocheng Feng, Yi Jiang, Libo Qin, Yangfan Ye, Lei Huang, Weitao Ma, Qiming Li, Yuxuan Gu, Bing Qin, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 本文提出STRATAGEM,通过轨迹调节游戏自我对战学习可转移的推理,解决领域特定性和上下文停滞问题,提升数学推理和代码生成等任务的性能。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17241 2026-04-21 cs.RO

GaLa: Hypergraph-Guided Visual Language Models for Procedural Planning

GaLa:基于超图的视觉语言模型用于程序规划

Kun Wang, Yiming Li, Mingcheng Qu, Aqiang Zhang, Guang Yang, Tonghua Su

机构 * Harbin Institute of Technology(哈尔滨工业大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳)) Chongqing Research Institute of HIT(重庆哈尔滨工业大学研究院)

AI总结 GaLa通过超图表示学习,有效捕捉物体间的隐含语义关系和功能区域的层次结构,提升多模态程序规划的性能。

Comments 14pages, 7figures

Journal ref ACL 2026(Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17178 2026-04-21 cs.CL

Cognitive Policy-Driven LLM for Diagnosis and Intervention of Cognitive Distortions in Emotional Support Conversation

认知驱动的LLM用于情绪支持对话中认知扭曲的诊断与干预

Lin Zhong, Renjin Zhu, Shujuan Ma, Jinhao Cui, Lingzhi Wang, Hao Chen, Qing Liao

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) City University of Macau, Macao SAR, China(澳门城市大学) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)

AI总结 本文提出CogBiasESC数据集和CoPoLLM框架,用于提升LLM在情绪支持对话中识别和干预认知扭曲的能力,实验显示其在诊断准确性和安全性方面优于现有方法。

Comments Accepted at ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17174 2026-04-21 cs.CL

Modeling Multi-Dimensional Cognitive States in Large Language Models under Cognitive Crowding

在认知拥挤下对大语言模型中的多维认知状态建模

Lin Zhong, Siyu Zhu, Zizhen Yuan, Jinhao Cui, Xinyang Zhao, Lingzhi Wang, Hao Chen, Qing Liao

机构 * Harbin Institute of Technology(哈尔滨工业大学) City University of Macau(澳门城市大学) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出CognitiveBench基准,通过统一标注四个认知维度,发现LLM在多维建模中表现下降,提出HyCoLLM在双曲空间中建模,提升多维认知理解。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04503 2026-04-21 cs.AI cs.MA

Memory Intelligence Agent

记忆智能代理

Jingyang Qiao, Weicheng Meng, Yu Cheng, Zhihang Lin, Zhizhong Zhang, Xin Tan, Jingyu Gong, Kun Shao, Yuan Xie

机构 * East China Normal University(华东师范大学) Shanghai Innovation Institute(上海创新研究院) Harbin Institute of Technology(哈尔滨工业大学) Xiamen University(厦门大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Independent Researcher(独立研究者)

AI总结 本文提出Memory Intelligence Agent框架,通过Manager-Planner-Executor架构实现高效记忆演化,结合强化学习与双向记忆转换,提升推理与自进化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03559 2026-04-21 cs.CL

DiffCoT: Diffusion-styled Chain-of-Thought Reasoning in LLMs

DiffCoT:在大语言模型中采用扩散风格的推理链推理

Shidong Cao, Hongzhan Lin, Yuxuan Gu, Ziyang Luo, Jing Ma

机构 * Hong Kong Baptist University(香港 Baptist 大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 DiffCoT通过扩散风格的推理链框架,改进了大语言模型在多步数学问题解决中的鲁棒性和错误纠正能力,通过迭代去噪过程实现中间步骤的统一生成与回顾性修正。

Comments DiffCoT improves multi-step LLM reasoning by applying diffusion-based iterative denoising to correct intermediate Chain-of-Thought steps

Journal ref The 64th Annual Meeting of the Association for Computational Linguistics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07745 2026-04-21 cs.CL cs.AI cs.LG

Parallel Test-Time Scaling for Latent Reasoning Models

潜在推理模型的并行测试时缩放

Runyang You, Yongqi Li, Meng Liu, Wenjie Wang, Liqiang Nie, Wenjie Li

机构 * Hong Kong Polytechnic University(香港理工大学) Shandong Jianzhu University(山东建筑大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文提出通过改进采样和聚合方法,使潜在推理模型能有效利用并行测试时缩放,提升连续空间中的推理能力。

Comments Accepted at ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00553 2026-04-21 cs.CV

HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models

HiPrune:面向视觉-语言模型的层次注意力高效标记修剪

Jizhihui Liu, Feiyi Du, Guangdao Zhu, Niu Lian, Jun Li, Bin Chen, Weili Guan, Yaowei Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室)

AI总结 本文提出HiPrune,通过分析视觉编码器中不同层次的注意力特性,实现高效的标记修剪,无需训练且适用于多种模型,在低token预算下保持高任务准确率。

Comments Accepted at ACL-2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16522 2026-04-21 cs.CL cs.AI

Large Language Models Are Still Misled by Simple Bias Ensembles

大语言模型仍易受简单偏见集合的误导

Zhouhao Sun, Zhiyuan Kan, Xiao Ding, Li Du, Bibo Cai, Yang Zhao, Bing Qin, Ting Liu

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心) Harbin Institute of Technology(哈尔滨工业大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 研究指出,尽管大语言模型对单一偏见的鲁棒性提升,但多个偏见的组合仍显著影响其性能,提出多偏见基准测试以评估模型在复杂偏见下的表现,发现现有模型和去偏方法效果不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07464 2026-04-21 eess.IV cs.LG q-bio.QM

Multi-Beholder: Biomarker Prediction for Low-Grade Glioma with Multiple Instance Learning and One-Class Classification

多视角:利用多实例学习和一类分类进行低级别胶质瘤的生物标志物预测

Zijie Fang, Yihan Liu, Yifeng Wang, Xiangyang Zhang, Yang Chen, Changjing Cai, Yiyang Lin, Ying Han, Zhi Wang, Shan Zeng, Jun Tan, Yongbing Zhang, Hong Shen

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Department of Oncology, Xiangya Hospital, Central South University(湘雅医院肿瘤科,中南大学) School of Science, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)科学学院) Department of Neurosurgery, Xiangya Hospital, Central South University(湘雅医院神经外科,中南大学) School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)计算机科学与技术学院)

AI总结 本文提出Multi-Beholder方法,通过全切片图像预测低级别胶质瘤的五个生物标志物状态,利用多实例学习和一类分类提高预测性能,并在两个不同队列中验证了其有效性。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16968 2026-04-21 cs.CL

On Safety Risks in Experience-Driven Self-Evolving Agents

经验驱动自演化代理中的安全风险

Weixiang Zhao, Yichen Zhang, Yingshuo Wang, Yang Deng, Yanyan Zhao, Xuda Zhi, Yongbo Huang, HaoHe, Wanxiang Che, Bing Qin, Ting Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) Singapore Management University(新加坡管理大学) SERES

AI总结 研究经验积累与利用对自演化代理在网页和具身环境中的安全性能影响,揭示经验驱动导致的安全性下降及安全-效用权衡问题。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16940 2026-04-21 cs.LG cs.AI

D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation

D-QRELO:通过量化和残差低秩近似实现大型语言模型的训练和数据无关的delta压缩

Junlin Li, Shuangyong Song, Guodong Du, Ngai Wong, Xuebo Liu, Yongxiang Li, Min Zhang, Jing Li, Xuelong Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) TeleAI of China Telecom(中国电信TeleAI) The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学)

AI总结 本文提出DQRELO方法,通过量化和残差低秩近似实现大型语言模型的delta压缩,解决大规模数据训练导致的压缩误差问题,提升压缩效果和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16923 2026-04-21 cs.AI

Alignment Imprint: Zero-Shot AI-Generated Text Detection via Provable Preference Discrepancy

对齐印记:通过可证明的偏好偏差实现零样本AI生成文本检测

Junxi Wu, Kailin Huang, Dongjian Hu, Bin Chen, Hao Wu, Shu-Tao Xia, Changliang Zou

机构 * Nankai University(南开大学) Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Peng Cheng Laboratory(鹏城实验室) Wuhan University(武汉大学)

AI总结 本文提出通过可证明的偏好偏差检测AI生成文本,利用对齐印记理论分析,引入LAPD统计量提升检测性能,实验显示在多种设置下均取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏