arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2604.27776 2026-05-01 cs.AI cs.CL

WindowsWorld: A Process-Centric Benchmark of Autonomous GUI Agents in Professional Cross-Application Environments

WindowsWorld: 一个以进程为中心的自主GUI代理跨应用专业环境基准测试

Jinchao Li, Yunxin Li, Chenrui Zhao, Zhenran Xu, Baotian Hu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 本文提出WindowsWorld基准测试,用于评估自主GUI代理在跨应用复杂任务中的能力,发现代理在多应用任务中表现不佳,执行效率低,需进一步改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05371 2026-05-01 cs.LG

Hinge Regression Tree: A Newton Method for Oblique Regression Tree Splitting

Hinge回归树:用于斜向回归树分裂的牛顿方法

Hongyi Li, Han Lin, Jun Xu

机构 * School of Intelligence Science and Engineering(智能科学与工程学院) Harbin Institute of Technology(哈尔滨工业大学) Shenzhen Key Lab for Advanced Motion Control and Modern Automation Equipments(深圳先进运动控制系统与现代自动化设备重点实验室)

AI总结 本文提出Hinge回归树,将斜向分裂转化为非线性最小二乘问题,通过牛顿法实现快速收敛,并证明其模型类具有通用近似能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16050 2026-05-01 cs.CV cs.LG eess.IV

Evaluating Similitude and Robustness of Deep Image Denoising Models via Adversarial Attack

通过对抗攻击评估深度图像去噪模型的相似性与鲁棒性

Jie Ning, Jiebao Sun, Yao Li, Zhichang Guo, Wangmeng Zuo

机构 * School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院) School of Computer Science and Technology(计算机科学与技术学院)

AI总结 本文通过对抗攻击方法评估深度图像去噪模型的相似性和鲁棒性,发现主流模型在灰度和彩色图像中共享对抗样本集,提出鲁棒性相似性指标,表明数据驱动的非盲去噪模型最鲁棒。

Journal ref Neurocomputing 687 (2026) 133674

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27555 2026-05-01 cs.AI

SpatialGrammar: A Domain-Specific Language for LLM-Based 3D Indoor Scene Generation

SpatialGrammar: 一种面向领域的语言用于基于LLM的3D室内场景生成

Song Tang, Kaiyong Zhao, Yuliang Li, Qingsong Yan, Penglei Sun, Junyi Zou, Qiang Wang, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文提出SpatialGrammar,一种领域特定语言,通过BEV网格放置确定性编译生成有效3D几何,提升空间准确性和物理合理性。SG-Agent通过编译器反馈迭代优化场景,SG-Mini在单次生成场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26934 2026-04-30 cs.CV

World2VLM: Distilling World Model Imagination into VLMs for Dynamic Spatial Reasoning

World2VLM: 将世界模型的想象能力蒸馏到VLM中以实现动态空间推理

Wanyue Zhang, Wenxiang Wu, Wang Xu, Jiaxin Luo, Helu Zhi, Yibin Huang, Shuo Ren, Zitao Liu, Jiajun Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Wuhan AI Research(武汉人工智能研究院)

AI总结 本文提出World2VLM框架,通过蒸馏生成式世界模型的空间想象能力到VLM中,提升动态空间推理性能,优于基线模型和测试时世界模型耦合方法。

Comments The code is available at https://github.com/WanyueZhang-ai/World2VLM. The dataset is available at https://huggingface.co/datasets/WanyueZhang/World2VLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26366 2026-04-30 stat.ML cs.LG

Probabilistic data quality assessment for structural monitoring data via outlier-resistant conditional diffusion model

基于鲁棒条件扩散模型的结构监测数据概率质量评估

Qi Li, Yong Huang, Hui Li

机构 * Key Lab of Smart Prevention and Mitigation of Civil Engineering Disasters of the Ministry of Industry and Information Technology(工业和信息化部智能防灾减灾重点实验室) School of Civil Engineering, Harbin Institute of Technology(哈尔滨工业大学土木工程学院) Key Lab of Structures Dynamic Behavior and Control of the Ministry of Education(教育部结构动力行为与控制重点实验室) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出基于预测偏差的结构监测数据质量评估方法,利用单变量隐式自回归模型实现异常检测与数据清洗,通过条件嵌入模块、四分位数归一化和Huber损失提升鲁棒性,实验表明该方法在数据质量评估中优于其他基线方法。

Comments 43 pages, 15 figures and 2 tables

Journal ref Expert Systems with Applications, 2026: 132181

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23514 2026-04-30 stat.ML cs.LG stat.ME

Probabilistic Graphical Model using Graph Neural Networks for Bayesian Inversion of Discrete Structural Component States

基于图神经网络的概率图模型用于离散结构组件状态的贝叶斯反演

Teng Li, Stephen Wu, Yong Huang, James L. Beck, Hui Li

机构 * Key Lab of Smart Prevention and Mitigation of Civil Engineering Disasters of the Ministry of Industry and Information Technology(工信部智能防灾减灾重点实验室) Harbin Institute of Technology(哈尔滨工业大学) Key Lab of Structures Dynamic Behavior and Control of the Ministry of Education, School of Civil Engineering, Harbin, Institute of Technology(教育部结构动力行为与控制重点实验室,土木工程学院) The Institute of Statistical Mathematics, Research Organization of Information and Systems(统计数学研究所,信息与系统研究机构) The Graduate University for Advanced Studies, SOKENDAI(高等研究大学,SOKENDAI) Division of Engineering and Applied Science, California Institute of Technology(工程与应用科学系,加州理工学院)

AI总结 本文提出基于概率图模型的新型贝叶斯反演方法,利用图神经网络实现高效离散状态推断,解决高维参数和非解析似然函数带来的计算挑战。

Comments Accepted by Reliability Engineering & System Safety on 23 February 2026

Journal ref Reliability Engineering & System Safety (2026): 112478

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25710 2026-04-29 stat.AP cs.LG stat.ME stat.ML

Adaptive Meta-Learning Stochastic Gradient Hamiltonian Monte Carlo Simulation for Bayesian Updating of Structural Dynamic Models

自适应元学习随机梯度Hamilton-Monte Carlo模拟用于结构动态模型的贝叶斯更新

Xianghao Meng, James L. Beck, Yong Huang, Hui Li

机构 * Key Lab of Smart Prevention and Mitigation of Civil Engineering Disasters of the Ministry of Industry and Information Technology, Harbin Institute of Technology, Harbin, China(工信部智能防灾减灾重点实验室,哈尔滨工业大学,哈尔滨,中国) Key Lab of Structures Dynamic Behavior and Control of the Ministry of Education, Harbin Institute of Technology, Harbin, China(教育部结构动力行为与控制重点实验室,哈尔滨工业大学,哈尔滨,中国) Division of Engineering and Applied Science, California Institute of Technology, CA, USA(加州理工学院工程与应用科学系,CA,美国)

AI总结 本文提出一种自适应元学习随机梯度Hamilton-Monte Carlo算法,通过训练适应性神经网络优化采样策略,实现无需进一步训练即可应用于同类结构贝叶斯更新问题,提升效率与通用性。

Journal ref Comput Meth Appl Mech Eng; 437: 117753 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00756 2026-04-29 cs.AI

MPR-GUI: Benchmarking and Enhancing Multilingual Perception and Reasoning in GUI Agents

MPR-GUI:多语言感知与推理GUI代理的基准测试与增强

Ruihan Chen, Qiming Li, Xiaocheng Feng, Weihong Zhong, Xiaoliang Yang, Yuxuan Gu, Zekun Zhou, Yunfei Lu, Haoyu Ren, Kun Chen, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本文提出MPR-GUI-Bench,通过六种语言和八个细粒度任务评估多语言GUI代理的感知与推理能力,并提出GUI-XLI方法以缩小跨语言差距。

Comments 35pages, 15figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24361 2026-04-28 cs.CL

Culture-Aware Machine Translation in Large Language Models: Benchmarking and Investigation

具有文化意识的大型语言模型机器翻译:基准测试与调查

Zekun Yuan, Yangfan Ye, Xiaocheng Feng, Baohang Li, Qichen Hong, Yunfei Lu, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本文提出CanMT数据集和评估框架,系统评估多种LLM在不同翻译策略下的表现,揭示模型在文化翻译中的性能差异及策略影响,指出文化特定项的翻译难度差异及评估可靠性问题。

Comments 26pages,25 figures ACL2026 main conference, long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24339 2026-04-28 cs.CV cs.AI

See Further, Think Deeper: Advancing VLM's Reasoning Ability with Low-level Visual Cues and Reflection

看得更远,想得更深:通过低级视觉线索和反思提升VLM的推理能力

Zhiheng Wu, Tong Wang, Shuning Wang, Naiming Liu, Yumeng Zhang

机构 * Baidu Inc.(百度公司) Zhejiang University(浙江大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出ForeSight框架,通过低级视觉线索和有效视觉反馈提升VLM推理能力,构建新数据集CG-SalBench,并验证其在参数规模相同和部分指标上优于现有SOTA模型。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24149 2026-04-28 cs.CV

6thGrid-Net: Unified Remote Sensing Image Dehazing Based on Color Restoration and Edge-Preserving

6thGrid-Net:基于颜色恢复和边缘保留的统一远程传感图像去雾

Runci Bai, Kui Jiang, Xiang Chen, Chen Wu, Dianjie Lu, Guijuan Zhang, Zhuoran Zheng

机构 * Harbin Institute of Technology(哈尔滨工业大学) Nanjing University of Science and Technology(南京理工大学) National University of Defense Technology(国防科技大学) Shandong Normal University(山东师范大学) Qilu University of Technology(齐鲁工业大学)

AI总结 本文提出6thGrid-Net,一种高效统一的远程传感图像恢复框架,通过六维融合张量整合3D LUTs的颜色还原能力和双侧网格的空间-亮度细节保留,结合自适应高维采样机制和边缘感知网格平滑约束,实现全局颜色风格化与局部边缘细化,提升去雾效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20164 2026-04-28 cs.CL cs.AI

AI Security Beyond Core Domains: Resume Screening as a Case Study of Adversarial Vulnerabilities in Specialized LLM Applications

超越核心领域的人工智能安全:简历筛选作为专门大语言模型应用中对抗性漏洞的案例研究

Honglin Mu, Jinghao Liu, Kaiyang Wan, Rui Xing, Xiuying Chen, Timothy Baldwin, Wanxiang Che

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究中心) Harbin Institute of Technology(哈尔滨工业大学) Natural Language Processing Research Department(自然语言处理研究部) MBZUAI Paul G. Allen School of Computer Science and Engineering(保罗·G·阿伦计算机科学与工程学院) University of Washington(华盛顿大学) School of Computing and Information Systems(计算与信息系统学院) The University of Melbourne(墨尔本大学)

AI总结 研究探讨了大语言模型在简历筛选中的对抗性漏洞,提出FIDS防御机制,通过实验显示训练时防御优于推理时缓解,有效降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00995 2026-04-28 cs.CV

S2AM3D: Scale-controllable Part Segmentation of 3D Point Clouds

S2AM3D: 可缩放部分的3D点云分割

Han Su, Tianyu Huang, Zichen Wan, Xiaohe Wu, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨理工大学)

AI总结 本文提出S2AM3D,通过结合2D分割先验与3D一致监督,解决3D点云分割中数据稀缺和视图不一致的问题,实现对复杂结构的鲁棒分割。

Comments Accepted by CVPR 2026(Oral). Project page:https://sumuru789.github.io/S2AM3D-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06020 2026-04-28 cs.SE cs.AI

Text Tells the Cost: Predicting and Analyzing Repayment Effort of Self-Admitted Technical Debt

文本揭示成本:预测和分析自我承认的技术债务偿还努力

Yikun Li, Mohamed Soliman, Paris Avgeriou, Jie Tan, Jiakun Liu

机构 * Bernoulli Institute for Mathematics, Computer Science and Artificial Intelligence, University of Groningen(格罗宁根大学数学、计算机科学与人工智能学院) Intelligent Game and Decision Lab(智能游戏与决策实验室) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文通过分析341740个技术债务项,提出PRESTI模型,利用文本信息预测偿还努力,发现不同类型的债务偿还难度差异显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23345 2026-04-28 cs.CL cs.HC

Bridging Reasoning and Action: Hybrid LLM-RL Framework for Efficient Cross-Domain Task-Oriented Dialogue

连接推理与行动:一种高效的跨领域任务导向对话混合LLM-RL框架

Yangyang Zhao, Linfan Dai, Li Cai, Bowen Xing, Libo Qin

机构 * School of Computer Science and Technology, Changsha University of Science and Technology(长沙理工大学计算机科学与技术学院) School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算与智能研究院) University of Science and Technology Beijing(北京科技大学) Text Computing and Cognitive Intelligence MOE Engineering Research Center, Guizhou University(贵州大学文字计算与智能认知MOE工程研究中心)

AI总结 本文提出VLK-RL框架,通过结合LLM生成约束并验证以提升跨领域任务导向对话的推理与行动效率,实验表明其在长周期任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23309 2026-04-28 cs.CV cs.LG

STAND: Semantic Anchoring Constraint with Dual-Granularity Disambiguation for Remote Sensing Image Change Captioning

STAND:语义锚定约束与双粒度消歧用于遥感图像变化描述

Yanpei Gong, Beichen Zhang, Hao Wang, Zhaobo Qi, Xinyan Liu, Yuanrong Xu, Ruiyang Gao, Weigang Zhang

机构 * Harbin Institute of Technology, Weihai, China(哈尔滨工业大学,威海)

AI总结 STAND通过语义锚定约束与双粒度消歧方法,解决遥感图像变化描述中的视角、尺度和先验知识模糊问题,提升描述精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23277 2026-04-28 cs.CL cs.AI

From Similarity to Structure: Training-free LLM Context Compression with Hybrid Graph Priors

从相似性到结构:基于混合图先验的训练自由LLM上下文压缩

Yitian Zhou, Chaoning Zhang, Jiaquan Zhang, Zhenzhen Huang, Jinyu Guo, Sung-Ho Bae, Lik-Hang Lee, Caiyan Qin, Yang Yang

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) Department of Computer Science and Engineering, Kyung Hee University(Kyung Hee大学计算机科学与工程系) Department of Industrial and Systems Engineering, The Hong Kong Polytechnic University(香港理工大学工业与系统工程系) School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区机器人与先进制造学院)

AI总结 本文提出一种无需训练的上下文压缩框架,利用混合图先验选择句子,通过构建稀疏句子图、提取主题骨架并结合可解释评分进行冗余抑制,实验证明在长文档基准上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16207 2026-04-28 cs.CV cs.AI

AIFIND: Artifact-Aware Interpreting Fine-Grained Alignment for Incremental Face Forgery Detection

AIFIND:面向增量面部伪造检测的 artifact 意识细粒度对齐

Hao Wang, Beichen Zhang, Yanpei Gong, Shaoyi Fang, Zhaobo Qi, Yuanrong Xu, Xinyan Liu, Weigang Zhang

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Weihai(哈尔滨工业大学计算机科学与技术学院)

AI总结 本文提出AIFIND,通过语义锚点稳定增量学习,设计Artifact-Driven Semantic Prior Generator和Artifact-Probe Attention模块,解决增量面部伪造检测中的特征漂移和灾难性遗忘问题。

Comments Accepted by ACM International Conference on Multimedia Retrieval (ICMR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20597 2026-04-28 cs.CV

StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval

StructAlign:结构化跨模态对齐用于连续文本到视频检索

Shaokun Wang, Weili Guan, Jizhou Han, Jianlong Wu, Yupeng Hu, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Xi’an Jiaotong University(西安交通大学) Shandong University(山东大学)

AI总结 本文提出StructAlign,通过结构化跨模态对齐方法解决连续文本到视频检索中的模态错位和特征漂移问题,提升模型持续学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21806 2026-04-27 cs.CV

TEMA: Anchor the Image, Follow the Text for Multi-Modification Composed Image Retrieval

TEMA: 图像锚定,文本引导的多修改复合图像检索

Zixu Li, Yupeng Hu, Zhiheng Fu, Zhiwei Chen, Yongqi Li, Liqiang Nie

机构 * School of Software, Shandong University(山东大学软件学院) Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系) School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)计算机科学与技术学院)

AI总结 TEMA通过构建多修改数据集和提出文本导向实体映射架构,解决复合图像检索中的实体覆盖不足和句法-实体对齐问题,提升检索准确性和效率。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10897 2026-04-24 cs.CV physics.optics

TV Subgradient-Guided Multi-Source Fusion for Spectral Imaging in Dual-Camera CASSI Systems

TV子梯度引导多源融合用于双相机CASSI系统的光谱成像

Weiqiang Zhao, Tianzhu Liu, Yuzhe Gui, Wei Bian, Yanfeng Gu

机构 * School of Electronics and Information Engineering, Harbin Institute of Technology(哈尔滨工业大学电子与信息工程学院) School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院)

AI总结 本文提出基于TV子梯度引导的多源融合框架,用于双相机CASSI系统的光谱成像重建,通过端到端的SD-CASSI观测模型、自适应空间参考生成器和TV子梯度正则化项,实现高质量的光谱图像重建。

Comments Main text: 14 pages, 12 figures; Supplementary material: 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20473 2026-04-23 cs.CV

Video-ToC: Video Tree-of-Cue Reasoning

Video-ToC: 视频树状提示推理

Qizhong Tan, Zhuotao Tian, Guangming Lu, Jun Yu, Wenjie Pei

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 Video-ToC通过树状提示推理框架提升视频理解,引入三创新:树引导视觉提示定位、需求驱动奖励机制和自动化标注流程,验证其在视频理解与幻觉检测中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20444 2026-04-23 cs.RO cs.AI cs.DB cs.LG

VTouch++: A Multimodal Dataset with Vision-Based Tactile Enhancement for Bimanual Manipulation

VTouch++:一个用于双臂操作的多模态数据集,具有基于视觉的触觉增强

Qianxi Hua, Xinyue Li, Zheng Yan, Yang Li, Chi Zhang, Yongyao Li, Yufei Liu

机构 * Humanoid Robot (Shanghai) Co., Ltd.(人形机器人(上海)有限公司) Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(上海智能自主系统研究院,同济大学) School of Astronautics, Harbin Institute of Technology(航天学院,哈尔滨工程大学)

AI总结 本文提出VTouch++数据集,通过视觉触觉传感提供高保真的物理交互信号,采用矩阵式任务设计实现系统学习,并利用自动化数据采集管道确保可扩展性,通过跨模态检索和真实机器人评估验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20358 2026-04-23 cs.CV

ConeSep: Cone-based Robust Noise-Unlearning Compositional Network for Composed Image Retrieval

ConeSep: 基于锥的鲁棒噪声-反学习组合网络用于组合图像检索

Zixu Li, Yupeng Hu, Zhiwei Chen, Mingyu Zhang, Zhiheng Fu, Liqiang Nie

机构 * Shandong University(山东大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文针对组合图像检索中噪声三元组对应问题,提出ConeSep网络,解决模态抑制、负锚缺乏和反学习反作用三大挑战,通过几何保真量化、负边界学习和边界基于的目标反学习方法,提升检索性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20313 2026-04-23 cs.LG cs.AI

Formalising the Logit Shift Induced by LoRA: A Technical Note

对LoRA引起的对数几率偏移进行形式化:技术说明

Xiang Shi, Shuaizhi Cheng, Mingwei Li

机构 * Imperial College London(帝国学院伦敦) Harbin Institute of Technology(哈尔滨工业大学) KigLand Machine Learning Lab(KigLand机器学习实验室)

AI总结 本文首次形式化LoRA引起的对数几率偏移及事实边际变化,通过一阶Fréchet近似证明多层LoRA效应可分解为层间贡献的线性求和及高阶余项。

Comments 7 pages, technical note

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20090 2026-04-23 cs.CL

Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework

少语言,少令牌:一种高效的统一逻辑跨语言推理框架

Chenyuan Zhang, Qiguang Chen, Xie Chen, Zhuotao Tian, Bowen Xing, Meishan Zhang, Libo Qin, Baotian Hu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Central South University(中南大学) Text Computing and Cognitive Intelligence Ministry of Education Engineering Research Center, Guizhou University(贵州省教育厅Text Computing and Cognitive Intelligence工程研究中心,贵州大学) University of Science and Technology Beijing(北京科技大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出UL-XCoT框架,通过减少语言和令牌数量提升跨语言推理效率,实验证明在多语言任务中准确率高且令牌成本降低超50%。

Comments Accepted by ACL2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19773 2026-04-23 cs.CL cs.AI

PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models

PR-CAD:基于大语言模型的统一可控且忠实的文本到CAD生成的渐进式细化

Jiyuan An, Jiachen Zhao, Fan Chen, Liner Yang, Zhenghao Liu, Hongyan Wang, Weihua An, Meishan Zhang, Erhong Yang

机构 * School of Information Science, Beijing Language and Culture University, China(北京语言大学信息学院) School of Computer Science and Technology, Beijing Jiaotong University, China(北京交通大学计算机科学与技术学院) School of Computer Science and Engineering, Northeastern University, China(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Tsinghua University, China(清华大学计算机科学与技术系) School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen), China(哈尔滨工业大学(深圳)计算机科学与技术学院)

AI总结 PR-CAD通过统一生成与编辑任务,提升文本到CAD生成的可控性和忠实性,采用高保真交互数据集和强化学习框架,实现设计创建与细化的一体化解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19769 2026-04-23 cs.CL cs.AI cs.LG

TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference

TTKV:面向长上下文LLM推理的时序分层KV缓存

Gradwell Dzikanyanga, Weihao Yang, Hao Huang, Donglei Wu, Shihao Wang, Wen Xia, Sanjeeb K C

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Guangzhou University(广州大学)

AI总结 TTKV通过时序分层缓存框架优化KV存储,利用HBM和DRAM解耦快慢存储,根据时间接近性分配KV状态,减少跨层通信开销,提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19749 2026-04-23 cs.AI cs.SE

The Tool-Overuse Illusion: Why Does LLM Prefer External Tools over Internal Knowledge?

工具过度使用错觉:为什么大语言模型更倾向于使用外部工具而非内部知识?

Yirong Zeng, Shen You, Yufei Liu, Qunyao Du, Xiao Ding, Yutai Hou, Yuxian Wang, Wu Ning, Haonan Song, Dandan Tu, Bibo Cai, Ting Liu

机构 * Harbin Institute of Technology, SCIR(哈尔滨理工大学SCIR研究所) Peking University(北京大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本文揭示大语言模型在推理中普遍存在工具过度使用现象,通过分析内部知识可用性区域,提出知识感知边界对齐策略,减少工具使用82.8%,并发现仅以结果奖励会鼓励工具过度使用,通过平衡奖励信号可减少66.7%的无用工具调用。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏