arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2604.16917 2026-04-21 cs.CL

x1: Learning to Think Adaptively Across Languages and Cultures

x1: 在多种语言和文化中学习适应性思考

Yangfan Ye, Xiaocheng Feng, Xiachong Feng, Yichong Huang, Zekun Yuan, Lei Huang, Weitao Ma, Qichen Hong, Yunfei Lu, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 x1通过在实例层面选择有利语言进行推理,提升多语言数学推理和文化相关任务的性能,挑战了单纯扩大模型规模的假设。

Comments Findings of ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16883 2026-04-21 cs.LG cs.AI

SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models

SinkRouter: 为大语言和多模态模型高效长上下文解码的感知路由

Junnan Liu, Xinyan Liu, Peifeng Gao, Zhaobo Qi, Beichen Zhang, Weigang Zhang, Antoni Bert Chen

机构 * Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海)) University of Hong Kong(香港大学) City University of Hong Kong(城市大学)

AI总结 本文提出SinkRouter,通过感知路由机制提升长上下文解码效率,减少计算冗余,实现在512K上下文下的2.03倍加速,保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16848 2026-04-21 cs.CV cs.AI

TowerDataset: A Heterogeneous Benchmark for Transmission Corridor Segmentation with a Global-Local Fusion Framework

TowerDataset:一种异构基准,用于传输走廊分割的全局-局部融合框架

Xu Cui, Xinyan Liu, Chen Yang, Zhaobo Qi, Beichen Zang, Weigang Zhang, Antoni B. Chan

机构 * Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海)) University of the Chinese Academy of Sciences(中国科学院大学) City University of Hong Kong(香港城市大学)

AI总结 本文提出TowerDataset异构基准,包含661个真实场景和24亿点,通过全局-局部融合框架提升传输走廊分割性能,实验验证了其在复杂场景中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09536 2026-04-21 cs.AI

Omni-R1: Towards the Unified Generative Paradigm for Multimodal Reasoning

Omni-R1:迈向多模态推理的统一生成范式

Dongjie Cheng, Yongqi Li, Zhixin Ma, Hongru Cai, Yupeng Hu, Wenjie Wang, Liqiang Nie, Wenjie Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Singapore Management University(新加坡国立大学) Shandong University(山东大学) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文提出Omni-R1,通过生成中间图像统一多模态推理技能,解决单一任务特定推理模式限制的问题,并引入Omni-R1-Zero无需多模态标注实现文本仅推理数据的逐步可视化。

Comments Accepted by ACL2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.07082 2026-04-21 cs.LG

Graph Neural Networks for Graphs with Heterophily: A Survey

图神经网络用于异质图:综述

Xin Zheng, Yi Wang, Yixin Liu, Ming Li, Miao Zhang, Di Jin, Philip S. Yu, Shirui Pan

机构 * School of Computing Technologies, RMIT University(罗特学院,皇家墨尔本理工大学) Department of Mathematics, City University of Hong Kong(香港城市大学数学系) School of Information and Communication Technology, Griffith University(信息与通信技术学院,格里菲斯大学) Zhejiang Key Laboratory of Intelligent Education Technology and Application, Zhejiang Normal University(浙江智能教育技术与应用重点实验室,浙江师范大学) School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳)) School of Computer Science and Technology, Tianjin University(计算机科学与技术学院,天津大学) Department of Computer Science, University of Illinois at Chicago(计算机科学系,伊利诺伊大学芝加哥分校)

AI总结 本文综述了针对异质图的图神经网络,提出系统分类并分析其与图研究领域的关系,旨在推动更有效的图神经网络发展。

Comments Accepted by IEEE Transactions on Knowledge and Data Engineering (TKDE) 2026; 24 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15923 2026-04-20 cs.SD cs.CV

Hierarchical Codec Diffusion for Video-to-Speech Generation

层次编码扩散用于视频到语音生成

Jiaxin Ye, Gaoxiang Cong, Chenhui Wang, Xin-Cheng Wen, Zhaoyang Li, Boyuan Cao, Hongming Shan

机构 * Fudan University(复旦大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文提出HiCoDiT,利用残差向量量化编码的层次结构,通过低层和高层块生成不同层级的语音令牌,以实现强音频视觉对齐,实验表明其在保真度和表达性上优于基线。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15589 2026-04-20 cs.CL cs.AI cs.LG

LLM attribution analysis across different fine-tuning strategies and model scales for automated code compliance

跨不同微调策略和模型规模的大型语言模型可解释性分析用于自动化代码合规

Jack Wei Lun Shi, Minghao Dang, Wawan Solihin, Justin K. W. Yeoh

机构 * Department of Civil and Environmental Engineering, National University of Singapore(新加坡国立大学土木与环境工程系) School of Transportation Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学交通运输科学与工程学院) Research and Innovation, NovaCITYNETS Pte.Ltd.(NovaCITYNETS Pte.Ltd.研究与创新部)

AI总结 本文通过扰动分析比较不同微调策略和模型规模下LLM的可解释行为,发现全微调产生更聚焦的属性模式,且模型规模增大时,LLM发展出优先考虑数值约束和规则标识符的策略,但语义相似度在7B以上模型中趋于平稳。

Comments 8 pages, 9 figures. Accepted at ICCCBE 2026 (International Conference on Computing in Civil and Building Engineering)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08281 2026-04-20 cs.CL

When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning

何时信任工具?用于工具集成数学推理的自适应工具信任校准

Ruotao Xu, Yixin Ji, Yu Luo, Jinpeng Li, Dong Li, Peifeng Li, Juntao Li, Min Zhang

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Department of Foundation Model, 2012 Labs, Huawei(华为基础模型部门) Harbin Institute of Technology, Shenzhen (HITSZ)(哈尔滨工业大学深圳(HITSZ))

AI总结 本文提出ATTC框架,通过自适应选择信任或忽略工具结果来解决工具忽略问题,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21322 2026-04-20 cs.RO

Robust Real-Time Coordination of CAVs: A Distributed Optimization Framework under Uncertainty

面向不确定环境的鲁棒实时协同:一种分布式优化框架

Haojie Bai, Tingting Zhang, Cong Guo, Yang Wang, Xiongwei Zhao, Hai Zhu

机构 * School of Electronic and Information Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)电子与信息工程学院) Defense Innovation Institute, Chinese Academy of Military Sciences(中国军事科学院国防创新研究院)

AI总结 本文提出一种分布式优化框架,通过鲁棒规划、并行ADMM算法和交互注意力机制,提升协同车辆的安全性和实时性能,实验表明在多种场景下碰撞率降低40.79%。

Comments Accept by IEEE TVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16176 2026-04-20 cs.AI cs.CL

Dynamic Sampling that Adapts: Self-Aware Iterative Data Persistent Optimization for Mathematical Reasoning

动态采样:自适应的自我意识迭代数据持久优化用于数学推理

Jun Rao, Xuebo Liu, Hexuan Deng, Zepeng Lin, Zixiong Yu, Jiansheng Wei, Xiaojun Meng, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳研究院) Huawei Large Model Data Technology Lab(华为大模型数据技术实验室)

AI总结 本文提出SAI-DPO框架,通过动态调整数据分布以适应模型能力变化,提升数学推理效率,实验显示其在多个基准上优于静态方法。

Comments ACL2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14564 2026-04-17 cs.AI cs.CL

MARS$^2$: Scaling Multi-Agent Tree Search via Reinforcement Learning for Code Generation

MARS$^2$:通过强化学习提升多智能体树搜索用于代码生成

Pengfei Li, Shijie Wang, Fangyuan Li, Yikun Fu, Kaifeng Liu, Kaiyan Zhang, Dazhi Zhang, Yuqiang Li, Biqing Qi, Bowen Zhou

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Harbin Institute of Technology(哈尔滨工业大学) Tsinghua University(清华大学)

AI总结 MARS$^2$通过多智能体协作与树搜索结合,提升强化学习在代码生成中的性能,实验表明其在多种模型和训练设置下均有效。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14159 2026-04-17 cs.CL cs.AI

HUOZIIME: An On-Device LLM-enhanced Input Method for Deep Personalization

HUOZIIME:一种基于大语言模型的设备端输入法用于深度个性化

Baocai Shan, Yuzhuang Xu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨理工大学)

AI总结 本文提出HUOZIIME,一种基于大语言模型的设备端输入法,通过合成个性化数据训练基础模型,结合分层记忆机制实现高效个性化文本生成,实验表明其在设备端执行高效且个性化质量高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12452 2026-04-17 cs.CL

Latent-Condensed Transformer for Efficient Long Context Modeling

基于MLA的潜在压缩Transformer用于高效长上下文建模

Zeng You, Yaofo Chen, Qiuwu Chen, Ying Sun, Shuhai Zhang, Yingjian Li, Yaowei Wang, Mingkui Tan

机构 * South China University of Technology(南方科技大学) Pengcheng Laboratory(鹏城实验室) AIGCode Harbin Institute of Technology(哈尔滨工业大学) Pazhou Laboratory(琶洲实验室)

AI总结 本文提出Latent-Condensed Attention,通过在MLA的潜在空间内压缩上下文,减少计算成本和KV缓存,同时保持性能。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08064 2026-04-16 cs.AI

ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models

ImplicitMemBench: 测量大语言模型中的无意识行为适应

Chonghan Qin, Xiachong Feng, Weitao Ma, Xiaocheng Feng, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出ImplicitMemBench,首个评估大语言模型隐性记忆的系统基准,通过三个认知基础构念测试隐性记忆,揭示模型在自动执行任务中的局限性。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13787 2026-04-16 cs.CL

ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution

ToolOmni: 通过代理学习实现开放世界工具使用:基于主动检索和基础执行

Shouzheng Huang, Meishan Zhang, Baotian Hu, Min Zhang

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 ToolOmni通过主动检索和基础执行实现开放世界工具使用,通过冷启动多轮交互数据集和Decoupled Multi-Objective GRPO算法提升工具检索和执行性能,实验表明其在检索和执行任务上均达到SOTA水平。

Comments 19 pages, 9 figures, 9 tables, accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12780 2026-04-15 cs.CV cs.AI

Efficient Adversarial Training via Criticality-Aware Fine-Tuning

通过临界性感知微调实现高效的对抗训练

Wenyun Li, Zheng Zhang, Dongmei Jiang, Yaowei Wang, Xiangyuan Lan

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Pazhou Laboratory (Huangpu)(琶洲实验室(黄埔))

AI总结 本文提出CAAT方法,通过选择性微调关键参数提升对抗鲁棒性,仅需6%的参数调整即可实现与标准对抗训练相当的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12610 2026-04-15 cs.CL

Transforming External Knowledge into Triplets for Enhanced Retrieval in RAG of LLMs

将外部知识转化为三元组以增强LLM中RAG的检索

Xudong Wang, Chaoning Zhang, Qigan Sun, Zhenzhen Huang, Chang Lu, Sheng Zheng, Zeyu Ma, Caiyan Qin, Yang Yang, Hengtao Shen

机构 * School of Computing, Kyung Hee University(韩国庆熙大学计算机学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) School of Robotics and Advanced Manufacture, Harbin Institute of Technology(哈尔滨工业大学机器人与先进制造学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

AI总结 Tri-RAG通过结构化三元组构建提升检索效率,减少冗余信息,提高生成质量与资源利用率。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12582 2026-04-15 cs.CV

Relaxing Anchor-Frame Dominance for Mitigating Hallucinations in Video Large Language Models

缓解视频大语言模型幻觉的锚架主导问题

Zijian Liu, Sihan Cao, Pengcheng Zheng, Kuien Liu, Caiyan Qin, Xiaolin Qin, Jiwei Wei, Chaoning Zhang

机构 * University of Electronic Science and Technology of China(电子科技大学) Institute of Software Chinese Academy of Sciences(中国科学院软件研究所) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Chengdu Institute of Computer Applications, Chinese Academy of Sciences, University of the Chinese Academy of Sciences(中国科学院成都计算机应用研究所,中国科学院大学)

AI总结 本文提出DTR方法,通过解码器侧时间再平衡缓解视频大语言模型在生成时的时间证据分配不均问题,提升幻觉鲁棒性并保持视频理解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13340 2026-04-15 cs.CV

Retrievals Can Be Detrimental: Unveiling the Backdoor Vulnerability of Retrieval-Augmented Diffusion Models

检索可能有害:揭示检索增强扩散模型的后门漏洞

Hao Fang, Xiaohang Sui, Hongyao Yu, Kuofeng Gao, Jiawei Kong, Sijin Yu, Bin Chen, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文揭示了检索增强扩散模型(RDM)的后门漏洞,通过多模态对比攻击方法BadRDM,展示了如何利用检索数据库中的毒害代理进行攻击,同时保持模型的正常功能。

Comments Accepted by ACL-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01620 2026-04-15 cs.LG cs.CR cs.CV

IMU: Influence-guided Machine Unlearning

IMU: 基于影响的机器遗忘

Xindi Fan, Jing Wu, Mingyi Zhou, Pengwei Liang, Mehrtash Harandi, Dinh Phung

机构 * Harbin Institute of Technology(哈尔滨工业大学) Monash University(墨尔本大学) Beihang University(北航大学) City University of Hong Kong(香港城市大学)

AI总结 IMU通过利用影响函数作为优先信号,基于遗忘集进行机器遗忘,提升模型效用并减少对保留知识的扰动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01041 2026-04-15 cs.LG cs.AI

Fast AI Model Partition for Split Learning over Edge Networks

边缘网络上的快速AI模型划分用于分裂学习

Zuguang Li, Wen Wu, Shaohua Wu, Xuemin, Shen

机构 * School of Electronics and Information Engineering, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区电子与信息工程学院) Department of Strategic and Advanced Interdisciplinary Research, Pengcheng Laboratory, Shenzhen(鹏城实验室战略与先进交叉学科研究部) Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系)

AI总结 本文提出了一种优化模型划分算法,通过将AI模型表示为DAG并转化为最小s-t割问题,以减少分裂学习中的训练延迟,实验表明该方法在运行时间和延迟上优于现有方案。

Comments This version lacks sufficient detail in key technical parts, including the equivalence proof for the s-t cut transformation and the computational complexity analysis (Sections VI-D). We are withdrawing it to prepare a revised, more complete manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11320 2026-04-14 cs.RO

CLASP: Closed-loop Asynchronous Spatial Perception for Open-vocabulary Desktop Object Grasping

CLASP: 闭环异步空间感知用于开放词汇桌面物体抓取

Yiran Ling, Wenxuan Li, Siying Dong, Yize Zhang, Xiaoyao Huang, Jing Jiang, Ruonan Li, Jie Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学) National Key Laboratory of Smart Farm Technologies and Systems(智慧农场技术与系统全国重点实验室) Peng Cheng Laboratory(鹏城实验室) Northeastern University(东北大学)

AI总结 本文提出CLASP框架,通过异步闭环机制整合多模态感知、逻辑推理与状态反馈,解决低级抓取中多模态演示不足、空间幻觉和开放环执行脆弱性问题,实现87%的成功率和强泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11214 2026-04-14 cs.CL

HiEdit: Lifelong Model Editing with Hierarchical Reinforcement Learning

HiEdit:基于分层强化学习的终身模型编辑

Yangfan Wang, Tianyang Sun, Chen Tang, Jie Liu, Wei Cai, Jingchi Jiang

机构 * Harbin Institute of Technology(哈尔滨工业大学) Beidahuang Information Co., Ltd.(北大荒信息有限公司) State Key Laboratory of Smart Farm Technologies and Systems(智慧农场技术与系统全国重点实验室) AI Research Center, Midea Group (Shanghai) Co., Ltd.(美的集团(上海)有限公司人工智能研究中心)

AI总结 本文提出HiEdit,通过分层强化学习框架实现对部署大语言模型中过时或不准确知识的修正,通过动态选择知识相关的层实现精准更新,提升RLEdit性能8.48%。

Comments Accept by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11188 2026-04-14 cs.CL cs.AI

MathAgent: Adversarial Evolution of Constraint Graphs for Mathematical Reasoning Data Synthesis

MathAgent: 基于约束图的对抗进化用于数学推理数据合成

Zixiong Yu, Jun Rao, Guhan Chen, Songtao Tian, Bohan Li, Jiansheng Wei, Min Zhang, Xiaojun Meng

机构 * Huawei Large Model Data Technology Lab(华为大模型数据技术实验室) Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Kyoto University(京都大学)

AI总结 本文提出MathAgent框架,通过约束图的对抗进化生成高质量数学推理数据,提升模型在八个数学基准上的泛化能力。

Comments Accepted by ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11174 2026-04-14 cs.RO cs.AI

EmbodiedGovBench: A Benchmark for Governance, Recovery, and Upgrade Safety in Embodied Agent Systems

EmbodiedGovBench: 一种用于具身代理系统治理、恢复和升级安全性的基准

Xue Qin, Simin Luan, John See, Cong Yang, Zhijun Li

机构 * School of Software, Harbin Institute of Technology(哈尔滨工业大学软件学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) School of Mathematical and Computer Sciences, Heriot-Watt University, Malaysia Campus(赫瑞-瓦特大学马来西亚校区数学与计算机科学学院) School of Future Science and Engineering, Soochow University(苏州大学未来科学与工程学院)

AI总结 本文提出EmbodiedGovBench基准,用于评估具身代理系统的治理能力,包括可控性、政策边界、安全恢复和审计完整性等,填补了传统任务成功率指标的不足。

Comments 34 pages, 7 tables. Code: https://github.com/s20sc/embodied-gov-bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09270 2026-04-14 cs.CL

MCGA: A Multi-task Classical Chinese Literary Genre Audio Corpus

MCGA:多任务古典中文文学体裁音频语料库

Yexing Du, Kaiyuan Liu, Bihe Zhang, Youcheng Pan, Bo Yang, Liangyu Huo, Xiyuan Zhang, Jian Xie, Daojing He, Yang Xiang, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室) South China University of Technology(华南理工大学) Du xiaoman(杜小满)

AI总结 本文提出MCGA语料库,包含22000个音频样本,涵盖六个任务:ASR、S2TT、SEC、SQA、SU和SR,评估十种MLLM发现其在MCGA测试集上仍面临显著挑战,并引入领域特定的SEC指标和语音与文本一致性度量。

Comments Accepted in ACL 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01512 2026-04-14 cs.CL

MCAT: Scaling Many-to-Many Speech-to-Text Translation with MLLMs to 70 Languages

MCAT: 通过MLLMs扩展多对多语音到文本翻译至70种语言

Yexing Du, Kaiyuan Liu, Youcheng Pan, Bo Yang, Keqi Deng, Xie Chen, Yang Xiang, Ming Liu, Bing Qin, YaoWei Wang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Harbin Institute of Technology, Harbin(哈尔滨工业大学(哈尔滨)) University of Cambridge(剑桥大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 MCAT框架通过课程学习和数据平衡策略扩展MLLMs支持70种语言并实现互译,同时优化语音适配模块将语音序列长度缩减至30个token,提升翻译效率。

Comments Accepted in IEEE TASLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10557 2026-04-14 cs.CL cs.AI

LLMs Should Incorporate Explicit Mechanisms for Human Empathy

LLMs应纳入显式的人类共情机制

Xiaoxing You, Qiang Huang, Jun Yu

机构 * School of Computer Science, Hangzhou Dianzi University(杭州电子科技大学计算机学院) School of Intelligence Science and Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)智能科学与工程学院)

AI总结 本文探讨了LLM应纳入显式共情机制以保持人类视角,指出现有模型在共情方面存在系统性缺陷,提出通过认知、文化和关系维度分析共情失败,并推动建立共情意识的目标、基准和训练信号。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20725 2026-04-14 cs.CV

Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation

Premier: 基于可学习用户嵌入的个性化偏好调节在文本到图像生成中

Zihao Wang, Yuxiang Wei, Xinpeng Zhou, Tianyu Zhang, Tao Liang, Yalong Bai, Hongzhi Zhang, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Duxiaoman(度小满)

AI总结 Premier通过可学习用户嵌入和偏好适配器实现个性化图像生成,引入分散损失提升用户偏好区分度,实验显示其在偏好对齐和文本一致性上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07224 2026-04-14 cs.AI cs.LG

Consolidation or Adaptation? PRISM: Disentangling SFT and RL Data via Gradient Concentration

巩固还是适应?PRISM:通过梯度集中解耦SFT和RL数据

Yang Zhao, Yangou Ouyang, Xiao Ding, Hepeng Wang, Bibo Cai, Kai Xiong, Jinglong Gao, Zhouhao Sun, Li Du, Bing Qin, Ting Liu

机构 * Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology(哈尔滨工业大学社会计算与交互机器人研究中心) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 PRISM通过分析梯度空间结构,区分高冲突数据需RL重构与低冲突数据需SFT巩固,提升LLM训练效率与鲁棒性。

Comments ACL2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏