arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

共收录 765
2605.00702 2026-05-04 cs.CL

Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory

学习如何和记忆什么:受认知启发的两阶段优化用于进化记忆

Derong Xu, Shuochen Liu, Pengfei Luo, Pengyue Jia, Yingyi Zhang, Yi Wen, Yimin Deng, Wenlin Zhang, Enhong Chen, Xiangyu Zhao, Tong Xu

机构 * University of Science and Technology of China & State Key Laboratory of Cognitive Intelligence(中国科学技术大学 & 认知智能国家重点实验室) City University of Hong Kong(香港城市大学) Dalian University of Technology(大连理工大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出MemCoE框架,通过两阶段优化学习记忆组织方式和更新内容,提升长期个性化记忆的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00630 2026-05-04 cs.CV cs.MM eess.IV

CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection

CMTA:利用跨模态时间特征进行通用的AI生成视频检测

Hang Wang, Chao Shen, Chenhao Lin, Minghui Yang, Lei Zhang, Cong Wang

机构 * Xi’an Jiaotong University(西安交通大学) The Hong Kong Polytechnic University(香港理工大学) Guangdong OPPO Mobile Communications Co., Ltd.(广东OPPO移动通信有限公司) City University of Hong Kong(香港城市大学)

AI总结 本文提出CMTA框架,通过联合跨模态嵌入和多粒度时间建模,识别AI生成视频中的跨模态时间特征,验证了其在四个大规模数据集上的新状态和跨生成器泛化能力。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00605 2026-05-04 cs.CV

Faithful Extreme Image Rescaling with Learnable Reversible Transformation and Semantic Priors

基于可学习可逆变换和语义先验的忠实极端图像放大

Hao Wei, Yanhui Zhou, Chenyang Ge, Saeed Anwar, Ajmal Mian

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) School of Information and Communications Engineering, Xi’an Jiaotong University(信息与通信工程学院,西安交通大学) Department of Computer Science and Software Engineering, The University of Western Australia(计算机科学与软件工程系,西澳大学)

AI总结 本文提出FaithEIR框架,通过可学习可逆变换和语义先验提升极端图像放大的真实性与细节,实验表明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28158 2026-05-04 cs.AI

Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists

Intern-Atlas:一种方法论进化图作为人工智能科学家的研究基础设施

Yujun Wu, Dongxu Zhang, Xinchen Li, Jinhang Xu, Yiling Duan, Yumou Liu, Jiabao Pan, Qiyuan Zhu, Xuanhe Zhou, Jingxuan Wei, Siyuan Li, Jintao Chen, Conghui He, Cheng Tan

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Peking University(北京大学) Xi'an Jiaotong University(西安交通大学) Zhejiang University(浙江大学) East China Normal University(华东师范大学) Hunan University(湖南大学) Shanghai Jiao Tong University(上海交通大学) Shanghai University(上海大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 Intern-Atlas通过构建方法论进化图,自动识别方法实体,推断方法间的关系,并捕捉驱动创新过渡的瓶颈,为AI研究提供因果网络支持。

Comments 25 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22018 2026-05-01 cs.LG cs.SE

Do Papers Tell the Whole Story? A Benchmark and Framework for Uncovering Hidden Implementation Gaps in Bioinformatics

论文是否讲完了全部故事?一个用于揭示生物信息学中隐藏实现差距的基准和框架

Tianxiang Xu, Xiaoyan Zhu, Xin Lai, Sizhe Dang, Xin Lian, Hangyu Cheng, Jiayin Wang

机构 * Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出论文-代码一致性检测任务,构建首个生物信息学基准数据集BioCon,通过统一框架提升代码与论文的一致性与语义对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27553 2026-05-01 cs.CV

Revealing the Impact of Visual Text Style on Attribute-based Descriptions Produced by Large Visual Language Models

揭示视觉文本风格对大型视觉语言模型生成的基于属性的描述的影响

Xiaomeng Wang, Martha Larson, Zhengyu Zhao

机构 * Radboud University(拉博德大学) Xi'an Jiaotong University(西安交通大学)

AI总结 研究视觉文本风格如何影响大型视觉语言模型对概念属性的描述,发现即使正确识别概念,文本风格仍会影响模型输出,推动风格感知评估与缓解。

Comments Accepted by ICMR 2026. Code is available at https://github.com/XiaomengWang-AI/The-Impact-of-Visual-Text-style-on-Attribute-based-Descriptions-Produced-by-LVLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07798 2026-05-01 cond-mat.mtrl-sci cs.LG

Generative Inversion for Property-Targeted Materials Design: Application to Shape Memory Alloys

面向性能目标的材料设计生成性反向设计:应用于形状记忆合金

Cheng Li, Pengfei Danga, Yuehui Xiana, Yumei Zhou, Bofeng Shi, Xiangdong Ding, Jun Suna, Dezhen Xue

机构 * State Key Laboratory for Mechanical Behavior of Materials, Xi'an Jiaotong University, Xi'an 710049, China(材料机械行为国家重点实验室,西安交通大学,西安710049,中国)

AI总结 本文提出基于生成对抗网络反向设计的框架,用于设计高性能形状记忆合金,通过梯度优化生成满足性能目标的合金成分和工艺参数,并通过实验验证了其有效性。

Journal ref Advanced Functional Materials (2026): e27774

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26774 2026-04-30 cs.CV cs.AI

MemOVCD: Training-Free Open-Vocabulary Change Detection via Cross-Temporal Memory Reasoning and Global-Local Adaptive Rectification

MemOVCD:基于跨时间记忆推理和全局局部自适应校正的无训练开放词汇变化检测

Zuzheng Kuang, Honghao Chang, Boqiang Liang, Haoqian Wang, Lijun He, Fan Li, Haixia Bi

机构 * School of Information and Communications Engineering, Xi’an Jiaotong University(西安交通大学信息与通信工程学院)

AI总结 MemOVCD通过跨时间记忆推理和全局局部自适应校正,解决开放词汇变化检测中时间耦合不足和局部碎片化问题,验证了其在多基准上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11058 2026-04-30 cs.CV

Action Hints: Semantic Typicality and Context Uniqueness for Generalizable Skeleton-based Video Anomaly Detection

动作提示:语义典型性和上下文唯一性用于可泛化的基于骨架的视频异常检测

Canhui Tang, Sanping Zhou, Haoyue Shi, Le Wang

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室) National Engineering Research Center for Visual Information(视觉信息工程国家级工程研究中心) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) Robotics, Xi'an Jiaotong University(机器人学,西安交通大学) School of Electronics and Control Engineering(电子控制工程学院)

AI总结 本文提出基于骨架的零样本视频异常检测框架,通过动作典型性和唯一性学习提升模型泛化能力,在四个大规模数据集上取得最佳性能。

Comments The paper has been accepted by Pattern Recognition (PR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14246 2026-04-30 cs.LG cs.AI

Awakening Dormant Experts:Counterfactual Routing to Mitigate MoE Hallucinations

唤醒沉睡的专家:反事实路由以缓解MoE幻觉

Wentao Hu, Yanbo Zhai, Xiaohui Hu, Mingkuan Zhao, Shanhong yu, Xue Liu, Kaidong Yu, Shuangyong Song, Xuelong Li

机构 * Xi’an Jiaotong University(西安交通大学) Xingchen AGI Lab, China Telecom Artificial Intelligence Technology (Beijing) Co., Ltd.(兴辰AGI实验室,中国电信人工智能技术(北京)有限公司) Institute of Artificial Intelligence, China Telecom(中国电信人工智能研究院) Beijing Foreign Studies University(北京外国语大学)

AI总结 本文提出反事实路由框架,通过动态调整计算资源以唤醒沉睡的专家,提升事实准确性,实验显示在TruthfulQA等数据集上平均提升3.1%。

Comments 14 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03558 2026-04-30 cs.CV cs.AI cs.MM

ELIQ: A Label-Free Framework for Quality Assessment of Evolving AI-Generated Images

ELIQ:一种无需标签的进化AI生成图像质量评估框架

Xinyue Li, Zhiming Xu, Min Tang, Zhaolin Cai, Sijing Wu, Xiongkuo Min, Yitong Chen, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Xi'an Jiaotong University(西安交通大学)

AI总结 ELIQ通过自动构建正负样本对,利用预训练多模态模型提升质量评估,实现无需人工标注的高质量评估,优于现有无标签方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24622 2026-04-29 cs.CV cs.AI

CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies

CF-VLA:面向视觉-语言-动作策略的高效粗到细动作生成

Fan Du, Feng Yan, Jianxiong Wu, Xinrun Xu, Weiye Zhang, Weinong Wang, Yu Guo, Bin Qian, Zhihai He, Fei Wang, Heng Yang

机构 * Southern University of Science and Technology(南方科技大学) Xi’an Jiaotong University(西安交通大学) United Nova Technology(联合Nova技术) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出CF-VLA,通过粗到细两阶段方法优化视觉-语言-动作策略的动作生成,提升效率与性能,在低NFE条件下实现更优的效率-性能平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23069 2026-04-29 cs.CV

Align then Adapt: Rethinking Parameter-Efficient Transfer Learning in 4D Perception

对齐后再适应:重新思考4D感知中的参数高效迁移学习

Yiding Sun, Jihua Zhu, Haozhe Cheng, Chaoyi Lu, Zhichuan Yang, Lin Chen, Yaonan Wang

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室) School of Electrical and Information Engineering, Hunan University(湖南大学电气与信息工程学院) National Engineering Research Center for Robot Visual Perception and Control Technology(机器人视觉感知与控制技术国家工程研究中心)

AI总结 本文提出PointATA方法,通过分阶段对齐和适应解决4D感知中的模态差距和过拟合问题,实现参数高效迁移学习,实验显示其在动作识别、分割等任务中表现优异。

Comments Accepted by IEEE Transactions on Multimedia (Regular Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25152 2026-04-29 cs.CR cs.CL

MGTEVAL: An Interactive Platform for Systemtic Evaluation of Machine-Generated Text Detectors

MGTEVAL:一种用于机器生成文本检测器系统性评估的交互平台

Yuanfan Li, Qi Zhou, Chengzhengxu Li, Zhaohan Zhang, Chenxu Zhao, Zepu Ruan, Chao Shen, Xiaoming Liu

机构 * Faculty of Electronic and Information Engineering, Xi’an Jiaotong University(西安交通大学电子与信息工程学院) Queen Mary University of London(伦敦大学女王学院)

AI总结 MGTEVAL平台通过统一接口构建自定义基准、应用文本攻击测试集、训练检测器并评估性能,解决MGT检测评估碎片化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.14245 2026-04-29 cs.CV

Practical exposure correction via compensation

实用曝光校正 via 补偿

Long Ma, Nan An, Jinyuan Liu, Xin Fan, Zhongxuan Luo, Deyu Meng, Risheng Liu

机构 * School of Software Technology, Dalian University of Technology(大连理工大学软件学院) School of Mechanical Engineering, Dalian University of Technology(大连理工大学机械工程学院) School of Mathematics and Statistics, Xi'an Jiaotong University(西安交通大学数学与统计学学院) Macao Institute of Systems Engineering, Macau University of Science and Technology(澳门科学理工学院系统工程研究所)

AI总结 本文提出一种实用曝光校正器PEC,通过构建曝光敏感补偿模型和对抗函数,提升校正质量和效率,并在多个数据集上验证了其适应性和处理速度。

Comments Project Page: https://rsliu.tech/PEC

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24515 2026-04-28 cs.CL

SEARCH-R: Structured Entity-Aware Retrieval with Chain-of-Reasoning Navigator for Multi-hop Question Answering

SEARCH-R: 结构化实体感知检索与推理链导航器用于多跳问答

Yuqing Fu, Yimin Deng, Wanyu Wang, Yuhao Wang, Yejing Wang, Hongshi Liu, Yiqi Wang, Xiao Han, Maolin Wang, Guoshuai Zhao, Yi Chang, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) Xi’an Jiaotong University(西安交通大学) Zhejiang University of Technology(浙江工业大学) Michigan State University(密歇根州立大学) Jilin University(吉林大学)

AI总结 SEARCH-R通过结构化实体感知检索与推理链导航器,解决多跳问答中推理路径生成和知识检索的准确性问题,提升多跳问答性能。

Comments ACL2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24186 2026-04-28 cs.CL cs.AI

MultiDx: A Multi-Source Knowledge Integration Framework towards Diagnostic Reasoning

MultiDx: 一个面向诊断推理的多源知识整合框架

Yimin Deng, Zhenxi Lin, Yejing Wang, Guoshuai Zhao, Pengyue Jia, Zichuan Fu, Derong Xu, Yefeng Zheng, Xiangyu Zhao, Li Zhu, Xian Wu, Xueming Qian

机构 * Xi’an Jiaotong University(西安交通大学) City University of Hong Kong(香港城市大学) Tencent Jarvis Lab(腾讯 Jarvis实验室) Westlake University(西湖大学)

AI总结 本文提出MultiDx框架,通过多源知识整合提升诊断推理能力,结合网络搜索、病例数据库等多视角证据,生成最终预测。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24175 2026-04-28 cs.CL cs.AI

AdapTime: Enabling Adaptive Temporal Reasoning in Large Language Models

AdapTime:在大语言模型中实现自适应时间推理

Yimin Deng, Yejing Wang, Zhenxi Lin, Zichuan Fu, Guoshuai Zhao, Derong Xu, Yefeng Zheng, Xiangyu Zhao, Xian Wu, Li Zhu, Xueming Qian

机构 * Xi’an Jiaotong University(西安交通大学) City University of Hong Kong(香港城市大学) Tencent Jarvis Lab(腾讯 Jarvis实验室) Westlake University(西湖大学)

AI总结 本文提出AdapTime方法,通过动态执行推理步骤提升大语言模型的时间推理能力,采用重构、重写和复核三步策略,无需外部工具即可增强模型对时间信息的处理能力。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23999 2026-04-28 math.NA cs.LG cs.NA

Adaptive-Distribution Randomized Neural Networks for PDEs: A Low-Dimensional Distribution-Learning Framework

自适应分布随机神经网络用于PDEs:一种低维分布学习框架

You Yang, Fei Wang

机构 * School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, Shaanxi 710049, China(西安交通大学数学与统计学院,西安,陕西710049,中国)

AI总结 本文提出AD-RaNN框架,通过低维优化解决随机神经网络在求解PDEs时的分布敏感问题,减少人工调参,提升求解精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20597 2026-04-28 cs.CV

StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval

StructAlign:结构化跨模态对齐用于连续文本到视频检索

Shaokun Wang, Weili Guan, Jizhou Han, Jianlong Wu, Yupeng Hu, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Xi’an Jiaotong University(西安交通大学) Shandong University(山东大学)

AI总结 本文提出StructAlign,通过结构化跨模态对齐方法解决连续文本到视频检索中的模态错位和特征漂移问题,提升模型持续学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23213 2026-04-28 cs.CL cs.AI

Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process

评分、推理与选择最佳!通过同行评审过程进行大型语言模型的集成

Zhijun Chen, Zeyu Ji, Qianren Mao, Hao Wu, Jinhuan Song, Junhang Cheng, Bangjie Qin, Zhuoran Li, Jingzheng Li, Kai Sun, Zizhe Wang, Yikun Ban, Zhu Sun, Xiangyang Ji, Hailong Sun

机构 * Beihang University, Beijing, China(北京航空航天大学) Zhongguancun Laboratory, Beijing, China(中关村实验室) Beijing University of Posts and Telecommunications(北京邮电大学) Hong Kong University of Science and Technology(香港科学与技术大学) Xi'an Jiaotong University, Xi'an, China(西安交通大学) Tsinghua University, Beijing, China(清华大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 本文提出LLM-PeerReview方法,通过同行评审机制集成多个大型语言模型,提升响应质量。实验显示其在多个数据集上优于Smoothie-Global,适用于事实性问答、数学推理等任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22333 2026-04-27 cs.CV cs.AI

ChangeQuery: Advancing Remote Sensing Change Analysis for Natural and Human-Induced Disasters from Visual Detection to Semantic Understanding

ChangeQuery: 从视觉检测到语义理解,推动自然灾害和人为灾害的遥感变化分析

Dongwei Sun, Jing Yao, Kan Wei, Xiangyong Cao, Chen Wu, Zhenghui Zhao, Pedram Ghamisi, Jun Zhou, Jón Atli Benediktsson

机构 * School of Computer Science and Technology and the Ministry of Education Key Lab for Intelligent Networks and Network Security, Xi’an Jiaotong University(计算机科学与技术学院和教育部智能网络与网络安全重点实验室,西安交通大学) State Key Laboratory of Remote Sensing and Digital Earth, Aerospace Information Research Institute, Chinese Academy of Sciences(遥感与数字地球国家重点实验室,航空信息研究所,中国科学院) State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(测绘遥感信息工程国家重点实验室,武汉大学) Helmholtz-Zentrum Dresden-Rossendorf(德累斯顿-罗斯托克研究所) Lancaster Environment Centre, Lancaster University(兰卡斯特大学环境研究中心) Faculty of Electrical and Computer Engineering, University of Iceland(冰岛大学电气与计算机工程学院) School of Information and Communication Technology, Griffith University(格里菲斯大学信息与通信技术学院)

AI总结 ChangeQuery通过多模态框架实现灾害情境感知,结合DICQ数据集和自动化标注管道,提升灾害监测的交互性和解释性,实现高精度的灾害量化与总结。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21510 2026-04-24 cs.CL

OptiVerse: A Comprehensive Benchmark towards Optimization Problem Solving

OptiVerse:一个面向优化问题求解的综合基准

Xinyu Zhang, Boxuan Zhang, Yuchen Wan, Lingling Zhang, YiXing Yao, Bifan Wei, Yaqiang Wu, Jun Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Ministry of Education Key Laboratory of Intelligent Networks and Network Security, China(教育部智能网络与网络安全重点实验室) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering, China(陕西省大数据知识工程重点实验室) Lenovo Research(联想研究院)

AI总结 OptiVerse通过1000个跨领域问题评估LLM在复杂优化任务中的表现,揭示模型在难题上的性能下降,并提出Dual-View Auditor Agent提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05563 2026-04-24 cs.CV cs.SI

What's Left Unsaid? Detecting and Correcting Misleading Omissions in Multimodal News Previews

未被言说之物:检测和纠正多模态新闻预告中的误导性省略

Fanxiao Li, Jiaying Wu, Tingchao Fu, Dayang Li, Herun Wan, Wei Zhou, Min-Yen Kan

机构 * School of Information Science and Engineering, Yunnan University(云南大学信息科学与工程学院) National University of Singapore(新加坡国立大学) Xi’an Jiaotong University(西安交通大学) School of Engineering, Yunnan University(云南大学工程学院)

AI总结 本文提出MM-Misleading基准,通过多阶段流程评估开源LVLMs,发现省略性误导的盲区,并提出OMGuard结合细调和引导修正,提升检测与纠正效果,揭示局部叙事变化导致的误导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18457 2026-04-24 cs.CV cs.LG

VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models

VFM-VAE:视觉基础模型可以作为潜在扩散模型的良好分词器

Tianci Bi, Xiaoyi Zhang, Yan Lu, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文提出VFM-VAE,利用冻结的视觉基础模型作为潜在扩散模型的分词器,通过设计新解码器提升图像重建能力,实现分词器与扩散模型的协同优化,提升训练效率与性能。

Comments Accepted at CVPR 2026. Code and models available at: https://github.com/tianciB/VFM-VAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21503 2026-04-23 cs.AI cs.CL cs.LG cs.NE

MAR: Efficient Large Language Models via Module-aware Architecture Refinement

MAR:通过模块感知架构优化实现高效的大型语言模型

Junhong Cai, Guiqin Wang, Kejie Zhao, Jianxiong Tang, Xiang Wang, Luziwei Leng, Ran Cheng, Yuxin Ma, Qinghai Guo

机构 * Department of CSE, Southern University of Science and Technology(南方科技大学计算机科学与工程系) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) National Engineering Laboratory for Big Data Analytics, Xi’an Jiaotong University(西安交通大学大数据分析国家工程实验室) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) ACS Laboratory, Huawei Technologies Co., Ltd.(华为技术有限公司ACS实验室)

AI总结 本文提出MAR框架,结合状态空间模型和激活稀疏化,降低LLM的能耗并提升性能,同时设计ATMN和SBDS解决SNN与SSM整合问题,实验表明其在受限资源下性能优异且能超越同等或更大规模的高效模型。

Comments Accepted by ICASSP 2026. 5 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18036 2026-04-23 cs.CL

Harnessing Multiple Large Language Models: A Survey on LLM Ensemble

利用多个大语言模型:关于LLM集成的综述

Zhijun Chen, Xiaodong Lu, Jingzheng Li, Pengpeng Chen, Zhuoran Li, Kai Sun, Yuankai Luo, Qianren Mao, Ming Li, Likang Xiao, Dingqi Yang, Xiao Huang, Yikun Ban, Hailong Sun, Philip S. Yu

机构 * State Key Laboratory of Complex & Critical Software Environment, Beihang University, Beijing, China(复杂与关键软件环境国家重点实验室,北京航空航天大学,北京,中国) Zhongguancun Laboratory, Beijing, China(中关村实验室,北京,中国) Aviation System Engineering Institute of China, Beijing, China(中国航空系统工程研究院,北京,中国) Xi’an Jiaotong University, Xi’an, China(西安交通大学,西安,中国) Nanjing University, Nanjing, China(南京大学,南京,中国) Tsinghua University, Beijing, China(清华大学,北京,中国) University of Macau, Macau SAR, China(澳门大学,澳门特别行政区,中国) The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学,香港,中国) University of Illinois at Chicago, Chicago, USA(伊利诺伊大学香槟分校,芝加哥,美国)

AI总结 本文系统回顾了LLM集成的最新发展,介绍了分类方法,讨论了相关研究问题,并提出了未来研究方向。

Comments 12 pages, 2 figures, codebase: https://github.com/junchenzhi/Awesome-LLM-Ensemble

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08730 2026-04-23 cs.CV

SegEarth-OV3: Exploring SAM 3 for Open-Vocabulary Semantic Segmentation in Remote Sensing Images

SegEarth-OV3: 探索SAM 3用于遥感图像的开放词汇语义分割

Kaiyu Li, Shengqi Zhang, Yujie Wang, Yupeng Deng, Zhi Wang, Deyu Meng, Xiangyong Cao

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Information and Communications Engineering, Xi’an Jiaotong University(西安交通大学信息与通信工程学院) Ministry of Education Key Lab of Intelligent Network Security, Xi’an, China(教育部智能网络安全重点实验室) Pazhou Laboratory (Huangpu), Radarweg 29, Guangzhou, China(琶洲实验室(黄埔),雷达路29号,广州,中国)

AI总结 本文提出SegEarth-OV3,通过结合SAM 3的语义分割头和Transformer解码器,提升遥感图像的语义分割性能,并通过实例和像素级验证策略改进变化检测,验证了SAM 3在开放词汇遥感任务中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04562 2026-04-22 cs.AI

Reasoning Over Space: Enabling Geographic Reasoning for LLM-Based Generative Next POI Recommendation

空间推理:为基于大语言模型的生成下POI推荐启用地理推理

Dongyi Lv, Qiuyu Ding, Heng-Da Xu, Zhaoxu Sun, Zhi Wang, Feng Xiong, Mu Xu

机构 * School Of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) Amap, Alibaba Group(阿里巴巴集团阿地图)

AI总结 本文提出ROS框架,通过地理信息作为决策变量提升生成式推荐的地理推理能力,采用分层空间语义ID和三阶段移动链式推理,结合空间引导强化学习,实现跨城市迁移和命中率提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19685 2026-04-21 cs.CV cs.AI

Generating Attribution Reports for Manipulated Facial Images: A Dataset and Baseline

生成篡改面部图像的归因报告:一个数据集和基线

Jingchun Lian, Lingyu Liu, Yaxiong Wang, Yujiao Wu, Lianwei Wu, Li Zhu, Zhedong Zheng

机构 * Xi’an Jiaotong University(西安交通大学) Hefei University of Technology(合肥工业大学) CSIRO(澳大利亚联邦科学与工业研究组织) Northwestern Polytechnical University(西北工业大学) University of Macau(澳门大学)

AI总结 本文提出多模态篡改追踪数据集和 ForgeryTalker 框架,通过联合定位篡改区域和生成自然语言解释,提升面部伪造检测的语义理解能力。

Comments Accepted to ACL 2026 (Main Conference). This version includes camera-ready revisions and updated experimental results

Journal ref Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏