arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

共收录 765
2601.00919 2026-01-08 cs.LG cs.AI cs.CL

Attention Needs to Focus: A Unified Perspective on Attention Allocation

注意力需要聚焦:注意力分配的统一视角

Zichuan Fu, Wentao Song, Guojing Li, Yejing Wang, Xian Wu, Yimin Deng, Hanyu Yan, Yefeng Zheng, Xiangyu Zhao

机构 * City University of Hong Kong(香港城市大学) Xi’an Jiaotong University(西安交通大学) Tencent(腾讯) Westlake University(西湖大学)

AI总结 本文提出Lazy Attention机制,通过位置歧视和Elastic-Softmax解决注意力过载和不足问题,提升注意力分配效率。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03717 2026-01-08 cs.CL

MIND: From Passive Mimicry to Active Reasoning through Capability-Aware Multi-Perspective CoT Distillation

MIND:通过能力感知的多视角CoT蒸馏从被动模仿到主动推理

Jin Cui, Jiaqi Guo, Jiepeng Zhou, Ruixuan Yang, Jiayi Lu, Jiajun Xu, Jiangcheng Song, Boran Zhao, Pengju Ren

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, National Engineering Research Center for Visual Information and Applications, and Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人机混合增强智能国家重点实验室、视觉信息与应用国家工程研究中心、人工智能与机器人研究所) Nankai University(南开大学) The Hong Kong University of Science and Technology(Guangzhou)(香港科技大学(广州)) School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件学院)

AI总结 MIND通过能力感知的多视角CoT蒸馏,从被动模仿转向主动推理,提升模型在分布内和分布外任务中的性能。

Comments 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02890 2026-01-07 physics.geo-ph cs.LG

Enhanced 3D Gravity Inversion Using ResU-Net with Density Logging Constraints: A Dual-Phase Training Approach

利用密度测井约束的增强型3D重力反演:一种双相训练方法

Siyuan Dong, Jinghuai Gao, Shuai Zhou, Baohai Wu, Hongfa Jia

机构 * School of Information and Communications Engineering(信息与通信工程学院) Xi’an Jiaotong University(西安交通大学) College of Geoexploration Science and Technology(地球探测科学与技术学院) Jilin University(吉林大学)

AI总结 本文提出一种双相训练方法,通过整合密度测井约束,改进3D重力反演的精度和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12043 2026-01-07 cs.LG

Information-Theoretic Generalization Bounds of Replay-based Continual Learning

基于回放的持续学习的信息论泛化界限

Wen Wen, Tieliang Gong, Zeyu Gao, Yunjiao Zhang, Weizhan Zhang, Yong-Jin Liu

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Department of Oncology, University of Cambridge(剑桥大学肿瘤学系) China Telecom, China(中国电信) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)

AI总结 本文提出了一种基于回放的持续学习的信息论泛化界限理论框架,通过分析内存缓冲区与当前任务的相互作用,建立了更精确的泛化性能评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02249 2026-01-06 cs.CV

SLGNet: Synergizing Structural Priors and Language-Guided Modulation for Multimodal Object Detection

SLGNet: 结合结构先验与语言引导调制的多模态目标检测

Xiantai Xiang, Guangyao Zhou, Zixiao Wen, Wenshuai Li, Ben Niu, Feng Wang, Lijia Huang, Qiantong Wang, Yuhan Liu, Zongxu Pan, Yuxin Hu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所) Key Laboratory of Target Cognition and Application Technology, Chinese Academy of Sciences(中国科学院目标认知与应用技术重点实验室) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件学院)

AI总结 SLGNet通过结合结构先验与语言引导调制,在冻结的ViT基础上实现高效多模态目标检测,提升环境适应性和检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01188 2026-01-06 cs.RO cs.CV

DST-Calib: A Dual-Path, Self-Supervised, Target-Free LiDAR-Camera Extrinsic Calibration Network

DST-Calib: 一种双路径、自监督、无目标的激光雷达-摄像头外参校准网络

Zhiwei Huang, Yanwei Fu, Yi Zhou, Xieyuanli Chen, Qijun Chen, Rui Fan

机构 * Department of Control Science & Engineering, the College of Electronics & Information Engineering, Tongji University(控制科学与工程系,电子与信息工程学院,同济大学) Department of Mechanical Engineering, the School of Mechanical Engineering, Tongji University(机械工程系,机械工程学院,同济大学) School of Robotics, Hunan University(机器人学院,湖南大学) College of Intelligence Science and Technology, National University of Defense Technology(智能科学与技术学院,国防科学技术大学) Department of Control Science & Engineering, the College of Electronics & Information Engineering, Shanghai Research Institute for Intelligent Autonomous Systems, the State Key Laboratory of Intelligent Autonomous Systems, and Frontiers Science Center for Intelligent Autonomous Systems, Tongji University(控制科学与工程系,电子与信息工程学院,上海智能自主系统研究院,智能自主系统国家重点实验室,智能自主系统前沿科学中心,同济大学) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学)

AI总结 DST-Calib通过双路径自监督方法,无需目标实现激光雷达与摄像头的高效外参校准,提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16760 2026-01-06 cs.RO

Vision-Language-Action Models for Autonomous Driving: Past, Present, and Future

面向自动驾驶的视觉-语言-动作模型:过去、现在与未来

Tianshuai Hu, Xiaolu Liu, Song Wang, Yiyao Zhu, Ao Liang, Lingdong Kong, Guoyang Zhao, Zeying Gong, Jun Cen, Zhiyu Huang, Xiaoshuai Hao, Linfeng Li, Hang Song, Xiangtai Li, Jun Ma, Shaojie Shen, Jianke Zhu, Dacheng Tao, Ziwei Liu, Junwei Liang

机构 * HKUST(香港科技大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) HKUST(GZ)(香港科技大学(广州)) DAMO Academy, Alibaba(阿里巴巴达摩院) University of California, Los Angeles(加州大学洛杉矶分校) Xiaomi EV(小米电动车) Xi'an Jiaotong University(西安交通大学) Nanyang Technological University, Singapore(新加坡南洋理工大学)

AI总结 本文探讨了自动驾驶中视觉-语言-动作模型的发展历程,提出两种主要范式并分析其挑战与未来方向。

Comments Survey; 47 pages, 7 figures, 9 tables; GitHub Repo at https://github.com/worldbench/awesome-vla-for-ad

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14716 2026-01-06 cs.LG cs.AI cs.CL

A Systematic Survey on Large Language Models for Algorithm Design

大型语言模型在算法设计中的系统性调研

Fei Liu, Yiming Yao, Ping Guo, Zhiyuan Yang, Zhe Zhao, Xi Lin, Xialiang Tong, Kun Mao, Zhichao Lu, Zhenkun Wang, Mingxuan Yuan, Qingfu Zhang

机构 * City University of Hong Kong(香港城市大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Xi'an Jiaotong University(西安交通大学) Huawei Cloud EI Service Product Dept.(华为云EI服务产品部) Southern University of Science(南方科技大学)

AI总结 本文系统性地综述了大型语言模型在算法设计中的应用,提出分类法分析其角色并指出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00647 2026-01-05 cs.CL cs.CE q-bio.QM

Physio-DPO: Aligning Large Language Models with the Protein Energy Landscape to Eliminate Structural Hallucinations

Physio-DPO:将大型语言模型与蛋白质能量景观对齐以消除结构幻觉

QiWei Meng

机构 * Xi’an Jiaotong University(西安交通大学)

AI总结 Physio-DPO通过引入物理感知的目标,将蛋白质语言模型与热力学稳定性对齐,有效减少结构幻觉并提升折叠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00625 2026-01-05 cs.CV

RePose: A Real-Time 3D Human Pose Estimation and Biomechanical Analysis Framework for Rehabilitation

RePose:一种用于康复训练的实时3D人体姿态估计与生物力学分析框架

Junxiao Xue, Pavel Smirnov, Ziao Li, Yunyun Shi, Shi Chen, Xinyi Yin, Xiaohan Yue, Lei Wang, Yiduo Wang, Feng Lin, Yijia Chen, Xiao Ma, Xiaoran Yan, Qing Zhang, Fengjian Xue, Xuecheng Wu

机构 * Zhejiang Lab(浙江实验室) Northeastern University(东北大学) Xi’an Jiaotong University(西安交通大学) Zhengzhou University(郑州大学) Dalian Minzu University(大连民族大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Fuyao University of Science and Technology(福耀科技大学) Xianghu Lab(翔虎实验室)

AI总结 RePose通过实时3D姿态估计和生物力学分析,为康复训练提供即时反馈和指导,提升患者运动恢复效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00278 2026-01-05 cs.CV

Disentangling Hardness from Noise: An Uncertainty-Driven Model-Agnostic Framework for Long-Tailed Remote Sensing Classification

分离难度与噪声:一种基于不确定性驱动的模型无关框架用于长尾遥感分类

Chi Ding, Junxiao Xue, Xinyi Yin, Shi Chen, Yunyun Shi, Yiduo Wang, Fengjian Xue, Xuecheng Wu

机构 * Research Center for Space Computing System, Zhejiang Lab(空间计算系统研究中心,浙江实验室) School of Cyber Science and Engineering, Zhengzhou University(网络安全工程学院,郑州大学) School of Computer Science and Technology, Xi'an Jiaotong University(计算机科学与技术学院,西安交通大学)

AI总结 本文提出DUAL框架,通过分离预测不确定性为信念和偶然不确定性,解决遥感长尾分类中噪声与困难样本的分离问题,提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24591 2026-01-01 cs.CV

Improving Few-Shot Change Detection Visual Question Answering via Decision-Ambiguity-guided Reinforcement Fine-Tuning

通过决策模糊性引导的强化微调提升少样本变化检测视觉问答

Fuyu Dong, Ke Li, Di Wang, Nan Luo, Yiming Zhang, Kaiyu Li, Jianfei Yang, Quan Wang

机构 * School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Department of Mathematics, University of California, San Diego(加州大学圣地亚哥分校数学系) School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院)

AI总结 DARFT通过决策模糊性引导的强化微调提升CDVQA的判别性和鲁棒性,尤其在少样本场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22693 2026-01-01 cs.CV

VADTree: Explainable Training-Free Video Anomaly Detection via Hierarchical Granularity-Aware Tree

VADTree: 通过分层粒度感知树实现可解释的无训练视频异常检测

Wenlong Li, Yifei Xu, Yuan Rao, Zhenhua Wang, Shuiguang Deng

机构 * School of Software, Xi’an Jiaotong University(西安交通大学软件学院) China Railway Xi’an Group(中国铁路西安集团) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 VADTree通过分层粒度感知树结构实现无训练视频异常检测,利用预训练模型知识和多维先验提升异常感知与推理能力。

Comments NeurIPS 2025 poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23105 2026-01-01 cs.CV

Towards Comprehensive Interactive Change Understanding in Remote Sensing: A Large-scale Dataset and Dual-granularity Enhanced VLM

迈向遥感中全面交互变化理解:一个大规模数据集和双粒度增强VLM

Junxiao Xue, Quan Deng, Xuecheng Wu, Kelu Yao, Xinyi Yin, Fei Yu, Wei Zhou, Yanfei Zhong, Yang Liu, Dingkang Yang

机构 * Research Center for Space Computing System, Zhejiang Lab(浙江省实验室空间计算系统研究中心) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Cyber Science and Engineering, Zhengzhou University(郑州大学网络科学与工程学院) Liaoning University of Technology(辽宁科技学院) School of Computer Science and Informatics, Cardiff University(卡迪夫大学计算机科学与信息学院) State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing (LIESMARS), Wuhan University(武汉测绘遥感与信息工程国家重点实验室(LIESMARS)) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

AI总结 本文提出ChangeIMTI数据集和ChangeVG模型,通过双粒度增强方法提升遥感图像变化理解的准确性和交互性。

Comments Junxiao Xue, Quan Deng, and Xuecheng Wu deserve equal contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.17797 2026-01-01 cs.CV eess.IV

HIDFlowNet: A Flow-Based Deep Network for Hyperspectral Image Denoising

HIDFlowNet: 一种基于流的深度网络用于超光谱图像去噪

Qizhou Wang, Li Pang, Xiangyong Cao, Zhiqiang Tian, Deyu Meng

机构 * Xi'an Jiaotong University(西安交通大学)

AI总结 HIDFlowNet是一种基于流的深度网络,通过分离低频和高频信息来提升超光谱图像去噪性能。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23714 2026-01-01 cs.CL

PharmaShip: An Entity-Centric, Reading-Order-Supervised Benchmark for Chinese Pharmaceutical Shipping Documents

PharmaShip: 一种以实体为中心、受阅读顺序监督的中文制药运输文件基准数据集

Tingwei Xie, Tianyi Zhou, Yonghong Song

机构 * School of Software Engineering, Xi’an Jiaotong University(软件工程学院,西安交通大学)

AI总结 PharmaShip通过引入以实体为中心的基准数据集,评估文本布局模型在噪声环境下的表现,强调阅读顺序正则化对提升实体识别和关系抽取效果的重要性。

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23220 2025-12-30 cs.RO

A Human-Oriented Cooperative Driving Approach: Integrating Driving Intention, State, and Conflict

面向人类的协作驾驶方法:整合驾驶意图、状态和冲突

Qin Wang, Shanmin Pang, Jianwu Fang, Shengye Dong, Fuhao Liu, Jianru Xue, Chen Lv

机构 * School of Software Engineering, Xi’an Jiaotong University(软件工程学院,西安交通大学) School of Artificial Intelligence, Xi’an Jiaotong University(人工智能学院,西安交通大学) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学)

AI总结 本文提出面向人类的协作驾驶方法,通过意图感知轨迹规划和控制权分配策略,提升驾驶性能并减少人机冲突。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15560 2025-12-30 cs.CV

GRAN-TED: Generating Robust, Aligned, and Nuanced Text Embedding for Diffusion Models

GRAN-TED: 生成稳健、对齐且细腻的文本嵌入以用于扩散模型

Bozhou Li, Sihan Yang, Yushuo Guan, Ruichuan An, Xinlong Chen, Yang Shi, Pengfei Wan, Wentao Zhang, Yuanxing zhang

机构 * Peking University(北京大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) Xi’an Jiaotong University(西安交通大学) School of Artificial Intelligence, UCAS(清华大学人工智能学院)

AI总结 GRAN-TED提出了一种生成稳健、对齐且细腻的文本嵌入以用于扩散模型的范式,通过TED-6K基准提升文本编码器性能,显著加快扩散模型训练速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14404 2025-12-30 cs.CV

ViC-Bench: Benchmarking Visual-Interleaved Chain-of-Thought Capability in MLLMs with Free-Style Intermediate State Representations

ViC-Bench: 用自由式中间状态表示法对多模态大语言模型的视觉交错链式思维能力进行基准测试

Xuecheng Wu, Jiaxing Liu, Danlei Huang, Yifan Wang, Yunyun Shi, Kedi Chen, Junxiao Xue, Yang Liu, Chunlin Chen, Hairong Dong, Dingkang Yang

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Meituan Inc.(美团公司) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院) Research Center for Space Computing System, Zhejiang Lab(浙江实验室空间计算系统研究中心) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) School of Robotics and Automation, Nanjing University(南京大学机器人与自动化学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院)

AI总结 ViC-Bench 通过自由式中间状态表示法,系统评估多模态大语言模型的视觉交错链式思维能力,涵盖四个任务并提出新评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03737 2025-12-30 eess.IV cs.CV

Re-Visible Dual-Domain Self-Supervised Deep Unfolding Network for MRI Reconstruction

可重见双域自监督深度展开网络用于MRI重建

Hao Zhang, Qi Wang, Jian Sun, Zhijie Wen, Jun Shi, Shihui Ying

机构 * Shanghai University(上海大学) Shanghai Institute of Applied Mathematics and Mechanics(上海应用数学和力学研究所) School of Mechanics and Engineering Science(机械与工程科学学院) Xi’an Jiaotong University(西安交通大学) School of Communication and Information Engineering(通信与信息工程学院)

AI总结 本文提出一种可重见双域自监督深度展开网络,通过引入双域损失和SFFE块,提升MRI重建性能,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22147 2025-12-30 cs.DC cs.AI cs.LG cs.PF

GPU Kernel Optimization Beyond Full Builds: An LLM Framework with Minimal Executable Programs

GPU内核优化超越完整构建:一种带有性能反馈的LLM框架,使用最小可执行程序

Ruifan Chu, Anbang Wang, Xiuxiu Bai, Shuai Liu, Xiaoshe Dong

机构 * School of Software Engineering, Xi'an Jiaotong University, China(软件工程学院,西安交通大学)

AI总结 该研究提出一种LLM框架,通过最小可执行程序实现无需完整构建的GPU内核优化,提升性能并降低开发成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14582 2025-12-25 cs.CL

Can Pruning Improve Reasoning? Revisiting Long-CoT Compression with Capability in Mind for Better Reasoning

剪枝能否提升推理?基于能力对齐的Long-Cot压缩以获得更好的推理

Shangziqi Zhao, Jiahao Yuan, Jinyang Wu, Zhenglin Wang, Guisong Yang, Usman Naseem

机构 * XJTU(西安交通大学) ECNU(华东师范大学) THU(清华大学) SEU(上海师范大学) USST(上海师范大学)

AI总结 本文提出Prune-on-Logic框架,通过结构感知剪枝提升Long-CoT推理效率,发现验证剪枝在保持准确性的同时减少令牌使用,揭示剪枝与模型容量对齐的重要性。

Comments 19 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.03155 2025-12-25 cs.LG

Intrinsic Benefits of Categorical Distributional Loss: Uncertainty-aware Regularized Exploration in Reinforcement Learning

类别分布损失的内在优势:强化学习中的不确定性感知正则化探索

Ke Sun, Yingnan Zhao, Enze Shi, Yafei Wang, Xiaodong Yan, Bei Jiang, Linglong Kong

机构 * University of Alberta, Canada(阿尔伯塔大学) Harbin Engineering University, China(哈尔滨工程大学) Xi’an Jiaotong University, China(西安交通大学)

AI总结 本文提出了一种基于类别分布损失的不确定性感知正则化方法,通过增强奖励信号提升强化学习的探索效率。

Comments NeurIPS 2025; Previous Version in ICML Workshop: Exploration in AI Today (EXAIT) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20013 2025-12-24 cs.CV

SegEarth-R2: Towards Comprehensive Language-guided Segmentation for Remote Sensing Images

SegEarth-R2: 向远程 sensing 图像的全面语言引导分割迈进

Zepeng Xin, Kaiyu Li, Luodi Chen, Wanchen Li, Yuchen Xiao, Hui Qiao, Weizhan Zhang, Deyu Meng, Xiangyong Cao

机构 * Xi’an Jiaotong University(西安交通大学) China Telecom Shaanxi Branch(中国电信陕西分支)

AI总结 SegEarth-R2通过MLLM架构实现远程 sensing 图像的全面语言引导分割,解决复杂场景下的多目标和隐含意图识别问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16222 2025-12-24 cs.CV

SPECIAL: Zero-shot Hyperspectral Image Classification With CLIP

专题:基于CLIP的零样本超光谱图像分类

Li Pang, Jing Yao, Kaiyu Li, Jun Zhou, Deyu Meng, Xiangyong Cao

机构 * School of Mathematics and Statistics and the Ministry of Education Key Laboratory of Intelligent Networks and Network Security, Xi’an Jiaotong University(数学与统计学学院和教育部智能网络与网络安全重点实验室,西安交通大学) Aerospace Information Research Institute, Chinese Academy of Sciences(航天信息研究所,中国科学院) School of Computer Science and Technology and the Ministry of Education Key Laboratory for Intelligent Networks and Network Security, Xi’an Jiaotong University(计算机科学与技术学院和教育部智能网络与网络安全重点实验室,西安交通大学) School of Information and Communication Technology, Griffith University(信息与通信技术学院,格里菲斯大学)

AI总结 基于CLIP的零样本超光谱图像分类框架,通过伪标签生成和噪声标签学习提升分类准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19104 2025-12-23 math.OC cs.LG

Explicit and Non-asymptotic Query Complexities of Rank-Based Zeroth-order Algorithm on Stochastic Smooth Functions

秩为基础的零阶算法在随机光滑函数上的显式和非渐近查询复杂性

Haishan Ye

机构 * Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出了一种基于秩的零阶优化算法,针对随机光滑函数建立了显式非渐近查询复杂性界限,证明顺序信息在随机优化中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18980 2025-12-23 cs.LG cs.SY eess.SY

OPBO: Order-Preserving Bayesian Optimization

OPBO:顺序保持贝叶斯优化

Wei Peng, Jianchen Hu, Kang Liu, Qiaozhu Zhai

机构 * School of Automation Science and Engineering(自动化科学与工程学院) Xi’an Jiaotong University(西安交通大学) School of Future Technology(未来技术学院)

AI总结 OPBO通过顺序保持方法替代传统高斯过程,有效解决高维黑盒优化问题。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18814 2025-12-23 cs.CV

EchoMotion: Unified Human Video and Motion Generation via Dual-Modality Diffusion Transformer

EchoMotion: 通过双模态扩散变换器实现统一的人体视频与运动生成

Yuxiao Yang, Hualian Sheng, Sijia Cai, Jing Lin, Jiahao Wang, Bing Deng, Junzhe Lu, Haoqian Wang, Jieping Ye

机构 * Tsinghua University(清华大学) Alibaba Group(阿里巴巴集团) Nanyang Technology University(南阳技术大学) Xi’an Jiaotong University(西安交通大学)

AI总结 EchoMotion通过双模态扩散变换器统一生成人体视频与运动,提升复杂人类动作视频的连贯性与合理性。

Comments 26 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18607 2025-12-23 cs.LG cs.AI

The Interaction Bottleneck of Deep Neural Networks: Discovery, Proof, and Modulation

深度神经网络的交互瓶颈:发现、证明与调节

Huiqi Deng, Qihan Ren, Zhuofan Chen, Zhenyuan Cui, Wen Shen, Peng Zhang, Hongbin Pei, Quanshi Zhang

机构 * Xi’an Jiaotong University(西安交通大学) Shanghai Jiao Tong University(上海交通大学) Tongji University(同济大学)

AI总结 本文发现深度神经网络在不同上下文复杂度下对交互的表示存在瓶颈,通过理论证明和实验验证,揭示中阶交互的难以学习,并提出通过损失函数调节交互阶数以提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25141 2025-12-23 cs.CV

EIRES:Training-free AI-Generated Image Detection via Edit-Induced Reconstruction Error Shift

EIRES: 通过编辑诱导的重建误差偏移实现无需训练的AI生成图像检测

Wan Jiang, Jing Yan, Xiaojing Chen, Lin Shen, Chenhao Lin, Yunfeng Diao, Richang Hong

机构 * HFUT(合肥大学) AHU(安徽大学) XJTU(西安交通大学)

AI总结 EIRES通过编辑诱导的重建误差偏移实现无需训练的AI生成图像检测,利用结构编辑揭示真实与生成图像的固有差异,提高检测可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏