arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

共收录 765
2503.13047 2025-12-02 cs.CV

InsightDrive: Insight Scene Representation for End-to-End Autonomous Driving

InsightDrive: 用于端到端自动驾驶的洞察场景表示

Ruiqi Song, Xianda Guo, Yanlun Peng, Qinggong Wei, Hangbin Wu, Long Chen

机构 * College of Surveying and Geo-informatics, Tongji University(同济大学测绘与地理信息学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Computer Science, Wuhan University(武汉大学计算机学院) The School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Great Wall Motor(长城汽车) IAIR, Xi’an Jiaotong University(西安交通大学IAIR)

AI总结 InsightDrive通过结合显式和隐式场景表示,提升自动驾驶轨迹规划的鲁棒性和人类认知一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06588 2025-12-02 cs.SD cs.CV

Speech Audio Generation from dynamic MRI via a Knowledge Enhanced Conditional Variational Autoencoder

通过动态MRI生成语音音频的增强知识条件变分自编码器

Yaxuan Li, Han Jiang, Yifei Ma, Shihua Qin, Jonghye Woo, Fangxu Xing

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) Wake Forest University School of Medicine(威克森林大学医学学院) Department of Radiology, Harvard Medical School(哈佛医学院放射科)

AI总结 本文提出KE-CVAE方法,通过动态MRI生成语音音频,解决MRI数据损坏和噪声问题,提升语音合成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03805 2025-12-02 cs.CL cs.AI

Beyond Token Length: Step Pruner for Efficient and Accurate Reasoning in Large Language Models

超越标记长度:用于大语言模型高效准确推理的步剪枝

Canhui Wu, Qiong Cao, Chang Li, Zhenfang Wang, Chao Xue, Yuwei Fan, Wei Xi, Xiaodong He

机构 * Xi’an Jiaotong University(西安交通大学) JD Future Academy(京东未来学院)

AI总结 本文提出步剪枝框架,通过强化学习优化大语言模型的推理效率与准确性,显著减少响应长度并在多个基准测试中取得最佳性能。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23150 2025-12-01 cs.CV

Cascaded Robust Rectification for Arbitrary Document Images

级联鲁棒校正用于任意文档图像

Chaoyun Wang, Quanxin Huang, I-Chao Shen, Takeo Igarashi, Nanning Zheng, Caigui Jiang

机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家级实验室) National Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院) Xi’an Jiaotong University(西安交通大学) The University of Tokyo(东京大学)

AI总结 本文提出了一种级联鲁棒校正方法,通过多阶段逐步校正文档图像的透视、几何和内容变形,提升实际应用中的文档校正性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22934 2025-12-01 cs.CV

NeuMatC: A General Neural Framework for Fast Parametric Matrix Operation

NeuMatC: 一种通用的神经框架,用于快速参数矩阵运算

Chuan Wang, Xi-le Zhao, Zhilong Han, Liang Li, Deyu Meng, Michael K. Ng

机构 * Department of Mathematics, Hong Kong Baptist University(香港 Baptist 大学数学系) School of Mathematical Sciences, UESTC(UESTC 数学科学学院) School of Mathematics and Statistics, Xi’an Jiaotong University(西安交通大学数学与统计学学院)

AI总结 NeuMatC通过利用参数维度的低秩性和连续性,提出了一种通用神经框架,实现快速参数矩阵运算,实验表明其在无线通信中参数求逆和SVD的速度显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03408 2025-12-01 cs.CL

Efficient Reasoning via Thought-Training and Thought-Free Inference

通过思维训练和无思维推理实现高效推理

Canhui Wu, Qiong Cao, Chao Xue, Wei Xi, Xiaodong He

机构 * Xi’an Jiaotong University(西安交通大学) JD Future Academy(京东未来学院)

AI总结 3TF通过训练混合模型实现高效推理,使模型能在无显式推理生成的情况下进行高质量推理。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22441 2025-12-01 cs.CR cs.AI cs.CV cs.LG

GEO-Detective: Unveiling Location Privacy Risks in Images with LLM Agents

GEO-Detective:利用LLM代理揭示图像中的位置隐私风险

Xinyu Zhang, Yixin Wu, Boyang Zhang, Chenhao Lin, Chao Shen, Michael Backes, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA赫尔姆霍茨信息安全中心) Xi’an Jiaotong University(西安交通大学)

AI总结 GEO-Detective利用LLM代理进行图像地理定位推断,通过自适应策略和专用工具提升定位精度并降低隐私风险。

Comments 15 pages with 7 figures and 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00515 2025-11-27 cs.CV

Class-Independent Increment: An Efficient Approach for Multi-label Class-Incremental Learning

类无关增量:一种多标签类增量学习的有效方法

Chenhao Ding, Songlin Dong, Zhengdong Zhou, Jizhou Han, Qiang Wang, Yuhang He, Yihong Gong

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) College of Artificial Intelligence, Xi’an Jiaotong University(西安交通大学人工智能学院) Faculty of Computility Microelectronics, Shenzhen University of Advanced Technology(深圳先进技术大学计算微电子学院)

AI总结 本文提出类无关增量方法,通过类级嵌入和特定标记优化,解决多标签类增量学习中的特征混淆和遗忘问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11381 2025-11-27 cs.CV cs.AI

Without Paired Labeled Data: End-to-End Self-Supervised Learning for Drone-view Geo-Localization

无需配对标注数据:无人机视角地理定位的端到端自监督学习

Zhongwei Chen, Zhao-Xu Yang, Hai-Jun Rong, Guoqi Li

机构 * State Key Laboratory for Strength and Vibration of Mechanical Structures(强度与振动机械结构国家重点实验室) Shaanxi Key Laboratory of Environment and Control for Flight Vehicle(陕西省飞行器环境与控制重点实验室) School of Aerospace Engineering(航空航天工程学院) Xi’an Jiaotong University(西安交通大学) Institute of Automation(自动化研究所) Chinese Academy of Sciences(中国科学院) School of Artificial Intelligence(人工智能学院) University of Chinese Academy of Sciences(中国科学院大学) Peng Cheng Laboratory(鹏城实验室)

AI总结 本文提出DMNIL方法,通过动态记忆和邻域信息学习提升无人机视角地理定位的自监督学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08896 2025-11-26 cs.LG cs.AI

Position: Beyond Euclidean -- Foundation Models Should Embrace Non-Euclidean Geometries

位置:超越欧几里得——基础模型应拥抱非欧几里得几何

Neil He, Jiahong Liu, Buze Zhang, Ngoc Bui, Ali Maatouk, Menglin Yang, Irwin King, Melanie Weber, Rex Ying

机构 * Yale University(耶鲁大学) Chinese University of Hong Kong(香港中文大学) Xi’an Jiaotong University(西安交通大学) Hong Kong University of Science and Technology(香港科学大学) Harvard University(哈佛大学)

AI总结 本文主张基础模型应超越欧几里得几何,以更高效地利用非欧几里得结构,提升模型性能与适应性。

Comments 27 pages, 6 figures, LoG Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19497 2025-11-26 cs.LG cs.AI

PeriodNet: Boosting the Potential of Attention Mechanism for Time Series Forecasting

PeriodNet: 提升注意力机制在时间序列预测中的潜力

Bowen Zhao, Huanlai Xing, Zhiwen Xiao, Jincheng Peng, Li Feng, Xinhan Wang, Rong Qu, Hui Li

机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(计算机与人工智能学院,西南交通大学) Tangshan Institute of Southwest Jiaotong University(西南交通大学唐山研究院) School of Computer Science, University of Nottingham(计算机科学学院,诺丁汉大学) School of Mathematics and Statistics, Xi’an Jiaotong University(数学与统计学院,西安交通大学)

AI总结 PeriodNet通过引入周期注意力和稀疏周期注意力机制,提升时间序列预测的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17941 2025-11-25 cs.CV

V2X-RECT: An Efficient V2X Trajectory Prediction Framework via Redundant Interaction Filtering and Tracking Error Correction

V2X-RECT: 一种通过冗余交互过滤和轨迹误差修正的高效V2X轨迹预测框架

Xiangyan Kong, Xuecheng Wu, Xiongwei Zhao, Xiaodong Li, Yunyun Shi, Gang Wang, Dingkang Yang, Yang Liu, Hong Chen, Yulong Gao

机构 * Communication Research Center, Harbin Institute of Technology(哈尔滨工业大学通信研究所) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Electronics and Information Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)电子与信息工程学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)

AI总结 V2X-RECT通过冗余交互过滤和轨迹误差修正,提升高密度环境下的轨迹预测效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17229 2025-11-24 cs.LG physics.chem-ph

Generating transition states of chemical reactions via distance-geometry-based flow matching

通过基于距离几何的流匹配生成化学反应的过渡态

Yufei Luo, Xiang Gu, Jian Sun

机构 * State Industry-Education Integration Center for Medical Innovations at Xi’an Jiaotong University(西安交通大学医学创新产业-教育融合中心)

AI总结 本文提出TS-DFM方法,通过基于距离几何的流匹配预测化学反应的过渡态,提高了结构准确性并加速优化过程,展示了其在反应路径探索中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17201 2025-11-24 cs.CV

Continual Alignment for SAM: Rethinking Foundation Models for Medical Image Segmentation in Continual Learning

持续对齐用于SAM:重新思考面向持续学习的医学图像分割的基础模型

Jiayi Wang, Wei Dai, Haoyu Wang, Sihan Yang, Haixia Bi, Jian Sun

机构 * Xi’an Jiaotong University(西安交通大学) School of Information and Communications Engineering, Xi’an Jiaotong University(信息与通信工程学院) School of Mathematics and Statistics, Xi’an Jiaotong University(数学与统计学学院)

AI总结 CA-SAM通过引入对齐层,实现了在持续学习中高效适应医学图像分割,提升性能并减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17198 2025-11-24 cs.AI cs.CV

Designing Domain-Specific Agents via Hierarchical Task Abstraction Mechanism

通过层次化任务抽象机制设计领域专用代理

Kaiyu Li, Jiayu Wang, Zhi Wang, Hui Qiao, Weizhan Zhang, Deyu Meng, Xiangyong Cao

机构 * Xi’an Jiaotong University(西安交通大学) China Telecom Shaanxi Branch(中国电信陕西分公司)

AI总结 本文提出层次化任务抽象机制,设计领域专用代理EarthAgent,通过任务结构对齐提升复杂地理空间分析的规划能力。

Comments Page: https://earth-insights.github.io/EarthAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05248 2025-11-24 cs.CL

Response Attack: Exploiting Contextual Priming to Jailbreak Large Language Models

响应攻击:利用上下文优先级来劫持大语言模型

Ziqi Miao, Lijun Li, Yuan Xiong, Zhenhua Liu, Pengyu Zhu, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Xi’an Jiaotong University(西安交通大学) Beijing University of Posts and Telecommunications(北京邮电大学)

AI总结 响应攻击通过利用对话中中间响应作为上下文优先级,有效劫持大语言模型生成违反政策的内容。

Comments 20 pages, 10 figures. Code and data available at https://github.com/Dtc7w3PQ/Response-Attack

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16278 2025-11-21 cs.CR cs.AI

"To Survive, I Must Defect": Jailbreaking LLMs via the Game-Theory Scenarios

为生存,我必须背叛:通过博弈论场景进行大语言模型的劫持攻击

Zhen Sun, Zongmin Zhang, Deqi Liang, Han Sun, Yule Liu, Yun Shen, Xiangshan Gao, Yilong Yang, Shuai Liu, Yutao Yue, Xinlei He

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) East China Normal University(华东师范大学) Flexera(Flexera公司) Zhejiang University(浙江大学) Xidian University(西安电子科技大学) Xi’an Jiaotong University(西安交通大学) Institute of Deep Perception Technology, JITRI(JITRI深度感知技术研究所)

AI总结 本文提出一种基于博弈论的可扩展黑盒劫持框架GTA,通过重塑LLM目标以提高攻击成功率,实现在多种场景下的高ASR表现。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15316 2025-11-20 cs.CV

What Your Features Reveal: Data-Efficient Black-Box Feature Inversion Attack for Split DNNs

Zhihan Ren, Lijun He, Jiaxi Liang, Xinzhu Fu, Haixia Bi, Fan Li

机构 * Xi’an Jiaotong University(西安交通大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17644 2025-11-19 eess.IV cs.CV

Towards Prospective Medical Image Reconstruction via Knowledge-Informed Dynamic Optimal Transport

Taoran Zheng, Yan Yang, Xing Li, Xiang Gu, Jian Sun, Zongben Xu

机构 * School of Mathematics and Statistics, Xi’an Jiaotong University(西安交通大学数学与统计学学院)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12644 2025-11-18 cs.CV

Use as Many Surrogates as You Want: Selective Ensemble Attack to Unleash Transferability without Sacrificing Resource Efficiency

Bo Yang, Hengwei Zhang, Jindong Wang, Yuchen Ren, Chenhao Lin, Chao Shen, Zhengyu Zhao

机构 * Information Engineering University(信息工程大学) Xi’an Jiaotong University(西安交通大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13001 2025-11-18 cs.CV

Medal S: Spatio-Textual Prompt Model for Medical Segmentation

Pengcheng Shi, Jiawei Chen, Jiaqi Liu, Xinglin Zhang, Tao Chen, Lei Li

机构 * Medical Image Insights, Shanghai, China(医学影像洞察,上海,中国) University of Washington, Seattle, WA, USA(华盛顿大学,西雅图,华盛顿州,美国) University of Waterloo, Waterloo, ON, Canada(滑铁卢大学,滑铁卢,安大略省,加拿大) Xi'an Jiaotong University, Xi'an, China(西安交通大学,西安,中国)

Comments Accepted by CVPR 2025 Workshop MedSegFM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12956 2025-11-18 cs.CV cs.CR

T2I-Based Physical-World Appearance Attack against Traffic Sign Recognition Systems in Autonomous Driving

Chen Ma, Ningfei Wang, Junhao Zheng, Qing Guo, Qian Wang, Qi Alfred Chen, Chao Shen

机构 * Xi’an Jiaotong University(西安交通大学) University of California, Irvine(加州大学 Irvine 分校) Nankai University(南开大学) Wuhan University(武汉大学)

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12588 2025-11-18 cs.CV

Rank-Aware Agglomeration of Foundation Models for Immunohistochemistry Image Cell Counting

Zuqi Huang, Mengxin Tian, Huan Liu, Wentao Li, Baobao Liang, Jie Wu, Fang Yan, Zhaoqing Tang, Zhongyu Li

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Department of Gastrointestinal Surgery and the Gastric Cancer Center, Zhongshan Hospital, Fudan University(复旦大学中山医院胃肠外科及胃癌中心) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) The Comprehensive Breast Care Center, The Second Affiliated Hospital of Xi'an Jiaotong University(西安交通大学第二附属医院综合乳腺护理中心) Department of Pathology, The Second Affiliated Hospital of Xi’an Jiaotong University(西安交通大学第二附属医院病理科) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Department of General Surgery, Zhongshan Hospital (Xiamen), Fudan University(复旦大学中山医院(厦门)外科科)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12267 2025-11-18 cs.CV

ZoomEarth: Active Perception for Ultra-High-Resolution Geospatial Vision-Language Tasks

Ruixun Liu, Bowen Fu, Jiayi Song, Kaiyu Li, Wanchen Li, Lanxuan Xue, Hui Qiao, Weizhan Zhang, Deyu Meng, Xiangyong Cao

机构 * Xi’an Jiaotong University(西安交通大学) China Telecom Shaanxi Branch(中国电信陕西分公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00631 2025-11-18 stat.ML cs.LG

Bayes-Optimal Fair Classification with Multiple Sensitive Features

Yi Yang, Yinghui Huang, Xiangyu Chang

机构 * Department of Information Systems, Arizona State University(信息系统系,亚利桑那州立大学) Department of Information Systems and Intelligent Business, School of Management, Xi’an Jiaotong University(信息系统与智能商业系,管理学院,西安交通大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10648 2025-11-14 cs.CV

Enhancing the Outcome Reward-based RL Training of MLLMs with Self-Consistency Sampling

Jiahao Wang, Weiye Xu, Aijun Yang, Wengang Zhou, Lewei Lu, Houqiang Li, Xiaohua Wang, Jinguo Zhu

机构 * Xi’an Jiaotong University(西安交通大学) University of Science and Technology of China(中国科学技术大学) SenseTime Research(商汤科技研究院)

Comments Accepted to NeurIPS 2025 (The Thirty-Ninth Annual Conference on Neural Information Processing Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10112 2025-11-14 cs.SD

FabasedVC: Enhancing Voice Conversion with Text Modality Fusion and Phoneme-Level SSL Features

Wenyu Wang, Zhetao Hu, Yiquan Zhou, Jiacheng Xu, Zhiyu Wu, Chen Li, Shihao Li

机构 * School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) AI Platform Department, bilibili(bilibili人工智能平台部) School of Software Engineering, East China Normal University(华东师范大学软件工程学院) School of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Division of Music and Audio, Union Wheatland Culture and Media Ltd.(Union Wheatland Culture and Media Ltd.音乐与音频部)

Comments Accepted by ACMMM-Asia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02054 2025-11-14 cs.CV

Redundant Queries in DETR-Based 3D Detection Methods: Unnecessary and Prunable

Lizhen Xu, Zehao Wu, Wenzhao Qiu, Shanmin Pang, Xiuxiu Bai, Kuizhi Mei, Jianru Xue

机构 * Xi’an Jiaotong University(西安交通大学)

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.07759 2025-11-13 cs.CV

Adjacent-view Transformers for Supervised Surround-view Depth Estimation

Xianda Guo, Wenjie Yuan, Yunpeng Zhang, Tian Yang, Chenming Zhang, Zheng Zhu, Qin Zou, Long Chen

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Waytous Tsinghua University(清华大学) PhiGent Robotics(PhiGent机器人) Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所) GigaAI Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

Comments This paper has been accepted by IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08487 2025-11-12 cs.MA cs.CL

How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity

Zihan Ma, Dongsheng Zhu, Shudong Liu, Taolin Zhang, Junnan Liu, Qingqiu Li, Minnan Luo, Songyang Zhang, Kai Chen

机构 * School of Computer Science and Technology Xi’an Jiaotong University China(西安交通大学计算机科学与技术学院) Shanghai AI Laboratory(上海人工智能实验室) MOE KLINNS Lab Xi’an Jiaotong University China(西安交通大学教育部KLINNS实验室)

详情

展开后加载摘要…

URL PDF HTML 收藏