arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Xi'an Jiaotong University(西安交通大学)

共收录 765
2604.10158 2026-04-14 cs.LG

Tracing the Thought of a Grandmaster-level Chess-Playing Transformer

追溯国际象棋顶级棋手级变压器的思维过程

Rui Lin, Zhenyu Jin, Guancheng Zhou, Xuyang Ge, Wentao Shu, Jiaxing Wu, Junxuan Wang, Zhengfu He, Junping Zhang, Xipeng Qiu

机构 * Shanghai Innovation Institute, Shanghai, China(上海创新研究院) School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机科学技术学院) School of Mathematics and Statistics, Xi’an Jiaotong University(西安交通大学数学与统计学院)

AI总结 本文通过稀疏分解框架解析Leela Chess Zero的内部计算,揭示其战术考量,并引入三个量化指标证明其并行推理行为,首次在MLP和注意力模块上实现可解释性分解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09989 2026-04-14 cs.CV cs.AI

FlowPalm: Optical Flow Driven Non-Rigid Deformation for Geometrically Diverse Palmprint Generation

FlowPalm: 基于光流的非刚性变形生成几何多样性指纹

Yuchen Zou, Huikai Shao, Lihuang Fang, Zhipeng Xiong, Dexing Zhong

机构 * Xi’an Jiaotong University(西安交通大学) Sichuan Digital Economy Industry Development Research Institute(四川数字经济发展研究院) Southern University of Science and Technology(南方科技大学)

AI总结 FlowPalm通过光流驱动生成几何多样性的指纹,结合统计变形模式与渐进采样过程,提升指纹识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20151 2026-04-13 cs.CV

A Compact Hybrid Convolution--Frequency State Space Network for Learned Image Compression

一种紧凑的混合卷积-频率状态空间网络用于学习图像压缩

Haodong Pan, Hao Wei, Yusong Wang, Nanning Zheng, Caigui Jiang

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi'an Jiaotong University(西安交通大学人工智能与机器人研究所人机混合增强智能国家重点实验室)

AI总结 本文提出HCFSSNet,结合卷积层和视觉频率状态空间模块,解决传统方法在长距离依赖建模中的效率与连续性问题,实现高效图像压缩。

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08106 2026-04-10 cs.CV

EPIR: An Efficient Patch Tokenization, Integration and Representation Framework for Micro-expression Recognition

EPIR: 一种高效的补丁分词、整合与表示框架用于微表情识别

Junbo Wang, Liangyu Fu, Yuke Li, Yining Zhu, Xuecheng Wu, Kun Hu

机构 * School of Software, Northwestern Polytechnical University(西北工业大学软件学院) School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) School of Computer Science and Technology, Xi'an Jiaotong University(西安交通大学计算机科学与技术学院) School of Science, Edith Cowan University(埃迪斯科文大学理学院)

AI总结 本文提出EPIR框架,通过双范数位移分词模块、token整合模块和判别token提取器,提升微表情识别性能并降低计算复杂度,实验表明在多个数据集上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07981 2026-04-10 cs.CL cs.AI cs.LG

A Decomposition Perspective to Long-context Reasoning for LLMs

从分解视角看大语言模型的长上下文推理

Yanling Xiao, Huaibing Xie, Guoliang Zhao, Shihan Dou, Shaolei Wang, Yiting Liu, Nantao Zheng, Cheng Zhang, Pluto Zhou, Zhisong Zhang, Lemao Liu

机构 * Large Language Model Department, Tencent(腾讯大语言模型部门) Xi'an Jiaotong University(西安交通大学) Tencent(腾讯) Fudan University(复旦大学) City University of Hong Kong(香港城市大学)

AI总结 本文从分解视角出发,将长上下文推理分解为基本原子技能,并通过伪数据集训练提升模型能力,实验证明该方法在多个基准测试中提升了7.7%的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04678 2026-04-10 cs.CV

ChangeBridge: Spatiotemporal Image Generation with Multimodal Controls for Remote Sensing

ChangeBridge: 多模态控制下的遥感时空图像生成

Zhenghui Zhao, Chen Wu, Xiangyong Cao, Di Wang, Hongruixuan Chen, Datao Tang, Liangpei Zhang, Zhuo Zheng

机构 * State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing, Wuhan University(武汉大学测绘遥感信息工程国家重点实验室) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) School of Computer Science, Wuhan University(武汉大学计算机学院) Zhongguancun Academy(中关村学院) Graduate School of Frontier Sciences, The University of Tokyo(东京大学新领域创成科学研究科) Department of Computer Science, Stanford University(斯坦福大学计算机科学系)

AI总结 本文提出ChangeBridge模型,通过多模态事件控制生成时空一致的遥感图像,解决了现有方法在跨时间变化建模上的不足,提升了土地利用规划和变化检测任务的数据生成能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05584 2026-04-09 cs.CV

Purify-then-Align: Towards Robust Human Sensing under Modality Missing with Knowledge Distillation from Noisy Multimodal Teacher

在模态缺失情况下通过知识蒸馏从噪声多模态教师中实现鲁棒的人体感知:Purify-then-Align

Pengcheng Weng, Yanyu Qian, Yangxin Xu, Fei Wang

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) Institute of Computer Science, Universität Bern(伯尔尼大学计算机科学研究所) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 本文提出PTA框架,通过元学习和知识扩散解决多模态人体感知中模态缺失问题,通过净化知识源和对齐模态提升单模态模型鲁棒性。

Comments Accepted by CVPR 2026 Workshop On Any-to-Any Multimodal Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06067 2026-04-08 cs.RO

HiPolicy: Hierarchical Multi-Frequency Action Chunking for Policy Learning

HiPolicy:分层多频动作分块用于策略学习

Jiyao Zhang, Zimu Han, Junhan Wang, Xionghao Wu, Shihong Lin, Jinzhou Li, Hongwei Fan, Ruihai Wu, Dongjiang Li, Hao Dong

机构 * CFCS, School of CS, PKU(北京大学计算机学院计算与金融研究中心) National Key Laboratory for Multimedia Information Processing, School of CS, PKU(北京大学计算机学院多媒体信息处理国家重点实验室) XJTU(西安交通大学) THU(清华大学) BUAA(北京航空航天大学) Jingdong Technology Information Technology Co., Ltd(京东科技信息技术有限公司)

AI总结 HiPolicy通过分层多频动作分块框架,联合预测不同频率的动作序列,以捕捉粗粒度高层次计划和精确的反应动作,提升策略学习的性能和执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05526 2026-04-08 cs.SD cs.AI

Controllable Singing Style Conversion with Boundary-Aware Information Bottleneck

可控的歌唱风格转换与边界感知信息瓶颈

Zhetao Hu, Yiquan Zhou, Wenyu Wang, Zhiyu Wu, Xin Gao, Jihua Zhu

机构 * School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) Fudan University(复旦大学) Division of Music and Audio Union Wheatland Culture and Media Ltd.(音乐与音频联合Wheatland文化传媒有限公司)

AI总结 本文提出了一种新颖的歌唱风格转换系统,通过边界感知信息瓶颈、帧级技术矩阵和高频带补全策略,解决风格泄漏、动态渲染和高保真生成问题,实现高质量的风格转换。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05397 2026-04-08 cs.CL

Confidence Should Be Calibrated More Than One Turn Deep

置信度应比单轮更深入地校准

Zhaohan Zhang, Chengzhengxu Li, Xiaoming Liu, Chao Shen, Ziquan Liu, Ioannis Patras

机构 * Queen Mary University of London(伦敦玛丽女王大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出多轮校准任务,解决多轮对话中置信度动态校准问题,通过MTCal和ConfChat提升模型在多轮交互中的事实性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05297 2026-04-08 cs.AI

Breakthrough the Suboptimal Stable Point in Value-Factorization-Based Multi-Agent Reinforcement Learning

突破基于价值因子化的多智能体强化学习中的次优稳定点

Lesong Tao, Yifei Wang, Haodong Jing, Jingwen Fu, Miao Kang, Shitao Chen, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi'an Jiaotong University(西安交通大学人工智能与机器人研究所,人机混合增强智能国家重点实验室) Zhongguancun Academy(中关村学院)

AI总结 本文提出多轮价值因子化框架MRVF,通过迭代过滤次优动作以实现全局最优,揭示了非最优稳定点对性能的影响,实验验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04488 2026-04-07 cs.CV cs.LG

A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models

基于补丁的跨视图正则化框架用于多模态大语言模型中的后门防御

Tianmeng Fang, Yong Wang, Zetai Kong, Zengzhen Su, Jun Wang, Chengjin Yu, Wei Wang

机构 * Singapore Management University(新加坡管理大学) China University of Mining and Technology(中国矿业大学) The University of Melbourne(墨尔本大学) Anhui University(安徽大学) Xi’an Jiaotong University(西安交通大学) Sun Yat-sen University(中山大学)

AI总结 本文提出一种基于补丁增强和跨视图正则化的统一后门防御框架,通过约束特征表示和输出分布层面的异常行为,有效降低后门攻击成功率并保持正常生成能力。

Comments 26 pages, 3 figures. Subjects: Machine Learning (cs.LG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04090 2026-04-07 cs.LG cs.AI

Fine-grained Analysis of Stability and Generalization for Stochastic Bilevel Optimization

细粒度分析随机双层优化的稳定性和泛化能力

Xuelin Zhang, Hong Chen, Bin Gu, Tieliang Gong, Feng Zheng

机构 * College of Informatics, Huazhong Agricultural University(华中农业大学信息学院) Engineering Research Center of Intelligent Technology for Agriculture, Ministry of Education(教育部农业智能技术工程研究中心) School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系)

AI总结 本文研究了随机双层优化方法的稳定性和泛化能力,通过理论分析和实验验证,推导了单时间尺度和双时间尺度SGD的稳定性上界,适用于非凸-非凸、凸-凸和强凸-强凸等不同场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04036 2026-04-07 cs.IR cs.CL

MisEdu-RAG: A Misconception-Aware Dual-Hypergraph RAG for Novice Math Teachers

MisEdu-RAG:一种面向初学者数学教师的误解意识双超图RAG

Zhihan Guo, Rundong Xue, Yuting Lu, Jionghao Lin

机构 * The University of Hong Kong(香港大学) Xi'an Jiaotong University(西安交通大学) Carnegie Mellon University(卡内基梅隆大学) Monash University(莫纳什大学)

AI总结 针对初学者数学教师难以诊断和纠正学生错误的问题,提出基于双超图的RAG框架,通过组织教学知识和学生错误案例,提升响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04029 2026-04-07 cs.CV

ATSS: Detecting AI-Generated Videos via Anomalous Temporal Self-Similarity

ATSS:通过异常时间自相似性检测AI生成视频

Hang Wang, Chao Shen, Lei Zhang, Zhi-Qi Cheng

机构 * Xi’an Jiaotong University(西安交通大学) The Hong Kong Polytechnic University(香港理工大学) University of Washington(华盛顿大学)

AI总结 本文提出ATSS方法,通过三重相似性表示和跨注意融合机制,检测AI生成视频的异常时间自相似性,优于现有方法,在多个基准上表现更优。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03706 2026-04-07 cs.CV

XSeg: A Large-scale X-ray Contraband Segmentation Benchmark For Real-World Security Screening

XSeg:一个大规模X射线违禁品分割基准用于现实世界的安全筛查

Hongxia Gao, Litao Li, Yixin Chen, Jiali Wen, Kaijie Zhang, Qianyun Liu

机构 * Xi’an Jiaotong University(西安交通大学) South China University of Technology(华南理工大学) Shenzhen Loop Area Institute(深圳河套学院) Pazhou Laboratory(琶洲实验室)

AI总结 本文提出XSeg,首个大规模X射线违禁品分割数据集,包含98644张图像和295932个实例掩码,通过自定义数据清洗流程提升数据质量,并引入APSAM模型提升分割性能。

Comments 12 pages, 8 figures, Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14869 2026-04-07 cs.AI

A Self-Evolving Defect Detection Framework for Industrial Photovoltaic Systems

面向工业光伏系统的自进化缺陷检测框架

Haoyu He, Yu Duan, Wenzhen Liu, Hanyuan Hang, Boyu Qin, Qiantu Tuo, Xiaoke Yang, Rui Li

机构 * EcoFlow Inc(EcoFlow公司) School of Electrical Engineering, Xi’an Jiaotong University(西安交通大学电气工程学院)

AI总结 本文提出SEPDD框架,通过自适应模型优化与持续自进化学习机制,解决工业光伏检测中分布偏移和新缺陷模式识别问题,实验表明其在公有和私有数据集上均表现优异。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24326 2026-04-06 cs.CV cs.AI cs.IR

Boosting Document Parsing Efficiency and Performance with Coarse-to-Fine Visual Processing

通过粗到细的视觉处理提升文档解析效率和性能

Cheng Cui, Ting Sun, Suyin Liang, Tingquan Gao, Zelun Zhang, Jiaxuan Liu, Xueqing Wang, Changda Zhou, Hongen Liu, Manhui Lin, Yue Zhang, Yubo Zhang, Jing Zhang, Jun Zhang, Xing Wei, Yi Liu, Dianhai Yu, Yanjun Ma

机构 * PaddlePaddle Team, Baidu Inc.(百度公司飞桨团队) Xi’an Jiaotong University(西安交通大学)

AI总结 本文提出PaddleOCR-VL模型,通过粗到细的视觉处理方法,减少冗余视觉区域,提升文档解析和识别的效率与性能,实验表明其在页面级和元素级识别上均达到最优。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00438 2026-04-02 cs.CL

TR-ICRL: Test-Time Rethinking for In-Context Reinforcement Learning

TR-ICRL:基于上下文的强化学习中的测试时重新思考

Wenxuan Jiang, Yuxin Zuo, Zijian Zhang, Xuecheng Wu, Zining Fan, Wenxuan Liu, Li Chen, Xiaoyu Li, Xuezhi Cao, Xiaolong Jin, Ninghao Liu

机构 * The Hong Kong Polytechnic University(香港理工大学) Meituan(美团) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Xi’an Jiaotong University(西安交通大学) East China Normal University(华东师范大学) Northeastern University(东北大学)

AI总结 TR-ICRL通过在推理过程中重新思考来解决ICRL中的奖励估计问题,通过伪标签生成反馈,提升模型在推理和知识密集型任务中的性能。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29697 2026-04-01 cs.CV

FED-Bench: A Cross-Granular Benchmark for Disentangled Evaluation of Facial Expression Editing

FED-Bench:一种跨粒度的面部表情编辑评估基准

Fengjian Xue, Xuecheng Wu, Heli Sun, Yunyun Shi, Shi Chen, Liangyu Fu, Jinheng Xie, Dingkang Yang, Hao Wang, Junxiao Xue, Liang He

机构 * Xi’an Jiaotong University(西安交通大学) Northwestern Polytechnical University(西北工业大学) National University of Singapore(新加坡国立大学) Fudan University(复旦大学) Zhejiang Lab(之江实验室)

AI总结 本文提出FED-Bench,通过构建747个三元组基准,引入FED-Score评估协议,评估面部表情编辑的对齐、保真度和相对表达增益,揭示当前方法在高保真与准确表达操控间的困境,并提供20k+真实世界面部训练集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29192 2026-04-01 cs.RO

Efficient Camera Pose Augmentation for View Generalization in Robotic Policy Learning

高效的相机姿态增强用于机器人策略学习中的视角泛化

Sen Wang, Huaiyi Dong, Jingyi Tian, Jiayi Li, Zhuo Yang, Tongtong Cao, Anlin Chen, Shuang Wu, Le Wang, Sanping Zhou

机构 * Xi'an Jiaotong University(西安交通大学) Noah's Ark Lab(诺亚方舟实验室)

AI总结 本文提出GenSplat框架,通过新颖视角渲染实现视角泛化的策略学习,利用3D高斯点云重建和3D先验蒸馏策略,增强策略在空间扰动下的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28824 2026-04-01 cs.CR cs.AI

SNEAKDOOR: Stealthy Backdoor Attacks against Distribution Matching-based Dataset Condensation

SNEAKDOOR:针对基于分布匹配的数据集压缩的隐秘后门攻击

He Yang, Dongyi Lv, Song Ma, Wei Xi, Jizhong Zhao

机构 * School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University(西安交通大学人机混合增强智能全国重点实验室)

AI总结 本文提出SNEAKDOOR,通过利用类别决策边界漏洞和生成模块,提升隐秘性而不影响攻击效果,实验表明其在攻击成功率、清洁测试准确率和隐秘性之间取得良好平衡。

Comments 29 pages, 5 figures, accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24037 2026-03-31 cs.CV

A$^3$: Towards Advertising Aesthetic Assessment

A$^3$:迈向广告审美评估

Kaiyuan Ji, Yixuan Gao, Lu Sun, Yushuo Zheng, Zijian Chen, Jianbo Zhang, Xiangyang Zhu, Yuan Tian, Zicheng Zhang, Guangtao Zhai

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(上海交通大学图像通信与网络工程研究所) School of Information and Electronic Engineering, East China Normal University(华东师范大学信息与电子工程学院) School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)

AI总结 本文提出A$^3$框架,通过理论驱动的A$^3$-Law、大规模标注数据集A$^3$-Dataset、多模态大语言模型A$^3$-Align及基准A$^3$-Bench,解决广告审美评估中主观性、缺乏标准等问题。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08553 2026-03-31 cs.CV cs.AI cs.RO

Dream to Recall: Imagination-Guided Experience Retrieval for Memory-Persistent Vision-and-Language Navigation

梦想回溯:基于想象的体验检索用于记忆持久的视觉与语言导航

Yunzhe Xu, Yiyuan Pan, Zhe Liu

机构 * National Key Laboratory of Human Machine Hybrid Augmented Intelligence, Xi’an Jiaotong University(西安交通大学人机混合增强智能全国重点实验室) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

AI总结 本文提出Memoir,通过想象引导的检索机制提升记忆持久的视觉与语言导航性能,通过混合视角记忆和经验增强导航模型,在多个基准测试中实现了显著提升。

Comments Accepted by IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10195 2026-03-31 cs.CV

Minimizing the Pretraining Gap: Domain-aligned Text-Based Person Retrieval

缩小预训练差距:领域对齐的基于文本的人检索

Shuyu Yang, Yaxiong Wang, Yongrui Li, Li Zhu, Zhedong Zheng

机构 * Xi’an Jiaotong University(西安交通大学) Hefei University of Technology(合肥工业大学) University of Macau(澳门大学)

AI总结 本文提出双层级策略,通过领域感知扩散和多粒度关系对齐,解决光照、颜色和视角变化导致的领域差距,提升CUHK-PEDES等数据集上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19111 2026-03-31 cs.CV cs.AI

A Benchmark for Incremental Micro-expression Recognition

增量微表情识别的基准测试

Zhengqin Lai, Xiaopeng Hong, Yabin Wang, Xiaobai Li

机构 * Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室) Xi’an Jiaotong University(西安交通大学) Zhejiang University(浙江大学)

AI总结 本文提出增量微表情识别基准测试,通过定制学习设置、有序数据集和交叉评估协议,为研究提供基础,并提供六个基线方法的评估结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27720 2026-03-31 cs.CV cs.MM

Look, Compare and Draw: Differential Query Transformer for Automatic Oil Painting

观察、比较和绘制:用于自动油画的差分查询变换器

Lingyu Liu, Yaxiong Wang, Li Zhu, Lizi Liao, Zhedong Zheng

机构 * School of Software, Xi’an Jiaotong University(西安交通大学软件学院) School of Computer and Information Science, Hefei University of Technology(合肥工业大学计算机与信息学院) Jianghuai Advance Technology Center(江淮前沿技术中心) Anhui Provincial Key Laboratory of Humanoid Robots(安徽省人形机器人重点实验室) Anhui Provincial Industry Innovation Center of Humanoid Robots(安徽省人形机器人产业创新中心) Singapore Management University(新加坡管理大学) Institute of Collaborative Innovation, University of Macau(澳门大学协同创新研究院)

AI总结 本文提出了一种新的自动油画方法,通过差分图像分析提升笔触的动态和表现力,采用差分查询变换器增强局部细节敏感性,提升油画的真实性和艺术性。

Comments https://differential-query-painter.github.io/DQ-painter/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27460 2026-03-31 cs.CV cs.AI

Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development

Project Imaging-X:1000多个开放访问医学影像数据集的调查

Zhongying Deng, Cheng Tang, Ziyan Huang, Jiashi Lin, Ying Chen, Junzhi Ning, Chenglong Ma, Jiyao Liu, Wei Li, Yinghao Zhu, Shujian Gao, Yanyan Huang, Sibo Ju, Yanzhou Su, Pengcheng Chen, Wenhao Tang, Tianbin Li, Haoyu Wang, Yuanfeng Ji, Hui Sun, Shaobo Min, Liang Peng, Feilong Tang, Haochen Xue, Rulin Zhou, Chaoyang Zhang, Wenjie Li, Shaohao Rui, Weijie Ma, Xingyue Zhao, Yibin Wang, Kun Yuan, Zhaohui Lu, Shujun Wang, Jinjie Wei, Lihao Liu, Dingkang Yang, Lin Wang, Yulong Li, Haolin Yang, Yiqing Shen, Lequan Yu, Xiaowei Hu, Yun Gu, Yicheng Wu, Benyou Wang, Minghui Zhang, Angelica I. Aviles-Rivero, Qi Gao, Hongming Shan, Xiaoyu Ren, Fang Yan, Hongyu Zhou, Haodong Duan, Maosong Cao, Shanshan Wang, Bin Fu, Xiaomeng Li, Zhi Hou, Chunfeng Song, Lei Bai, Yuan Cheng, Yuandong Pu, Xiang Li, Wenhai Wang, Hao Chen, Jiaxin Zhuang, Songyang Zhang, Huiguang He, Mengzhang Li, Bohan Zhuang, Zhian Bai, Rongshan Yu, Liansheng Wang, Yukun Zhou, Xiaosong Wang, Xin Guo, Guanbin Li, Xiangru Lin, Dakai Jin, Mianxin Liu, Wenlong Zhang, Qi Qin, Conghui He, Yuqiang Li, Ye Luo, Nanqing Dong, Jie Xu, Wenqi Shao, Bo Zhang, Qiujuan Yan, Yihao Liu, Jun Ma, Zhi Lu, Yuewen Cao, Zongwei Zhou, Jianming Liang, Shixiang Tang, Qi Duan, Dongzhan Zhou, Chen Jiang, Yuyin Zhou, Yanwu Xu, Jiancheng Yang, Shaoting Zhang, Xiaohong Liu, Siqi Luo, Yi Xin, Chaoyu Liu, Haochen Wen, Xin Chen, Alejandro Lozano, Min Woo Sun, Yuhui Zhang, Yue Yao, Xiaoxiao Sun, Serena Yeung-Levy, Xia Li, Jing Ke, Chunhui Zhang, Zongyuan Ge, Ming Hu, Jin Ye, Zhifeng Li, Yirong Chen, Yu Qiao, Junjun He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Shanghai Institute of Optics and Fine Mechanics(上海光学精密机械研究所) Fudan University(复旦大学) University of Cambridge(剑桥大学) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) Fuzhou University(福州大学) University of Washington(华盛顿大学) Stanford University(斯坦福大学) Incept Labs Monash University(莫纳什大学) Ruijin Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院) Alibaba DAMO Academy(阿里巴巴达摩院) The Hong Kong Polytechnic University(香港理工大学) South China University of Technology(华南理工大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Yau Mathematical Sciences Center, Tsinghua University(清华大学丘成桐数学科学中心) Chinese Academy of Sciences(中国科学院) Tsinghua University(清华大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与产业研究院) Shanghai Academy of Artificial Intelligence for Science(上海科学智能研究院) Nankai University(南开大学) The Chinese University of Hong Kong(香港中文大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学) School of Informatics, Xiamen University(厦门大学信息学院) University College London(伦敦大学学院) Sun Yat-sen University(中山大学) Alibaba Group, DAMO Academy, New York, NY, USA(阿里巴巴集团达摩院(纽约)) Tongji University(同济大学) University of Toronto(多伦多大学) Department of Psychological and Cognitive Sciences, Tsinghua University(清华大学心理与认知科学系) Johns Hopkins University(约翰霍普金斯大学) Arizona State University(亚利桑那州立大学) Academy for Clinical Innovation and Translation of Shanghai(上海临床创新转化研究院) University of California, Santa Cruz(加州大学圣克鲁兹分校) ELLIS Institute Finland(芬兰ELLIS研究所) Aalto University(阿尔托大学) Shandong University(山东大学) Xi’an Jiaotong University(西安交通大学)

AI总结 本文调查了1000多个开放访问医学影像数据集,揭示了其规模小、任务碎片化和分布不均的问题,并提出元数据驱动融合方法和交互发现门户,为医学影像数据集的整合和基础模型发展提供路线图。

Comments 157 pages, 19 figures, 26 tables. Project repo: \url{https://github.com/uni-medical/Project-Imaging-X}

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10465 2026-03-31 cs.CL cs.AI

Beyond Elicitation: Provision-based Prompt Optimization for Knowledge-Intensive Tasks

超越启发:基于供应的提示优化用于知识密集型任务

Yunzhe Xu, Zhuosheng Zhang, Zhe Liu

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(西安交通大学人工智能与机器人研究所人机混合增强智能全国重点实验室)

AI总结 本文提出KPPO框架,通过系统整合知识而非潜在启发来优化提示,解决知识密集型任务中静态知识容量的局限,提升性能并降低token消耗。

Comments Accepted by IEEE Transactions on Audio, Speech and Language Processing (TASLP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26675 2026-03-31 cs.CL cs.LG

GeoBlock: Inferring Block Granularity from Dependency Geometry in Diffusion Language Models

GeoBlock:从扩散语言模型中的依赖几何推断块粒度

Lipeng Wan, Junjie Ma, Jianhui Gu, Zeyang Liu, Xuyang Lu, Xuguang Lan

机构 * Xi'an Jiaotong University(西安交通大学)

AI总结 GeoBlock通过分析依赖几何推断块粒度,提升扩散语言模型的并行效率与依赖一致性。

Comments 13 pages, 4 figures, Code available upon publication

详情

展开后加载摘要…

URL PDF HTML 收藏