arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3172
2603.12008 2026-03-13 cs.CV

CrossEarth-SAR: A SAR-Centric and Billion-Scale Geospatial Foundation Model for Domain Generalizable Semantic Segmentation

跨地球雷达:一种以雷达为中心的十亿级地理空间基础模型,用于领域通用的语义分割

Ziqi Ye, Ziyang Gong, Ning Liao, Xiaoxing Hu, Di Wang, Hongruixuan Chen, Chen Huang, Yiguo He, Yuru Jia, Xiaoxing Wang, Haipeng Wang, Xue Yang, Junchi Yan

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) The University of Tokyo(东京大学) Sun Yat-sen University(中山大学) KU Leuven(比利时鲁汶大学) KTH(皇家理工学院)

AI总结 CrossEarth-SAR是一种基于雷达的十亿级地理空间基础模型,通过物理引导的稀疏专家混合架构实现跨域语义分割的领域泛化,通过大规模预训练和基准测试验证其有效性。

Comments 26 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05884 2026-03-13 cs.CE cs.AI

Computational Pathology in the Era of Emerging Foundation and Agentic AI -- International Expert Perspectives on Clinical Integration and Translational Readiness

在新兴基础和代理AI时代 computational pathology 的发展——国际专家对临床整合与转化准备的视角

Qian Da, Yijiang Chen, Min Ju, Zheyi Ji, Albert Zhou, Wenwen Wang, Matthew A Abikenari, Philip Chikontwe, Guillaume Larghero, Bowen Chen, Peter Neidlinger, Dingrong Zhong, Shuhao Wang, Wei Xu, Drew Williamson, German Corredor, Sen Yang, Le Lu, Xiao Han, Kun-Hsing Yu, Jun-zhou Huang, Laura Barisoni, Geert Litjens, Anant Madabhushi, Lifeng Zhu, Chaofu Wang, Junhan Zhao, Weiguo Hu

机构 * Department of Pathology, Ruijin Hospital, Shanghai Jiao Tong University School of Medicine, Shanghai, China(复旦大学附属中山医院病理科,上海交通大学医学院,上海,中国) Department of Radiation Oncology, Stanford University School of Medicine, Stanford, CA, USA(斯坦福大学医学院放射肿瘤科,斯坦福,加利福尼亚州,美国) Department of Basic Education, Qingdao City University, Qingdao, Shandong, China(青岛城市大学基础教育系,青岛,山东省,中国) Department of Human Genetics, the University of Chicago, Chicago, IL, USA(芝加哥大学人类遗传学系,芝加哥,伊利诺伊州,美国) Department of Computer Science, University of Warwick, Coventry UK(沃里克大学计算机科学系,科文特里,英国) Department of Electrical and Computer Engineering, Carnegie Mellon University, Pittsburgh, Pennsylvania, USA(卡内基梅隆大学电气与计算机工程系,匹兹堡,宾夕法尼亚州,美国) Department of Neurosurgery, Stanford University School of Medicine, Stanford, CA, USA(斯坦福大学医学院神经外科,斯坦福,加利福尼亚州,美国) Department of Biomedical Informatics, Harvard Medical School, Boston, MA, USA(哈佛医学院生物医学信息学系,波士顿,马萨诸塞州,美国)

AI总结 本文探讨新兴基础和代理AI在计算病理学中的临床整合与转化准备,分析技术成熟度、经济监管及实际应用挑战,提供国际专家对当前能力与障碍的评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10893 2026-03-12 cs.CV

S2D: Sparse to Dense Lifting for 3D Reconstruction with Minimal Inputs

S2D:基于稀疏到密集的3D重建方法,使用最少输入

Yuzhou Ji, Qijian Tian, He Zhu, Xiaoqi Jiang, Guangzhi Cao, Lizhuang Ma, Yuan Xie, Xin Tan

机构 * Shanghai Jiao Tong University(上海交通大学) East China Normal University(华东师范大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Chery Automobile(奇瑞汽车)

AI总结 S2D通过稀疏到密集的提升方法,在最少输入下实现高质量的3DGS重建,提升稀疏点云和3DGS的一致性与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10588 2026-03-12 cs.AI cs.CL cs.LG

Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning

LLM对齐真的需要多样性吗?对道德推理适应RLVR方法的实证研究

Zhaowei Zhang, Xiaohan Liu, Xuekai Zhu, Junchao Huang, Ceyao Zhang, Zhiyuan Feng, Yaodong Yang, Xiaoyuan Yi, Xing Xie

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Microsoft Research(微软研究院) University of Michigan(密歇根大学) Shanghai Jiao Tong University(上海交通大学) CUHKSZ(香港中文大学(深圳)) THU(清华大学)

AI总结 本文通过实证研究发现,LLM对齐任务并不需要多样性算法,标准奖励最大化RLVR方法在道德推理中同样有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10463 2026-03-12 cs.CV

Learning to Wander: Improving the Global Image Geolocation Ability of LMMs via Actionable Reasoning

学习漫游:通过可操作推理提升LMMs的全球图像地理定位能力

Yushuo Zheng, Huiyu Duan, Zicheng Zhang, Xiaohong Liu, Xiongkuo Min

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 通过可操作推理提升LMMs的全球图像地理定位能力,提出GeoAoT框架和WanderBench基准,实现交互式地理定位探索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10397 2026-03-12 cs.LG cs.AI

On the Learning Dynamics of Two-layer Linear Networks with Label Noise SGD

关于带有标签噪声的两层线性网络学习动态的研究

Tongcheng Zhang, Zhanpeng Zhou, Mingze Wang, Andi Han, Wei Huang, Taiji Suzuki, Junchi Yan

机构 * Sch. of Computer Science and Zhiyuan College, Shanghai Jiao Tong University(上海交通大学计算机科学学院和智远学院) Peking University(北京大学) University of Sydney(悉尼大学) RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能项目中心) The Institute of Statistical Mathematics(统计数学研究所) The University of Tokyo(东京大学)

AI总结 研究揭示了带有标签噪声的两层线性网络学习动态的两阶段行为,展示了标签噪声在促进模型从懒惰范式向丰富范式过渡中的关键作用,并扩展至更广泛的优化算法。

Comments Accepted to AAAI 2026(oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07181 2026-03-12 cs.CV

FreeFly-Thinking : Aligning Chain-of-Thought Reasoning with Continuous UAV Navigation

自由飞行-思考:将链式推理对齐连续无人机导航

Jiaxu Zhou, Shaobo Wang, Zhiyuan Yang, Zhenjun Yu, Tao Li

机构 * SJTU Paris Elite Institute of Technology(上海交通大学巴黎精英理工学院) Shanghai Jiao Tong University(上海交通大学) Tongji University(同济大学)

AI总结 FreeFly-thinking是一种端到端的无人机视觉-语言导航框架,通过链式推理提升导航性能,实现了在复杂户外环境中的高效导航。

Comments 10 pages, 5 figures, ECCV review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01914 2026-03-12 cs.CL

AdaPonderLM: Gated Pondering Language Models with Token-Wise Adaptive Depth

AdaPonderLM: 带令牌级自适应深度的门控沉思语言模型

Shixiang Song, He Li, Zitong Wang, Boyi Zeng, Feichen Song, Yixuan Wang, Zhiqin John Xu, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Sun Yat-sen University(中山大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 AdaPonderLM通过自适应深度和令牌级门控机制,在保持语言建模性能的同时减少推理计算,实现高效自监督训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10955 2026-03-12 cs.CR cs.AI

Beyond Max Tokens: Stealthy Resource Amplification via Tool Calling Chains in LLM Agents

超越最大令牌:通过工具调用链实现隐秘的资源放大

Kaiyu Zhou, Yongsen Zheng, Yicheng He, Meng Xue, Xueluan Gong, Yuji Wang, Xuanye Zhang, Kwok-Yan Lam

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) University of Illinois Urbana-Champaign, United States(伊利诺伊大学厄巴纳-香槟分校,美国) The Hong Kong University of Science and Technology, Hong Kong(香港科学与技术大学,香港) Shanghai Jiao Tong University, China(上海交通大学,中国)

AI总结 本文提出了一种基于工具调用链的隐秘DoS攻击,通过多轮交互显著提升LLM的资源消耗,挑战现有安全防护机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10705 2026-03-12 cs.CV

Enhanced Continual Learning of Vision-Language Models with Model Fusion

增强视觉-语言模型的持续学习与模型融合

Haoyuan Gao, Zicong Zhang, Yuqi Wei, Linglan Zhao, Guilin Li, Yexin Li, Bo Wang, Linghe Kong, Weiran Huang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) State Key Laboratory of General Artificial Intelligence, BIGAI(国家一般人工智能重点实验室,BIGAI) Tencent(腾讯)

AI总结 本文提出ConDU方法,通过模型融合解决VLMs在持续学习中的灾难性遗忘问题,提升零样本性能和多任务表现。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09968 2026-03-11 cs.CV

ReCoSplat: Autoregressive Feed-Forward Gaussian Splatting Using Render-and-Compare

ReCoSplat: 基于渲染与比较的自回归前馈高斯点云生成

Freeman Cheng, Botao Ye, Xueting Li, Junqi You, Fangneng Zhan, Ming-Hsuan Yang

机构 * University of California Merced(加州大学默塞德分校) ETH Zurich(苏黎世联邦理工学院) NVIDIA Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 ReCoSplat通过引入渲染与比较模块,解决高斯点云生成中姿态误差问题,实现高效稳定的视角合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09877 2026-03-11 cs.CV

InternVL-U: Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing

InternVL-U: 使统一多模态模型在理解、推理、生成和编辑方面更加普及

Changyao Tian, Danni Yang, Guanzhou Chen, Erfei Cui, Zhaokai Wang, Yuchen Duan, Penghao Yin, Sitao Chen, Ganlin Yang, Mingxin Liu, Zirun Zhu, Ziqian Fan, Leyao Gu, Haomin Wang, Qi Wei, Jinhui Yin, Xue Yang, Zhihang Zhong, Qi Qin, Yi Xin, Bin Fu, Yihao Liu, Jiaye Ge, Qipeng Guo, Gen Luo, Hongsheng Li, Yu Qiao, Kai Chen, Hongjie Zhang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学) Nanjing University(南京大学) Xiamen University(厦门大学) CUHK MMLab(香港中文大学MMLab)

AI总结 InternVL-U通过轻量级统一多模态模型,在保持强大生成能力的同时,实现了在理解、推理、生成和编辑方面的高效平衡。

Comments technical report, 61 pages, https://github.com/OpenGVLab/InternVL-U

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09716 2026-03-11 cs.AI

AutoAgent: Evolving Cognition and Elastic Memory Orchestration for Adaptive Agents

AutoAgent:为自适应智能体演化认知与弹性记忆编排

Xiaoxing Wang, Ning Liao, Shikun Wei, Chen Tang, Feiyu Xiong

机构 * MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司) Shanghai Jiao Tong University(上海交通大学) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所)

AI总结 AutoAgent通过自我进化多智能体框架,实现动态认知演化与弹性记忆编排,提升智能体在动态环境中的适应性和任务执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09268 2026-03-11 cs.AI

Logos: An evolvable reasoning engine for rational molecular design

Logos:一种可进化推理引擎用于理性分子设计

Haibin Wen, Zhe Zhao, Fanfu Wang, Tianyi Xu, Hao Zhang, Chao Yang, Ye Wei

机构 * City University of Hong Kong(香港城市大学) Lanzhou University(兰州大学) Riltide Medicines(Riltide医药公司) Shanghai Jiao Tong University(上海交通大学)

AI总结 Logos是一种集成多步逻辑推理与严格化学一致性的分子推理模型,通过分阶段训练和化学规则优化,在多个基准数据集上实现了结构准确性和化学有效性上的高性能,同时参数量仅为通用语言模型的几分之一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09251 2026-03-11 stat.ML cs.LG cs.NA math.NA

A Generative Sampler for distributions with possible discrete parameter based on Reversibility

基于可逆性的生成采样器:用于可能具有离散参数分布的采样器

Lei Li, Zhen Wang, Lishuo Zhang

机构 * School of Mathematical Sciences, Shanghai Jiao Tong University, Shanghai, 200240, P.R.China(上海交通大学数学科学学院) Institute of Natural Sciences, MOE-LSC, Shanghai Jiao Tong University, Shanghai, 200240, P.R.China(上海交通大学自然科学研究院)

AI总结 本文提出了一种基于可逆性的生成采样器,适用于具有离散参数分布的复杂系统,通过最小化MMD来实现高效的采样方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09121 2026-03-11 cs.RO cs.AI

DexHiL: A Human-in-the-Loop Framework for Vision-Language-Action Model Post-Training in Dexterous Manipulation

DexHiL: 一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架

Yifan Han, Zhongxi Chen, Yuxuan Zhao, Congsheng Xu, Yanming Shao, Yichuan Peng, Yao Mu, Wenzhao Lian

机构 * CASIA(中国科学院自动化研究所) SJTU(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 DexHiL是一种用于灵巧操作中视觉-语言-动作模型后训练的人机协同框架,通过干预意识的数据采样策略和轻量级远程操作界面,显著提升了模型在不同任务中的成功率。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02023 2026-03-11 cs.CL

PonderLM-3: Adaptive Token-Wise Pondering with Differentiable Masking

PonderLM-3: 基于可微掩码的自适应逐token pondering

He Li, Feichen Song, Boyi Zeng, Shixiang Song, Zhiqin John Xu, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

AI总结 PonderLM-3通过可微掩码实现token级自适应计算分配,降低预训练困惑度并提升推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08220 2026-03-11 cs.CL

Pretraining with Token-Level Adaptive Latent Chain-of-Thought

基于令牌级适应性潜在链式思维的预训练

Boyi Zeng, Yiqin Hao, He Li, Shixiang Song, Feichen Song, Zitong Wang, Siyuan Huang, Yi Xu, ZiWei He, Xinbing Wang, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Al Laboratory(上海Al实验室) Sun Yat-sen University(中山大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 本研究提出了一种基于令牌级适应性潜在链式思维的预训练方法,通过内部化潜在链式思维来提高模型性能,减少计算成本,并在语言建模和下游任务中取得显著改进。

Comments 15pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02541 2026-03-11 cs.CV

AVGGT: Rethinking Global Attention for Accelerating VGGT

AVGGT:重新思考全局注意以加速VGGT

Xianbing Sun, Zhikai Zhu, Zhengyu Lou, Bo Yang, Jinyang Tang, Liqing Zhang, He Wang, Jianfu Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

AI总结 AVGGT通过将早期全局注意力转换为帧注意力并子采样全局注意力,实现多视图3D任务的加速,同时保持模型精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05875 2026-03-11 cs.SD

LARA-Gen: Enabling Continuous Emotion Control for Music Generation Models via Latent Affective Representation Alignment

LARA-Gen:通过潜在情感表示对齐实现音乐生成模型的连续情绪控制

Jiahao Mei, Xuenan Xu, Zeyu Xie, Zihao Zheng, Ye Tao, Yue Ding, Mengyue Wu

机构 * X-LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai AI Lab, China(上海人工智能实验室) Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine, China(上海交通大学医学院精神卫生中心)

AI总结 LARA-Gen通过潜在情感表示对齐实现音乐生成模型的连续情绪控制,提升情绪可控性和音乐质量。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01068 2026-03-11 cs.RO cs.LG

Compose Your Policies! Improving Diffusion-based or Flow-based Robot Policies via Test-time Distribution-level Composition

制定你的策略!通过测试时的分布级组合改进扩散型或流型机器人策略

Jiahang Cao, Yize Huang, Hanzhong Guo, Rui Zhang, Mu Nan, Weijian Mai, Jiaxu Wang, Hao Cheng, Jingkai Sun, Gang Han, Wen Zhao, Qiang Zhang, Yijie Guo, Qihao Zheng, Chunfeng Song, Xiao Li, Ping Luo, Andrew F. Luo

机构 * The University of Hong Kong(香港大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) Shanghai AI Lab(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本研究提出无需训练的通用策略组合方法,通过测试时分布级组合提升机器人策略性能。

Comments Accepted to ICLR 2026. Project Page: https://sagecao1125.github.io/GPC-Site/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01611 2026-03-11 cs.CV cs.AI cs.LG

DRUPI: Dataset Reduction Using Privileged Information

DRUPI: 利用特权信息进行数据集缩减

Shaobo Wang, Youxin Jiang, Tianle Niu, Yantai Yang, Ruiji Zhang, Shuhao Hu, Shuaiyu Zhang, Chenghao Sun, Weiya Li, Conghui He, Xuming Hu, Linfeng Zhang

机构 * EPIC Lab, SJTU(EPIC实验室,上海交通大学) ICBC Shanghai AI Lab(上海人工智能实验室) HKUST(GZ)(香港科技大学(广州))

AI总结 本文提出DCPI方法,通过合成特权信息提升数据集凝练效果,在多个数据集上实现性能提升。

Comments 21 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17135 2026-03-11 cs.CV

TIMotion: Temporal and Interactive Framework for Efficient Human-Human Motion Generation

TIMotion: 时空交互框架用于高效的人机运动生成

Yabiao Wang, Shuo Wang, Jiangning Zhang, Ke Fan, Jiafu Wu, Zhucun Xue, Yong Liu

机构 * Zhejiang University(浙江大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 TIMotion提出一种高效框架,通过因果交互注入、角色演变扫描和局部模式放大,实现高效的人类交互运动生成。

Comments Accepted to CVPR 2025. Project page: https://aigc-explorer.github.io/TIMotion-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08718 2026-03-11 cs.AR cs.AI

CktEvo: Repository-Level RTL Code Benchmark for Design Evolution

CktEvo: 用于设计演化的仓库级RTL代码基准

Zhengyuan Shi, Jingxin Wang, Tairan Cheng, Changran Xu, Weikang Qian, Qiang Xu

机构 * The Chinese University of Hong Kong(中国香港大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 CktEvo提出一个用于仓库级RTL代码演化的基准和框架,通过闭环框架实现PPA改进,无需人工干预。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06261 2026-03-11 cs.AI cs.CL cs.LG

AlphaApollo: A System for Deep Agentic Reasoning

AlphaApollo:一个深度代理推理系统

Zhanke Zhou, Chentao Cao, Xiao Feng, Xuan Li, Zongze Li, Xiangyu Lu, Jiangchao Yao, Weikai Huang, Tian Cheng, Jianghangfan Zhang, Tangyu Jiang, Linrui Xu, Yiming Zheng, Brando Miranda, Tongliang Liu, Sanmi Koyejo, Masashi Sugiyama, Bo Han

机构 * TMLR Group Department of Computer Science Hong Kong Baptist University(香港 Baptist 大学计算机科学系 TMLR 组) RIKEN AIP Cooperative Medianet Innovation Center Shanghai Jiao Tong University(上海交通大学合作中立创新中心) Stanford University(斯坦福大学) Sydney AI Centre The University of Sydney(悉尼大学悉尼AI中心) The University of Tokyo(东京大学)

AI总结 AlphaApollo通过多轮代理推理、学习和进化机制,提升基础模型在复杂问题解决中的推理能力和工具使用可靠性。

Comments Ongoing project

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08324 2026-03-10 cs.RO cs.AI

EndoSERV: A Vision-based Endoluminal Robot Navigation System

EndoSERV:一种基于视觉的内镜机器人导航系统

Junyang Wu, Fangfang Xie, Minghui Zhang, Hanxiao Zhang, Jiayuan Sun, Yun Gu, Guang-Zhong Yang

机构 * Institute of Medical Robotics, Shanghai Jiao Tong University(医学机器人研究所,上海交通大学)

AI总结 EndoSERV提出了一种基于视觉的内镜机器人导航系统,通过SE段到结构和Real到虚拟映射技术,解决内镜路径复杂、狭窄和曲折带来的导航难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00927 2026-03-10 cs.CV

LAHNet: Local Attentive Hashing Network for Point Cloud Registration

LAHNet:用于点云配准的局部注意哈希网络

Wentao Qu, Xiaoshui Huang, Liang Xiao

机构 * Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 LAHNet通过引入局部注意机制和高效窗口化策略,提升点云配准的特征区分性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11549 2026-03-10 cs.CV

ODI-Bench: Can MLLMs Understand Immersive Omnidirectional Environments?

ODI-Bench: MLLMs能否理解沉浸式全向环境?

Liu Yang, Huiyu Duan, Ran Tao, Juntao Cheng, Sijing Wu, Yunhao Li, Jing Liu, Xiongkuo Min, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Xinjiang University(新疆大学) Tianjin University(天津大学)

AI总结 ODI-Bench旨在评估多模态大语言模型对全向图像沉浸环境的理解能力,通过定制基准和Omni-CoT方法提升模型表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24758 2026-03-10 cs.CV

ExGS: Extreme 3D Gaussian Compression with Diffusion Priors

ExGS:基于扩散先验的极端3D高斯压缩

Jiaqi Chen, Xinhao Ji, Yuanyuan Gao, Hao Li, Yuning Gong, Yifei Liu, Dan Xu, Zhihang Zhong, Dingwen Zhang, Xiao Sun

机构 * Northwestern Polytechnical University(北western工业大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 ExGS通过结合UGC和GaussPainter,利用扩散先验实现高效且高质量的极端3DGS压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01941 2026-03-10 cs.RO

FreeTacMan: Robot-free Visuo-Tactile Data Collection System for Contact-rich Manipulation

FreeTacMan: 无需机器人的人工智能视觉-触觉数据采集系统用于接触密集的 manipulation

Longyan Wu, Checheng Yu, Jieji Ren, Li Chen, Yufei Jiang, Ran Huang, Guoying Gu, Hongyang Li

机构 * Shanghai Innovation Institute(上海创新研究院) The University of Hong Kong(香港大学) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Shanghai University(上海大学)

AI总结 FreeTacMan 提出了一种无需机器人的视觉-触觉数据采集系统,通过可穿戴抓取器和高精度光学跟踪系统,实现了高效的数据收集和多模态数据集的构建,推动了机器人 manipulation 的研究。

详情

展开后加载摘要…

URL PDF HTML 收藏