arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3172
2603.05900 2026-03-09 cs.LG cs.AI

Reference-guided Policy Optimization for Molecular Optimization via LLM Reasoning

基于参考的策略优化用于分子优化 via LLM 推理

Xuan Li, Zhanke Zhou, Zongze Li, Jiangchao Yao, Yu Rong, Lu Zhang, Bo Han

机构 * Hong Kong Baptist University(香港 Baptist 大学) CMIC, Shanghai Jiao Tong University(CMIC,上海交通大学) DAMO Academy, Alibaba Group(DAMO 院,阿里巴巴集团) Hupan Lab(虎盘实验室)

AI总结 RePO通过结合强化学习和参考引导策略优化,在分子优化中提升探索与利用的平衡,优于SFT和RLVR方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05861 2026-03-09 cs.RO

DexEMG: Towards Dexterous Teleoperation System via EMG2Pose Generalization

DexEMG: 通过EMG2Pose泛化实现灵巧遥控系统

Qianyou Zhao, Wenqiao Li, Chiyu Wang, Kaifeng Zhang

机构 * Sharpa Shanghai Jiao Tong University(上海交通大学)

AI总结 DexEMG通过EMG2Pose泛化实现灵巧遥控系统,利用sEMG信号提升机器人手的高精度操控与环境适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05818 2026-03-09 cs.CL

RouteGoT: Node-Adaptive Routing for Cost-Efficient Graph of Thoughts Reasoning

RouteGoT: 用于图状思维推理的节点自适应路由

Yuhang Liu, Ruijie Wang, Yunlong Chu, Bing Hao, Yumeng Lin, Shengzhong Liu, Minglai Shao

机构 * School of New Media and Communication, Tianjin University(新媒体与传播学院,天津大学) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航) Shanghai Jiao Tong University(上海交通大学)

AI总结 RouteGoT通过节点自适应路由框架提升图状思维推理的效率与准确性,实现性能与成本的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05504 2026-03-09 cs.RO cs.AI cs.LG

RoboPocket: Improve Robot Policies Instantly with Your Phone

RoboPocket: 通过手机即时改进机器人策略

Junjie Fang, Wendi Chen, Han Xue, Fangyuan Zhou, Tian Le, Yi Wang, Yuting Zhang, Jun Lv, Chuan Wen, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix Ltd.(诺姆矩阵有限公司)

AI总结 RoboPocket通过手机实现无需机器人即时策略迭代,提升数据与样本效率,克服传统方法的效率瓶颈。

Comments Project page: https://robo-pocket.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02872 2026-03-09 cs.CV

Think-as-You-See: Streaming Chain-of-Thought Reasoning for Large Vision-Language Models

Think-as-You-See: 为大视觉-语言模型设计的流式推理链式思维

Jialiang Zhang, Junlong Tong, Junyan Lin, Hao Wu, Yirong Sun, Yunpu Ma, Xiaoyu Shen

机构 * Institute of Digital Twin, Eastern Institute of Technology(数字孪生研究院,东技术学院) Ocean University of China(中国海洋大学) Shanghai Jiao Tong University(上海交通大学) The Hong Kong Polytechnic University(香港理工大学) Munich Center for Machine Learning, LMU Munich(慕尼黑机器学习中心,慕尼黑大学) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative(宁波空间智能与数字衍生关键实验室)

AI总结 TaYS为大视觉-语言模型设计了流式推理链式思维框架,通过并行化生成、流约束训练和解耦的KV缓存,提升视频理解的效率和响应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01288 2026-03-09 cs.LG

EDIS: Diagnosing LLM Reasoning via Entropy Dynamics

EDIS: 通过熵动力学诊断LLM推理

Chenghua Zhu, Siyan Wu, Xiangkang Zeng, Zishan Xu, Zhaolu Kang, Yifu Guo, Yuquan Lu, Junduan Huang, Guojing Zhou

机构 * South China Normal University(华南师范大学) Sun Yat-sen University(中山大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

AI总结 EDIS通过分析LLM推理过程中的熵动态变化,识别错误推理的特征模式,提供有效的诊断信号以提升推理准确性。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18663 2026-03-09 cs.CV

DVD-Quant: Data-free Video Diffusion Transformers Quantization

DVD-Quant: 数据无依赖的视频扩散变换器量化

Zhiteng Li, Hanxuan Li, Junyi Wu, Kai Liu, Haotong Qin, Linghe Kong, Guihai Chen, Yulun Zhang, Xiaokang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) ETH Zürich(苏黎世联邦理工学院)

AI总结 DVD-Quant通过无数据量化框架实现视频DiT模型的高效量化,提升运行速度并保持视觉质量。

Comments Code and models will be available at https://github.com/lhxcs/DVD-Quant

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14273 2026-03-09 eess.AS cs.SD

Efficient Emotion and Speaker Adaptation in LLM-Based TTS via Characteristic-Specific Partial Fine-Tuning

基于特征特定部分微调的LLM语音合成中高效情感与说话人适应

Tianrui Wang, Meng Ge, Cheng Gong, Chunyu Qiang, Haoyu Wang, Zikang Huang, Yu Jiang, Ye Ni, Yuheng Lu, Xiaobao Wang, Engsiong Chng, Xie Chen, Longbiao Wang, Jianwu Dang

机构 * Tianjin Key Laboratory of Cognitive Computing and Application(天津认知计算与应用重点实验室) College of Intelligence and Computing(智能与计算学院) Tianjin University(天津大学) TeleAI, China Telecom(TeleAI,中国电信) Southeast University(东南大学) Shanghai Jiao Tong University(上海交通大学) Huiyan Technology Co., Ltd(慧言科技有限公司) Nanyang Technological University(南洋理工大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院)

AI总结 本文提出CSP-FT方法,通过特征特定部分微调提升LLM语音合成在情感和说话人适应中的性能,实现参数更新效率与模型表现的平衡。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05410 2026-03-06 cs.RO

PhysiFlow: Physics-Aware Humanoid Whole-Body VLA via Multi-Brain Latent Flow Matching and Robust Tracking

PhysiFlow: 通过多脑潜在流匹配和鲁棒跟踪实现物理感知的人形全身体控制VLA

Weikai Qin, Sichen Wu, Ci Chen, Mengfan Liu, Linxi Feng, Xinru Cui, Haoqi Han, Hesheng Wang

机构 * department of Automation Engineering, Shanghai Jiao Tong University(自动化工程系,上海交通大学) Department of Automation, Key Laboratory of System Control and Information Processing of Ministry of Education, Key Laboratory of Marine Intelligent Equipment and System of Ministry of Education, Shanghai Engineering Research Center of Intelligent Control and Management, Shanghai Jiao Tong University(自动化系,教育部系统控制与信息处理重点实验室,教育部海洋智能设备与系统重点实验室,智能控制与管理上海工程研究中心,上海交通大学)

AI总结 PhysiFlow通过多脑潜在流匹配和鲁棒跟踪,实现了物理感知的人形机器人全身控制的VLA融合,提升了动态肢体协调任务的稳定性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05305 2026-03-06 cs.CV

Fusion4CA: Boosting 3D Object Detection via Comprehensive Image Exploitation

Fusion4CA: 通过全面利用图像信息提升3D目标检测

Kang Luo, Xin Chen, Yangyi Xiao, Hesheng Wang

机构 * IRMV Lab, the Department of Automation, Shanghai Jiao Tong University(IRMV实验室,自动化系,上海交通大学)

AI总结 Fusion4CA通过全面利用图像信息提升3D目标检测性能,采用对比对齐模块和相机辅助分支,结合认知适配器和坐标注意力模块,在nuScenes数据集上实现69.7%的mAP。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13306 2026-03-06 cs.AI cs.CV

DAP: A Discrete-token Autoregressive Planner for Autonomous Driving

DAP:一种用于自动驾驶的离散令牌自回归规划器

Bowen Ye, Bin Zhang, Hang Zhao

机构 * Shanghai Qi Zhi Institute IIIS, Tsinghua University(上海启智研究院 IIIS,清华大学) Shanghai Jiaotong University(上海交通大学)

AI总结 DAP是一种基于离散令牌自回归的自动驾驶规划器,通过联合预测鸟瞰图语义和自身轨迹,实现高效且全面的表示学习,从而在开环和闭环指标上均取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05232 2026-03-06 cs.LG

SlideSparse: Fast and Flexible (2N-2):2N Structured Sparsity

SlideSparse: 快速且灵活的(2N-2):2N结构稀疏

Hanyong Shao, Yingbo Hao, Ting Song, Yan Xia, Di Zhang, Shaohan Huang, Xun Wu, Songchen Xu, Le Xu, Li Dong, Zewen Chi, Yi Zou, Furu Wei

机构 * Peking University(北京大学) South China University of Technology(南方科技大学) Microsoft Research(微软研究院) Shanghai Jiao Tong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 SlideSparse通过滑动窗口分解和激活提升技术,在通用GPU上实现(2N-2):2N结构稀疏的高效加速,提升LLM推理效率的同时保持准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05053 2026-03-06 cs.CV

CLIP-driven Zero-shot Learning with Ambiguous Labels

基于CLIP的模糊标签零样本学习

Jinfu Fan, Jiangnan Li, Xiaowen Yan, Xiaohui Zhong, Wenpeng Lu, Linqing Huang

机构 * College of Computer Science and Technology, Qingdao University(青岛大学计算机科学与技术学院) School of Computer Science, Shanghai JiaoTong University(上海交通大学计算机科学学院)

AI总结 本文提出基于CLIP的模糊标签零样本学习框架,通过语义挖掘和部分零样本损失提升模型对模糊标签的处理能力。

Comments Accepted by ICASSP 2026 (IEEE International Conference on Acoustics, Speech, and Signal Processing)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04945 2026-03-06 cs.CL

Federated Heterogeneous Language Model Optimization for Hybrid Automatic Speech Recognition

联邦异构语言模型优化用于混合自动语音识别

Mengze Hong, Yi Gu, Di Jiang, Hanlin Gu, Chen Jason Zhang, Lu Wang, Zhiyang Su

机构 * Hong Kong Polytechnic University(香港理工大学) Ant Group(蚂蚁集团) Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology(香港科学与技术大学) Shenzhen University(深圳大学)

AI总结 本文提出了一种联邦异构语言模型优化方法,通过遗传算法和强化学习实现高效合并,提升混合自动语音识别系统的性能和可扩展性。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04914 2026-03-06 cs.RO cs.SY eess.SY math.OC

U-OBCA: Uncertainty-Aware Optimization-Based Collision Avoidance via Wasserstein Distributionally Robust Chance Constraints

基于不确定性优化的碰撞避免:通过Wasserstein分布鲁棒机会约束

Zehao Wang, Yuxuan Tang, Han Zhang, Jingchuan Wang, Weidong Chen

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学) Institute of Medical Robotics, Shanghai Jiao Tong University(医学机器人研究所,上海交通大学) Key Laboratory of System Control and Information Processing, Ministry of Education of China(教育部系统控制与信息处理重点实验室) Shanghai Engineering Research Center of Intelligent Control and Management, Shanghai(智能控制与管理上海工程研究中心)

AI总结 U-OBCA通过引入Wasserstein分布鲁棒机会约束,提升机器人在狭窄环境中的导航效率和轨迹规划的保守性

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04898 2026-03-06 cs.LG cs.NI

U-Parking: Distributed UWB-Assisted Autonomous Parking System with Robust Localization and Intelligent Planning

U-Parking:基于UWB的分布式自主泊车系统,具备稳健定位与智能规划

Yiang Wu, Qiong Wu, Pingyi Fan, Kezhi Wang, Wen Chen, Guoqiang Mao, Khaled B. Letaief

机构 * Jiangnan University(江南大学) Zhuhai Fudan Innovation Institute(珠海复旦创新研究院) Tsinghua University(清华大学) Brunel University of London(布鲁内尔大学) Shanghai Jiao Tong University(上海交通大学) Southeast University(东南大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 U-Parking通过整合大语言模型辅助规划、稳健定位与轨迹跟踪,实现具有挑战性的室内环境中的可靠自动化泊车。

Comments This paper has been accepted by infocom. The source code has been released at: https://github.com/qiongwu86/U-Parking

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04771 2026-03-06 cs.CV cs.AI

MADCrowner: Margin Aware Dental Crown Design with Template Deformation and Refinement

MADCrowner: 带边界的牙冠设计与模板变形与细化

Linda Wei, Chang Liu, Wenran Zhang, Yuxuan Hu, Ruiyang Li, Feng Qi, Changyao Tian, Ke Wang, Yuanyuan Wang, Shaoting Zhang, Dimitris Metaxas, Hongsheng Li

机构 * Multimedia Laboratory, The Chinese University of Hong Kong(香港中文大学多媒体实验室) College of Biomedical Engineering, Fudan University(复旦大学生物医学工程学院) Sensetime Research(商汤科技研究院) Department of Second Dental Center, Shanghai Ninth People's Hospital, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院第九人民医院第二牙科中心) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) Department of Computer Science, Rutgers University(罗格斯大学计算机科学系) Centre for Perceptual and Interactive Intelligence (CPII) under InnoHK(InnoHK下的感知与交互智能中心) Shanghai Stomatological Hospital, Fudan University(复旦大学上海牙科医院)

AI总结 MADCrowner通过结合模板变形和边缘分割网络,实现了高精度的牙冠设计,提升了几何精度和临床可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04766 2026-03-06 cs.CV cs.CY

Evaluating and Correcting Human Annotation Bias in Dynamic Micro-Expression Recognition

评估和纠正动态微表情识别中的人类标注偏差

Feng Liu, Bingyu Nan, Xuezhong Qian, Xiaolan Fu

机构 * School of Psychology, Shanghai Jiao Tong University(心理学系,上海交通大学) School of Artificial Intelligence and Computer Science, Jiangnan University(人工智能与计算机科学学院,江南大学)

AI总结 本文提出GAMDSS架构,通过动态关键帧重选提升微表情识别性能,减少跨文化数据集中的标注偏差。

Comments 15 pages, 8 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04243 2026-03-06 cs.RO

Viewpoint Matters: Dynamically Optimizing Viewpoints with Masked Autoencoder for Visual Manipulation

视角至关重要:基于掩码自动编码器的动态视角优化用于视觉操控

Pengfei Yi, Yifan Han, Junyan Li, Litao Liu, Wenzhao Lian

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) the School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Rutgers University(罗格斯大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 MAE-Select通过动态选择最具信息量的视角,提升单摄像头机器人视觉操控性能,甚至超越多摄像头系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22796 2026-03-06 cs.CV

Parallel Diffusion Solver via Residual Dirichlet Policy Optimization

并行扩散求解器 via 剩余狄利克雷策略优化

Ruoyu Wang, Ziyu Li, Beier Zhu, Liangyu Yuan, Hanwang Zhang, Xun Yang, Xiaojun Chang, Chi Zhang

机构 * AGI lab, Westlake University(西溪大学AGI实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出EPD-Solver,通过并行梯度评估和狄利克雷策略优化,提升扩散模型的低延迟采样性能。

Comments arXiv admin note: substantial text overlap with arXiv:2507.14797

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10534 2026-03-06 cs.AI

Achieving Olympia-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning

通过复杂度提升强化学习实现奥lympia级几何大语言模型代理

Haiteng Zhao, Junhao Shen, Yiming Zhang, Songyang Gao, Kuikun Liu, Tianyou Ma, Fan Zheng, Dahua Lin, Wenwei Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) ICMAT Spanish National Research Council(西班牙国家研究委员会ICMAT) The Chinese University of Hong Kong(香港中文大学)

AI总结 InternGeometry通过复杂度提升强化学习实现几何问题求解,仅用13K训练示例解决44个IMO问题,超越平均金牌得主得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08344 2026-03-06 cs.CV cs.AI cs.HC

SASG-DA: Sparse-Aware Semantic-Guided Diffusion Augmentation For Myoelectric Gesture Recognition

SASG-DA:基于稀疏性的语义引导扩散增强用于肌电信号手势识别

Chen Liu, Can Han, Weishi Xu, Yaqi Wang, Dahong Qian

机构 * School of Biomedical Engineering, Shanghai Jiao Tong University(生物医学工程学院,上海交通大学) Innovation Center for Electronic Design Automation Technology, Hangzhou Dianzi University(电子设计自动化技术创新中心,杭州电子科技大学)

AI总结 SASG-DA通过稀疏感知语义引导扩散增强方法,提升sEMG手势识别的样本忠实性和多样性,从而提高模型泛化能力。

Comments Accepted by IEEE Journal of Biomedical and Health Informatics (JBHI), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20333 2026-03-06 cs.CR cs.AI

GhostEI-Bench: Do Mobile Agents Resilience to Environmental Injection in Dynamic On-Device Environments?

GhostEI-Bench: 移动代理在动态设备环境中的环境注入鲁棒性研究

Chiyu Chen, Xinhao Song, Yunkai Chai, Yang Yao, Haodong Zhao, Lijun Li, Jie Li, Yan Teng, Gongshen Liu, Yingchun Wang

机构 * Shanghai Jiao Tong University, School of Computer Science(上海交通大学计算机科学学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学)

AI总结 GhostEI-Bench通过动态环境注入攻击评估移动代理的鲁棒性,揭示现有模型对欺骗性UI的脆弱性,并提供量化和缓解该威胁的框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16688 2026-03-06 cs.CV cs.AI

Pursuing Minimal Sufficiency in Spatial Reasoning

追求空间推理的最小充分性

Yejie Guo, Yunzhong Hou, Wufei Ma, Meng Tang, Ming-Hsuan Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) Johns Hopkins University(约翰霍普金斯大学) University of California Merced(加州大学默塞德分校)

AI总结 本文提出 MSSR 框架,通过构建最小充分集提升视觉-语言模型的空间推理能力,实现充分性与最小性的平衡,取得最佳性能并生成可解释的推理路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08966 2026-03-06 cs.AI cs.CL

Beyond Prefixes: Graph-as-Memory Cross-Attention for Knowledge Graph Completion with Large Language Models

超越前缀:基于图记忆的交叉注意力用于大型语言模型的知识图谱补全

Ruitong Liu, Boxu Lin, Peize Li, Siyuan Li, Yunjia Wu, Te Sun, Chaohan Wu

机构 * Peking University(北京大学) Dalian University of Technology(大连理工大学) King’s College London(伦敦国王学院) Peng Cheng Laboratory(鹏城实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出图记忆调优方法,通过深度交叉注意力机制提升大型语言模型在知识图谱补全任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10117 2026-03-06 cs.LG cs.CL

Learning Virtual Machine Scheduling in Cloud Computing through Language Agents

通过语言代理学习云计算中的虚拟机调度

JieHao Wu, Ziwei Wang, Junjie Sheng, Wenhao Li, Xiangfeng Wang, Jun Luo

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Antai College of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Key Laboratory of Mathematics and Engineering Applications, MoE, East China Normal University(教育部数学与工程应用重点实验室)

AI总结 本文提出MiCo框架,通过语言代理解决云计算中的虚拟机调度问题,实现高效动态调度并验证其在大规模场景中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04411 2026-03-06 cs.CL cs.AI cs.LG

One Size Does Not Fit All: Token-Wise Adaptive Compression for KV Cache

一个尺寸并不适合所有:针对KV缓存的令牌级自适应压缩

Liming Lu, Kaixi Qiu, Jiayu Zhou, Jushi Kai, Haoyan Zhang, Huanyu Wang, Jingwen Leng, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) John Class Zhiyuan College(约翰·类智院) School of Computer Science(计算机科学学院) School of Mathematical Sciences(数学科学学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 DynaKV 是一种基于令牌级自适应压缩的KV缓存压缩方法,通过动态分配压缩率提升压缩比下的保真度,实现内存减少与生成质量的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03957 2026-03-05 cs.RO

ArthroCut: Autonomous Policy Learning for Robotic Bone Resection in Knee Arthroplasty

ArthroCut:膝关节置换术中机器人骨切除的自主策略学习

Xu Lu, Yiling Zhang, Wenquan Cheng, Longfei Ma, Fang Chen, Hongen Liao

机构 * School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) School of Biomedical Engineering, Shanghai Jiao Tong University(上海交通大学生物医学工程学院) Longwood Valley MedTech

AI总结 ArthroCut通过结合术前和术中数据,实现膝关节置换术中骨切除的自主策略学习,提升机器人手术的自主性和可解释性。

Comments Accepted for publication at the 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03836 2026-03-05 cs.RO

SkillVLA: Tackling Combinatorial Diversity in Dual-Arm Manipulation via Skill Reuse

SkillVLA: 通过技能复用解决双臂操作中的组合多样性问题

Xuanran Zhai, Zekai Huang, Longyan Wu, Qianyou Zhao, Qiaojun Yu, Jieji Ren, Ce Hao, Harold Soh

机构 * National University of Singapore(国立新加坡大学) Beijing Zhongguancun Academy(北京中关村学院) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Smart Systems Institute, NUS(NUS智能系统研究所)

AI总结 SkillVLA通过技能复用解决双臂操作中的组合多样性问题,提升技能组合成功率至51%并在复杂任务中表现优异。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03825 2026-03-05 cs.CV cs.AI

From Narrow to Panoramic Vision: Attention-Guided Cold-Start Reshapes Multimodal Reasoning

从窄视场到全景视觉:基于注意力的冷启动重塑多模态推理

Ruilin Luo, Chufan Shi, Yizhen Zhang, Cheng Yang, Songtao Jiang, Tongkun Guan, Ruizhe Chen, Ruihang Chu, Peng Wang, Mingkun Yang, Yujiu Yang, Junyang Lin, Zhibo Yang

机构 * Tsinghua University(清华大学) University of South California(南加州大学) Qwen Team, Alibaba Group(通义实验室,阿里巴巴集团) University of California San Diego(南加州大学圣地亚哥分校) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出AVAR框架,通过视觉锚定与注意力引导提升多模态推理性能,实现7%的平均提升。

Comments ICLR 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏