arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3172
2602.14208 2026-02-24 cs.LG math.OC stat.ML

Fast Catch-Up, Late Switching: Optimal Batch Size Scheduling via Functional Scaling Laws

快速追上,后期切换:通过函数缩放定律进行最优批量大小调度

Jinbo Wang, Binghui Li, Zhanpeng Zhou, Mingze Wang, Yuxuan Sun, Jiaqi Zhang, Xunliang Cai, Lei Wu

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Center for Machine Learning Research, Peking University(北京大学机器学习研究中心) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(中国科学技术大学认知智能国家重点实验室) Meituan, Beijing(美团(北京)) AI for Science Institute, Beijing(北京人工智能科学研究院)

AI总结 本文通过函数缩放定律揭示了大规模深度学习中最优批量大小调度的理论机制,表明在困难任务中后期切换大批次可提升效率并减少数据消耗。

Comments 34 pages, accepted by ICLR 2026 as a conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16175 2026-02-24 cs.CV cs.AI

Mantis: A Versatile Vision-Language-Action Model with Disentangled Visual Foresight

Mantis:一种具有解耦视觉前瞻性能力的多功能视觉-语言-动作模型

Yi Yang, Xueqi Li, Yiyang Chen, Jin Song, Yihan Wang, Zipeng Xiao, Jiadi Su, You Qiaoben, Pengfei Liu, Zhijie Deng

机构 * SJTU(上海交通大学) SII(上海信息所) SUSTech(四川大学) NJUPT(南京工业大学) FDU(福建大学) BOSCH(博世)

AI总结 Mantis通过解耦视觉前瞻性模块提升视觉-语言-动作模型的性能,实现高成功率和快速收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25232 2026-02-24 cs.AI cs.CL

From Medical Records to Diagnostic Dialogues: A Clinical-Grounded Approach and Dataset for Psychiatric Comorbidity

从医疗记录到诊断对话:一种基于临床的途径和数据集用于精神疾病共病

Tianxi Wan, Jiaming Luo, Siyuan Chen, Kunyao Lan, Jianhua Chen, Haiyang Geng, Mengyue Wu

机构 * X - LANCE Lab, Shanghai Jiao Tong University, China(上海交通大学X-LANCE实验室) Shanghai Mental Health Center, SJTU School of Medicine, China(上海精神卫生中心,上海交通大学医学院) Chen Frontier Lab for AI and Mental Health, Tianqiao and Chrissy Chen Institute, Shanghai, China(陈前沿人工智能与心理健康实验室,田青和克里斯蒂娜·陈研究所)

AI总结 本文提出了一种基于临床的途径和数据集,用于生成支持精神疾病共病的多轮诊断对话,通过合成患者电子医疗记录和多智能体对话生成技术,构建了首个大规模对话数据集PsyCoTalk,提升了诊断准确性和治疗计划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18920 2026-02-24 cs.CL cs.AI

DeepInnovator: Triggering the Innovative Capabilities of LLMs

DeepInnovator: 激发大语言模型的创新能力

Tianyu Fan, Fengji Zhang, Yuxiang Zheng, Bei Chen, Xinyao Niu, Chengen Huang, Junyang Lin, Chao Huang

机构 * The University of Hong Kong(香港大学) City University of Hong Kong(城市大学) Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团)

AI总结 DeepInnovator通过自动化数据提取和猜想与反驳训练范式,提升大语言模型的创新能力,实现显著优于基线的创新想法生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18773 2026-02-24 cs.AI

LAMMI-Pathology: A Tool-Centric Bottom-Up LVLM-Agent Framework for Molecularly Informed Medical Intelligence in Pathology

LAMMI-Pathology: 一种以工具为中心的自下而上LVLM-智能体框架用于分子信息引导的病理学智能

Haoyang Su, Shaoting Zhang, Xiaosong Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 LAMMI-Pathology提出了一种以工具为中心的自下而上智能体框架,通过分子信息引导的病理学智能提升病理图像分析的证据驱动能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18697 2026-02-24 cs.CV

Deep LoRA-Unfolding Networks for Image Restoration

深度 LoRA 展开网络用于图像恢复

Xiangming Wang, Haijin Zeng, Benteng Sun, Jiezhang Cao, Kai Zhang, Qiangqiang Shen, Yongyong Chen

机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳)) Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(图像通信与网络工程院,上海交通大学) School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学) School of Electronics and Information Engineering, Harbin Institute of Technology (Shenzhen)(电子与信息工程学院,哈尔滨工业大学(深圳))

AI总结 LoRun 通过引入 LoRA 适配器实现高效图像恢复,减少参数冗余并提升去噪性能。

Comments Accepted by IEEE Transactions on Image Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07854 2026-02-24 cs.CV

Geometry-Aware Rotary Position Embedding for Consistent Video World Model

面向一致视频世界模型的几何感知旋转位置嵌入

Chendong Xiang, Jiajun Liu, Jintao Zhang, Xiao Yang, Zhengwei Fang, Shizun Wang, Zijun Wang, Yingtian Zou, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(清华大学计算机科学与技术系、人工智能研究院、BNRist中心、THBI实验室、清华-博世联合机器学习中心、清华大学) Gaoling School of Artificial Intelligence, Renmin University of China(北京人民大学人工智能学院) National University of Singapore(新加坡国立大学) Peking University(北京大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 本文提出ViewRope和几何感知帧稀疏注意力,通过引入相机射线方向提升视频世界模型的长期一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20648 2026-02-24 cs.LG cs.RO

Wonder Wins Ways: Curiosity-Driven Exploration through Multi-Agent Contextual Calibration

Wonder Wins Ways: 通过多智能体上下文校准实现好奇心驱动的探索

Yiyuan Pan, Zhe Liu, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) School of Automation and Intelligent Sensing(自动化与智能感知学院) Key Laboratory of System Control and Information Processing(系统控制与信息处理重点实验室) Ministry of Education of China(中华人民共和国教育部) National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家级重点实验室) Institute of Artificial Intelligence and Robotics(人工智能与机器人研究院)

AI总结 CERMIC通过多智能体上下文校准增强探索,解决稀疏奖励环境下多智能体强化学习的探索效率问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08134 2026-02-24 cs.CV

Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control

跟随你的形状:通过轨迹引导的区域控制实现形状感知图像编辑

Zeqian Long, Mingzhe Zheng, Kunyu Feng, Xinhua Zhang, Hongyu Liu, Harry Yang, Linfeng Zhang, Qifeng Chen, Yue Ma

机构 * HKUST(香港科技大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Shanghai Jiao Tong University(上海交通大学)

AI总结 Follow-Your-Shape通过轨迹引导的区域控制实现精准形状编辑,无需训练和掩码,提升大规模形状变换任务的编辑性和视觉保真度。

Comments Accepted to ICLR 2026. Project webpage is available at https://follow-your-shape.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02066 2026-02-24 cs.LG cs.AI cs.CL

MolReasoner: Toward Effective and Interpretable Reasoning for Molecular LLMs

MolReasoner:迈向分子大语言模型的有效且可解释的推理

Guojiang Zhao, Zixiang Lu, Yutang Ge, Sihang Li, Zheng Cheng, Haitao Lin, Lirong Wu, Hanchen Xia, Hengxing Cai, Wentao Guo, Hongshuai Wang, Mingjun Xu, Siyu Zhu, Guolin Ke, Linfeng Zhang, Zhifeng Gao

机构 * DP Technology, Beijing, China(DP技术有限公司) AI for Science Institute, Beijing, China(AI for Science研究院) Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Fudan University, Shanghai, China(复旦大学)

AI总结 MolReasoner通过两阶段框架提升分子大语言模型的推理能力和可解释性,有效减少幻觉并提高生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18010 2026-02-23 cs.SD

Scaling Audio-Text Retrieval with Multimodal Large Language Models

通过多模态大语言模型扩展音频-文本检索

Jilan Xu, Carl Thomé, Danijela Horak, Weidi Xie, Andrew Zisserman

机构 * Visual Geometry Group, University of Oxford(牛津大学视觉几何组) Epidemic Sound School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 AuroLA通过多模态大语言模型实现音频-文本检索的扩展,利用可扩展的数据管道和混合NCE损失提升检索性能。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17769 2026-02-23 cs.MM cs.SD eess.AS

MusicSem: A Semantically Rich Language--Audio Dataset of Natural Music Descriptions

MusicSem: 一种语义丰富的语言-音频数据集,用于自然音乐描述

Rebecca Salganik, Teng Tu, Fei-Yueh Chen, Xiaohao Liu, Keifeng Lu, Ethan Luvisia, Zhiyao Duan, Guillaume Salha-Galvan, Anson Kahng, Yunshan Ma, Jian Kang

机构 * University of Rochester(罗切斯特大学) National University of Singapore(新加坡国立大学) SJTU Paris Elite Institute of Technology(上海科技技术巴黎精英学院) Singapore Management University(新加坡管理学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 MusicSem是一个基于Reddit讨论的语义丰富的音乐描述数据集,旨在提升多模态音乐表示学习中对细粒度语义的建模能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15060 2026-02-23 cs.RO cs.AI

CLOT: Closed-Loop Global Motion Tracking for Whole-Body Humanoid Teleoperation

CLOT:闭环全局运动跟踪用于全身人形远程操作

Tengjie Zhu, Guanyu Cai, Yang Zhaohui, Guanzhu Ren, Haohui Xie, ZiRui Wang, Junsong Wu, Jingbo Wang, Xiaokang Yang, Yao Mu, Yichao Yan

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(人工智能联合实验室、AI研究院、上海交通大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 CLOT通过高频定位反馈实现闭环全局运动跟踪,解决长时间全身人形远程操作中的姿态漂移问题,结合数据驱动随机化策略和对抗性运动先验,提升远程操作的稳定性和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14201 2026-02-23 cs.CV cs.AI

GeoEyes: On-Demand Visual Focusing for Evidence-Grounded Understanding of Ultra-High-Resolution Remote Sensing Imagery

GeoEyes: 面向超高清遥感影像证据驱动理解的按需视觉聚焦

Fengxiang Wang, Mingshuo Chen, Yueying Li, Yajie Yang, Yifan Zhang, Long Lan, Xue Yang, Hongda Sun, Yulin Wang, Di Wang, Jun Song, Jing Zhang, Bo Du

机构 * National University of Defense Technology, China(国防科技大学) Beijing University of Posts and Telecommunications, China(北京邮电大学) University of the Chinese Academy of Sciences, China(中国科学院大学) Shanghai Jiao Tong University, China(上海交通大学) Wuhan University, China(武汉大学) Chinese Academy of Science, China(中国科学院) Tsinghua University, China(清华大学) Renmin University of China, China(中国人民大学)

AI总结 GeoEyes通过分阶段训练框架,结合冷启动数据集和代理强化学习方法,解决超高清遥感影像中证据获取不足的问题,提升视觉问答任务的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02437 2026-02-23 cs.CV cs.AI

UniReason 1.0: A Unified Reasoning Framework for World Knowledge Aligned Image Generation and Editing

UniReason 1.0: 一个统一的推理框架,用于世界知识对齐的图像生成与编辑

Dianyi Wang, Chaofan Ma, Feng Han, Size Wu, Wei Song, Yibin Wang, Zhixiong Zhang, Tianhang Wang, Siyuan Wang, Zhongyu Wei, Jiaqi Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) University of Southern California(美国南加州大学)

AI总结 UniReason 1.0通过统一推理框架整合图像生成与编辑,利用世界知识增强文本推理和视觉优化,提升复杂合成任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20674 2026-02-23 cs.CL cs.AI

PonderLM: Pretraining Language Models to Ponder in Continuous Space

PonderLM:在连续空间中预训练语言模型以进行思考

Boyi Zeng, Shixiang Song, Siyuan Huang, Yixuan Wang, He Li, Ziwei He, Xinbing Wang, Zhiyu Li, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) Shanghai Jiao Tong University(上海交通大学) Institute for Advanced Algorithms Research Shanghai(上海高级算法研究所) Shanghai Innovation Institute(上海创新研究院)

AI总结 PonderLM通过在连续空间中引入思考过程,提升语言模型的认知处理能力,实验表明其在多个基准测试中优于现有模型。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17473 2026-02-20 cs.CV

4D Monocular Surgical Reconstruction under Arbitrary Camera Motions

在任意摄像机运动下进行4D单目手术重建

Jiwei Shan, Zeyu Cai, Cheng-Tai Hsieh, Yirui Li, Hao Liu, Lijun Han, Hesheng Wang, Shing Shin Cheng

机构 * Department of Mechanical and Automation Engineering(机械与自动化工程系) T Stone Robotics Institute, The Chinese University of Hong Kong, Hong Kong(T Stone机器人研究院,香港中文大学,香港) Shenyang Institute of Automation, Chinese Academy of Sciences, Shenyang, China(沈阳自动化研究所,中国科学院,沈阳,中国) State Key Laboratory of Robotics and Intelligent Systems, Shenyang, China(机器人与智能系统国家重点实验室,中国,沈阳) School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai, China(集成电路学院,上海交通大学,中国,上海) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, China(自动化与智能感知学院,上海交通大学,中国,上海) Key Laboratory of System Control and Information Processing, Ministry of Education of China, Shanghai, China(系统控制与信息处理重点实验室,中国教育部,中国,上海)

AI总结 本文提出Local-EndoGS框架,通过局部可变形场景模型和多视图几何优化,实现任意摄像机运动下的高质量4D单目手术重建。

Comments Due to the limitation "The abstract field cannot be longer than 1,920 characters", the abstract here is shorter than that in the PDF file Subjects

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17182 2026-02-20 cs.CV cs.RO

NRGS-SLAM: Monocular Non-Rigid SLAM for Endoscopy via Deformation-Aware 3D Gaussian Splatting

NRGS-SLAM:通过变形感知的3D高斯点云实现内窥镜单目非刚性SLAM

Jiwei Shan, Zeyu Cai, Yirui Li, Yongbo Chen, Lijun Han, Yun-hui Liu, Hesheng Wang, Shing Shin Cheng

机构 * Department of Mechanical and Automation Engineering and T Stone Robotics Institute, The Chinese University of Hong Kong(机械与自动化工程系和T Stone机器人研究所,香港中文大学) School of Automation and Intelligent Sensing, the State Key Laboratory of Avionics Integration and Aviation System of-Systems Synthesis, and Shanghai Key Laboratory of Navigation and Location Based Services, Shanghai Jiao Tong University(自动化与智能感知学院、航空系统集成与航空系统综合国家重点实验室、上海导航与定位服务重点实验室,上海交通大学)

AI总结 NRGS-SLAM通过变形感知的3D高斯点云实现内窥镜单目非刚性SLAM,有效解决刚性假设与变形耦合问题,提升定位精度与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16742 2026-02-20 cs.LG cs.AI

DeepVision-103K: A Visually Diverse, Broad-Coverage, and Verifiable Mathematical Dataset for Multimodal Reasoning

DeepVision-103K: 一种视觉多样、覆盖面广且可验证的数学数据集,用于多模态推理

Haoxiang Sun, Lizhen Xu, Bing Zhao, Wotao Yin, Wei Wang, Boyu Yang, Rui Wang, Hu Wei

机构 * Alibaba Group(阿里巴巴集团) Shanghai Jiao Tong University(上海交通大学)

AI总结 DeepVision-103K是一个用于多模态推理的视觉多样、覆盖面广且可验证的数学数据集,通过增强模型的视觉反思和推理能力推动多模态推理发展。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15901 2026-02-19 cs.RO

Coverage Path Planning for Autonomous Sailboats in Inhomogeneous and Time-Varying Oceans: A Spatiotemporal Optimization Approach

自主帆船在非均匀和时变海洋中的覆盖路径规划:一种时空优化方法

Yang An, Zhikang Ge, Taiyu Zhang, Jean-Baptiste R. G. Souppez, Gaofei Xu, Zhengru Ren

机构 * Institute of Deep-sea Science and Engineering, Chinese Academy of Sciences(中国科学院深海科学与工程研究所) Institute for Ocean Engineering, Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院海洋工程研究所) ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学 Hangzhou 全球科技创新中心) Department of Engineering, Faculty of Computing, Engineering and the Built Environment, Birmingham City University(伯明翰城市大学工程系) School of Ocean and Civil Engineering, Shanghai Jiao Tong University(上海交通大学海洋与Civil Engineering学院)

AI总结 本文提出了一种专为自主帆船设计的时空优化方法,解决非均匀和时变海洋环境中的覆盖路径规划问题,通过空间拓扑约束和时间预测规划提升覆盖效率。

Comments 12 pages, 9 figures. This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07101 2026-02-19 cs.CV cs.RO

Zero-Shot UAV Navigation in Forests via Relightable 3D Gaussian Splatting

通过可重照明的3D高斯点散布实现森林中的零样本无人机导航

Zinan Lv, Yeqian Qian, Chen Sang, Hao Liu, Danping Zou, Ming Yang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学)

AI总结 本文提出一种基于可重照明3D高斯点散布的端到端强化学习框架,实现无人机在复杂森林环境中的零样本导航,具备对光照变化的强鲁棒性。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17047 2026-02-19 cs.LG cs.CR

Navigating the Deep: End-to-End Extraction on Deep Neural Networks

深入神经网络:端到端提取

Haolin Liu, Adrien Siproudhis, Samuel Experton, Peter Lorenz, Christina Boura, Thomas Peyrin

机构 * Shanghai Jiao Tong University, China(上海交通大学) Nanyang Technological University, Singapore(南洋理工大学) IRIF, Université Paris Cité, France(IRIF,巴黎cité大学,法国) Institut universitaire de France (IUF), Paris, France(法国国家科学院(IUF),巴黎,法国)

AI总结 本文提出了一种端到端的神经网络模型提取方法,通过改进签名提取和符号提取过程,实现了多项式时间复杂度的深度网络提取。

Comments 42 pages, published at EUROCRYPT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15733 2026-02-18 cs.RO cs.AI

MeshMimic: Geometry-Aware Humanoid Motion Learning through 3D Scene Reconstruction

MeshMimic: 通过3D场景重建实现几何感知的人形运动学习

Qiang Zhang, Jiahao Ma, Peiran Liu, Shuai Shi, Zeran Su, Zifan Wang, Jingkai Sun, Wei Cui, Jialin Yu, Gang Han, Wen Zhao, Pihai Sun, Kangning Yin, Jiaxu Wang, Jiahang Cao, Lingfeng Zhang, Hao Cheng, Xiaoshuai Hao, Yiding Ji, Junwei Liang, Jian Tang, Renjing Xu, Yijie Guo

机构 * X-Humanoid The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The University of Hong Kong(香港大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) The Australian National University(澳大利亚国立大学)

AI总结 MeshMimic通过3D场景重建实现人形机器人学习与地形耦合的运动交互,利用消费级传感器低成本训练复杂物理交互。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15539 2026-02-18 cs.CV cs.AI cs.SC

Dynamic Training-Free Fusion of Subject and Style LoRAs

动态免训练 主体与风格LoRA融合

Qinglong Cao, Yuntian Chen, Chao Ma, Xiaokang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Eastern Institute of Technology(技术东院)

AI总结 本文提出一种动态免训练的LoRA融合框架,通过特征级选择和度量引导的潜在调整实现主体与风格的动态合成,无需重新训练即可提升生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07812 2026-02-18 cs.CL

LLMs Know More About Numbers than They Can Say

LLMs对数字了解得比他们能说的更多

Fengting Yuchi, Li Du, Jason Eisner

机构 * Shanghai Jiao Tong University(上海交通大学) Johns Hopkins University(约翰霍普金斯大学)

AI总结 研究发现LLM对数字大小的内部表示影响其数值推理能力,通过隐藏状态探测和微调提升准确性。

Comments EACL 2026 (Oral), camera-ready version with GitHub link

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15061 2026-02-18 cs.RO cs.AI

Safe-SDL:Establishing Safety Boundaries and Control Mechanisms for AI-Driven Self-Driving Laboratories

Safe-SDL:建立AI驱动自主实验室的安全边界与控制机制

Zihan Zhang, Haohui Que, Junhan Chang, Xin Zhang, Hao Wei, Tong Zhu

机构 * Shanghai Innovation Institute(上海创新研究院) Nankai University(南开大学) East China Normal University(华东师范大学) AI for Science Institute, Beijing(北京人工智能科学研究院) Peking University(北京大学) DP Technology(DP技术公司) Shanghai Jiao Tong University(上海交通大学) National Key Laboratory of Advanced Micro and Nano Manufacture Technology, School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学国家先进微纳米制造技术重点实验室,集成电路学院,上海200240,中国)

AI总结 Safe-SDL通过建立安全边界和控制机制,解决AI驱动自主实验室中的语法到安全间隙问题,确保实验系统的安全性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11661 2026-02-18 cs.AI

SR-Scientist: Scientific Equation Discovery With Agentic AI

SR-Scientist:基于代理AI的科学方程发现

Shijie Xia, Yuhan Sun, Pengfei Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) GAIR

AI总结 SR-Scientist通过代理AI实现科学方程发现,具备自主编写代码、分析数据、优化方程的能力,实验表明其在多个科学领域表现优异。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14699 2026-02-17 cs.DB cs.AI cs.AR

Qute: Towards Quantum-Native Database

Qute:迈向量子原生数据库

Muzhi Chen, Xuanhe Zhou, Wei Zhou, Bangrui Xu, Surui Tang, Guoliang Li, Bingsheng He, Yeye He, Yitong Song, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学) Microsoft Corporation(微软公司) Hong Kong Baptist University(香港 Baptist 大学)

AI总结 Qute提出了一种量子原生数据库系统,通过编译扩展SQL、混合优化器、选择性量子索引和保真存储,实现量子计算与经典计算的融合,并在真实量子处理器上展示了其优越性。

Comments Please refer our open-source prototype at: https://github.com/weAIDB/Qute

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11858 2026-02-17 cs.CV cs.AI cs.CL cs.LG

Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

无需缩放:用于细粒度多模态感知的区域到图像蒸馏

Lai Wei, Liangbo He, Jun Lan, Lingzhong Dong, Yutong Cai, Siyuan Li, Huijia Zhu, Weiqiang Wang, Linghe Kong, Yue Wang, Zhuosheng Zhang, Weiran Huang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Zhongguancun Academy(中关村学院) Shanghai Innovation Institute(上海创新研究院)

AI总结 本文提出区域到图像蒸馏方法,通过训练时间内化代理缩放能力,提升细粒度多模态感知性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10551 2026-02-17 cs.CV cs.AI

C^2ROPE: Causal Continuous Rotary Positional Encoding for 3D Large Multimodal-Models Reasoning

C^2ROPE: 3D 大多模态模型推理中的因果连续旋转位置编码

Guanting Ye, Qiyan Zhao, Wenhao Yu, Xiaofeng Zhang, Jianmin Ji, Yanyong Zhang, Ka-Veng Yuen

机构 * State Key Laboratory of Internet of Things for Smart City, University of Macau(物联网智能城市国家重点实验室,澳门大学) Department of Automation, Shanghai Jiaotong University(上海交通大学自动化系) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) School of Computer Science and Technology, USTC(中国科学技术大学计算机科学与技术学院) School of Artificial Intelligence and Data Science, USTC(中国科学技术大学人工智能与数据科学学院)

AI总结 C^2ROPE通过引入空间-时间连续位置编码和切比雪夫因果掩码,解决3D多模态模型中视觉特征连续性和因果关系建模问题。

Comments Accepted in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏