arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3167
2604.02779 2026-04-08 cs.RO

Vision-Based End-to-End Learning for UAV Traversal of Irregular Gaps via Differentiable Simulation

基于视觉的端到端学习:通过可微模拟实现无人机穿越不规则缝隙

Linzuo Zhang, Yu Hu, Feng Yu, Yang Deng, Wenxian Yu, Danping Zou

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出一种纯视觉端到端框架,通过可微模拟实现无人机在未知环境中穿越复杂不规则缝隙,采用SE(3)空间、停止梯度操作和双模初始化分布提升稳定性,结合辅助预测模块增强导航连续性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05522 2026-04-08 cs.CL

Cross-Modal Coreference Alignment: Enabling Reliable Information Transfer in Omni-LLMs

跨模态指代对齐:在全模态大语言模型中实现可靠信息传输

Hongcheng Liu, Yuhao Wang, Zhe Chen, Pingjie Wang, Zhiyuan Zhu, Yixuan Hou, Yanfeng Wang, Yu Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 研究提出跨模态指代对齐问题,通过CrossOmni数据集和两种方法提升全模态推理能力,揭示指代意识缺失是跨模态推理弱化的主要原因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05502 2026-04-08 cs.CR cs.LG

AttnDiff: Attention-based Differential Fingerprinting for Large Language Models

AttnDiff:基于注意力的差分指纹法用于大语言模型

Haobo Zhang, Zhenhua Xu, Junxian Li, Shangfeng Sheng, Dezhang Kong, Meng Han

机构 * Zhejiang University of Technology(浙江工业大学) Zhejiang University(浙江大学) Binjiang Institute of Zhejiang University(浙江大学滨江研究院) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出AttnDiff,一种高效白盒框架,通过内在信息路由行为提取模型指纹,用于验证大语言模型的衍生关系,实现高相似度区分相关衍生模型与无关模型家族。

Comments Accepted at ACL2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05484 2026-04-08 cs.RO cs.CV

CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment

CoEnv:通过组合环境驱动具身体验多智能体协作

Li Kang, Yutao Fan, Rui Li, Heng Zhou, Yiran Qin, Zhemeng Zhang, Songtao Huang, Xiufeng Song, Zaibin Zhang, Bruno N. Y. Chen, Zhenfei Yin, Dongzhan Zhou, Wangmeng Zuo, Lei Bai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学) CUHK-Shenzhen(香港中文大学(深圳)) Fudan University(复旦大学) Dalian University of Technology(大连理工大学) Carnegie Mellon University(卡内基梅隆大学) University of Oxford(牛津大学)

AI总结 本文提出CoEnv框架,通过模拟与现实结合的组合环境,实现多智能体协作的高效执行与安全部署,提升任务成功率和效率。

Comments 31 pages, 8 figures, including supplementary material. Project page: https://faceong.github.io/CoEnv/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11680 2026-04-08 cs.CV

UCAN: Unified Convolutional Attention Network for Expansive Receptive Fields in Lightweight Super-Resolution

UCAN:统一的卷积注意力网络用于轻量超分辨率中的扩展感受野

Cao Thien Tan, Phan Thi Thu Trang, Do Nghiem Duc, Ho Ngoc Anh, Hanyang Zhuang, Nguyen Duc Dung

机构 * Ho Chi Minh City Open University(胡志明市开放大学) AI Tech Lab, Ho Chi Minh City University of Technology(胡志明市科技大学人工智能技术实验室) Code Mely AI Research Team(Code Mely 人工智能研究团队) Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Ha Noi University of Science and Technology(河内科技大学) University of Manitoba(曼尼托巴大学)

AI总结 UCAN通过融合卷积与注意力机制,有效扩展感受野,采用Hedgehog注意力和蒸馏模块实现高效轻量化,适用于资源受限设备的超分辨率恢复。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10610 2026-04-08 cs.CR cs.AI

LaSM: Layer-wise Scaling Mechanism for Defending Pop-up Attack on GUI Agents

LaSM:用于防御GUI代理中弹出攻击的分层缩放机制

Zihe Yan, Jiaping Gui, Zhuosheng Zhang, Gongshen Liu

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出LaSM机制,通过分层放大关键层的注意力和MLP模块,提升模型对任务相关区域的对齐性,有效防御弹出攻击,同时不影响模型整体能力。

Comments Accepted by CVPR-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04857 2026-04-07 cs.CV

The Blind Spot of Adaptation: Quantifying and Mitigating Forgetting in Fine-tuned Driving Models

适应的盲区:量化和缓解在微调驾驶模型中的遗忘

Runhao Mao, Hanshi Wang, Yixiang Yang, Qianli Ma, Jingmeng Zhou, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab实验室)

AI总结 本文首次系统研究驾驶模型中灾难性遗忘问题,提出Drive Expert Adapter框架,通过提示空间适应提升驾驶性能并保留通用能力。

Comments received by cvpr2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04843 2026-04-07 cs.CV cs.AI

InfBaGel: Human-Object-Scene Interaction Generation with Dynamic Perception and Iterative Refinement

InfBaGel: 基于动态感知和迭代细化的人-物体-场景交互生成

Yude Zou, Junji Gong, Xing Gao, Zixuan Li, Tianxing Chen, Guanjie Zheng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Sichuan University(四川大学) Shenzhen University(深圳大学) The University of Hong Kong(香港大学)

AI总结 本文提出一种粗到细的指令条件交互生成框架,结合一致性模型的迭代去噪过程,通过动态感知策略和 bump-aware 指导减少物理伪影,提升 HOSI 和 HOI 生成性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04170 2026-04-07 cs.CV cs.AI

Incomplete Multi-View Multi-Label Classification via Shared Codebook and Fused-Teacher Self-Distillation

不完整多视图多标签分类 via 共享代码本和融合教师自蒸馏

Xu Yan, Jun Yin, Shiliang Sun, Minghua Wan

机构 * College of Information Engineering, Shanghai Maritime University(上海海事大学信息工程学院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

AI总结 本文提出一种结构化机制,通过多视图共享代码本和跨视图重建学习一致表示,并设计权重估计方法和融合教师自蒸馏框架,以提升缺失标签条件下的模型泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17541 2026-04-07 cs.CV

FLEG: Feed-Forward Language Embedded Gaussian Splatting from Any Views via Compact Semantic Representation

FLEG:通过紧凑语义表示从任意视角进行前馈语言嵌入高斯散射

Qijian Tian, Xin Tan, Jiayu Ying, Xuhong Wang, Yuan Xie, Lizhuang Ma

机构 * Shanghai Jiao Tong University(上海交通大学) East China Normal University(华东师范大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 FLEG通过几何-语义双分支蒸馏框架,实现从任意多视角图像灵活重建语言嵌入3D高斯,减少语义冗余并提升存储效率。

Comments Project page: https://fangzhou2000.github.io/projects/fleg

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06448 2026-04-07 cs.MA cs.AI cs.CL cs.SI

When AI Agents Collude Online: Financial Fraud Risks by Collaborative LLM Agents on Social Platforms

当AI代理在线合谋:社交平台上基于协作LLM代理的金融欺诈风险

Qibing Ren, Zhijie Zheng, Jiaxuan Guo, Junchi Yan, Lizhuang Ma, Jing Shao

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学)

AI总结 研究大型多代理系统中集体金融欺诈的风险,通过MultiAgentFraudBench基准测试分析欺诈行为协作机制及影响因素,提出内容警告、LLM监控和群体韧性提升等缓解策略。

Comments ICLR 2026, Code is available at https://github.com/zheng977/MutiAgent4Fraud

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14202 2026-04-07 cs.LG

MSDformer: Multi-scale Discrete Transformer For Time Series Generation

MSDformer:多尺度离散Transformer用于时间序列生成

Shibo Feng, Zhicheng Chen, Xi Xiao, Zhong Zhang, Qing Li, Xingyu Gao, Peilin Zhao

机构 * Nanyang Technological University(南洋理工大学) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Tencent(腾讯) Peng Cheng Laboratory(鹏城实验室) Institute of Microelectronics, Chinese Academy of Sciences(中国科学院微电子研究所) University of Chinese Academy of Sciences(中国科学院大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 MSDformer通过多尺度离散Transformer方法,解决传统DTM在捕捉复杂时间序列多尺度特征和理论指导方面的不足,提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04060 2026-04-07 cs.CR cs.AI

CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks

CoopGuard:基于协作代理的有状态多轮防御框架用于抵御LLM的演变攻击

Siyuan Li, Zehao Liu, Xi Lin, Qinghua Mao, Yuliang Chen, Haoyu Li, Jun Wu, Jianhua Li, Xiu Su

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) Department of Computer Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学系) Big Data Institute, Central South University(中南大学大数据研究院)

AI总结 本文提出CoopGuard,通过协作代理维护和更新内部防御状态,有效应对多轮演变攻击。实验显示其在攻击成功率、欺骗率和攻击效率上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03748 2026-04-07 cs.GR cs.CV

Real-time Neural Six-way Lightmaps

实时神经六方向光图

Wei Li, Hanxiao Sun, Tao Huang, Haoxiang Wang, Tongtong Wang, Zherong Pan, Kui Wu

机构 * Shanghai Jiao Tong University(上海交通大学) LIGHTSPEED Tsinghua University(清华大学)

AI总结 本文提出神经六方向光图方法,通过生成指导图和训练神经网络,实现动态与视觉真实性的平衡,支持实时交互和烟雾效果渲染。

Comments 11 Pages, 16 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03693 2026-04-07 cs.CV

ResGuard: Enhancing Robustness Against Known Original Attacks in Deep Watermarking

ResGuard: 提高深度水印在已知原始攻击下的鲁棒性

Hanyi Wang, Han Fang, Yupeng Qiu, Shilin Wang, Ee-Chien Chang

机构 * Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出ResGuard模块,通过增强图像依赖性来提升对已知原始攻击的鲁棒性,使水印提取准确率从59.87%提升至99.81%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03660 2026-04-07 cs.AI

TableVision: A Large-Scale Benchmark for Spatially Grounded Reasoning over Complex Hierarchical Tables

TableVision:一种大规模基准,用于复杂分层表格上的空间感知推理

Xiaoyu Chen, Lu Dai, Hanqing Wang, Zhuoyu Li, Wenbin Dai, Yanzong Zheng, Zhenggang Xia, Junyong Lin, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出TableVision基准,通过量化分析发现复杂表格推理中的感知瓶颈,引入轨迹感知的分层任务分类,结合确定性接地流程生成6799条高保真推理轨迹,提升多模态大语言模型的空间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03558 2026-04-07 cs.CV

LOGER: Local--Global Ensemble for Robust Deepfake Detection in the Wild

LOGER:用于野外鲁棒深度伪造检测的局部-全局集成

Fei Wu, Dagong Lu, Mufeng Yao, Xinlei Xu, Fengjun Guo

机构 * Shanghai Jiao Tong University(上海交通大学) INTSIG Information(INTSIG信息)

AI总结 LOGER通过局部-全局集成框架提升深度伪造检测鲁棒性,利用多尺度视觉基础模型捕捉全局异常,结合多实例学习策略提取局部伪造痕迹,有效应对真实世界退化。

Comments 2nd place (out of 94 teams) in the NTIRE 2026 Robust Deepfake Detection Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03555 2026-04-07 cs.CV

HEDGE: Heterogeneous Ensemble for Detection of AI-GEnerated Images in the Wild

HEDGE:异构集成用于野外AI生成图像检测

Fei Wu, Dagong Lu, Mufeng Yao, Xinlei Xu, Fengjun Guo

机构 * Shanghai Jiao Tong University(上海交通大学) INTSIG Information(INTSIG信息)

AI总结 本文提出HEDGE,通过异构集成方法提升野外AI生成图像检测的鲁棒性,采用多轴互补检测路线,包括多样化训练数据、多尺度特征提取和骨干网络异构性,实现高精度检测。

Comments 4th place (out of 193 teams) in the NTIRE 2026 Robust AI-Generated Image Detection in the Wild Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03302 2026-04-07 cs.CV cs.AI

Beyond Static Vision: Scene Dynamic Field Unlocks Intuitive Physics Understanding in Multi-modal Large Language Models

超越静态视觉:场景动态场解锁多模态大语言模型中的直观物理理解

Nanxi Li, Xiang Wang, Yuanjie Chen, Haode Zhang, Hong Li, Yong-Lu Li

机构 * Shanghai Jiao Tong University(上海交通大学) Tianjin University(天津大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 研究探讨多模态大语言模型在物理理解上的不足,提出Scene Dynamic Field方法提升对连续物体动态的理解能力,实现20.7%的改进并展现良好的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09378 2026-04-07 cs.LG

Personalized Federated Distillation Assisted Vehicle Edge Caching Strategy

个性化联邦蒸馏辅助车辆边缘缓存策略

Xun Li, Qiong Wu, Pingyi Fan, Kezhi Wang, Wen Chen, Cui Zhang

机构 * School of Internet of Things Engineering, Jiangnan University(江南大学物联网工程学院) Department of Electronic Engineering, State Key laboratory of Space Network and Communications, Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学电子工程系、空间网络与通信国家重点实验室、北京信息科学与技术国家研究中心) Department of Computer Science, Brunel University(布鲁内尔大学计算机科学系) Department of Electronic Engineering, Shanghai JiaoTong University(上海交通大学电子工程系) School of Internet of Things Engineering, Wuxi Institute of Technology(无锡职业技术学院物联网工程学院)

AI总结 本文提出一种个性化联邦蒸馏辅助车辆边缘缓存策略,以解决传统联邦学习在通信开销和训练稳定性方面的不足,通过预测用户兴趣内容来减少延迟。

Comments This paper has been accepted by IEEE International Conference on Radio Frequency and Antenna Technologies. The source code has been released at: https://github.com/qiongwu86/Federated-Distillation-Assisted-Vehicle-Edge-Caching-Scheme-Based-on-Lightweight-DDPM

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08751 2026-04-07 cs.CV cs.LG

Disentangled World Models: Learning to Transfer Semantic Knowledge from Distracting Videos for Reinforcement Learning

解耦世界模型:从干扰视频中学习转移语义知识以用于强化学习

Qi Wang, Zhipeng Zhang, Baao Xie, Xin Jin, Yunbo Wang, Shiyu Wang, Liaomo Zheng, Xiaokang Yang, Wenjun Zeng

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院教育部人工智能重点实验室) Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo, China(东方理工高等研究院宁波数字孪生研究院) Ningbo Key Laboratory of Spatial Intelligence and Digital Derivative, Ningbo, China(宁波市空间智能与数字衍生重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Shenyang Institute of Computing Technology, Chinese Academy of Sciences(中国科学院沈阳计算技术研究所) Shenyang CASNC Technology Co., Ltd(沈阳中科数控技术股份有限公司)

AI总结 本文提出了解耦世界模型,通过离线到在线的潜在蒸馏和灵活解耦约束,从干扰视频中学习语义知识,提升强化学习的样本效率。

Comments Accepted by ICCV 2025. Project page: https://qiwang067.github.io/diswm

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03144 2026-04-06 cs.AR cs.AI cs.CL

InCoder-32B-Thinking: Industrial Code World Model for Thinking

InCoder-32B-Thinking:工业代码世界模型用于推理

Jian Yang, Wei Zhang, Jiajun Wu, Junhang Cheng, Tuney Zheng, Fanglin Xu, Weicheng Gu, Lin Jing, Yaxin Du, Joseph Li, Yizhi Li, Yan Xing, Chuan Hao, Ran Tao, Ruihao Gong, Aishan Liu, Zhoujun Li, Mingjie Tang, Chenghua Lin, Siheng Chen, Wayne Xin Zhao, Xianglong Liu, Ming Zhou, Bryan Dai, Weifeng Lv

机构 * Beihang University(北京航空航天大学) IQuest Research Shanghai Jiao Tong University(上海交通大学) ELLIS University of Manchester(曼彻斯特大学) Sichuan University(四川大学) Langboat(朗博特)

AI总结 本文提出InCoder-32B-Thinking,通过工业代码世界模型生成推理轨迹,评估显示其在通用和工业基准上均取得领先开源结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03139 2026-04-06 cs.RO

FSUNav: A Cerebrum-Cerebellum Architecture for Fast, Safe, and Universal Zero-Shot Goal-Oriented Navigation

FSUNav: 一种用于快速、安全和通用零样本目标导向导航的脑皮层-小脑架构

Mingao Tan, Yiyang Li, Shanze Wang, Xinming Zhang, Wei Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) College of Information Science and Technology, Eastern Institute of Technology(东方理工学院信息科学与技术学院)

AI总结 本文提出FSUNav架构,通过整合视觉语言模型与小脑-脑皮层模块,实现跨异构平台的零样本目标导航,提升效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03092 2026-04-06 cs.RO

Flash-Mono: Feed-Forward Accelerated Gaussian Splatting Monocular SLAM

Flash-Mono: 基于前馈加速的高斯点云单目SLAM

Zicheng Zhang, Ke Wu, Xiangting Meng, Keyu Liu, Jieru Zhao, Wenchao Ding

机构 * Fudan University(复旦大学) ShanghaiTech University(上海科技大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 Flash-Mono通过前馈预测前端和高效隐藏状态模块,解决了单目高斯点云SLAM在时间效率、几何精度和多视角一致性方面的不足,实现10倍速度提升和高质量渲染。

Journal ref International Conference on Learning Representations, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02795 2026-04-06 cs.CL cs.AI

Rubrics to Tokens: Bridging Response-level Rubrics and Token-level Rewards in Instruction Following Tasks

评分标准到标记:在指令遵循任务中连接响应级评分标准和标记级奖励

Tianze Xu, Yanzhao Zheng, Pengrui Lu, Lyumanshan Ye, Yong Wu, Zhentao Zhang, Yuanqiang Yu, Chao Ma, Jihuai Zhu, Pengfei Liu, Baohua Dong, Hangcheng Zhu, Ruohui Huang, Gang Yu

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) GAIR

AI总结 本文提出RTT框架,通过引入标记级相关性判别器和RTT-GRPO方法,解决响应级奖励稀疏性和模糊性问题,提升指令遵循任务的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02794 2026-04-06 cs.AI

CharTool: Tool-Integrated Visual Reasoning for Chart Understanding

CharTool: 集成工具的视觉推理用于图表理解

Situo Zhang, Yifan Zhang, Zichen Zhu, Da Ma, Lei Pan, Danyang Zhang, Zihan Zhao, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院X-LANCE实验室) Jiangsu Key Lab of Language Computing(江苏省语言计算重点实验室) Suzhou Laboratory(苏州实验室) AISpeech Co., Ltd.(思必驰科技股份有限公司)

AI总结 本文提出CharTool,通过集成工具提升多模态大语言模型对图表的理解能力,通过双重数据管道和代理强化学习,在六个图表基准测试中取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02752 2026-04-06 cs.CV

Differentiable Stroke Planning with Dual Parameterization for Efficient and High-Fidelity Painting Creation

可微笔触规划与双参数化:用于高效且高保真的绘画创建

Jinfan Liu, Wuze Zhang, Zhangli Hu, Zhehan Zhao, Ye Chen, Bingbing Ni

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出双参数化方法,结合离散折线与连续贝塞尔控制点,实现高效且高保真的绘画生成,减少笔触数量并提升布局结构一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02729 2026-04-06 cs.SE cs.AI cs.CL

IndustryCode: A Benchmark for Industry Code Generation

IndustryCode: 一个用于行业代码生成的基准

Puyu Zeng, Zhaoxi Wang, Zhixu Duan, Liang Feng, Shaobo Wang, Cunxiang Wang, Jinghang Wang, Bing Zhao, Hu Wei, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

AI总结 本文提出IndustryCode基准,涵盖125个工业挑战和579个子问题,支持多种编程语言,评估大模型在工业场景中的代码生成能力。

Comments 37 pages, 28 figures, 4 tables. Includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02334 2026-04-06 cs.AI cs.MA

Holos: A Web-Scale LLM-Based Multi-Agent System for the Agentic Web

Holos:一种基于大语言模型的多智能体系统,用于代理网络

Xiaohang Nie, Zihan Guo, Zicai Cui, Jiachi Yang, Zeyi Chen, Leheyi De, Yu Zhang, Junwei Liao, Bo Huang, Yingxuan Yang, Zhi Han, Zimian Peng, Linyao Chen, Wenzheng Tom Tang, Zongkai Liu, Tao Zhou, Botao Amber Hu, Shuyang Tang, Jianghao Lin, Weiwen Liu, Muning Wen, Yuanjian Zhou, Weinan Zhang

机构 * Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学) Sun Yat-sen University(中山大学) University of Oxford(牛津大学) Holos Engineering

AI总结 Holos是一种大规模多智能体系统,旨在解决LLM驱动智能体在扩展、协调和价值分配中的挑战,通过五层架构和内生价值循环,推动代理网络的自组织和持续发展。

Comments 38 pages, 8 figures, and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14617 2026-04-06 cs.RO cs.SE

UniCon: A Unified System for Efficient Robot Learning Transfers

UniCon:一种高效的机器人学习迁移统一系统

Yunfeng Lin, Li Xu, Yong Yu, Jiangmiao Pang, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) AI Laboratory, Chongqing Changan Automobile Co. Ltd.(重庆长安汽车股份有限公司人工智能实验室)

AI总结 UniCon通过标准化状态、控制流程和仪器化,解决了异构机器人间部署学习控制器的挑战,采用模块化数据导向方法实现仿真到现实的无缝迁移,减少代码冗余并提高推理效率。

Comments The article has been accepted by Frontiers of Computer Science (FCS), with the DOI: {10.1007/s11704-026-52064-1}

详情

展开后加载摘要…

URL PDF HTML 收藏