arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-07-01 至 2026-07-01 共收录 14
2606.30560 2026-07-01 cs.LG cs.AI cs.PF 版本更新

TraceLab: Characterizing Coding Agent Workloads for LLM Serving

TraceLab: 表征用于LLM服务的编码代理工作负载

Kan Zhu, Mathew Jacob, Chenxi Ma, Yi Pan, Stephanie Wang, Arvind Krishnamurthy, Baris Kasikci

机构 * University of Washington(华盛顿大学) Wuhan University of Technology(武汉理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 通过收集4300个编码代理会话(含35万LLM步骤和43万工具调用)的真实轨迹,分析发现长自主循环、长上下文短输出、多样化重尾工具调用及高但不完美前缀缓存命中率等特征,为优化服务提供具体方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29575 2026-07-01 cs.SD cs.AI 版本更新

TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation

TF-MoE:用于高效语音分离的时频混合专家

Qinzhe Hu, Chenda Li, Wangyou Zhang, Shujie Liu, Yan Lu, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab Shanghai Jiao Tong University(上海交通大学听觉认知与计算声学实验室) Microsoft Research Asia(微软亚洲研究院)

AI总结 提出TF-MoE框架,通过时频维度的稀疏混合专家动态选择专家,在几乎不增加推理成本下提升模型容量,在低计算量下实现优于BSRNN的语音分离性能。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29215 2026-07-01 cs.LG cs.CL 版本更新

Multi-Block Diffusion Language Models

多块扩散语言模型

Yijie Jin, Jiajun Xu, Yuxuan Liu, Chenkai Xu, Yi Tu, Jiajun Li, Dandan Tu, Xiaohui Yan, Kai Yu, Pengfei Liu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Xi’an Jiao Tong University(西安交通大学) Huawei(华为)

AI总结 提出多块教师强制(MultiTF)训练策略,将单块扩散语言模型扩展为多块扩散(MultiBD),通过块缓冲机制实现并行解码,提升令牌吞吐量和准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21355 2026-07-01 cs.RO 版本更新

RPG: Robust Policy Gating for Smooth Multi-Skill Transitions in Humanoid Fighting

RPG: 为人类oid战斗中平滑多技能过渡的鲁棒策略门控

Yucheng Xin, Jiacheng Bao, Yubo Dong, Xueqian Wang, Bin Zhao, Xuelong Li, Junbo Tan, Dong Wang

机构 * Center for Artificial Intelligence and Robotics, Shenzhen International Graduate School, Tsinghua University(人工智能与机器人中心,深圳国际研究生院,清华大学) Shanghai AI Laboratory(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出RPG框架,通过动作过渡随机化和时间随机化训练统一策略,实现人类oid多技能平滑稳定过渡,并设计控制管道整合步行/跑步与战斗技能,实验证明其有效性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26266 2026-07-01 cs.AI cs.CV 版本更新

GUIDE: Resolving Domain Bias in GUI Agents through Real-Time Web Video Retrieval and Plug-and-Play Annotation

GUIDE:通过实时网络视频检索和即插即用标注解决GUI代理的领域偏见

Rui Xie, Zhi Gao, Chenrui Shi, Zirui Shang, Lu Chen, Qing Li

机构 * Shanghai Jiao Tong University(上海交通大学) State Key Laboratory for General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,北京通用人工智能研究院) Beijing Institute of Technology(北京理工大学)

AI总结 GUIDE通过实时网络视频检索和即插即用标注框架,解决GUI代理的领域偏见问题,通过视频语义分析和自动化标注流程提升代理对特定应用的操作流程和UI布局的理解,实验表明其在多代理系统和单模型代理中均能提升性能。

Comments Accepted to ECCV 2026. 30 pages: 15-page main paper followed by supplementary material as an appendix (Sections A-F). Project page: https://sharryXR.github.io/GUIDE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25399 2026-07-01 cs.CV cs.RO 版本更新

LaMP: Learning Vision-Language-Action Policy with 3D Scene Flow as Latent Motion Prior

LaMP: 以3D场景流作为潜在运动先验的视觉-语言-动作策略学习

Xinkai Wang, Chenyi Wang, Yifu Xu, Mingzhe Ye, Fucheng Zhang, Jialin Tian, Xinyu Zhan, Lifeng Zhu, Cewu Lu, Lixin Yang

机构 * Southeast University(东南大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 提出LaMP框架,通过门控融合将3D场景流作为潜在运动先验,对齐运动专家与动作专家,提升VLA策略在复杂空间交互中的鲁棒性,在LIBERO等基准上取得最高平均成功率。

Comments Accepted to ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16424 2026-07-01 cs.RO cs.NA cs.SY eess.SY math.NA 版本更新

Early-Terminable Energy-Safe Iterative Coupling for Parallel Simulation of Partitioned Port-Hamiltonian Systems

用于分区端口-哈密顿系统并行仿真的早期可终止节能迭代耦合

Qi Wei, Jianfeng Tao, Hongyu Nie, Wangtao Tan

机构 * School of Mechanical Engineering, Shanghai Jiao Tong University(上海交通大学机械与动力工程学院)

AI总结 针对并行仿真中分区耦合可能注入虚假能量的问题,提出基于Douglas-Rachford分裂的早期可终止节能耦合接口,利用Fejér单调性提供算法耗散,保证离散无源性并收敛到整体离散化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24421 2026-07-01 cs.CV 版本更新

Proxy-GS: Unified Occlusion Priors for Training and Inference in Structured 3D Gaussian Splatting

Proxy-GS:结构化3D高斯泼溅中训练与推理的统一遮挡先验

Yuanyuan Gao, Yuning Gong, Yifei Liu, Li Jingfeng, Dingwen Zhang, Yanci Zhang, Dan Xu, Xiao Sun, Zhihang Zhong

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Sichuan University(四川大学) Hong Kong University of Science and Technology(香港科技大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 提出Proxy-GS,利用快速代理系统生成精确遮挡深度图,在训练中引导表面致密化、在推理中剔除冗余高斯体,实现2.5倍以上加速并提升渲染质量。

Comments Project page: https://visionary-laboratory.github.io/Proxy-GS

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14171 2026-07-01 cs.AI 版本更新

Paper2Rebuttal: A Multi-Agent Framework for Transparent Author Response Assistance

Paper2Rebuttal: 一种透明的作者回复辅助多智能体框架

Qianli Ma, Chang Guo, Zhiheng Tian, Siyu Wang, Jipeng Xiao, Yuanhao Yue, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab)

AI总结 提出多智能体框架RebuttalAgent,将回复生成重构为以证据为中心的规划任务,通过分解反馈、构建混合上下文和外部搜索模块,提升覆盖度、忠实性和策略连贯性。

Comments Accepted by ACL2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08187 2026-07-01 cs.AI 版本更新

Improving LLM Reasoning with Homophily-aware Structural and Semantic Text-Attributed Graph Compression

利用同质性感知的结构和语义文本属性图压缩提升LLM推理能力

Zijun Di, Bin Lu, Huquan Kang, Luoyi Fu, Jiaxin Ding, Xiaoying Gan, Lei Zhou, Xinbing Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 提出HS2C框架,通过结构熵最小化进行全局层次划分以识别同质社区,并利用检测到的结构同质性指导LLM进行差异化语义聚合,在10个节点级和7个图级基准上同时提升压缩率和推理精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24561 2026-07-01 cs.CV 版本更新

RGBT-GroundBench: Visual Grounding Beyond RGB in Complex Real-World Scenarios

RGBT-GroundBench: 超越RGB的复杂真实世界场景中的视觉定位

Tianyi Zhao, Jiawen Xi, Linhui Xiao, Junnan Li, Xue Yang, Maoxun Yuan, Xingxing Wei

机构 * Institute of Artificial Intelligence, State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学人工智能研究院、虚拟现实技术与系统国家重点实验室) Pengcheng Laboratory(鹏城实验室) Shanghai Jiao Tong University(上海交通大学)

AI总结 提出首个大规模RGB-热红外视觉定位基准RGBT-GroundBench,包含4万+图像和3级细粒度标注,统一评估协议支持RGB/热红外/融合输入,揭示低照度下性能显著下降,并引入参考基线RGBT-VGNet。

Comments 40pages, 9figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02187 2026-07-01 cs.RO cs.CV 版本更新

Registering the 4D Millimeter Wave Radar Point Clouds Via Generalized Method of Moments

通过广义矩方法配准4D毫米波雷达点云

Xingyi Li, Han Zhang, Ziliang Wang, Yukai Yang, Weidong Chen

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Institute of Medical Robotics, Shanghai Jiao Tong University(上海交通大学医疗机器人研究院) Department of Statistics, Uppsala University(乌普萨拉大学统计系)

AI总结 针对4D雷达点云稀疏噪声导致配准困难的问题,提出基于广义矩方法的配准框架,无需显式点对应,在合成与真实数据集上精度和鲁棒性优于基准方法,甚至接近激光雷达方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19600 2026-07-01 cs.SE cs.AI cs.CL 版本更新

Human-Agent Collaborative Paper-to-Page Crafting

人机协作的论文到网页制作

Qianli Ma, Siyu Wang, Yilin Chen, Yinhao Tang, Yixiang Yang, Chang Guo, Bingjie Gao, Zhening Xing, Yanan Sun, Zhipeng Zhang

机构 * AutoLab, SAI, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab实验室) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 提出AutoPage多智能体系统,通过粗到细的流水线将论文转化为交互式网页,并引入Checker智能体验证和人工检查点,在15分钟内以低于0.1美元的成本生成高质量网页。

Comments Accepted by ACL2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12878 2026-07-01 cs.CV 版本更新

Few to Big: Prototype Expansion Network via Diffusion Learner for Point Cloud Few-shot Semantic Segmentation

从少到多:基于扩散学习器的原型扩展网络用于点云小样本语义分割

Qianguang Zhao, Dongli Wang, Yan Zhou, Jianxun Li, Richard Irampa

机构 * School of Mathematics and Computational Science, Xiangtan University(湘潭大学数学与计算科学学院) School of Automation and Electronics Information, Xiangtan University(湘潭大学自动化与电子信息学院) School of Automation, Shanghai Jiao Tong University(上海交通大学自动化学院)

AI总结 针对小样本点云语义分割中原型容量小且与查询空间不对齐的问题,提出原型扩展网络(PENet),利用扩散模型的预训练条件编码器扩展原型,并通过推-拉机制对齐,在S3DIS和ScanNet数据集上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏