arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-08-19 至 2026-08-19 共收录 12
2608.18063 2026-08-19 cs.CV 新提交

EDITBRIDGE: Towards Faithful and Efficient Ultra-High-Resolution Image Editing

EditBridge:迈向忠实且高效的超高清图像编辑

Jiayi Song, Shijie Huang, Fangtai Wu, Yubo Huang, Zhenxiong Tan, Songhua Liu, Jiaming Liu, Ruihua Huang

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Qwen Business Unit of Alibaba(阿里巴巴通义千问业务部) National University of Singapore(新加坡国立大学)

AI总结 针对现有扩散图像编辑模型无法高效处理超高清图像的问题,提出EditBridge扩散桥框架,通过先验引导的块级稀疏注意力机制实现4K高保真编辑,速度提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18034 2026-08-19 cs.CV 新提交

Deep Academic Survey: Stateful Agentic Closed-Loop Paradigm for Academic Survey Automation

深度学术调查:用于学术调查自动化的有状态智能体闭环范式

Zhikai Xu, Zhucun Xue, Teng Hu, Yabiao Wang, Yong Liu, Jiangning Zhang

机构 * Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 该研究提出DAS框架,通过状态智能体闭环实现学术调查自动化,在DAS-Bench基准测试中,其在引用质量等四维度得分及专家评估中均优于现有系统。

Comments Project page: this https URL (https://zhikaixu24.github.io/projects/DAS/) | Code: this https URL (https://github.com/ZhikaiXu24/DAS) | Data: this https URL (https://huggingface.co/datasets/ZhikaiXu24/DAS-2M)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17995 2026-08-19 cs.CV 新提交

AViTS: Adaptive Spatiotemporal Token Selection for Efficient Dynamic-Resolution Generation

AViTS:用于高效动态分辨率生成的自适应时空令牌选择

Haoran Qin, Zhengan Yan, Shikang Zheng, Xiaobing Tu, Jiacheng Liu, Yuqi Lin, Chang Zou, JinShan Liu, Peiliang Cai, Xiantao Zhang, Jinkui Ren, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) Terminal Intelligent Computing Division, Alibaba Cloud(阿里云终端智能计算事业部) Jilin University(吉林大学) Xi’an Jiaotong University(西安交通大学)

AI总结 该研究针对扩散变换器动态分辨率采样的冗余计算问题,提出AViTS框架,通过时空重要性感知的选择性上采样减少冗余,在FLUX等模型上实现显著加速且与其他优化技术兼容

Comments Accepted to ECCV 2026. 20 pages including appendix. Code: this https URL (https://github.com/QHR69/AViTS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17973 2026-08-19 cs.CV 新提交

LinCa: Accelerating Diffusion Models via Learnable Decomposed Feature Caching

LinCa:基于可学习分解特征缓存的扩散模型加速方法

Jinshan Liu, Haoran Qin, Xiaobing Tu, Jiacheng Liu, Jiahui Hu, Zhengan Yan, Yukun Xie, Kerui Shen, Jinkui Ren, Yuqi Lin, Xiantao Zhang, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shandong University(山东大学) Terminal Intelligent Computing Division, Alibaba Cloud(阿里云终端智能计算事业部) South China University of Technology(华南理工大学) Jilin University(吉林大学)

AI总结 本文提出LinCa框架,通过可学习可逆网络分解缓存特征并差异化预测,仅需少量额外参数即可在5-7倍加速下使扩散模型保持近无损质量,性能优于现有方法。

Comments Accepted to ECCV 2026. 28 pages including appendix. Code: this https URL (https://github.com/QHR69/LinCa)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17911 2026-08-19 cs.CL 新提交

CABLE: Extending the Reach of Memory Retrieval via Complementary Antecedent-Based Linking and Expansion

CABLE:通过基于互补前项的链接与扩展扩展记忆检索的覆盖范围

Zheling Tan, Jin Gao, Dequan Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 CABLE是一种插件式记忆检索增强模块,通过构建互补关联扩展检索覆盖范围,在多个模型和数据集上的系统级评估中提升了证据可及性的LLM评判分数。

Comments Accepted by COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17535 2026-08-19 cs.CV 新提交

GroupForward: Building Referable 3D Scenes via Instance-Grouped Feed-Forward Gaussian Splatting

GroupForward:通过实例分组前馈高斯溅射构建可参考的3D场景

Qijian Tian, Zimeng Wu, Xuhong Wang, Lizhuang Ma, Xin Tan

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院)

AI总结 GroupForward是一种实例分组前馈高斯溅射模型,可从稀疏多视图图像重建3D场景,结合RSRF实现复杂3D参考推理,提升了语义重建与参考推理的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17468 2026-08-19 cs.AI 新提交

SAGE: Self-Evolving Storyboard Skills via Attribution-Guided Rule Evolution

SAGE:基于归因引导规则演化的自演进分镜脚本技能

Maolin Ran, Xiaoyang Lu, Jiaqi Liu, Jian Wang, Weiwen Liu, Jianghao Lin, Yong Yu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) CreativeFitting(创意拟合)

AI总结 针对分镜脚本制作的工业瓶颈,提出SAGE框架,通过归因引导规则演化实现导演知识的自演进,在测试中表现接近专业导演,部署后大幅提升制作效率,还发布了首个相关公开数据集PROSE

Comments 11 pages, 9 figures, 4 tables. Dataset available at this https URL (https://github.com/creDreams/PROSE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17420 2026-08-19 cs.CV 新提交

SPVC: Structured and Panoptic Video Fixing for Cross-Dataset Driving Scene Rendering

SPVC:面向跨数据集驾驶场景渲染的结构化全景视频修复

Gen Li, Shu Han, Yun Xi Qiao, Hua Chen, Xuyang Dai, Bohan Li, Hao Zhao, Chaojian Li

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Zhejiang University(浙江大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Great Wall Motor Company Limited(长城汽车股份有限公司) Shanghai Jiao Tong University(上海交通大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本文提出SPVC框架,通过结构化、全景、视频及跨数据集修复原则,训练两阶段可控视频扩散模型,解决驾驶场景渲染的伪影问题,实现跨数据集的高效修复。

Comments Project page: this https URL (https://li00147.github.io/SPVC-Project-Page/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17209 2026-08-19 cs.RO cs.AI cs.CV cs.LG 新提交

Teach and Grow: An Agent-Centered Architecture for General Robot Learning

教学与成长:面向通用机器人学习的智能体中心架构

Chang Nie, Zhe Liu, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

AI总结 该研究提出TGL智能体中心架构,通过将演示转化为可复用技能块,无需特定任务再训练即可实现通用机器人学习,在LIBERO评估中达SOTA性能,还提出相关缩放定律假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20784 2026-08-19 cs.CV 版本更新

GeoRect4D: Geometry-Compatible Generative Rectification for Dynamic Sparse-View 3D Reconstruction

GeoRect4D:几何兼容的生成性矩形化用于动态稀疏视角3D重建

Zhenlong Wu, Zihan Zheng, Xuanxuan Wang, Lei Huang, Hongwei Hu, Xiaoyun Zhang, Qiang Hu, Wenjun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出GeoRect4D框架,通过闭环优化结合显式3D一致性与生成性细化,解决动态稀疏视角3D重建中的几何崩溃和漂移问题,提升重建精度与时间一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04061 2026-08-19 quant-ph cond-mat.stat-mech cs.LG 版本更新

Fermi-Dirac thermal measurements: A framework for quantum hypothesis testing and semidefinite optimization

费米-狄拉克热测量:量子假设检验和半定规划的框架

Nana Liu, Mark M. Wilde

机构 * Institute of Natural Sciences, Shanghai Jiao Tong University, Shanghai 200240, China(自然科学院,上海交通大学,上海) School of Mathematical Sciences, Shanghai Jiao Tong University, Shanghai, 200240, China(数学科学学院,上海交通大学,上海) Ministry of Education Key Laboratory in Scientific and Engineering Computing, Shanghai Jiao Tong University, Shanghai 200240, China(教育部科学与工程计算重点实验室,上海交通大学,上海) Global College, Shanghai Jiao Tong University, Shanghai 200240, China(全球学院,上海交通大学,上海) School of Electrical and Computer Engineering, Cornell University, Ithaca, New York 14850, USA(电气与计算机工程学院,康奈尔大学,纽约)

AI总结 该研究提出费米-狄拉克热测量作为量子假设检验和半定规划的新框架,通过热力学方法优化量子测量,构建了费米-狄拉克机模型。

Comments v2: 36 pages, 3 figures, various technical corrections introduced

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15455 2026-08-19 cs.MM cs.AI 版本更新

M3TR: Temporal Retrieval Enhanced Multi-Modal Micro-video Popularity Prediction

M3TR: 增强型多模态微视频流行度预测框架

Jiacheng Lu, Weijian Wang, Mingyuan Xiao, Yang Hua, Tao Song, Bo Peng, Cheng Hua, Haibing Guan

机构 * Shanghai Jiao Tong University(上海交通大学) Queen's University Belfast(女王大学贝尔法斯特分校) Purdue University(普渡大学)

AI总结 M3TR通过结合精细时序建模与新颖的时序感知检索过程,提升微视频流行度预测的准确性与长期预测能力。

Comments Accepted by MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏