arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3178
2602.03782 2026-02-04 cs.CV cs.RO

QVLA: Not All Channels Are Equal in Vision-Language-Action Model's Quantization

QVLA:视觉-语言-动作模型量化中并非所有通道都平等

Yuhao Xu, Yantai Yang, Zhenyang Fan, Yufan Liu, Yuming Li, Bing Li, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(自动化实验室,人工智能学院,上海交通大学) Anyverse Dynamics State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Terminal Technology Department, Alipay, Ant Group(终端技术部,蚂蚁集团)

AI总结 QVLA提出了一种动作导向的量化框架,通过按通道分配比特数来优化视觉-语言-动作模型的压缩,实现了更高的性能和效率。

Comments ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03634 2026-02-04 cs.CV

SPWOOD: Sparse Partial Weakly-Supervised Oriented Object Detection

SPWOOD:稀疏部分弱监督定向目标检测

Wei Zhang, Xiang Liu, Ningjing Liu, Mingxin Liu, Wei Liao, Chunyan Xu, Xue Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Nanjing University of Science and Technology(南京理工大学)

AI总结 SPWOOD提出一种稀疏部分弱监督定向目标检测框架,通过稀疏标注和多级伪标签过滤策略提升检测性能,适用于遥感领域高成本标注问题。

Comments The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03569 2026-02-04 cs.AI cs.LG

EHRWorld: A Patient-Centric Medical World Model for Long-Horizon Clinical Trajectories

EHRWorld: 一个以患者为中心的医疗世界模型用于长周期临床轨迹

Linjie Mu, Zhongzhen Huang, Yannian Gu, Shengqian Qin, Shaoting Zhang, Xiaofan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 EHRWorld通过因果序列范式训练,有效解决长周期临床模拟中的误差累积问题,提升医疗世界模型的稳定性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03538 2026-02-04 cs.CV

Constrained Dynamic Gaussian Splatting

受限动态高斯点撒技术

Zihan Zheng, Zhenglong Wu, Xuanxuan Wang, Houqiang Zhong, Xiaoyun Zhang, Qiang Hu, Guangtao Zhai, Wenjun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 CDGS通过引入可微预算控制器和自适应分配机制,在约束条件下实现高效动态场景重建,提升率-失真性能并实现3倍压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03495 2026-02-04 cs.DC cs.LG

DALI: A Workload-Aware Offloading Framework for Efficient MoE Inference on Local PCs

DALI:一种面向工作负载的高效MoE推理卸载框架

Zeyu Zhu, Gang Li, Peisong Wang, Zitao Mo, Minnan Pei, Zhuoran Song, Xiaoyao Liang, Jian Cheng

机构 * Institute of Automation, CAS(中国科学院自动化研究所) School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院) Shanghai Jiao Tong University(上海交通大学) AiRiA

AI总结 DALI通过动态分配和残差预取技术,提升本地PC上MoE推理效率,实现显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03414 2026-02-04 cs.CV cs.AI

Socratic-Geo: Synthetic Data Generation and Geometric Reasoning via Multi-Agent Interaction

Socratic-Geo:通过多智能体交互实现合成数据生成与几何推理

Zhengbo Jiao, Shaobo Wang, Zifan Zhang, Wei Wang, Bing Zhao, Hu Wei, Linfeng Zhang

机构 * AI DATA, Alibaba Group Holding Limited(阿里数据,阿里巴巴集团控股有限公司) EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Shanghai University of Finance(上海财经大学) Wuhan University(武汉大学)

AI总结 Socratic-Geo通过多智能体交互实现合成数据生成与几何推理,利用教师代理和求解代理动态耦合数据合成与模型学习,提升图像生成和推理能力。

Comments 18pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03285 2026-02-04 cs.AI

MeetBench-XL: Calibrated Multi-Dimensional Evaluation and Learned Dual-Policy Agents for Real-Time Meetings

MeetBench-XL: 一种经过校准的多维评估和学习双策略代理用于实时会议

Yuelin Hu, Jun Xu, Bingcong Lu, Zhengxue Cheng, Hongwei Hu, Ronghua Wu, Li Song

机构 * Shanghai Jiao Tong University(上海交通大学) Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(法国巴黎-罗克琴特研究所) Rajiv Gandhi University(拉朱·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒研究实验室)

AI总结 MeetBench-XL通过多维评估和学习双策略代理提升实时会议AI助手的性能与效率

Comments accepted by AAAI2026 ws

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03279 2026-02-04 cs.AI cs.LG

Agentic Proposing: Enhancing Large Language Model Reasoning via Compositional Skill Synthesis

代理提案:通过组合技能合成增强大语言模型推理

Zhengbo Jiao, Shaobo Wang, Zifan Zhang, Xuan Ren, Wei Wang, Bing Zhao, Hu Wei, Linfeng Zhang

机构 * AI DATA, Alibaba Group Holding Limited(阿里数据,阿里巴巴集团控股有限公司) EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Shanghai University of Finance(上海财经大学) Wuhan University(武汉大学)

AI总结 Agentic Proposing通过组合技能合成生成高质量训练数据,使大语言模型在数学、编程和科学领域实现更高效的推理和泛化能力。

Comments 23page4

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03184 2026-02-04 cs.LG cs.CL

DynSplit-KV: Dynamic Semantic Splitting for KVCache Compression in Efficient Long-Context LLM Inference

DynSplit-KV: 动态语义分割用于高效长上下文LLM推理中的KV缓存压缩

Jiancai Ye, Jun Liu, Qingchen Li, Tianlang Zhao, Hanbin Zhang, Jiayi Pan, Ningyi Xu, Guohao Dai

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 DynSplit-KV通过动态语义分割和统一映射策略,提升长上下文LLM推理的准确性与效率,减少内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03182 2026-02-04 cs.CV

LSGQuant: Layer-Sensitivity Guided Quantization for One-Step Diffusion Real-World Video Super-Resolution

LSGQuant: 层敏感性引导的量化方法用于一步扩散现实视频超分辨率

Tianxing Wu, Zheng Chen, Cirou Xu, Bowen Chai, Yong Guo, Yutong Liu, Linghe Kong, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为)

AI总结 LSGQuant 通过动态范围自适应量化器和层敏感性引导策略,实现了一步扩散现实视频超分辨率的高效量化方法,显著提升了模型压缩效果。

Comments Code is available at: https://github.com/zhengchen1999/LSGQuant

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03176 2026-02-04 cs.CV

BinaryDemoire: Moiré-Aware Binarization for Image Demoiréing

BinaryDemoire: 用于图像去摩尔纹的摩尔纹感知二值化

Zheng Chen, Zhi Yang, Xiaoyang Liu, Weihang Zhang, Mengfan Wang, Yifan Fu, Linghe Kong, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 BinaryDemoire通过引入摩尔感知二值门和洗牌分组残差适配器,实现高效去摩尔纹,优于现有二值化方法。

Comments Code is available at: https://github.com/zhengchen1999/BinaryDemoire

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03075 2026-02-04 cs.CL

ReMiT: RL-Guided Mid-Training for Iterative LLM Evolution

ReMiT: 通过强化学习指导的迭代大语言模型进化

Junjie Huang, Jiarui Qin, Di Yin, Weiwen Liu, Yong Yu, Xing Sun, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 ReMiT通过强化学习指导中训练过程,实现大语言模型的迭代进化,提升模型在数学、代码和推理任务上的表现。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03052 2026-02-04 cs.LG

Fedcompass: Federated Clustered and Periodic Aggregation Framework for Hybrid Classical-Quantum Models

Fedcompass: 用于混合经典-量子模型的联邦聚类和周期性聚合框架

Yueheng Wang, Xing He, Zinuo Cai, Rui Zhang, Ruhui Ma, Yuan Liu, Rajkumar Buyya

机构 * 1 School of Artificial Intelligence Computer Science, Jiangnan University 2 Antai College of Economics \& Management, Shanghai Jiao Tong University 3 School of Computer Science, Shanghai Jiao Tong University 4 Cloud Computing Distributed Systems Laboratory, University of Melbourne

AI总结 Fedcompass通过谱聚类和自适应优化提升混合经典-量子联邦学习在非IID数据下的准确率与稳定性。

Comments Accepted by the 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing(ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03038 2026-02-04 cs.CV cs.AI

Bongards at the Boundary of Perception and Reasoning: Programs or Language?

Bongards在感知与推理边界上的问题:程序还是语言?

Cassidy Langenfeld, Claas Beger, Gloria Geng, Wasu Top Piriyakulkij, Keya Hu, Yewen Pu, Kevin Ellis

机构 * Cornell University(康奈尔大学) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出了一种神经符号方法,利用大语言模型和贝叶斯优化解决Bongard问题,通过生成参数化程序化表示来提升视觉推理能力。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02000 2026-02-04 cs.CV cs.AI

SurfSplat: Conquering Feedforward 2D Gaussian Splatting with Surface Continuity Priors

SurfSplat:通过表面连续性先验攻克前馈2D高斯散射

Bing He, Jingnan Gao, Yunuo Chen, Ning Cao, Gang Chen, Zhengxue Cheng, Li Song, Wenjun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Tianyi Shilian Technology Co., Ltd(天翼视联科技有限公司)

AI总结 SurfSplat通过表面连续性先验和强制alpha混合策略,提升稀疏输入下高保真3D重建的几何精度和纹理一致性

Comments ICLR 2026; Project Page: https://hebing-sjtu.github.io/SurfSplat-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01709 2026-02-04 cs.CL

ARTIS: Agentic Risk-Aware Test-Time Scaling via Iterative Simulation

ARTIS: 通过迭代模拟实现代理风险感知的测试时间扩展

Xingshan Zeng, Lingzhi Wang, Weiwen Liu, Liangyou Li, Yasheng Wang, Lifeng Shang, Xin Jiang, Qun Liu

机构 * Huawei Technologies Co., Ltd(华为技术有限公司) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shanghai Jiao Tong University(上海交通大学)

AI总结 ARTIS通过迭代模拟提升代理在高风险环境中的可靠性和鲁棒性,采用风险感知的模拟器改进决策效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00748 2026-02-04 cs.DC cs.AI cs.AR

HyperOffload: Graph-Driven Hierarchical Memory Management for Large Language Models on SuperNode Architectures

HyperOffload: 图驱动的分层内存管理用于超节点架构上的大型语言模型

Fangxin Liu, Qinghua Zhang, Hanjing Shen, Zhibo Liang, Li Jiang, Haibing Guan, Chong Bao, Xuefeng Jin

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

AI总结 HyperOffload通过图驱动的编译器方法优化超节点架构上的LLM内存管理,减少峰值内存使用并提升计算效率。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00197 2026-02-04 q-bio.QM cs.AI cs.CL

Rank-and-Reason: Multi-Agent Collaboration Accelerates Zero-Shot Protein Mutation Prediction

Rank-and-Reason: 多智能体协作加速零样本蛋白质突变预测

Yang Tan, Yuanxi Yu, Can Wu, Bozitao Zhong, Mingchen Li, Guisheng Fan, Jiankang Zhu, Yafeng Liang, Nanqing Dong, Liang Hong

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Southern University of Science(南方大学(科学)) East China University of Science and Technology(东中国科学与技术大学)

AI总结 Rank-and-Reason通过多智能体协作提升零样本蛋白质突变预测的准确性与效率,显著提高湿实验验证的成功率。

Comments 22 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07182 2026-02-04 cs.LG cs.AI

PRPO: Aligning Process Reward with Outcome Reward in Policy Optimization

PRPO:在策略优化中对过程奖励与结果奖励的对齐

Ruiyi Ding, Yongxuan Lv, Xianhui Meng, Jiahe Song, Chao Wang, Chen Jiang, Yuan Cheng

机构 * Shanghai University(上海大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiaotong University(上海交通大学) Artificial Intelligence Incubation and Innovation Institute, Fudan University(复旦大学人工智能孵化与创新研究院) Shanghai Academy of AI for Science(上海人工智能科学研究院)

AI总结 PRPO通过结合结果可靠性与过程级指导,在无批评者框架中提升策略优化效率,实现对过程奖励与结果奖励的对齐,从而提高模型在多步推理任务中的性能。

Comments 8 pages, 2 figures Code is available at: https://github.com/SchumiDing/srpocode

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11361 2026-02-04 cs.AI

MAPGD: Multi-Agent Prompt Gradient Descent for Collaborative Prompt Optimization

MAPGD:多智能体提示梯度下降用于协作提示优化

Yichen Han, Yuhang Han, Siteng Huang, Guanyu Liu, Zhengpeng Zhou, Bojun Liu, Yujia Zhang, Isaac N Shi, Lewei He, Tianyu Shi

机构 * South China Normal University(华南师范大学) Shanghai Jiao Tong University(上海交通大学) Zhejiang University(浙江大学) University of Macau(澳门大学) University of Sydney(悉尼大学) Silicon Sapiens LLC University of Alberta(阿尔伯塔大学) University of Toronto(多伦多大学)

AI总结 MAPGD通过多智能体协作机制提升提示优化的鲁棒性和效率,结合梯度融合与动态加权实现高效且可解释的优化方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10801 2026-02-04 cs.CV

Object Fidelity Diffusion for Remote Sensing Image Generation

遥感图像生成的物体保真扩散

Ziqi Ye, Shuran Ma, Jie Yang, Xiaoyi Yang, Yi Yang, Ziyang Gong, Xue Yang, Haipeng Wang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Xidian University(西安电子科技大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出Object Fidelity Diffusion模型,通过提取对象先验形状和双分支扩散模型提升遥感图像生成的保真度和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19420 2026-02-04 cs.CV

CAD-SLAM: Consistency-Aware Dynamic SLAM with Dynamic-Static Decoupled Mapping

CAD-SLAM: 基于一致性的动态SLAM与动态-静态分离映射

Wenhua Wu, Chenpeng Su, Siting Zhu, Tianchen Deng, Jianhao Jiao, Guangming Wang, Dimitrios Kanoulas, Zhe Liu, Hesheng Wang

机构 * Department of Automation, Shanghai Jiao Tong University(自动化系,上海交通大学) Department of Computer Science, University College London(计算机科学系,伦敦大学学院) Department of Engineering, University of Cambridge(工程系,剑桥大学) Department of Automation, Key Laboratory of System Control and Information Processing of Ministry of Education, State Key Laboratory of Avionics Integration and Aviation System-of-Systems Synthesis, Shanghai Key Laboratory of Navigation and Location Based Services, Shanghai Jiao Tong University(自动化系,教育部系统控制与信息处理重点实验室,航空系统集成与航空系统-of-系统综合国家重点实验室,导航与基于位置的服务上海实验室,上海交通大学)

AI总结 CAD-SLAM通过基于一致性的动态SLAM框架,实现动态物体的在线识别与分离映射,提升动态环境下的定位与映射性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12968 2026-02-04 cs.CV cs.RO

OptiPMB: Enhancing 3D Multi-Object Tracking with Optimized Poisson Multi-Bernoulli Filtering

OptiPMB:通过优化的泊松多伯努利滤波增强3D多目标跟踪

Guanhua Ding, Yuxuan Xia, Runwei Guan, Qinchen Wu, Tao Huang, Weiping Ding, Jinping Sun, Guoqiang Mao

机构 * School of Electronic Information Engineering, Beihang University(电子信息工程学院,北京航空航天大学) School of Automation and Intelligent Sensing, Shanghai Jiaotong University(自动化与智能感知学院,上海交通大学) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学) College of Science and Engineering, James Cook University(科学与工程学院,詹姆斯库克大学) School of Artificial Intelligence and Computer Science, Nantong University(人工智能与计算机科学学院,南通大学) Faculty of Data Science, City University of Macau(数据科学学院,澳门城市大学) Research Laboratory of Smart Driving and Intelligent Transportation Systems, Southeast University(智能驾驶与智能交通系统研究实验室,东南大学)

AI总结 OptiPMB通过优化的泊松多伯努利滤波器和创新设计提升3D多目标跟踪的准确性与性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01881 2026-02-03 cs.CV

ProxyImg: Towards Highly-Controllable Image Representation via Hierarchical Disentangled Proxy Embedding

ProxyImg: 通过分层解耦代理嵌入实现高度可控的图像表示

Ye Chen, Yupeng Zhu, Xiongzhen Zhang, Zhewen Wan, Yingzhe Li, Wenjun Zhang, Bingbing Ni

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei Cloud BU(华为云业务部)

AI总结 ProxyImg通过分层解耦代理嵌入实现高度可控的图像表示,支持高效、细粒度的图像和视频编辑与实时物理动画。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01771 2026-02-03 cs.CL cs.AI cs.NI

<SOG_k>: One LLM Token for Explicit Graph Structural Understanding

<SOG_k>: 一个LLM令牌用于显式图结构理解

Jingyao Wu, Bin Lu, Zijun Di, Xiaoying Gan, Meng Jin, Luoyi Fu, Xinbing Wang, Chenghu Zhou

机构 * Shanghai Jiao Tong University(上海交通大学) IGSNRR, Chinese Academy of Sciences(中科院信息融合国家重点实验室)

AI总结 本文提出<SOG_k>令牌,通过统一令牌空间实现图结构的显式表示,提升LLM对图结构的理解、生成和推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01711 2026-02-03 cs.AI cs.LG

Optimizing Prompts for Large Language Models: A Causal Approach

为大型语言模型优化提示:一种因果方法

Wei Chen, Yanbin Fang, Shuran Fu, Fasheng Xu, Xuan Wei

机构 * School of Business, University of Connecticut(康涅狄格大学商学院) Antai College of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院)

AI总结 CPO通过因果推断方法优化提示设计,提升企业LLM在复杂查询中的鲁棒性,并降低提示优化的经济成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01710 2026-02-03 cs.CV cond-mat.mtrl-sci cs.AI

Physics Informed Generative AI Enabling Labour Free Segmentation For Microscopy Analysis

物理引导的生成式人工智能实现无劳动分割用于显微分析

Salma Zahran, Zhou Ao, Zhengyang Zhang, Chen Chi, Chenchen Yuan, Yanming Wang

机构 * Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Xiaomi AI Lab(小米AI实验室) Kunshan GCL Optoelectronic Material Co., Ltd(昆山GCL光电材料有限公司) Future Photovoltaics Research Center, Global Institute of Future Technology, Shanghai Jiao Tong University(未来光伏研究中心,全球未来技术研究院,上海交通大学)

AI总结 本文提出一种基于物理引导的生成式人工智能框架,通过相场模拟生成真实数据,实现无劳动的显微图像分割,提升材料分析的自动化水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01630 2026-02-03 cs.CV

Research on World Models Is Not Merely Injecting World Knowledge into Specific Tasks

世界模型的研究并非仅仅是将世界知识注入特定任务

Bohan Zeng, Kaixin Zhu, Daili Hua, Bozhou Li, Chengzhuo Tong, Yuran Wang, Xinyi Huang, Yifan Dai, Zixiang Zhang, Yifan Yang, Zhou Liu, Hao Liang, Xiaochen Ma, Ruichuan An, Tianyi Bai, Hongcheng Gao, Junbo Niu, Yang Shi, Xinlong Chen, Yue Ding, Minglei Shi, Kai Zeng, Yiwen Tang, Yuanxing Zhang, Pengfei Wan, Xintao Wang, Wentao Zhang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 本文提出统一的世界模型设计规范,强调其应整合交互、感知、符号推理和空间表示,以实现更通用和稳健的世界模型。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01593 2026-02-03 cs.CV

Samba+: General and Accurate Salient Object Detection via A More Unified Mamba-based Framework

Samba+: 通过更统一的Mamba框架实现通用且准确的显著目标检测

Wenzhuo Zhao, Keren Fu, Jiahao He, Xiaohong Liu, Qijun Zhao, Guangtao Zhai

机构 * College of Computer Science, Sichuan University(四川大学计算机学院) National Key Laboratory of Fundamental Science on Synthetic Vision, Sichuan University(合成视觉基础科学国家级重点实验室) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院) School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(上海交通大学信息科学与电子工程学院)

AI总结 Samba+通过统一的Mamba框架实现多模态显著目标检测,提升模型通用性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01559 2026-02-03 cs.CV eess.IV

Combined Flicker-banding and Moire Removal for Screen-Captured Images

结合闪烁条纹和摩尔纹去除的屏幕捕获图像处理

Libo Zhu, Zihan Zhou, Zhiyi Zhou, Yiyang Qu, Weihang Zhang, Keyu Shi, Yifan Fu, Yulun Zhang

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Central Media Technology Institute, Huawei, China(华为中央媒体技术研究所) Department of XXX, University of YYY, Location, Country(YYY大学XXX系) School of ZZZ, Institute of WWW, Location, Country(ZZZ学院WWW研究所)

AI总结 本文提出CLEAR框架,通过联合去除屏幕捕获图像中的摩尔纹和闪烁条纹,提升图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏