arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2931
2601.15221 2026-01-22 cs.CV

ScenDi: 3D-to-2D Scene Diffusion Cascades for Urban Generation

ScenDi: 3D到2D场景扩散级联用于城市生成

Hanlei Guo, Jiahao Shao, Xinya Chen, Xiyang Tan, Sheng Miao, Yujun Shen, Yiyi Liao

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) The University of British Columbia(不列颠哥伦比亚大学)

AI总结 ScenDi通过整合3D和2D扩散模型,解决3D城市生成中外观细节与相机可控性的平衡问题,实现高质量场景生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14857 2026-01-22 cs.CL

HiNS: Hierarchical Negative Sampling for More Comprehensive Memory Retrieval Embedding Model

HiNS:分层负采样用于更全面的记忆检索嵌入模型

Motong Tian, Allen P. Wong, Mingjun Mao, Wangchunshu Zhou

机构 * OPPO Zhejiang University(浙江大学)

AI总结 HiNS通过分层负采样方法提升记忆检索嵌入模型的检索保真度和泛化能力,在多个任务中取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14780 2026-01-22 cs.CL cs.AI

RECAP: Resistance Capture in Text-based Mental Health Counseling with Large Language Models

RECAP: 在基于文本的心理健康咨询中利用大语言模型进行抗阻捕捉

Anqi Li, Yuqian Chen, Yu Lu, Zhaoming Chen, Yuan Xie, Zhenzhong Lan

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

AI总结 RECAP通过捕捉13种细粒度抗阻行为,提高了基于文本的心理健康咨询中抗阻检测的准确性和解释性,优于现有方法。

Comments 19 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14304 2026-01-22 cs.CL cs.SD eess.AS

Guided by the Plan: Enhancing Faithful Autoregressive Text-to-Audio Generation with Guided Decoding

受计划引导:通过引导解码增强忠实的自回归文本到音频生成

Juncheng Wang, Zhe Hu, Chao Xu, Siyue Ren, Yuxiang Feng, Yang Liu, Baigui Sun, Shujun Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) IROOTECH TECHNOLOGY(IROOTECH技术公司) Wolf 1069 b Lab, Sany Group(三一集团沃尔夫1069实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Zhejiang University(浙江大学)

AI总结 本研究提出Plan-Critic模型,通过引导解码提升自回归文本到音频生成的忠实度,实现CLAP分数提升10分,达到新状态。

Comments Accepted at EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13910 2026-01-22 eess.AS cs.SD

Synthetic Singers: A Review of Deep-Learning-based Singing Voice Synthesis Approaches

合成歌手:深度学习在歌唱语音合成方法中的综述

Changhao Pan, Dongyu Yao, Yu Zhang, Wenxiang Guo, Jingyu Lu, Zhiyuan Zhu, Zhou Zhao

机构 * Zhejiang University(浙江大学)

AI总结 本文综述了基于深度学习的歌唱语音合成方法,系统分析了其任务分类、架构范式及核心技术,并提供了相关数据集和评估基准。

Comments Accepetd by IJCNLP-AACL 2025(Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08223 2026-01-22 cs.CR cs.AI

DNF: Dual-Layer Nested Fingerprinting for Large Language Model Intellectual Property Protection

DNF:用于大语言模型知识产权保护的双层嵌套指纹

Zhenhua Xu, Yiran Zhao, Mengting Zhong, Dezhang Kong, Changting Lin, Tong Qiao, Meng Han

机构 * Zhejiang University(浙江大学) Binjiang Institute of Zhejiang University(浙江大学滨江学院) Hangzhou Dianzi University(杭州电子科技大学) Hefei University of Technology(合肥工业大学)

AI总结 DNF通过结合领域特定风格线索和隐含语义触发器,实现大语言模型的隐蔽知识产权保护。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05665 2026-01-22 cs.CL cs.CV

Interleaved Latent Visual Reasoning with Selective Perceptual Modeling

交错的潜在视觉推理与选择性感知建模

Shuai Dong, Siyuan Wang, Xingyu Liu, Chenglin Li, Haowen Hou, Zhongyu Wei

机构 * China University of Geosciences, Wuhan(中国地质大学(武汉)) Shanghai Innovation Institute(上海创新研究院) University of Southern California(南加州大学) Fudan University(复旦大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 ILVR通过交错潜在视觉表示与文本生成,实现动态状态演变与精确感知建模的统一,提升多模态推理性能。

Comments 18 pages, 11 figures. Code available at https://github.com/XD111ds/ILVR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06605 2026-01-22 cs.CR cs.AI cs.CL

Reading Between the Lines: Towards Reliable Black-box LLM Fingerprinting via Zeroth-order Gradient Estimation

在行之间阅读:通过零阶梯度估计实现可靠的黑盒LLM指纹识别

Shuo Shao, Yiming Li, Hongwei Yao, Yifei Chen, Yuchen Yang, Zhan Qin

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) City University of Hong Kong(香港城市大学)

AI总结 本文提出ZeroPrint方法,通过零阶梯度估计在黑盒环境下实现更可靠的LLM指纹识别,有效提升指纹识别的准确性和鲁棒性。

Comments This paper is accepeted by the ACM Web Conference (WWW) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19780 2026-01-22 cs.LG

Listwise Direct Preference Optimization with Multi-Dimensional Preference Mixing

基于多维偏好混合的列表式直接偏好优化

Yuhui Sun, Xiyao Wang, Zixi Li, YiTian Ding, Tianyang Ling, Jialuo Chen, Tianyi Yu, Zhenlong Yuan, Jinman Zhao

机构 * University of Alberta(阿尔伯塔大学) University of Toronto(多伦多大学) Zhejiang University(浙江大学) School of Computer Science McGill University(麦吉尔大学计算机学院) Alibaba Group (Ant Group)(阿里巴巴集团(蚂蚁集团)) Chinese Academy of Sciences(中国科学院)

AI总结 本文提出λ-DPO,通过多维偏好混合和自适应调度器提升模型对多维度偏好权衡的建模能力。

Comments 13 pages, 1 figures, appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15091 2026-01-22 cs.IR cs.AI

ThinkRec: Thinking-based recommendation via LLM

ThinkRec: 基于思考的推荐方法

Qihang Yu, Kairui Fu, Zheqi Lv, Shengyu Zhang, Xinhui Wu, Chen Lin, Feng Wei, Bo Zheng, Fei Wu

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 ThinkRec通过引入思考激活机制和实例级专家融合机制,提升推荐系统的准确性和可解释性。

Comments Published on WWW'26: In Proceedings of the ACM Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12676 2026-01-22 cs.CV

Accurate Tracking of Arabidopsis Root Cortex Cell Nuclei in 3D Time-Lapse Microscopy Images Based on Genetic Algorithm

基于遗传算法的阿拉伯拟南芥根皮层细胞核在3D时间延拓显微镜图像中的准确跟踪

Yu Song, Tatsuaki Goh, Yinhao Li, Jiahua Dong, Shunsuke Miyashima, Yutaro Iwamoto, Yohei Kondo, Keiji Nakajima, Yen-wei Chen

机构 * Graduate School of Science and Technology, Nara Institute of Science and Technology(奈良科学技术大学研究生院) Bioresource Engineering Laboratory, Ishikawa Prefectural University(石川县立大学生物资源工程实验室) Department of Engineering Informatics, Osaka Electro-Communication University(大阪电讯大学工程信息学系) Exploratory Research Center on Life and Living Systems, National Institutes of Natural Sciences(国家自然科学研究院生命与生活系统探索研究中心) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 本研究提出基于遗传算法的拟南芥根部细胞核跟踪方法,解决密集细胞排列下的准确跟踪问题,首次在根尖领域实现时间延拓显微镜中的细胞跟踪突破。

Journal ref IEEE Transactions on Computational Biology and Bioinformatics, vol. 22, pp. 3260-3272, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14103 2026-01-21 cs.CV

Interp3D: Correspondence-aware Interpolation for Generative Textured 3D Morphing

Interp3D: 基于对应关系的生成式纹理3D变形

Xiaolu Liu, Yicong Li, Qiyuan He, Jiayin Zhu, Wei Ji, Angela Yao, Jianke Zhu

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Nanjing University(南京大学) State Key Lab of CAD & CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 Interp3D提出一种无需训练的纹理3D变形方法,通过结构化潜在引导和渐进对齐实现几何与纹理一致性,提升3D变形的平滑度和合理性。

Comments 22 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14060 2026-01-21 cs.CV

Fine-Grained Zero-Shot Composed Image Retrieval with Complementary Visual-Semantic Integration

细粒度零样本组合图像检索与互补视觉-语义整合

Yongcong Ye, Kai Zhang, Yanghai Zhang, Enhong Chen, Longfei Li, Jun Zhou

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学) Zhejiang University(浙江大学)

AI总结 本文提出CVSI方法,通过互补视觉-语义整合提升细粒度零样本组合图像检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14052 2026-01-21 cs.CV

Vision Also You Need: Navigating Out-of-Distribution Detection with Multimodal Large Language Model

视觉也需要:利用多模态大语言模型进行分布外检测导航

Haoran Xu, Yanlin Liu, Zizhao Tong, Jiaze Li, Kexue Fu, Yuyang Zhang, Longxiang Gao, Shuaiguang Li, Xingyu Li, Yanran Xu, Changwei Wang

机构 * Zhejiang University(浙江大学) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(教育部计算电力网络与信息安全重点实验室,山东计算机科学中心(国家超算中心济南中心),齐鲁工业大学(山东科学院)) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing, Shandong Fundamental Research Center for Computer Science(山东省计算电力互联网与服务计算重点实验室,山东省计算机科学基础研究中心) University of Electronic Science and Technology of China(电子科技大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) RWTH Aachen University(亚琛工业大学)

AI总结 本文提出MM-OOD方法,利用多模态大语言模型的推理能力,通过多轮对话增强分布外检测,提升近远OOD任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13752 2026-01-21 cs.AI cs.CL

Finding RELIEF: Shaping Reasoning Behavior without Reasoning Supervision via Belief Engineering

寻找RELIFF:通过信念工程塑造推理行为而无需推理监督

Chak Tou Leong, Dingwei Chen, Heming Xia, Qingyu Yin, Sunbowen Lee, Jian Wang, Wenjie Li

机构 * Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系) Sun Yat-sen University(中山大学) Zhejiang University(浙江大学) WUST(华中科技大学)

AI总结 本文提出RELIFF,通过信念工程无需推理监督塑造大型推理模型的行为,实验表明其在效率和忠实度任务上表现优异。

Comments Working in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13578 2026-01-21 cs.LG cs.CV

FG-OrIU: Towards Better Forgetting via Feature-Gradient Orthogonality for Incremental Unlearning

FG-OrIU: 通过特征-梯度正交性实现更好的增量遗忘

Qian Feng, JiaHang Tu, Mintong Kang, Hanbin Zhao, Chao Zhang, Hui Qian

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

AI总结 FG-OrIU通过特征和梯度正交约束实现深度不可逆的增量遗忘,解决现有方法中残留信息可恢复的问题。

Comments This paper has been accepted by ICCV 2025. code: \url{https://github.com/RAIAN08/FG-OrIU}

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13247 2026-01-21 cs.CL cs.AI cs.CV cs.LG cs.MM

Aligning Agentic World Models via Knowledgeable Experience Learning

通过知识性经验学习对齐代理世界模型

Baochang Ren, Yunzhi Yao, Rui Sun, Shuofei Qiao, Ningyu Zhang, Huajun Chen

机构 * Zhejiang University(浙江大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 WorldMind通过知识性经验学习对齐代理世界模型,解决物理模拟中的幻觉问题,实现跨环境的高效迁移。

Comments Ongoing work

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08189 2026-01-21 cs.CR cs.AI

ForgetMark: Stealthy Fingerprint Embedding via Targeted Unlearning in Language Models

ForgetMark: 通过针对性遗忘实现语言模型的隐秘指纹嵌入

Zhenhua Xu, Haobo Zhang, Zhebo Wang, Qichen Liu, Haitao Xu, Wenpeng Xing, Meng Han

机构 * Zhejiang University(浙江大学) Zhejiang University of Technology(浙江工业大学)

AI总结 ForgetMark通过针对性遗忘技术,在语言模型中实现隐秘指纹嵌入,提升隐蔽性和鲁棒性,同时保持模型性能。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15394 2026-01-21 cs.CV

Doracamom: Joint 3D Detection and Occupancy Prediction with Multi-view 4D Radars and Cameras for Omnidirectional Perception

Doracamom:多视角4D雷达与摄像头联合3D检测与占用预测用于全方位感知

Lianqing Zheng, Jianan Liu, Runwei Guan, Long Yang, Shouyi Lu, Yuanzhe Li, Xiaokai Bai, Jie Bai, Zhixiong Ma, Hui-Liang Shen, Xichan Zhu

机构 * School of Automotive Studies, Tongji University(同济大学汽车学院) Momoni AI Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系) Chair of Automotive Engineering, Technische Universität Berlin(柏林技术大学汽车工程学系) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Information and Electrical Engineering, Hangzhou City University(杭州城市学院信息与电气工程学院)

AI总结 Doracamom通过融合多视角4D雷达与摄像头,实现3D物体检测与语义占用预测,提升自动驾驶环境感知能力。

Comments Accepted by IEEE TCSVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12768 2026-01-21 cs.CV cs.MM

Delving Deeper: Hierarchical Visual Perception for Robust Video-Text Retrieval

深入探索:用于鲁棒视频-文本检索的层次视觉感知

Zequn Xie, Boyun Zhang, Yuxiao Lin, Tao Jin

机构 * Zhejiang University(浙江大学)

AI总结 HVP-Net通过提取和细化视觉编码器的多层特征,提升视频-文本检索的鲁棒性,实现新的最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12730 2026-01-21 cs.LG

Distribution-Centric Policy Optimization Dominates Exploration-Exploitation Trade-off

以分布为中心的策略优化主导探索-利用权衡

Zhaochun Li, Chen Wang, Jionghao Bai, Shisheng Cui, Ge Lan, Zhou Zhao, Yue Wang

机构 * College of Software, Nankai University(南开大学软件学院) Zhongguancun Academy(中关村学院) School of Automation , Beijing Institute of Technology(北京理工大学自动化学院) College of Computer Science(计算机科学学院) Technology, Zhejiang University(浙江大学技术学院)

AI总结 本文提出DCPO,通过分布层面的正则化实现可控探索,改进了探索-利用权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12729 2026-01-21 cs.CV cs.RO

DC-VLAQ: Query-Residual Aggregation for Robust Visual Place Recognition

DC-VLAQ:用于鲁棒视觉位置识别的查询残差聚合

Hanyu Zhu, Zhihao Zhan, Yuhang Ming, Liang Li, Dibo Hou, Javier Civera, Wanzeng Kong

机构 * BCCITA Provincial Key Laboratory, Hangzhou Dianzi University, China(杭州电子科技大学省重点实验室) TopXGun Robotics, China(TopXGun Robotics) ICT State Key Laboratory, Zhejiang University, China(浙江大学信息与电子技术国家重点实验室) I3A, University of Zaragoza, Spain(阿拉贡大学I3A)

AI总结 DC-VLAQ通过融合互补视觉基础模型和鲁棒的全局聚合方法,提升了视觉位置识别在大视角变化和领域偏移下的鲁棒性。

Comments 10 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10327 2026-01-21 cs.CV cs.MM

Simple Yet Effective Selective Imputation for Incomplete Multi-view Clustering

简单而有效的选择性填补用于不完整多视图聚类

Cai Xu, Jinlong Liu, Yilin Zhang, Ziyu Guan, Wei Zhao, Xiaofei He

机构 * School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) State Key Laboratory of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室)

AI总结 SI$^3$提出了一种轻量级、数据驱动的选择性填补方法,用于不完整多视图聚类,通过预评估信息量实现高效且鲁棒的填补与融合。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10065 2026-01-21 cs.RO

Prespecified-Performance Kinematic Tracking Control for Aerial Manipulation

预设性能的空中机械臂运动跟踪控制

Huazi Cao, Jiahao Shen, Zhengzhen Li, Qinquan Ren, Shiyu Zhao

机构 * Westlake Institute for Optoelectronics(西lake光电研究所) Department of Artificial Intelligence, Westlake University(人工智能系,西lake大学) WINDY Lab(WINDY实验室) College of Control Science and Engineering, Zhejiang University(控制科学与工程学院,浙江大学)

AI总结 本文提出了一种预设性能的空中机械臂运动跟踪控制方法,通过结合预设轨迹和二次规划参考分配,确保在指定时间内达到目标位置并满足任务要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05928 2026-01-21 cs.CL cs.AI

MoA: Heterogeneous Mixture of Adapters for Parameter-Efficient Fine-Tuning of Large Language Models

MoA:异构适配器混合用于大语言模型的参数高效微调

Jie Cao, Tianwei Lin, Bo Yuan, Rolan Yan, Hongyang He, Wenqiao Zhang, Juncheng Li, Dongping Zhang, Siliang Tang, Yueting Zhuang

机构 * Zhejiang University(浙江大学)

AI总结 MoA通过异构适配器混合提升大语言模型的参数高效微调性能,采用软和稀疏变体实现细粒度整合与稀疏激活,增强预训练知识向下游任务的转移效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12269 2026-01-21 cs.CL cs.AI

Simulated Annealing Enhances Theory-of-Mind Reasoning in Autoregressive Language Models

退火模拟增强语言模型的理论思维推理

Xucong Hu, Jian-Qiao Zhu

机构 * Department of Psychology and Behavioral Sciences, Zhejiang University(浙江大学心理学与行为科学系) Department of Psychology, The University of Hong Kong(香港大学心理学系)

AI总结 通过退火模拟提升自回归语言模型的理论思维推理能力,无需额外训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11952 2026-01-21 cs.CV

Decoder Gradient Shields: A Family of Provable and High-Fidelity Methods Against Gradient-Based Box-Free Watermark Removal

解码器梯度防护:一种可证明且高保真的对抗梯度基于的框外水印移除方法

Haonan An, Guang Hua, Wei Du, Hangcheng Cao, Yihang Tao, Guowen Xu, Susanto Rahardja, Yuguang Fang

机构 * Hong Kong JC STEM Lab of Smart City and Department of Computer Science, City University of Hong Kong(香港JC STEM实验室及城市大学计算机科学系) Infocomm Technology Cluster, Singapore Institute of Technology(新加坡理工学院信息通信技术集群) College of Information Science & Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科学与技术大学计算机科学与工程学院) Department of Electronic and Electrical Engineering, University College London(伦敦大学学院电子与电气工程系)

AI总结 本文提出了解码器梯度防护(DGSs)方法,通过防止梯度传播来增强对抗框外水印移除的鲁棒性,有效保护模型知识产权。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11655 2026-01-21 cs.SE cs.CL

Advances and Frontiers of LLM-based Issue Resolution in Software Engineering: A Comprehensive Survey

大语言模型在软件工程中的问题解决进展与前沿:一项全面的调查

Caihua Li, Lianghong Guo, Yanlin Wang, Daya Guo, Wei Tao, Zhenyu Shan, Mingwei Liu, Jiachi Chen, Haoyu Song, Duyu Tang, Hongyu Zhang, Zibin Zheng

机构 * Sun Yat-sen University(中山大学) Hangzhou Normal University(杭州师范大学) Zhejiang University(浙江大学) Huawei Technologies Co, Ltd(华为技术有限公司) Chongqing University(重庆大学)

AI总结 本文全面调查了大语言模型在软件工程中问题解决的进展与前沿,分析了数据构建、方法和技术挑战,并提供了开源资源。

Comments 26 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08626 2026-01-21 cs.CL

How Order-Sensitive Are LLMs? OrderProbe for Deterministic Structural Reconstruction

大语言模型对顺序敏感性如何?OrderProbe用于确定性结构重建

Yingjie He, Zhaolu Kang, Kehan Jiang, Qianyuan Zhang, Jiachen Qian, Chunlei Meng, Yujie Feng, Yuan Wang, Jiabao Dou, Aming Wu, Leqi Zheng, Pengxiang Zhao, Jiaxin Liu, Zeyu Zhang, Lei Wang, Guansu Wang, Qishi Zhan, Xiaomin He, Meisheng Zhang, Jianyuan Ni

机构 * Peking University(北京大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) City University of Hong Kong(香港城市大学) Fudan University(复旦大学) The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校) Marquette University(马凯特大学) Juniata College(朱尼阿特学院)

AI总结 研究通过OrderProbe基准评估大语言模型对输入顺序的敏感性,发现即使在前沿模型上,结构重建仍面临挑战,且语义能力与结构鲁棒性存在脱节。

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06712 2026-01-21 cs.CV

Compositional Feature Augmentation for Unbiased Scene Graph Generation

组合特征增强用于无偏场景图生成

Lin Li, Guikun Chen, Jun Xiao, Yi Yang, Chunping Wang, Long Chen

机构 * Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港理工大学) FinVolution

AI总结 本文提出组合特征增强策略,通过增强关系三元组特征多样性,解决SGG中的偏见问题。

Comments ICCV

详情

展开后加载摘要…

URL PDF HTML 收藏