arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-03-04 至 2026-03-04 共收录 10
2603.03094 2026-03-04 cs.IR cs.AI

Proactive Guiding Strategy for Item-side Fairness in Interactive Recommendation

面向交互推荐中物品侧公平性的前瞻性引导策略

Chongjun Xia, Xiaoyu Shi, Hong Xie, Xianzhi Wang, yun lu, Mingsheng Shang

机构 * Chinese Academy of Sciences(中国科学院) University of Technology Sydney(悉尼科技大学) University of Science and Technology of China(中国科学技术大学)

AI总结 HRL4PFG通过分层强化学习引导用户偏好向长尾物品倾斜,提升交互推荐的公平性和用户参与度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02910 2026-03-04 cs.CV

Articulation in Motion: Prior-free Part Mobility Analysis for Articulated Objects By Dynamic-Static Disentanglement

运动中的关节性:通过动态-静态解耦实现无先验知识的关节物体部分移动分析

Hao Ai, Wenjie Chang, Jianbo Jiao, Ales Leonardis, Ofek Eyal

机构 * School of Computer Science, University of Birmingham(伯明翰大学计算机科学学院) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出了一种无需先验知识的关节物体部分移动分析方法,通过动态-静态解耦实现高质量的3D重建与分割。

Comments Accepted by ICLR 2026. Project Page: https://haoai-1997.github.io/AiM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26127 2026-03-04 cs.CV

EchoGen: Generating Visual Echoes in Any Scene via Feed-Forward Subject-Driven Auto-Regressive Model

EchoGen: 通过前馈主体驱动自回归模型在任意场景中生成视觉回声

Ruixiao Dong, Zhendong Wang, Keli Liu, Li Li, Ying Chen, Kai Li, Daowen Li, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团)

AI总结 EchoGen通过前馈主体驱动自回归模型在任意场景中生成高质量视觉回声,实现高效生成与高保真度的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02281 2026-03-04 cs.LG cs.AI quant-ph

Quantum-Inspired Fine-Tuning for Few-Shot AIGC Detection via Phase-Structured Reparameterization

量子启发的少样本AIGC检测相结构重参数化细调

Kaiyang Xing, Han Fang, Zhaoyun Chen, Zhonghui Li, Yang Yang, Weiming Zhang, Guoping Guo

机构 * Anhui University, Hefei, China(安徽大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center, Hefei, China(人工智能研究院) National University of Singapore, Singapore, Singapore(新加坡国立大学) University of Science and Technology of China, Hefei, China(中国科学技术大学)

AI总结 本文提出Q-LoRA和H-LoRA,利用量子和经典方法在少样本AIGC检测中提升准确率超过5%。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02219 2026-03-04 cs.LG cs.AI

NExT-Guard: Training-Free Streaming Safeguard without Token-Level Labels

NExT-Guard: 不依赖令牌级标签的无训练流式安全防护

Junfeng Fang, Nachuan Chen, Houcheng Jiang, Dan Zhang, Fei Shen, Xiang Wang, Xiangnan He, Tat-Seng Chua

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 NExT-Guard通过监控稀疏自编码器的潜在特征,实现无训练的流式安全防护,优于基于监督训练的防护方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02216 2026-03-04 cs.LG cs.AI

ATPO: Adaptive Tree Policy Optimization for Multi-Turn Medical Dialogue

ATPO:多轮医疗对话中的自适应树策略优化

Ruike Cao, Shaojie Bai, Fugen Yao, Liang Dong, Jian Xu, Li Xiao

机构 * University of Science and Technology of China(中国科学技术大学) Qwen Applications Business Group, Alibaba Group(阿里云应用业务部) Zhejiang University(浙江大学)

AI总结 ATPO通过自适应树策略优化提升多轮医疗对话中的信息获取效率,有效解决不确定性问题,实验表明其在医疗对话任务中表现优异。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14686 2026-03-04 cs.DC cs.AI

xLLM Technical Report

xLLM 技术报告

Tongxuan Liu, Tao Peng, Peijun Yang, Xiaoyang Zhao, Xiusheng Lu, Weizhe Huang, Zirui Liu, Xiaoyu Chen, Zhiwei Liang, Jun Xiong, Donghe Jin, Minchao Zhang, Jinrong Guo, Yingxu Deng, Xu Zhang, Xianzhe Dong, Siqi Wang, Siyu Wu, Yu Wu, Zihan Tang, Yuting Zeng, Yanshu Wang, Jinguang Liu, Meng Kang, Menxin Li, Yunlong Wang, Yiming Liu, Xiaolong Ma, Yifan Wang, Yichen Zhang, Jinrun Yin, Keyang Zheng, Jiawei Yin, Jun Zhang, Ziyue Wang, Xiaobo Lin, Liangyu Liu, Liwei Lan, Yang Liu, Chunhua Peng, Han Liu, Songcheng Ren, Xuezhu Wang, Yunheng Shen, Yi Wang, Guyue Liu, Yitao Hu, Hui Chen, Tong Yang, Hailong Yang, Jing Li, Guiguang Ding, Ke Zhang

机构 * THU(清华大学) USTC(University of Science and Technology of China) BUAA(Beijing University of Aeronautics and Automation) PKU(Peking University) TJU(Tianjin University)

AI总结 xLLM是一种针对高性能大规模企业级服务设计的高效LLM推理框架,通过解耦服务引擎架构和多层优化提升吞吐量和推理效率。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00438 2026-03-04 cs.CV

BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration

BindWeave:通过跨模态整合实现主体一致的视频生成

Zhaoyang Li, Dongjun Qian, Kai Su, Qishuai Diao, Xiangyang Xia, Chang Liu, Wenfei Yang, Tianzhu Zhang, Zehuan Yuan

机构 * University of Science and Technology of China(中国科学技术大学) ByteDance(字节跳动) National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家深空探测重点实验室,深空探测实验室)

AI总结 BindWeave通过跨模态整合解决主体一致视频生成难题,利用MLLM-DiT框架提升生成视频的主体一致性和自然度。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17520 2026-03-04 cs.RO cs.CV

InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation

InstructVLA: 从理解到操作的视觉-语言-动作指令微调

Shuai Yang, Hao Li, Bin Wang, Yilun Chen, Yang Tian, Tai Wang, Hanqing Wang, Feng Zhao, Yiyi Liao, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 InstructVLA通过视觉-语言-动作指令微调,实现了在多模态推理和动作生成之间的平衡,提升了机器人在复杂任务中的操控性能和泛化能力。

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07218 2026-03-04 cs.LG cs.AI cs.CV

Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward

Perception-R1: 通过视觉感知奖励提升多模态大语言模型的多模态推理能力

Tong Xiao, Xin Xu, Zhenya Huang, Hongyu Gao, Quan Liu, Qi Liu, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) iFLYTEK AI Research(iFLYTEK人工智能研究院) Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 Perception-R1通过引入视觉感知奖励提升多模态大语言模型的多模态推理能力

详情

展开后加载摘要…

URL PDF HTML 收藏