arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

共收录 353
2607.10238 2026-07-14 cs.CV 新提交

Benchmarking Dynamic Affective Reasoning: A Viewer-Centric Video Emotion Dataset

动态情感推理基准测试:一个以观众为中心的视频情感数据集

Zhiyan Zhang, Peipei Song, Jinpeng Hu, Jingyang Jia, Xun Yang, Xiaojun Chang

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

AI总结 研究针对视频情感分析常被视为静态分类问题的不足,引入动态情感推理及数据集DAR,定义三项任务,提出DAR - R1框架,经实验验证其在情感定位和推理方面达新的先进水平。

Comments 25 pages, 6 figures. Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10165 2026-07-14 cs.CV cs.AI 新提交

EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation

EmoStyle:用于情感图像生成的风格专家情感调节

Dexiang Hong, Yijie Guo, Weidong Chen, Xinyan Liu, Zixuan Zou, Zhendong Mao, Yongdong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 针对情感感知艺术图像生成中训练与测试时属性不一致造成的控制差距问题,提出EmoStyle框架,利用语言模型推理器预测情感线索,编码情感字段指导生成,训练专用LoRA适配器结合风格表达情感,经视觉语言模型引导排序,在挑战赛中获佳绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10130 2026-07-14 cs.CV 新提交

TextGaze: Prompting Gaze Target Estimation with Textual Scene Cues

TextGaze:利用文本场景线索提示注视目标估计

Junhui She, Fei Wang, Kun Li, Yiqi Nie, Yuxin Liu, Zhangling Duan, Xun Yang

机构 * University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院) Anhui University(安徽大学) United Arab Emirates University(阿联酋大学)

AI总结 研究注视目标估计问题,提出TextGaze统一跨模态架构,利用大型视觉语言模型平衡多分支与简化设计范式,通过冻结编码器提取视觉特征、设计融合模块等进行联合预测,在多数据集上评估有竞争力,为传统设计提供简化替代。

Comments Accepted by IJCAI 2026. All contents are available at: https://github.com/idremo/TextGaze-IJCAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00321 2026-07-13 cs.CV 新提交

CORGI: Consistency-Aware 3D Dog Reconstruction from a Single Image in the Wild

CORGI: 从野外单张图像进行一致性感知的3D狗重建

Yuxiao Wu, Weile Li, Boyi Zhu, Yumeng Liu, Youcheng Cai, Ligang Liu

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 提出CORGI框架,通过规范驱动轨道生成、一致性感知可变形3DGS和自监督变形条件生成修复模块,从单张无约束图像重建高保真3D狗模型,无需3D监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08124 2026-07-10 cs.SE cs.LG 新提交

TTHE: Test-Time Harness Evolution

测试时工具演化

Jun Nie, Yonggang Zhang, Jun Song, Qianshu Cai, Dahai Yu, Yike Guo, Xinmei Tian, Bo Han

机构 * Hong Kong Baptist University(香港 Baptist 大学) University of Science and Technology of China(中国科学技术大学) Hong Kong Generative AI Research & Development Center, The Hong Kong University of Science and Technology(香港生成式人工智能研究与开发中心,香港科技大学) TCL Corporate Research (HK) Co., Ltd(TCL 企业研究(香港)有限公司)

AI总结 研究LLM智能体测试时工具优化问题,提出TTHE方法,通过维护候选工具种群,基于执行轨迹推理优化,无需黄金标签或特定任务监督,在多任务实验中改进基线工具,将测试时适应重塑为程序演化并确定代理可靠性挑战。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07974 2026-07-10 cs.CL cs.AI 新提交

A Multi-cluster Boundary Learning Method for Out-of-Scope Intent Detection via MiniLM Embedding

一种基于MiniLM嵌入的多簇边界学习方法用于检测超出范围的意图

Yihong Xu, Mingyu Kang, Linyuan Lü

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 针对意图检测中超出范围意图检测的挑战,提出基于MiniLM嵌入的多簇边界学习方法,在单类分类工作流程中检测超出范围意图,实验表明该方法性能最优,所用MiniLM能更好适应相关要求。

Comments To submit

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15920 2026-07-10 cs.CV 新提交

OmniOPSD: Rationale-Privileged On-Policy Self-Distillation for Affective Computing

OmniOPSD:面向情感计算的理性特权在线自蒸馏

Zebang Cheng, Shuimu Chen, Boxue Yang, Yuanshen Guan, Jingyi Chen, Zheng Lian, Xiaojiang Peng, Fei Ma, LaiZhong Cui, Qi Tian

机构 * Shenzhen University(深圳大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Shenzhen Technology University(深圳技术大学) Tongji University(同济大学) Huawei(华为)

AI总结 针对多模态大模型在复杂推理任务中奖励稀疏的问题,提出OmniOPSD框架,利用前沿模型生成的理性作为教师特权证据而非学生模仿目标,通过在线自蒸馏提供密集令牌级监督,在MER-UniBench上取得84.19平均分的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07708 2026-07-09 cs.CL cs.AI cs.CE cs.LG 新提交

Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning

通过深度原生结构推理实现准确、跨学科和透明的结构-属性理解

Chen Tang, Yizhou Wang, Jianyu Wu, Lintao Wang, Shixiang Tang, Pengze Li, Encheng Su, Jun Yao, Jiabei Xiao, Yuqi Shi, Jielan Li, Hongxia Hao, Zhangyang Gao, Fang Wu, Ben Fei, Xiangyu Yue, Pan Tan, Bozitao Zhong, Jinouwen Zhang, Aoran Wang, Yan Lu, Jiaheng Liu, Xinzhu Ma, Liang Hong, Mingyue Zheng, Phil Torr, Bowen Zhou, Wanli Ouyang, Lei Bai

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) University of Sydney(悉尼大学) Nanjing University(南京大学) University of Oxford(牛津大学) The University of Science and Technology of China(中国科学技术大学) Drug Discovery and Design Center, State Key Laboratory of Drug Research, Shanghai Institute of Materia Medica, Chinese Academy of Sciences(药物发现与设计中心、国家药物研究重点实验室、上海中医药材料医学研究所、中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Stanford University(斯坦福大学)

AI总结 研究聚焦利用人工智能解释结构-属性关系的挑战,提出多模态科学基础模型SciReasoner,通过离散化结构信息为可寻址单元进行推理,在多领域基准测试中表现出色,实现准确预测与可解释科学推理的结合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06954 2026-07-09 cs.LG 新提交

Physical activities enable scalable foundation modelling for broad-spectrum health prediction

身体活动助力实现用于广谱健康预测的可扩展基础建模

Zhenghuang Wu, Yuyao Zhu, Songlin Xu

机构 * Beihang University(北京航空航天大学) University of Science and Technology of China(中国科学技术大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 研究针对多数健康预测传感器模型局限性,提出仅基于步数计数器数据的StepFM基础模型,设计可扩展预训练框架,能跨多任务迁移,实验证明其性能强劲、保持稳健,还揭示了身体活动与健康风险关系,为健康监测奠定了基于步数传感的基础。

Comments 18 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07623 2026-07-09 cs.LG cs.NA math.NA physics.chem-ph physics.comp-ph physics.data-an 新提交

Higher-Order Geometric Updates for Levenberg-Marquardt Method via Riemann Normal Coordinates

通过黎曼法坐标对列文伯格-马夸特方法进行高阶几何更新

Jianing Liu, Dong H. Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Chinese Academy of Sciences(中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Hefei National Laboratory(合肥国家实验室)

AI总结 研究针对非线性最小二乘优化问题,提出黎曼法坐标列文伯格-马夸特方法(RNC-LM)。通过重新表述测地线方程扩展校正阶数,构建有限步更新。该方法提高了收敛性和鲁棒性,在多任务中表现出色,如降低误差、加速计算等。

Comments 34 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04653 2026-07-09 cs.CV 新提交

Enhancing Video Physical Consistency via Role-aware Joint Training and Modality-decoupled Denoising

通过角色感知联合训练和模态解耦去噪增强视频物理一致性

Guangting Zheng, Haojing Chen, Hao Li, Jingtao Zhang, Zhen Yang, Xiaosong Jia, Xue Yang, Shaofeng Zhang, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) University of Electronic Science and Technology of China(电子科技大学) Fudan University(复旦大学) Georgia Institute of Technology(佐治亚理工学院) Shanghai Jiao Tong University(上海交通大学)

AI总结 研究针对视频扩散模型长程物理一致性挑战,提出VPT微调框架。通过角色感知信号清晰建模不同物理角色,采用模态解耦去噪策略及损失权重衰减,引入跨步自动引导,增强物理动力学,提升物理一致性与视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06516 2026-07-08 cs.CV 新提交

Point as Skeleton: Accumulated Point Cloud Enhanced Autoregressive Generation for Closed-Loop Autonomous Driving Simulation

点作为骨架:累积点云增强自回归生成用于闭环自动驾驶模拟

Songbur Wong, Xiaosong Jia, Junqi You, Bo Zhang, Pei Xu, Renqiu Xia, Yuping Qiu, Shaofeng Zhang, Zelin Zhao, Xuechao Yan, Yuchen Zhou, Yurui Chen, Wen Guo, Hang Xu, Junchi Yan

机构 * Shanghai Jiao Tong University(上海交通大学) Yinwang Intelligent Technology Co., Ltd.(银望智能科技有限公司) Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 针对自动驾驶模拟难题,提出“点作为骨架”框架,通过自回归生成器结合多种条件合成视频,引入Reset-and-Roll支持闭环,用点云骨架稳定误差,实现基于nuPlan的闭环生成接口,实验证明其提升了闭环自回归生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06080 2026-07-08 cs.CL cs.AI cs.SI 新提交

From Blueprint to Reality: Modeling and Applying Putnam's Social Capital Theory with LLM-based Multi-agent Simulations

从蓝图到现实:基于大语言模型的多智能体模拟对普特南社会资本理论的建模与应用

Shiyi Ling, Zhi Zheng, Hui Zheng, Wenjun Xue, Feng Ye, Tong Xu

机构 * University of Science and Technology of China(中国科学技术大学) Anhui University(安徽大学) North Automatic Control Technology Institute(北方自动控制技术研究所)

AI总结 研究利用基于大语言模型的多智能体模拟框架SocaSim,对普特南社会资本理论进行建模与应用,通过构建特定环境及智能体实验分析智能老年护理挑战,重现宏观模式且具微观因果路径可解释性,弥合了社会科学与计算机科学。

Comments 23 pages, 13 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05955 2026-07-08 cs.CV cs.AI 新提交

NegROI: Click-Centric Uncertainty-Guided Refinement with Scene-Conditioned Negative Prompts for Robust Interactive 3D Segmentation

NegROI:基于场景条件负提示的以点击为中心的不确定性引导细化用于稳健交互式3D分割

Shuheng Zhang, Feng Wu

机构 * School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院)

AI总结 研究针对交互式3D分割中粗体素分辨率及背景误报问题,提出NegROI框架,结合点击中心多分辨率细化与场景条件负提示,通过不确定性驱动选择性细化、负提示建模及边界感知硬负挖掘,提升点击效率、减少误报并增强跨数据集鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04360 2026-07-07 stat.ML cs.LG 新提交

Optimal Mixture-of-Experts Model Averaging for Conditional Generative Models

面向条件生成模型的最优专家混合模型平均方法

Shijin Gong, Baihua He, Xinyu Zhang

机构 * School of Management, University of Science and Technology of China(中国科学技术大学管理学院) Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院)

AI总结 针对条件生成模型多候选生成器性能随场景波动的问题,提出无需可处理密度的样本驱动最优模型平均框架,含静态与输入自适应方法,经多模态实验验证效果优于基线。

Comments 32 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05377 2026-07-07 cs.RO cs.AI cs.CV 新提交

Cortex: A Bidirectionally Aligned Embodied Agent Framework for Long-horizon Manipulation

Cortex:一种用于长视距操作的双向对齐具身智能体框架

Jiaqi Peng, Xiqian Yu, Delin Feng, Yuqiang Yang, Wenzhe Cai, Jing Xiong, Ganlin Yang, Jinliang Zheng, Jiafei Cao, Xueyuan Wei, Jiangmiao Pang, Yuan Shen, Tai Wang

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) USTC(中国科学技术大学)

AI总结 针对现有VLA模型长视距任务短板及分层方法语义-运动鸿沟问题,提出双向对齐框架Cortex,标准化技能原语、优化数据与采样策略,提升长视距操作性能与零样本泛化能力。

Comments Project website: https://steinate.github.io/cortex.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05056 2026-07-07 cs.CV 新提交

Consistent and Editable: A Balanced Framework for Text-Guided Video Editing

一致且可编辑:文本引导视频编辑的平衡框架

Tao Jin, Li Xiao

机构 * USTC(中国科学技术大学)

AI总结 针对视频编辑中时间一致性和可编辑性难以平衡的问题,提出EquiEdit框架。通过时间Mamba模块增强时间一致性,设计基于频谱变换的噪声注入策略提升可编辑性,实验证明该方法有效。

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04851 2026-07-07 cs.MM cs.LG 新提交

SleepBand: Single-Source Domain Generalization for Sleep Staging via Physiologically Structured Spectral Modeling

SleepBand:通过生理结构谱建模实现睡眠分期的单源域泛化

Zhi Lu, Yang Hu, Yan Chen

机构 * Laboratory of Intelligent Collaborative Computing, University of Electronic Science and Technology of China(电子科技大学智能协同计算实验室) School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学学院) School of Cyber Science and Technology, University of Science and Technology of China(中国科学技术大学网络科学与技术学院)

AI总结 针对睡眠分期模型跨数据集泛化难题及单源域泛化的严格实际场景,提出SleepBand框架,利用可学习的Morlet滤波器组和结构化管道嵌入振荡先验,提升单源域泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04816 2026-07-07 cs.RO 新提交

CAC-VLA: Context-Gated Action Conditioning for Vision-Language-Action Models

CAC-VLA:用于视觉-语言-动作模型的上下文门控动作条件调节

Yifu Xiong, Wenhao Yu, Jiaxuan Lin, Bojun Zou, Jiahao Li, Lu Zhang, Yanyong Zhang, Jianmin Ji

机构 * University of Science and Technology of China (USTC)(中国科学技术大学) Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)

AI总结 研究视觉-语言-动作模型,提出上下文门控动作条件调节框架CAC-VLA,在视觉语言模型中学习轻量级潜在动作接口,训练模型预测潜在动作并通过上下文门调节动作专家,实验验证其有效性。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04740 2026-07-07 cs.CV 新提交

DriftST: One-Step Generative Inference of Spatial Transcriptomics from H\&E Histology

DriftST:从苏木精和伊红(H&E)组织学进行空间转录组学的一步生成推理

Yuhang Yang, Yonggan Bu, Shengyuan Zhou, Yiming Luo, Kai Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Peking University Cancer Hospital(北京大学肿瘤医院)

AI总结 研究旨在从H&E图像推断空间解析基因表达。提出DriftST框架,基于细胞漂移生成模型,引入STransformer捕捉基因结构,能处理不同层级数据,实验表明其在两种分辨率下均达最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04625 2026-07-07 cs.CV cs.AI 新提交

Hierarchical Evidence-Driven Reasoning for Long Document Understanding

用于长文档理解的分层证据驱动推理

Junyu Xiong, Yonghui Wang, Rongjian Gu, Chenyu Liu, Bing Yin, Wengang Zhou, Houqiang Li

机构 * University of Science and Technology of China(中国科学技术大学) iFLYTEK Research(科大讯飞研究院)

AI总结 针对现有多模态RAG管道面临的问题,提出分层证据驱动的多模态RAG框架HIEVI-RAG,通过四阶段管道,包括分层问题分解、粗视觉页面检索、细粒度页面验证和内存引导迭代生成,提升长文档理解,效果显著优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04433 2026-07-07 cs.IR cs.CL 新提交

Autonomous Information Seeking: A Roadmap for Agentic Recommender Systems

自主信息寻求:智能推荐系统路线图

Xinyu Lin, Yashar Deldjoo, Sunhao Dai, Honghui Bao, Xiaopeng Ye, Fatemeh Nazary, Wenjie Wang, Tommaso Di Noia, Jun Xu, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Polytechnic University of Bari(巴里理工大学) Renmin University of China(中国人民大学) University of Science and Technology of China(中国科学技术大学)

AI总结 综述基于大语言模型的智能体融入推荐系统带来的转变,介绍基于自主性水平的分类法及三种核心范式,分析各范式采用的架构和智能体对关键组件的增强,探讨评估方法及未解决问题,指出开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04350 2026-07-07 cs.CL 新提交

WPG-MoE: Weak-Prior-Guided Dense Mixture-of-Experts for User-Level Social Media Depression Detection

WPG-MoE:用于用户级社交媒体抑郁症检测的弱先验引导密集专家混合模型

Xian Li, Yuanhe Tian, Yang Yang, Guoqing Wang, Yan Song

机构 * University of Electronic Science and Technology of China(电子科技大学) Zhongguancun Academy(中关村科学院) University of Science and Technology of China(中国科学技术大学)

AI总结 研究社交媒体抑郁症检测,提出基于共享大语言模型骨干的WPG-MoE框架,通过推导用户级弱语义先验将用户软路由到匹配的专家,以解决单一检测器决策问题,实验表明其性能优于基线。

Comments 23 pages, 8 figures, 26 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04270 2026-07-07 cs.IR cs.AI 新提交

LBR: Towards Mitigating Length Bias in Large Language Models for Recommendation

LBR:减轻用于推荐的大语言模型中的长度偏差

Hongchen Li, Bohao Wang, Jingbang Chen, Weiqin Yang, Hang Pan, Bingde Hu, Can Wang, Jiawei Chen

机构 * Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) University of Science and Technology of China(中国科学技术大学) Bangsun Technology(Bangsun科技)

AI总结 研究大语言模型用于推荐时的长度偏差问题,提出LBR框架。通过长度感知注意力校准减轻输入偏差,引入有效信息长度归一化处理输出偏差,实验证明该框架能减轻偏差并提升推荐准确性和公平性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04156 2026-07-07 cs.AI cs.SC 新提交

Language models guide symbolic equation discovery by controlling search

语言模型通过控制搜索来指导符号方程发现

Zikai Xie, Wenmei Li, Man Luo, Jun Jiang, Linjiang Chen

机构 * State Key Laboratory of Precision and Intelligent Chemistry, Hefei National Research Center for Physical Sciences at the Microscale, School of Chemistry and Materials Science, University of Science and Technology of China(精确与智能化学国家重点实验室,合肥微尺度物理科学国家研究中心,化学与材料科学学院,中国科学技术大学) Center for Scientific Intelligence Innovation, Hefei, China(智能创新研究中心,合肥,中国) School of Chemistry, School of Computer Science, University of Birmingham(化学系,计算机科学学院,伯明翰大学)

AI总结 研究科学方程发现,对比语言模型不同角色设定,提出语言模型作搜索控制器的方式(LLM-PySR),经实验其在多任务中平衡了准确率、复杂度等,还发现新关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03883 2026-07-07 cs.CV 新提交

SGF-CDNet: A Consistency-Discrepancy Graph Network over Semantic-Geometric Fused Nodes for Face Forgery Detection

SGF-CDNet:基于语义-几何融合节点的一致性-差异图网络用于人脸伪造检测

Jiayao Jiang, Bin Liu, Nenghai Yu

机构 * School of Cyber Science and Technology, University of Science and Technology of China(中国科学技术大学网络空间安全学院) Anhui Province Key Laboratory of Digital Security(安徽省数字安全重点实验室)

AI总结 针对人脸伪造检测,提出SGF-CDNet,通过融合语义与几何信息构建节点,利用双路径CD-GNN在一致性和差异两维度并行推理,有效识别面部组件间不和谐关系,实验证明性能优越。

Comments 6 pages, 4 figures. This work has been accepted at ICMEW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03758 2026-07-07 cs.RO cs.CR 新提交

Occluding the Solution Space: Planner-Agnostic Adversarial Attacks on Tolerance-Aware Manipulation

遮挡解空间:针对容错感知操纵的与规划器无关的对抗攻击

Keke Tang, Tianyu Hao, Weilong Peng, Hao Jiang, Feng Wu, Peican Zhu, Jianmin Ji, Zhihong Tian

机构 * Guangzhou University(广州大学) University of Science and Technology of China(中国科学技术大学) Northwestern Polytechnical University(西北工业大学)

AI总结 提出针对容错感知操纵的与规划器无关攻击框架,通过运动学占用热图刻画机器人能力,将攻击设为预算最大覆盖优化,实验表明该方法能可靠引发规划失败,优于基线。

Comments Accepted by IROS'2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03524 2026-07-07 cs.CV 新提交

Perceptual Flow Matching for Few-Step Generative Modeling

用于少步生成建模的感知流匹配

Chuyang Zhao, Yifei Song, Hongfa Wang, Jianlong Yuan, Yuan Zhang, Siming Fu, Zhineng Chen, Huilin Deng, Haoyang Huang, Nan Duan

机构 * Joy Future Academy(京东探索研究院) Fudan University(复旦大学) Tsinghua University(清华大学) USTC(中国科学技术大学)

AI总结 提出感知流匹配框架,在感知特征空间监督流匹配,改进少步生成能力,减少采样步骤,无需教师模型和辅助分数网络,实验表明其能产生高质量结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03512 2026-07-07 cs.RO 新提交

High-Precision Formation Control for Heterogeneous Multi-Robot Systems via Hierarchical Hybrid Physics-Informed Deep Reinforcement Learning

基于分层混合物理信息深度强化学习的异构多机器人系统高精度编队控制

Yanzhou Li, Guangli Chen, Xiao-Meng Li, Wenjian Zhong, Yongkang Lu, Shenghuang He

机构 * Dongguan Key Laboratory of Intelligent Equipment and Smart Industry, School of Advanced Engineering, Great Bay University(东莞智能装备与智能产业重点实验室,大湾区大学先进工程学院) Technische Universität Dresden(德累斯顿工业大学) School of Mechanical and Electrical Engineering, Guangzhou University(广州大学机电工程学院) University of Science and Technology of China(中国科学技术大学) College of Computer Science, Dongguan University of Technology(东莞理工学院计算机科学与技术学院)

AI总结 针对异构多机器人系统编队控制问题,提出分层混合物理信息深度强化学习框架。上层用深度强化学习设计领导者导航策略网络,下层整合多种控制器构建编队控制策略网络,设计分层奖励函数训练跟随者,实验验证方法有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03327 2026-07-07 cs.CV 新提交

From General Actions to Domain-Specific Monitoring: Prior-Adaptive Transfer for Skeleton-Based Action Recognition

从通用动作到特定领域监测:基于骨架的动作识别的先验自适应迁移

Hao Wang, Di Yang, Jiangtao Wang

机构 * University of Science and Technology of China(中国科学技术大学)

AI总结 研究基于骨架的动作识别模型在特定领域任务中表现不佳的问题,提出先验自适应迁移框架PATS,通过选择性保留相关先验并过滤冗余,经实验在阿尔茨海默病检测和跌倒检测任务中提升性能与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏