arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Nanjing University(南京大学)

2026-04-10 至 2026-04-10 共收录 7
2604.08547 2026-04-10 cs.CV cs.GR

GaussiAnimate: Reconstruct and Rig Animatable Categories with Level of Dynamics

GaussiAnimate:通过动态层次重建和 rig 可动画类别

Jiaxin Wang, Dongxin Lyu, Zeyu Cai, Zhiyang Dou, Cheng Lin, Anpei Chen, Yuliang Xiu

机构 * Westlake University(西湖大学) Nanjing University(南京大学) University of Hong Kong(香港大学) Macau University of Science and Technology(澳门科技大学)

AI总结 本文提出Skelebones系统,通过三个步骤将4D形状的动态层次压缩为可控且表达性强的骨架,实验证明在未见姿态下比LBS和BoB有显著提升,且在低数据条件下表现优异。

Comments Page: https://cookmaker.cn/gaussianimate

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08384 2026-04-10 eess.AS cs.AI

TASU2: Controllable CTC Simulation for Alignment and Low-Resource Adaptation of Speech LLMs

TASU2:用于语音大语言模型对齐和低资源适应的可控CTC模拟

Jing Peng, Chenghao Wang, Yi Yang, Lirong Qian, Junjie Li, Yu Xi, Shuai Wang, Kai Yu

机构 * X-LANCE Lab, Department of Computer Science and Engineering, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系X-LANCE实验室) MoE Key Lab of Artificial Intelligence(教育部人工智能重点实验室) Jiangsu Key Lab of Language Computing(江苏省语言计算重点实验室) AISpeech Ltd(思必驰科技股份有限公司) Nanjing University(南京大学)

AI总结 TASU2通过可控CTC模拟生成文本监督,提升语音大语言模型的对齐和低资源适应性能,优于TASU和文本细调等基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09928 2026-04-10 cs.RO

HiF-VLA: Hindsight, Insight and Foresight through Motion Representation for Vision-Language-Action Models

HiF-VLA:通过运动表示实现视觉-语言-动作模型的回顾、洞察与前瞻性

Minghui Lin, Pengxiang Ding, Shu Wang, Zifeng Zhuang, Yang Liu, Xinyang Tong, Wenxuan Song, Shangke Lyu, Siteng Huang, Donglin Wang

机构 * Westlake University(西湖大学) Zhejiang University(浙江大学) HKUST(GZ)(香港科技大学(广州)) Nanjing University(南京大学) Westlake Robotics(西湖机器人)

AI总结 HiF-VLA通过运动表示提升视觉-语言-动作模型的时序推理能力,采用回顾、洞察和前瞻性机制,在长时域任务中表现优异,且推理延迟低。

Comments CVPR 2026, Project page: https://hifvla.github.io, Github: https://github.com/OpenHelix-Team/HiF-VLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07997 2026-04-10 cs.CV

Few-Shot Incremental 3D Object Detection in Dynamic Indoor Environments

少样本增量式动态室内环境3D物体检测

Yun Zhu, Jianjun Qian, Jian Yang, Jin Xie, Na Zhao

机构 * Nanjing University of Science and Technology(南京理工大学) Nanjing University(南京大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 本文提出FI3Det框架,利用视觉语言模型学习未见类别知识,通过VLM引导模块和多模态原型模块实现高效3D感知,在ScanNet V2和SUN RGB-D数据集上取得显著提升。

Comments Accepted by CVPR 2026

Journal ref CVPR-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07989 2026-04-10 cs.IR cs.AI

Show Me the Infographic I Imagine: Intent-Aware Infographic Retrieval for Authoring Support

展示我所想象的图表:面向作者支持的意图感知图表检索

Jing Xu, Jiarui Hu, Zhihao Shuai, Yiyun Chen, Weikai Yang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanjing University(南京大学)

AI总结 本文提出意图感知图表检索框架,通过意图分类提升检索准确性,支持高效图表创作。

Comments Project homepage: https://infographicretrieval.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07931 2026-04-10 cs.LG

Robust Length Prediction: A Perspective from Heavy-Tailed Prompt-Conditioned Distributions

鲁棒长度预测:从重尾提示条件分布的角度

Jing Wang, Yu-Yang Qian, Ke Xue, Chao Qian, Peng Zhao, Zhi-Hua Zhou

机构 * State Key Laboratory of Novel Software Technology, Nanjing University(南京大学计算机软件新技术国家重点实验室) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院)

AI总结 本文提出通过重尾提示条件分布进行鲁棒长度预测,改进传统单次采样方法,提升预测稳定性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07737 2026-04-10 cs.CL

SepSeq: A Training-Free Framework for Long Numerical Sequence Processing in LLMs

SepSeq:一种无需训练的长数值序列处理框架

Jie Sun, Yu Liu, Lu Han, Qiwen Deng, Xiang Shu, Yang Xiao, Xingyu Lu, Jun Zhou, Pengfei Liu, Lintao Ma, Jiancan Wu, Xiang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Innovation Institute(上海创新研究院) Nanjing University(南京大学) University of Edinburgh(爱丁堡大学) East China Normal University(华东师范大学) Hong Kong Polytechnic University(香港理工大学) Zhejiang University(浙江大学) Ocean University of China(中国海洋大学)

AI总结 针对LLM处理长数值序列性能下降问题,提出SepSeq框架通过插入分隔符令牌缓解注意力分散,提升准确率并减少推理令牌消耗。

Comments 16 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏