arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

共收录 2393
2511.06830 2026-03-10 cs.CV

MUGSQA: Novel Multi-Uncertainty-Based Gaussian Splatting Quality Assessment Method, Dataset, and Benchmarks

MUGSQA:一种基于多不确定性因素的高斯点散布质量评估方法、数据集与基准测试

Tianang Chen, Jian Jin, Shilv Cai, Zhuangzi Li, Weisi Lin

机构 * Nanyang Technological University(南洋理工大学)

AI总结 MUGSQA提出了一种基于多不确定性的高斯点散布质量评估方法,构建了新的数据集和基准,用于评估不同重建方法的鲁棒性和现有质量评估指标的性能。

Comments ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08131 2026-03-10 cs.CV

Real-Time Motion-Controllable Autoregressive Video Diffusion

实时可控的自回归视频扩散

Kesen Zhao, Jiaxin Shi, Beier Zhu, Junbao Zhou, Xiaolong Shen, Yuan Zhou, Qianru Sun, Hanwang Zhang

机构 * Nanyang Technological University(南洋理工大学) Xmax.AI Ltd(Xmax.AI有限公司) Zhejiang University(浙江大学) Singapore Management University(新加坡国立大学)

AI总结 AR-Drag是一种基于强化学习的实时图像到视频生成模型,通过自回归机制和轨迹奖励模型实现高效运动控制,提升视频生成质量和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18485 2026-03-10 cs.CL cs.AI

A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models

一个简单的‘动机’可以增强大推理模型的强化微调

Junjie Zhang, Guozheng Ma, Shunyu Liu, Haoyu Wang, Jiaxing Huang, Ting-En Lin, Fei Huang, Yongbin Li, Dacheng Tao

机构 * Generative AI Lab, College of Computing and Data Science, Nanyang Technological University, Singapore(生成式人工智能实验室,计算与数据科学学院,南洋理工大学,新加坡) Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

AI总结 本文提出MeRF,通过在强化微调中引入任务动机,提升大模型在复杂任务中的推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03858 2026-03-10 cs.CV

Pose Prior Learner: Unsupervised Categorical Prior Learning for Pose Estimation

姿态先验学习器:无监督类别先验学习用于姿态估计

Ziyu Wang, Shuangpeng Han, Mengmi Zhang

机构 * Deep NeuroCognition Lab, Nanyang Technological University, Singapore(深神经认知实验室,南洋理工大学,新加坡)

AI总结 姿态先验学习器通过自监督学习为物体类别学习通用姿态先验,提升遮挡图像中的姿态估计准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17881 2026-03-10 cs.CV

Deepfake Generation and Detection: A Benchmark and Survey

深度伪造生成与检测:基准与综述

Gan Pei, Jiangning Zhang, Menghan Hu, Zhenyu Zhang, Chengjie Wang, Yunsheng Wu, Guangtao Zhai, Jian Yang, Dacheng Tao

机构 * East China Normal University(华东师范大学) Zhejiang University(浙江大学) Nanjing University(南京大学) Youtu Lab, Tencent(腾讯优图实验室) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 本文综述了深度伪造生成与检测的最新进展,分析了相关技术、数据集及未来研究方向。

Comments This paper has been accepted by ACM Computing Surveys. We closely follow the latest developments in this \href{https://github.com/flyingby/Awesome-Deepfake-Generation-and-Detection}{project}

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07020 2026-03-10 cs.LG cs.AI

RESCHED: Rethinking Flexible Job Shop Scheduling from a Transformer-based Architecture with Simplified States

RESCHED: 从基于Transformer的架构重新思考柔性作业车间调度

Xiangjie Xiao, Cong Zhang, Wen Song, Zhiguang Cao

机构 * School of Computing and Information Systems, Singapore Management University, Singapore(新加坡管理大学计算机与信息系) College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院) Institute of Marine Science and Technology, Shandong University, China(山东大学海洋科学与技术研究院)

AI总结 ReSched通过简化状态空间和改进架构,在柔性作业车间调度问题中实现了更高效和通用的调度方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06985 2026-03-10 cs.CV

Perception-Aware Multimodal Spatial Reasoning from Monocular Images

视感知-aware的多模态空间推理从单目图像

Yanchun Cheng, Rundong Wang, Xulei Yang, Alok Prakash, Daniela Rus, Marcelo H Ang, ShiJie Li

机构 * NUS, Singapore(新加坡国立大学) NTU, Singapore(新加坡国立大学) MIT, US(麻省理工学院) A*STAR, Singapore(新加坡科技研究局)

AI总结 本文提出了一种感知-aware的多模态推理框架,通过统一标记空间联合处理视觉证据和文本推理,提升单目图像空间推理的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06971 2026-03-10 cs.CV

SurgCUT3R: Surgical Scene-Aware Continuous Understanding of Temporal 3D Representation

SurgCUT3R: 术场景感知的连续时间3D表示理解

Kaiyuan Xu, Fangzhou Hong, Daniel Elson, Baoru Huang

机构 * The Hamlyn Centre for Robotic Surgery, Imperial College London(机器人手术中心,帝国理工学院伦敦分校) S-Lab, College of Computing and Data Science, Nanyang Technological University(S实验室, computing and Data Science学院,南洋理工大学) Department of Computer Science, University of Liverpool(计算机科学系,利物浦大学)

AI总结 SurgCUT3R通过数据生成、混合监督和分层推理框架,解决手术场景中3D重建的准确性和效率问题,实现稳健的重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06914 2026-03-10 cs.RO

SysNav: Multi-Level Systematic Cooperation Enables Real-World, Cross-Embodiment Object Navigation

SysNav:多级系统性合作实现现实世界跨载体物体导航

Haokun Zhu, Zongtai Li, Zihan Liu, Kevin Guo, Zhengzhi Lin, Yuxin Cai, Guofei Chen, Chen Lv, Wenshan Wang, Jean Oh, Ji Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) New York University(纽约大学) Nanyang Technological University(南洋理工大学)

AI总结 SysNav通过多级系统性合作实现现实世界跨载体物体导航,提升复杂环境下的导航效率与成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06704 2026-03-10 cs.CV cs.LG

On the Generalization Capacities of MLLMs for Spatial Intelligence

关于多模态大语言模型在空间智能中的泛化能力

Gongjie Zhang, Wenhao Li, Quanhao Qian, Jiuniu Wang, Deli Zhao, Shijian Lu, Ran Xu

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) HuPan Lab(虎朋实验室) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Camera-Aware MLLM框架,通过注入相机内参、数据增强和蒸馏几何先验,提升多模态大语言模型在空间任务中的泛化能力与鲁棒性。

Comments ICLR 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10285 2026-03-10 cs.AI

Reallocating Attention Across Layers to Reduce Multimodal Hallucination

跨层分配注意力以减少多模态幻觉

Haolang Lu, Bolun Chu, WeiYe Fu, Guoshun Nan, Junning Liu, Minghui Pan, Qiankun Li, Yi Yu, Hua Wang, Kun Wang

机构 * Beijing University of Posts and Telecommunications, China(北京邮电大学) Nanyang Technological University, Singapore(南洋理工大学) Guangxi Transportation Science and Technology Group, China(广西交通科学和技术集团)

AI总结 通过跨层分配注意力减少多模态幻觉,提升推理一致性和视觉忠实性。

Comments Acceptted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03505 2026-03-10 cs.AI

Parallelized Planning-Acting for Efficient LLM-based Multi-Agent Systems in Minecraft

并行规划-行动用于Minecraft中基于大语言模型的多智能体系统的高效性

Yaoru Li, Shunyu Liu, Tongya Zheng, Li Sun, Mingli Song

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Hangzhou City University(杭州市城市大学) Ningbo Global Innovation Center, Zhejiang University(宁波全球创新中心,浙江大学)

AI总结 本文提出了一种基于大语言模型的多智能体系统并行规划-行动框架,通过双线程架构实现同时规划和行动,提升Minecraft中动态决策的效率和响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06444 2026-03-09 cs.SD cs.AI

Prosodic Boundary-Aware Streaming Generation for LLM-Based TTS with Streaming Text Input

面向流式文本输入的语调边界感知流式生成用于基于大语言模型的语音合成

Changsong Liu, Tianrui Wang, Ye Ni, Yizhou Peng, Eng Siong Chng

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Tianjin University, China(天津大学) Southeast University, China(东南大学)

AI总结 本文提出一种面向语调边界的后训练策略,通过调整预训练模型以处理流式文本输入,从而提升语音合成的语调质量和长文本生成的稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06079 2026-03-09 eess.AS cs.AI eess.SP

StreamVoiceAnon+: Emotion-Preserving Streaming Speaker Anonymization via Frame-Level Acoustic Distillation

StreamVoiceAnon+: 通过帧级声学蒸馏实现情感保留的流式语音匿名化

Nikita Kuzmin, Kong Aik Lee, Eng Siong Chng

机构 * Nanyang Technological University, Singapore(南洋理工大学) Institute for Infocomm Research (I2R), A*STAR, Singapore(信息与通信研究所) The Hong Kong Polytechnic University, Hong Kong(香港理工大学)

AI总结 StreamVoiceAnon+通过帧级声学蒸馏和监督微调,在保持情感信息的同时实现高效的流式语音匿名化,提升情感保留率并保持隐私性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05925 2026-03-09 cs.CV cs.AI

RAC: Rectified Flow Auto Coder

RAC:修正流自编码器

Sen Fang, Yalin Feng, Yanxin Zhang, Dimitris N. Metaxas

机构 * Rutgers University(罗格斯大学) Nanyang Technological University(南洋理工大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

AI总结 RAC通过修正流改进VAE,实现多步解码和双向推断,提升生成质量并降低计算成本。

Comments 11 Figures, 4 Tables. Project Page at https://world-snapshot.github.io/RAC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03704 2026-03-09 cs.RO cs.AI

Large-Language-Model-Guided State Estimation for Partially Observable Task and Motion Planning

基于大语言模型的态估计用于部分可观测任务和运动规划

Yoonwoo Kim, Raghav Arora, Roberto Martín-Martín, Peter Stone, Ben Abbatematteo, Yoonchang Sung

机构 * The University of Texas at Austin(德克萨斯大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出CoCo-TAMP框架,利用大语言模型的常识推理能力,通过分层态估计提升部分可观测任务和运动规划的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16538 2026-03-09 cs.CV

OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding

OnlineSI: 通过大规模语言模型实现在线3D理解和定位

Zixian Liu, Zhaoxi Chen, Liang Pan, Ziwei Liu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Shanghai AI Lab(上海人工智能实验室)

AI总结 OnlineSI通过整合3D点云与语义信息,提升大规模语言模型在动态环境中的空间理解和物体识别能力。

Comments Project Page: https://onlinesi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05283 2026-03-09 cs.SE cs.AI

Software Development Life Cycle Perspective: A Survey of Benchmarks for Code Large Language Models and Agents

软件开发生命周期视角:代码大语言模型和代理的基准测试调查

Kaixin Wang, Tianlin Li, Xiaoyu Zhang, Chong Wang, Weisong Sun, Yang Liu, Aishan Liu, Xianglong Liu, Chao Shen, Bin Shi

机构 * Xi’an Jiaotong University(西安交通大学) Beihang University(北京航空航天大学) Nanyang Technological University(南洋理工大学)

AI总结 本文从软件开发生命周期视角调查代码大语言模型和代理的基准测试,揭示当前基准测试在覆盖方面的不平衡,并提出未来研究方向以缩小理论能力与实际应用之间的差距。

Comments Significantly enhanced the tiered analysis framework for a more comprehensive evaluation of CodeLLMs and Agents throughout the SDLC

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14273 2026-03-09 eess.AS cs.SD

Efficient Emotion and Speaker Adaptation in LLM-Based TTS via Characteristic-Specific Partial Fine-Tuning

基于特征特定部分微调的LLM语音合成中高效情感与说话人适应

Tianrui Wang, Meng Ge, Cheng Gong, Chunyu Qiang, Haoyu Wang, Zikang Huang, Yu Jiang, Ye Ni, Yuheng Lu, Xiaobao Wang, Engsiong Chng, Xie Chen, Longbiao Wang, Jianwu Dang

机构 * Tianjin Key Laboratory of Cognitive Computing and Application(天津认知计算与应用重点实验室) College of Intelligence and Computing(智能与计算学院) Tianjin University(天津大学) TeleAI, China Telecom(TeleAI,中国电信) Southeast University(东南大学) Shanghai Jiao Tong University(上海交通大学) Huiyan Technology Co., Ltd(慧言科技有限公司) Nanyang Technological University(南洋理工大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院)

AI总结 本文提出CSP-FT方法,通过特征特定部分微调提升LLM语音合成在情感和说话人适应中的性能,实现参数更新效率与模型表现的平衡。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09864 2026-03-09 cs.CV

AuthFace: Towards Authentic Blind Face Restoration with Face-oriented Generative Diffusion Prior

AuthFace: 向真实盲脸修复迈进的面向面部生成扩散先验

Guoqiang Liang, Qingnan Fan, Bingtao Fu, Jinwei Chen, Hong Gu, Lin Wang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) vivo Mobile Communication Co., Ltd(vivo移动通信有限公司) Nanyang Technological University(南洋理工大学)

AI总结 AuthFace通过面向面部的生成扩散先验和摄影引导标注,实现高质量盲脸修复,提升面部细节还原和减少关键区域伪影。

Comments ACM MM 25, Codes and datasets are available at https://github.com/EthanLiang99/AuthFace

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05134 2026-03-06 cs.CL cs.AI

LBM: Hierarchical Large Auto-Bidding Model via Reasoning and Acting

LBM:通过推理与行动构建的分层大自动竞价模型

Yewen Li, Zhiyi Lyu, Peng Jiang, Qingpeng Cai, Fei Pan, Bo An, Peng Jiang

机构 * Nanyang Technological University(南洋理工大学)

AI总结 本文提出LBM模型,通过分层推理与行动机制,结合双嵌入和GQPO技术,提升自动竞价策略的性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04999 2026-03-06 cs.CV

Physics-consistent deep learning for blind aberration recovery in mobile optics

基于物理的深度学习用于移动光学中盲性像差恢复

Kartik Jhawar, Tamo Sancho Miguel Tandoc, Khoo Jun Xuan, Wang Lipo

机构 * Institute for Digital Molecular Analytics and Science (IDMxS), Nanyang Technological University, Singapore 636921(数字分子分析与科学研究所(IDMxS)、南洋理工大学,新加坡636921) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore 639798(电气与电子工程学院、南洋理工大学,新加坡639798)

AI总结 本研究提出Lens2Zernike框架,通过结合物理约束和多任务学习,实现从单张模糊图像中盲性恢复光学参数,提升移动摄影中反卷积的稳定性与精度。

Comments 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04869 2026-03-06 cs.CV

SURE: Semi-dense Uncertainty-REfined Feature Matching

SURE: 半密集不确定性细化特征匹配

Sicheng Li, Zaiwang Gu, Jie Zhang, Qing Guo, Xudong Jiang, Jun Cheng

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University (NTU), Singapore(南洋理工大学电子与电气工程学院) Institute for Infocomm Research (I 2 R), Agency for Science, Technology and Research (A*STAR), Singapore(信息与通信研究 institute(I2R),科技研究局(A*STAR)) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR), Singapore(高性能计算研究所,科技研究局(A*STAR)) College of Computer Science, Nankai University, Tianjin, China(南开大学计算机学院)

AI总结 SURE通过建模偶然性和epistemic不确定性,联合预测对应关系及其置信度,提升半密集匹配的准确性和效率。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04514 2026-03-06 cs.AI

Progressive Refinement Regulation for Accelerating Diffusion Language Model Decoding

逐步细化调节以加速扩散语言模型解码

Lipeng Wan, Jianhui Gu, Junjie Ma, Jianguo Huang, Shiguang Sun, Siyuan Li, Xuguang Lan

机构 * Department of Artificial Intelligence, Xi'an Jiaotong University(人工智能系,西安交通大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) School of Computer Science and Technology, Harbin Institute of Technology(计算机科学与技术学院,哈尔滨工业大学)

AI总结 逐步细化调节通过动态控制细化规则提升扩散语言模型解码效率并保持生成质量。

Comments 19 pages, 10 figures, Code available upon publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04448 2026-03-06 cs.AI cs.CL cs.CV cs.LG cs.MA

SkillNet: Create, Evaluate, and Connect AI Skills

SkillNet: 创建、评估和连接AI技能

Yuan Liang, Ruobin Zhong, Haoming Xu, Chen Jiang, Yi Zhong, Runnan Fang, Jia-Chen Gu, Shumin Deng, Yunzhi Yao, Mengru Wang, Shuofei Qiao, Xin Xu, Tongtong Wu, Kun Wang, Yang Liu, Zhen Bi, Jungang Lou, Yuchen Eleanor Jiang, Hangcheng Zhu, Gang Yu, Haiwen Hong, Longtao Huang, Hui Xue, Chenxi Wang, Yijun Wang, Zifei Shan, Xi Chen, Zhaopeng Tu, Feiyu Xiong, Xin Xie, Peng Zhang, Zhengke Gui, Lei Liang, Jun Zhou, Chiyu Wu, Jin Shang, Yu Gong, Junyu Lin, Changliang Xu, Hongjie Deng, Wen Zhang, Keyan Ding, Qiang Zhang, Fei Huang, Ningyu Zhang, Jeff Z. Pan, Guilin Qi, Haofen Wang, Huajun Chen

机构 * Zhejiang University(浙江大学) Tongji University(同济大学) Southeast University(东南大学) Alibaba Group(阿里巴巴集团) Tencent(腾讯) Fudan University(复旦大学) The University of Edinburgh(爱丁堡大学) Monash University(墨尔本大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Huzhou University(湖州大学) Hornor Device Co., Ltd(Hornor设备有限公司) Hangzhou Institute for Advanced Study, UCAS(杭州先进研究所,UCAS)

AI总结 SkillNet通过统一的本体和多维评估机制,大规模创建、评估和连接AI技能,提升代理性能并促进技能的持久掌握。

Comments http://skillnet.openkg.cn/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04179 2026-03-06 cs.CV

NOVA3R: Non-pixel-aligned Visual Transformer for Amodal 3D Reconstruction

NOVA3R:非像素对齐的视觉变换器用于模态3D重建

Weirong Chen, Chuanxia Zheng, Ganlin Zhang, Andrea Vedaldi, Daniel Cremers

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Oxford(牛津大学) Nanyang Technological University(南洋理工大学)

AI总结 NOVA3R通过非像素对齐的视觉变换器实现更准确的3D重建,解决了传统像素对齐方法在处理可见和不可见点及重叠区域结构上的局限。

Comments Accepted to ICLR 2026. Project Page: https://wrchen530.github.io/nova3r

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03848 2026-03-06 eess.SY cs.MA cs.RO cs.SY

Dual-Interaction-Aware Cooperative Control Strategy for Alleviating Mixed Traffic Congestion

双交互感知的协同控制策略用于缓解混合交通拥堵

Zhengxuan Liu, Yuxin Cai, Yijing Wang, Xiangkun He, Chen Lv, Zhiqiang Zuo

机构 * Tianjin Key Laboratory of Intelligent Unmanned Swarm Technology and System, School of Electrical and Information Engineering, Tianjin University(天津智能无人群技术与系统重点实验室,电气与信息工程学院,天津大学) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学) Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(深圳高等研究院,电子科学与技术大学)

AI总结 本文提出双交互感知协同控制策略,通过去中心化决策模块、集中化批评者和奖励设计,提升混合交通瓶颈场景下的交通效率和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22796 2026-03-06 cs.CV

Parallel Diffusion Solver via Residual Dirichlet Policy Optimization

并行扩散求解器 via 剩余狄利克雷策略优化

Ruoyu Wang, Ziyu Li, Beier Zhu, Liangyu Yuan, Hanwang Zhang, Xun Yang, Xiaojun Chang, Chi Zhang

机构 * AGI lab, Westlake University(西溪大学AGI实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出EPD-Solver,通过并行梯度评估和狄利克雷策略优化,提升扩散模型的低延迟采样性能。

Comments arXiv admin note: substantial text overlap with arXiv:2507.14797

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17929 2026-03-06 cs.CV cs.AI

MambaTAD: When State-Space Models Meet Long-Range Temporal Action Detection

当状态空间模型与长程时序动作检测相遇:MambaTAD

Hui Lu, Yi Yu, Shijian Lu, Deepu Rajan, Boon Poh Ng, Alex C. Kot, Xudong Jiang

机构 * Rapid-Rich Object Search Lab, Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(跨学科研究生项目,南洋理工大学,新加坡) College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(电子与电气工程学院,南洋理工大学,新加坡)

AI总结 MambaTAD通过引入长程建模和全局特征检测能力,提升时序动作检测的准确性与效率。

Journal ref IEEE Transactions on Multimedia, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06068 2026-03-06 cs.RO cs.AI

MachaGrasp: Morphology-Aware Cross-Embodiment Dexterous Hand Articulation Generation for Grasping

MachaGrasp:基于形态的跨躯体灵巧手关节生成方法用于抓取

Heng Zhang, Kevin Yuchen Ma, Mike Zheng Shou, Weisi Lin, Yan Wu

机构 * Robotics & Autonomous Systems Division, Institute for Infocomm Research, Agency for Science, Technology and Research (A*STAR-I 2 R)(机器人与自主系统 division,信息通信研究所,科技研究局) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Show Lab, National University of Singapore(Show Lab,国立新加坡大学)

AI总结 MachaGrasp提出一种基于形态的跨躯体灵巧手抓取生成方法,通过形态嵌入和特征抓取集生成抓取动作,实现高成功率的抓取任务。

详情

展开后加载摘要…

URL PDF HTML 收藏