arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Nanyang Technological University(南洋理工大学)

2026-04-16 至 2026-04-16 共收录 11
2604.14062 2026-04-16 cs.CV cs.MM

OneHOI: Unifying Human-Object Interaction Generation and Editing

OneHOI:统一人类-物体交互生成与编辑

Jiun Tian Hoe, Weipeng Hu, Xudong Jiang, Yap-Peng Tan, Chee Seng Chan

机构 * Nanyang Technological University(南洋理工大学) Sun Yat-sen University(中山大学) Universiti Malaya(马来亚大学) VinUniversity(文大学)

AI总结 OneHOI提出一种统一的扩散变换框架,整合人类-物体交互生成与编辑,通过共享的交互表示实现单条件去噪过程,支持多种控制模式,取得生成与编辑的最新成果。

Comments Accepted at CVPR2026. This paper moves toward unifying HOI generation and editing within a single model

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14025 2026-04-16 cs.CV cs.AI cs.GR

Feed-Forward 3D Scene Modeling: A Problem-Driven Perspective

前馈3D场景建模:以问题为导向的视角

Weijie Wang, Qihang Cao, Sensen Gao, Donny Y. Chen, Haofei Xu, Wenjing Bian, Songyou Peng, Tat-Jen Cham, Chuanxia Zheng, Andreas Geiger, Jianfei Cai, Jia-Wang Bian, Bohan Zhuang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Monash University(墨尔本大学) ETH Zurich(苏黎世联邦理工学院) University of Tübingen(图宾根大学)

AI总结 本文探讨了前馈3D重建的通用方法,提出以模型设计为核心的分类体系,涵盖特征增强、几何意识、模型效率等五个核心问题,旨在推动3D场景建模的标准化与可扩展性。

Comments 67 pages, 395 references. Project page: https://ff3d-survey.github.io. Code: https://github.com/ziplab/Awesome-Feed-Forward-3D. This work has been submitted to Springer for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01410 2026-04-16 cs.AI

GraphScout: Empowering Large Language Models with Intrinsic Exploration Ability for Agentic Graph Reasoning

GraphScout: 通过内在探索能力增强大语言模型以实现代理图推理

Yuchen Ying, Weiqi Jiang, Tongya Zheng, Yu Wang, Shunyu Liu, Kaixuan Chen, Mingli Song

机构 * Zhejiang University(浙江大学) Hangzhou City University(杭州市大学) Nanyang Technological University(南洋理工大学)

AI总结 GraphScout通过灵活的图探索工具,使模型自主生成结构化训练数据,从而在无需人工标注的情况下提升大语言模型的图推理能力,实验显示其在多个领域表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20352 2026-04-16 cs.AI

AMA: Adaptive Memory via Multi-Agent Collaboration

AMA:通过多智能体协作实现自适应记忆

Weiquan Huang, Zixuan Wang, Hehai Lin, Sudong Wang, Bo Xu, Qian Li, Beier Zhu, Linyi Yang, Chengwei Qin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Shandong University(山东大学) Nanyang Technological University(南洋理工大学) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出AMA框架,通过多智能体协作实现自适应记忆管理,解决传统方法在记忆粒度和一致性维护上的不足,实验表明其在长上下文任务中表现优异,减少约80%的token消耗。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13581 2026-04-16 cs.CV

SocialMirror: Reconstructing 3D Human Interaction Behaviors from Monocular Videos with Semantic and Geometric Guidance

SocialMirror: 从单目视频中利用语义和几何引导重建3D人体交互行为

Qi Xia, Peishan Cong, Ziyi Wang, Yujing Sun, Qin Sun, Xinge Zhu, Mao Ye, Ruigang Yang, Yuexin Ma

机构 * ShanghaiTech University(上海科技大学) Nanyang Technological University(南洋理工大学) Guangzhou Institute of Energy Conversion, CAS(广州能源研究所,中国科学院) University of Science and Technology of China(中国科学技术大学) The Chinese University of Hong Kong(香港中文大学) Inceptio Technology(Inceptio科技) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出SocialMirror框架,通过语义和几何引导解决单目视频中人体重建的挑战,实现高精度交互行为重建,展现强大的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13509 2026-04-16 cs.CV

DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer

DiT作为实时重绘器:基于自回归扩散变换器的流式视频风格化

Hengye Lyu, Zisu Li, Yue Hong, Yueting Weng, Jiaxin Shi, Hanwang Zhang, Chen Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) XMax.AI Ltd.(XMax人工智能有限公司) Nanyang Technological University(南洋理工大学)

AI总结 本文提出RTR-DiT框架,通过微调双向教师模型和知识蒸馏实现高效视频风格化,支持文本和参考图像引导,实现实时稳定处理长视频和风格切换。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13275 2026-04-16 cs.CL cs.LG

Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size

更大与更小:如何在模型规模下语境同步发生分歧

Dikshant Kukreja, Kshitij Sah, Gautam Gupta, Avinash Anand, Rajiv Ratn Shah, Zhengkui Wang, Aik Beng Ng, Erik Cambria

机构 * IIIT Delhi, India(德里印度理工学院) Nanyang Technological University(南洋理工大学) NVIDIA(NVIDIA公司) Singapore Institute of Technology(新加坡理工学院)

AI总结 研究探讨了模型规模对语境同步的影响,发现大模型在忽略虚假信息方面更有效,但对无关token的忽略能力下降,揭示了语义过滤与机械复制的对立行为。

Comments 16 pages, 11 figures, 6 tables. Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11064 2026-04-16 cs.LG cs.CV

A Faster Path to Continual Learning

连续学习的更快路径

Wei Li, Hangjie Yuan, Zixiang Zhao, Borui Kang, Ziwei Liu, Tao Feng

机构 * College of Computer Science, Sichuan University, China(四川大学计算机学院) College of Computer Science and Technology, Zhejiang University, China(浙江大学计算机科学与技术学院) Photogrammetry and Remote Sensing Lab, ETH Zürich, Switzerland(苏黎世联邦理工学院摄影测量与遥感实验室) School of Computer Science, Nanjing University, China(南京大学计算机科学系) College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算与数据科学学院) Department of Computer Science and Technology, Tsinghua University, China(清华大学计算机科学与技术系)

AI总结 本文提出C-Flat Turbo,通过优化梯度计算减少连续学习的训练成本,提升效率并保持性能。

Comments Update Author Affiliations

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07717 2026-04-16 cs.RO cs.CV

RoboTAG: End-to-end Robot Configuration Estimation via Topological Alignment Graph

RoboTAG: 通过拓扑对齐图实现端到端的机器人配置估计

Yifan Liu, Fangneng Zhan, Wanhua Li, Haowen Sun, Katerina Fragkiadaki, Hanspeter Pfister

机构 * Tsinghua University(清华大学) Harvard University(哈佛大学) Massachusetts Institute of Technology(麻省理工学院) Nanyang Technological University(南洋理工大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出RoboTAG,通过结合3D和2D分支,利用拓扑对齐图缓解对标签的依赖,提升机器人姿态估计的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00555 2026-04-16 cs.CR cs.AI cs.CL

Activation-Guided Local Editing for Jailbreaking Attacks

基于激活的局部编辑对抗攻击

Jiecong Wang, Haoran Li, Hao Peng, Ziqian Zeng, Zihao Wang, Haohua Du, Zhengtao Yu

机构 * Beihang University(北航) Hangzhou Innovation Institute(杭州创新研究院) HKUST(香港科技大学) South China University of Technology(华南理工大学) Nanyang Technological University(南洋理工大学) Kunming University of Science and Technology(昆明理工大学)

AI总结 本文提出一种两阶段框架,结合上下文生成与隐藏状态信息,有效提升对抗攻击的成功率和可迁移性,对抗当前防御机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16005 2026-04-16 cond-mat.mtrl-sci cs.AI cs.LG

Autonomous Multi-objective Alloy Design through Simulation-guided Optimization

通过模拟引导的优化实现自主多目标合金设计

Penghui Yang, Chendong Zhao, Bijun Tang, Zhonghan Zhang, Xinrun Wang, Yanchen Deng, Xuyu Dong, Yuhao Lu, Jianguo Huang, Yixuan Li, Yushan Xiao, Cuntai Guan, Zheng Liu, Bo An

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore 639798, Singapore(南洋理工大学计算机与数据科学学院,新加坡) School of Materials Science and Engineering, Nanyang Technological University, Singapore 639798, Singapore(南洋理工大学材料科学与工程学院,新加坡) School of Computing and Information Systems, Singapore Management University, Singapore 188065, Singapore(新加坡管理学院计算机与信息学院,新加坡) School of Materials Science and Engineering, Shanghai Jiao Tong University, Shanghai 200240, China(上海交通大学材料科学与工程学院,中国) Institute for Functional Intelligent Materials, National University of Singapore, Singapore(新加坡国立大学功能智能材料研究所,新加坡)

AI总结 本文提出AutoMAT框架,整合大语言模型、自动化CALPHAD模拟等技术,实现自主合金设计,发现高性能合金并缩短研发周期。

详情

展开后加载摘要…

URL PDF HTML 收藏