arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

共收录 2393
2512.09407 2026-02-17 cs.CV

Geometry-to-Image Synthesis-Driven Generative Point Cloud Registration

基于几何到图像合成的生成式点云配准

Haobo Jiang, Jin Xie, Jian Yang, Liang Yu, Jianmin Zheng

机构 * ANGEL CorpLab and College of Computing and Data Science, Nanyang Technological University, Singapore(ANGEL CorpLab和计算与数据科学学院,南洋理工大学,新加坡) Alibaba Cloud, Alibaba Group, China(阿里巴巴云,阿里巴巴集团,中国) PCA Lab, VCIP, College of Computer Science, Nankai University, China(PCA实验室,VCIP,计算机科学学院,南开大学,中国) State Key Laboratory for Novel Software Technology & Schoolof Intelligence Science and Technology, Nanjing University, China(新型软件技术国家重点实验室与智能科学与技术学校,南京大学,中国)

AI总结 本文提出生成式点云配准方法,通过生成跨视角一致的图像对,结合几何与颜色特征融合,提升3D配准性能。

Comments Journal extension of the ICML 2025 paper "Generative Point Cloud Registration". This version adopts a new title, and includes substantial methodological improvements, additional experiments, and extended analysis. Under review at IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16701 2026-02-17 cs.AI

An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems

基于大语言模型的代理框架用于解决复杂车辆路径问题

Ni Zhang, Zhiguang Cao, Jianan Zhou, Cong Zhang, Yew-Soon Ong

机构 * School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡管理大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 本文提出基于大语言模型的代理框架AFL,实现复杂车辆路径问题的完全自动化,通过分解任务和协调代理提升解决方案的可靠性和可行性。

Comments Accepted by iclr2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13086 2026-02-16 cs.RO

UniManip: General-Purpose Zero-Shot Robotic Manipulation with Agentic Operational Graph

UniManip: 通用目的零样本机器人操作的代理操作图

Haichao Liu, Yuanjiang Xue, Yuheng Zhou, Haoyuan Deng, Yinan Liang, Lihua Xie, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) Department of Automation, Tsinghua University, China(清华大学自动化系)

AI总结 UniManip通过双层代理操作图实现通用零样本机器人操作,结合高层任务协调与底层动态状态表示,提升无监督环境下的执行鲁棒性。

Comments 15 pages, 12 figures, 6 tables, project page: https://henryhcliu.github.io/unimanip

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13071 2026-02-16 cs.LG cs.AI

Bus-Conditioned Zero-Shot Trajectory Generation via Task Arithmetic

基于公交时间表的零样本轨迹生成

Shuai Liu, Ning Cao, Yile Chen, Yue Jiang, Gao Cong

机构 * College of Computing(计算学院) Data Science, Nanyang Technological University, Singapore(数据科学,南洋理工大学,新加坡)

AI总结 本文提出MobTA方法,通过任务算术实现基于公交时间表的零样本轨迹生成,无需目标城市真实数据即可生成符合其移动模式的轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12922 2026-02-16 cs.CV

Beyond Benchmarks of IUGC: Rethinking Requirements of Deep Learning Methods for Intrapartum Ultrasound Biometry from Fetal Ultrasound Videos

超越IUGC基准:重新思考深度学习方法在胎儿超声视频中的产程超声生物测量需求

Jieyun Bai, Zihao Zhou, Yitong Tang, Jie Gan, Zhuonan Liang, Jianan Fan, Lisa B. Mcguire, Jillian L. Clarke, Weidong Cai, Jacaueline Spurway, Yubo Tang, Shiye Wang, Wenda Shen, Wangwang Yu, Yihao Li, Philippe Zhang, Weili Jiang, Yongjie Li, Salem Muhsin Ali Binqahal Al Nasim, Arsen Abzhanov, Numan Saeed, Mohammad Yaqub, Zunhui Xian, Hongxing Lin, Libin Lan, Jayroop Ramesh, Valentin Bacher, Mark Eid, Hoda Kalabizadeh, Christian Rupprecht, Ana I. L. Namburete, Pak-Hei Yeung, Madeleine K. Wyburd, Nicola K. Dinsdale, Assanali Serikbey, Jiankai Li, Sung-Liang Chen, Zicheng Hu, Nana Liu, Yian Deng, Wei Hu, Cong Tan, Wenfeng Zhang, Mai Tuyet Nhi, Gregor Koehler, Rapheal Stock, Klaus Maier-Hein, Marawan Elbatel, Xiaomeng Li, Saad Slimani, Victor M. Campello, Benard Ohene-Botwe, Isaac Khobo, Yuxin Huang, Zhenyan Han, Hongying Hou, Di Qiu, Zheng Zheng, Gongning Luo, Dong Ni, Yaosheng Lu, Karim Lekadir, Shuo Li

机构 * Department of Cardiovascular Surgery, The First Affiliated Hospital of Jinan University, Jinan University, Guangzhou, China Auckland Bioengineering Institute, The University of Auckland, Auckland, New Zealand School of Computer Science, University of Sydney, Sydney, Australia Neonatology, Sydney Medical School Nepean, University of Sydney Nepean Hospital, Penrith, New South Wales, Australia Discipline of Medical Imaging, Faculty of Medicine Health, Susan Wakil Health Building, University of Sydney, Camperdown, New South Wales, Australia Medical Imaging, Orange Health Service, Orange, New South Wales, Australia University of Electronic Science Henan Kaifeng College of Science Technology Changchun University of Science University of Western Brittany, Brest, France Sichuan University, Chengdu, China Department of Machine Learning, Mohamed bin Zayed University of Artificial Intelligence, Masdar, Abu Dhabi College of Computer Science Engineering, Chongqing University of Technology, Chongqing, China Oxford Machine Learning in NeuroImaging Lab, Department of Computer Science, University of Oxford, Oxford, United Kingdom Visual Geometry Group, University of Oxford, Oxford, United Kingdom School of Computer Science Engineering, Nanyang Technological University, Singapore The University of Michigan-Shanghai Jiao Tong University Joint Institute, Shanghai Jiao Tong University, Shanghai, China College of Computer Information Science, Chongqing Normal University, Chongqing, China The University of Manchester, Manchester, United Kingdom Southwest University, Chongqing, China Division of Medical Image Computing, German Cancer Research Center (DKFZ), Heidelberg, Germany Department of Electronic Computer Engineering, The Hong Kong University of Science Chief Medical Officer Deepecho Ibn Rochd CHU, Hassan II University, Casablanca, Morocco Department of Radiography, School of Biomedical Allied Health Sciences, College of Health Sciences, University of Ghana, Accra Department of Human Biology, Biomedical Engineering Research Center, University of Cape Town, Cape Town, South Africa Gynecology Center, Zhujiang Hospital, Southern Medical University, Guangzhou, China Department of Obstetrics Gynecology, Third Affiliated Hospital of Sun Yat-sen University, Guangzhou, China Gynecology, The First Affiliated Hospital of Jinan University, Guangzhou, China Children's Medical Center, Guangdong Provincial Clinical Research Center for Child Health, Guangzhou, China Engineering Division, King Abdullah University of Science Shenzhen University, Shenzhen, China Artificial Intelligence in Medicine Lab (BCN-AIM), Barcelona, Spain School of Biomedical Engineering, Case Western Reserve University, Cleveland, OH, USA

AI总结 本研究提出了一种多任务自动测量框架,用于产程超声生物测量,旨在解决资源有限环境下超声技师短缺的问题,并通过公开数据集和基准结果促进该领域的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12613 2026-02-16 cs.LG

Coden: Efficient Temporal Graph Neural Networks for Continuous Prediction

Coden: 为连续预测设计的高效时序图神经网络

Zulun Zhu, Siqiang Luo

机构 * College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 Coden是一种为连续预测设计的高效时序图神经网络,通过克服现有模型的复杂性瓶颈,实现了动态图的高效学习和预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11850 2026-02-16 cs.CV cs.LG

Free Lunch for Stabilizing Rectified Flow Inversion

为稳定修正流反向操作获取免费午餐

Chenru Wang, Beier Zhu, Chi Zhang

机构 * Westlake University(西湖大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出PMI和mimic-CFG方法,通过稳定速度场提升修正流反向操作的稳定性与重建质量,减少计算资源消耗。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09600 2026-02-16 cs.CV

Hand2World: Autoregressive Egocentric Interaction Generation via Free-Space Hand Gestures

Hand2World: 通过自由空间手势生成自主回归的视角交互

Yuxi Wang, Wenqi Ouyang, Tianyi Wei, Yi Dong, Zhiqi Shen, Xingang Pan

机构 * College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 Hand2World通过自由空间手势生成视角交互,利用自回归框架解决遮挡、相机运动解耦和长视频生成问题,提升视觉生成的质量与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12273 2026-02-13 math.OC cs.LG cs.NA math.NA

Learning to Control: The iUzawa-Net for Nonsmooth Optimal Control of Linear PDEs

学习控制:用于线性偏微分方程非光滑最优控制的iUzawa-Net

Yongcun Song, Xiaoming Yuan, Hangrui Yue, Tianyou Zeng

机构 * Division of Mathematical Sciences, School of Physical and Mathematical Sciences, Nanyang Technological University(南洋理工大学数学科学系) Department of Mathematics, The University of Hong Kong(香港大学数学系) School of Mathematical Sciences, Nankai University(南开大学数学学院)

AI总结 iUzawa-Net是一种用于非光滑最优控制的深度学习方法,结合了模型优化和数据驱动技术,实现线性PDE的实时求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11902 2026-02-13 cs.LG cs.AI

Mitigating Mismatch within Reference-based Preference Optimization

缓解基于参考的偏好优化中的不匹配

Suqin Yuan, Xingrui Yu, Jiyang Zheng, Lei Feng, Dadong Wang, Ivor Tsang, Tongliang Liu

机构 * Sydney AI Centre, The University of Sydney(悉尼人工智能中心,悉尼大学) CFAR, A*STAR(CFAR,A*STAR) CSIRO, Data61(CSIRO,Data61) Southeast University(东南大学) Nanyang Technological University(南洋理工大学)

AI总结 HyPO通过有条件地去偏参考信号缓解基于参考的偏好优化中的不匹配问题,提升推理对齐性能。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22488 2026-02-13 eess.SP cs.LG

EEG-to-Gait Decoding via Phase-Aware Representation Learning

通过相意识表示学习实现EEG到步态解码

Xi Fu, Weibang Jiang, Rui Liu, Gernot R. Müller-Putz, Cuntai Guan

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore 639798(计算与数据科学学院,南洋理工大学,新加坡) Department of Computer Science and Engineering, Shanghai Jiao Tong University, Shanghai 200240, China(计算机科学与工程系,上海交通大学,上海) Institute of Neural Engineering, Graz University of Technology, Graz, Austria(神经工程研究所,格拉茨技术大学,奥地利) Centre of AI in Medicine (C-AIM), Nanyang Technological University, Singapore(医学人工智能中心(C-AIM),南洋理工大学,新加坡)

AI总结 NeuroDyGait通过相意识表示学习实现EEG到步态解码,提升跨受试者性能并满足实时BCI需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03757 2026-02-13 eess.SP cs.LG

EEG2GAIT: A Hierarchical Graph Convolutional Network for EEG-based Gait Decoding

EEG2GAIT:一种用于基于EEG的步态解码的分层图卷积网络

Xi Fu, Rui Liu, Aung Aung Phyo Wai, Hannah Pulferer, Neethu Robinson, Gernot R Müller-Putz, Cuntai Guan

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Institute of Neural Engineering, Graz University of Technology(技术大学神经工程研究所) Center for Al in Medicine (C-AlM)(医学人工智能中心)

AI总结 EEG2GAIT通过分层图卷积网络和混合时间-频域奖励损失函数,实现了基于EEG的步态解码,提升了解码性能和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15189 2026-02-13 cs.RO

RM-RL: Role-Model Reinforcement Learning for Precise Robot Manipulation

RM-RL:基于角色模型的强化学习用于精确机器人操控

Xiangyu Chen, Chuhao Zhou, Yuxi Liu, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(马斯实验室,南洋理工大学)

AI总结 RM-RL通过角色模型策略实现精确机器人操控,无需人类示范,提升在线和离线训练效率,实验显示在现实任务中精度显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08025 2026-02-12 cs.CV cs.AI

MIND: Benchmarking Memory Consistency and Action Control in World Models

MIND:世界模型中内存一致性与动作控制的基准测试

Yixuan Ye, Xuanyu Lu, Yuxin Jiang, Yuchao Gu, Rui Zhao, Qiwei Liang, Jiachun Pan, Fengda Zhang, Weijia Wu, Alex Jinpeng Wang

机构 * CSU-JPG, Central South University(中南大学) National University of Singapore(新加坡国立大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学)

AI总结 MIND提出首个开放域闭环基准,评估世界模型的内存一致性和动作控制能力,揭示当前模型在长期记忆保持和动作空间泛化上的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16415 2026-02-12 cs.CL cs.AI cs.LG

Attributing Response to Context: A Jensen-Shannon Divergence Driven Mechanistic Study of Context Attribution in Retrieval-Augmented Generation

基于Jensen-Shannon散度的响应归因研究:一种驱动上下文归因的机理研究

Ruizhe Li, Chen Chen, Yuchen Hu, Yanjun Gao, Xi Wang, Emine Yilmaz

机构 * University of Aberdeen(阿伯丁大学) Nanyang Technological University(南洋理工大学) University College London(伦敦大学学院) University of Colorado Anschutz Medical Campus(科罗拉多大学安舒兹医学校区) University of Sheffield(谢菲尔德大学)

AI总结 本文提出基于Jensen-Shannon散度的ARC-JSD方法,实现高效准确的上下文归因,提升RAG模型的性能和效率。

Comments Accepted at ICLR 2026; Best Paper Award at COLM 2025 XLLM-Reason-Plan Workshop; Accepted at NeurIPS 2025 Mechanistic Interpretability Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10171 2026-02-12 cs.SE cs.AI

EvoCodeBench: A Human-Performance Benchmark for Self-Evolving LLM-Driven Coding Systems

EvoCodeBench:用于自演化LLM驱动编码系统的性能基准

Wentao Zhang, Jianfeng Wang, Liheng Liang, Yilei Zhao, HaiBin Wen, Zhe Zhao

机构 * Nanyang Technological University(南洋理工大学) East China University of Science and Technology(东华大学) Guangdong Ocean University(广东海洋大学) City University of Hong Kong(香港城市大学) Stanford University(斯坦福大学)

AI总结 EvoCodeBench通过跨语言对比和人类表现评估,评估自演化LLM驱动编码系统的性能提升与效率改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10161 2026-02-12 cs.CR cs.AI cs.CL

Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment

跨模态冲突下的全方位安全:漏洞、动态机制和高效对齐

Kun Wang, Zherui Li, Zhenhong Zhou, Yitong Zhang, Yan Mi, Kun Yang, Yiming Zhang, Junhao Dong, Zhongxiang Sun, Qiankun Li, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Renmin University of China(中国人民大学)

AI总结 本文提出OmniSteer方法,通过提取黄金拒绝向量和轻量级适配器提升多模态模型的安全性与通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10122 2026-02-12 cs.CY cs.AI

A Practical Guide to Agentic AI Transition in Organizations

组织中代理AI转型的实用指南

Eranga Bandara, Ross Gore, Sachin Shetty, Sachini Rajapakse, Isurunima Kularathna, Pramoda Karunarathna, Ravi Mukkamala, Peter Foytik, Safdar H. Bouk, Abdul Rahman, Xueping Liang, Amin Hass, Tharaka Hewa, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(旧 Dominion 大学) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学) Center for Wireless Communications, University of Oulu(无线通信中心,奥卢大学) University of Sri Jayewardenepura(斯里贾yenepura大学) Accenture Technology Labs(埃森哲技术实验室)

AI总结 本文提出了一种实用框架,帮助组织将手动流程转型为自动化代理AI系统,通过领域驱动用例识别、任务委托给AI代理及人机协同模型实现可持续的自动化与业务价值对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16659 2026-02-12 cs.LG cs.AI

Provably Robust Bayesian Counterfactual Explanations under Model Changes

可证明鲁棒的贝叶斯反事实解释 under 模型变化

Jamie Duell, Xiuyi Fan

机构 * School of Computing and Digital Technologies(计算与数字技术学院) Sheffield Hallam University(谢菲尔德哈姆大学) Lee Kong Chian School of Medicine(李科金医学院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出PSCE方法,通过概率安全和鲁棒性保证,在模型变化下生成更可靠且具有判别性的反事实解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10094 2026-02-11 cs.CV

4RC: 4D Reconstruction via Conditional Querying Anytime and Anywhere

4RC: 通过条件查询随时任何地方进行4D重建

Yihang Luo, Shangchen Zhou, Yushi Lan, Xingang Pan, Chen Change Loy

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) VGG, University of Oxford(牛津大学视觉几何组)

AI总结 4RC通过条件查询实现4D重建,提供统一的前馈框架,同时捕捉密集场景几何和运动动态,优于现有方法。

Comments Project page: https://yihangluo.com/projects/4RC/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09973 2026-02-11 cs.RO

RoboInter: A Holistic Intermediate Representation Suite Towards Robotic Manipulation

RoboInter: 一种面向机器人操控的综合中间表示套件

Hao Li, Ziqin Wang, Zi-han Ding, Shuai Yang, Yilun Chen, Yang Tian, Xiaolin Hu, Tai Wang, Dahua Lin, Feng Zhao, Si Liu, Jiangmiao Pang

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北航) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 RoboInter通过统一的中间表示套件,提升机器人操控中视觉-语言-动作系统的泛化能力和推理能力。

Comments Published to ICLR 2026, 69 pages, 40 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09825 2026-02-11 cs.CV

SAKED: Mitigating Hallucination in Large Vision-Language Models via Stability-Aware Knowledge Enhanced Decoding

SAKED: 通过稳定性感知知识增强解码缓解大视觉-语言模型中的幻觉

Zhaoxu Li, Chenqi Kong, Peijun Bao, Song Xia, Yi Tu, Yi Yu, Xinghao Jiang, Xudong Jiang

机构 * ROSE Lab, School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(ROSE实验室,电子工程学院,南洋理工大学,新加坡) ROSE Lab, Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(ROSE实验室,跨学科研究生项目,南洋理工大学,新加坡) School of Physical and Mathematical Sciences, Nanyang Technological University, Singapore(物理与数学科学学院,南洋理工大学,新加坡) Shanghai Jiao Tong University, China(上海交通大学,中国)

AI总结 SAKED通过引入稳定性感知知识增强解码方法,有效缓解大视觉-语言模型中的幻觉问题,无需训练即可集成至不同架构中,实现最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09736 2026-02-11 cs.CV

Toward Fine-Grained Facial Control in 3D Talking Head Generation

迈向3D说话人脸生成中的细粒度面部控制

Shaoyang Xie, Xiaofeng Cong, Baosheng Yu, Zhipeng Gui, Jie Gui, Yuan Yan Tang, James Tin-Yau Kwok

机构 * School of Cyber Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李科金医学院) School of Remote Sensing and Information Engineering, Wuhan University(武汉大学遥感与信息工程学院) Purple Mountain Laboratories, Nanjing(南京紫金山实验室) Engineering Research Center of Blockchain Application, Supervision And Management (Southeast University), Ministry of Education(教育部区块链应用、监督与管理工程研究中心(东南大学)) Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学系) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

AI总结 本文提出FG-3DGS框架,通过频率感知解耦策略实现细粒度面部控制,提升3D说话人脸生成的精度和唇同步效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09411 2026-02-11 cs.CV

K-Sort Eval: Efficient Preference Evaluation for Visual Generation via Corrected VLM-as-a-Judge

K-Sort Eval: 通过校正VLM作为评判者实现视觉生成的高效偏好评估

Zhikai Li, Jiatong Li, Xuewen Liu, Wangbo Zhao, Pan Du, Kaicheng Zhou, Qingyi Gu, Yang You, Zhen Dong, Kurt Keutzer

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of California, Berkeley(加州大学伯克利分校) University of California, Santa Barbara(加州大学圣巴巴拉分校) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 K-Sort Eval通过后验校正和动态匹配策略,实现高效可靠的视觉生成模型偏好评估。

Comments ICLR 2026. Code is available at: https://github.com/zkkli/K-Sort-Eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09007 2026-02-11 cs.AI cs.CV

GEBench: Benchmarking Image Generation Models as GUI Environments

GEBench: 图形用户界面生成模型的基准测试

Haodong Li, Jingwei Wu, Quan Sun, Guopeng Li, Juanxi Tian, Huanyu Zhang, Yanlin Lai, Ruichuan An, Hongbo Peng, Yuhong Dai, Chenxi Li, Chunmei Qing, Jia Wang, Ziyang Meng, Zheng Ge, Xiangyu Zhang, Daxin Jiang

机构 * StepFun South China University of Technology(南方科技大学) Peking University(北京大学) Tsinghua University(清华大学) Institute of Automation Chinese Academy of Sciences(中国科学院自动化研究所) The University of Chicago(芝加哥大学) Nanyang Technological University(南洋理工大学)

AI总结 GEBench提出一个评估GUI生成模型动态交互和时间一致性的基准测试,通过五维指标揭示模型在多步交互中的瓶颈问题。

Comments 23 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08030 2026-02-11 cs.AI cs.CL

Free(): Learning to Forget in Malloc-Only Reasoning Models

Free(): 学会遗忘的仅malloc推理模型

Yilun Zheng, Dongyang Ma, Tian Liang, Jiahao Xu, Xinting Huang, Lihui Chen, Haitao Mi, Yan Wang

机构 * Tencent AI Lab(腾讯AI实验室) Nanyang Technological University(南洋理工大学)

AI总结 Free()LM通过引入内在自我遗忘机制,解决推理模型中过多思考标记导致性能下降的问题,实现模型在不同规模上的性能提升,并在长周期任务中恢复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07358 2026-02-11 cs.LG

UTOPIA: Unlearnable Tabular Data via Decoupled Shortcut Embedding

UTOPIA: 通过解耦的快捷嵌入实现不可学习的表格数据

Jiaming He, Fuming Luo, Hongwei Li, Wenbo Jiang, Wenshu Fan, Zhenbo Shi, Xudong Jiang, Yi Yu

机构 * University of Electronic Science and Technology of China(电子科学与技术大学) Independent Researcher(独立研究者) University of Science and Technology of China(科学技术大学) Nanyang Technological University(南洋理工大学)

AI总结 UTOPIA通过解耦的快捷嵌入方法,实现对敏感表格数据的不可学习保护,有效阻止未经授权的模型训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08847 2026-02-10 cs.LG cs.AI

Dr. MAS: Stable Reinforcement Learning for Multi-Agent LLM Systems

Dr. MAS:多智能体大语言模型系统的稳定强化学习

Lang Feng, Longtao Zheng, Shuo He, Fuxiang Zhang, Bo An

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 Dr. MAS通过智能体级归一化方法稳定多智能体大语言模型的强化学习训练,提升性能并减少梯度不稳定问题。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08753 2026-02-10 cs.CV

MVAnimate: Enhancing Character Animation with Multi-View Optimization

MVAnimate: 通过多视角优化提升角色动画

Tianyu Sun, Zhoujie Fu, Bang Zhang, Guosheng Lin

机构 * College of Computing and Data Science (CCDS), Nanyang Technological University(计算与数据科学学院(CCDS),南洋理工大学) Alibaba Group(阿里巴巴集团)

AI总结 MVAnimate通过多视角优化提升角色动画质量,结合2D和3D信息生成更逼真且高质量的动画视频。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08439 2026-02-10 cs.CV

Demo-ICL: In-Context Learning for Procedural Video Knowledge Acquisition

Demo-ICL: 用于过程视频知识获取的上下文学习

Yuhao Dong, Shulin Tian, Shuai Liu, Shuangrui Ding, Yuhang Zang, Xiaoyi Dong, Yuhang Cao, Jiaqi Wang, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) Shanghai AI Lab(上海人工智能实验室) CUHK-MMLab(香港大学多媒体实验室)

AI总结 Demo-ICL通过两阶段训练策略提升模型从上下文示例中学习的能力,针对视频理解中的新挑战提出Demo-ICL-Bench基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏