arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-08-18 至 2026-08-18 共收录 12
2608.16234 2026-08-18 cs.CV 新提交

GaussianDWM++: Language-Grounded 3D Gaussian Driving World Model for Unified Scene Understanding, Editing, and Multi-Modal Generation

GaussianDWM++:用于统一场景理解、编辑与多模态生成的语言接地3D高斯驾驶世界模型

Tianchen Deng, Xuefeng Chen, Shuang Wu, Qu Chen, Jiajun Zhu, Bo Dai, Jianfei Yang, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Tsinghua University(清华大学) Chongqing Afari Intelligent Drive Co., Ltd.(重庆阿法瑞智能驾驶有限公司) Nanyang Technological University(南洋理工大学)

AI总结 该研究提出GaussianDWM++,通过基础特征高斯分词器等模块构建统一框架,在多类驾驶任务中实现场景理解、编辑与多模态生成,性能达当前最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16031 2026-08-18 cs.LG cs.CV 新提交

AdROD: HyperNetwork-based Adversarially Robust Object Detection for Autonomous Driving

AdROD:面向自动驾驶的基于超网络的对抗鲁棒目标检测

Yuting Wu, Dongfang Guo, Xiangzhong Luo, Qun Song, Rui Tan

机构 * Nanyang Technological University(南洋理工大学) City University of Hong Kong(香港城市大学)

AI总结 AdROD是面向自动驾驶的嵌入式随机集成防御软件,采用低秩超网络与功能多样性机制,设两种服务模式,经多类评估优于基线防御,可在对抗场景下保持实时安全停车。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15766 2026-08-18 cs.RO 新提交

Tac4Loco: Learning Spatiotemporal Plantar Pressure Representations for Humanoid Locomotion

Tac4Loco:学习用于人形机器人运动的时空足底压力表征

Ziyun Liu, Sikai Guo, Zheng Li, Jiahang Cao, Haichao Liu, Pei Qu, Yinghong Zhang, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Tac4Loco框架,通过构建拓扑保持的序数表征提取足底压力时空特征,结合增强本体感知训练非对称演员-评论家策略,提升人形机器人在复杂地形的运动性能并实现零样本部署。

Comments 9 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15705 2026-08-18 cs.CV 新提交

PixelControl: Fine-Grained Condition Fidelity in Text-to-Image Diffusion

PixelControl:文本到图像扩散中的细粒度条件保真度

Xin Lin, Haodong Li, Zhifei Zhang, Yutong Yang, Haitian Zheng, Juanxi Tian, Zhe Lin, Truong Nguyen

机构 * Adobe Research(奥多比研究院) Nanyang Technological University(南洋理工大学) University of California San Diego(加州大学圣迭戈分校)

AI总结 针对可控文本到图像扩散模型细粒度结构保真度不足的问题,提出PixelControl框架,通过结构感知控制注入与多尺度金字塔循环损失等设计,提升了边界及中/小区域的结构保真度。

Comments The project homepage can be found: this https URL (https://linxin0.github.io/pixelcontrol_homepage/pixelcontrol-site/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15695 2026-08-18 cs.CV 新提交

Bitstream Action Recognition is Byte Modeling

比特流动作识别即字节建模

Fangcheng Li, Chaoran Huang, Tianyi Liu, Wenyang Liu, Kejun Wu, Qiong Liu, You Yang, Zhengguo Li

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院) School of Electrical and Electronics Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院) Institute for Infocomm Research, Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局信息通信研究院)

AI总结 该研究针对比特流损坏导致动作识别失效的问题,提出BRACE框架,结合RBCS构建首个大规模BAR数据集,实验表明其鲁棒性优于对比方法。

Comments 10 pages; supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15573 2026-08-18 cs.RO 新提交

Not All History Helps: Velocity-Aware Selective Memory for Long-Horizon End-to-End Autonomous Driving

并非所有历史都有用:面向长 horizon 端到端自动驾驶的速度感知选择性记忆

Yuchen Liu, Ziying Song, Shengkai Zhang, Jiannan Chen, Peiliang Wu, Lei Yang, Bin Sun, Yan Gong, Li Wang

机构 * Nanyang Technological University(南洋理工大学) North University of China(中北大学) Yanshan University(燕山大学) Beijing Jiaotong University(北京交通大学) China Automotive Technology and Research Center Co., Ltd.(中国汽车技术研究中心有限公司) Harbin Institute of Technology(哈尔滨工业大学) Beijing Institute of Technology(北京理工大学)

AI总结 针对长 horizon 端到端自动驾驶的历史规划状态不可靠问题,提出 StableDrive 模型,通过 SMM 与 MSTS 实现规划优化,在多个数据集上取得规划指标的 SOTA 性能。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15490 2026-08-18 cs.RO 新提交

Vision-Based Tactile Intelligence for Robotics: Sensing, Learning, and Embodied Manipulation

机器人基于视觉的触觉智能:感知、学习与具身操作

Peng Zhou, Jun Hu, Sihan Chen, Zeqing Zhang, Haofei Ma, Zhenyu Lu, Sichao Liu, Xueqian Wang, Pai Zheng, Xiang Li, Shan Luo, Jia Pan, David Navarro-Alarcon, Chenguang Yang, Michael Yu Wang

机构 * Great Bay University(大湾区大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学) The Hong Kong Polytechnic University(香港理工大学) South China University of Technology(华南理工大学) KTH Royal Institute of Technology(瑞典皇家理工学院) King’s College London(伦敦国王学院)

AI总结 本综述调研机器人领域基于视觉的触觉传感器(VBTSs)全流程,对其硬件分类、学习方法、仿真与数据集等展开分析,指出开放挑战,以推进接触密集型机器人任务的触觉智能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15354 2026-08-18 cs.AI 新提交

Incoherent by Design? On the Moral Self-Consistency of LLMs

天生不连贯?大型语言模型的道德自我一致性研究

Pegah Nokhiz, Aravinda Kanchana Ruwanpathirana, Helen Nissenbaum

机构 * Cornell University(康奈尔大学) Cornell Tech(康奈尔科技学院) Nanyang Technological University(南洋理工大学)

AI总结 本研究针对GPT、Mistral、Llama等LLM,在义务论等三大伦理框架下,发现其道德推理存在最高78%的矛盾率,内部不连贯是AI对齐的必要前提。

Comments 88 pages; pages 16 to 88 are the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15113 2026-08-18 cs.CV cs.AI cs.LG 新提交

Fast Test-Time Refinement for Robust Learned Image Compression

用于鲁棒学习型图像压缩的快速测试时精化

Jiaming Liang, Chi-Man Pun, Weisi Lin

机构 * University of Macau(澳门大学) Nanyang Technological University(南洋理工大学)

AI总结 本文针对学习型图像压缩的对抗脆弱性问题,揭示其非对称对抗轨迹特性,提出快速测试时精化框架,经多系统多攻击评估验证了该框架的鲁棒性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14730 2026-08-18 cs.CV cs.CR cs.LG 新提交

IP Protection in the Era of Visual Generative AI: A Survey

视觉生成AI时代的知识产权保护:一项综述

Zhuan Shi, Shunchang Liu, Alireza Dehghanpour Farashah, Qian Yang, Han Yu, Cao Yang, Chaochao Chen, Yuping Yan, Yaochu Jin, Golnoosh Farnadi, Lingjuan Lyu

机构 * Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) McGill University(麦吉尔大学) EPFL(洛桑联邦理工学院) Université de Montréal(蒙特利尔大学) Nanyang Technological University(南洋理工大学) Science Tokyo(东京理科大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Sony Research(索尼研究院)

AI总结 本综述针对视觉生成AI带来的知识产权风险,提出二维分类体系梳理相关防御方法,对齐评估协议并探讨挑战,为该领域研究者提供系统概述。

Comments 35 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16180 2026-08-18 cs.LG math.DG 新提交

Demystifying Oversmoothing in Sheaf Neural Networks: An Index-Theoretic Criterion

揭开层神经网络(Sheaf Neural Networks, SNNs)中的过度平滑之谜:一种指标理论判据

Junwen Dong, Yuhan Peng, Hao Li, Huitao Feng, Kelin Xia

机构 * Chern Institute of Mathematics(陈省身数学研究所) Nankai University(南开大学) School of Physical and Mathematical Sciences(物理与数学科学学院) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 本研究针对层神经网络的过度平滑问题,提出指标理论比较判据,引入GyroSheaf扩展至非线性场景,经十个模型实验验证了该判据的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15124 2026-08-18 cs.LG math.OC 新提交

Decision-Driven Regularization: A Blended Model for Learning and Optimization

决策驱动正则化:一种用于学习与优化的混合模型

Gar Goei Loke, Qinshen Tang, Yangge Xiao, Xun Zhang

机构 * Durham University Business School(杜伦大学商学院) Nanyang Business School, Nanyang Technological University(南洋理工大学南洋商学院) Faculty of Business and Economics, The University of Melbourne(墨尔本大学商学院与经济学院) International Institute of Finance, School of Management, University of Science and Technology of China(中国科学技术大学管理学院国际金融研究所)

AI总结 针对上下文优化中分离式学习与优化易致决策有效性下降的问题,提出决策驱动正则化框架,平衡预测精度与代价最小化,可推广SPO+,在合成研究中优于多个基准模型。

Comments 42 pages (including appendix), 7 figures in main, journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏