arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-08-18 至 2026-08-18 共收录 19
2608.16234 2026-08-18 cs.CV 新提交

GaussianDWM++: Language-Grounded 3D Gaussian Driving World Model for Unified Scene Understanding, Editing, and Multi-Modal Generation

GaussianDWM++:用于统一场景理解、编辑与多模态生成的语言接地3D高斯驾驶世界模型

Tianchen Deng, Xuefeng Chen, Shuang Wu, Qu Chen, Jiajun Zhu, Bo Dai, Jianfei Yang, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Tsinghua University(清华大学) Chongqing Afari Intelligent Drive Co., Ltd.(重庆阿法瑞智能驾驶有限公司) Nanyang Technological University(南洋理工大学)

AI总结 该研究提出GaussianDWM++,通过基础特征高斯分词器等模块构建统一框架,在多类驾驶任务中实现场景理解、编辑与多模态生成,性能达当前最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16031 2026-08-18 cs.LG cs.CV 新提交

AdROD: HyperNetwork-based Adversarially Robust Object Detection for Autonomous Driving

AdROD:面向自动驾驶的基于超网络的对抗鲁棒目标检测

Yuting Wu, Dongfang Guo, Xiangzhong Luo, Qun Song, Rui Tan

机构 * Nanyang Technological University(南洋理工大学) City University of Hong Kong(香港城市大学)

AI总结 AdROD是面向自动驾驶的嵌入式随机集成防御软件,采用低秩超网络与功能多样性机制,设两种服务模式,经多类评估优于基线防御,可在对抗场景下保持实时安全停车。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15766 2026-08-18 cs.RO 新提交

Tac4Loco: Learning Spatiotemporal Plantar Pressure Representations for Humanoid Locomotion

Tac4Loco:学习用于人形机器人运动的时空足底压力表征

Ziyun Liu, Sikai Guo, Zheng Li, Jiahang Cao, Haichao Liu, Pei Qu, Yinghong Zhang, Jinni Zhou, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Tac4Loco框架,通过构建拓扑保持的序数表征提取足底压力时空特征,结合增强本体感知训练非对称演员-评论家策略,提升人形机器人在复杂地形的运动性能并实现零样本部署。

Comments 9 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15705 2026-08-18 cs.CV 新提交

PixelControl: Fine-Grained Condition Fidelity in Text-to-Image Diffusion

PixelControl:文本到图像扩散中的细粒度条件保真度

Xin Lin, Haodong Li, Zhifei Zhang, Yutong Yang, Haitian Zheng, Juanxi Tian, Zhe Lin, Truong Nguyen

机构 * Adobe Research(奥多比研究院) Nanyang Technological University(南洋理工大学) University of California San Diego(加州大学圣迭戈分校)

AI总结 针对可控文本到图像扩散模型细粒度结构保真度不足的问题,提出PixelControl框架,通过结构感知控制注入与多尺度金字塔循环损失等设计,提升了边界及中/小区域的结构保真度。

Comments The project homepage can be found: this https URL (https://linxin0.github.io/pixelcontrol_homepage/pixelcontrol-site/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15695 2026-08-18 cs.CV 新提交

Bitstream Action Recognition is Byte Modeling

比特流动作识别即字节建模

Fangcheng Li, Chaoran Huang, Tianyi Liu, Wenyang Liu, Kejun Wu, Qiong Liu, You Yang, Zhengguo Li

机构 * School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院) School of Electrical and Electronics Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院) Institute for Infocomm Research, Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局信息通信研究院)

AI总结 该研究针对比特流损坏导致动作识别失效的问题,提出BRACE框架,结合RBCS构建首个大规模BAR数据集,实验表明其鲁棒性优于对比方法。

Comments 10 pages; supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15573 2026-08-18 cs.RO 新提交

Not All History Helps: Velocity-Aware Selective Memory for Long-Horizon End-to-End Autonomous Driving

并非所有历史都有用:面向长 horizon 端到端自动驾驶的速度感知选择性记忆

Yuchen Liu, Ziying Song, Shengkai Zhang, Jiannan Chen, Peiliang Wu, Lei Yang, Bin Sun, Yan Gong, Li Wang

机构 * Nanyang Technological University(南洋理工大学) North University of China(中北大学) Yanshan University(燕山大学) Beijing Jiaotong University(北京交通大学) China Automotive Technology and Research Center Co., Ltd.(中国汽车技术研究中心有限公司) Harbin Institute of Technology(哈尔滨工业大学) Beijing Institute of Technology(北京理工大学)

AI总结 针对长 horizon 端到端自动驾驶的历史规划状态不可靠问题,提出 StableDrive 模型,通过 SMM 与 MSTS 实现规划优化,在多个数据集上取得规划指标的 SOTA 性能。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15490 2026-08-18 cs.RO 新提交

Vision-Based Tactile Intelligence for Robotics: Sensing, Learning, and Embodied Manipulation

机器人基于视觉的触觉智能:感知、学习与具身操作

Peng Zhou, Jun Hu, Sihan Chen, Zeqing Zhang, Haofei Ma, Zhenyu Lu, Sichao Liu, Xueqian Wang, Pai Zheng, Xiang Li, Shan Luo, Jia Pan, David Navarro-Alarcon, Chenguang Yang, Michael Yu Wang

机构 * Great Bay University(大湾区大学) Tsinghua University(清华大学) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学) The Hong Kong Polytechnic University(香港理工大学) South China University of Technology(华南理工大学) KTH Royal Institute of Technology(瑞典皇家理工学院) King’s College London(伦敦国王学院)

AI总结 本综述调研机器人领域基于视觉的触觉传感器(VBTSs)全流程,对其硬件分类、学习方法、仿真与数据集等展开分析,指出开放挑战,以推进接触密集型机器人任务的触觉智能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15354 2026-08-18 cs.AI 新提交

Incoherent by Design? On the Moral Self-Consistency of LLMs

天生不连贯?大型语言模型的道德自我一致性研究

Pegah Nokhiz, Aravinda Kanchana Ruwanpathirana, Helen Nissenbaum

机构 * Cornell University(康奈尔大学) Cornell Tech(康奈尔科技学院) Nanyang Technological University(南洋理工大学)

AI总结 本研究针对GPT、Mistral、Llama等LLM,在义务论等三大伦理框架下,发现其道德推理存在最高78%的矛盾率,内部不连贯是AI对齐的必要前提。

Comments 88 pages; pages 16 to 88 are the appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15113 2026-08-18 cs.CV cs.AI cs.LG 新提交

Fast Test-Time Refinement for Robust Learned Image Compression

用于鲁棒学习型图像压缩的快速测试时精化

Jiaming Liang, Chi-Man Pun, Weisi Lin

机构 * University of Macau(澳门大学) Nanyang Technological University(南洋理工大学)

AI总结 本文针对学习型图像压缩的对抗脆弱性问题,揭示其非对称对抗轨迹特性,提出快速测试时精化框架,经多系统多攻击评估验证了该框架的鲁棒性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14730 2026-08-18 cs.CV cs.CR cs.LG 新提交

IP Protection in the Era of Visual Generative AI: A Survey

视觉生成AI时代的知识产权保护:一项综述

Zhuan Shi, Shunchang Liu, Alireza Dehghanpour Farashah, Qian Yang, Han Yu, Cao Yang, Chaochao Chen, Yuping Yan, Yaochu Jin, Golnoosh Farnadi, Lingjuan Lyu

机构 * Mila - Quebec AI Institute(米拉-魁北克人工智能研究所) McGill University(麦吉尔大学) EPFL(洛桑联邦理工学院) Université de Montréal(蒙特利尔大学) Nanyang Technological University(南洋理工大学) Science Tokyo(东京理科大学) Zhejiang University(浙江大学) Westlake University(西湖大学) Sony Research(索尼研究院)

AI总结 本综述针对视觉生成AI带来的知识产权风险,提出二维分类体系梳理相关防御方法,对齐评估协议并探讨挑战,为该领域研究者提供系统概述。

Comments 35 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16180 2026-08-18 cs.LG math.DG 新提交

Demystifying Oversmoothing in Sheaf Neural Networks: An Index-Theoretic Criterion

揭开层神经网络(Sheaf Neural Networks, SNNs)中的过度平滑之谜:一种指标理论判据

Junwen Dong, Yuhan Peng, Hao Li, Huitao Feng, Kelin Xia

机构 * Chern Institute of Mathematics(陈省身数学研究所) Nankai University(南开大学) School of Physical and Mathematical Sciences(物理与数学科学学院) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 本研究针对层神经网络的过度平滑问题,提出指标理论比较判据,引入GyroSheaf扩展至非线性场景,经十个模型实验验证了该判据的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15124 2026-08-18 cs.LG math.OC 新提交

Decision-Driven Regularization: A Blended Model for Learning and Optimization

决策驱动正则化:一种用于学习与优化的混合模型

Gar Goei Loke, Qinshen Tang, Yangge Xiao, Xun Zhang

机构 * Durham University Business School(杜伦大学商学院) Nanyang Business School, Nanyang Technological University(南洋理工大学南洋商学院) Faculty of Business and Economics, The University of Melbourne(墨尔本大学商学院与经济学院) International Institute of Finance, School of Management, University of Science and Technology of China(中国科学技术大学管理学院国际金融研究所)

AI总结 针对上下文优化中分离式学习与优化易致决策有效性下降的问题,提出决策驱动正则化框架,平衡预测精度与代价最小化,可推广SPO+,在合成研究中优于多个基准模型。

Comments 42 pages (including appendix), 7 figures in main, journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26833 2026-08-18 cs.LG cs.AI 版本更新

Periodic Topological Deep Learning for Polymer Design and Discovery

周期性拓扑深度学习用于聚合物设计与发现

Yasharth Yadav, Tze Kwang Gerald Er, Atsushi Goto, Kelin Xia

机构 * School of Physical and Mathematical Sciences, Nanyang Technological University, Singapore 637371(新加坡南洋理工大学物理与数学科学学院) School of Chemistry, Chemical Engineering and Biotechnology (CCEB), Nanyang Technological University, Singapore 637371(新加坡南洋理工大学化学、化工与生物技术学院)

AI总结 提出基于周期性Vietoris-Rips复形和层次单纯形消息传递的深度学习框架Periodic-TDL,通过捕捉多体相互作用和长程信息,在聚合物性质预测任务上超越现有模型,并验证了酯到酰胺取代和α-甲基化对热稳定性的提升。

Comments 22 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13221 2026-08-18 cs.AI cs.LG 版本更新

An Agentic AI Framework with Large Language Models and Chain-of-Thought for UAV-Assisted Logistics Scheduling with Mobile Edge Computing

基于大语言模型和链式推理的智能AI框架用于无人机辅助物流调度与移动边缘计算

Hanwen Zhang, Dusit Niyato, Wei Zhang, Xin Lou, Malcolm Yoke Hean Low

机构 * Nanyang Technological University(南洋理工大学) Singapore Institute of Technology(新加坡理工学院) Seatrium New Energy Laboratory(Seatrium 新能源实验室) Ministry of Education (MOE) Tier 1(教育部 Tier 1) Research Innovation and Enterprise (RIE) 2025 Industry Alignment Fund-Industry Collaboration Projects (IAF-ICP)(研究创新与企业 (RIE) 2025 行业对齐基金-行业合作项目 (IAF-ICP))

AI总结 本文提出结合大语言模型和链式推理的智能AI框架,用于解决无人机辅助物流调度中的混合调度问题,通过分层深度强化学习实现无人机路由和任务执行优化,提升物流效率与任务完成率。

Comments 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09041 2026-08-18 cs.CL cs.CR 版本更新

BiAxisBias: Evaluating LLM Bias Beyond a Single Prompt and a Single Explanation

BiAxisAudit:一种评估大语言模型偏见的新框架,跨提示敏感性和响应层分歧

Jialing Gan, Junhao Dong, Songze Li

机构 * Southeast University, China(东南大学) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 本文提出BiAxisAudit框架,通过双轴评估方法揭示LLM偏见的跨提示敏感性和响应层分歧,解决单一指标无法捕捉的偏见问题。

Comments 19 pages, 6 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08974 2026-08-18 cs.CV cs.AI 版本更新

Tracking the Truth: Object-Centric Spatio-Temporal Monitoring for Video Large Language Models

追踪真相:面向视频大语言模型的物体感知时空监控

Tri Cao, Khoi Le, Thong Nguyen, Cong-Duy Nguyen, Quynh Vo, Anh Tuan Luu, Chunyan Miao, See-Kiong Ng, Shuicheng Yan, Bryan Hooi

机构 * National University of Singapore(新加坡国立大学) VinUniversity(文大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出STEMO-Bench基准测试,通过分解查询验证时空监控能力,改进视频大语言模型的时空推理一致性。

Comments The authors are withdrawing this manuscript due to errors identified in the experimental evaluation and result aggregation, which affect several reported quantitative results and some conclusions. These issues require substantial re-evaluation of the experiments and analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06264 2026-08-18 cs.LG 版本更新

Can Attribution Predict Risk? From Multi-View Attribution to Planning Risk Signals in End-to-End Autonomous Driving

属性能否预测风险?从多视图属性到端到端自动驾驶中的规划风险信号

Le Yang, Haijun Liu, Jiawei Liang, ShangQuan Sun, Xiaochun Cao

机构 * Sun Yat-sen University(中山大学) University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出了一种层次化属性框架,用于端到端规划中的风险预测,通过提取三种属性统计作为预测信号,提升了对轨迹误差和碰撞检测的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22415 2026-08-18 cs.CV cs.AI 版本更新

Evidence Recomposition and Predictive Context Residualization for Visual Attribution in Multimodal Large Language Models

多模态大语言模型中用于视觉归因的证据重组与预测上下文残差化

Jiawei Liang, Jianjie Huang, Xianghao Jiao, Siyuan Liang, Shiming Liu, Xiaochun Cao

机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Zhongguancun Academy(中关村学院) University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学) Department of Mechanical Engineering, Imperial College London(伦敦帝国理工学院机械工程系)

AI总结 研究多模态大语言模型token级视觉证据难检查问题,提出基于证据重组和预测上下文残差化的ERCR框架,经实验验证该框架能改善目标token视觉证据、减轻上下文干扰,为视觉证据检查提供实用改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09105 2026-08-18 cs.AI 版本更新

SMA: Who Said That? Auditing Membership Leakage in Semi-Black-box RAG Controlling

SMA:谁说的?半黑盒RAG控制中的成员泄露审计

Shixuan Sun, Siyuan Liang, Jianjie Huang, Jingzhi Li, Xiaochun Cao

机构 * Sun Yat-Sen University(孙中山大学) Nanyang Technological University(南洋理工大学) University of Chinese Academy of Science(中国科学院大学) Zhongguancun Academy(中关村学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

AI总结 本研究针对半黑盒RAG控制中的成员泄露问题,提出首个源感知成员审计SMA,通过零阶优化归因估计机制与跨模态归因技术,实现生成内容的细粒度来源归因,为复杂生成系统的数据来源审计提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏