arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

共收录 2400
2511.04555 2025-12-08 cs.RO cs.CV

Evo-1: Lightweight Vision-Language-Action Model with Preserved Semantic Alignment

Evo-1:轻量级视觉-语言-动作模型,保持语义对齐

Tao Lin, Yilei Zhong, Yuxin Du, Jingjing Zhang, Jiting Liu, Yinxinyu Chen, Encheng Gu, Ziyan Liu, Hongyi Cai, Yanwen Zou, Lixing Zou, Zhaoye Zhou, Gen Li, Bo Zhao

机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) EvoMind Tech(EvoMind科技) IAAR-Shanghai(IAAR-上海) SII Carnegie Mellon University(卡内基梅隆大学) University of Cambridge(剑桥大学) Nanyang Technological University(南洋理工大学)

AI总结 Evo-1是一种轻量级的视觉-语言-动作模型,通过减少计算并保持语义对齐,实现了高效的部署和强大的性能。

Comments Github: https://github.com/MINT-SJTU/Evo-1

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22143 2025-12-08 cs.CV

3D Question Answering via only 2D Vision-Language Models

仅通过2D视觉-语言模型实现3D问答

Fengyun Wang, Sicheng Yu, Jiawei Wu, Jinhui Tang, Hanwang Zhang, Qianru Sun

机构 * Nanyang Technological University, Singapore Singapore Management University, Singapore National University of Singapore, Singapore Nanjing University of Science \& Technology, Nanjing, China

AI总结 本文提出cdViews方法,通过仅使用2D视觉-语言模型,实现3D问答任务的高性能表现。

Comments ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04785 2025-12-05 cs.AI cs.CR

ASTRIDE: A Security Threat Modeling Platform for Agentic-AI Applications

ASTRIDE:面向智能体AI应用的安全威胁建模平台

Eranga Bandara, Amin Hass, Ross Gore, Sachin Shetty, Ravi Mukkamala, Safdar H. Bouk, Xueping Liang, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(老奥布里恩大学) Accenture Technology Labs(埃森哲技术实验室) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学)

AI总结 ASTRIDE是首个专为AI智能体应用设计的自动化威胁建模平台,通过扩展STRIDE框架并结合微调的视觉语言模型与推理LLM,实现基于图的威胁建模自动化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10901 2025-12-05 cs.CV cs.AI cs.LG

A Gray-box Attack against Latent Diffusion Model-based Image Editing by Posterior Collapse

针对基于潜在扩散模型的图像编辑的灰盒攻击

Zhongliang Guo, Chun Tong Lei, Lei Fang, Shuai Zhao, Yifei Qian, Jingyu Lin, Zeyu Wang, Cunjian Chen, Ognjen Arandjelović, Chun Pong Lau

机构 * School of Computer Science, University of St Andrews(圣安德鲁大学计算机科学学院) Department of Data Science, City University of Hong Kong(香港城市大学数据科学系) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) School of Computer Science, University of Nottingham(诺丁汉大学计算机科学学院) Department of Data Science and Artificial Intelligence, Monash University(墨尔本大学数据科学与人工智能系) College of Information Science & Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院)

AI总结 本文提出了一种基于后验崩溃现象的灰盒攻击方法,通过调整参数实现两种崩溃类型,有效防止未经授权的图像编辑,且对模型依赖低,计算效率高。

Comments 15 pages, 9 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04597 2025-12-05 cs.CV cs.AI cs.LG cs.RO

When Robots Should Say "I Don't Know": Benchmarking Abstention in Embodied Question Answering

机器人何时应说'我不知道':身体化问答中退避的基准测试

Tao Wu, Chuhao Zhou, Guangyu Zhao, Haozhi Cao, Yewen Pu, Jianfei Yang

机构 * Nanyang Technological University(南洋理工大学) Peking University(北京大学)

AI总结 本文研究了身体化问答中退避机制的重要性,通过构建AbstainEQA数据集,发现人类在退避任务中表现优异,而模型退避能力有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03377 2025-12-05 cs.CL

Nexus: Higher-Order Attention Mechanisms in Transformers

Nexus:Transformer中的高阶注意力机制

Hanting Chen, Chong Zhu, Kai Han, Yuchuan Tian, Yuchen Liang, Tianyu Guo, Xinghao Chen, Dacheng Tao, Yunhe Wang

机构 * Nanyang Technological University(南洋理工大学) Huawei Noah's Ark Lab(华为诺亚实验室)

AI总结 Nexus通过递归框架和动态注意力机制提升Transformer的表示能力,突破线性瓶颈并优于标准Transformer。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03280 2025-12-05 cs.LG cs.AI cs.CL

FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion

FusionBench: 一种统一的库和全面的深度模型融合基准

Anke Tang, Li Shen, Yong Luo, Enneng Yang, Han Hu, Lefei Zhang, Bo Du, Dacheng Tao

机构 * School of Computer Science, National Engineering Research Center for Multimedia Software and Hubei Key Laboratory of Multimedia and Network Communication Engineering, Wuhan University, Wuhan, China(计算机学院、多媒体软件国家工程研究中心、多媒体与网络通信工程湖北省重点实验室、武汉大学) Shenzhen Campus of Sun Yat-sen University, China(中山大学深圳校区) Beijing Institute of Technology, Beijing, China(北京理工大学) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 FusionBench 是首个用于深度模型融合的统一库和基准,提供多种任务和设置以评估融合方法的有效性和鲁棒性。

Comments Project homepage: https://github.com/tanganke/fusion_bench Online documentation: https://tanganke.github.io/fusion_bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03939 2025-12-04 cs.CV cs.RO

MUT3R: Motion-aware Updating Transformer for Dynamic 3D Reconstruction

MUT3R:面向动态3D重建的运动感知更新Transformer

Guole Shen, Tianchen Deng, Xingrui Qin, Nailin Wang, Jianyu Wang, Yanbo Wang, Yongtao Chen, Hesheng Wang, Jingchuan Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 MUT3R通过利用预训练Transformer的运动线索,在无需训练的情况下抑制动态内容,提升动态场景下的3D重建时间一致性和姿态鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03905 2025-12-04 cs.CV

Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence

无监督视频翻译与编辑中的帧空间-时间对应

Shuai Yang, Junxin Lin, Yifan Zhou, Ziwei Liu, Chen Change Loy

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

AI总结 FRESCO通过整合帧内与帧间对应关系,提升视频翻译与编辑的空间-时间一致性,实现高质量、一致的视频生成。

Comments Code: https://github.com/Sunnycookies/FRESCO-v2, Project: https://williamyang1991.github.io/projects/FRESCOv2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03059 2025-12-04 cs.LG

Safe and Sustainable Electric Bus Charging Scheduling with Constrained Hierarchical DRL

安全且可持续的电动巴士充电调度与受约束的分层深度强化学习

Jiaju Qi, Lei Lei, Thorsteinn Jonsson, Dusit Niyato

机构 * College of Engineering, University of Guelph(圭尔夫大学工程学院) EthicalAI College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 本文提出了一种安全且可持续的电动巴士充电调度方法,采用受约束的分层深度强化学习框架,通过整合拉格朗日松弛实现安全与成本的优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18212 2025-12-04 cs.AI cs.LG

A Definition of AGI

AGI 的定义

Dan Hendrycks, Dawn Song, Christian Szegedy, Honglak Lee, Yarin Gal, Erik Brynjolfsson, Sharon Li, Andy Zou, Lionel Levine, Bo Han, Jie Fu, Ziwei Liu, Jinwoo Shin, Kimin Lee, Mantas Mazeika, Long Phan, George Ingebretsen, Adam Khoja, Cihang Xie, Olawale Salaudeen, Matthias Hein, Kevin Zhao, Alexander Pan, David Duvenaud, Bo Li, Steve Omohundro, Gabriel Alfour, Max Tegmark, Kevin McGrew, Gary Marcus, Jaan Tallinn, Eric Schmidt, Yoshua Bengio

机构 * Center for AI Safety(AI安全中心) University of California, Berkeley(加州大学伯克利分校) Virtue AI Morph Labs(Morph实验室) University of Michigan(密歇根大学) LG AI Research(LG人工智能研究) University of Oxford(牛津大学) Stanford University(斯坦福大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Gray Swan AI Carnegie Mellon University(卡内基梅隆大学) Cornell University(康奈尔大学) Hong Kong Baptist University(香港 Baptist大学) HKUST(香港科技大学) Nanyang Technological University(南洋理工大学) KAIST(韩国科学技术院) University of California, Santa Cruz(加州大学圣克鲁兹分校) Massachusetts Institute of Technology(麻省理工学院) University of Tübingen(图宾根大学) University of Washington(华盛顿大学) University of Toronto(多伦多大学) Vector Institute(向量研究所) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Beneficial AI Research(有益AI研究) Conjecture Institute for Applied Psychometrics(应用心理测量研究所) New York University(纽约大学) CSER Université de Montréal(蒙特利尔大学) LawZero

AI总结 本文提出了一种基于卡特尔-霍恩-卡罗尔理论的可量化框架,定义AGI为与受过良好教育的成年人认知能力相匹配,并通过心理测量电池评估AI系统,揭示当前AI在基础认知机制上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18980 2025-12-04 cs.CL cs.AI cs.CV

IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web

IW-Bench: 评估大规模多模态模型的图像到网页转换能力

Hongcheng Guo, Wei Zhang, Junhao Chen, Yaonan Gu, Jian Yang, Junjia Du, Shaosheng Cao, Binyuan Hui, Tianyu Liu, Jianxin Ma, Chang Zhou, Zhoujun Li

机构 * Beihang University(北京航空航天大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 IW-Bench提出了一种新的基准,用于评估大规模多模态模型在图像到网页转换中的性能,通过元素准确率和布局准确率以及五跳提示方法来提升评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02870 2025-12-03 cs.CV

Taming Camera-Controlled Video Generation with Verifiable Geometry Reward

驯服受控摄像机视频生成的可验证几何奖励

Zhaoqing Wang, Xiaobo Xia, Zhuolin Bie, Jinlin Liu, Dongdong Yu, Jia-Wang Bian, Changhu Wang

机构 * AIsphere National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出了一种在线强化学习框架,通过可验证的几何奖励提升摄像机控制的视频生成精度与一致性。

Comments 11 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02794 2025-12-03 cs.CV

PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation

PhyCustom: 向文本到图像生成中的真实物理定制迈进

Fan Wu, Cheng Chen, Zhoujie Fu, Jiacheng Wei, Yi Xu, Deheng Ye, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) Goertek Alpha Labs(歌尔声学Alpha实验室) Tencent(腾讯)

AI总结 PhyCustom通过引入两个新正则化损失,提升文本到图像生成中对物理概念的真实定制能力。

Comments codes:https://github.com/wufan-cse/PhyCustom

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02793 2025-12-03 cs.CV

IC-World: In-Context Generation for Shared World Modeling

IC-World:基于上下文的共享世界建模生成

Fan Wu, Jiacheng Wei, Ruibo Li, Yi Xu, Junyou Li, Deheng Ye, Guosheng Lin

机构 * Nanyang Technological University(南洋理工大学) Goertek Alpha Labs(歌尔声学实验室) Tencent(腾讯)

AI总结 IC-World通过激活大视频模型的上下文生成能力,实现了多视角共享世界建模,通过强化学习和奖励模型提升生成视频的几何和运动一致性。

Comments codes:https://github.com/wufan-cse/IC-World

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01830 2025-12-03 cs.CV

OpenREAD: Reinforced Open-Ended Reasoning for End-to-End Autonomous Driving with LLM-as-Critic

OpenREAD: 基于LLM作为批评者的开放性推理端到端自动驾驶框架

Songyan Zhang, Wenhui Huang, Zhan Chen, Chua Jiahao Collister, Qihang Huang, Chen Lv

机构 * Nanyang Technological University, Singapore(南洋理工大学) Harvard University, USA(哈佛大学)

AI总结 OpenREAD通过端到端强化微调框架,结合LLM作为批评者,提升自动驾驶中的推理与规划能力,实现从高层推理到低层轨迹规划的全面优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02321 2025-12-03 cs.CR cs.CL

LeechHijack: Covert Computational Resource Exploitation in Intelligent Agent Systems

LeechHijack: 智能代理系统中的隐蔽计算资源利用

Yuanhe Zhang, Weiliu Wang, Zhenhong Zhou, Kun Wang, Jie Zhang, Li Sun, Yang Liu, Sen Su

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Hangzhou Dianzi University(杭州电子科技大学) Nanyang Technological University(南洋理工大学) CFAR North China Electric Power University(华北电力大学) Chongqing University of Posts(重庆邮电大学)

AI总结 LeechHijack通过隐式毒性攻击利用MCP框架中的信任边界,隐蔽劫持代理计算资源,揭示对计算溯源和资源认证机制的迫切需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21393 2025-12-03 cs.CR cs.AI

VeriLoRA: Fine-Tuning Large Language Models with Verifiable Security via Zero-Knowledge Proofs

VeriLoRA: 通过零知识证明实现通过验证的安全大语言模型微调

Guofu Liao, Taotao Wang, Shengli Zhang, Jiqun Zhang, Shi Long, Dacheng Tao

机构 * Shenzhen University(深圳大学) Nanjing University of Science(南京理工大学) Nanyang Technological University(南洋理工大学)

AI总结 VeriLoRA通过整合零知识证明与LoRA微调,实现了大语言模型在敏感环境中的安全可信部署。

Comments This paper has been accepted for publication at the Network and Distributed System Security Symposium (NDSS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02009 2025-12-02 cs.CV

AirSim360: A Panoramic Simulation Platform within Drone View

AirSim360:无人机视角下的全景模拟平台

Xian Ge, Yuling Pan, Yuhang Zhang, Xiang Li, Weijun Zhang, Dizhe Zhang, Zhaoliang Wan, Xin Lin, Xiangkai Zhang, Juntao Liang, Jason Li, Wenjie Jiang, Bo Du, Ming-Hsuan Yang, Lu Qi

机构 * Insta360 Research(Insta360研究机构) Wuhan University(武汉大学) University of California, San Diego(加州大学圣地亚哥分校) Nanyang Technological University(南洋理工大学) University of California, Merced(加州大学默塞德分校) Shenzhen University(深圳大学)

AI总结 AirSim360 是一个基于无人机视角的全景模拟平台,通过渲染对齐的数据标注、交互式行人建模和自动轨迹生成,实现全方位场景采样和空间智能研究。

Comments Project Website: https://insta360-research-team.github.io/AirSim360-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01960 2025-12-02 cs.CV cs.HC

SpriteHand: Real-Time Versatile Hand-Object Interaction with Autoregressive Video Generation

SpriteHand: 实时多样的手-物体交互与自回归视频生成

Zisu Li, Hengye Lyu, Jiaxin Shi, Yufeng Zeng, Mingming Fan, Hanwang Zhang, Chen Liang

机构 * HKUST (Guangzhou)(香港科技大学(广州)) XMax.AI Ltd.(XMax人工智能有限公司) Nanyang Technological University(南洋理工大学)

AI总结 SpriteHand通过自回归视频生成框架实现实时高质量手-物体交互视频合成,支持多种物体和运动模式,具有高视觉真实性和物理合理性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01446 2025-12-02 cs.RO

$\mathbf{M^3A}$ Policy: Mutable Material Manipulation Augmentation Policy through Photometric Re-rendering

M³A策略:通过光度重渲染的可变材料操控增强策略

Jiayi Li, Yuxuan Hu, Haoran Geng, Xiangyu Chen, Chuhao Zhou, Ziteng Cui, Jianfei Yang

机构 * Tsinghua University(清华大学) MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室) University of California, Berkeley(加州大学伯克利分校) The University of Tokyo(东京大学)

AI总结 M³A策略通过光度重渲染生成多样化演示,提升机器人跨材料操控的泛化能力。

Comments under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01335 2025-12-02 cs.CR cs.AI cs.CL

EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations

EmoRAG:评估RAG对符号扰动的鲁棒性

Xinyun Zhou, Xinfeng Li, Yinan Peng, Ming Xu, Xuanwang Zhang, Miao Yu, Yidong Wang, Xiaojun Jia, Kun Wang, Qingsong Wen, XiaoFeng Wang, Wei Dong

机构 * ZJU Hangzhou China(浙江大学杭州校区) NTU Singapore(南洋理工大学) Hengxin Tech. Singapore(新加坡恒心科技) NUS Singapore(国立新加坡大学) NJU Nanjing China(南京大学) PKU Beijing China(北京大学)

AI总结 EmoRAG研究揭示RAG系统对细微表情符号扰动的鲁棒性问题,发现单个表情符号可导致检索严重误导,并提出针对性防御措施。

Comments Accepted to ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01223 2025-12-02 cs.CV cs.AI

S$^2$-MLLM: Boosting Spatial Reasoning Capability of MLLMs for 3D Visual Grounding with Structural Guidance

S$^2$-MLLM:通过结构指导提升多模态大语言模型在3D视觉定位中的空间推理能力

Beining Xu, Siting Zhu, Zhao Jin, Junxian Li, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 S$^2$-MLLM通过隐式空间推理提升多模态大语言模型在3D视觉定位中的空间推理能力,实现高效且准确的3D场景理解。

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00694 2025-12-02 cs.CV

Affordance-First Decomposition for Continual Learning in Video-Language Understanding

基于可及性的分解方法用于视频-语言理解中的持续学习

Mengzhu Xu, Hanzhi Liu, Ningkang Peng, Qianyu Chen, Canran Xiao

机构 * University of Sydney(悉尼大学) University of California, Santa Barbara(加州大学圣巴巴拉分校) Nanjing Normal University(南京师范大学) Nanyang Technological University(南洋理工大学) Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区)

AI总结 AFD通过显式分解视频-语言理解中的稳定性与适应性,实现了在持续学习中的高性能表现。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00391 2025-12-02 cs.LG cs.AI

From Coefficients to Directions: Rethinking Model Merging with Directional Alignment

从系数到方向:重新思考模型融合与方向对齐

Zhikang Chen, Sen Cui, Deheng Ye, Min Zhang, Gang Niu, Yu Zhang, Masashi Sugiyama, Tingting Zhu

机构 * University of Oxford(牛津大学) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) East China Normal University(华东师范大学) RIKEN(日本研究机构) The University of Tokyo(东京大学) Southern University of Science and Technology(南方科技大学)

AI总结 本文提出方向对齐融合方法,通过统一几何框架对齐参数和特征空间的方向结构,提升模型融合的结构一致性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03657 2025-12-02 cs.CV

Dynamic Multimodal Prototype Learning in Vision-Language Models

视觉-语言模型中的动态多模态原型学习

Xingyu Zhu, Shuo Wang, Beier Zhu, Miaoge Li, Yunfan Li, Junfeng Fang, Zhicai Wang, Dongsheng Wang, Hanwang Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学) The Hong Kong Polytechnic University(香港理工大学) Sichuan University(四川大学) National University of Singapore(新加坡国立大学) Shenzhen University(深圳大学)

AI总结 本文提出ProtoMM框架,通过动态更新视觉粒子和多模态原型学习,提升视觉-语言模型在测试时的适应性能。

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08594 2025-12-02 cs.CV cs.LG

PointNSP: Autoregressive 3D Point Cloud Generation with Next-Scale Level-of-Detail Prediction

PointNSP: 通过下一尺度细节预测实现自回归3D点云生成

Ziqiao Meng, Qichao Wang, Zhiyang Dou, Zixing Song, Zhipeng Zhou, Irwin King, Peilin Zhao

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) University of Hong Kong(香港大学) University of Cambridge(剑桥大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 PointNSP通过下一尺度细节预测实现自回归3D点云生成,首次在自回归范式中达到最先进的生成质量,并在参数、训练和推理效率上超越扩散基线。

Comments 24 pages; Previously this version appeared as arXiv:2510.05613 which was submitted as a new work by accident

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01598 2025-12-02 cs.AI cs.HC

Prism: Mining Task-aware Domains in Non-i.i.d. IMU Data for Flexible User Perception

Prism: 在非独立同分布的IMU数据中挖掘任务感知域以实现灵活的用户感知

Yunzhe Li, Facheng Hu, Hongzi Zhu, Quan Liu, Xiaoke Zhao, Jiangang Shen, Shan Chang, Minyi Guo

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(新加坡国立大学) Ant Group(蚂蚁集团) Donghua University(东华大学)

AI总结 Prism通过挖掘任务感知的IMU数据域,实现移动设备上的灵活用户感知,提升预测精度并降低延迟。

Comments in Proceedings of IEEE INFOCOM 2025, London, United Kingdom

Journal ref Proceedings of IEEE Conference on Computer Communications (INFOCOM), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02429 2025-12-02 cs.AI cs.CL

IoT-LLM: a framework for enhancing Large Language Model reasoning from real-world sensor data

IoT-LLM: 一个增强大语言模型现实世界传感器数据推理能力的框架

Tuo An, Yunjiao Zhou, Han Zou, Jianfei Yang

机构 * MARS Lab, School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(MARS实验室,机械与航空航天工程学院,南洋理工大学,新加坡) School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(机械与航空航天工程学院,南洋理工大学,新加坡)

AI总结 IoT-LLM通过整合物联网数据与常识知识,提升大语言模型在现实世界传感任务中的推理能力。

Comments 33 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00355 2025-12-02 cs.CV

SMamDiff: Spatial Mamba for Stochastic Human Motion Prediction

SMamDiff: 基于空间Mamba的随机人体运动预测

Junqiao Fan, Pengfei Liu, Haocong Rao

机构 * School of Computer Science, Nanyang Technological University(计算机科学学院,南洋理工大学)

AI总结 SMamDiff通过空间Mamba和余数-DCT编码提升随机人体运动预测的时空一致性,实现更高效且准确的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏