arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

共收录 2393
2509.10506 2026-03-06 cs.LG cs.CE

AttnBoost: Retail Supply Chain Sales Insights via Gradient Boosting Perspective

AttnBoost:从梯度提升视角探索零售供应链销售洞察

Yadi Liu, Xiaoli Ma, Muxin Ge, Zeyu Han, Jingxi Qiu, Ye Aung Moe, Yilan Shen, Wenbin Wei, Cheng Huang

机构 * Nanyang Technological University(南洋理工大学) Washington State University(华盛顿州立大学) Southern Methodist University(南方 Methodist 大学) Georgetown University(乔治城大学) University of Nebraska-Lincoln(内布拉斯加大学林肯分校) China Construction Bank(中国建设银行)

AI总结 AttnBoost通过引入特征层面的注意力机制,提升零售供应链销售预测的准确性与可解释性,为供应链管理提供实用洞察。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04338 2026-03-05 cs.CV

ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors

ArtHOI: 通过视频先验进行4D重建的可变形人-物交互合成

Zihao Huang, Tianqi Liu, Zhaoxi Chen, Shaocong Xu, Saining Zhang, Lixing Xiao, Zhiguo Cao, Wei Li, Hao Zhao, Ziwei Liu

机构 * School of AIA, Huazhong University of Science and Technology(华中科技大学人工智能学院) the S-Lab, Nanyang Technological University (NTU)(南洋理工大学S实验室) the Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院) Zhejiang University (ZJU)(浙江大学) the Institute for AI Industry Research (AIR), Tsinghua University (THU)(清华大学人工智能产业研究院)

AI总结 ArtHOI通过4D重建从视频先验生成可变形人-物交互,提升接触精度和物理合理性。

Comments Project Page: https://arthoi.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21782 2026-03-05 cs.AI

Benchmarking MLLM-based Web Understanding: Reasoning, Robustness and Safety

基于MLLM的网页理解基准测试:推理、鲁棒性与安全性

Junliang Liu, Jingyu Xiao, Wenxin Tang, Zhixian Wang, Zipeng Xie, Wenxuan Wang, Minrui Zhang, Shuanghe Yu

机构 * Dalian Maritime University(大连海事大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Xi'an Jiaotong University(西安交通大学) Renmin University of China(中国人民大学) Wuhan University(武汉大学)

AI总结 本文提出WebRRSBench基准测试,评估多模态大语言模型在网页理解中的推理、鲁棒性和安全性能力,揭示模型在复杂交互任务中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20376 2026-03-05 cs.CV cs.CR

When Memory Becomes a Vulnerability: Towards Multi-turn Jailbreak Attacks against Text-to-Image Generation Systems

当记忆成为漏洞:针对文本到图像生成系统的多轮劫持攻击

Shiqian Zhao, Jiayang Liu, Yiming Li, Runyi Hu, Xiaojun Jia, Wenshu Fan, Xiao Bao, Xinfeng Li, Jie Zhang, Wei Dong, Tianwei Zhang, Luu Anh Tuan

机构 * Nanyang Technological University(南洋理工大学) Institute of Science(科学研究院) University of Electronic Science and Technology of China(电子科技大学) CFAR and IHPC Agency for Science Technology and Research(CFAR和IHPC科技研究局) VinUniversity(文大学)

AI总结 本文提出Inception,首个利用文本到图像生成系统内存机制的多轮劫持攻击方法,通过分割和递归模块有效规避安全过滤,提升攻击成功率20%。

Comments This work proposes a multi-turn jailbreak attack against real-world chat-based T2I generation systems that intergrate memory mechanism. It also constructed a simulation system, with considering three industrial-grade memory mechanisms, 7 kinds of safety filters (both input and output); It is going to appear on USENIX 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03564 2026-03-05 cs.CV

Modeling Cross-vision Synergy for Unified Large Vision Model

跨视觉协同的统一大视觉模型建模

Shengqiong Wu, Lanhu Wu, Mingyang Bao, Wenhao Xu, Hanwang Zhang, Shuicheng Yan, Hao Fei, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 PolyV通过统一架构和协同训练方法,实现了跨视觉模态的协同推理,显著提升了多模态视觉任务的性能。

Comments 21 pages, 9 figures, 16 tables, CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01138 2026-03-05 eess.SP cs.LG

Graph Neural Networks in EEG-based Emotion Recognition: A Survey

基于EEG的情感识别中的图神经网络:综述

Chenyu Liu, Yuqiu Deng, Yihao Wu, Ruizhi Yang, Zhongruo Wang, Liangwei Zhang, Siyun Chen, Tianyi Zhang, Yang Liu, Yi Ding, Liming Zhai, Ziyu Jia, Xinliang Zhou

机构 * Nanyang Technological University, Singapore(南洋理工大学) Xi’an Jiaotong University, Xi’an, China(西安交通大学) Imperial College London, London, UK(伦敦帝国理工学院) Amazon, Seattle, WA, USA(亚马逊) Carnegie Mellon University, Pittsburgh, PA, USA(卡内基梅隆大学) Uber Technologies, Inc., USA(Uber Technologies, Inc.) School of Computer Science, Central China Normal University, Wuhan, China(中央财经大学计算机学院) Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所)

AI总结 本文综述了基于EEG的情感识别中图神经网络的应用,分析了现有方法的共性与差异,并探讨了未来研究方向。

Comments The 30th Pacific-Asia Conference on Knowledge Discovery and Data Mining (PAKDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03241 2026-03-04 cs.CV cs.AI

UniG2U-Bench: Do Unified Models Advance Multimodal Understanding?

UniG2U-Bench: 统一模型是否能提升多模态理解?

Zimo Wen, Boxiu Li, Wanbo Zhang, Junxiang Lei, Xiaoyu Chen, Yijia Fan, Qi Zhang, Yujiang Wang, Lili Qiu, Bo Li, Ziwei Liu, Caihua Shan, Yifan Yang, Yifei Shen

机构 * Microsoft Research Asia(微软亚洲研究院) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) Fudan University(复旦大学) University of Oxford(牛津大学)

AI总结 UniG2U-Bench通过系统评估生成到理解的任务,揭示统一模型在多模态理解中的局限性和改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03198 2026-03-04 cs.RO cs.CL cs.CV

ACE-Brain-0: Spatial Intelligence as a Shared Scaffold for Universal Embodiments

ACE-Brain-0:空间智能作为通用具身化体系的共享框架

Ziyang Gong, Zehang Luo, Anke Tang, Zhe Liu, Shi Fu, Zhi Hou, Ganlin Yang, Weiyun Wang, Xiaofeng Wang, Jianbo Liu, Gen Luo, Haolan Kang, Shuang Luo, Yue Zhou, Yong Luo, Li Shen, Xiaosong Jia, Yao Mu, Xue Yang, Chunxiao Liu, Junchi Yan, Hengshuang Zhao, Dacheng Tao, Xiaogang Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) University of Science(科学技术大学) Fudan University(复旦大学) Xiamen University(厦门大学) East China Normal University(华东师范大学) Wuhan University(武汉大学) Sun Yat-sen University(中山大学)

AI总结 ACE-Brain-0 通过空间智能作为共享框架,统一了自动驾驶、机器人和 UAVs 的具身化任务,采用 SSR 范式和 GRPO 方法实现跨领域泛化和领域精通的平衡。

Comments Code: https://github.com/ACE-BRAIN-Team/ACE-Brain-0 Hugging Face: https://huggingface.co/ACE-Brain/ACE-Brain-0-8B

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03005 2026-03-04 cs.AI

OrchMAS: Orchestrated Reasoning with Multi Collaborative Heterogeneous Scientific Expert Structured Agents

OrchMAS: 基于多协作异构科学专家结构代理的协同推理

Yichao Feng, Haoran Luo, Zhenghong Lin, Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh, Anh Tuan Luu

机构 * Magellan Technology Research Institute (MTRI)(Magellan技术研究 institute) Nanyang Technological University(南洋理工大学)

AI总结 OrchMAS通过双层多模型编排框架,实现异构科学专家代理的动态协作,提升复杂科学推理的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02846 2026-03-04 cs.LG cs.AI

Learning Memory-Enhanced Improvement Heuristics for Flexible Job Shop Scheduling

学习记忆增强的改进启发式方法用于灵活作业车间调度

Jiaqi Wang, Zhiguang Cao, Peng Zhao, Rui Cao, Yubin Xiao, Yuan Jiang, You Zhou

机构 * Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education(教育部符号计算与知识工程重点实验室) College of Software(软件学院) College of Computer Science and Technology(计算机科学与技术学院) Singapore Management University(新加坡管理大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出MIStar框架,通过记忆增强的异构图神经网络和并行贪婪搜索策略,提升灵活作业车间调度的调度效果。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22901 2026-03-04 eess.SY cs.AI cs.LG cs.SY eess.SP

A Neural Network-Based Real-time Casing Collar Recognition System for Downhole Instruments

基于神经网络的实时套管接箍识别系统用于井下仪器

Si-Yu Xiao, Xin-Di Zhao, Xiang-Zhan Wang, Tian-Hao Mao, Ying-Kai Liao, Xing-Yu Liao, Yu-Qiao Chen, Jun-Jie Wang, Shuang Liu, Tu-Pei Chen, Yang Liu

机构 * State Key Laboratory of Electronic Thin Films and Integrated Devices, University of Electronic Science and Technology of China(电子薄膜与集成器件国家重点实验室,电子科学与技术大学) Southwest Branch of China National Petroleum Corporation Logging Co., Ltd.(中国石油天然气集团有限公司西南分公司) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

AI总结 本文提出了一种轻量级神经网络,用于在井下环境中实现实时、鲁棒的套管接箍识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07177 2026-03-04 cs.CV cs.AI

Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models

帧引导:基于帧级信号的无训练引导用于视频扩散模型的可控生成

Sangwon Jang, Taekyung Ki, Jaehyeong Jo, Jaehong Yoon, Soo Ye Kim, Zhe Lin, Sung Ju Hwang

机构 * KAIST(韩国国立科学技术院) NTU Singapore(南洋理工大学) Adobe Research(Adobe研究)

AI总结 帧引导通过帧级信号实现无训练的视频生成控制,支持多种任务如关键帧引导、风格化和循环,无需训练即可生成高质量视频。

Comments ICLR 2026. Project page: https://frame-guidance-video.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19892 2026-03-04 cs.AI

OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging

OptMerge: 通过模型融合统一多模态大语言模型的能力与模态

Yongxian Wei, Runxi Cheng, Weike Jin, Enneng Yang, Li Shen, Lu Hou, Sinan Du, Chun Yuan, Xiaochun Cao, Dacheng Tao

机构 * Tsinghua University(清华大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学)

AI总结 OptMerge通过模型融合统一多模态大语言模型的能力与模态,提出基准和算法提升性能2.48%

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02729 2026-03-04 cs.LG math.OC stat.ML

The power of small initialization in noisy low-tubal-rank tensor recovery

小初始化在噪声低管秩张量恢复中的作用

ZHiyu Liu, Haobo Geng, Xudong Wang, Yandong Tang, Zhi Han, Yao Wang

机构 * State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences, China(机器人与智能系统国家重点实验室,沈阳自动化研究所,中国科学院,中国) University of Chinese Academy of Sciences, China(中国科学院大学,中国) School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院,新加坡) The Center for Intelligent Decision-making and Machine Learning, School of Management, Xi’an Jiaotong University, China(智能决策与机器学习中心,西安交通大学管理学院,中国)

AI总结 本文研究了在噪声环境下利用小初始化改进低管秩张量恢复的性能,证明了小初始化能实现接近最优的恢复误差,同时提供了理论保证和实验验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02635 2026-03-04 cs.LG

SaFeR-ToolKit: Structured Reasoning via Virtual Tool Calling for Multimodal Safety

SaFeR-ToolKit: 通过虚拟工具调用实现多模态安全的结构化推理

Zixuan Xu, Tiancheng He, Huahui Yi, Kun Wang, Xi Chen, Gongli Xi, Qiankun Li, Kang Li, Yang Liu, Zhigang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Beijing University of Posts and Telecommunications(北京邮电大学) West China Hospital, Sichuan University(四川大学华西医院) Nanyang Technological University(南洋理工大学)

AI总结 SaFeR-ToolKit通过虚拟工具调用实现多模态安全的结构化推理,提升安全性、帮助性和推理严谨性,同时保持通用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02022 2026-03-04 cs.SD cs.AI

CodecFlow: Efficient Bandwidth Extension via Conditional Flow Matching in Neural Codec Latent Space

CodecFlow:通过条件流匹配在神经编解码器潜在空间中实现高效的带宽扩展

Bowen Zhang, Junchuan Zhao, Ian McLoughlin, Ye Wang, A S Madhukumar

机构 * Singapore Institute of Technology(新加坡理工学院) Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学)

AI总结 CodecFlow通过条件流匹配和结构受限量化器,在神经编解码器潜在空间中实现高效语音带宽扩展,提升频谱保真度和感知质量。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18560 2026-03-04 cs.SE cs.AI

WebDevJudge: Evaluating (M)LLMs as Critiques for Web Development Quality

WebDevJudge: 评估 (M)LLMs 作为 Web 开发质量的批评者

Chunyang Li, Yilun Zheng, Xinting Huang, Tianqing Fang, Jiahao Xu, Lihui Chen, Yangqiu Song, Han Hu

机构 * Tencent AI Lab(腾讯AI实验室) The Hong Kong University of Science and Technology(香港科学与技术大学) Nanyang Technological University(南洋理工大学)

AI总结 WebDevJudge 提出了一种评估 LLM 作为 Web 开发质量批评者的基准,揭示了 LLM 与人类专家之间的显著差距,指出了模型在功能等价性识别、任务可行性验证和偏见缓解方面的根本性限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08862 2026-03-04 cs.CV cs.LG

StreamSplat: Towards Online Dynamic 3D Reconstruction from Uncalibrated Video Streams

StreamSplat: 向动态3D重建的在线方法:从未校准视频流中

Zike Wu, Qi Yan, Xuanyu Yi, Lele Wang, Renjie Liao

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute for AI(人工智能向量研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) Nanyang Technological University(南洋理工大学)

AI总结 StreamSplat通过在线动态3D重建方法,实现从未校准视频流中快速生成高精度3DGS表示,支持任意长度视频的实时重建。

Comments Accepted by ICLR 2026, Project page: https://streamsplat3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01948 2026-03-03 cs.CV

PreSight: Preoperative Outcome Prediction for Parkinson's Disease via Region-Prior Morphometry and Patient-Specific Weighting

PreSight:通过区域先验形态学和患者特异性加权进行帕金森病术前预后预测

Yand Wang, Chen Zhang, Lanyun Zhu, Yixin Chen, Qunbo Wang, Yutong Bai, Jurgen Germann, Yinghong Wen, Shuai Shao

机构 * Beijing Jiaotong University(北京交通大学) Nanyang Technological University(南洋理工大学) Institute of Medical Technology, Peking University(北京大学医学技术研究院) Beijing Tiantan Hospital, Capital Medical University(北京天坛医院) University Health Network, University of Toronto(多伦多大学健康网络) Suzhou Institute for Advanced Research, University of Science and Technology of China(中国科学技术大学苏州研究院)

AI总结 PreSight通过结合临床先验与区域自适应形态学,实现帕金森病术前预后预测,提升术后运动改善预测的准确性和临床实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15504 2026-03-03 cs.CV cs.AI

Exploiting Low-Dimensional Manifold of Features for Few-Shot Whole Slide Image Classification

利用特征的低维流形进行少样本全滑动图像分类

Conghao Xiong, Zhengrui Guo, Zhe Xu, Yifei Zhang, Raymond Kai-Yu Tong, Si Yong Yeo, Hao Chen, Joseph J. Y. Sung, Irwin King

机构 * The Chinese University of Hong Kong(香港中文大学) Centre of AI in Medicine, Singapore(新加坡人工智能医学中心) The Hong Kong University of Science and Technology(香港科学大学) Nanyang Technological University(南洋理工大学) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学Lee Kong Chian医学学院) MedVisAI Lab, Singapore(新加坡MedVisAI实验室)

AI总结 本文提出Manifold Residual块,通过几何意识的残差学习方法,解决少样本全滑动图像分类中的过拟合问题,实现更高效的模型性能。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01755 2026-03-03 cs.NI cs.AI

Federated Agentic AI for Wireless Networks: Fundamentals, Approaches, and Applications

联邦代理AI用于无线网络:基础、方法与应用

Lingyi Cai, Yu Zhang, Ruichen Zhang, Yinqiu Liu, Tao Jiang, Dusit Niyato, Wei Ni, Abbas Jamalipour

机构 * Research Center of 6G Mobile Communications, School of Cyber Science and Engineering, Huazhong University of Science and Technology(6G移动通信研究中心,信息科学与工程学院,华中科技大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) School of Engineering, Edith Cowan University(工程学院,埃迪斯·科文大学) School of Computer Science and Engineering, University of New South Wales (UNSW)(计算机科学与工程学院,新南威尔士大学) School of Electrical and Computer Engineering, University of Sydney(电气与计算机工程学院,悉尼大学) Graduate School of Information Sciences, Tohoku University(信息科学研究生院,东北大学)

AI总结 本文提出适用于无线网络的联邦代理AI方法,通过协作本地学习和参数共享提升无线网络的自主性和自我改进能力。

Comments 7 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01450 2026-03-03 cs.CV

Deepfake Forensics Adapter: A Dual-Stream Network for Generalizable Deepfake Detection

深度伪造取证适配器:一种通用深度伪造检测的双流网络

Jianfeng Liao, Yichen Wei, Raymond Chan Ching Bon, Shulan Wang, Kam-Pui Chow, Kwok-Yan Lam

机构 * Shenzhen Technology University(深圳技术大学) Singapore Institute of Technology(新加坡理工学院) The University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出深度伪造取证适配器,通过双流网络结合CLIP模型实现高效通用深度伪造检测。

Comments Accepted at ICDF2C 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01125 2026-03-03 cs.CV cs.AI

Predictive Reasoning with Augmented Anomaly Contrastive Learning for Compositional Visual Relations

利用增强异常对比学习进行预测推理以处理组合视觉关系

Chengtai Li, Yuting He, Jianfeng Ren, Ruibin Bai, Yitian Zhao, Heng Yu, Xudong Jiang

机构 * School of Computer Science, University of Nottingham Ningbo China(诺丁汉大学宁波校区计算机科学学院) Institute of Biomedical Engineering, Ningbo institute of materials technology and engineering, Chinese Academy of Sciences(中国科学院宁波材料技术与工程研究所生物医学工程研究所) School of Electrical & Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

AI总结 PR-A$^2$CL通过增强异常对比学习和预测验证范式,有效提升了组合视觉关系推理任务的性能。

Comments Accepted by IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20650 2026-03-03 cs.CV cs.AI

Dataset Color Quantization: A Training-Oriented Framework for Dataset-Level Compression

数据集颜色量化:面向数据集层面压缩的训练导向框架

Chenyue Yu, Lingao Xiao, Jinhong Deng, Ivor W. Tsang, Yang He

机构 * CFAR, Agency for Science, Technology and Research, Singapore(科技研究局CFAR, 新加坡) IHPC, Agency for Science, Technology and Research, Singapore(科技研究局IHPC, 新加坡) National University of Singapore(新加坡国立大学) University of Electronic Science and Technology of China (UESTC)(电子科技大学) Nanyang Technological University (NTU), Singapore(南洋理工大学, 新加坡)

AI总结 本文提出DCQ框架,通过减少颜色空间冗余并保留训练关键信息,实现数据集层面的高效压缩,提升训练性能。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10609 2026-03-03 cs.CL cs.AI

Online Causal Kalman Filtering for Stable and Effective Policy Optimization

在线因果卡尔曼滤波用于稳定和有效的策略优化

Shuo He, Lang Feng, Xin Cheng, Lei Feng, Bo An

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Southeast University, China(东南大学,中国)

AI总结 本文提出KPO方法,通过在线因果卡尔曼滤波稳定和提升策略优化效果,有效解决token级重要性采样比率的高方差问题。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06502 2026-03-03 cs.AI

DRAGON: LLM-Driven Decomposition and Reconstruction Agents for Large-Scale Combinatorial Optimization

DRAGON:基于大语言模型的分解与重建代理用于大规模组合优化

Shengkai Chen, Zhiguang Cao, Jianan Zhou, Yaoxin Wu, Senthilnath Jayavelu, Zhuoyi Lin, Xiaoli Li, Shili Xiang

机构 * Institute for Infocomm Research A STAR Singapore Singapore Management University Singapore Nanyang Technological University Singapore Eindhoven University of Technology Eindhoven Netherlands National University of Singapore \& Institute for Infocomm Research A STAR Singapore Singapore University of Technology Institute for Infocomm Research Singapore Management University Nanyang Technological University Eindhoven University of Technology National University of Singapore \& Institute for Infocomm Research

AI总结 DRAGON是一种结合元启发式设计和LLM推理的新型框架,通过分解与重建代理实现大规模组合优化问题的高效求解。

Comments This paper has been accepted for presentation and publication at the 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026), source code: https://github.com/skychan/DARGON

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00129 2026-03-03 cs.LG cs.AI eess.SP

Data-Augmented Deep Learning for Downhole Depth Sensing and Validation

数据增强深度学习用于井下深度感知与验证

Si-Yu Xiao, Xin-Di Zhao, Tian-Hao Mao, Yi-Wei Wang, Yu-Qiao Chen, Hong-Yun Zhang, Jian Wang, Jun-Jie Wang, Shuang Liu, Tu-Pei Chen, Yang Liu

机构 * State Key Laboratory of Electronic Thin Films and Integrated Devices, University of Electronic Science and Technology of China(电子薄膜与集成器件国家重点实验室,电子科学与技术大学) Southwest Branch of China National Petroleum Corporation Logging Co., Ltd.(中国石油天然气集团有限公司西南分公司) School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院)

AI总结 本文提出数据增强深度学习方法,提升井下套管定位识别的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02253 2026-03-03 cs.CV cs.AI cs.LG

DragFlow: Unleashing DiT Priors with Region Based Supervision for Drag Editing

DragFlow: 通过基于区域的监督释放DiT先验以实现拖拽编辑

Zihan Zhou, Shilin Lu, Shuli Leng, Shaocong Zhang, Zhuming Lian, Xinlei Yu, Adams Wai-Kin Kong

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学)

AI总结 DragFlow通过基于区域的监督利用FLUX先验,改进基于拖拽的图像编辑效果,实现对点式和区域式基线的超越。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22643 2026-03-03 cs.RO

VLA-Reasoner: Empowering Vision-Language-Action Models with Reasoning via Online Monte Carlo Tree Search

VLA-Reasoner: 通过在线蒙特卡洛树搜索增强视觉-语言-动作模型的推理能力

Wenkai Guo, Guanxing Lu, Haoyuan Deng, Zhenyu Wu, Yansong Tang, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) School of Intelligent Engineering and Automation, Beijing University of Posts and Telecommunications(北京邮电大学智能工程与自动化学院)

AI总结 VLA-Reasoner通过在线蒙特卡洛树搜索增强视觉-语言-动作模型,提升长时间轨迹任务的推理能力与执行效率。

Comments 8 pages, 6 figures, Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05606 2026-03-03 cs.CV cs.CL

Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision

Uni-cot: 向跨文本和视觉的统一链式推理迈进

Luozheng Qin, Jia Gong, Yuqing Sun, Tianjiao Li, Mengping Yang, Xiaomeng Yang, Chao Qu, Zhiyu Tan, Hao Li

机构 * Shanghai Academy of AI for Science(上海人工智能科学研究院) Fudan University(复旦大学) Nanyang Technological University(南洋理工大学)

AI总结 Uni-CoT通过统一的链式推理框架实现跨文本和视觉的连贯多模态推理,采用宏级和微级推理范式,提升多模态推理的效率和性能。

Comments Accepted by ICLR 2026, Project Page: https://sais-fuxi.github.io/projects/uni-cot/

详情

展开后加载摘要…

URL PDF HTML 收藏