arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

共收录 304
2607.08652 2026-07-10 cs.AI 新提交

Formal Mechanisms for Market Stability in Self-Interested Agent Societies: A Marketplace Simulation Study

自利代理社会中市场稳定性的形式机制:市场模拟研究

Eugene Ng Yi Sheng, Bingquan Shen

机构 * DSO National Laboratories(国防科技研究院) National University of Singapore(新加坡国立大学)

AI总结 研究自利代理社会中市场稳定性的形式机制,通过多智能体市场模拟实验,比较八种机制,发现调解机制最佳,对其进行对抗性红队测试,结果表明该机制具有对抗鲁棒性,能在攻击下维持市场稳定。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08198 2026-07-10 cs.CV 新提交

Unpaired Joint Distribution Modeling via Multi-Scale Image Representations

通过多尺度图像表示进行无配对联合分布建模

Yihang Zou, Hui Zhang, Zuowei Shen, Chenglong Bao

机构 * Yau Mathematical Sciences Center, Tsinghua University(丘成桐数学科学中心,清华大学) Department of Mathematical Sciences, Tsinghua University(清华大学数学科学系) Qiuzhen College, Tsinghua University(清华大学求真书院) Department of Mathematics, National University of Singapore(新加坡国立大学数学系) Beijing Institute of Mathematical Sciences and Applications(北京数学科学与应用研究院) State Key Laboratory of Membrane Sciences, Tsinghua University(清华大学膜生物学国家重点实验室)

AI总结 研究从边际观测学习联合分布问题,提出LUD - MSR框架,通过辅助表示建模并优化证据下界,建立误差上界揭示权衡,引入MSR映射,实验证明该框架在真实去噪基准测试中有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08194 2026-07-10 cs.CV 新提交

Dive Into the Implicit Biases of Low-rank Vision-language Alignment

深入探究低秩视觉-语言对齐中的隐式偏差

Mingjia Shi, Shuo Wang, Xiaobo Wang, Sifan Zhou, Kai Wang, Tianyu Fu, Chenxu Zhao, Anyang Su, Ping Jiang, Minghui Wu

机构 * Shenzhen University of Advanced Technology(深圳先进技术研究院) National University of Singapore(新加坡国立大学) Mininglamp(明略科技)

AI总结 挑战视觉-语言对齐需全参数更新的观点,研究低秩适应在此阶段的应用,发现其能降成本且性能优。通过实证、几何分析和理论推导探究现象原因,并进行多方面消融实验。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07608 2026-07-09 cs.RO cs.CV 新提交

Dual Latent Memory in Vision-Language-Action Models for Robotic Manipulation

用于机器人操作的视觉-语言-动作模型中的双潜记忆

Hongyu Qu, Jianzhe Gao, Xiaobin Hu, Shaohuan Yang, Xinlei Yu, Rui Yan, Wenguan Wang, Xiangbo Shu, Shuicheng Yan

机构 * Nanjing University of Science and Technology(南京理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

AI总结 研究针对主流VLA模型处理长期任务的不足,提出LaMem-VLA框架,通过四个协调组件将历史经验重构为潜记忆令牌并与VLA推理直接交织,实现在同一潜空间处理历史经验,经实验验证该框架具有优越性。

Comments Project page: https://github.com/quhongyu/LaMem-VLA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07320 2026-07-09 cs.CV 新提交

SoccerNet 2026 Challenges Results

SoccerNet 2026挑战结果

Anthony Cioppa, Silvio Giancola, Håkan Ardö, Mohamad Dalal, Jan Held, Jérémie Ochin, Jiayuan Rao, Karen Sanchez, Renaud Vandeghen, Artur Xarles, Olivier Barnich, Albert Clapés, Mathieu Delvaux, Sergio Escalera, Bernard Ghanem, Cédric Hons, Antoine Houet, Sotiris Manitsaris, Tom Michel, Pierre Miralles, Thomas B. Moeslund, Mikael Nilsson, Bogdan Stanciulescu, Marc Van Droogenbroeck, Yanfeng Wang, Weidi Xie, Faisal Altawijri, Mohamed Atef, Semen Budennyy, Vasiliy Chelpanov, Puhua Chen, Yixin Chen, Lechao Cheng, Jianling Chu, Ju-Seong Do, Oleg Durygin, Omar Fetouh, Mirco Fuchs, Youssef Ghallab, Falguni Ghosh, Wonjun Heo, Yufeng Hu, Weixuan Huang, Phuong-Linh Huynh-Ha, Matvey Isupov, Yangguang Ji, Siyuan Jiang, Zhenxiang Jiang, Wonyong Jo, Ho-Young Jung, SeongHeon Kang, MinJae Kim, Youngseon Kim, Jakub Komosa, Artem Konshin, Trung-Hoang Le, Jongmin Lee, Lingling Li, Litao Li, Vadim Linkov, Fang Liu, Haoxuan Ma, Shun Makino, Ismail Mathkour, Konstantin Mitin, Mikhail Moiseev, Takumi Nagaya, Yuki Nakamura, Thanh-Khoi Nguyen, Hoang-Phuc Nguyen, Trong-Thuan Nguyen, Christian Orduz, Kwanyong Park, Fabian Perez, Parthsarthi Rawat, SuHyun Rim, Hoover Rueda-Chacón, Atom Scott, Minori Sugimura, Yuyang Sun, Shengeng Tang, Minh-Triet Tran, Ikuma Uchida, Juan Vanegas, Thanh-Nhan Vo, Jiangtao Wang, Yaxiong Wang, Xiaogang Wang, Ruifeng Wang, Rio Watanabe, Jiali Wen, Yongliang Wu, Di Yang, Xu Yang, Zhuo Yang, Xinyu Ye, Yibo Yu, Zihan Zhai, Yu Zhang, Zhenyu Zhao, Zhun Zhong, Yixi Zhou, Xingyu Zhu, Wenbo Zhu, Julian Ziegler

机构 * University of Liège(列日大学) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) Spiideo(斯皮迪奥公司) Aalborg University(奥尔堡大学) SpAItial(斯帕蒂亚尔公司) Center for Robotics, Mines Paris, PSL(巴黎矿业学院机器人中心(巴黎文理研究大学)) Footovision(Footovision公司) Shanghai Jiao Tong University(上海交通大学) Universitat de Barcelona(巴塞罗那大学) Computer Vision Center(计算机视觉中心) EVS Broadcast Equipment(EVS广播设备公司) Pioneer Center for Artificial Intelligence(先锋人工智能中心) Lund University(隆德大学) TAHAKOM(TAHAKOM公司) Mohamed Bin Zayed University for Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Sber AI(Sber人工智能公司) Salute For Business(Salute For Business公司) Intelligent Perception and Image Understanding Lab, Xidian University(西安电子科技大学智能感知与图像理解实验室) South China University of Technology(华南理工大学) Hefei University of Technology(合肥工业大学) Kyungpook National University(庆北国立大学) Leipzig University of Applied Sciences(莱比锡应用科学大学) Friedrich-Alexander University Erlangen-Nuremberg(埃尔朗根-纽伦堡大学) University of Seoul(首尔大学) Shenzhen Institute for Advanced Study, University of Electronic Science and Technology of China(电子科技大学深圳高等研究院) Nanjing University(南京大学) University of Science, Ho Chi Minh City(胡志明市科技大学) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 SoccerNet 2026挑战涵盖五项体育视频理解视觉任务,为每项任务提供数据、协议和基线。众多团队参与,本文介绍任务、评估协议,展示排行榜并总结领先提交内容,记录各任务当前状态。

Comments 40 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06879 2026-07-09 cs.LG stat.ML 新提交

Best-Arm Identification with Generative Proxy

基于生成代理的最佳臂识别

Tianyi Ma, Hanzhang Qin, Ruihao Zhu, Jierui Zuo

机构 * School of Operations Research and Information Engineering, Cornell University(康奈尔大学运营研究与信息工程学院) Department of Industrial Systems Engineering and Management, National University of Singapore(新加坡国立大学工业系统工程与管理系) SC Johnson College of Business, Cornell University(康奈尔大学SC约翰逊商学院) Michael G. Foster School of Business, University of Washington(华盛顿大学迈克尔·G·福斯特商学院)

AI总结 研究固定置信度最佳臂识别,将其与廉价代理分数配对,提出PROBE算法,通过控制变量调整转化为异方差问题,证明算法是δ - PAC的,能达到已知相关性神谕样本复杂度,实验证实样本节省与相关性强度成比例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06740 2026-07-09 cs.RO cs.AI 新提交

A Continual Learning Framework for Adaptive Control of Modular Soft Robots

一种用于模块化软机器人自适应控制的持续学习框架

Nilay Kushawaha, Muhammad Sunny Nazeer, Baljinder Singh Bal, Cecilia Laschi, Egidio Falotico

机构 * The BioRobotics Institute, Scuola Superiore Sant’Anna(生物机器人研究所,圣安娜高等学校) Department of Excellence in Robotics and AI, Scuola Superiore Sant’Anna(机器人与人工智能卓越系,圣安娜高等学校) Department of Mechanical Engineering, National University of Singapore(新加坡国立大学机械工程系) ETIS Lab UMR8051 CY Cergy Paris University - ENSEA - CNRS(ETIS实验室UMR8051,CY赛尔吉 - 巴黎大学 - ENSEA - 法国国家科学研究中心)

AI总结 针对模块化软机器人设计控制器的挑战,提出持续学习启发的控制框架,能顺序学习新配置不忘旧知识,可分布式学习特定模块动力学,经实验验证其能适应形态变化并减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06644 2026-07-09 stat.ML cs.LG math.PR 新提交

Fast determinantal sampling on general spaces and diffusion geometry

一般空间上的快速行列式采样与扩散几何

Hoang-Son Tran, Pranav Gupta, Subhroshekhar Ghosh

机构 * National University of Singapore(国立新加坡大学)

AI总结 研究在一般空间(如黎曼流形和加权网络)上的行列式采样,基于谱核建立明确速率保证,实现与可比维度欧几里得空间已知速率匹配,借助韦尔定律及马尔可夫扩散等理论工具。

Comments Preliminary version - to be updated

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04434 2026-07-09 cs.RO cs.AI cs.CV cs.GR 新提交

RoboDojo: A Unified Sim-and-Real Benchmark for Comprehensive Evaluation of Generalist Robot Manipulation Policies

RoboDojo:用于综合评估通用机器人操作策略的统一模拟与现实基准测试

Tianxing Chen, Yue Chen, Zixuan Li, Junyuan Tang, Kailun Su, Haoran Lu, Weijie Wan, Baijun Chen, Songling Liu, Haowen Yan, Honghao Su, Zhiyang Dou, Kaixuan Wang, Dandan Zhang, Yunze Liu, Yan Qin, Qiwei Liang, Qiwei Wu, Zijian Lin, Wenwei Lin, Yuran Wang, Minghua He, Tianshu Wu, Ruihai Wu, Jingquan Zhou, Kai-Chong Lei, Haibao Yu, Yuanfeng Ji, Weiyang Jin, Guanyu Lin, Xiaofan Li, Qi Xiong, Renjing Xu, Zhongyu Li, Wenhao Chai, Enze Xie, Ziwei Wang, Yao Mu, Hao Dong, Wojciech Matusik, Mingyu Ding, Wenbo Ding, Ping Luo, Masayoshi Tomizuka

机构 * UC Berkeley(加州大学伯克利分校) THU(清华大学) PKU(北京大学) Stanford(斯坦福大学) MIT(麻省理工学院) UNC(北卡罗来纳大学) Princeton(普林斯顿大学) CMU(卡内基梅隆大学) NUS(新加坡国立大学) NTU(南洋理工大学) CUHK(香港中文大学) SJTU(上海交通大学) HKUST (GZ)(香港科技大学(广州)) ZJU(浙江大学) Yale(耶鲁大学)

AI总结 现有基准测试在系统评估通用机器人操作策略能力方面有限,本文引入RoboDojo统一基准测试,含模拟与现实任务,支持多维度评估及可扩展评估,还建立了公共排行榜与系统分析。

Comments Website: https://robodojo-benchmark.com/, Code: https://github.com/RoboDojo-Benchmark/RoboDojo, Leaderboard: https://robodojo-benchmark.com/leaderboard

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01935 2026-07-09 cs.AI 新提交

A-TMA: Decoupling State-Aware Memory Failures in Long-Term Agent Memory

A-TMA: 解耦长期智能体记忆中的状态感知记忆故障

Zitong Shi, Yixuan Tang, Anthony Kum Hoe Tung

机构 * National University of Singapore(新加坡国立大学)

AI总结 针对长期记忆中状态不一致导致的幽灵记忆问题,提出A-TMA方法,通过状态感知覆盖层在存储、检索和回答三个层面解耦故障,在冲突密集基准上显著提升时间F1。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06501 2026-07-08 cs.RO 新提交

Hypothesis-driven Model Expansion under Uncertainty for Open-World Robot Planning

不确定性下用于开放世界机器人规划的假设驱动模型扩展

Anxing Xiao, Hanbo Zhang, Tianrun Hu, David Hsu

机构 * School of Computing, National University of Singapore(新加坡国立大学计算机学院) Smart Systems Institute, National University of Singapore(新加坡国立大学智能系统研究所)

AI总结 针对开放世界机器人规划中传统方法失效的问题,提出假设驱动模型扩展框架,利用基础模型生成假设,结合自动规划与验证反馈进行迭代优化,实现自主知识扩展,推动家用服务机器人实际部署。

Comments Accepted to Robotics: Science and Systems (RSS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05794 2026-07-08 cs.AI 新提交

From Passive Retrieval to Active Memory Navigation: Learning to Use Memory as a Structured Action Space

从被动检索到主动记忆导航:学习将记忆用作结构化动作空间

Yue Xu, Yutao Sun, Yihao Liu, Mengyu Zhou, Jiayi Qiao, Lu Ma, Kai Tang, Wenjie Wang, Xiaoxi Jiang, Guanjun Jiang

机构 * Alibaba(阿里巴巴) ShanghaiTech University(上海科技大学) Zhejiang University(浙江大学) Peking University(北京大学) National University of Singapore(新加坡国立大学)

AI总结 研究针对个性化对话代理中记忆系统的被动性问题,提出NapMem框架,将用户记忆组织成多粒度金字塔并通过工具暴露层次,经记忆工具强化学习训练智能体,在多任务实验中具竞争力,还进行了多方面分析,证明结构化存储与策略结合对长期用户记忆有益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05783 2026-07-08 cs.CV 新提交

Benchmarking the Robustness of Autonomous Driving to Environmental Illusions: A Lane Perception Perspective

从车道感知角度评估自动驾驶对环境错觉的鲁棒性:基准测试

Tianyuan Zhang, Xianglong Liu, Aishan Liu, Lu Wang, Yitong Zhang, Peng Yue, Mingchuan Zhang, Siyuan Liang, Dacheng Tao

机构 * SKLCCSE, the School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院软件安全技术与工程北京市重点实验室) the School of Cyber Science and Technology, Sun Yat-sen University(中山大学网络空间科学与技术学院) Henan University of Science and Technology(河南科技大学) the School of Computing, National University of Singapore(新加坡国立大学计算学院) College of Computing & Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 研究自动驾驶对环境错觉的鲁棒性,聚焦传统车道检测和视觉语言模型系统。引入基准LanEvil++并评估,发现错觉严重影响性能,阴影干扰最大。提出多模态错觉防御方法MIDA,有效提升了模型在挑战性条件下的鲁棒性。

Comments Accepted by IEEE TPAMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05765 2026-07-08 cs.CV cs.RO 新提交

Image2Sim: Scaling Embodied Navigation via Generative Neural Simulator

Image2Sim:通过生成神经模拟器扩展具身导航

Zihan Wang, Seungjun Lee, Yinghao Xu, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学) HKUST(香港科技大学)

AI总结 研究针对具身导航缺乏优质交互环境的问题,提出Image2Sim实时神经模拟框架,通过解耦3D空间锚定与观察合成构建环境,能大规模生成相关数据,训练的导航模型在基准测试中有提升且可迁移,为具身导航提供实用训练基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27377 2026-07-08 cs.CV cs.CL cs.LG 新提交

DanceOPD: On-Policy Generative Field Distillation

DanceOPD:在策略生成场蒸馏

Wei Zhou, Xiongwei Zhu, Zelin Xu, Bo Dong, Lixue Gong, Yongyuan Liang, Meng Chu, Leigang Qu, Lingdong Kong, Wei Liu, Tat-Seng Chua

机构 * ByteDance Seed(字节跳动Seed) NUS(新加坡国立大学) UMD(马里兰大学) HKUST(香港科技大学)

AI总结 提出DanceOPD框架,通过将每个样本路由到能力场并查询低噪声学生诱导状态,用速度MSE损失训练流匹配模型,实现文本到图像、局部编辑和全局编辑的多能力组合,提升目标能力同时保持生成质量。

Comments Technical Report; 40 pages, 13 figures, 9 tables; Project Page at https://danceopd.github.io/ GitHub Repo at https://github.com/worldbench/DanceOPD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05051 2026-07-07 cs.SD 新提交

Listen, Think, Transcribe: Continuous Latent Test-Time Scaling for ASR

倾听、思考、转录:用于自动语音识别的连续潜在测试时间缩放

Ho Lam Chung, Yiming Chen, Dau-Cheng Lyu, Hsiao-Tsung Hung, Hung-yi Lee

机构 * National Taiwan University, Taiwan(台湾国立台湾大学) ASUS, Taiwan(台湾ASUS) National University of Singapore, Singapore(新加坡国立大学)

AI总结 提出LatentASR方法,通过两个可训练模块在冻结的ASR主干上添加连续潜在测试时间缩放,在极小数据量下降低词错误率,动态停止可节省计算量,还能在多语言中泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04972 2026-07-07 cs.RO cs.AI 新提交

Multi-Robot Open Adaptive Teaming Across Unseen Environments, Partners, and Scales

跨未知环境、伙伴和规模的多机器人开放式自适应协作

Yang Li, Feng Xue, Fan Mo, Yunhao Liu, Jianhong Wang, Ying Wen, Qingrui Zhang, Shaoshuai Mou, Wei Pan

机构 * Shanghai Jiao Tong University(上海交通大学) Sun Yat-sen University(中山大学) National University of Singapore(新加坡国立大学) Genisom AI University of Bristol(布里斯托大学) Purdue University(普渡大学) Newcastle University(新castle大学)

AI总结 研究多机器人在未知环境、伙伴及规模下的协作,提出超图形式博弈公式,开发HOLA算法,能在训练中扩展多样性,在多平台实验中性能优于基线,策略可直接部署到硬件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04761 2026-07-07 cs.CV 新提交

DeGenseGS: Geometrically and Semantically Decoupled Surgical Scene Understanding in 4D Gaussian Splatting

DeGenseGS:4D高斯点云渲染中几何与语义解耦的手术场景理解

Yimo Wang, Bin Kang, Shuojue Yang, Yueming Jin

机构 * School of Automation, Southeast University(东南大学自动化学院) School of Internet of Things, Nanjing University of Posts and Telecommunications(南京邮电大学物联网学院) Department of Biomedical Engineering, National University of Singapore(新加坡国立大学生物医学工程系)

AI总结 研究针对自主手术交互中语义与解剖错位问题,提出DeGenseGS框架,独立建模语义演变与几何变形,用时空纠缠模块同步语义与场景动态,还设计机制确保鲁棒性,提升了手术场景理解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04534 2026-07-07 cs.CL 新提交

Mechanism-level routing failure in LLMs over Lean-verified algebraic structures

基于精益验证代数结构的大语言模型中的机制级路由失败

Manuel Israel Cázares, Wenlin Zhang, Haobo Ma

机构 * Bytepro AI(字节宝人工智能公司) National University of Singapore(新加坡国立大学) Omega Institute(欧米茄研究所) ChronoAI(chrono人工智能公司)

AI总结 研究大语言模型在形式验证代数语料库中的结构路由失败,通过在固定模板集选正确证明机制标签任务,发现机制级路由上限,揭示主导失败类型及模型差异,扩展了路由器假设。

Comments Code, data, and evaluation pipeline available at https://github.com/bytepro-ai/fiber-routing-eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04484 2026-07-07 cs.CV 新提交

TrustCLIP: Learning Private Visual Features via Adversarial Reconstruction

TrustCLIP:通过对抗性重建学习隐私视觉特征

Nikos Athanasiou, Ilya A. Petrov, Angela Yao, Shugao Ma, Eric Sauser, Edoardo Remelli, Shreyas Hampali, Johannes Schönberger, Fadime Sener, Bugra Tekin

机构 * Meta Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) University of Tübingen(图宾根大学) National University of Singapore(新加坡国立大学)

AI总结 研究视觉和视觉语言模型中视觉特征隐私问题,提出TrustCLIP框架,以特征条件生成器为隐私对手,优化编码器特征与下游模块投影,降低生成式反演保真度并保持下游任务性能。

Comments https://atnikos.github.io/trustclip/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04439 2026-07-07 cs.AI 新提交

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes

研究工作室-创意:基于机器学习会议成果的有证据支持的研究创意技能套件

Qihao Zhao, Yangyu Huang, Yalun Dai, Lingao Xiao, Jianjun Gao, Xin Zhang, Wenshan Wu, Scarlett Li, Yang He, Yan Lu, Yap Kim Hui

机构 * Nanyang Technological University(南洋理工大学) Microsoft Research(微软研究院) National University of Singapore(新加坡国立大学) CFAR, A*STAR(计算机辅助放射治疗中心,新加坡科技研究局)

AI总结 研究问题是提升研究创意,核心方法是构建包含多种技能的套件,主要贡献是揭示31个反复出现的创意子模式并整合为15个可复用模式,能将其转化为可追溯研究提案,经评估效果优于基线。

Comments Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04433 2026-07-07 cs.IR cs.CL 新提交

Autonomous Information Seeking: A Roadmap for Agentic Recommender Systems

自主信息寻求:智能推荐系统路线图

Xinyu Lin, Yashar Deldjoo, Sunhao Dai, Honghui Bao, Xiaopeng Ye, Fatemeh Nazary, Wenjie Wang, Tommaso Di Noia, Jun Xu, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Polytechnic University of Bari(巴里理工大学) Renmin University of China(中国人民大学) University of Science and Technology of China(中国科学技术大学)

AI总结 综述基于大语言模型的智能体融入推荐系统带来的转变,介绍基于自主性水平的分类法及三种核心范式,分析各范式采用的架构和智能体对关键组件的增强,探讨评估方法及未解决问题,指出开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04428 2026-07-07 cs.CL cs.AI 新提交

dOPSD: On-Policy Self-Distillation for Diffusion Language Models

dOPSD:扩散语言模型的策略内自蒸馏

Phuong Tuan Dat, Qi Li, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学)

AI总结 研究扩散语言模型强化推理难的问题,提出dOPSD,通过从学生去噪轨迹直接推导教师特权信息,实现策略内自蒸馏,提升模型在数学推理和代码生成等任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04332 2026-07-07 cs.LG 新提交

On the effectiveness of reward functions in reinforcement learning for confidence calibration of large language models

关于强化学习中奖励函数对大语言模型置信度校准的有效性

Chee Heng Tan, Zhuoyi Lin, Mehul Motani, Wee Sun Lee

机构 * School of Computing National University of Singapore(新加坡国立大学计算机学院) Institute of Advanced Intelligence and Computing(高级智能与计算研究所) Agency for Science, Technology and Research(科技研究局) Department of Electrical & Computer Engineering(电气与计算机工程系)

AI总结 研究大语言模型用强化学习训练以提升推理准确性和表达置信度时,奖励函数的设计问题。提出不可破解置信奖励方案概念并定义相关奖励方案谱,指出实际数据集中存在的问题及最佳校准奖励方案因数据集和应用而异。

Comments 50 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03595 2026-07-07 cs.CV cs.AI cs.RO 新提交

Token-Based Affordance Grounding with Large Vision-Language Models

基于令牌的大型视觉语言模型的可供性基础

Seung Il Lee, Qinqian Lei, Daguang Xu, Dong Yang, Robby T. Tan, Yixin Chen, Bo Wang

机构 * University of Mississippi(密西西比大学) National University of Singapore(新加坡国立大学) NVIDIA(英伟达)

AI总结 研究旨在解决现有视觉语言模型在行动定位上的问题,提出TokAG零样本可供性基础框架,利用令牌级语义空间信号定位相关区域,引入空间感知令牌选择机制,在多基准测试中优于先前方法。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02963 2026-07-07 cs.CV cs.AI cs.MM 新提交

Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning

用于全模态密集视频字幕的并行自回归解码

Wenzheng Zeng, Siyi Jiao, Chen Gao, Hwee Tou Ng, Mike Zheng Shou

机构 * National University of Singapore(新加坡国立大学)

AI总结 研究密集视频字幕生成,提出并行自回归框架,利用事件间弱局部依赖重组因果依赖图,引入全局规划和事件分解并行解码机制,提升效率与字幕性能。

Comments ECCV 2026. Project website: https://github.com/showlab/PadCaptioner

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02961 2026-07-07 cs.CV cs.CR 新提交

Overloading Large Vision-Language Models for Jailbreaking

通过信息过载对大型视觉语言模型进行越狱攻击

Haoyu Zhang, Yangyang Guo, Mohan Kankanhalli

机构 * National University of Singapore(新加坡国立大学) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)

AI总结 研究大型视觉语言模型易受越狱攻击问题,提出基于递归图像排版布局的信息过载方法,含大量文本和多维图像攻击,大幅提升攻击成功率,凸显此为现实部署安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02896 2026-07-07 cs.IT cs.LG math.IT math.ST stat.ML stat.TH 新提交

Open Problem: Is Interaction Necessary for Order-Optimal 1-bit Mean Estimation?

开放问题:1比特均值估计的最优阶是否需要交互?

Ivan Lau, Jonathan Scarlett

机构 * National University of Singapore(新加坡国立大学)

AI总结 探讨非参数有限矩类上1比特均值估计最优阶是否需交互。自适应阈值查询协议可达最优阶极小极大率,非自适应中阈值和区间查询次优,任意非自适应量化器情况未决。

Comments COLT 2026 Open Problem

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03904 2026-07-07 cs.LG astro-ph.IM gr-qc 新提交

Transformers with Physics-Informed Encodings and Simulation-Based Inference for Robust Detection of Eccentric Binary Black Holes in Pulsar Timing Array Data

具有物理信息编码和基于模拟推理的变压器用于脉冲星计时阵列数据中偏心双黑洞的稳健检测

Subhajit Dandapat, Alvin J. K. Chua

机构 * Department of Physics, National University of Singapore(新加坡国立大学物理系) Department of Mathematics, National University of Singapore(新加坡国立大学数学系)

AI总结 研究利用含物理信息编码框架的Transformer从脉冲星计时阵列数据高效推断相对论轨道上偏心双黑洞,用生成模型在模拟推理框架中推断后验分布,相比无物理基线有改进。

Comments 24 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15198 2026-07-07 cs.CV cs.HC 新提交

City landscape in sight: A crowdsourced framework for unlocking urban-scale window view perceptions from real estate imagery

城市景观在望:一种从房地产图像解锁城市尺度窗景感知的众包框架

Chucai Peng, Sijie Yang, Ang Liu, Yang Xiang, Zhixiang Zhou, Filip Biljecki

机构 * National University of Singapore(新加坡国立大学)

AI总结 提出一种利用房地产平台真实窗景图像(WVI)进行大规模感知映射的方法,通过混合神经网络模型预测六维感知并分析空间分布,发现楼层高度和窗景组成(如天空、树木比例)对感知有非线性影响。

Journal ref Landscape and Urban Planning, 275, 105734 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏