arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

2026-07-07 至 2026-07-07 共收录 15
2607.05051 2026-07-07 cs.SD 新提交

Listen, Think, Transcribe: Continuous Latent Test-Time Scaling for ASR

倾听、思考、转录:用于自动语音识别的连续潜在测试时间缩放

Ho Lam Chung, Yiming Chen, Dau-Cheng Lyu, Hsiao-Tsung Hung, Hung-yi Lee

机构 * National Taiwan University, Taiwan(台湾国立台湾大学) ASUS, Taiwan(台湾ASUS) National University of Singapore, Singapore(新加坡国立大学)

AI总结 提出LatentASR方法,通过两个可训练模块在冻结的ASR主干上添加连续潜在测试时间缩放,在极小数据量下降低词错误率,动态停止可节省计算量,还能在多语言中泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04972 2026-07-07 cs.RO cs.AI 新提交

Multi-Robot Open Adaptive Teaming Across Unseen Environments, Partners, and Scales

跨未知环境、伙伴和规模的多机器人开放式自适应协作

Yang Li, Feng Xue, Fan Mo, Yunhao Liu, Jianhong Wang, Ying Wen, Qingrui Zhang, Shaoshuai Mou, Wei Pan

机构 * Shanghai Jiao Tong University(上海交通大学) Sun Yat-sen University(中山大学) National University of Singapore(新加坡国立大学) Genisom AI University of Bristol(布里斯托大学) Purdue University(普渡大学) Newcastle University(新castle大学)

AI总结 研究多机器人在未知环境、伙伴及规模下的协作,提出超图形式博弈公式,开发HOLA算法,能在训练中扩展多样性,在多平台实验中性能优于基线,策略可直接部署到硬件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04761 2026-07-07 cs.CV 新提交

DeGenseGS: Geometrically and Semantically Decoupled Surgical Scene Understanding in 4D Gaussian Splatting

DeGenseGS:4D高斯点云渲染中几何与语义解耦的手术场景理解

Yimo Wang, Bin Kang, Shuojue Yang, Yueming Jin

机构 * School of Automation, Southeast University(东南大学自动化学院) School of Internet of Things, Nanjing University of Posts and Telecommunications(南京邮电大学物联网学院) Department of Biomedical Engineering, National University of Singapore(新加坡国立大学生物医学工程系)

AI总结 研究针对自主手术交互中语义与解剖错位问题,提出DeGenseGS框架,独立建模语义演变与几何变形,用时空纠缠模块同步语义与场景动态,还设计机制确保鲁棒性,提升了手术场景理解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04534 2026-07-07 cs.CL 新提交

Mechanism-level routing failure in LLMs over Lean-verified algebraic structures

基于精益验证代数结构的大语言模型中的机制级路由失败

Manuel Israel Cázares, Wenlin Zhang, Haobo Ma

机构 * Bytepro AI(字节宝人工智能公司) National University of Singapore(新加坡国立大学) Omega Institute(欧米茄研究所) ChronoAI(chrono人工智能公司)

AI总结 研究大语言模型在形式验证代数语料库中的结构路由失败,通过在固定模板集选正确证明机制标签任务,发现机制级路由上限,揭示主导失败类型及模型差异,扩展了路由器假设。

Comments Code, data, and evaluation pipeline available at https://github.com/bytepro-ai/fiber-routing-eval

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04439 2026-07-07 cs.AI 新提交

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes

研究工作室-创意:基于机器学习会议成果的有证据支持的研究创意技能套件

Qihao Zhao, Yangyu Huang, Yalun Dai, Lingao Xiao, Jianjun Gao, Xin Zhang, Wenshan Wu, Scarlett Li, Yang He, Yan Lu, Yap Kim Hui

机构 * Nanyang Technological University(南洋理工大学) Microsoft Research(微软研究院) National University of Singapore(新加坡国立大学) CFAR, A*STAR(计算机辅助放射治疗中心,新加坡科技研究局)

AI总结 研究问题是提升研究创意,核心方法是构建包含多种技能的套件,主要贡献是揭示31个反复出现的创意子模式并整合为15个可复用模式,能将其转化为可追溯研究提案,经评估效果优于基线。

Comments Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04433 2026-07-07 cs.IR cs.CL 新提交

Autonomous Information Seeking: A Roadmap for Agentic Recommender Systems

自主信息寻求:智能推荐系统路线图

Xinyu Lin, Yashar Deldjoo, Sunhao Dai, Honghui Bao, Xiaopeng Ye, Fatemeh Nazary, Wenjie Wang, Tommaso Di Noia, Jun Xu, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Polytechnic University of Bari(巴里理工大学) Renmin University of China(中国人民大学) University of Science and Technology of China(中国科学技术大学)

AI总结 综述基于大语言模型的智能体融入推荐系统带来的转变,介绍基于自主性水平的分类法及三种核心范式,分析各范式采用的架构和智能体对关键组件的增强,探讨评估方法及未解决问题,指出开放挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04428 2026-07-07 cs.CL cs.AI 新提交

dOPSD: On-Policy Self-Distillation for Diffusion Language Models

dOPSD:扩散语言模型的策略内自蒸馏

Phuong Tuan Dat, Qi Li, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学)

AI总结 研究扩散语言模型强化推理难的问题,提出dOPSD,通过从学生去噪轨迹直接推导教师特权信息,实现策略内自蒸馏,提升模型在数学推理和代码生成等任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04332 2026-07-07 cs.LG 新提交

On the effectiveness of reward functions in reinforcement learning for confidence calibration of large language models

关于强化学习中奖励函数对大语言模型置信度校准的有效性

Chee Heng Tan, Zhuoyi Lin, Mehul Motani, Wee Sun Lee

机构 * School of Computing National University of Singapore(新加坡国立大学计算机学院) Institute of Advanced Intelligence and Computing(高级智能与计算研究所) Agency for Science, Technology and Research(科技研究局) Department of Electrical & Computer Engineering(电气与计算机工程系)

AI总结 研究大语言模型用强化学习训练以提升推理准确性和表达置信度时,奖励函数的设计问题。提出不可破解置信奖励方案概念并定义相关奖励方案谱,指出实际数据集中存在的问题及最佳校准奖励方案因数据集和应用而异。

Comments 50 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03595 2026-07-07 cs.CV cs.AI cs.RO 新提交

Token-Based Affordance Grounding with Large Vision-Language Models

基于令牌的大型视觉语言模型的可供性基础

Seung Il Lee, Qinqian Lei, Daguang Xu, Dong Yang, Robby T. Tan, Yixin Chen, Bo Wang

机构 * University of Mississippi(密西西比大学) National University of Singapore(新加坡国立大学) NVIDIA(英伟达)

AI总结 研究旨在解决现有视觉语言模型在行动定位上的问题,提出TokAG零样本可供性基础框架,利用令牌级语义空间信号定位相关区域,引入空间感知令牌选择机制,在多基准测试中优于先前方法。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02963 2026-07-07 cs.CV cs.AI cs.MM 新提交

Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning

用于全模态密集视频字幕的并行自回归解码

Wenzheng Zeng, Siyi Jiao, Chen Gao, Hwee Tou Ng, Mike Zheng Shou

机构 * National University of Singapore(新加坡国立大学)

AI总结 研究密集视频字幕生成,提出并行自回归框架,利用事件间弱局部依赖重组因果依赖图,引入全局规划和事件分解并行解码机制,提升效率与字幕性能。

Comments ECCV 2026. Project website: https://github.com/showlab/PadCaptioner

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02961 2026-07-07 cs.CV cs.CR 新提交

Overloading Large Vision-Language Models for Jailbreaking

通过信息过载对大型视觉语言模型进行越狱攻击

Haoyu Zhang, Yangyang Guo, Mohan Kankanhalli

机构 * National University of Singapore(新加坡国立大学) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)

AI总结 研究大型视觉语言模型易受越狱攻击问题,提出基于递归图像排版布局的信息过载方法,含大量文本和多维图像攻击,大幅提升攻击成功率,凸显此为现实部署安全风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02896 2026-07-07 cs.IT cs.LG math.IT math.ST stat.ML stat.TH 新提交

Open Problem: Is Interaction Necessary for Order-Optimal 1-bit Mean Estimation?

开放问题:1比特均值估计的最优阶是否需要交互?

Ivan Lau, Jonathan Scarlett

机构 * National University of Singapore(新加坡国立大学)

AI总结 探讨非参数有限矩类上1比特均值估计最优阶是否需交互。自适应阈值查询协议可达最优阶极小极大率,非自适应中阈值和区间查询次优,任意非自适应量化器情况未决。

Comments COLT 2026 Open Problem

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03904 2026-07-07 cs.LG astro-ph.IM gr-qc 新提交

Transformers with Physics-Informed Encodings and Simulation-Based Inference for Robust Detection of Eccentric Binary Black Holes in Pulsar Timing Array Data

具有物理信息编码和基于模拟推理的变压器用于脉冲星计时阵列数据中偏心双黑洞的稳健检测

Subhajit Dandapat, Alvin J. K. Chua

机构 * Department of Physics, National University of Singapore(新加坡国立大学物理系) Department of Mathematics, National University of Singapore(新加坡国立大学数学系)

AI总结 研究利用含物理信息编码框架的Transformer从脉冲星计时阵列数据高效推断相对论轨道上偏心双黑洞,用生成模型在模拟推理框架中推断后验分布,相比无物理基线有改进。

Comments 24 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15198 2026-07-07 cs.CV cs.HC 新提交

City landscape in sight: A crowdsourced framework for unlocking urban-scale window view perceptions from real estate imagery

城市景观在望:一种从房地产图像解锁城市尺度窗景感知的众包框架

Chucai Peng, Sijie Yang, Ang Liu, Yang Xiang, Zhixiang Zhou, Filip Biljecki

机构 * National University of Singapore(新加坡国立大学)

AI总结 提出一种利用房地产平台真实窗景图像(WVI)进行大规模感知映射的方法,通过混合神经网络模型预测六维感知并分析空间分布,发现楼层高度和窗景组成(如天空、树木比例)对感知有非线性影响。

Journal ref Landscape and Urban Planning, 275, 105734 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10522 2026-07-07 cs.CV 新提交

GUI-AC: Enhancing Continual Learning in GUI Agents

GUI-AC:增强GUI代理的持续学习能力

Can Lin, Tao Feng, Hangjie Yuan, Dan Zhang, Yifan Zhu, Zhonghong Ou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学)

AI总结 针对GUI代理在持续学习中的分布漂移和强化微调不稳定性问题,提出GUI-AC方法,通过自适应优势和动态裁剪机制提升性能,超越现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏