arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

共收录 202
2606.31651 2026-07-14 cs.AI 版本更新

FARS: A Fully Automated Research System Deployed at Scale

FARS:一个大规模部署的全自动研究系统

Qiong Tang, Tianxiang Sun, Xiangkun Hu, Xiangyang Liu, Yiran Chen, Yunfan Shao, Bobo Li, Changze Lv, Cheng Xu, Chengsong Huang, Chunyang Li, Dizhan Xue, Hao Bai, Haodong Duan, Hengquan Guo, Hongyang He, Hongyi Chen, Hui Shen, Jiahao Yuan, Jiankai Sun, Jikang Cheng, Jinfeng Xu, Jingqi Tong, Jingye Chen, Jinxiu Liu, Jixuan Leng, Junchi Yu, Kaixun Jiang, Kun Xiang, Kunpeng Yao, Lang Feng, Liangqi Yuan, Longsen Gao, Meng Li, Qi Jia, Qiushi Sun, Shengyuan Ding, Shizhan Gong, Siru Zhong, Terry Jingchen Zhang, Tianle Gu, Tianyi Liang, Weijie Liu, Weikai Yang, Weizhi Fei, Xin Wang, Xinpeng Liu, Xuanwen Ding, Yihong Tang, Yuanli Wang, Yukun Jiang, Yuming Yang, Zhengbao He, Zhikai Chen, Zhikun Xu, Zhuang Li, Zihao Huang

机构 * Analemma National University of Singapore(新加坡国立大学) Fudan University(复旦大学) University College Dublin(都柏林大学) Washington University in St. Louis(圣路易斯华盛顿大学) The Hong Kong University of Science and Technology(香港科技大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ByteDance(字节跳动) ShanghaiTech University(上海科技大学) University of Warwick(华威大学) Carnegie Mellon University(卡内基梅隆大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校) East China Normal University(华东师范大学) Stanford University(斯坦福大学) Tencent(腾讯) The University of Hong Kong(香港大学) Shanghai Innovation Institute(上海创新研究院) Nex-AGI Team(Nex-AGI团队)

AI总结 提出FARS系统,通过分阶段智能体协作自动生成研究项目,在67个AI/ML主题上产出166篇论文,经282份评审验证其可产出有价值成果,同时暴露实验范围窄、方法局限和诚信问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11637 2026-07-14 cs.AI 版本更新

TouchThinker: Scaling Tactile Commonsense Reasoning to the Open World with Large-scale Data and Action-aware Representation

TouchThinker: 通过大规模数据和动作感知表示将触觉常识推理扩展到开放世界

Kailin Lyu, Di Wu, Pengwei Zhang, Yuhang Zheng, Yingxin Lai, Long Xiao, Kangyi Wu, Pengna Li, Chen Gao, Lianyu Hu, Xiaobin Hu, Jie Hao, Ce Hao, Weihao Yuan, Shuicheng Yan

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) National University of Singapore(新加坡国立大学) Zhongguancun Academy(中关村学院) Xiamen University(厦门大学) Xi’an Jiaotong University(西安交通大学) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学)

AI总结 提出TouchThinker框架,通过构建百万级多源触觉数据集TouchThinker-1M和动作感知建模,将触觉常识推理扩展到开放世界,在多个数据集上取得竞争性表现。

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18601 2026-07-14 cs.CV 版本更新

Incantation: Natural Language as the Action Interface for Multi-Entity Video World Models

Incantation: 自然语言作为多实体视频世界模型的动作接口

Shangwen Zhu, Qianyu Peng, Zhao Pu, Zhilei Shu, Xiangrui Ke, Zhaohu Xing, Zizhao Tong, Zeqing Wang, Xinyu Cui, Zian Zheng, Huangji Wang, Jian Zhao, Yeying Jin, Fan Cheng, Ruili Feng

机构 * SJTU(上海交通大学) NVIDIA Research(英伟达研究) USTC(中国科学技术大学) UCAS(乌兹别克斯坦科学院) NUS(新加坡国立大学) UWaterloo(滑铁卢大学) HKUST(香港理工大学) HKU(香港大学) ZGCA(浙江大学)

AI总结 本研究提出了一种基于自然语言的动作接口,用于多实体视频世界模型,解决了传统接口在细粒度多实体控制和跨实体、跨世界泛化能力上的不足,通过引入自然语言条件化实现了更强大的表达能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06280 2026-07-14 cs.CV 版本更新

Eulerian Motion Guidance: Robust Image Animation via Bidirectional Geometric Consistency

欧拉运动引导:基于双向几何一致性的鲁棒图像动画

Thong Nguyen, Khoi M. Le, Cong-Duy Nguyen, Luu Anh Tuan, See-Kiong Ng, Chunyan Miao

机构 * National University of Singapore(新加坡国立大学) Centre for AI Research, VinUniversity(Vin大学人工智能研究中心) Nanyang Technological University(南洋理工大学)

AI总结 提出使用相邻帧欧拉运动场引导生成,并通过双向几何一致性机制解决遮挡问题,实现加速训练、保持时间连贯性和减少动态伪影。

Comments Accepted by ACM MM 2026. Code is available at https://github.com/nguyentthong/eulerian_motion_guidance

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09172 2026-07-14 cs.LG 版本更新

BalDRO: A Distributionally Robust Optimization based Framework for Large Language Model Unlearning

BalDRO:一种基于分布鲁棒优化的大语言模型遗忘框架

Pengyang Shao, Naixin Zhai, Lei Chen, Yonghui Yang, Fengbin Zhu, Xun Yang, Meng Wang

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学) Hefei University of Technology(合肥工业大学)

AI总结 针对大语言模型遗忘中样本不均衡问题,提出BalDRO框架,将遗忘设为最小-上确界过程,通过内、外步更新参数,经BalDRO-G和BalDRO-DV变体实例化,实验显示其在遗忘质量和模型效用上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10504 2026-07-14 cs.CL 版本更新

DR-Arena: an Automated Evaluation Framework for Deep Research Agents

DR-Arena:深度研究智能体的自动化评估框架

Yiwen Gao, Ruochen Zhao, Yang Deng, Wenxuan Zhang

机构 * National University of Singapore(国立新加坡大学) Nanyang Technological University(南洋理工大学) Singapore Management University(新加坡管理学院) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 针对大语言模型作深度研究智能体时任务性能评估难的问题,提出DR-Arena自动化评估框架,通过动态调查、构建实时信息树、自动考官出题及自适应进化循环提升任务复杂性来评估,实验证明其与人类偏好对齐效果好,可替代人工裁决。

Comments 22 pages, 8 figures. Accepted to ACL 2026 as an oral presentation and selected as an SAC Highlight

Journal ref Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pp. 27130-27152, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14926 2026-07-13 stat.ML cs.LG 版本更新

Contrastive Learning on Multimodal Analysis of Electronic Health Records

电子健康记录多模态分析中的对比学习

Tianxi Cai, Feiqing Huang, Ryumei Nakada, Linjun Zhang, Doudou Zhou

机构 * Harvard T.H. Chan School of Public Health(哈佛T.H. 柏林公共卫生学院) Harvard Medical School(哈佛医学院) Rutgers University(罗格斯大学) National University of Singapore(新加坡国立大学)

AI总结 研究针对电子健康记录多模态数据传统分析方法不足,提出多模态特征嵌入生成模型及对比损失来学习特征表示,经理论分析、模拟研究和真实数据验证,该方法有效且具隐私保护特性,展现了多模态学习优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07409 2026-07-10 cs.CL cs.LG stat.AP 版本更新

The Proxy Presumption: From Semantic Embeddings to Valid Social Measures

代理假设:从语义嵌入到有效的社会测量

Baishi Li, Ta Yu, Kelvin J. L. Koa, Ke-Wei Huang

机构 * National University of Singapore(新加坡国立大学) Asian Institute of Digital Finance(亚洲数字金融研究院)

AI总结 本文提出Construct Validity Protocol,通过因果表示学习和心理测量学,提供从概念化到量化验证的严谨流程,利用Counterfactual Neutralization方法减少嵌入空间中的混淆因素,构建标准化的效度套件以提升社会测量的科学性。

Comments ACL 2026 (Oral + SAC Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12478 2026-07-10 cs.CV cs.LG 版本更新

Less Data, Faster Convergence: Goal-Driven Data Optimization for Multimodal Instruction Tuning

数据更少,收敛更快:面向多模态指令微调的目标驱动数据优化

Rujie Wu, Haozhe Zhao, Hai Ci, Yizhou Wang

机构 * Peking University(北京大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) National University of Singapore(新加坡国立大学)

AI总结 本文提出目标驱动数据优化框架GDO,通过优化训练样本实现更快收敛和更高精度,适用于多模态指令微调任务。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23192 2026-07-08 cs.LG 版本更新

PGOT: A Physics-Geometry Operator Transformer for Complex PDEs

PGOT:用于复杂偏微分方程的物理-几何运算变换器

Zhuo Zhang, Xi Yang, Ying Miao, Xiaobin Hu, Yifu Gao, Yong Yang, Canqun Yang, Boocheong Khoo

机构 * National University of Defense Technology(国防科技大学) National SuperComputer Center in Tianjin(天津国家超算中心) National University of Singapore(新加坡国立大学) Tiangong University(天工大学) Peking University(北京大学)

AI总结 PGOT通过显式几何意识重建物理特征学习,利用SpecGeo-Attention机制在保持线性计算复杂度的同时,保留多尺度几何特征,实现高精度物理场建模。

Comments 24 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24690 2026-07-08 cs.CV 版本更新

UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy

UniICL:通过能力导向的分类系统化统一多模态上下文学习

Yicheng Xu, Jiangning Zhang, Zhucun Xue, Teng Hu, Ran Yi, Xiaobin Hu, Yong Liu, Dacheng Tao

机构 * Zhejiang University(浙江大学) Shanghai Jiaotong University(上海交通大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出能力导向的分类系统,通过构建UniICL-760K语料库和UniICL-Bench评估体系,提出Context-Adaptive Prototype Modulator模块,提升多模态少样本学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17240 2026-07-08 cs.IT cs.DM cs.LG math.IT math.PR 版本更新

A Fast Binary Splitting Approach for Non-Adaptive Learning of Erdős--Rényi Graphs

一种用于非自适应学习厄多斯 - 雷尼图的快速二分法

Hoang Ta, Jonathan Scarlett

机构 * National University of Singapore(国立新加坡大学) Hanoi University of Science and Technology(胡志明市科技大学)

AI总结 研究非自适应学习厄多斯 - 雷尼图问题,扩展二分法,设计测试 - 解码方案,用\(O(\bar{k}\log n)\)次测试高概率恢复边集,解码时间为\(O(\bar{k}^{1+\delta}\log n)\),改进先前工作。

Journal ref IEEE Transactions on Information Theory (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30919 2026-07-07 cs.LG cs.AI 版本更新

De-attribute to Forget for LLM Unlearning

De-attribute to Forget for LLM Unlearning

Xinyang Lu, Jiabao Pan, Rachael Hwee Ling Sim, See-Kiong Ng, Anthony Kum Hoe Tung, Bryan Kian Hsiang Low

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系)

AI总结 本文提出基于数据归因奖励的LLM遗忘框架DareU,通过强化学习降低生成响应与遗忘数据的归因分数,实现有效遗忘并平衡模型效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27991 2026-07-07 stat.ML cs.LG 版本更新

Gradient-Flow Optimization as Dynamic Random-Effects Inference: Testing and Early Stopping with Applications to Deep Learning

深度神经网络训练作为随机效应:优化-推断对偶性

Minhao Yao, Ruoyu Wang, Xihong Lin, Lin Liu, Zhonghua Liu

机构 * Centre for Biomedical Data Science, Duke-NUS Medical School, National University of Singapore(生物医学数据科学中心,国立新加坡大学杜克-新加坡医学学校) Department of Biostatistics, Harvard T.H. Chan School of Public Health, Boston, MA, USA(生物统计学系,哈佛T.H. Chan公共卫生学院,马萨诸塞州波士顿,美国) Institute of Natural Sciences, MOE-LSC, School of Mathematical Sciences, CMA-Shanghai, SJTU-Yale Joint Center of Biostatistics and Data Science, Shanghai Jiao Tong University(自然科学院,MOE-LSC,数学科学学院,CMA-上海,SJTU-耶鲁联合生物统计学与数据科学中心,上海交通大学) Department of Biostatistics, Columbia University, New York, NY, USA(生物统计学系,哥伦比亚大学,纽约州纽约市,美国)

AI总结 本文提出深度神经网络训练与经典随机效应模型等价,揭示了优化-推断对偶性,并利用限制最大似然估计实现基于似然的早停规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09018 2026-07-07 cs.NE cs.AI cs.LG 版本更新

Evolutionary Ensemble of Agents

进化代理群体

Zongmin Yu, Liu Yang

机构 * National University of Singapore(新加坡国立大学)

AI总结 本文提出EvE框架,通过进化编码代理群体实现算法发现,解决了传统方法的局限,展示了自修正群体在复杂代码库中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16771 2026-07-07 cs.SE cs.AI cs.HC 版本更新

EyeMulator: Improving Code Language Models by Mimicking Human Visual Attention

EyeMulator:通过模仿人类视觉注意力改进代码语言模型

Yifan Zhang, Chen Huang, Yueke Zhang, Jiahao Zhang, Toby Jia-Jun Li, Collin McMillan, Kevin Leach, Yu Huang

机构 * Vanderbilt University(范德比大学) National University of Singapore(新加坡国立大学) University of Notre Dame(诺丁汉大学)

AI总结 本文提出EyeMulator,通过提取眼动数据中的扫描路径,调整代码语言模型的注意力机制,使其更符合人类视觉注意力模式,从而在翻译和摘要任务中取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26306 2026-07-07 cs.AI 版本更新

Interactive Learning for LLM Reasoning

为LLM推理设计的交互学习

Hehai Lin, Shilei Cao, Sudong Wang, Haotian Wu, Minzhi Li, Linyi Yang, Juepeng Zheng, Chengwei Qin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Sun Yat-sen University(中山大学) Southern University of Science and Technology(南方科技大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出ILR框架,通过动态交互和感知校准提升LLM独立问题解决能力,实验表明其在多个基准测试中优于单agent学习。

Comments The code is available at https://github.com/linhh29/Interactive-Learning-for-LLM-Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28660 2026-07-07 cs.CV 版本更新

Industrial3D: A Water-Treatment TLS Point Cloud Dataset and Cross-Paradigm Benchmark for MEP Scene Understanding

Industrial3D: 一个用于工业基础设施的地面激光雷达点云数据集和跨范式基准

Chao Yin, Hongzhe Yue, Qing Han, Difeng Hu, Zhenyu Liang, Fangzhou Lin, Bing Sun, Boyu Wang, Mingkai Li, Wei Yao, Jack C. P. Cheng

机构 * Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(香港科技大学土木与环境工程系) Guangzhou Institute of Geography, Guangdong Academy of Sciences(广东省科学院广州地理研究所) School of Civil Engineering, Southeast University(东南大学土木工程学院) College of Geography and Tourism, Hengyang Normal University(衡阳师范学院地理与旅游学院) Department of Architecture and Civil Engineering, City University of Hong Kong(香港城市大学建筑与土木工程系) S.M.A.R.T. Construction Research Group, New York University Abu Dhabi(纽约大学阿布扎比分校S.M.A.R.T.建筑研究组) Department of the Built Environment, National University of Singapore(新加坡国立大学建筑环境系) Spatial Intelligence and Urban Computing, Institute of Urban Environment, Chinese Academy of Sciences(中国科学院城市环境研究所空间智能与城市计算) State Key Lab of Ecological Security of Regions and Cities, Institute of Urban Environment, Chinese Academy of Sciences(中国科学院城市环境研究所区域与城市生态安全国家重点实验室)

AI总结 本文提出Industrial3D数据集,包含6.12亿个高精度标注点云,用于解决工业设施中密集点云的语义理解难题,并建立首个跨范式基准,揭示了工业TLS数据中统计稀有性和几何模糊性带来的领域迁移挑战。

Comments 52 pages, 8 figure, 14 tables

Journal ref 2026, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28345 2026-07-07 cs.SE cs.AI 版本更新

Reachability Across the NL/PL Boundary: A Taxonomy-Driven Dataflow Model for LLM-Integrated Applications

当代码遇见自然语言:基于分类法的LLM集成应用信息流分析

Zihao Xu, Xiao Cheng, Ruijie Meng, Yuekang Li

机构 * University of New South Wales(新南威尔士大学) Macquarie University(麦考瑞大学) National University of Singapore(新加坡国立大学)

AI总结 提出一种基于定量信息流理论的分类法,定义24个标签以跨越LLM调用的自然语言与编程语言边界,实现信息流分析,并在污点传播和程序切片中验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24025 2026-07-07 cs.LG stat.ME 版本更新

i-IF-Learn: Iterative Feature Selection and Unsupervised Learning for High-Dimensional Complex Data

i-IF-Learn: 迭代特征选择与无监督学习用于高维复杂数据

Chen Ma, Wanjie Wang, Shuhao Fan

机构 * SUSTech(华南理工大学) NUS(国立大学)

AI总结 本文提出i-IF-Learn框架,通过迭代特征选择与聚类,有效识别高维数据中的关键特征,提升聚类性能并增强下游模型表现。

Comments 28 pages, 5 figures, including appendix. Accepted at AISTATS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07965 2026-07-07 stat.ML cs.LG 版本更新

Local Constrained Bayesian Optimization

局部约束贝叶斯优化

Jing Jingzhe, Fan Zheyi, Szu Hui Ng, Qingpei Hu

机构 * Department of Industrial Systems Engineering & Management, National University of Singapore, Singapore(新加坡国立大学工业系统工程与管理系,新加坡)

AI总结 针对高维约束问题的贝叶斯优化面临挑战,提出局部约束贝叶斯优化框架。利用约束惩罚替代函数的可微景观,在局部下降与探索间交替,理论证明其收敛率,实验表明优于现有基线。

Comments 28 pages, 7 figures, accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06575 2026-07-07 cs.RO cs.CV 版本更新

Think Proprioceptively: State-Grounded Visual Token Selection for VLA Policies

通过本体感知进行思考:用于VLA策略的状态基础视觉令牌选择

Fangyuan Wang, Peng Zhou, Jiaming Qi, Shipeng Lyu, Chengyang He, David Navarro-Alarcon, Guodong Guo

机构 * The Hong Kong Polytechnic University(香港理工大学) Eastern Institute of Technology(东区技术研究所) Great Bay University(大湾大学) Northeast Forestry University(东北林业大学) National University of Singapore(新加坡国立大学)

AI总结 研究VLA模型中本体感知应用问题,提出ThinkProprio方法,将本体感知离散化为视觉语言模型(VLM)词汇令牌,与指令共同作用在VLM计算前选视觉补丁,贡献是提升性能、降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11960 2026-07-07 cs.LG cs.AI cs.CL 版本更新

R$^2$PO: Decoupling Rollout and Inference Policies for LLM Reasoning

R$^2$PO:用于大语言模型推理的解耦展开与推理策略

Jingchu Wang, Bingbing Xu, Yige Yuan, Dan Zhang, Bin Xie, Xiaoqian Sun, Huawei Shen

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) National University of Singapore(新加坡国家大学)

AI总结 研究指出强化学习方法中训练轨迹与推理响应策略耦合的问题,提出R$^2$PO解耦二者,在训练时多样化展开,保持推理生成不变,实验表明其性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08579 2026-07-07 cs.CL 版本更新

LLM-based Human Simulations Have Not Yet Been Reliable

基于大语言模型的人类模拟尚不可靠

Qian Wang, Jiaying Wu, Zichen Jiang, Zhenheng Tang, Bingqiao Luo, Nuo Chen, Wei Chen, Huacan Wang, Bingsheng He

机构 * National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港理工大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 研究指出基于大语言模型(LLM)的人类模拟不可靠,通过系统回顾找出其在多领域模拟中的问题源于LLM局限与设计缺陷,提出强化数据、提升模型能力及稳健设计的解决框架与算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07447 2026-07-07 cs.PF cs.AI 版本更新

Saving GPU Hours in LLM Inference System Development and Online Workloads with Simulation and DBMS-Inspired Cache Replacement Policies

通过模拟和受数据库管理系统启发的缓存替换策略在大语言模型推理系统开发和在线工作负载中节省GPU时间

Kyoungmin Kim, Jiacheng Li, Kijae Hong, Qunyou Liu, Darong Huang, Anastasia Ailamaki

机构 * EPFL, Switzerland(苏黎世联邦理工学院) NUS, Singapore(新加坡国立大学) POSTECH, South Korea(POSTECH大学)

AI总结 研究大语言模型推理系统,通过模拟和受数据库管理系统启发的缓存替换策略,节省GPU时间,提出新缓存替换策略并证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01299 2026-07-07 cs.CV cs.AI cs.CL cs.LG 版本更新

CausalChaos! Dataset for Comprehensive Causal Action Question Answering Over Longer Causal Chains Grounded in Dynamic Visual Scenes

因果混沌!用于基于动态视觉场景的更长因果链上的综合因果动作问答的数据集

Paritosh Parmar, Eric Peh, Ruirui Chen, Ting En Lam, Yuhan Chen, Elston Tan, Basura Fernando

机构 * Institute of High-Performance Computing, Agency for Science, Technology and Research, Singapore(高性能计算研究所,科技研究局,新加坡) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学) Singapore Polytechnic(新加坡理工学院)

AI总结 针对因果视频问答中现有数据集因果推理深度不足的问题,利用卡通特性构建CausalChaos!数据集,含因果链等问题并引入错误答案挖掘,为因果关系建模等发展助力。

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03056 2026-07-03 cs.AI 版本更新

SkillDAG: Self-Evolving Typed Skill Graphs for LLM Skill Selection at Scale

SkillDAG:面向大规模LLM技能选择的自演化类型化技能图

Tong Bai, Zhenglin Wan, Pengfei Zhou, Xingrui Yu, Yang You, Ivor W. Tsang

机构 * Fudan University(复旦大学) National University of Singapore(国立新加坡大学) CFAR A*STAR

AI总结 提出SkillDAG,通过类型化有向图建模技能间关系,并作为推理时可调用的结构化检索接口,支持在线演化,在ALFWorld和SkillsBench上显著超越基线。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16046 2026-07-03 cs.SE cs.AI 版本更新

XSearch: Explainable Code Search via Concept-to-Code Alignment

XSearch: 通过概念到代码对齐实现可解释的代码搜索

Yiming Liu, Ruofan Liu, Yun Lin, Zicong Zhang, Weiyu Kong, Pengnian Qi, Xiao Cheng, Weinan Zhang, Qianxiang Wang, Linpeng Huang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) National University of Singapore(新加坡国立大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本文提出XSearch框架,通过将代码搜索转化为概念对齐问题,提升代码搜索的可解释性和泛化能力,在分布偏移基准测试中性能提升显著。

Comments Accepted to ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27313 2026-07-03 cs.RO 版本更新

MetaTune: Adjoint-based Meta-tuning via Robotic Differentiable Dynamics

MetaTune: 通过机器人可微动力学进行基于共轭的元调优

Xiexin Peng, Bingheng Wang, Tao Zhang, Que Dong, Ying Zheng

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院) School of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电气与计算机工程系) The Shenzhen Huazhong University of Science and Technology Research Institute(华中科技大学深圳研究院)

AI总结 本文提出MetaTune框架,通过可微闭环元学习实现反馈控制器与扰动观测器的联合自调优,减少计算复杂度并提升鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19013 2026-07-03 cs.CV 版本更新

GenHOI: Generalized Hand-Object Pose Estimation with Occlusion Awareness

GenHOI:具有遮挡意识的通用手-物体姿态估计

Hui Yang, Wei Sun, Jian Liu, Jian Xiao, Tao Xie, Hossein Rahmani, Ajmal Saeed Mian, Nicu Sebe, Gim Hee Lee

机构 * Hunan University(湖南大学) Lancaster University(兰卡斯特大学) University of Western Australia(西澳大学) University of Trento(特伦托大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出GenHOI框架,通过整合层次语义知识与手部先验,提升在遮挡条件下手-物体姿态估计的泛化能力,实验表明在DexYCB和HO3Dv2基准上达到SOTA性能。

Comments European Conference on Computer Vision (ECCV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏