arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

共收录 2379
2509.04923 2026-08-04 quant-ph cs.AI cs.LG

Artificial intelligence for representing and characterizing quantum systems

Yuxuan Du, Yan Zhu, Yuan-Hang Zhang, Min-Hsiu Hsieh, Patrick Rebentrost, Weibo Gao, Ya-Dong Wu, Jens Eisert, Giulio Chiribella, Dacheng Tao, Barry C. Sanders

机构 * College of Computing Data Science, Nanyang Technological University, Singapore 639798, Singapore Computation Initiative, Department of Computer Science, The University of Hong Kong, Pokfulam Road, Hong Kong Department of Physics, University of California, San Diego, La Jolla, CA 92093, USA Hon Hai (Foxconn) Research Institute, Taipei, Taiwan Centre for Quantum Technologies, National University of Singapore Department of Computer Science, National University of Singapore School of Electrical \& Electronic Engineering, Nanyang Technological University, Singapore 639798, Singapore John Hopcroft Center for Computer Science, Shanghai Jiao Tong University, Shanghai 200240, China Dahlem Center for Complex Quantum Systems, Freie Universitat Berlin, 14195 Berlin, Germany Department of Computer Science, Parks Road, Oxford, OX1 3QD, United Kingdom Perimeter Institute for Theoretical Physics, Waterloo, Ontario N2L 2Y5, Canada Institute for Quantum Science Technology, University of Calgary, Alberta T2N 1N4, Canada

Comments 32 pages. Comments are welcome

Journal ref Nature Reviews Physics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21296 2026-08-04 cs.LG cs.AI 版本更新

Fairness in Augmented Graph Learning: A Survey

增强图学习中的公平性:一项综述

Renqiang Luo, Huafei Huang, Ziqi Xu, Xikun Zhang, Enyan Dai, Bo Yang, Feng Xia

机构 * Jilin University(吉林大学) RMIT University(皇家墨尔本理工大学) Nanyang Technological University(南洋理工大学) Dalian University of Technology(大连理工大学) University of South Australia(澳大利亚南澳大利亚大学) Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本综述针对增强图学习(AGL)的新型交叉公平挑战,系统研究其FairGX范式,梳理偏差源与分类法,分析ML范式对公平性的影响,明确未来研究方向,为构建稳健公平图系统提供路线图。

Comments Accepted in TKDE, 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29106 2026-08-03 cs.CV 新提交

Forwardrobe: Garment-Aware Gaussian Avatars from a Single Image

Forwardrobe:基于单张图像的衣物感知高斯化身

Daisheng Jin, Shuyun Wang, Ying He

机构 * Nanyang Technological University(南洋理工大学) The University of Queensland(昆士兰大学)

AI总结 该研究提出Forwardrobe框架,通过在高斯空间分离衣物与身体,实现单张图像的衣物感知高斯化身重建,提升了衣物重建质量与操作灵活性,支持衣物编辑等应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16870 2026-08-03 cs.CV cs.AI 版本更新

Demystifying Video Reasoning

揭秘视频推理

Ruisi Wang, Zhongang Cai, Fanyi Pu, Junxiang Xu, Wanqi Yin, Maijunxian Wang, Ran Ji, Chenyang Gu, Bo Li, Ziqi Huang, Hokin Deng, Dahua Lin, Ziwei Liu, Lei Yang

机构 * SenseTime Research(商汤科技研究院) Nanyang Technological University(南洋理工大学) University of California, Berkeley(加州大学伯克利分校) University of California, San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文通过实验揭示视频扩散模型中的推理主要发生在去噪步骤中,提出链式步骤(CoS)机制,并发现工作记忆、自我修正和感知先行等涌现行为,最后提出一种无需训练的集成策略来提升推理能力。

Comments Homepage: https://www.wruisi.com/demystifying_video_reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18660 2026-08-03 cs.CV 版本更新

So-Fake: Benchmarking and Explaining Social Media Image Forgery Detection

So-Fake:社交媒体图像伪造检测的基准构建与可解释性研究

Zhenglin Huang, Xiangtai Li, Xi Yang, Bei Peng, Xiaowei Huang, Baoyuan Wu, Dacheng Tao, Ming-Hsuan Yang, Guangliang Cheng

机构 * University of Liverpool, UK(利物浦大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) The University of Sheffield(谢菲尔德大学)

AI总结 该研究针对社交媒体图像伪造检测的数据集与基准缺口,构建了So-Fake-Set数据集与So-Fake-OOD分布外基准,提出采用强化学习的So-Fake-R1框架,其检测准确率与定位IoU均优于现有方法,为相关研究提供了新基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28625 2026-07-31 cs.CV 新提交

ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine

ACE-Data-0:以人为中心的环境捕获作为具身数据引擎

Yukang Cao, Haozhe Xie, Beichen Wen, Runmao Yao, Yinghao Liu, Yue Huang, Zhichao Liao, Yunxiang Wang, Haiheng Liu, Xingshun Tian, Dawei Su, Long Zhuo, Dacheng Tao, Xiaogang Wang, Liang Pan, Ziwei Liu

机构 * S-Lab, Nanyang Technological University(新加坡南洋理工大学S-Lab) ACE Robotics(ACE机器人公司)

AI总结 本研究提出以人为中心的具身数据引擎ACE,构建含150小时数据的ACE-Data-0数据集,引入分层基准,暴露现有方法缺陷,为具身AI等领域提供基础。

Comments Project Page: https://ace-data-engine.github.io/ACE-Data-0/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28277 2026-07-31 cs.CV 新提交

MSCM-net: A hyperspectral image classiffcation method based on multi-scale convolution and Mamba

MSCM-net:基于多尺度卷积和Mamba的高光谱图像分类方法

Jianjun Chen, Linlin Wang, Lifang Chang, Limin Huo, Shujiang Song, Yanjia Zhao, Mingwei Shao

机构 * Qingdao University of Technology(青岛理工大学) Nanyang Technological University(南洋理工大学)

AI总结 该研究针对高光谱图像分类的局部性约束与高计算复杂度问题,提出结合多尺度CNN和Mamba的MSCM-net模型,经多组基准实验验证其在降复杂度的同时可实现先进分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28082 2026-07-31 cs.CL 新提交

GGC: Selective Query Correction for Reliable Text-to-SPARQL Generation

GGC:面向可靠Text-to-SPARQL生成的选择性查询修正

Ziyi Yang, Thanh-Son Nguyen, Tuan Anh Nguyen, Lihui Chen

机构 * Nanyang Technological University(南洋理工大学) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局高性能计算研究所)

AI总结 该研究针对LLM生成Text-to-SPARQL查询不可靠的问题,提出GGC框架,通过选择性修正高风险查询,在MCQA数据集上提升准确率并降低推理开销。

Comments 18 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27913 2026-07-31 cs.LG 新提交

S-CEReBrO: Breaking the Memory Barrier in Continuous EEG Monitoring

S-CEReBrO:突破连续脑电图监测中的内存瓶颈

Glenn Anta Bucagu, Thorir Mar Ingolfsson, Yawei Li, Luca Benini

机构 * ETH Zurich(苏黎世联邦理工学院) Nanyang Technological University(南洋理工大学) University of Bologna(博洛尼亚大学)

AI总结 该研究针对连续EEG监测中Transformer架构的内存瓶颈,提出S-CEReBrO架构,通过窗口交替注意力实现内存恒定,在EEG下游任务中性能领先且效率提升。

Comments This is the pre-rebuttal version of a paper accepted at MICCAI 2026. The camera-ready version will be posted following the embargo

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27897 2026-07-31 cs.CV 新提交

Unifying Adversarially Robust Model Experts in Vision-Language Models

统一视觉-语言模型中的对抗鲁棒模型专家

Nguyen Duc Thai, Junhao Dong, Sua Qi Rong, Hua Yu, Yew-Soon Ong

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Center for Frontier AI Research, Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局前沿人工智能研究中心)

AI总结 针对视觉-语言模型对抗鲁棒性不足问题,提出CARE框架,通过维护并协同微调多个鲁棒模型专家,实现知识融合,在多任务上性能优于单独训练的专家。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27788 2026-07-31 cs.AI cs.CE 新提交

SpecCal: Ambiguity-Aware Candidate Calibration for Infrared Spectrum-Based Molecular Structure Reconstruction

SpecCal:面向红外光谱分子结构重建的歧义感知候选校准方法

Yixuan Chen, Bo Liu, Yusen Tan, Guokun Yang, Wenjie Du, Jun Xia

机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) School of Mathematics, Jilin University(吉林大学数学学院) Information Hub, HKUST(GZ)(香港科技大学(广州)信息中心) School of Chemistry, Chemical Engineering and Biotechnology (CCEB), Nanyang Technological University(南洋理工大学化学、化学工程与生物工程学院) School of Software Engineering, University of Science and Technology of China(中国科学技术大学软件学院)

AI总结 本研究针对红外光谱分子结构重建的歧义问题,提出即插即用、与模型无关的SpecCal校准框架,可提升不同基础模型在SMILES和骨架水平的top-k重建性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27620 2026-07-31 cs.CV 新提交

MedXplore: Towards Reliable and Unbiased Generalized Category Discovery in Medical Imaging

MedXplore:面向医学成像中可靠且无偏的广义类别发现

Jianwei He, Kailin Lyu, Junhao Dong, Long Xiao, Wenjie Hou, Jingze Lu, Di Wu, Lin Shu, Jie Hao

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanyang Technological University(南洋理工大学)

AI总结 针对医学成像中广义类别发现存在的旧类偏差问题,提出MedXplore框架,通过FAAC与ACAM模块优化表征学习,在多基准上实现准确率提升且旧类误报率显著降低。

Comments accepted by ACM MM 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27617 2026-07-31 cs.AI 新提交

Hidden APIs in Language Models: Discovering Reusable Causal Interfaces from Forked Futures

语言模型中的隐藏API:从分叉未来中发现可复用的因果接口

SiYuan Ma, Yiqin Luo, Zhangji, Canran Xiao, Albert Gao, Wei-Hsing Huang, Wei Wang, Qiwei Wu, Xinran Li, Jinfeng Wei, Qixin Zhang

机构 * Nanyang Technological University(南洋理工大学) Southern University of Science and Technology(南方科技大学) Tianjin University(天津大学) Sun Yat-sen University(中山大学) Carnegie Mellon University(卡内基梅隆大学) Georgia Institute of Technology(佐治亚理工学院) The Hong Kong Polytechnic University(香港理工大学) Shenzhen University(深圳大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 本研究从分叉未来采样后续操作以比较语言模型隐藏状态,发现共享接口在多模型评估中表现最优,支持测试操作库中存在可复用因果接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27610 2026-07-31 cs.LG 新提交

Kalman Meets Curriculum: Efficient Dynamic Prompt Selection for Adaptive RL Finetuning

卡尔曼与课程学习结合:面向自适应RL微调的高效动态提示选择

Haodong Zhu, Yangyang Ren, Yanjing Li, Sheng Xu, Haiguang Liu, Linlin Yang, Baochang Zhang

机构 * Beihang University(北京航空航天大学) Zhongguancun Academy(中关村学院) Nanyang Technological University(南洋理工大学) Communication University of China(中国传媒大学)

AI总结 本文提出KGPS方法,将提示选择转化为动态状态估计问题,适配RL训练动态,在多推理基准和RL算法上较基线提升准确率与rollout效率,在在线提示选择中达最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27348 2026-07-31 cs.CV 新提交

Bunraku: Turning a Single Illustration into an Editable Live2D Character

Bunraku:将单张插图转换为可编辑的Live2D角色

Junhao Chen, Jingjia Mao, Dayong Li, Chenghai Li, Saining Zhang, Zhihao Li, Hao Zhao, Yufei Wang, Ruqi Huang

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) SparcAI Inc.(SparcAI公司)

AI总结 本文提出Bunraku系统,可从单张插图端到端生成可编辑Live2D角色,构建分层扩散与联合位移预测方法,发布首个相关基准Live2D-Bench及8884模型语料库,解决了Live2D模型手动构建效率低的问题。

Comments Project page: https://bunraku-live2d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27265 2026-07-31 cs.LG 新提交

PlatformBid: An Auto-Bidding Benchmark from a Unified Advertising Platform's Perspective

PlatformBid:来自统一广告平台视角的自动竞价基准

Shengtian Yang, Yewen Li, Peng Jiang, Zhiyi Lyu, Bo An, Peng Jiang, Qingpeng Cai, Lei Feng

机构 * Southeast University(东南大学) Kuaishou Technology(快手科技) Nanyang Technological University(南洋理工大学)

AI总结 该研究针对现有自动竞价算法仅聚焦DSP侧的问题,提出首个以统一广告平台为中心的自动竞价基准PlatformBid,定义三类竞争场景并评估多种方法,还提出BidFlow方法,在快手实验中目标成本提升0.68%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22932 2026-07-31 cs.LG 版本更新

FORGE: Fused On-Register Gradient Elimination for Memory-Efficient LLM Training

FORGE: 融合寄存器梯度消除以实现内存高效的大语言模型训练

Dikshant Kukreja, Kritarth Prasad, Avinash Anand, Zhengkui Wang, Erik Cambria, Timothy Liu, Aik Beng Ng, Simon See, Bapi Chatterjee

机构 * Puch AI Singapore Institute of Technology(新加坡理工大学) Nanyang Technological University(南洋理工大学) NVIDIA(英伟达) IIIT-Delhi(德里印度理工学院)

AI总结 提出FORGE方法,将优化器步骤融合到反向传播中,逐块在寄存器中应用,消除梯度张量,减少内存占用并加速训练,在微调和持续预训练中速度提升约1.5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10396 2026-07-31 cs.AI 版本更新

Verbalizing LLM's Higher-order Uncertainty via Imprecise Probabilities

通过不精确概率实现LLM的高阶不确定性 verbalizing

Anita Yang, Krikamol Muandet, Michele Caprio, Siu Lun Chau, Masaki Adachi

机构 * Lattice Lab Toyota Motor Corporation(丰田汽车公司) Department of Computer Science(计算机科学系) University of Tokyo(东京大学) Rational Intelligence Lab(理性智能实验室) CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全中心) University of Manchester(曼彻斯特大学) Manchester Centre for AI Fundamentals(曼彻斯特人工智能基础中心) EPIC Lab(EPIC实验室) College of Computing & Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出基于不精确概率的新型提示方法,用于更准确地提取LLM的高阶不确定性,以提升其不确定性和决策支持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26811 2026-07-30 cs.CV 新提交

DistillAlign: Coordinating Mode Covering and Mode Seeking in Autoregressive Video Distillation

DistillAlign:自回归视频蒸馏中覆盖模式与寻找模式的协调

Jiaxing Li, Kai Zou, Cindy Zhou, Kaichen Huang, Junyao Gao, Zile Wang, Yang Liu, Bin Liu, Bo An, Yangguang Li

机构 * Riemann Dynamics(黎曼动力学) Nanyang Technological University(南洋理工大学) Wellington College, UK(惠灵顿公学(英国))

AI总结 该研究针对自回归视频蒸馏中初始化与DMD阶段解耦、覆盖度不足等问题,提出DistillAlign联合蒸馏方法,结合模式寻找与覆盖约束,提升了视频生成的质量、覆盖度与多样性。

Comments Project page: https://lijiaxing0213.github.io/DistillAlign

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26710 2026-07-30 cs.LG 新提交

PowerAtlas: Towards Electricity-Computing Co-Scheduling for Power Systems

PowerAtlas:面向电力系统的电-计算协同调度

Kaiwen Jiang, Siya Xu, Ziyue Zhu, Chao Yang, Anh Tuan Luu, Haoran Luo

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) State Grid Liaoning Electric Power Co., Ltd.(国网辽宁省电力有限公司) Nanyang Technological University(南洋理工大学)

AI总结 PowerAtlas是用于电-计算协同调度的LLM智能体框架,整合多类约束生成可行方案,构建含2000个实例的ECBench基准,在11种LLM上验证了有效性。

Comments 17 pages, 9 figures, 5 tables. Code: https://github.com/JAVA-Jiang/PowerAtlas

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26393 2026-07-30 cs.AI 新提交

CaM-Wolf: Causal-Aware Multimodal Agents for Social Deduction Games

CaM-Wolf:面向社交推理游戏的因果感知多模态智能体

Zheng Zhang, Nanjie Yao, Jiarui He, Deheng Ye, Peilin Zhao, Hao Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 该研究针对现有SDG智能体多模态特性缺失的问题,提出首个整合多模态感知生成的CaM-Wolf,经实验验证其游戏性能与交互质量均有提升。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15684 2026-07-30 cs.CR cs.AI 版本更新

State-Dependent Safety Failures in Multi-Turn Language Model Interaction

多轮语言模型交互中的状态依赖性安全故障

Pengcheng Li, Jie Zhang, Tianwei Zhang, Han Qiu, Zhang kejun, Weiming Zhang, Nenghai Yu, Wenbo Zhou

机构 * School of Cyber Science and Technology, University of Science and Technology of China, China(中国科学技术大学信息科学与技术学院) Nanyang Technological University, Singapore(南洋理工大学) Tsinghua University, Beijing, China(清华大学) Beijing Electronic Science and Technology Institute, Beijing, China(北京电子科技研究所)

AI总结 本文从状态空间视角研究多轮交互中的安全故障,提出STAR框架分析对话历史作为状态转移操作,揭示对齐模型在多轮交互中安全边界穿越的机制。

Comments 9 pages, accepted at the International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04641 2026-07-30 cs.CR cs.CL cs.LG 版本更新

DP-MGTD: Privacy-Preserving Machine-Generated Text Detection via Adaptive Differentially Private Entity Sanitization

DP-MGTD:通过自适应差分隐私实体净化实现隐私保护的机器生成文本检测

Lionel Z. Wang, Yusheng Zhao, Jiabin Luo, Xinfeng Li, Lixu Wang, Yinan Peng, Haoyang Li, XiaoFeng Wang, Wei Dong

机构 * Nanyang Technological University(南洋理工大学) The Hong Kong Polytechnic University(香港理工大学) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Hengxin Tech(恒心科技)

AI总结 DP-MGTD通过自适应差分隐私实体净化技术,在保障隐私的前提下实现对机器生成文本的高精度检测。

Comments This article is unable to reproduce the experimental results, and we no longer have confidence in the main conclusion of this article

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01043 2026-07-30 cs.LG cs.AI 版本更新

Low-Precision Training of Large Language Models: Methods, Challenges, and Opportunities

大语言模型的低精度训练:方法、挑战与机遇

Zhiwei Hao, Jianyuan Guo, Li Shen, Yong Luo, Han Hu, Guoxia Wang, Dianhai Yu, Yonggang Wen, Dacheng Tao

机构 * School of Information and Electronics, Beijing Institute of Technology(信息与电子学院,北京理工大学) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学) School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(网络科学与技术学院,中山大学深圳校区) School of Computer Science, Wuhan University(计算机科学学院,武汉大学) Baidu Inc.(百度公司) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 本综述全面梳理大语言模型低精度训练方法,按数值格式分类并探讨相关挑战、鲁棒性及研究方向,助力统一该领域研究视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25894 2026-07-29 cs.CV 新提交

TIGA: Trajectory-Injected Generative Attack against Black-box AIGC Detectors

TIGA:针对黑盒AIGC检测器的轨迹注入生成攻击

Xia Du, Zhuosen Bao, Zheng Lin, Jizhe Zhou, Jiawei Lian, Chi-man Pun, Jun Luo, Wei Ni, Symeon Chatzinotas

机构 * School of Computer and Information Engineering, Xiamen University of Technology(厦门理工学院计算机与信息工程学院) Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(卢森堡大学安全、可靠性和信任跨学科中心) School of Computer Science, Engineering Research Center of Machine Learning and Industry Intelligence, Sichuan University(四川大学计算机学院机器学习与工业智能工程研究中心) PCA Laboratory, Key Laboratory of Intelligent Perception and Systems for High-Dimensional Information of Ministry of Education, School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院高维信息智能感知与系统教育部重点实验室PCA实验室) Department of Computer and Information Science, Faculty of Science and Technology, University of Macau(澳门大学科技学院计算机与信息科学系) School of Engineering, Edith Cowan University(伊迪斯科文大学工程学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 针对黑盒AIGC检测器,TIGA提出无需源图像和训练的框架,通过操纵DDIM轨迹、聚合梯度及方向搜索估计目标响应,实现强大黑盒攻击性能、可转移性及高鲁棒性,且无需源图像或扩散模型再训练。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25681 2026-07-29 cs.AI 新提交

Cognivia: A Cognitive Behavioral Therapy Copilot for Evidence-Based Mental Healthcare

Cognivia:用于循证心理保健的认知行为疗法辅助工具

Qi Chen, Siria Xiyueyao Luo, Jian Wang, Yuan Shi, Haocong Rao, Xuejiao Zhao

机构 * Sichuan University(四川大学) Southwest Petroleum University(西南石油大学) University of Groningen(格罗宁根大学) West China Hospital, Sichuan University(四川大学华西医院) Nanyang Technological University(南洋理工大学)

AI总结 研究针对认知行为疗法应用受限及大语言模型在心理健康应用存在的问题,提出Cognivia,通过整合权威文本、问答数据,运用多阶段提示等策略构建并微调模型,还提出评估框架,该模型经多种评估验证效果良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25397 2026-07-29 cs.RO 新提交

Decompose and Reorganize: Planning with Primitives and Visuomotor Policies Learned from Demonstrations

分解与重组:利用从示范中学到的原语和视觉运动策略进行规划

Yizhou Chen, Hang Xu, Dongjie Yu, Yupu Lu, Tengye Xu, Zeqing Zhang, Wei Zhang, Yi Ren, Ben M. Chen, Jia Pan

机构 * The University of Hong Kong(香港大学) JD.com (JingDong)(京东) Nanyang Technological University (NTU)(南洋理工大学) Southern University of Science and Technology (SUSTech)(南方科技大学) Huawei Technologies(华为技术有限公司) The Chinese University of Hong Kong (CUHK)(香港中文大学)

AI总结 研究如何使机器人灵巧、长视野操作自动化,提出DR-LfD框架,将视觉运动策略集成到TAMP决策系统,基于接触关系分解示范为原子技能,经实验验证该框架在多类任务中性能强大。

Comments 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25388 2026-07-29 cs.RO 新提交

SGTP: Sampling-based Game-Theoretic Planning for Real-Time Multi-Vehicle Autonomous Racing

SGTP:基于采样的博弈论实时多车辆自主赛车规划

Zhouheng Li, Fangguo Zhao, Mattia Piccinini, Baha Zarrouki, Yuan Gao, Zitong Shan, Johannes Betz, Chen Lv, Lei Xie

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Technical University of Munich(慕尼黑工业大学)

AI总结 针对自主多车辆赛车中平衡战略多样性与计算效率的难题,提出基于采样的博弈论规划(SGTP)框架,结合博弈论推理与GPU加速采样,经可行性选择确保安全过渡,模拟显示其在多智能体场景表现良好,还开源代码及基准促进研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25305 2026-07-29 cs.CL 新提交

Toward a systematic method for identifying language areas

迈向一种识别语言区域的系统方法

Hiram Ring

机构 * NTU Singapore(新加坡南洋理工大学)

AI总结 本文旨在填补语言区域识别缺乏系统方法的空白,提出简单地理聚类方法,能识别任意区域分组,生成的全球宏观区域与现有分组相符,还为著名语言联盟生成局部分组。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25157 2026-07-29 cs.AI 新提交

PreDiff-LM: Pretrained Discrete Masked Diffusion Language Modeling with Hybrid Attention

PreDiff-LM:具有混合注意力的预训练离散掩码扩散语言模型

Zhengtao Yao, Runhao Li, Xupeng Chen, Jiayi Cheng, Chenqian Le, Michael Yue, Jesson Wang, Siheng Wang, Guang Yang, Haoyan Xu, Chenhao Wei, Zhengqing Yuan, Youran Shen, Yanfang Ye, Junhao Dong

机构 * University of Southern California(南加州大学) New York University(纽约大学) Columbia University(哥伦比亚大学) University of California, Berkeley(加州大学伯克利分校) Stevens Institute of Technology(史蒂文斯理工学院) University of Notre Dame(圣母大学) Nanyang Technological University(南洋理工大学)

AI总结 研究离散掩码扩散语言模型中因果预训练与双向去噪协调问题,提出PreDiff-LM模型,通过混合注意力机制改进无条件困惑度等指标,在多方面优于先前扩散基线,明确与优化AR模型的差距,为预训练因果主干调整提供补充机制。

详情

展开后加载摘要…

URL PDF HTML 收藏