arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-07-27 至 2026-07-27 共收录 9
2607.22386 2026-07-27 cs.CV cs.CR 新提交

Correlation-Aware and Gaussianity-Preserving Robust Latent Angular Watermarking for Diffusion Models

用于扩散模型的相关感知和高斯性保持的鲁棒潜在角水印

Yebin Zheng, Haonan An, Guang Hua, Zhiping Lin, Yuguang Fang

机构 * Singapore Institute of Technology(新加坡理工学院) City University of Hong Kong(香港城市大学) Nanyang Technological University(南洋理工大学)

AI总结 研究扩散模型潜在域水印问题,提出潜在角水印(LAW)及变体LAW-M,通过对映角编码保持高斯性,解决现有方法易受攻击及相关性退化问题,理论上严格表征相关性退化并推导自相关结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22375 2026-07-27 cs.AI 新提交

IDEAgent: Agentic Quality-Diversity Search for Research Idea Generation

IDEAgent:用于研究想法生成的智能体质量多样性搜索

Varun Gumma, Navonil Majumder, Soumitra Sinhahajari, Soujanya Poria

机构 * DeCLaRe Lab, Nanyang Technological University(声明实验室,南洋理工大学)

AI总结 研究针对大语言模型在生成研究想法时质量与多样性独立导致的局限,提出将研究构思视为质量多样性搜索。介绍多智能体框架IDEAgent,通过多目标反馈驱动质量,轻量级记忆等实现多样性,开发Yield指标评估,实验表明其性能优于基线,还证实修复改进对质量提升的重要性并开源。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22302 2026-07-27 cs.CV 新提交

fMRI2Face: A Full-HD fMRI-Video Dataset and Geometry-Guided Neural Decoding Framework for Dynamic Human Face Reconstruction

fMRI2Face:用于动态人脸重建的全高清功能磁共振成像视频数据集和几何引导神经解码框架

Jingyang Huo, Xiangru Huang, Chentao Shen, Yikai Wang, Yun Wang, Jianxiong Gao, Shihao Jin, Yanwei Fu, Jianfeng Feng

机构 * Fudan University(复旦大学) Westlake University(西湖大学) Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Xmov(未提及通用中文名,可音译为艾莫夫)

AI总结 该研究提出fMRI-Face数据集及fMRI2Face框架,用于从大脑活动重建动态人脸。框架从大脑活动中获取两种互补神经控制,经整合实现高保真面部视频重建,实验显示其性能优于基线,为动态面部感知研究提供了新平台和基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22098 2026-07-27 cs.AI cs.LG 新提交

Reasoning Denoiser: Denoising Reasoning Traces for Hallucination Detection in Large Reasoning Models

推理去噪器:用于大型推理模型中幻觉检测的推理痕迹去噪

Junlin Fang, Do Nguyen-Thanh, Xiaogang Xu, Zhen Fang, Sean Du

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Zhejiang University(浙江大学) Australian Artificial Intelligence Institute, University of Technology Sydney(悉尼科技大学澳大利亚人工智能研究所)

AI总结 针对大型推理模型中推理痕迹含噪声影响幻觉检测的问题,提出REDE框架,利用最终答案注意力塑造表示空间去噪,经实验验证,该框架能有效提升幻觉检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17770 2026-07-27 cs.AI cs.CL 版本更新

Entropy-Gradient Inversion: Moving Toward Internal Mechanism of Large Reasoning Models

熵梯度反转:迈向大型推理模型的内部机制

Junyao Yang, Chen Qian, Kun Wang, Linfeng Zhang, Quanshi Zhang, Yong Liu, Dongrui Liu

机构 * National University of Singapore(新加坡国立大学) Renmin University of China(中国人民大学) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 本文发现大型推理模型中令牌熵与logit梯度之间的稳健负相关(熵梯度反转),并提出相关性正则化组策略优化(CorR-PO)将其嵌入强化学习奖励正则化,从而提升推理性能。

Comments 15 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01006 2026-07-27 cs.CL cs.CY 版本更新

Can AI Debias the News? LLM Interventions Improve Cross-Partisan Receptivity but LLMs Overestimate Their Own Effectiveness

AI能否去偏新闻?LLM干预提升了跨党派接受度但LLM高估了自身效果

Faisal Feroz, Jonas R. Kunst

机构 * Department of Experimental Psychology, University of Oxford(心理学实验系,牛津大学) Uehiro Oxford Institute, University of Oxford(牛津大学欧胡罗研究所) Psychology Programme, School of Social Sciences, Nanyang Technological University(南洋理工大学社会科学学院心理学项目) Department of Communication and Culture, BI Norwegian Business School(BI挪威商学院传播与文化系)

AI总结 研究探讨LLM对新闻去偏的影响,发现实质性重构干预提升保守派对左派新闻的信任度,但LLM高估自身效果,需人类监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06064 2026-07-27 cs.CV 版本更新

PersonaGesture: Single-Reference Co-Speech Gesture Personalization for Unseen Speakers

PersonaGesture: 单参考共语手势个性化用于未见说话人

Xiangyue Zhang, Yiyi Cai, Kunhang Li, Kaixing Yang, You Zhou, Zhengqing Li, Xuangeng Chu, Jiaxu Zhang, Haiyang Liu

机构 * The University of Tokyo(东京大学) Shanda AI Research Tokyo(Shanda AI东京研究所) Nanyang Technological University(南洋理工大学) Renmin University(中国人民大学)

AI总结 本文提出PersonaGesture,一种基于扩散的管道,用于未见说话人的单参考共语手势个性化。通过编码参考视频并分离身份证据与残差统计修正,提升未见说话人的个性化效果。

Comments Needs to be improved

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07025 2026-07-27 cs.CL 版本更新

Language-Aware Distillation for Multilingual Instruction-Following Speech LLMs with ASR-Only Supervision

面向多语言指令遵循语音大语言模型的语言感知蒸馏:仅使用ASR监督

Shreyas Gopal, Donghang Wu, Ashutosh Anshul, Yeo Yue Heng, Yizhou Peng, Haoyang Li, Hexin Liu, Eng Siong Chng

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学) AI Singapore(AI新加坡) National University of Singapore(新加坡国立大学) Institute for Infocomm Research (I$^2$R)(信息通信研究所) A$^{*}$STAR(A*星)

AI总结 本文提出一种语言感知蒸馏方法,通过查询库和门控网络提升多语言指令遵循语音大语言模型的性能,实现在Audio-MLQA基准上比现有基线提升32%。

Comments Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12311 2026-07-27 cs.NI cs.CR cs.HC cs.LG 版本更新

Cross-reality location privacy protection in 6G-enabled vehicular metaverses: an LLM-enhanced hybrid generative diffusion model-based approach

6G赋能车联网元宇宙中的跨现实位置隐私保护:一种基于LLM增强混合生成扩散模型的方法

Xiaofeng Luo, Jiayi He, Jiawen Kang, Ruichen Zhang, Zhaoshui He, Ekram Hossain, Dong In Kim

机构 * School of Automation, Guangdong University of Technology(自动化学院,广东技术大学) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学) Department of Electrical and Computer Engineering, University of Manitoba(电气与计算机工程系,曼尼托巴大学) Department of Electrical and Computer Engineering, Sungkyunkwan University(电气与计算机工程系,成均馆大学)

AI总结 本文提出了一种基于LLM增强混合生成扩散模型的方法,用于6G赋能车联网元宇宙中的跨现实位置隐私保护,通过混合动作优化平衡隐私保护、延迟降低和服务质量维护。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏