arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

National University of Singapore(新加坡国立大学)

共收录 2360
2608.00510 2026-08-04 cs.CV 新提交

Test-time Adaptation of Pelvic Bone Segmentation Models via Dynamic Reliability-Guided

基于动态可靠性引导的骨盆骨分割模型测试时适应

Ling Ren, Chao Deng, Ziming Wang, Yuecong Xu, Kai Zheng

机构 * College of Automation, Nanjing University of Posts and Telecommunications(南京邮电大学自动化学院) Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电气与计算机工程系) the Affiliated Stomatological Hospital of Nanjing Medical University(南京医科大学附属口腔医院)

AI总结 针对骨盆骨分割模型跨中心域偏移导致的性能下降问题,提出ReGA框架,结合SICE准则、信任加权细化模块、对比学习与TS方案,在三个数据集上优于现有TTA方法,实现有效适应。

Comments Provisionally accepted for presentation at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06435 2026-08-04 cs.AI 版本更新

Trust but Verify:Evidence-Linked Multi-Agent Clinical Information Extraction in Pathology

从细则中发现幽门螺杆菌:基于证据关联的多智能体胃活检报告病例发现

Yufan Wang, Anit Kumar Sahu, Yan Fei Ng, Daniel Kang, Shayan Vassef, Soorya Ram Shimgekar, Koustuv Saha, Piyum Zonooz, Navin Kumar, Chee Leong Cheng, Li Yan Khor

机构 * Department of Anatomical Pathology, Singapore General Hospital(新加坡中央医院解剖病理科) Duke–NUS Medical School(新加坡国立大学Duke-NUS医学院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Independent Researcher(独立研究者)

AI总结 研究针对胃活检报告中幽门螺杆菌证据提取难题,采用Nimblemind多智能体系统,经试点评估其总体准确率达98.61%,虽与其他比较器性能相似,但实现了工作流程整合和可追溯性,还能大幅减少审查时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06303 2026-08-04 cs.LG cs.AI 版本更新

Plug-and-Play Guidance for Discrete Diffusion Models via Gradient-Informed Logit Correction

基于梯度信息逻辑校正的离散扩散模型即插即用引导

Hongkun Dou, Zike Chen, Fengji Li, Hongjue Li, Yue Deng

机构 * National University of Singapore(新加坡国立大学) University of Science and Technology of China(中国科学技术大学)

AI总结 提出GILC框架,通过将预训练去噪网络作为变分代理来估计引导信号,并引入无雅可比机制直接校正干净预测逻辑,实现无需额外训练的离散扩散模型可控生成,在DNA、蛋白质序列和分子生成任务上达到最优性能。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07725 2026-08-04 cs.CL cs.AI 版本更新

SOD: Step-wise On-policy Distillation for Small Language Model Agents

SOD:分步式在线蒸馏用于小型语言模型代理

Qiyong Zhong, Mao Zheng, Mingyang Song, Xin Lin, Jie Sun, Houcheng Jiang, Xiang Wang, Junfeng Fang

机构 * Zhejiang University(浙江大学) Large Language Model Department, Tencent(腾讯大语言模型部门) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

AI总结 针对小型语言模型中工具集成推理的稳定性问题,提出SOD分步式在线蒸馏框架,通过动态调整蒸馏强度缓解教师信号误导,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06543 2026-08-04 cs.CL cs.LG 版本更新

The Illusion of Stochasticity in LLMs

大语言模型中的随机性错觉

Xiangming Gu, Soham De, Michalis Titsias, Larisa Markeeva, Petar Veličković, Razvan Pascanu

机构 * Google DeepMind(谷歌DeepMind) National University of Singapore(新加坡国立大学)

AI总结 研究指出大语言模型作为智能体在随机采样方面存在根本性缺陷,通过多模型家族和分布的实证分析揭示了这一问题。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04923 2026-08-04 quant-ph cs.AI cs.LG

Artificial intelligence for representing and characterizing quantum systems

Yuxuan Du, Yan Zhu, Yuan-Hang Zhang, Min-Hsiu Hsieh, Patrick Rebentrost, Weibo Gao, Ya-Dong Wu, Jens Eisert, Giulio Chiribella, Dacheng Tao, Barry C. Sanders

机构 * College of Computing Data Science, Nanyang Technological University, Singapore 639798, Singapore Computation Initiative, Department of Computer Science, The University of Hong Kong, Pokfulam Road, Hong Kong Department of Physics, University of California, San Diego, La Jolla, CA 92093, USA Hon Hai (Foxconn) Research Institute, Taipei, Taiwan Centre for Quantum Technologies, National University of Singapore Department of Computer Science, National University of Singapore School of Electrical \& Electronic Engineering, Nanyang Technological University, Singapore 639798, Singapore John Hopcroft Center for Computer Science, Shanghai Jiao Tong University, Shanghai 200240, China Dahlem Center for Complex Quantum Systems, Freie Universitat Berlin, 14195 Berlin, Germany Department of Computer Science, Parks Road, Oxford, OX1 3QD, United Kingdom Perimeter Institute for Theoretical Physics, Waterloo, Ontario N2L 2Y5, Canada Institute for Quantum Science Technology, University of Calgary, Alberta T2N 1N4, Canada

Comments 32 pages. Comments are welcome

Journal ref Nature Reviews Physics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29102 2026-08-03 cs.RO 新提交

VSTaI: Design and Characterization of Variable-Stiffness Tactile Interfaces Based on 3D-Printed Structured Fabrics

VSTaI:基于3D打印结构化织物的变刚度触觉界面的设计与表征

Yiting Mo, Xinyuan Mao, Jashan Preet Singh, Fernando Bello

机构 * Duke-NUS Medical School(杜克-新加坡国立大学医学院) College of Design and Engineering, National University of Singapore(新加坡国立大学设计与工程学院) Mechanobiology Institute, National University of Singapore(新加坡国立大学力学生物学研究所) Imperial College(帝国理工学院)

AI总结 本文设计了基于3D打印结构化织物真空阻塞的变刚度触觉界面VSTaI,经测试其刚度可调范围广、贴合性好,可用于触诊训练。

Journal ref Haptics: Understanding Touch; Technology and Systems; Applications and Interaction. EuroHaptics 2026. Lecture Notes in Computer Science, vol 16594. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29053 2026-08-03 cs.LG 新提交

Who Wins Where? Conformal Model Comparison for Local Superiority

何处胜出?用于局部优势的共形模型比较

Yi Zhou, Baishi Li, Xuan Yao, Ke-Wei Huang

机构 * Asian Institute of Digital Finance, National University of Singapore(新加坡国立大学亚洲数字金融研究院)

AI总结 该研究针对全局模型比较掩盖局部性能异质性的问题,提出共形化局部模型比较框架,经理论证明和实验验证,可识别局部胜出区域、弃权不确定情况并提升条件增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28638 2026-08-03 cs.CL cs.LG 新提交

Learning Stateful Predictive Knowledge From Experience

从经验中学习有状态的预测知识

Yan Song, Xidong Feng, Bo Liu, Xinyu Cui, Haotian Fu, Zichen Liu, Mengyue Yang, Cheng Deng, Jian Zhao, Jun Wang

机构 * University College London(伦敦大学学院) National University of Singapore(新加坡国立大学) Chinese Academy of Sciences(中国科学院) Brown University(布朗大学) University of Bristol(布里斯托尔大学) University of Edinburgh(爱丁堡大学) Zhongguancun Academy(中关村科学院) The Yangtze River Delta(长三角)

AI总结 该研究针对LLM智能体现有轨迹级反思学习的缺陷,提出SKL方法,通过两种算法训练智能体学习有状态预测知识,在多任务上性能优于现有范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23802 2026-08-03 cs.AI 版本更新

From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement

从可验证奖励强化学习到自验证奖励强化学习:任务转换为开放式语言模型自我改进带来自验证奖励

Qinsi Wang, Jing Shi, Huazheng Wang, Kun Wan, Yiran Wu, Bo Liu, Qingyun Wu, Hai Helen Li, Yiran Chen, Handong Zhao, Wentian Zhao

机构 * Duke University(杜克大学) Adobe Inc.(奥多比公司) Oregon State University(俄勒冈州立大学) Pennsylvania State University(宾夕法尼亚州立大学) National University of Singapore(新加坡国立大学) Amazon(亚马逊)

AI总结 研究针对开放式LLM自我改进中奖励验证问题,提出基于任务转换的RLSVR方法,通过SpyRL实例化,在文本摘要等任务实验中,该方法在不可验证任务上优于现有方法,在可验证推理任务上有提升,扩展了基于RLVR的自我改进。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23986 2026-08-03 cs.DB cs.AI cs.MA 版本更新

MemForest: An Efficient Agent Memory System with Hierarchical Temporal Indexing

MemForest: 一种具有层次化时间索引的高效智能体记忆系统

Han Chen, Zining Zhang, Wenqi Pei, Bingsheng He, Ming Wu, Jason Zeng, Michael Heinrich, Wei Wu, Hongbao Zhang

机构 * National University of Singapore(新加坡国立大学) Zero Gravity Labs(零重力实验室)

AI总结 针对长上下文LLM智能体记忆系统中粗粒度状态管理和顺序更新导致的维护开销问题,提出MemForest框架,通过并行块提取和层次化时间索引树MemTree实现高效写入和局部更新,在LongMemEval-S上达到79.8% pass@1准确率,吞吐量比现有方法高约6倍。

Comments 12 pages. Extended version with appendix as supplemental material. Submitted to VLDB

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16301 2026-08-03 cs.CY cs.AI cs.LG 版本更新

Do LLMs Hold Their Values? MANTA: A Multi-Turn Adversarial Benchmark for Animal Welfare Reasoning

LLMs 是否坚持其价值观?MANTA:一个用于动物福利推理的多轮对抗性基准

Isabella Luong, Joyee Chen, Sankalpa Ghose, David Williams-King, Linh Le, Allen Lu

机构 * SPAR Compassion Aligned Machine Learning(同情对齐机器学习) NUS(新加坡大学) Mila(Mila研究所) ERA Cambridge(剑桥ERA)

AI总结 提出 MANTA 基准,通过多轮对抗性对话评估大语言模型在动物福利推理中的价值观稳定性和道德敏感性,发现单轮基准无法捕捉的排名变化和物种-压力交互效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03322 2026-08-03 cs.CL cs.AI 版本更新

Can Large Language Models Derive New Knowledge? A Dynamic Benchmark for Biological Knowledge Discovery

大语言模型能否推导新知识?一种动态生物知识发现基准

Chaoqun Yang, Xinyu Lin, Shulin Li, Wenjie Wang, Ruihan Guo, Fuli Feng, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出DBench-Bio,一种动态生物知识发现基准,通过三阶段流程评估AI的新知识发现能力,揭示当前模型在知识发现上的局限性。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22876 2026-08-03 cs.LG 版本更新

Matterhorn: Masked Time-to-First-Spike Encoding by Reassigning the Silent State for Sparse and Energy-Efficient Spiking Transformers

Matterhorn: 一种高效的类脑稀疏脉冲变压器架构与掩码时间到首次脉冲编码

Zhanglu Yan, Kaiwen Tang, Zixuan Zhu, Zhenyu Bai, Qianhui Liu, Yongxin Zhu, Weng-Fai Wong

机构 * Department of computer science, National University of Singapore(新加坡国立大学计算机科学系) School of Artificial Intelligence, Shandong University(山东大学人工智能学院) Shanghai Advanced Research Institute, Chinese Academy of Science(中国科学院上海先进研究院) University of Chinese Academy of Sciences, Beijing(中国科学院大学北京校区)

AI总结 Matterhorn通过引入掩码时间到首次脉冲编码和类比计算在内存技术,实现高效稀疏脉冲变压器架构,提升能效并达到新的准确率水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18660 2026-08-03 cs.CV 版本更新

So-Fake: Benchmarking and Explaining Social Media Image Forgery Detection

So-Fake:社交媒体图像伪造检测的基准构建与可解释性研究

Zhenglin Huang, Xiangtai Li, Xi Yang, Bei Peng, Xiaowei Huang, Baoyuan Wu, Dacheng Tao, Ming-Hsuan Yang, Guangliang Cheng

机构 * University of Liverpool, UK(利物浦大学) Nanyang Technological University(南洋理工大学) Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) The University of Sheffield(谢菲尔德大学)

AI总结 该研究针对社交媒体图像伪造检测的数据集与基准缺口,构建了So-Fake-Set数据集与So-Fake-OOD分布外基准,提出采用强化学习的So-Fake-R1框架,其检测准确率与定位IoU均优于现有方法,为相关研究提供了新基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28553 2026-07-31 cs.LG cs.AI cs.MA 新提交

APO: Unsupervised Atomic Policy Optimization for 3D Structure Prediction of Atomic Systems

APO:面向原子系统三维结构预测的无监督原子策略优化

Shentong Mo, Yatao Bian

机构 * CMU(卡内基梅隆大学) NUS(新加坡国立大学)

AI总结 本研究提出无监督原子策略优化框架APO,通过双奖励机制实现原子系统三维结构预测,在晶体与抗体预测中优于全监督基线,提升了匹配率、结构保真度与推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28020 2026-07-31 cs.CV 新提交

ENCORE: Event-Assisted Complementary Motion Refinement for Learned Video Compression

ENCORE:用于学习型视频压缩的事件辅助互补运动细化

Shuhan Ye, Hongbin Yu, Chenqi Kong, Pingchuan Ma, Chong Wang, Jun Wan, Qixin Zhang

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Artificial Intelligence, Ningbo University(宁波大学人工智能学院) National University of Singapore(新加坡国立大学) Zhejiang University of Technology(浙江工业大学) School of Information Engineering, Zhongnan University of Economics and Law(中南财经政法大学信息工程学院)

AI总结 ENCORE是结合事件相机与RGB帧的学习型视频压缩框架,通过CMR、SERIC、EAR模块细化运动,在多数据集上实现了BD-rate节省的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27263 2026-07-31 cs.LG physics.data-an stat.ME 新提交

DoTime: A Synthetic Benchmark Generator for Interventional and Counterfactual Time Series

DoTime:用于干预和反事实时间序列的合成基准生成器

Dennis Thumm, Billy Tim Anthony, Ying Chen

机构 * National University of Singapore(新加坡国立大学)

AI总结 DoTime是用于干预和反事实时间序列的合成基准生成器,具备现有工具没有的多项功能,附带评估套件与基线,经测试其干预训练的因果模型相比同容量观测模型有方向准确性优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26991 2026-07-31 cs.RO 版本更新

RL$^2$-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models

RL²-VLA:面向视觉-语言-动作模型的测试时缩放自适应RL隐成分引导

Derek Ming Siang Tan, Shailesh Shailesh, Srikrishna Iyer, William Wei Jie Teo, Yuanliang Ju, Qiao Gu, Guillaume Sartoretti

机构 * National University of Singapore(新加坡国立大学) University of Toronto(多伦多大学) Singapore Technologies Engineering(新加坡科技工程公司)

AI总结 针对VLA模型分布外任务性能下降问题,提出基于VLA隐空间的自适应推理时引导框架RL²,仅在预测失败时激活成分引导,在SIMPLER等基准上分布外成功率最高提升17.3%,可迁移至真实世界。

Comments Code and models are available at https://rl2-vla.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19261 2026-07-31 cs.CV cs.AI 版本更新

PathAgentBench: Benchmarking Evidence-Seeking Vision-Language Models on Whole-Slide Pathology Image

PathAgentBench:在全切片病理图像上对寻求证据的视觉语言模型进行基准测试

Dankai Liao, Tianyi Zhang, Yufeng Wu, Xinyue Zhang, Qiaochu Xue, Zeyu Liu, Dachun Zhao, Linghan Cai, Yueming Jin

机构 * National University of Singapore(新加坡国立大学) PuzzleLogic Pte Ltd(拼图逻辑私人有限公司) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区) Peking Union Medical College Hospital(北京协和医院)

AI总结 研究针对全切片病理图像诊断中证据获取与整合问题,引入PathAgentBench基准,评估视觉语言模型的四项互补能力,包含多模型评估结果,揭示了证据推理与获取间的差距,为改进病理模型提供统一框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08881 2026-07-31 cs.CV 版本更新

Targeted Interpretable Safety Neuron Enhancement for Multilingual Vision-Language Large Models

Precise Shield:通过神经层面指导解释和对齐VLLM安全

Enyi Shi, Fei Shen, Chuancheng Shi, Shuyi Miao, Linxia Zhu, Pengyang Shao, Jinhui Tang, Tat-Seng Chua

机构 * Nanjing University of Science and Technology(南京理工大学) National University of Singapore(新加坡国立大学) Beihang University(北京航空航天大学) Nanjing Forestry University(南京林业大学)

AI总结 本文提出Precise Shield框架,通过对比有害与良性输入的激活模式识别安全神经元,并通过梯度掩码限制参数更新,提升VLLM安全性能并保持多语言多模态泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19830 2026-07-31 cs.LG cs.AI stat.ML 版本更新

On the Rate of Convergence of Kolmogorov-Arnold Network Regression Estimators

关于Kolmogorov-Arnold网络回归估计器收敛速度的论文

Wei Liu, Eleni Chatzi, Zhilu Lai

机构 * Department of Industrial Systems Engineering and Management, National University of Singapore(新加坡国立大学工业系统工程与管理系) Department of Civil, Environmental and Geomatic Engineering, ETH Zürich(苏黎世联邦理工学院土木、环境与地理工程系) Internet of Things Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)物联网研究组)

AI总结 本文研究了KANs在Sobolev空间中函数近似时的收敛速度,证明了其达到最小最大最优收敛速度,并提供了B-样条结点数选择的指导方针。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26784 2026-07-30 cs.LG cs.AI 新提交

SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

SkillRise:面向跨任务技能演化的智能体强化学习

Zhiyuan Yao, Yuxin Chen, Zhengxi Lu, Zishan Xu, Yueqing Sun, Yifu Guo, Yuquan Lu, Zhengzhou Cai, Kangning Zhang, Zhuowen Han, Zi-Han Wang, Ziang Ye, Qi Gu, Xunliang Cai, Weiwen Liu, Yongliang Shen

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学) Meituan(美团)

AI总结 SkillRise是跨任务学习技能的统一强化学习框架,解耦信用分配机制实现任务求解与技能整理,在多基准上Pass@1性能优于基线,还降低了运行开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26412 2026-07-30 cs.CV 新提交

When Fish Look Alike: Tracking Identities with Dual-branch Elasticity

当鱼看起来相似时:利用双分支弹性机制跟踪身份

Vran Lee, Xin Liu, Yijie Wei, Yeqiang Liu, Hwa Liang Leo, Zhenbo Li

机构 * China Agricultural University(中国农业大学) Beijing Normal University(北京师范大学) National University of Singapore(新加坡国立大学)

AI总结 针对密集同质鱼群跟踪难题,提出双分支弹性机制TIDE,采用自适应几何对应IoU关联机制,轻量L分支实现38.7倍计算量缩减,可扩展S分支提升精度,适配边缘部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25597 2026-07-30 cs.AI 版本更新

A Density-Matrix Framework for Electronic-Structure Analysis of Functional-Group and Salt Effects in Lithium-Metal Electrolytes

用于锂金属电解质中官能团和盐效应电子结构分析的密度矩阵框架

Mingkang Liu, Huize Yu, Yanbin Gao, Nan Yao, Xiang Chen, Lei Shen

机构 * National University of Singapore(新加坡国立大学) Tsinghua University(清华大学) Institute for Carbon Neutrality, Tsinghua University(清华大学碳中和研究院) AI Solid-State Battery Innovation Center(人工智能固态电池创新中心) C Innovation Laboratory (21C LAB), Contemporary Amperex Technology Co., Limited (CATL)(21C创新实验室(21C实验室),宁德时代新能源科技股份有限公司) National University of Singapore Guangzhou Research Translation and Innovation Institute(新加坡国立大学广州研究院) National University of Singapore (Chongqing) Research Institute(新加坡国立大学(重庆)研究院)

AI总结 该研究提出密度矩阵框架EMolStudio,通过集成分子功能化等流程预测分析锂金属电解质电子结构。应用于多种分子和簇,发现分子尺度上功能化的影响及溶剂化壳中阴离子对前沿轨道定位的作用,能将官能团和盐选择转化为相关电子结构假设。

Comments The data needs to be supplemented

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07131 2026-07-30 cs.CV cs.AI 版本更新

Deep Expert Injection for Anchoring Retinal VLMs with Domain-Specific Knowledge

深度专家注入用于带有领域特定知识的视网膜视觉语言模型的锚定

Shuai Lu, Meng Wang, Jia Guo, Jiawei Du, Bo Liu, Shengzhu Yang, Weihang Zhang, Huazhu Fu, Huiqi Li

机构 * Beijing Institute of Technology, Beijing, China(北京理工大学) National University of Singapore, Singapore(新加坡国立大学) Tsinghua University, Beijing, China(清华大学) The Hong Kong Polytechnic University, Hong Kong(香港理工大学)

AI总结 本文提出EyExIn框架,通过深度专家注入机制提升视网膜VLMs的领域知识嵌入能力,解决感知与推理间隙问题,实现高精度眼科视觉问答。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22768 2026-07-30 cs.CL 版本更新

ML2B: Benchmarking LLMs on Cross-Lingual ML Pipeline Generation

ML2B:评估大语言模型跨语言ML流水线生成能力的基准

Ekaterina Trofimova, Zosia Shamina, Maria Selifanova, Artem Zaitsev, Remi Savchuk, Maxim Minets, Daria Ozerova, Emil Sataev, Denis Zuenko, Andrey E. Ustyuzhanin

机构 * HSE University(俄罗斯伏尔加格勒国立大学) Constructor University(Constructor大学) National University of Singapore(新加坡国立大学)

AI总结 ML2B是首个评估大语言模型跨语言ML流水线生成能力的基准,含多领域多语言任务,实验发现跨语言性能退化高度依赖任务,挑战了传统多语言模型能力假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25962 2026-07-29 cs.CV 新提交

LaP-Forensics: Latent-Pixel Consistency Guided Multimodal Reasoning for Deepfake Detection

LaP-Forensics:用于深度伪造检测的潜在像素一致性引导的多模态推理

Can Wang, Yuhao Wang, Yushe Cao, Canran Xiao, Fei Shen

机构 * The Hong Kong Polytechnic University(香港理工大学) University College London(伦敦大学学院) Tsinghua University(清华大学) Sun Yat-sen University(中山大学) National University of Singapore(新加坡国立大学)

AI总结 研究针对深度伪造检测问题,提出LaP-Forensics多模态框架,利用基于重建的取证证据及结构化模型预测,经组相对策略优化,实现跨生成器检测和伪影定位,实验验证了残差流效用,但后处理下文本忠实性和可靠性有局限。

Comments Accepted at ACM Multimedia 2026 (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25933 2026-07-29 cs.CL cs.AI 新提交

Evaluating Multi-Turn Multimodal Diagnostic Reasoning on Challenging Real-World Clinical Cases

评估具有挑战性的真实世界临床病例中的多轮多模态诊断推理

Rui Yang, Weihao Xuan, Yi Lin, Zhuhan Bao, Jonathan Chong Kai Liew, Matthew Yu Heng Wong, Nicolás Lescano, Nikita R. Paripati, Emily Ling-Lin Pai, Jiarui Liu, Heli Qi, Heng-Jui Chang, Benny Kai Guo Loo, Huitao Li, Kunyu Yu, Yufan Wang, Chuan Hong, Shijian Lu, Douglas Teodoro, Naoto Yokoya, Ross Koppel, Mona Diab, Hua Xu, David W. Bates, Nan Liu, Yifan Peng

机构 * Center for Biomedical Data Science, Duke-NUS Medical School(生物医学数据科学中心,杜克 - 新加坡国立大学医学院) Duke-NUS AI + Medical Sciences Initiative, Duke-NUS Medical School(杜克 - 新加坡国立大学人工智能与医学科学计划,杜克 - 新加坡国立大学医学院) Department of Population Health Sciences, Weill Cornell Medicine(人口健康科学系,威尔康奈尔医学院) System Engineering, College of Engineering, Cornell University(系统工程,康奈尔大学工程学院) Graduate School of Frontier Sciences, The University of Tokyo(前沿科学研究生院,东京大学) RIKEN Center for Advanced Intelligence Project(理化学研究所先进智能项目中心) Department of Biostatistics and Bioinformatics, Duke University(生物统计学与生物信息学系,杜克大学) Perelman School of Medicine, University of Pennsylvania(佩雷尔曼医学院,宾夕法尼亚大学) School of Clinical Medicine, University of Cambridge(临床医学学院,剑桥大学) Hospital of the University of Pennsylvania(宾夕法尼亚大学医院) Children’s Hospital of Philadelphia (CHOP)(费城儿童医院) Department of Anatomic Pathology and Laboratory Medicine, Hospital of the University of Pennsylvania(解剖病理学与检验医学系,宾夕法尼亚大学医院) Department of Pathology and Laboratory Medicine, University of California, San Francisco(病理学与检验医学系,加州大学旧金山分校) Language Technologies Institute, Carnegie Mellon University(语言技术研究所,卡内基梅隆大学)

AI总结 研究针对现有多模态大语言模型评估难以捕捉现实临床诊断复杂性的问题,开发ClinMM-Bench基准,用两级框架评估15个模型,发现专有模型诊断准确性最高,但各模型完全正确诊断比例有限,当前模型诊断推理有局限并明确了失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25380 2026-07-29 cs.CL 新提交

Memory for Large Language Models

大语言模型的记忆

Sining Zhoubian, Dan Zhang, Evgeny Kharlamov, Jie Tang

机构 * Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Bosch AI(博世人工智能)

AI总结 综述对大语言模型中记忆这一基础架构维度进行系统分类,沿表示、更新动态、持久性三个正交轴表征记忆,形式化相关机制,阐明不同内存概念界限,分析混合架构等,为以记忆为中心的LLM设计及未来创新提供基础。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏