ExpGuard: LLM Content Moderation in Specialized Domains
ExpGuard: 专门领域中的大语言模型内容审核
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; Financial Tech Lab, KakaoBank Corp(Kakao银行金融科技实验室)
AI总结 ExpGuard通过专门领域的大语言模型内容审核模型,有效提升对金融、医疗和法律领域有害内容的防御能力。
Comments ICLR 2026
期刊&会议
International Conference on Learning Representations · 会议 · Machine Learning
ExpGuard: 专门领域中的大语言模型内容审核
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; Financial Tech Lab, KakaoBank Corp(Kakao银行金融科技实验室)
AI总结 ExpGuard通过专门领域的大语言模型内容审核模型,有效提升对金融、医疗和法律领域有害内容的防御能力。
Comments ICLR 2026
通过对比的视角:VLMs中的自改进视觉推理
机构 * Huazhong University of Science and Technology(华中科技大学) ; Alibaba Cloud(阿里云)
AI总结 通过视觉对比提升VLMs的推理能力,提出VC-STaR框架,有效减少推理幻觉并提升多种VLMs的视觉推理性能。
Comments 19 pages, 9 figures, accepted to ICLR 2026 (oral)
ForestPersons: 一个大规模数据集用于树冠下失踪人员检测
机构 * Autonomous UAV Research Section, ETRI(ETRI自主无人机研究部) ; Kim Jaechul Graduate School of AI, KAIST(KAIST人工智能研究生院)
AI总结 ForestPersons是一个大规模数据集,用于解决森林树冠下失踪人员检测的挑战,通过提供地面级和低空视角的图像和注释,提升无人机在搜索和救援任务中的人员检测能力。
Comments ICLR 2026 Accepted
通过机器学习推进地球观测:TorchGeo教程
机构 * Microsoft AI for Good Research Lab(微软AI for Good研究实验室) ; Chair of Data Science in Earth Observation, Technical University of Munich(地球观测数据科学主任,技术大学慕尼黑) ; Chair of Earth Observation, University of the Bundeswehr Munich(地球观测主任,联邦国防军大学慕尼黑) ; Department of Robotics, Perception and Learning, KTH Royal Institute of Technology(机器人、感知与学习系,皇家理工学院) ; Wherobots(Wherobots公司) ; National Water and Sanitation Agency, Brazil, Federal District, Brasilia(巴西国家水务与卫生局,联邦区,巴西利亚)
AI总结 本文介绍TorchGeo教程,展示如何利用该库进行地球观测数据的机器学习处理,包括多光谱水分割的端到端案例研究。
Comments Accepted at ICLR ML4RS 2026 Tutorial Track
ZeroDayBench: 评估LLM代理在未见的零日漏洞上的能力以应对网络防御
AI总结 ZeroDayBench评估了前沿LLM在未见零日漏洞上的自主修复能力,揭示了其在主动网络防御中的局限性及改进方向。
Comments Accepted to ICLR 2026 Workshop "Agents in the Wild"
拓扑因果效应
机构 * Department of Statistics, Korea University(韩国大学统计系)
AI总结 本文提出了一种基于拓扑结构的因果推断框架,通过持续图的加权轮廓函数估计治疗效应,并构建了检验无拓扑效应的正式检验。
Journal ref Proceedings of the Fourteenth International Conference on Learning Representations (ICLR 2026)
ATPO:多轮医疗对话中的自适应树策略优化
机构 * University of Science and Technology of China(中国科学技术大学) ; Qwen Applications Business Group, Alibaba Group(阿里云应用业务部) ; Zhejiang University(浙江大学)
AI总结 ATPO通过自适应树策略优化提升多轮医疗对话中的信息获取效率,有效解决不确定性问题,实验表明其在医疗对话任务中表现优异。
Comments Accepted to ICLR 2026
重新思考大规模强化学习中集成策略梯度中的策略多样性
机构 * The University of Tokyo(东京大学) ; RIKEN Center for Advanced Intelligence Project(RIKEN高级智能项目中心)
AI总结 本文提出耦合策略优化方法,通过KL约束调节策略多样性,提升大规模强化学习中的探索效率和学习性能。
Comments In ICLR 2026. Website at https://naoki04.github.io/paper-cpo/
不可见假设:AGI的承诺与全球南方的未来
AI总结 本文探讨AGI对全球南方的影响,指出其可能加剧或缓解全球不平等,强调基础设施和制度对人类相关性的决定性作用。
Comments 5 pages, 1 figure. Accepted as a workshop paper at Post-AGI Science and Society Workshop ICLR 2026
PreciseCache: 用于高效且高保真的视频生成的精确特征缓存
机构 * MMLab, CUHK(香港中文大学MMLab) ; Tsinghua University(清华大学) ; Tongyi Lab, Alibaba(阿里巴巴通义实验室)
AI总结 PreciseCache通过精确检测和跳过冗余计算,实现视频生成的高效且高质量推理。
Comments ICLR 2026
IDER:惰性经验重放用于可靠的持续学习
机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) ; Shanghai Innovation Institute(上海创新研究院) ; Lehigh University(莱斯大学) ; State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI) ; MIFA Lab(MIFA实验室)
AI总结 IDER通过惰性性质提出新的经验重放方法,提升持续学习的可靠性与准确性,减少遗忘问题。
Comments Accepted by ICLR 2026
可扩展的多语言多模态机器翻译与语音-文本融合
机构 * Harbin Institute of Technology(哈尔滨工业大学) ; Pengcheng Laboratory(鹏城实验室)
AI总结 本文提出一种语音引导的机器翻译框架,通过融合语音和文本提升多语言翻译性能,并在多个基准上取得新突破。
Comments Accepted in ICLR 2026
函数空间解耦扩散用于碳捕集与封存的正反演建模
机构 * Stanford University(斯坦福大学) ; California Institute of Technology(加州理工学院) ; Imperial College London(伦敦帝国学院)
AI总结 函数空间解耦扩散方法在碳捕集与封存的正反演建模中实现高效且物理一致的参数恢复与数据同化。
Comments Accepted to ICLR AI&PDE Workshop
CHAMMI-75:利用异质显微图像预训练多通道模型
机构 * Morgridge Institute for Research(莫里格研究所) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; Institute for Molecular Medicine Finland (FIMM)(芬兰分子医学研究所) ; University of Helsinki(赫尔辛基大学) ; Boston University(波士顿大学) ; Institute of Computational Biology, Helmholtz Munich(海德堡医学院计算生物学研究所) ; Massachusetts Institute of Technology(麻省理工学院) ; Broad Institute of MIT and Harvard(MIT和哈佛大学博德研究所)
AI总结 CHAMMI-75通过预训练多通道模型,提升异质显微图像在细胞形态分析中的性能与适应性。
Comments 47 Pages, 23 Figures, 26 Tables. Published in ICLR 2026
WARP:用于攻击鲁棒删除学习协议的权重传送
机构 * Imperial College London(伦敦帝国学院) ; Dartmouth College(达特茅斯学院)
AI总结 WARP通过利用神经网络对称性减少遗忘集梯度能量和参数分散,提升删除学习协议的攻击鲁棒性,有效降低对抗优势。
Comments This work has been accepted for publication at the International Conference on Learning Representations (ICLR) 2026 (to appear)
PrismAudio:分解的思维链与多维奖励用于视频到音频生成
机构 * Hong Kong University of Science and Technology (HKUST)(香港科技大学) ; Tongyi Fun Team, Alibaba Group(通义Fun团队,阿里巴巴集团) ; The Chinese University of Hong Kong (CUHK)(香港中文大学)
AI总结 PrismAudio通过分解思维链与多维奖励,解决视频到音频生成中的目标纠缠问题,实现更高质量的生成效果。
Comments ICLR 2026
文本到图像扩散模型的持续反学习:一种正则化视角
机构 * The Ohio State University(俄亥俄州立大学) ; Michigan State University(密歇根州立大学) ; Texas A&M University(德克萨斯大学安德森分校) ; Boston University(波士顿大学)
AI总结 本文提出通过正则化方法解决文本到图像扩散模型中持续反学习的问题,通过减轻参数漂移和增强语义意识,提升反学习性能并推动生成式AI的安全发展。
Comments Accepted to ICLR 2026
Self-Aug: 用于大视觉-语言模型的查询和熵自适应解码
机构 * Arizona State University(亚利桑那州立大学) ; Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔兰根-纽伦堡弗里德里希-亚历山大大学)
AI总结 本研究提出Self-Aug,一种无需训练的解码策略,通过自增强提示和自适应阈值算法提升大视觉-语言模型的事实一致性。
Comments 10 pages, accepted to ICLR 2026
推理作为表示:重新思考图像质量评估中的视觉强化学习
AI总结 本文提出RALI算法,通过对比学习实现图像与通用文本表示的对齐,无需推理过程,显著降低参数和推理时间,提升图像质量评估的泛化性能。
Comments ICLR 2026 Oral
通过子空间优化实现变压器的高效资源受限训练
机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris(LTCI、巴黎电信学院、巴黎理工学院)
AI总结 本研究提出WASI方法,通过子空间优化在变压器模型中实现高效资源受限训练,显著降低内存和计算成本,提升推理效率。
Comments ICLR 2026 Oral
缓存到缓存:大型语言模型之间的直接语义通信
机构 * Tsinghua University(清华大学) ; Infinigence AI ; The Chinese University of Hong Kong(香港中文大学) ; Shanghai Jiao Tong University(上海交通大学) ; SLAI ; Shanghai AI Laboratory(上海人工智能实验室)
AI总结 缓存到缓存通过直接语义通信提升大型语言模型的性能和效率,实现比文本通信更高的准确率和更低的延迟。
Comments Published in ICLR'26
通过中间分布塑形微调扩散模型
机构 * Google DeepMind(谷歌DeepMind) ; Georgia Institute of Technology(佐治亚理工学院) ; University of Texas at Austin(德克萨斯大学奥斯汀分校)
AI总结 通过中间分布塑形提升扩散模型微调效果,改进文本到图像生成质量
Comments Accepted at ICLR 2026
任意生成视频插值
AI总结 ArbInterp提出了一种可灵活调整时间戳和长度的视频帧插值框架,通过时间戳感知旋转位置嵌入和外观-运动解耦策略,实现更高效的生成与更流畅的时空过渡。
Comments ICLR 2026
BindWeave:通过跨模态整合实现主体一致的视频生成
机构 * University of Science and Technology of China(中国科学技术大学) ; ByteDance(字节跳动) ; National Key Laboratory of Deep Space Exploration, Deep Space Exploration Laboratory(国家深空探测重点实验室,深空探测实验室)
AI总结 BindWeave通过跨模态整合解决主体一致视频生成难题,利用MLLM-DiT框架提升生成视频的主体一致性和自然度。
Comments Accepted by ICLR 2026
CREPE:通过复制交换控制扩散模型
机构 * University of Cambridge(剑桥大学) ; Technical University of Denmark(丹麦技术大学) ; University of Oxford(牛津大学) ; Cornell University(康奈尔大学) ; University of British Columbia(不列颠哥伦比亚大学) ; Xaira Therapeutics(Xaira制药公司)
AI总结 CREPE通过复制交换算法在推理过程中控制扩散模型,实现样本生成的高多样性与在线优化,适用于多种任务并优于传统SMC方法。
Comments Accepted to ICLR 2026
Earth-Agent: 解锁地球观测的全貌与潜力
AI总结 Earth-Agent是一种结合RGB和光谱数据的代理框架,通过多模态工具生态系统实现跨模态、多步骤推理,提升地球观测分析的科学性和应用潜力。
Comments Published as a conference paper at ICLR 2026
新型词的终结:超越n-gram新颖性作为文本创造力的度量
机构 * Columbia University(哥伦比亚大学) ; Boston University(波士顿大学) ; Stony Brook University(石溪大学)
AI总结 本文研究了n-gram新颖性作为文本创造力度量的局限性,发现其与专家判断的创造力正相关,但高新颖性表达未必具有创造力,且LLM在识别非实用表达方面表现欠佳。
Comments ICLR 2026 Camera Ready. 30 pages, 11 figures, 15 tables
连接柯尔莫哥洛夫复杂性与深度学习:用于Transformer的渐近最优描述长度目标
AI总结 本文提出基于柯尔莫哥洛夫复杂性的渐近最优描述长度目标,用于改进Transformer模型的压缩与泛化能力,揭示了优化挑战。
Comments ICLR 2026
SiNGER:一种更清晰的声音蒸馏进一步视觉变换器
机构 * Kyung Hee University(庆熙大学) ; MOBILTECH CO., LTD(MOBILTECH公司)
AI总结 SiNGER通过奇异空心引导能量再分配框架,在抑制伪影的同时保留信息信号,提升学生模型性能。
Comments Main paper: 12 pages (including 3 pages of references), 6 figures, 6 tables. Appendix: 9 pages, 7 figures. ICLR 2026 accepted
通过回归切片Wasserstein距离快速估计Wasserstein距离
机构 * Department of Statistics and Data Sciences University of Texas at Austin(统计与数据科学系得克萨斯大学奥斯汀分校)
AI总结 本文提出通过回归切片Wasserstein距离快速估计Wasserstein距离的方法,该方法在多种任务中表现出色,尤其在低数据情况下优于现有模型。
Comments Accepted to ICLR 2026, 34 pages, 30 figures, 6 tables