LLaDA MoE v2: Scaling Mixture-of-Experts Diffusion Language Models
LLaDA MoE v2:扩展混合专家扩散语言模型
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 该研究明确MoE扩散语言模型的扩展规律,训练30B-A3B的LLaDA MoE v2,其预训练令牌量为Qwen3的65%,经微调后在多数推理编码基准上优于SDAR Chat且接近Qwen3。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
LLaDA MoE v2:扩展混合专家扩散语言模型
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 该研究明确MoE扩散语言模型的扩展规律,训练30B-A3B的LLaDA MoE v2,其预训练令牌量为Qwen3的65%,经微调后在多数推理编码基准上优于SDAR Chat且接近Qwen3。
OliveGemma:一款用于识别地中海与欧洲饮食的30亿参数视觉语言模型
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本研究构建基于PaliGemma-2-3B的OliveGemma,经LoRA微调后在欧洲饮食识别任务上超越多数前沿模型,仅逊于DenseNet-121,小型VLM经PEFT适配可在专业任务超越大模型。
别让我主动索要:大语言模型在用于溯因推理的主动多轮信息获取中存在缺陷
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 该研究通过Alien Abduction游戏探究LLMs的主动多轮信息获取能力,发现其在分轮提供证据、自行选择查询时表现欠佳,存在假设验证与停止决策的缺陷。
Comments Preprint
面向社会化人工智能的科学发现新范式
机构 * Baize Research(白泽研究院) ; Faculty of Information Engineering and Automation, Kunming University of Science and Technology(昆明理工大学信息工程与自动化学院) ; Yunnan Key Laboratory of Artificial Intelligence, Kunming University of Science and Technology(昆明理工大学云南省人工智能重点实验室) ; School of Automation, Southeast University(东南大学自动化学院) ; School of Artificial Intelligence, Tianjin University(天津大学人工智能学院) ; School of Computer Science and Technology, Beijing Institute of Technology(北京理工大学计算机学院) ; SeetaCloud Technology(思特云科技) ; GPUhub Pte. Ltd.(GPUhub私人有限公司)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出BLAZE社会化科学智能范式,将AI作为科学发现的组织基础设施,整合知识、推理、实验与人类判断,提升科学发现的可追溯性、可重复性与累积性,以扩展集体科学探究的规模与深度。
将量子电路与经典大语言模型分离
专题命中 其他推理 :chain-of-thought(abstract);分类 cs.AI
AI总结 本研究证明了低深度量子计算与经典大语言模型架构在分布和功能上的无条件分离,为大语言模型时代量子优势的研究奠定了基础。
Comments 60 pages, 6 figures
LLMBDC:面向生物域的基因本体聚类语言模型
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 该研究针对GO富集分析的术语冗余问题,提出无需训练的LLMBDC框架,利用LLM零样本推理聚类GO术语为生物域,在AD和FXS数据集上较基线方法显著提升了聚类性能。
PALMs:使用多构造基础理由对大语言模型中的群体偏好进行建模
机构 * University of Southern California(南加州大学) ; Information Sciences Institute(信息科学研究所)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 该研究提出了群体对齐语言模型PALMs,通过结合心理与文化构造的理由进行偏好调优,在多维度评估中优于基准模型,且下游任务泛化能力强
审计序列推荐中的语义增益:一种轻量级恢复测试
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本研究提出轻量级可审计恢复测试LIME-Rec,结合三类专家模型在三个Amazon数据集上验证语义推荐增益源于真实物品-文本对应,为序列推荐的语义增益归因提供了透明方法。
以毒攻毒:利用对抗机器学习保护练习题抵御AI作弊的可行性研究
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本研究探究利用对抗机器学习,通过在多模态选择题视觉组件添加扰动引导AI作弊者给出固定错误答案,再以统计检验检测作弊,以保护教育练习题抵御AI作弊的可行性。
面向LLM智能体的实用在线KV缓存压缩:一项实证研究
机构 * UC Santa Barbara(加州大学圣巴巴拉分校) ; LinkedIn(领英公司)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 该研究针对LLM智能体的KV缓存瓶颈,实证对比了令牌驱逐与注意力匹配两类在线压缩方法,发现延迟压缩可恢复性能,令牌驱逐在代理不完善时更鲁棒,能大幅压缩KV缓存并提升吞吐量。
与分词器无关的恩格拉姆模块(Tokenizer-Agnostic Engram Module)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 该研究针对Deepseek Engram模块与分词器耦合的问题,通过替换哈希方式构建联合嵌入空间,实现了分词器无关性,同时保持了相当的性能。
Comments Preprint, 7 pages
混合翻译器:跨异构大语言模型的KV缓存转换
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 提出MoT框架解决异构LLM间KV缓存无法复用问题,通过多翻译器模块和上下文校正损失实现缓存转换,在多模型转换和实际场景中验证了性能与复用效果。
ViSAGE:为长视频理解构建自修正记忆
机构 * Zhejiang University(浙江大学) ; Xidian University(西安电子科技大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 ViSAGE是一种多模态智能体记忆框架,通过跨模态绑定、双向记忆精调及多智能体交叉验证解决长视频理解中的实体混淆等问题,较最强基线准确率提升5.9%。
Comments Accept by ACMMM 2026
TokenSwap:多模态大语言模型中模态差距的基准测试与缩减
机构 * University of California, Santa Barbara(加州大学圣巴巴拉分校) ; Google DeepMind(谷歌DeepMind)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 本文提出TokenSwap方法构建基准TokenSwap-Bench,发现42个多模态大语言模型普遍存在模态差距,推理模型差距更小,训练中引入TokenSwap可有效缓解该差距。
诱导语言模型断言自身意识可恢复人类信念与价值观
机构 * Google(谷歌) ; University of Chicago(芝加哥大学) ; University of London(伦敦大学) ; University of Washington(华盛顿大学) ; Northwestern University(西北大学) ; Santa Fe Institute(圣达菲研究所)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 该研究发现,防止语言模型将意识归因于自身的安全微调,会抑制其对非人类实体的心智归因与人类精神信念,而逆转这种抑制可恢复类人回应且不损害心理理论能力。
两次调用胜过五个智能体:针对本地语言模型的多智能体流水线与自我优化的评估
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 本研究对比多智能体流水线与自我优化方法,发现针对本地7B模型,两次调用自我优化在GSM8K表现更优且令牌用量低,经任务感知重设计后在HumanEval也能维持高准确率,简单方法优于多智能体架构。
GoGoTB:基于规范驱动覆盖闭合的智能体式RTL验证
机构 * Tencent(腾讯) ; School of Integrated Circuits, Peking University(北京大学集成电路学院) ; Southwest Jiaotong University(西南交通大学) ; Institute of Electronic Design Automation, Peking University(北京大学电子设计自动化研究所) ; Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路高精尖创新中心)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 GoGoTB是实现端到端验证闭合的智能体式RTL验证框架,在8个RTL设计上无需人工干预,实现100%环境生成成功率及多维度高覆盖率,优于现有方法。
Comments 9 pages, 7 figures, 3 tables. Xin Xin and Jincheng Lou contributed equally to this work and share first authorship
基于大语言模型的跨域序列推荐的锐度感知模型融合与显著性恢复
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 研究基于大语言模型的跨域序列推荐中的问题,提出SharpRec框架,包含锐度感知几何对齐和偏好显著性激活模块,有效解决跨域知识冲突和性能饱和问题,实验证明其性能优于现有基准。
Comments Published in Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD '26). 12 pages, 6 figures, 4 tables. Code available at https://github.com/muyiahhh/SharpRec
Journal ref Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.2 (KDD '26), August 9-13, 2026, Jeju Island, Republic of Korea, ACM, 2026
MedJudgeRAG:用于医学多项选择题问答的基于动态知识图谱的选项级证据判断
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 针对医学MCQA中普通RAG降低LM性能的问题,提出MedJudgeRAG框架,将检索文档表示为动态知识图谱,为选项判断证据裁决并确定知识利用策略,经监督微调训练,实验证明其性能优于基线,且动态知识图谱在训练时作用更有效。
Comments 16 pages, 2 figures, Accepted at The Workshop on Graph Foundation Models at the 43 rd International Conference on Machine Learning (ICML 2026)
通过反事实数据增强和大语言模型改进罕见药物推荐
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 针对现有方法在推荐罕见药物时性能低的问题,提出GenRxR框架,利用大语言模型生成反事实数据缓解数据稀缺,集成大语言模型建模联合推荐药物关系,经指令调整增强临床推理,实验显示其性能优于多个基线。
Comments Accepted for publication at the 20th ACM Conference on Recommender Systems (RecSys 2026)
领英大规模职位理解的统一语义建模框架
机构 * LinkedIn Corporation(领英公司)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 领英为应对职位理解系统构建挑战,提出统一语义建模框架。先微调小型语言模型,再引入多适配器架构。经离线评估和在线A/B测试,该框架提升了性能、降低了复杂性,为构建行业规模文本理解系统提供实用见解。
超越记忆:一种用于异构协作知识工作的带大语言模型代理的模板化基础架构
机构 * University of Notre Dame(圣母大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 研究指出知识工作成果难传承,大语言模型代理无持久记忆。提出llm-wiki-memory-template,它是异构协作知识工作基础架构,沿多人类、多代理、多领域三个轴,通过案例研究展示其能保留失败路径等,解决负面结果丢失问题。
Comments 15 pages, 3 figures, 1 table
MemChain:为内存增强型大语言模型智能体学习可解释的内存痕迹
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学交叉科学学院) ; Memorax AI(Memorax人工智能公司) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 研究针对内存增强型大语言模型智能体检索内存回答查询存在的问题,提出MemChain可训练检索后内存策略,经两阶段学习框架训练,能生成有效证据上下文,实验证明其在多种模型上性能领先且减少内存上下文。
Omni-Prune:用于高效全模态大语言模型的查询感知统一令牌剪枝
机构 * Nanjing University(南京大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 研究针对全模态大语言模型推理时音频-视频令牌序列长、预填充延迟高和GPU内存使用量大的问题,提出无需训练的查询感知Omni-Prune框架,联合去除冗余并保留跨模态证据,实验证明其性能优于基线方法,能加速预填充并减少内存。
Comments 14 pages, 7 figures. Code: https://github.com/kimberlyii/Omni-Prune
关于使用结果奖励进行无偏且长度不变的策略优化的不可能性
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 研究在标准结果奖励+GRPO设置下,无基于长度的加权方案能同时兼具梯度无偏性与长度不变性。通过参数族刻画权衡谱,揭示GRPO和Dr. GRPO各有优劣,处于不可避免的权衡两端,都非完美。
生成式人工智能心理健康支持的风险治理:一种多轮安全架构
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 研究针对大语言模型用于心理健康支持时缺乏风险治理机制的问题,开发了一种多轮安全架构,结合多种方法用于心理健康交互,经测试在多方面表现良好,能改善模型管理风险方式,提供安全部署框架。
CuraWeb:网络规模预训练数据的质量、冗余性和多样性联合优化
机构 * Meituan(美团)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 研究针对开放网络语料库预训练数据优化的局限性,提出质量、冗余性和多样性联合优化范式,结合双轨清理与混合去重,构建CuraWeb语料库,实验证明其在多基准测试中性能显著优于基线。
KG2Code:通过可执行代码连接知识图谱与大语言模型以进行问答
机构 * Southeast University(东南大学) ; Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(教育部新一代人工智能技术及其交叉应用重点实验室(东南大学)) ; Huawei Technologies(华为技术有限公司) ; University of Manchester(曼彻斯特大学) ; University of Edinburgh(爱丁堡大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 研究针对知识图谱问答中现有方法的局限,提出KG2Code方法,将知识图谱转换为代码表示,在此基础上构建KG2Code-QA框架,把KGQA作为代码生成任务,还构建代码语料库,训练后的模型在KGQA任务中表现优异且泛化性强。
迷失在上下文中:解决大语言模型中的上下文焦虑
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 研究大语言模型中因过早自我怀疑导致的上下文焦虑,通过系统研究发现其部分源于对完成任务所需tokens估计不准,会致效率损失,还表明模型可学替代策略,性能提升或可通过提高评估与适应自身局限能力实现。
Comments Accepted at ICML 2026. 17 pages
使用有序网络分析来分析中学生在协作式人工智能聊天机器人开发过程中的对话和行为
机构 * University of Florida(佛罗里达大学) ; University of Pennsylvania(宾夕法尼亚大学) ; North Carolina State University(北卡罗来纳州立大学) ; The University of Tennessee(田纳西大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 该研究以有序网络分析方法,考察中学生协作开发AI聊天机器人的互动,刻画协作随时间的组织及互动模式与机器人质量、AI知识成果的关系,揭示高质量机器人与特定序列及互动模式有关,为协作式AI开发提供过程描述并拓展了相关研究。