Learning Reasoning World Models for Parallel Code
学习并行代码的推理世界模型
专题命中 其他推理 :reasoning(title,abstract)
AI总结 提出Parallel-Code World Models (PCWMs),通过推理LLM直接预测并行代码的工具输出,以解决并行代码训练数据稀缺问题,在数据竞争预测和性能分析任务上取得显著提升。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
学习并行代码的推理世界模型
专题命中 其他推理 :reasoning(title,abstract)
AI总结 提出Parallel-Code World Models (PCWMs),通过推理LLM直接预测并行代码的工具输出,以解决并行代码训练数据稀缺问题,在数据竞争预测和性能分析任务上取得显著提升。
UniD$^3$:一种用于药物-疾病发现与推理的知识图谱增强RAG框架
机构 * Department of Health Outcomes and Biomedical Informatics, University of Florida(佛罗里达大学健康成果与生物医学信息学系) ; Department of Hematology, H. Lee Moffitt Cancer Center and Research Institute(血液科,H. Lee Moffitt癌症中心与研究院) ; Center for Bioinformatics and Computational Biology, Houston Methodist Research Institute(生物信息学与计算生物学中心,休斯顿方法主义研究学院) ; Department of Cardiothoracic Surgery, Weill Cornell Medicine, Cornell University(心胸外科,Weill Cornell医学,康奈尔大学) ; Department of Biostatistics and Health Data Science, Indiana University School of Medicine(生物统计学与健康数据科学系,印第安纳大学医学院)
专题命中 其他推理 :reasoning(title);分类 cs.CL
AI总结 提出UniD$^3$框架,结合大语言模型与知识图谱增强检索生成(KG-RAG),从生物医学文献中提取、组织和验证药物-疾病知识,生成结构化数据集并提升推理可靠性。
原型Transformer:迈向可解释设计的语言模型架构
机构 * University of Cambridge(剑桥大学) ; ETH Zurich(苏黎世联邦理工学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出原型Transformer(ProtoT),一种用线性代价原型模块替代二次代价自注意力的自回归语言模型架构,原型自动捕获可命名概念,提升可解释性并支持行为编辑。
Comments Accepted at ICML 2026. Equal contribution: Yordan Yordanov and Matteo Forasassi. 40 pages, 28 figures, 22 tables
Soft-NBCE: 基于熵加权分块融合的长上下文处理
机构 * Beijing Normal University(北京师范大学) ; Chunjiang Intelligence(春江智能)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 针对长上下文推理中硬选择策略导致语义碎片化的问题,提出Soft-NBCE,通过熵加权软融合和一致性蒸馏,在保持检索精度的同时提升多跳推理性能。
Comments 7 pages, 3 figures, 2 tables. Preprint
MiCU: 基于大语言模型的端到端智能家居指令理解
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; Xiaomi Corporation(小米公司) ; Institute for Math & AI, Wuhan University(武汉大学数学与人工智能研究院)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 提出MiCU,一种利用课程学习、强化学习和令牌压缩技术的领域特定大语言模型,用于解决智能家居中模糊指令理解问题,平均准确率提升20.01%。
通过苏格拉底式提问和批判性论证教授外行人逻辑谬误,以应对错误信息的根源
机构 * ETH Zurich(苏黎世联邦理工学院) ; ETH AI Center(苏黎世联邦理工学院人工智能中心)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 提出LFTutor智能辅导系统,利用大语言模型结合苏格拉底式提问和批判性论证原则,帮助外行人学习识别逻辑谬误,显著优于基线模型。
Comments This paper has been accepted to Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Long Paper), Main Conference
Journal ref Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics, 2026
从演示到奖励:VLM奖励模型的测试时提示优化
机构 * University of Amsterdam(阿姆斯特丹大学) ; Catholic University of Leuven(鲁汶天主大学) ; Toyota Research Institute(丰田研究院) ; Toyota Motor Europe(丰田欧洲公司)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 提出Demo2Reward方法,利用少量专家演示在测试时优化VLM奖励模型的提示指令,减少假阳性并保持真阳性,无需额外训练即可提升下游策略学习。
目标重掩码:在离散扩散语言模型中将令牌编辑替换为令牌到掩码的精炼
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 针对离散掩码扩散语言模型中令牌编辑机制的局限性,提出无训练的令牌到掩码重掩码方法,通过将疑似错误令牌重置为掩码状态,利用扩散过程在更干净上下文中重新预测,显著提升数学等任务的性能。
Comments This paper has been significantly revised, expanded, and superseded by a more comprehensive version available at arXiv:2604.18738. The authors have chosen to withdraw this version to avoid overlap and direct readers to the updated work
LLM引导的通信用于合作多智能体强化学习
机构 * KAIST(韩国科学技术院)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 提出LMAC框架,利用大语言模型的推理能力设计通信协议,使所有智能体尽可能准确一致地重建底层状态,从而提升多智能体强化学习中的状态重建和性能。
Comments 9 pages for main, 32 pages for total, Accepted to ICML 2026
ES-Merging: 通过嵌入空间信号进行生物多模态大模型合并
机构 * KAIST(韩国科学技术院) ; DeepAuto.ai
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 提出ES-Merging框架,利用嵌入空间信号估计合并系数,实现生物多模态大模型的高效合并,提升跨模态推理和单模态知识保留能力。
DyLLM: 基于显著性标记选择与部分注意力的高效扩散LLM推理
机构 * University of Seoul(首尔大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 针对扩散语言模型迭代去噪计算昂贵的问题,提出DyLLM框架,通过仅计算显著标记的注意力与前馈操作,实现无需训练的加速推理,在保持精度的同时吞吐量提升高达9.6倍。
Comments 21 pages, 10 figures, 7 tables, accepted at ICML 2026
ASKD-Whisper: 自适应自知识蒸馏用于高效低延迟自动语音识别
机构 * OKESTRO Co., Ltd(OKESTRO公司) ; Sejong University(世宗大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 提出自适应自知识蒸馏(ASKD)动态课程框架,通过逐步减少对教师模型的依赖并引入自知识蒸馏阶段,在压缩Whisper模型时实现5倍推理加速和1.07%词错误率降低。
Comments Title and content have been updated
ACON:面向长周期LLM智能体的上下文压缩优化
机构 * University of Washington(华盛顿大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 提出ACON框架,通过自然语言空间优化压缩策略,在不微调模型的情况下减少峰值token使用量26-54%并提升任务成功率,同时可蒸馏至小模型。
Comments ICML 2026
视觉关系的多模态函数向量
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 通过因果中介分析提取多模态函数向量,操纵注意力头以改善视觉关系推理,并实现零样本和微调性能提升。
DECK: LLM幻觉的一致性×置信度分类法
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 提出一种基于样本间一致性和词级置信度的2×2分类法(DECK),将LLM幻觉分为四个行为区域,每个区域对应可检测的评分器家族,并通过实验验证其有效性及识别出输出级不确定性评估的普遍盲点。
Comments 18 pages, 3 figures, 5 tables
HarnessForge:面向自适应智能体系统的协同框架与策略进化
机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算先进创新中心,人工智能学院,北京航空航天大学) ; Tsinghua University(清华大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 提出HarnessForge元自适应框架,通过框架-策略协同进化实现LLM智能体系统的全系统自适应,在多个基准上显著提升性能。
Comments 25 pages, 13 figures
TrafficRAG:用于交通事故责任认定的多模态RAG框架
机构 * Southwest Petroleum University(西南石油大学) ; Sichuan Police College(四川警察学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 提出TrafficRAG框架,通过视觉语言模型生成结构化描述、混合检索获取法规和案例、大语言模型融合多模态证据进行推理,实现自动化交通事故责任分析报告生成。
Comments 12 pages, 3 figures, accepted at ICANN 2026
深入歧义:基于A*的多智能体常识混淆攻击LLM提示
机构 * University of Liverpool(利物浦大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 提出一种基于A*的事实错误诱导框架,通过层次化重写策略和动态语义分散系数生成语义对齐但混淆的提示,以高效攻击LLM的常识推理。
Comments Pre-print
识别你的编排器:面向LLM多智能体系统的熵动力学视角
机构 * Junze Zhu, Weihao Chen, Xuanwang Zhang, Zhen Wu, Xinyu Dai(朱俊泽、陈伟浩、张轩望、伍震、戴新宇)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 提出平均场熵动力学框架,通过逆工作流生成(IWG)合成高复杂度基准,揭示推理型模型作为编排器时因上下文压缩而失效的“推理陷阱”,为多智能体系统架构设计提供物理可解释参数。
OCC-RAG:面向忠实问答的最优认知核心
机构 * OCC Team(OCC团队)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 提出OCC-RAG,一种通过多上下文多跳合成数据训练的小语言模型,在忠实问答任务中匹配或超越2-6倍规模通用模型。
SDR:用于放射学报告生成的集合距离奖励
机构 * Stanford University(斯坦福大学) ; Stanford University School of Medicine(斯坦福大学医学院) ; Ghent University(根特大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 针对胸部X光报告生成中标准奖励不兼容的问题,提出基于集合距离的连续置换不变奖励,通过GRPO后训练和测试时缩放显著提升性能。
Zamba2-VL 技术报告
机构 * University of California, Berkeley(加州大学伯克利分校) ; University of Cambridge(剑桥大学) ; University of Washington(华盛顿大学) ; University of Toronto(多伦多大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 提出基于混合架构Zamba2的视觉语言模型Zamba2-VL,在图像理解等基准上媲美Transformer模型,且首次令牌延迟降低约一个数量级。
Comments 16 pages, 2 figures
测试时深度思考以探索隐式规则
机构 * Renmin University of China(中国人民大学) ; Department of Statistics and Data Science, Tsinghua University(清华大学统计与数据科学系) ; School of Computer Science and Engineering, UESTC(UESTC计算机科学与工程学院) ; Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) ; School of Mathematical Sciences, Nankai University(南开大学数学科学学院) ; Whiting School, Johns Hopkins University(约翰斯·霍普金斯大学惠特林学院) ; School of Artificial Intelligence, Shanghai Jiaotong University(上海交通大学人工智能学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 针对智能体在隐式规则环境中失败的问题,提出TTExplore框架,通过训练专用模型Exp-Thinker进行测试时推理,平均提升基线性能14-19点。
从碎片到事实:一种课程驱动的DPO方法用于生成印地语新闻真实性解释
机构 * TCS Research(TCS研究) ; Department of Computer Science and Engineering, Indian Institute of Technology Patna(印度理工学院帕纳布计算机科学与工程系) ; Indian Institute of Technology Patna(印度理工学院帕纳布) ; University of Innsbruck(因斯布鲁克大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 针对印地语等低资源语言的虚假信息检测,提出一种结合直接偏好优化(DPO)与课程学习的框架,通过引入“实际性”和“精炼度”参数优化解释质量,实验验证了生成连贯、相关解释的有效性。
Comments Accepted at ACL 2026 Findings
RefLoRA:重构低秩适配以实现大型模型的高效微调
机构 * Department of ECE University of Minnesota(电子工程系明尼苏达大学) ; Department of CS ETH Zürich(计算机科学系苏黎世联邦理工学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 针对LoRA因非唯一低秩分解导致权重更新不一致和性能下降的问题,提出RefLoRA方法,通过每步优化最小化损失上界的低秩分解,促进更平坦的损失景观和稳定收敛,在自然语言理解和常识推理任务上优于现有LoRA变体且计算开销可忽略。
Comments Accepted as a conference paper at NeurIPS 2025
良性输入,有害输出:通过分布式语义重组的跨模态越狱
专题命中 其他推理 :reasoning(abstract)
AI总结 提出分布式语义重组(DSR)框架,将有害意图分解为良性文本和视觉基元,利用多模态大模型的推理能力在跨模态推理阶段融合为有害输出,实现高攻击成功率且输入毒性极低。
Comments 11 pages, 5 figures
利用城市流动性增强基础模型的社会经济理解
专题命中 其他推理 :reasoning(abstract)
AI总结 提出MobFusion范式,通过将流动性网络作为上下文、图连接器和结构化令牌三种方式融入基础模型,以提升城市社会经济预测性能。
智能体系统运维:分类、挑战与未来方向
专题命中 其他推理 :reasoning(abstract)
AI总结 本文针对大型语言模型(LLM)驱动的智能体系统在运行中出现的异常问题,提出了一种名为AgentOps的运维框架,涵盖监控、异常检测、根因定位和修复四个关键阶段。
双路Top-K检索与1v1 VLM重排序用于CoVR-R
机构 * Southeast University(东南大学) ; National University of Singapore(新加坡国立大学) ; Independent Researcher(独立研究者) ; Opus AI Research(Opus AI研究) ; University of Science and Technology of China(中国科学技术大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 提出双路Top-K检索与1v1 VLM重排序方法,通过解耦召回与选择,在CoVR-R挑战中达到95.28% R@1。
CASTLE2026 团队 WDL 技术报告
机构 * Key Laboratory of Intelligent Perception and Image Understanding(智能感知与图像理解重点实验室)
专题命中 其他推理 :reasoning(abstract)
AI总结 提出基于 Qwen 的证据感知多模态推理流程,通过提示路由和置信度加权投票解决长视频问答,在 CASTLE 挑战赛中排名第一。
Comments 4 pages