Multiobjective Preexpectation Reasoning for Probabilistic Programs
概率程序的多目标预期望推理
专题命中 逻辑推理 :reasoning(title);planning(abstract)
AI总结 针对带非确定性的概率程序规划问题,提出多目标预期望变换器及对应策略综合规则,构建了无限MDP上多目标优化的程序层面符号方法。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
概率程序的多目标预期望推理
专题命中 逻辑推理 :reasoning(title);planning(abstract)
AI总结 针对带非确定性的概率程序规划问题,提出多目标预期望变换器及对应策略综合规则,构建了无限MDP上多目标优化的程序层面符号方法。
面向FANET中基于LLM的GPSR优化的参数特定检索与知识引导推理框架
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 针对FANET中现有GPSR协议难以适配动态环境的问题,提出基于LLM的PMKR-GPSR框架,通过参数特定多索引检索和知识引导约束图实现协议一致的路由参数适配,在高移动性场景下提升了数据包投递率并降低了端到端时延。
用于通用符号推理的递归视觉语言模型
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出基于预训练Qwen的递归推理框架R-Qwen,结合递归模型与预训练LLMs的优势,在8个基准测试中优于同类模型和更大LLMs,ARC-AGI上提升27.6%。
神经符号加速基于MILP的运动规划与时间逻辑和随机约束
专题命中 逻辑推理 :planning(title,abstract)
AI总结 本文提出利用神经符号方法加速MILP运动规划,通过机器学习指导求解器的符号搜索,提升处理时间逻辑、随机约束等复杂规划问题的效率和可扩展性。
语义丰富性还是几何推理?VLM视觉不变性的脆弱性
机构 * Boston University(波士顿大学)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 研究揭示VLM在基本几何变换下的脆弱性,指出其在空间不变性与等变性上的不足,影响物体识别的可靠性。
Antaeus: 通过上下文锚定的LLM推理发现仓库级逻辑漏洞
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出Antaeus框架,通过仓库级代码上下文锚定LLM推理,结合函数优先级排序、上下文推理、比较验证和结构化报告,有效检测逻辑漏洞,在28个仓库中检测出15个漏洞,优于基线方法。
GEAR-Seg:用于推理分割和数据引擎的基于可解释智能体
机构 * College of Biosystems Engineering and Food Science, Zhejiang University(浙江大学生物系统工程与食品科学学院) ; ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州国际科创中心)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出GEAR-Seg,一种解耦的智能体框架,通过将像素转换为属性文本实现可解释推理分割,零样本性能优异,并可作为数据引擎构建大规模基准GEAR-131K。
Comments 21 pages, 8 figures
AERMANI-VLM:基于视觉语言模型的空中 manipulation 的结构提示与推理
机构 * Robotics Research Center, IIIT Hyderabad(IIIT海得拉巴机器人研究中心) ; Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) ; Newcastle University(纽卡斯尔大学)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出AERMANI-VLM框架,通过分离高层推理与低层控制,利用结构化提示生成自然语言推理轨迹,实现安全可靠的空中 manipulation 任务执行。
VLMs 是视频推理的好老师:通过自适应测试时优化
机构 * City University of Hong Kong(香港城市大学) ; Kling Team, Kuaishou Technology(快手科技 Kling 团队)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出将视觉语言模型(VLM)作为“教师”,通过提取任务规则并设计可微分奖励,指导视频生成模型(VGM)在测试时在线优化轻量级 LoRA 模块,从而提升视频推理的泛化能力。
Comments Project Page: https://VLM-as-Teacher.github.io/
可解Transformer模型中思维链状态追踪的学习动力学
专题命中 逻辑推理 :chain-of-thought(title,abstract)
AI总结 通过可解设置研究Transformer在思维链状态追踪中的学习动力学,发现注意力检索与MLP逻辑模块分阶段协同发展。
Comments 10 pages, 3 figures
结构化可视化设计知识:用于基础生成推理和情境反馈
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出一种结构化方案,将可视化设计知识编码为带语义元数据的自然语言指南,支持专家编写、机器查询,并嵌入向量空间以分析冲突和跨领域原则,弥补符号系统与生成模型之间的鸿沟。
DWM-RO:面向支持SWIPT的卫星-地面异构网络的去中心化世界模型与推理卸载
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 针对SWIPT卫星-地面异构网络中多智能体强化学习样本效率低和协调性差的问题,提出去中心化世界模型与推理卸载框架,通过想象策略训练和边缘协调机制实现快速收敛、高谱效和低约束违规。
人工智能时代的临床推理:纵向认知与人机协作
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本研究通过混合方法揭示临床推理的纵向结构,发现当前AI系统主要支持单次就诊任务,与医生多就诊的推理过程存在关键不匹配,为设计更符合真实临床推理的AI系统提供方向。
VisualFLIP: 在多模态推理中,预测是否依赖于任务关键的视觉证据?
机构 * Imperial College London(伦敦帝国理工学院)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出VisualFLIP基准,通过成对图像扰动测试多模态大模型是否真正依赖关键视觉证据,发现正确预测与证据依赖存在分离。
多智能体系统在时序逻辑公式下的运动与协作运输规划
机构 * KTH Center for Autonomous Systems(KTH 自主系统中心)
专题命中 逻辑推理 :planning(title,abstract)
AI总结 本文提出一种混合控制框架,用于在高阶目标表达为线性时序逻辑(LTL)公式的情况下,多智能体系统的运动规划。设计控制协议以实现智能体在预定义兴趣区域间的过渡及协作运输物体。通过抽象智能体与物体的耦合行为为有限状态转移系统,设计满足智能体和物体规格的高层多智能体计划。
Comments Submitted to IEEE Transactions on Automation Science and Engineering. arXiv admin note: text overlap with arXiv:1611.05186
面向信号时间逻辑规范的多智能体通信感知运动规划
专题命中 逻辑推理 :planning(title,abstract)
AI总结 本文提出一种数学框架,用于合成满足复杂高层正式局部规范的多智能体运动计划,通过联合优化运动规划与无线通信,确保通信质量的同时避免碰撞。
Comments 6 pages, 3 figures. arXiv admin note: text overlap with arXiv:1705.10259
NeuroLog: 可审计的推理——通过LLM事实、Datalog和SMT进行神经符号漏洞发现
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 提出NeuroLog流水线,结合LLM提取事实、Souffle规则组合和Z3后处理,实现无需构建的漏洞发现,并在多个真实项目中重新发现CVE级漏洞。
推理能力如何赋能内窥手术中的AI助手机器人
机构 * Department of Electronic Engineering(电子工程系)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文研究了推理能力在内窥手术中AI助手机器人中的应用,提出通过整合多模态线索、解读手术意图和推断隐藏组织动态来提高手术的精确性、安全性和可持续性。
Comments Accepted by npj digital medicine
推理劫持:大语言模型中推理对齐的脆弱性
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文指出现有安全研究忽视了推理对齐的脆弱性,提出新的对抗性提示攻击方法'推理劫持',通过注入虚假决策标准影响模型推理逻辑,实验表明即使先进模型也易受此类攻击影响。
Comments accepted by ACL 2026
通过大型语言模型评估代码执行推理的连贯性与一致性
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出CES任务,评估大语言模型在模拟程序执行和编程任务中的推理能力,引入连贯性概念以判断执行逻辑是否符合常识,提出新的度量标准以衡量推理一致性,发现LLM在编程任务中存在路径敏感分析的不足。
扩展扩展逻辑:代理元合成逻辑推理
专题命中 逻辑推理 :reasoning(title);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出SSLogic框架,通过代理迭代生成和优化可执行的生成器-验证器对,生成具有新规则和难度梯度的任务家族,提升训练效率。
Comments 41 pages, 8 figures, 5 tables in the main body. Project page: https://github.com/AdAstraAbyssoque/Scaling-the-Scaling-Logic, typos corrected, claims cleared
设计转型游戏以支持关于生成式人工智能的社伦理推理
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文设计了两款游戏,通过同伴评估、基于约束的创造力和社会推理元素,促进青少年对生成式人工智能的社伦理推理。
我的爱,华生。通过神经符号推理跨异构工件检测恶意技能
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出MalSkills框架,通过符号解析与LLM语义分析提取异构工件中的安全敏感操作,构建技能依赖图并进行神经符号推理,实现恶意技能检测,实验表明其在F1得分上优于现有方法。
弥合感知与推理:用于多模态大语言模型中RLVR的标记重加权
机构 * University of Science and Technology of China(中国科学技术大学) ; Peking University(北京大学) ; Independent Researcher(独立研究员)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出Token-Reweighting策略,通过动态重加权多模态大语言模型中的感知与推理标记,提升RLVR性能,实现视觉 grounding 和推理的协同优化。
解耦感知与推理以实现抗幻觉的视频理解
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出DPL模型,通过解耦感知与推理以提升视频理解的抗幻觉能力,引入感知奖励和FAE评估器,有效提高训练后性能和数据效率。
Comments 17 pages, 8 figures
面向推理的编程:通过链式语义工具来突破大型视觉语言模型
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出面向推理的编程方法,通过链式语义工具突破大型视觉语言模型的安全对齐。
WaterVideoQA: 以ASV为中心的感知与符合规则的推理 via 多模态智能体
机构 * Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)人工智能研究所) ; Hubei Key Laboratory of Inland Shipping Technology (Wuhan University of Technology)(湖北内河航运技术重点实验室(武汉理工大学)) ; School of Navigation, Wuhan University of Technology(武汉理工大学航海学院) ; School of Advanced Technology, Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学先进科技学院) ; School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) ; School of Information Engineering, Yancheng Institute of Technology(盐城职业技术学院信息工程学院) ; School of Engineering, Stanford University(斯坦福大学工程学院) ; Centre for AI and Data Science Innovation and the School of Science and Engineering, James Cook University(詹姆斯库克大学人工智能与数据科学创新中心及科学与工程学院)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 WaterVideoQA通过多模态智能体系统,实现ASV在复杂水域环境中的感知与规则合规推理,提升自主航行的安全性和精确性。
Comments 11 pages,8 figures
恶意示例:通过模板填充和不安全推理实现大语言模型的劫持
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 TrojFill通过模板填充和不安全推理漏洞,实现对大语言模型的安全过滤绕过,展示了对齐LLM的系统性弱点。
Comments under review
看得少,看得对:双向感知塑造用于多模态推理
机构 * Microsoft Research Asia(微软亚洲研究院) ; Tsinghua University(清华大学)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 本文提出BiPS,通过双向感知塑造提升多模态推理性能,有效增强细粒度视觉依赖并提升跨领域泛化能力。
基于内部言语和持久记忆的因子推理用于证据导向的人机交互
机构 * Department of Engineering, University of Palermo(帕尔米罗大学工程系) ; TheEngineRoom, Department of Informatics Bioengineering, Robotics and System Engineering(TheEngineRoom,信息生物工程、机器人与系统工程系)
专题命中 逻辑推理 :reasoning(title,abstract)
AI总结 JANUS 通过因子推理实现证据导向的人机交互,结合内部言语和持久记忆模块,提升机器人辅助系统的可扩展性和可审计性。