QBism Logic
QB主义逻辑
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究基于QB主义对量子理论的解释进行逻辑形式化,通过引入相关语言和证明定理,将无动态算子片段转化为一阶公式,归约有效性,还表明有限维量子理论可通过SIC等实现框架并满足相关条件。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
QB主义逻辑
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究基于QB主义对量子理论的解释进行逻辑形式化,通过引入相关语言和证明定理,将无动态算子片段转化为一阶公式,归约有效性,还表明有限维量子理论可通过SIC等实现框架并满足相关条件。
用于钙钛矿氧化物逆设计的符号谓词引导语言智能体
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究钙钛矿氧化物逆设计,引入 DSL 引导策略,将自然语言规则转化为符号谓词,开发 ORCHESTRA 框架。该策略能增强 LLM 智能体推理能力,无需大量特定任务数据集或额外训练,提升材料设计性能。
直觉主义动态逻辑
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究直觉主义动态逻辑的数学理论,涵盖五种该逻辑。通过开发证明论工具、进行语义研究,建立相关性质与界限。主要贡献为开发演算、获有限模型性质及可判定性、给出直觉主义线性时态逻辑完备公理系统。
Comments PhD Thesis
JW-ASTClaw:一种用于自主太阳望远镜的通用多智能体框架及其在中国子午工程中的实现
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究将大语言模型驱动的自主控制系统部署在太阳望远镜上,采用多智能体框架及解耦三层架构,通过感知智能体编码专业知识,经中央推理引擎处理,实现实时自适应调度,跨季节验证效果良好,提升了观测等多方面能力。
Comments 17 pages, 6 figures,
Mizzle:一种用于在智能体错误查找中防止误报的完整并发错误逻辑
专题命中 逻辑推理 :reasoning(abstract)
AI总结 针对大语言模型在程序错误查找中产生大量误报的问题,提出Mizzle方法,它是一种用于并发程序的错误分离逻辑,在Rocq证明助手实现机械化,能防止误报且完整,还通过三种错误概念实例化并展示其可用于证明错误存在。
FlowArk:通过上下文感知知识重用提升安卓应用的智能数据流分析
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究安卓应用数据流分析中批量任务重复分析成本高的问题,提出FlowArk系统,通过提炼、打包和注入知识条目降低成本,实验表明其在保持分析质量的同时,能降低API成本并增加任务完成量。
Comments 12 pages, 9 figures, 6 tables
当模糊测试与理解相遇:用于RTL验证的大语言模型驱动的语义测试生成
专题命中 逻辑推理 :reasoning(abstract)
AI总结 针对硬件验证难题,提出ChipFuzzer框架,利用大语言模型语义推理能力。采用双阶段工作流程,覆盖引导阶段结合控制流分析提升覆盖率,错误引导阶段借助历史数据提高错误发现率,实验显示其显著提升验证效果。
Comments 8 figures
宗教与人工智能作为分布式意义系统:一种自然主义概念模型
专题命中 逻辑推理 :reasoning(abstract)
AI总结 该文将宗教与人工智能视为结构相似的分布式意义系统,源于相同底层认知架构。通过概念模型展示意义的产生等过程,宗教与当代AI系统有类似功能,此模型解释相关机制并阐明AI成意义权威的条件,提供统一框架理解二者。
SherAgent:通过大语言模型赋能的迭代查询-过滤回溯在野外扩展攻击调查
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究针对野外攻击调查中依赖爆炸和因果链碎片化问题。提出SherAgent系统,基于大语言模型,采用迭代“查询-过滤”回溯范式处理非结构化数据,克服相关问题。相比传统方法,提高调查成功率,且运行高效,减轻专家分析负担。
6G无线接入网的隐私保护意图实现与保证
专题命中 逻辑推理 :verifier(abstract)
AI总结 研究6G无线接入网隐私保护意图实现与保证问题,提出一种架构,协调器依意图类别分配资源且仅用O1接口计数器验证,定义隐私属性并证明其成立,映射到相关框架确定运行点,实验表明意图类别粒度变化对分配和保证有相应影响。
Log-Insight:通过神经符号日志分析实现微服务事件诊断自动化
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究针对大规模微服务系统生产事件诊断难题,提出Log-Insight系统,通过自动化SRE手动分类工作流程,经符号阶段处理后为LLM提供证据合成假设报告,六阶段管道减少大量原始事件,评估显示该系统能高效准确诊断根本原因,还报告了相关故障模式等内容。
使用多模态大语言模型从几何标签到室内建筑组件的语义理解
机构 * School of Qilu Transportation, Shandong University(山东大学齐鲁交通学院) ; Guangzhou Institute of Geography, Guangdong Academy of Sciences(广东省地理研究所)
专题命中 逻辑推理 :reasoning(abstract)
AI总结 研究针对室内建筑组件,提出以点云为中心的多模态大语言模型Building-MLLM,通过特定机制解决语义集中问题,开发引擎编译数据集,实验表明其在多任务上表现优异,提升室内组件语言理解。
Comments 46 pages, 13 figures, accepted by Automation in Construction journal
ArchEval:将人工智能代理作为计算机架构师进行评估
专题命中 逻辑推理 :verifier(abstract)
AI总结 介绍用于评估大语言模型代理在计算机架构设计与优化方面的ArchEval基准和平台,含20个挑战及8个模拟器,通过不同设置运行,报告性能并记录轨迹,揭示当前代理的优缺点及后续所需能力。
知识超越参数:演化智能合约漏洞检测
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出EvoVuln框架,将漏洞检测转化为程序性知识演化问题,通过运行时反转控制架构和两阶段演化流水线,仅用少量标注样本自动合成并优化检测逻辑,在五种真实漏洞类型上实现71%宏平均F1分数。
当智能体不停止:揭示LLM智能体中的无限循环
专题命中 逻辑推理 :planning(abstract)
AI总结 提出IAL-Scan静态分析工具,通过抽象智能体代码为Agent IR并构建循环依赖图,检测LLM智能体项目中因反馈路径未有效约束导致的无限循环故障,在6549个仓库中达到91.9%精度。
探究性行动逻辑
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出探究性行动逻辑InqAL,一种用于推理行动的多主体模态逻辑,通过问题模态分析主体对结果的确定作用,并证明其完备性和可判定性。
Comments In Proceedings AiML 2026, arXiv:2606.29444
Journal ref EPTCS 447, 2026, pp. 222-241
验证门控的智能工业多机器人系统任务状态治理
机构 * Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出验证门控任务状态治理框架,通过同步任务森林与黑板状态,经确定性验证后原子提交,减少无效提交和冲突,提升工业多机器人系统安全与效率。
ConcoLixir:用于Python符号执行的响应式LLM发现预言
专题命中 逻辑推理 :reasoning(abstract)
AI总结 针对Python符号执行中库调用降级、语义操作难解和路径覆盖停滞问题,提出ConcoLixir,利用LLM作为发现预言生成种子、输入并引导覆盖,平均行覆盖率提升8.6-17.0个百分点,成本仅$1.63。
TabClean: 用于表格数据清洗的可复用LLM合成程序
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出TabClean系统,通过将LLM推理编译为可复用的带守卫修复程序,实现无模型训练的表格数据清洗,在五个基准数据集上F1优于基线,并大幅降低重复运行成本。
Comments 13 pages
CEDAR-42001: 从ISO/IEC 42001符合性到面向架构、可审计可见的AI信息物理系统保障态势
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出CEDAR-42001方法,将ISO/IEC 42001审计证据转化为架构感知的保障态势,通过分层归因、成熟度评估和行动推荐,揭示符合性审计的局限性,并在自动驾驶案例中验证。
Comments 19 Pages, 3 figures, 4 tables. Code and data are available in the accompanying artifact repository
AgenticOS: 面向自主AI代理的意图导向安全操作系统架构
专题命中 逻辑推理 :planning(abstract)
AI总结 针对LLM驱动代理面临的结构性安全挑战,提出AgenticOS架构,将OS从资源管理器重构为意图过滤器,通过四层架构和意图ABI实现最小权限环境。
Comments 11 pages,5 figures,1 tables
LLM4CAD-Editor:一种面向多层级计算机辅助设计编辑的意图感知大语言模型框架
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出LLM4CAD-Editor框架,通过结构化领域特定语言LLM4CAD-DSL实现自然语言驱动的CAD编辑,支持功能、操作和参数三级编辑,在参数级编辑上达到96.3%解析准确率和0.935 IoU。
通过知识增强的LLM智能体实现左移高层次综合验证
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出一种知识增强的智能体驱动左移验证框架,通过双层级一致性检查、符号执行和HLS验证知识图谱,在综合前自动验证C与HLS-C的功能一致性,覆盖率达98.26%。
神经符号AI中的安全性、安全性和认知风险
专题命中 逻辑推理 :reasoning(abstract)
AI总结 本文系统分析了神经符号AI在五层架构中的攻击面,提出统一威胁模型、符号层威胁目录及认知风险分析,并通过三个实证基准验证了攻击的有效性与检测挑战。
Comments 28 pages, 1 figure, 10 tables
注意差距:诊断图像内文本编辑中的约束发现失败
专题命中 逻辑推理 :reasoning(abstract)
AI总结 通过图像内文本编辑的受控诊断,研究多模态模型在发现未明确指定的视觉依赖约束时的失败,发现模型仅能自行发现46%的约束,而明确提供时可达94%。
从帧到时间图:基于视觉语言模型的上下文第一人称动作识别
机构 * University of Alicante(阿利坎特大学) ; ETH Zürich(苏黎世联邦理工学院) ; Microsoft(微软)
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出将视频转换为时间动作图,通过多阶段提示生成自然语言叙述并结构化,实现上下文学习,在EGTEA和Epic-Kitchens-100上显著提升零样本和少样本动作识别性能。
OSDAG: 面向高效多机器人协作的在线调度
机构 * Japan Advanced Institute of Science and Technology(日本北陆先端科学技术大学院大学) ; University of Engineering and Technology, Vietnam National University(越南国立大学工程技术大学) ; Hanyang University(汉阳大学)
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出OSDAG框架,结合LLM任务推理与DAG在线调度,通过一次性分解指令为依赖图并实时分配任务,相比对话式方法推理速度提升5-15倍,调度时间缩短38%。
产生义务的动作
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出情境演算中处理产生义务动作的框架问题的解决方案,通过简化可达关系并扩展Reiter的基本动作理论,实现了义务的直觉性质。
Acoda:对抗性代码混淆防御基于LLM的分析
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出基于遗传算法的对抗性代码混淆框架Acoda,通过8种语义保留的混淆方法迭代优化,有效诱导LLM拒绝或误判代码分析,在7个先进LLM上攻击成功率高达70%。
一种用于LLM驱动服务放置的神经符号Prolog技能
专题命中 逻辑推理 :reasoning(abstract)
AI总结 提出一种基于Prolog技能的神经符号方法,将服务放置意图转化为符号事实和规则,利用Prolog进行约束验证和推理,实现可检查的策略感知放置。