When Do Institutions Beat Intelligence?
何时制度优于智能?
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究通过构建受控人工生态,实验揭示制度在修复集体构建可用公共状态的失败时优于智能,反之则不然,为智能与制度的选择提供了诊断依据。
科学与医疗
医学智能、临床 AI、医学影像、病理、诊断和医疗健康大模型。
何时制度优于智能?
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究通过构建受控人工生态,实验揭示制度在修复集体构建可用公共状态的失败时优于智能,反之则不然,为智能与制度的选择提供了诊断依据。
知识图谱引导的检索增强大语言模型用于汽车在环(HiL)验证中的可解释根本原因分析
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究提出KG引导的RAG-LLM框架,用于汽车HiL数据的RCA与故障定位,在ASM汽油发动机和电动车系统案例中分别获90%、94% Top-1准确率,可实现可解释且泛化的故障分析。
Comments 10 pages, 3 figures, 5 tables. Accepted for publication and oral presentation at the 10th International Conference on System Reliability and Safety (ICSRS 2026), Rome, Italy, November 23--25, 2026
量子与经典机器学习模型在肿瘤数据上的基准测试
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本研究开发公平基准测试方法,对比量子与经典机器学习模型在三类肿瘤数据集上的表现,未发现量子优势,建议优先分析高维度、更符合生物学实际的数据集以推进实用量子优势研究。
跨模态拓扑从稀疏电压快照解码电池故障
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本研究针对EV电池安全瓶颈,提出跨模态诊断框架DeFault,通过将电压序列展开为相空间拓扑解码故障,在99辆EV的1640万条数据上对四种故障类型平均准确率达0.96,无需新增传感器即可实现高可解释性故障诊断。
Comments 33 pages, 12 figures
面向汽车HiL验证的大语言模型集成故障分类
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本文提出可解释多LLM集成框架,结合异构LLM输出提升汽车HiL验证故障分类性能,经多车型多场景评估,Top-3集成优于单模型及Top-5集成,实现更优诊断效果。
Comments 8 pages, 3 figures. Accepted at the 23rd Workshop on Model Driven Engineering, Verification and Validation (MoDeVVa 2026), co-located with MODELS 2026. Original submitted version
观测证据修正了关于氮氧化物减排会导致臭氧严重恶化的假设
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 研究人员通过整合观测约束的机器学习框架,调和了空气质量模型关于NOx减排对臭氧影响的分歧,发现中国城市NOx减排普遍使臭氧下降,持续减排的益处被低估。
评估价值与异质性的框架:以多癌早期检测测试的人群筛查早期模型为例
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究提出了拆分价值与异质性的医疗干预价值评估框架,将其应用于英格兰MCED测试的人群筛查模型,发现Galleri筛查每人上限价值为0.135 QALYs,结肠/直肠等三类癌症贡献50%价值,结果稳健,可指导决策与研究优先级。
Comments 15 pages, 2 Figures, 2 Tables
基于模拟轨迹的大语言模型引导式启发式设计:动态生产与自动导引车调度的案例研究
机构 * Tsinghua University(清华大学)
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究提出LLM引导的启发式设计框架,通过模拟轨迹诊断优化AGV与生产调度策略,在多组实验中优于多种基线方法,证实模拟轨迹可指导代码层面的策略改进。
Comments 33 pages, 8 figures
SiriusDeliver:腾讯的数据仓库交付自动化方案
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 腾讯提出SiriusDeliver端到端交付自动化智能体,集成三类组件,经离线实验和腾讯云WeData大规模部署验证,可显著提升DW交付的成功率、效率,缩短交付时间与工程师工作量。
Comments 13 pages, 13 figures, 3 tables. Under submission
GALA:用于微服务根本原因分析和事件响应的图增强大语言模型智能体
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 针对微服务RCA的现有方法存在局限,提出图增强LLM智能体框架GALA+,结合STRIX与SURE-Score,在基准测试中性能优于最佳LLM基线,获SRE专家认可。
Comments Proceedings of the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26), October 12--16, 2026, Munich, Germany
Branch2Skill:基于推理树的高效技能演化方法
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 Branch2Skill是将推理树转化为密集监督信号的框架,通过蒙特卡洛树搜索提取推理证据并提炼更新,在六个基准测试中提升了任务性能与技能演化效率,以GPT 5.5为目标模型时token用量比SkillOpt少73.2%
Comments 9 pages, 6 figures, 3 tables. Technical report
穿行于讨论间:用于现场小组讨论分析的移动视觉分析系统
机构 * Central South University(中南大学) ; Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本研究提出移动视觉分析系统MobileGroupVis,适配小屏幕触控交互,用于现场分析课堂小组讨论,可辅助教师监控小组、诊断异常并开展课堂干预。
Comments Accepted by IEEE VIS'26
FailForge:从持续失败中提取过程能力到代码智能体
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 FailForge 框架将代码智能体的失败案例转化为训练信号,以边际成本恢复超26%失败实例,使 Qwen3.5-4B 在 SWE-bench Verified 上的解决率提升6.6个百分点,增益集中于最难问题。
用大语言模型智能体改进约束模型
机构 * TU Wien(维也纳技术大学)
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究提出一种基于LLM智能体的框架,通过迭代诊断修复改进约束模型,在9个组合优化问题的27个测试实例中多数表现优于原模型,部分问题求解速度提升超两个数量级,证明自主智能体方法可支持约束模型优化。
Lingjing:面向开放城市多智能体具身任务的仿真测试平台
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 Lingjing 是一款面向开放城市异构多智能体具身任务的仿真测试平台,支持城市多智能体协同的可复现评估与故障诊断,通过评估视觉语言模型等揭示了环境感知等瓶颈。
JaleesBench:AI助手能否成为良好的精神陪伴?
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 研究人员推出JaleesBench基准测试,评估AI助手的精神陪伴能力,发现简单提示指导可提升通用模型的陪伴表现,领域微调助手的优势来自检索和提示层,还可用于改进现有宗教类AI助手。
Comments 21 pages, 8 figures, 4 tables. Open-source harness, scenario bank, proof texts, and full evaluation (model responses and both judges' verdicts): https://github.com/iaser-ai/jaleesbench . Interactive browser for inspecting scenarios, responses, and judge verdicts: https://s.iaser.ai/jb
异构转诊患者的诊疗医院队列中的排队分析与成本优化
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本研究针对含初诊与转诊患者的医院队列,构建分析决策框架,推导性能指标,设计负载触发控制,验证结果并优化总成本,采用多种启发式求解器求解。
QSVM-RQNN:用于状态监测和故障分类的低量子比特循环量子相似度学习
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究针对NISQ设备的量子资源限制问题,提出QSVM-RQNN框架,结合QSVM与RQNN实现低量子比特需求,在故障分类任务上达到有竞争力的性能,实现了性能与效率的良好权衡。
Comments 24 Pages, 7 Figures
稀有事件搜寻中的静默覆盖失效及可预测该失效的简并指数
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究针对稀有事件搜寻中因模型误设导致的静默覆盖失效,提出泊松-费舍尔简并指数预测失效,通过建模变形恢复覆盖但损失灵敏度。
SkillProx:基于近端文本梯度下降的自进化智能体技能
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 SkillProx是结合闭环诊断进化与近端优化的自进化智能体技能框架,可提升LLM智能体在分布内外基准的平均准确率3.0个百分点,且两种核心组件具有互补效果。
Comments 23 pages, 4 figures
EMAS:通过证据引导的修正稳定多智能体系统演化
机构 * King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学) ; Fudan University(复旦大学)
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 EMAS 是一种不更新 LLM 参数、利用样本经验修正 MAS 拓扑与提示词的方法,在四个基准和两个 LLM 上提升了准确率并降低了 token 成本,表现优于多数基线方法。
头自主性:基于冻结查询-键几何的无数据稀疏注意力
机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) ; University of Chinese Academy of Sciences(中国科学院大学) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Baidu Inc.(百度公司)
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本研究提出无数据稀疏注意力方法 AoH,通过查询-键投影谱几何识别检索头与流头,在 50% 稀疏度下平均保留全注意力 96.5% 性能,同时显著降低 LLM 的计算延迟与 KV-cache 内存。
AgentChaos:通过可编程故障注入实现智能体系统的混沌工程
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 提出AgentChaos框架,在不修改源代码的情况下于LLM API共享层注入故障,评估显示智能体系统鲁棒性取决于自身实现,现有故障诊断方法仍有提升空间。
Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)
通过优化闪烁体、光电探测器、读出电子学以及正交堆叠探测器构型中基于DOI的时间校正实现108 ps符合时间分辨率
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 该研究提出正交堆叠的xDetector构型,通过优化闪烁体、光电探测器、读出电子学及三维相互作用CTR校正,使系统CTR达108.6 ps FWHM,较传统探测器提升10.3%,有望助力TOF-PET性能提升
过滤本原蕴含项的隐式计算
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 针对现有本原蕴含项计算方法因指数级数量导致可扩展性差的问题,提出基于决策图的端到端符号算法,实现受侧约束的本原蕴含项的隐式计算。
人工智能监管中的有效性、可靠性与透明度
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本文针对现有AI监管框架未将AI推断有效性作为部署前提的不足,结合印度《普塔斯瓦米》判决的信息自决原则,提出含有效性评估、部署后监测的结构化可操作AI监管框架。
BlockPython:一种支持从积木式编程向Python编程过渡的进程感知智能体平台
机构 * East China Normal University(华东师范大学) ; Tsinghua University(清华大学) ; University of Washington(华盛顿大学)
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 BlockPython是支持从积木式编程向Python过渡的平台,以双向转换为核心,通过四阶段引导学习者,利用进程证据诊断困难,为相关系统设计提供参考。
Comments AIED 2026 Interactive Event Track
C³PO:评估全模态模型中的跨模态组合与反事实性能
机构 * Microsoft Research India(微软研究院印度分院) ; IIIT Hyderabad(印度国际信息技术研究院(海得拉巴))
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 本研究推出C³PO基准数据集,评估全模态模型的跨模态组合与反事实性能,发现模型存在模态主导问题,需改进架构以支持持续跨模态注意力。
飞行前深思熟虑:面向无人机“看见并到达”导航的视觉引导空间深思熟虑
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 针对无人机“看见并到达”导航中语义-控制失配问题,提出视觉-语言航路点预测框架DBFly,通过空间机动决策链、隐式飞行走廊和感知终端收敛的停止策略,使成功率较SOTA基线平均提升25.07个百分点。
Comments 13 pages, 9 figures
面向时间敏感血液样本采集与配送的动态调度
专题命中 诊断辅助 :diagnosis(abstract)
AI总结 针对血液样本配送延迟问题,提出基于马尔可夫决策过程的神经近似动态规划调度框架,通过对偶值函数分解提升按时配送样本量占比,减少对外部快递的依赖。