A Pragmatic Guide to Building Conservative Discrete Abstractions of Cyber-Physical Systems
构建网络物理系统的保守离散抽象的实用指南
专题命中 工作流自动化 :workflow(abstract)
AI总结 本教程提出一种按构造保守的闭环动力系统离散抽象构建工作流,含四模块化步骤,经三案例研究验证其设计选择对抽象结构、运行时间及验证结果的影响。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
构建网络物理系统的保守离散抽象的实用指南
专题命中 工作流自动化 :workflow(abstract)
AI总结 本教程提出一种按构造保守的闭环动力系统离散抽象构建工作流,含四模块化步骤,经三案例研究验证其设计选择对抽象结构、运行时间及验证结果的影响。
基于量子比特控制身份记录和电路感知RFSoC模型的频分复用超导量子比特控制的射频预算帧编译
专题命中 工作流自动化 :workflow(abstract)
AI总结 该研究针对频分复用超导量子比特控制的射频预算扰动问题,提出结合QID记录、RFSoC模型等的帧编译工作流,经仿真验证其在12量子比特BV层等场景的应用效果。
Comments 21 pages, 14 figures
通过奇异值分解的关联电子方法中虚拟空间的压缩:在G2集上的应用
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出SVD-TC方案,通过SVD压缩TC计算的虚拟空间,将其应用于G2-1集,实现高效高精度的原子化能计算,且赝势TC基组收敛更快。
通过不确定性感知多保真度筛选加速具有极端功函数的材料发现
专题命中 工作流自动化 :workflow(abstract)
AI总结 本研究结合机器学习与多保真度筛选,开发数据驱动框架,筛选550万种化合物,识别出低、高功函数候选材料,为相关应用加速极端功函数材料发现。
Comments 20 pages, 8 figures
随机XNOR跳跃模型中的异常电流涨落
专题命中 工作流自动化 :workflow(abstract)
AI总结 针对随机XNOR跳跃模型,研究其自旋电流涨落,提出三个带明确振幅的长时间电流分布猜想,通过模拟提供数值支持,相关证明由AI生成。
Comments 27 pages, 6 figures
有限温度下无序合金相稳定性与力学性能的机器学习方法
专题命中 工作流自动化 :workflow(abstract)
AI总结 本研究以Ni-Pd体系为原型,构建高效机器学习势,证实Ni-Pd固态溶液约600 K时热力学稳定,为无序合金研究提供高通量工作流程,可扩展至多组分体系。
windsoCC:利用波前传感器遥测数据重建MagAO-X图像中的风致光晕
专题命中 工作流自动化 :workflow(abstract)
AI总结 本研究开发了windsoCC管道,利用MagAO-X的波前传感器遥测数据重建并去除风致光晕,显著提升了HR 4796A周围盘图像的天体恢复效果。
Comments 9 pages, 4 figures, 1 table, submitted to the Proceedings of SPIE Astronomical Telescopes + Instrumentation 2026
数字化辐射传感器衰变数据集的轮廓似然和基线敏感性诊断
专题命中 工作流自动化 :workflow(abstract)
AI总结 研究针对数字化辐射传感器衰变数据集,提出可重复的简化数据工作流程,通过加权指数拟合及考虑多种图形级效应来测试半衰期估计,展示了如何在有限信息下测试数据的可重复性、可识别性及对分析选择的敏感性。
Comments 39 pages, 7 figures. Published in Sensors, 2026, Volume 26, Article 5056. The journal article is the version of record
Journal ref Sensors 2026, 26, 5056
隐私保护的完全分布式高斯过程回归
专题命中 工作流自动化 :agent(abstract)
AI总结 本文提出基于安全多方计算的隐私保护完全分布式高斯过程回归协议,解决协作学习中的隐私风险,并实现核超参数优化。
Comments 12 pages, 3 figures, 1 table, revised version submitted to IEEE Transactions on Control of Network Systems
意识的模型者图式理论,附可证伪实验
专题命中 工作流自动化 :agent(abstract)
AI总结 提出意识源于单一控制代理——模型者图式,它监控模型者构建内部世界模型的过程,通过将模型者输出转化为感受质产生体验,并用于模型优化;通过扫视变化检测实验区分两种自下而上注意请求,为意识难题提供可检验方案。
Comments 35 pages, 4 figures
Bayesian-Agent:面向LLM Agent框架的后验引导技能演化
机构 * IDEA Research(IDEA研究院) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; DataArcTech Ltd.(DataArcTech有限公司)
专题命中 软件智能体 :agent(title,title_cn);分类 cs.CL
AI总结 提出Bayesian-Agent框架,将可复用技能视为假设,通过后验分布指导技能演化(如修补、拆分、压缩等),在多个基准上显著提升性能,表明Agent技能演化应视为后验引导的框架优化。
Comments 20 pages, 11 figures
OpenCodeReview:面向成本效益型智能体代码评审的非确定性转确定性方案
专题命中 软件智能体 :agent(title,abstract);tool use(abstract);分类 cs.SE
AI总结 OpenCodeReview针对LLM代码评审智能体的非确定性与上下文局部性缺陷,通过在三个流水线节点注入确定性,在AACR-Bench上实现SEM-F1提升且大幅降低令牌消耗,性能优于主流编码智能体。
CLAUDE.md 为何不断膨胀?智能体编码中的灾难性记忆
机构 * South Park Commons(南公园社区)
专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 该研究针对智能体编码中提示文件无限制膨胀的问题,提出通过提示注释消除多余指令,可使现实中智能体指令遵循能力提升多达23.1%。
GitSkills:GitHub上的智能体技能数据集
专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE
AI总结 本文提出GitSkills数据集,包含从28.22万个公开GitHub代码库收集的379.7117万个智能体技能相关文件,为智能体技能的多维度研究提供了数据支撑。
Comments Giuseppe Destefanis, Daniel Graziotin, Matteo Vaccargiu, and Marco Ortu. 2027. GitSkills: A Dataset of Agent Skills on GitHub. In Proceedings of the 24th International Conference on Mining Software Repositories (MSR '27). Association for Computing Machinery, New York, NY, USA, 3 pages. To appear
Ouroboros:一种具有经审核的核心演化机制的自发展前沿编码智能体
专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE
AI总结 本研究提出具有经审核核心演化机制的编码智能体Ouroboros,其在三个基准测试中均创最优结果,Hope部署为长期活体演化实验,同时需应对自发展带来的操作安全问题。
CoEvoSkills: 通过共进化验证实现自进化代理技能
机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) ; MBZUAI(穆罕默德·本·扎耶德人工智能大学) ; McGill University(麦吉尔大学) ; Columbia University(哥伦比亚大学) ; Zhejiang University(浙江大学) ; University of British Columbia(不列颠哥伦比亚大学)
专题命中 软件智能体 :agent(title,abstract);分类 cs.AI
AI总结 本文提出CoEvoSkills框架,使代理能自主生成复杂技能包,通过共进化验证提供反馈,实现在SkillsBench上最高通过率和强泛化能力。
Comments COLM accepted
基于熵的代码对抗翻译用于真实仓库迁移
专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE
AI总结 针对LLM迁移仓库难达可运行状态的问题,提出多智能体框架ECAT,引入A2H-RepoBench基准,迁移质量达74.7%且优于现有方法。
理解编码智能体的架构:一项使用研究原型的探索性研究
专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.SE
AI总结 本研究通过推出编码智能体Ark及基准ArkBench,探索了编码智能体的架构,用gpt-5.4-mini测试Ark解决10项任务中的8项,还对比了其与先进编码智能体的架构,为相关研究提供基础。
个性化技能对编码智能体有帮助吗?开发者交互历史的实证研究
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE
AI总结 本研究通过对13位开发者的206个真实会话实验,发现从交互历史提炼的开发者个性化技能改进有限,而汇集自所有开发者的通用技能增益最大且最一致,为编码智能体的个性化策略提供了实证依据。
Comments 15 pages, 10 figures
LLM智能体工厂:领域特定大语言模型智能体的检索
机构 * Sber AI ; Moscow Institute of Physics and Technology(莫斯科物理技术学院) ; National University of Science and Technology MISIS(莫斯科国立科学技术大学MISIS) ; Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究所) ; Artificial Intelligence Research Institute(人工智能研究所)
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL
AI总结 本研究提出LLM Agents Factory框架,通过检索2万余个预设智能体配置文件按需构建领域特定智能体,在多基准测试中实现高准确率与低推理成本,为工业应用提供动态智能体生成的替代方案。
Comments 7 pages, 1 figure, SIGIR 2026
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG
Journal ref Knowledge-Based Systems, 322 (2025) 113689
FlexSQL:灵活探索与执行打造更优的文本到SQL智能体
专题命中 软件智能体 :agent(abstract);分类 cs.CL
AI总结 FlexSQL是一种文本到SQL智能体,通过灵活的数据库交互机制,在Spider2-Snow数据集上使用gpt-oss-120b取得65.4%得分,优于相关基线,集成到Claude Code中可实现超10%的相对提升
Comments Published at COLM 2026
GitHub开源项目中Cursorrules文件的研究
专题命中 软件智能体 :AI agent(abstract);分类 cs.SE
AI总结 本研究对GitHub开源项目中的.cursorrules文件开展实证研究,明确其分布、内容特征及与.mdc文件的主题连续性,揭示其多用于小型非专业项目的现状。
Comments Published in ICSOFT 2026. This is the author copy version
Emotion2Skill:用于自适应技能选择与演化的模型内部情绪信号
专题命中 软件智能体 :agent(abstract);分类 cs.AI
AI总结 Emotion2Skill框架提取LLM内部情绪向量,将其融入技能选择与演化,在WebShop、ALFWorld上用Qwen3模型实现显著性能提升,验证了情绪表征作为智能体决策信号的有效性。
爆炸半径
机构 * Algorithm Reconnaissance Division(算法侦察部) ; Mankind Research Labs(人类研究实验室) ; North-West University(西北大学) ; University of Pretoria(比勒陀利亚大学)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI
AI总结 针对智能体编码的令牌浪费问题,提出Blast Radius内存管理层,结合NECROPHORESIS与RDM实现可逆上下文驱逐,在7个OpenAI模型上降低令牌消耗17%-26%,提升编码可持续性。
CodeInverter工具套件:基于结构与数据感知及高效大语言模型的二进制反编译技术
专题命中 软件智能体 :workflow(abstract);分类 cs.SE
AI总结 针对现有LLM反编译方法在结构重构、数据恢复等方面的不足,本文提出含CIW、CID、CIMs的CodeInverter套件,经实验验证可显著提升反编译性能,CIM-6.7B达最优效果
SATLOCK:用于低地球轨道星座上抗天气量子密钥分发的切换耦合调度
专题命中 软件智能体 :agent(abstract)
AI总结 研究低地球轨道卫星星座上量子密钥分发路由难题,提出SATLOCK框架,结合综合信道模型、整数线性规划和去中心化深度Q网络,评估不同竞争模式下性能,ILP给出吞吐量上限,DQN智能体学习策略但受跨需求协调限制。
基于反思引导的在线策略自蒸馏的测试时自演进GUI视觉定位
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL
AI总结 针对现有GUI视觉定位模型部署后难适配未见界面且无法反思失败探索的问题,提出测试时自演进框架,结合MLLM反思器、反思引导的在线策略自蒸馏等方法,在六个基准上平均提升7.4%准确率,完善了GUI智能体自演进能力。
SkillLens:用于检索增强型GUI动作预测与在线策略蒸馏的可视化技能卡片
专题命中 GUI与网页智能体 :workflow(abstract);分类 cs.AI
AI总结 SkillLens提出可视化技能卡片(VSCs),结合轨迹转卡片方法与检索增强机制,在两个多模态网页基准上提升了冻结GPT-5.4-mini执行器及Qwen3-VL-2B学生模型的GUI动作预测性能。
超越截图:评估VLMs对UI动画的理解
机构 * University of Michigan(密歇根大学)
专题命中 GUI与网页智能体 :AI agent(abstract);分类 cs.CL
AI总结 本文提出AniMINT数据集,评估VLMs对动态UI动画的理解能力,发现其在基础运动检测上可靠,但高阶解释仍不一致,揭示了模型性能的关键瓶颈。
Comments Published in ACL 2026 Findings