Leveraging machine learning to estimate individualized treatment effects in cluster-randomized trials
利用机器学习估计集群随机试验中的个体化治疗效应
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出利用混合效应机器学习方法估计集群随机试验中连续结果的条件平均治疗效应,通过整合个体和集群层面的基线协变量,解决传统方法无法捕捉个体异质性的问题。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
利用机器学习估计集群随机试验中的个体化治疗效应
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出利用混合效应机器学习方法估计集群随机试验中连续结果的条件平均治疗效应,通过整合个体和集群层面的基线协变量,解决传统方法无法捕捉个体异质性的问题。
对话移动代码本是否能推广到一对一辅导和多模态交互?
专题命中 工作流自动化 :workflow(abstract)
AI总结 研究探讨TalkMoves代码本在一对一辅导中的一致性、实用性及可解释性,对比AI-人类混合代码本,发现前者在可靠性上更优,但后者在多模态覆盖和可用性上更胜一筹。
构建一个经济实惠的自动驾驶实验室:利用物联网进行物理教育中的实用机器学习实验
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出一个低成本的物联网实验平台,用于物理教育中的机器学习实践,展示深度学习在处理复杂非线性关系上的优势。
Journal ref APL Mach. Learn. 3, 046105 (2025)
正二十面体上的十面非边共享翼集及其十边形赤道平衡
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文研究了正二十面体上基于顶点标记N,S,U1-U5,L1-L5的十面三角翼集,通过几何构造得到十边形赤道平衡,并推导出十边形半径的闭合表达式。
Comments 8 pages, 3 figures
ZK-AMS:通过递归证明聚合实现Web 3.0平台可信匿名准入
专题命中 工作流自动化 :workflow(abstract)
AI总结 ZK-AMS通过递归证明聚合技术,实现Web 3.0平台的可信匿名准入,降低验证成本和延迟,提升高并发下的准入效率。
Comments 18 pages, 6 figures
DICE:扩散共识均衡用于稀疏视角CT重建
机构 * Department of Systems and Informatics Engineering(系统与信息工程系) ; Department of Electrical, Electronics, and Telecommunications Engineering(电气、电子与电信工程系) ; Department of Physics(物理系) ; Universidad Industrial de Santander(圣安德烈斯工业大学)
专题命中 工作流自动化 :agent(abstract)
AI总结 DICE框架通过整合双代理共识均衡,结合生成先验能力和测量一致性,有效提升稀疏视角CT重建质量,实验显示在15、30和60视角下优于现有方法。
Comments 8 pages, 4 figures, confenrence
Journal ref Proceedings of the 2025 IEEE 10th International Workshop on Computational Advances in Multi-Sensor Adaptive Processing (CAMSAP)
代理MR序列开发:利用LLM与MR技能进行自动物理引导的序列开发
专题命中 软件智能体 :agentic(title,abstract);agent(abstract);autonomous agent(abstract)
AI总结 本文提出Agent4MR框架,利用LLM和物理验证报告自动生成并优化PyPulseq序列,减少交互次数,实现高效序列开发。
Comments Word count abstract/body: 223 / 4303
ViBES:一个具有行为智能的3D虚拟身体对话代理
机构 * Stanford University(斯坦福大学) ; ByteDance(字节跳动)
专题命中 软件智能体 :agent(title,abstract);agentic(abstract)
AI总结 ViBES通过联合规划语言和运动,实现对话条件下的身体动作生成,提升了多轮对话中的社会交互能力。
Comments Project page: https://ai.stanford.edu/~juze/ViBES/. Accepted by CVPR 2026
CodeTracer:迈向可追溯的代理状态
机构 * Nanjing University(南京大学) ; Kuaishou Technology(快手科技) ; Institute of Automation, CAS(中国科学院自动化研究所) ; University College London(伦敦大学学院) ; Renmin University of China(中国人民大学) ; Alibaba Group(阿里巴巴集团)
专题命中 软件智能体 :agent(title,abstract);分类 cs.AI、cs.SE
AI总结 CodeTracer通过解析异构运行 artifacts,重建状态转换历史,并定位故障起始点,提升代理调试效率。
AI 编程代理需要更好的编译器注释
专题命中 软件智能体 :agent(abstract);AI agent(abstract);workflow(abstract);agentic(comments)
AI总结 本文研究了编译器注释对AI代理优化程序的影响,发现精确注释能显著提升性能,而模糊注释会导致语义错误,结论是未来编译器需提供结构化反馈以支持自主性能工程。
Comments 3 pages, 1 figure, 2 tables, Presented at Workshop on Co-Design for Agentic and Multimodal AI (CoDAIM) 2026
应用代理编码工具改进已发表的算法实现
机构 * Worasait Suwannik(独立研究者)
专题命中 软件智能体 :agentic(title);分类 cs.AI、cs.SE
AI总结 本文提出一个两阶段流程,利用AI改进已发表的算法实现。首先,大语言模型识别符合条件的算法,其次通过Claude Code重复基准并迭代改进。研究显示所有实验均取得改进,且需单日完成,同时讨论了人类在选择目标、验证实验有效性等方面不可替代的作用。
编码代理可以是通用代理吗?
机构 * Agentic Labs
专题命中 软件智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 本文探讨编码代理能否实现端到端业务流程自动化,发现其在简单任务上表现可靠,但在复杂任务上存在瓶颈,指出领域逻辑与代码执行的衔接是通用性关键障碍。
数值不稳定性与混沌:量化大型语言模型的不可预测性
机构 * Department of Computer Science, Florida State University, Tallahassee, USA(佛罗里达州立大学计算机科学系,塔拉希西亚,美国) ; Department of Mathematics, Florida State University, Tallahassee, USA(佛罗里达州立大学数学系,塔拉希西亚,美国)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.LG
AI总结 本文研究了大型语言模型中数值不稳定性导致的不可预测性,揭示了浮点精度限制下误差传播机制,识别出混沌效应及三种不同行为模式。
Comments 8 pages, 9 figures
代码低语者:结合图神经网络和大语言模型的代码和漏洞解决方法
专题命中 软件智能体 :workflow(abstract);分类 cs.AI、cs.SE
AI总结 本文提出Code Whisperer框架,结合图分析与大语言模型,统一检测和修复代码维护性和安全性问题,提升检测性能和修复建议实用性。
Comments 10 Pages
形式架构描述符作为AI编码代理的导航原语
机构 * Independent Researcher(独立研究者)
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE
AI总结 本文研究了通过提供形式架构描述符减少AI编码代理在代码库探索中的导航开销,通过实验和观察证明了架构描述符在导航效率和错误检测方面的显著提升。
Comments 4 pages, 4 tables, preprint. Code and data: https://doi.org/10.5281/zenodo.19500105
CCCE:一种基于知识图谱遍历和自适应决策门控的连续代码校准引擎,用于企业代码库的自主维护
机构 * Independent Researcher(独立研究员)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE
AI总结 本文提出CCCE,通过知识图谱遍历和自适应决策门控技术,实现企业代码库的自主维护,减少修复时间并提供端到端可追溯性。
WybeCoder:验证性 imperative 代码生成
机构 * CERMICS, ENPC, Institut Polytechnique de Paris, CNRS(CERMICS,ENPC,巴黎理工学院,CNRS) ; Computer Lab, University of Cambridge(剑桥大学计算机实验室) ; Korea Institute for Advanced Study(韩国高级研究院) ; FAIR, Meta(FAIR,Meta) ; University College London(伦敦大学学院)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE
AI总结 WybeCoder 提出了一种验证性 imperative 代码生成框架,通过证明与生成同步的方式,实现代码、不变式和证明的共同进化,提升了复杂算法的验证效率。
面向个性化安全编程教育的LLM注入漏洞方法
专题命中 软件智能体 :agentic(abstract);分类 cs.SE
AI总结 本文提出利用LLM在学生代码中注入特定CWE漏洞,生成个性化教学材料,通过实验发现学生认为此类示例更相关清晰,但定量结果未显示显著差异,需进一步研究。
WebXSkill:自主网页代理的技能学习
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; Microsoft(微软)
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.CL
AI总结 WebXSkill通过可执行技能框架解决自主网页代理在长周期任务中的执行与适应问题,提升任务成功率。
Comments 21 pages
面向无人机的视觉与语言导航:进展、挑战与研究路线图
机构 * Autel Robotics, Shenzhen, China(大疆创新,深圳,中国) ; School of Intelligent Software and Engineering, Nanjing University, Nanjing, China(南京大学智能软件与工程学院,南京,中国) ; School of Computer, Data & Information Sciences, University of Wisconsin-Madison, Madison, WI, USA(威斯康星大学麦迪逊分校计算机、数据与信息科学学院,麦迪逊,WI,美国) ; Southern University of Science and Technology, Shenzhen, China(南方科技大学,深圳,中国) ; The University of Hong Kong, Hong Kong SAR, China(香港大学,香港特别行政区,中国) ; School of Software and Microelectronics, Peking University, Beijing, China(北京大学软件与微电子学院,北京,中国)
专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);multi-agent(abstract)
AI总结 本文综述了无人机视觉与语言导航领域,分析了从早期模块化方法到基于大模型的智能系统的发展,探讨了现实部署中的挑战,并提出了未来研究方向。
RiskWebWorld: 电子商务风险管理中GUI代理的现实交互基准
机构 * Ant Group(蚂蚁集团)
专题命中 GUI与网页智能体 :planning(abstract);agentic(abstract);分类 cs.AI、cs.LG
AI总结 RiskWebWorld是一个用于评估GUI代理在电子商务风险管理中能力的现实交互基准,揭示了通用模型与专用模型在长周期专业任务中的显著能力差距。
通过多角色编排实现可扩展的轻量级GUI代理
机构 * Zhejiang Key Laboratory of Accessible Perception and Intelligent Systems, Zhejiang University(浙江可及感知与智能系统重点实验室,浙江大学) ; College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) ; AntGroup(蚂蚁集团)
专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI
AI总结 本文提出LAMO框架,通过多角色编排提升轻量级GUI代理的任务扩展性,开发出支持单体执行和多代理系统编排的LAMO-3B代理,结合先进规划器实现持续性能提升。
Comments Findings of ACL 2026
ProRe:通过推理器-执行器协作的GUI代理前瞻性奖励系统
机构 * NTU(国立新加坡大学) ; Microsoft Research(微软研究院) ; Tsinghua University(清华大学) ; HKUST(香港理工大学)
专题命中 GUI与网页智能体 :agent(abstract,abstract_cn);分类 cs.AI
AI总结 ProRe通过推理器与领域特定评估器协作,提升GUI代理奖励准确性与F1分数,实验显示奖励准确性和F1分数提升达5.3%和19.4%。
Comments 23 pages, 12 figures, ICLR'2026
Journal ref The Fourteenth International Conference on Learning Representations, 2026
ExpSeek:面向Web代理的自触发经验寻求
机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) ; School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) ; Tongyi Lab , Alibaba Group(阿里云实验室,阿里巴巴集团)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL
AI总结 ExpSeek通过自触发机制实现Web代理的经验主动获取,提升交互能力,实验表明其在不同规模模型上均取得显著性能提升。
Comments ACL 2026 Findings, the code is accessible at https://github.com/WYRipple/ExpSeek
UI-Copilot: 通过工具集成策略优化推进长周期GUI自动化
机构 * Zhejiang University(浙江大学) ; Apple(苹果公司) ; Tencent(腾讯)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG
AI总结 本文提出UI-Copilot框架,通过分离持久观察与临时执行上下文实现内存解耦,结合工具集成策略优化提升长周期GUI任务性能,实验显示其在MemGUI-Bench和AndroidWorld上均优于现有模型。
Avenir-UX:通过模拟人类网络交互进行自动用户体验评估
机构 * University College London(伦敦大学学院)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI
AI总结 Avenir-UX通过模拟人类交互行为,提供标准化的可用性评估,结合GUI接地技术,提升用户体验评估的效率和准确性,支持持续、可扩展的数据驱动测试。
MAS-Bench:一种统一的快捷键增强混合移动GUI代理基准测试
机构 * Zhejiang University(浙江大学) ; vivo AI Lab(vivo AI实验室) ; Peking University(北京大学)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI
AI总结 本文提出MAS-Bench,用于评估结合GUI和快捷键的混合移动自动化代理,包含139个任务和9个评估指标,实验显示混合代理在效率上优于纯GUI代理。
具备能力的异构控制屏障函数用于去中心化多机器人安全导航
机构 * Department of Computer Science and Engineering, Texas A&M University(德克萨斯A&M大学计算机科学与工程系) ; Department of Computer Science, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 本文提出CA-HCBF框架,通过统一动力学模型和能力度量,实现异构机器人团队的安全一致性和能力感知协调,提升安全性和任务效率。
Comments 8 pages, 3 figures, 2 table
从指令到事件:基于声音的移动操作
机构 * University of Macau(澳门大学) ; Beihang University(北航) ; Hefei University of Technology(合肥工业大学)
专题命中 GUI与网页智能体 :agent(abstract)
AI总结 本文提出基于声音的移动操作方法,通过开发Habitat-Echo数据平台和任务规划器,使移动代理能主动感知并响应声音事件,无需显式指令。
失败让智能体更强:通过结构化反思提升准确性以实现可靠的工具交互
机构 * Vision Agent Team, Meituan(美团视觉代理团队) ; MeiGen AI Team, Meituan(美团MeiGen AI团队)
专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI、cs.CL
AI总结 本文提出结构化反思方法,通过显式反思和优化提升工具交互的可靠性,实验表明在多轮工具调用中显著提高成功率并减少冗余调用。
Comments ACL