Designing for Accountable Agents: a Viewpoint
为可问责的智能体设计:一种观点
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 本文探讨了多智能体系统中智能体的可问责性,提出了一种定义并分析其在开放社会技术系统中的应用,识别了研究挑战和未来研究方向。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
为可问责的智能体设计:一种观点
专题命中 多智能体 :agent(abstract);multi-agent(abstract)
AI总结 本文探讨了多智能体系统中智能体的可问责性,提出了一种定义并分析其在开放社会技术系统中的应用,识别了研究挑战和未来研究方向。
在人类加入团队之前:医疗机器人团队模拟中的协调失败诊断
机构 * Cornell Tech(康奈尔科技校区) ; Department of Information Science, Cornell University(康奈尔大学信息科学系) ; University of Maryland, College Park(马里兰大学帕克分校) ; Imperial College London(伦敦帝国学院)
专题命中 多智能体 :agent(abstract);分类 cs.AI
AI总结 本文通过模拟方法研究医疗机器人团队的协调失败问题,发现团队结构是协调的主要瓶颈,并提出安全的人机协作设计方法。
Comments Revised version incorporating new analysis and restructuring
Commander-GPT:多模态讽刺检测的分工与路由
专题命中 多智能体 :agent(abstract);分类 cs.AI
AI总结 本文提出Commander-GPT框架,通过分工协作的LLM代理团队,结合三种指挥官类型,提升多模态讽刺检测性能,实验结果显示在F1分数上优于现有方法。
基于事件触发的多机器人任务分配自适应一致性
专题命中 多智能体 :agent(abstract)
AI总结 本文提出一种基于事件触发的自适应一致性框架,用于在动态和通信受限环境中实现高效适应性任务分配。通过自适应一致性机制和行为树架构,减少通信开销并提升系统效率和鲁棒性。
Comments 40 pages, 18 figures. Published in Computer Communications under CC-BY license
Journal ref Computer Communications, Volume 251, 2026, 108499
Qualixar OS:面向AI代理编排的通用操作系统
专题命中 工作流自动化 :agent(title,abstract);AI agent(title,abstract);workflow(abstract);multi-agent(abstract)
AI总结 Qualixar OS是首个应用层操作系统,支持异构多代理系统,提供10个LLM供应商、8+代理框架和7种传输的完整运行时,包含12种多代理拓扑执行语义、LLM驱动的团队设计引擎、三层模型路由、共识判断管道、四层内容归属和通用兼容性等功能。
Comments 20 pages, 7 figures, 8 tables. Zenodo DOI: 10.5281/zenodo.19454219
基于高斯过程的去中心化标量场映射
专题命中 工作流自动化 :agent(abstract);multi-agent(abstract)
AI总结 本文提出去中心化交集数据共享与同化协议,通过局部高斯过程模型和子域重叠几何构造邻居特定包,提升团队预测性能。
软量子算法
机构 * Terra Quantum AG
专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG
AI总结 本文提出通过单个正则化项训练保持单位性的矩阵,再通过电路对齐恢复门基架构,从而提升量子机器学习效率。
Comments 6 pages, 6 figures, 0 tables
GS-Surrogate:基于可变形高斯散点的参数空间探索的可变形高斯散点
机构 * The Ohio State University(俄亥俄州立大学) ; NVIDIA(英伟达) ; Oak Ridge National Laboratory(橡树岭国家实验室)
专题命中 工作流自动化 :workflow(abstract);分类 cs.AI
AI总结 本文提出GS-Surrogate,一种基于可变形高斯散点的可视化替代模型,用于参数空间探索。通过构建标准高斯场并进行参数条件变形,实现高效可控的可视化任务适应,如等值面提取和转移函数编辑。
迈向基于大语言模型的自动化安全配置方法的开发:符合乌克兰网络安全法规
机构 * National Technical University of Ukraine “Igor Sikorsky Kyiv Polytechnic Institute”(乌克兰国立技术大学“伊戈尔·西科尔斯基基辅理工学院”)
专题命中 工作流自动化 :workflow(abstract);分类 cs.AI
AI总结 本文探讨将国际最佳实践整合到国家监管体系中,提出利用大语言模型实现自动化安全配置的方法,以应对高密度混合威胁环境下的网络安全挑战。
Comments 12 pages, 2 figures
面向高并发和容错Web应用的多方会话类型
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出一种全局类型框架,为多方会话类型添加显式失败语义和动态参与,以支持高并发和容错Web应用的正式验证。
Comments In Proceedings PLACES 2026, arXiv:2604.05737
Journal ref EPTCS 444, 2026, pp. 68-78
用于台式血栓切除分析的4D血管重建
机构 * UCLA Health(加州大学洛杉矶分校健康中心) ; UCLA Physics and Astronomy(加州大学洛杉矶分校物理与天文学系) ; Chan Zuckerberg Biohub Network(陈-扎克伯格生物中心网络) ; Ronald Reagan UCLA Medical Center(罗纳德·里根加州大学洛杉矶分校医学中心)
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出了一种低成本多视角工作流,用于台式血栓切除的4D高斯点云重建,实现了时间分辨的表面运动学和相对位移及应力代理测量,用于血栓切除台式研究。
Comments 20 pages, 10 figures, 1 table, supplementary material (3 tables, 3 figures, and 11 videos). Project page: https://ethanuser.github.io/vessel4D/
基于生成模型的语言引导多模态纹理创作
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出一种语言驱动的多模态纹理创作系统,通过生成模型将自然语言提示转化为触觉和视觉纹理,实现触觉与视觉信号的语义一致性,提升创作效率与可解释性。
Comments 14 pages, 13 figures, accepted to IEEE Haptics Symposium 2026
通过I-Q混频实现真实波形级物联网网络仿真
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出IQSim仿真方法,通过I-Q流混频模拟真实波形,解决传统包级仿真在邻道泄漏、交叉调制等关键波形效应上的不足,支持异构Sub-GHz ISM频段共存场景的仿真。
Comments Accepted for publication at the 2026 IEEE International Symposium on Spectrum Innovation (DySPAN 2026). 5 pages, 3 figures
最大化局部化的沃因纳函数的元优化
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出一种元优化方法,利用工作流抽象和机器学习技术,实现无需人工干预的全局优化沃因纳函数,应用于纠缠能带结构插值、加速玻尔兹曼输运计算和高精度沃因纳函数计算。
Script2Screen: 通过交互式视听生成支持对话脚本写作
专题命中 工作流自动化 :workflow(abstract)
AI总结 Script2Screen通过整合脚本写作与视听场景创建,提供统一同步的工作流程,帮助作家通过交互式视听生成提升对话脚本创作效率。
自组织:一种面向LLM服务的自演化系统范式,用于运行时动态
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出Autopoiesis,一种自演化系统,使LLM服务从静态策略部署转向持续在线策略演化,通过实时动态驱动策略合成,提升服务在运行时动态下的适应性与效率。
在误差受限的损失性压缩中保持离散的莫尔斯-塞曼复形
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出了一种在损失性压缩中完整保持拓扑结构(特别是莫尔斯-塞曼复形)的方法,通过迭代编辑策略修正解压输出中的关键点和分离线,确保拓扑特征的准确保留。
ClawLess:AI代理的安全模型
机构 * Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) ; Department of Computer Science and Engineering, Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系) ; Southern University of Science and Technology(南方科技大学) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI
AI总结 ClawLess提出一种形式化安全框架,通过在最坏情况威胁模型下强制验证策略,确保AI代理运行时的安全性,结合BPF技术实现动态策略的高效执行。
CODE-GEN:一种基于检索增强生成的多选题生成人机协作人工智能系统
机构 * University of Notre Dame(圣母大学)
专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 CODE-GEN通过生成与课程目标一致的多选题提升学生代码推理能力,采用生成器和验证器代理,结合专用工具提高准确性,评估结果显示系统在七个教学维度上表现优异,但人类专家仍需参与设计教学性干扰项和反馈质量。
Comments Full version of the paper accepted as a short paper at the 27th International Conference on Artificial Intelligence in Education (AIED 2026)
计算机环境在大语言模型中激发通用代理智能
机构 * GSAI, Renmin University of China(中国人民大学高瓴人工智能学院) ; Microsoft Research(微软研究院) ; Tsinghua University(清华大学)
专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 本文研究了计算机环境如何通过虚拟沙盒激发大语言模型的通用能力,展示了环境对任务解决的提升效果及训练方法。
Comments Project Page: https://llm-in-sandbox.github.io
ZitPit:面向代理软件摄入的消费者侧准入控制
专题命中 软件智能体 :agentic(title,abstract)
AI总结 ZitPit通过严格边界控制,确保首次见到的外部工件成为持久政策事件,统一了工件准入、仓库开放状态、能力范围执行和持久政策记录,提升代理工作流的安全性。
Comments 6 pages, 2 figures
FermiLink:一个多领域自主科学模拟的统一代理框架
专题命中 软件智能体 :agent(title,abstract)
AI总结 FermiLink通过分离知识库与模拟工作流,实现多领域科学模拟的统一框架,能高效复现74%的科学图表并生成高质量研究成果。
Comments Simulation data available at https://www.taoeli.org/publications; source code available at Github https://github.com/TaoELi/FermiLink
代理那么多?GitHub上编码代理的采用情况
专题命中 软件智能体 :agentic(title);分类 cs.SE
AI总结 研究探讨了编码代理在GitHub上的采用情况,发现其采用率高达22.20%-28.66%,且在项目成熟度、组织类型和编程语言上均广泛适用。
通过问答和基于特征的开发评估仓库级软件文档
机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) ; Independent Researcher, China(独立研究者)
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE
AI总结 本文提出SWD-Bench基准,通过功能驱动的问答任务评估仓库级文档质量,揭示现有方法局限,并展示高质量文档对SWE-Agent问题解决率的提升。
基于科学知识的解码约束:提升大语言模型的可靠性
机构 * Nanjing University(南京大学) ; Tsinghua University(清华大学) ; Northeastern University(东北大学)
专题命中 软件智能体 :planning(abstract);分类 cs.AI、cs.CL
AI总结 本文提出SciDC方法,通过整合领域知识与强约束提升LLM在科学任务中的可靠性,实验显示在工业配方设计、肿瘤诊断和逆合成规划中平均准确率提升12%。
超越功能性正确性:AI IDE生成大规模项目的 设计问题
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; School of Mathematical and Computational Sciences, Massey University(梅西大学数学与计算科学学院) ; School of Computer Science, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) ; School of Computer Science, Central China Normal University(华中师范大学计算机学院) ; School of Computing Technologies, RMIT University(RMIT大学计算技术学院)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE
AI总结 本文研究了AI IDE生成大规模项目的功能正确性和设计问题,通过FD-HITL框架生成10个项目,发现存在大量设计缺陷,需专业开发者审查。
Comments 40 pages, 19 images, 5 tables, Manuscript submitted to a Journal (2026)
基于聊天机器人的代码理解评估在自动化编程评估系统中的应用
机构 * University of Innsbruck(因斯布鲁克大学)
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE
AI总结 本文探讨了聊天机器人在自动化编程评估中的应用,提出混合苏格拉底框架以整合对话验证,解决代码理解评估中的挑战。
Comments 12 pages, accepted for publication at CSEDU 2026
REAgent:基于需求的LLM代理用于软件问题解决
专题命中 软件智能体 :agent(abstract);分类 cs.SE
AI总结 本文提出REAgent框架,通过引入问题导向的需求作为结构化任务规范,提升补丁生成准确性,实验表明其在问题解决率上平均提升17.40%。
WebExpert: 基于领域感知的网页代理:通过批评者引导的专家经验实现高精度搜索
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL
AI总结 WebExpert通过领域感知的网页代理,结合批评者引导的专家经验,提升搜索精度,其核心方法包括句子级经验检索、结构化轻量级领域诱导及偏好优化规划,有效提升了答案准确率。
Comments accepted by icassp2026
UI-AGILE: 通过有效的强化学习和精确的推理时间接地提升GUI代理
机构 * Sino-Russian Research Center for Digital Economy(中俄数字经济研究中心)
专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL
AI总结 UI-AGILE通过改进监督微调过程和推理中的分解接地,提升了GUI代理的接地性能和通用能力,在ScreenSpot-Pro和ScreenSpot-v2基准上实现了最佳表现,地面准确率提升23%。