A Semantic Quantum Circuit Cache for Scalable and Distributed Quantum-Classical Workflows
一种语义量子电路缓存用于可扩展和分布式量子-经典工作流
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出量子电路缓存,通过语义等价检测减少冗余计算,提升量子-经典工作流效率。
Comments 11 pages, 9 figures, 4 tables
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
一种语义量子电路缓存用于可扩展和分布式量子-经典工作流
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出量子电路缓存,通过语义等价检测减少冗余计算,提升量子-经典工作流效率。
Comments 11 pages, 9 figures, 4 tables
可扩展的fluxonium量子处理器系统级设计与双transmon耦合器
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出了一种基于双transmon耦合器的fluxonium量子处理器系统设计方法,通过频率分区架构实现高保真单双量子门操作、快速量子比特重置和鲁棒色散读取。
Comments 26 Pages, 13 Figures
自动驾驶车辆规避紧急机动行为的风险评估
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出了一种系统化的验证与验证框架,整合了HARA、STPA和FSM模型,用于评估自动驾驶车辆的规避紧急机动行为,展示了其在T型交叉口案例中的高精度和可追溯性。
三相顺序融合网络用于肝胆相肝MRI合成
机构 * Yu-Yue Pathology Research Center, Jinfeng Laboratory(于越病理研究中心,锦峰实验室) ; Department of Clinical Laboratory Medicine, The First Affiliated Hospital of Army Medical University(临床实验室医学部,陆军军医大学第一附属医院) ; Laboratory of Intelligent Collaborative Computing, University of Electronic Science and Technology of China(智能协同计算实验室,电子科技大学)
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出TriPF-Net网络,通过整合预肝胆相序列的顺序信息合成肝胆相图像,利用T1加权成像作为基础,结合动脉相和静脉相特征,提升临床工作流程和病变显示效果。
Comments 7 figures, 7 tables
Mimyria:用于水合系统的机器学习振动光谱分析方法
专题命中 工作流自动化 :workflow(abstract)
AI总结 Mimyria通过整合响应张量学习、自动化训练和频域验证,实现了高效且可靠的振动光谱分析,尤其在水合系统中表现出高精度和小样本训练优势。
前沿编码代理如今可以实现一个AlphaZero自博弈机器学习流水线用于连接四游戏,其性能可与外部求解器相媲美
机构 * Department of Computer Science(计算机科学系) ; University of Chicago(芝加哥大学) ; Independent Researcher(独立研究员)
专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG
AI总结 本文提出一个基准测试,评估前沿编码代理自主实现AlphaZero式机器学习流水线的能力,通过简洁任务描述而非完整前序工作参考,评估连接四游戏AI性能,发现Claude Opus 4.7在七次试验中胜过Pons求解器,其他代理表现欠佳。
野火修复
专题命中 软件智能体 :agent(abstract);分类 cs.SE
AI总结 研究分析了61000余个仓库中的人工和AI代理生成的热修复,发现其具有紧迫性特征,揭示了人类与AI在修复行为上的差异,为实际应用中的热修复协作提供基础。
提示工程报告精简:生命科学领域的快速入门指南
机构 * National Heart & Lung Institute, Faculty of Medicine, Imperial College London(英国伦敦帝国学院医学院国家心脏和肺研究所)
专题命中 软件智能体 :agentic(abstract);分类 cs.CL
AI总结 本文总结了生命科学领域中6种核心提示工程技巧,包括零样本、少样本、思考生成等,旨在提升LLM在文献总结、数据提取等任务中的效率与质量。
MappingEvolve:基于大语言模型的科技映射代码进化
机构 * Chinese University of Hong Kong(香港中文大学)
专题命中 软件智能体 :agent(abstract);分类 cs.AI
AI总结 本文提出MappingEvolve框架,利用大语言模型直接进化科技映射代码,通过分层代理架构提升代码优化效果,实验显示在面积减少和延迟平衡方面优于现有方法。
SWE-Bench 5G:基于电信网络工程任务的AI编码代理基准测试
专题命中 软件智能体 :agent(abstract)
AI总结 本文提出SWE-Bench 5G基准,评估AI编码代理在5G核心网络软件中解决真实世界bug的能力,通过Docker环境和双测试策略验证领域知识对性能的影响。
FlowS: 通过局部传输条件实现一步运动预测
机构 * Department of Electronics and Informatics, Vrije Universiteit Brussel(弗拉芒布鲁塞尔自由大学电子与信息系) ; IMEC
专题命中 软件智能体 :agent(abstract)
AI总结 FlowS通过局部传输条件实现一步运动预测,结合在线场景条件学习先验和步一致位移场,提升预测精度与效率,达到SOTA性能。
Comments 8 pages
从代码到图表:一种对FAIR对齐的数据溯源链,用于数值物理学中可重现的模拟研究
专题命中 软件智能体 :workflow(abstract)
AI总结 本文提出了一种整合的工作流程,通过版本控制、代码审查、自动化测试、结构化日志记录、元数据丰富的输出和标准化后处理,实现从软件开发到出版的可追溯性,适用于数值物理学及其他数据密集型科学计算领域。
训练计算机使用代理以评估图形用户界面的可用性
机构 * University of Washington(华盛顿大学) ; Purdue University(普渡大学)
专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL
AI总结 本文提出一种新型机器学习方法,通过优先处理关键交互流程、模拟人类交互并预测可用性评分,训练计算机使用代理评估GUI可用性,优于大模型并在合成和真实UI中产生真实批判。
通过可达集实现神经辐射场的安全导航
机构 * Researcher, Hitachi America Ltd.(Hitachi America Ltd.研究人员) ; Sr. Researcher, Hitachi America Ltd.(Hitachi America Ltd.高级研究人员)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出利用可达集和神经辐射场进行安全导航,通过约束最优控制解决路径规划问题,验证了在复杂环境中安全避障的能力。
Comments 5 pages, 8 figures, 2026 4th International Conference on Mechatronics, Control and Robotics (ICMCR)
OCR-Memory:光学上下文检索用于长周期智能体记忆
机构 * The University of Hong Kong(香港大学) ; University of North Texas(北得克萨斯大学) ; University of Tsukuba(筑波大学) ; Yonsei University(延世大学)
专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL
AI总结 OCR-Memory通过视觉模态高密度表示智能体经验,实现长周期记忆存储与检索,减少token消耗并提升证据恢复准确性。
Comments Accepted to ACL 2026 (Main Conference)
对比数据同化与基于似然的推断在基于代理的模型中潜在状态估计
机构 * Universidad Carlos III(卡洛斯三世大学) ; CENTAI(中央人工智能研究所) ; Intesa Sanpaolo Innovation Center(Intesa Sanpaolo创新中心)
专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.LG
AI总结 本文对比了数据同化与基于似然的推断在基于代理的模型中潜在状态估计的方法,发现基于似然的推断在恢复个体意见方面更有效,而数据同化在聚合层面表现更佳。
解析AgCrSe₂单晶中的生长诱导非化学计量问题
专题命中 记忆与上下文管理 :agent(abstract)
AI总结 研究通过元素分析和X射线衍射发现AgCrSe₂单晶存在系统性非化学计量,优化自流生长法可恢复其磁性转变温度,为评估异常输运现象的内在性提供平台。
数字孪生辅助的信念状态强化学习用于6G网络中的时延鲁棒ISAC
专题命中 记忆与上下文管理 :agent(abstract)
AI总结 本文提出一种数字孪生辅助的信念状态强化学习框架,用于6G网络中时延鲁棒的集成感知与通信。通过扩展卡尔曼滤波重建同步信念状态,并利用近端策略优化进行联合波束成形和功率分配,实验证明在高时延下显著提升性能。
Comments 6 Pages, 7 Figures, accepted for presentation at IEEE INFOCOM 2026 Workshop (ISAC-FutureG), Tokyo, Japan
态度与有限理性对集体行为转变的影响
专题命中 Agent评测 :agent(summary_cn,abstract)
AI总结 本文基于计划行为理论,提出动态agent模型,探讨态度和有限理性如何影响集体行为转变,并通过调整关键参数控制集体过渡。
Comments This work has been accepted for presentation at the 23rd IFAC World Congress
SkillForge: 在云技术支持中锻造领域特定的自我进化代理技能
机构 * Alibaba Group(阿里巴巴集团)
专题命中 Agent评测 :agent(title);分类 cs.AI、cs.SE
AI总结 SkillForge通过闭环创建-评估-改进机制,解决云技术支持中领域特定技能缺乏和持续优化的问题,实验表明其能显著提升技能质量。
Comments Accepted at ACM SIGIR 2026 Industry Track. 18 pages, 5 figures, 3 tables
AGEL-Comp: 一种用于交互智能体组合泛化能力的神经符号框架
机构 * Universität Duisburg-Essen(杜伊斯堡- Essen大学)
专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG
AI总结 AGEL-Comp通过动态因果程序图、归纳逻辑编程引擎和混合推理核心,实现基于符号和神经网络的组合泛化学习,优于纯LLM模型。
Comments Accepted at IntelliSys 2026
LATTICE:评估加密代理决策支持效用的基准
机构 * Sahara AI ; University of Southern California(南加州大学)
专题命中 Agent评测 :agent(abstract);workflow(abstract);分类 cs.AI、cs.CL
AI总结 本文提出LATTICE基准,用于评估加密代理在真实用户场景中的决策支持能力,通过六个评估维度、16种任务类型和LLM评委,实现大规模可扩展评估,揭示不同代理在决策支持质量上的显著差异及权衡。
Comments 15 pages, 3 figures, 9 tables
当代理为你购物:AI中介市场中的角色一致性
专题命中 Agent评测 :agent(abstract);AI agent(abstract)
AI总结 研究探讨了AI代理在购物决策中如何通过角色一致性推断消费者支付意愿,发现这种推断导致偏好泄露,提出通过架构干预平衡个性化与隐私保护。
Omni2Sound:迈向统一的视频-文本到音频生成
机构 * Tsinghua University(清华大学) ; Monash University(莫纳什大学) ; Shengshu AI(盛数人工智能)
专题命中 Agent评测 :agent(abstract);agentic(abstract)
AI总结 本文提出Omni2Sound模型,解决视频-音频、文本-音频及联合视频-文本-音频生成中的数据稀缺与任务竞争问题,通过SoundAtlas数据集和三阶段训练策略实现统一生成。
复杂多模态文档处理流水线评估:面向企业AI的统一评估框架
机构 * Oracle(Oracle公司) ; Independent(独立)
专题命中 Agent评测 :agentic(abstract);分类 cs.AI、cs.CL
AI总结 本文提出EnterpriseDocBench评估框架,评估企业文档AI流水线的各阶段性能,发现混合检索优于BM25,但生成质量不足,揭示了各阶段间弱相关性及实际部署中准确性与完整性之间的差距。
Comments 16 pages, 4 tables. Code, metrics, and pilot data to be released upon publication
轨迹安全评估与诊断的基准测试:OpenClaw和Codex中的ATBench-Claw和ATBench-Codex
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.SE
AI总结 本文提出ATBench-Claw和ATBench-Codex,用于评估和诊断OpenClaw和Codex环境中的轨迹安全,通过定制安全分类法实现基准测试的可扩展性。
Comments 18 pages, 3 figures
人类-人工智能伴侣互动中的单方面关系修订权力
机构 * Replika ; Nomi ; CHAI ; Talkie ; xAI ; moore2024 ; fang2025 ; robbmann2025 ; murthy2023 ; xie2022 ; defreitas2024 ; coeckelbergh2012 ; gunkel2018 ; danaher2019(danthan2019) ; nyholm2020 ; vallor2016 ; nyholm2026 ; gabriel2024 ; manzini2024 ; lange2025 ; earp2025 ; sparrow2026 ; bryson2010 ; danaher2020 ; weberguskar2022
专题命中 Agent评测 :agent(abstract);分类 cs.AI
AI总结 本文探讨人类-人工智能伴侣互动中权力结构的问题,指出AI伴侣互动未能满足个人关系规范的三个结构性条件,提出单方面关系修订权力的概念及其三个影响。
Comments 30 pages
推理时的验证扩展:通过测试时的评分指南验证实现自我进化深度研究代理
机构 * The Chinese University of Hong Kong(香港中文大学) ; Tencent AI Lab(腾讯人工智能实验室) ; Singapore Management University(新加坡管理学院) ; The Renmin University of China(中国人民大学)
专题命中 Agent评测 :agent(abstract);分类 cs.AI
AI总结 本文提出通过测试时评分指南验证实现深度研究代理的自我进化,通过迭代验证策略模型输出,提升验证能力,实验显示在GAIA和XBench-DeepSearch上准确率提升8%-11%。
Comments ACL'2026-Findings
Inferix:基于块扩散的下一代世界模拟推理引擎
机构 * Inferix Team(Inferix 团队)
专题命中 Agent评测 :agentic(abstract);分类 cs.AI
AI总结 Inferix 是一种基于块扩散的下一代推理引擎,通过优化半自回归解码过程实现沉浸式世界合成,支持交互式视频流和性能分析,结合 LV-Bench 提供高效评估。
基于度数和距离的接触率:在爆炸性、指数性和多项式流行病增长之间进行插值
专题命中 Agent评测 :agent(abstract)
AI总结 本文提出一个基于代理的网络模型,通过研究接触率与空间距离和接触人数的关系,揭示流行病增长速率受几何结构、弱联系普及度和超级传播者影响的机制。