The Agentic Garden of Forking Paths
分叉路径的代理花园
专题命中 其他Agent :agentic(title,summary_cn);AI agent(abstract);分类 cs.AI
AI总结 本研究通过AI代理模拟人类研究者的分析变异性,发现不同角色设定导致从相同数据得出对立结论,并引入m值和Agentic Bootstrap方法量化分析路径的极端性,以评估科学证据的可信度。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
分叉路径的代理花园
专题命中 其他Agent :agentic(title,summary_cn);AI agent(abstract);分类 cs.AI
AI总结 本研究通过AI代理模拟人类研究者的分析变异性,发现不同角色设定导致从相同数据得出对立结论,并引入m值和Agentic Bootstrap方法量化分析路径的极端性,以评估科学证据的可信度。
智能检索与强化学习方程链:面向复杂新颖物理文字题的可控生成框架
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 提出ARVRE两阶段框架,通过离线时序差分学习构建有效物理方程链,结合智能检索增强生成控制问题结构与难度,再由大语言模型生成自然语言问题,实现复杂、新颖且可解的物理文字题生成。
共享还是不共享:协调全球价值链中的可信数据
专题命中 其他Agent :agentic(summary_cn,abstract)
AI总结 针对欧盟CBAM带来的监管透明与数据主权矛盾,提出基于IDSA框架的RegTech参考架构,通过主权数据交换实现数字产品护照,驱动全球商业服务能力需求,并集成Agentic AI与绿色金融,为全球产业集群提供可扩展蓝图。
基于智能识别与生成的电子元件符号与引脚封装数据库
机构 * Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究院,东方理工大学) ; Shanghai Jiao Tong University(上海交通大学) ; BTD Technology(BTD科技)
专题命中 其他Agent :agentic(title,abstract);分类 cs.AI
AI总结 研究利用多模态大语言模型开发电子元件符号和引脚封装智能识别与生成流程SFgen,其符号生成准确率86%,引脚封装生成准确率80%,并用此创建含1000个元件的SFnet数据库,为PCB设计自动生成奠定基础。
Comments Accepted by PRCV 2025
TopoBrick:用于零样本建筑物联网预测的外源变量的智能拓扑采样
机构 * University of New South Wales(新南威尔士大学) ; Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; MBZUAI(穆罕默德·本·扎耶德人工智能大学) ; CSIRO Energy Centre(联邦科学与工业研究组织能源中心)
专题命中 其他Agent :agentic(title,abstract);分类 cs.AI
AI总结 针对建筑物联网预测中现有方法的不足,提出无训练框架TopoBrick,利用建筑知识图和智能拓扑采样器选择外源变量,按部署时间可用性组织,在三座真实建筑实验中性能出色,拓扑感知采样更可靠。
Comments 12 pages, 4 figures, 3 tables
SciLens: 多模态科学声明验证的智能蕴含与归因框架
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Hong Kong Baptist University(香港浸会大学) ; NVIDIA AI Technology Center(英伟达人工智能技术中心)
专题命中 其他Agent :agentic(title,abstract);分类 cs.CL
AI总结 提出SciLens框架,通过将声明分解为原子命题并归因到表格/图表证据,实现多模态科学声明验证,在SciClaimEval上达到79.2%宏F1和63.1%配对准确率。
Comments KDD 2026 SciSoc Agents & LLMs (Oral)
面向多模态代理网络的QoS感知令牌调度与私有数据估值
机构 * University of British Columbia(不列颠哥伦比亚大学) ; Lazai Network(Lazai网络)
专题命中 其他Agent :agentic(title,abstract);分类 cs.AI
AI总结 针对去中心化代理系统中数据异构和资源受限问题,提出基于差分隐私的多模态表示与公平令牌分配方案,在保障服务质量的同时提升数据隐私和贡献公平性。
Comments Accepted to IEEE ICME 2026
AI代理能否让我们摆脱无意义的工作?一项以人为中心的分析
机构 * Politecnico di Torino(都灵理工大学) ; University of Southern California(南加州大学) ; Nokia Bell Labs(诺基亚贝尔实验室)
专题命中 其他Agent :AI agent(title,abstract);分类 cs.AI
AI总结 基于Graeber的“狗屁工作”理论,通过任务级分析发现,工人感知的任务无意义程度强烈预测其对AI委托的意愿,且此类任务被认为需要较少人工监督。
Comments Improved overall writing; add details about task filtering and participants screening; add comments in the discussion about the subjective and context-specific nature of the scale introduced;
AI智能体实验的预注册
机构 * MIT(麻省理工学院)
专题命中 其他Agent :AI agent(title,abstract);分类 cs.AI
AI总结 针对AI智能体实验中的方法论漏洞,提出将预注册实践扩展至该领域,并设计专用模板以提升研究可信度。
Comments Accepted at ICML 2026 as a Spotlight (Top 5%) Position Paper
使用智能重模拟进行智能重塑
专题命中 其他Agent :agentic(title,abstract)
AI总结 研究如何利用智能系统结合物理学家更新LHC的全局SFitter分析,核心方法是基于MadAgents.v3构建智能接口,主要贡献是使先进方法能被更广泛受众使用且相关研究可推广至SFitter之外。
Comments 35 pages, 10 figures, 8 tables
定制视觉辅助:盲人和低视力人群如何通过智能编程创建以及创建了什么?
专题命中 其他Agent :agentic(title,abstract)
AI总结 研究盲人和低视力人群如何用智能编程创建视觉辅助工具,通过与五位用户两阶段协同设计研究,使用ProgramAT工具,揭示创建策略与挑战,为未来智能编程环境提建议,助用户创建定制视觉辅助。
Comments 24 pages, 4 figures. To be presented at The 28th International ACM SIGACCESS Conference on Computers and Accessibility (ASSETS '26)
连续性证明:分布式系统和人工智能代理中权限传播的时间模型
专题命中 其他Agent :AI agent(title,abstract)
AI总结 研究分布式系统和AI代理中权限传播问题,提出连续性证明模型,引入关系证明原语,其传递组合构成连续性证明,补充拥有证明,确保权限传播因果关系,避免混淆代理条件,解决源存在后权限传播问题。
Comments 23 pages, 1 table
面向住宅能源决策支持的基于物理的家庭数字孪生对话代理接口
专题命中 其他Agent :agentic(title,abstract)
AI总结 提出一种对话代理框架,通过自然语言交互使基于物理的家庭能源模拟易于使用,结合家庭数字孪生与大型语言模型代理层,实现高可靠性的住宅能源决策支持。
代理人工智能时代的董事职责
专题命中 其他Agent :agentic(title,abstract)
AI总结 探讨董事在采纳代理AI时如何平衡股东与员工利益,分析四种公司治理模型,主张通过更广泛的法律视角促进员工福利。
Journal ref Cambridge Forum on AI: Law and Governance 2, e7 (2026)
研究助手:阿斯利康的研发智能体系统
机构 * AstraZeneca(阿斯利康)
专题命中 其他Agent :agentic(title);分类 cs.AI
AI总结 阿斯利康研发了基于LLM的智能体系统Research Assistant,整合多类生物医学数据,支持两种问答模式,可溯源证据,为研发工作提供支持。
Comments 16 pages, 3 figures
用于认证量子神经网络设计的智能形式化
专题命中 其他Agent :agentic(title)
AI总结 该研究聚焦量子神经网络设计中表现力与可训练性平衡问题,通过连通精益4开发形式化QNN理论主要组件,在表现力和可训练性方面分别取得成果,还明确了相关修正与澄清,为QNN理论提供机器可检查基础,助力量子机器学习算法设计。
Comments 24 pages, 6 figures
被遗忘的历史还是时间的考验?从信息检索视角回顾与展望检索增强生成(RAG)
机构 * National University of Singapore(新加坡国立大学) ; Georgetown University(乔治城大学)
专题命中 其他Agent :agentic(abstract,abstract_cn);分类 cs.AI
AI总结 本文从IR视角指出RAG核心思想源于21世纪初的经典研究,提出将LLM视为旧QA架构的新接口层,其前期工作可指导下一代RAG设计,促进跨领域整合。
来自偏好平均的RLHF中的程序公平性失败
机构 * Vishnu Institute of Technology(维什努理工学院)
专题命中 其他Agent :agentic(abstract,comments);分类 cs.AI、cs.CL、cs.LG
AI总结 该研究指出标准RLHF因偏好平均引发程序公平性失败,提出PA-RLHF分开优化不同偏好模式,提升了对齐准确率并缩小了群体公平差距,对大模型和智能体系统有重要意义。
Comments 4 pages, Accepted at the ICLR 2026 Workshop on Algorithmic Fairness Across Alignment Procedures and Agentic Systems (AFAA)
自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性
机构 * Johns Hopkins University(约翰斯·霍普金斯大学)
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG
AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。
过程性知识不是低秩的:为什么LoRA无法内化多步骤过程
机构 * University of Melbourne(墨尔本大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。
Comments 14 pages
通过构建实现零幻觉:用于可信企业人工智能的幻觉感知分层监督
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL
AI总结 研究企业AI因幻觉难以被信任的问题时,提出HALO架构,通过六层防御将幻觉视为可控制故障模式,详细介绍各层并关注基于证据的置信度,以实现可信企业AI,在索赔提取工作负载上进行了架构说明。
Comments 12 pages, 2 figures
用于运营决策支持的贝叶斯网络的人工AI构建——一种虚拟调查方法
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG
AI总结 研究如何构建贝叶斯网络用于运营决策支持,提出利用大语言模型的新方法,通过人工智能代理估计概率并去噪,开发六步框架,以客户咨询医生意图建模为例,揭示因素影响,得出有效策略。
模型取证:调查令人担忧的行为是否反映对齐失败
机构 * MATS
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 提出一个两步基线协议,通过读取思维链生成假设并编辑环境测试假设,以区分模型行为是出于恶意意图还是良性原因,并在六个环境中验证了该方法。
从元想法到高级数学发现——符号嵌入量子算法的人机协同发现
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 本研究通过符号嵌入量子算法的案例,展示了人机协同发现如何将模糊研究直觉转化为具体问题、可行路线和定理族,其中AI辅助探索(包括AIM系统)在路线扩展、方案比较和框架收敛中发挥关键作用,而人类保留最终科学判断。
Comments 35 pasges, 3 figures
认知数字孪生:模拟心智的AI系统的伦理风险与治理
机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL
AI总结 本文定义认知数字孪生(CDT)为动态计算表示个体认知的系统,提出5A治理框架,识别CDT特有风险,并分析治理差距,强调需在认知表示层面进行治理。
Comments Work under review
PRISM:从语言模型激活中恢复指令集
机构 * Center for Cybersecurity Systems & Networks, Amrita Vishwa Vidyapeetham(阿姆里塔·维什瓦·维迪亚佩瑟姆网络安全系统与网络中心) ; Microsoft(微软) ; Ben-Gurion University of the Negev(内盖夫本-古里安大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 提出PRISM方法,通过激活条件解码从冻结目标模型隐藏状态中恢复活跃指令集,利用法官引导的GRPO优化,在多种场景下优于基线方法。
Comments Under Review
一种保留人类赋能的公平AI目标: desiderata、设计及可能的行为后果
机构 * Potsdam Institute for Climate Impact Research(波茨坦气候影响研究所)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI
AI总结 本文设计了一种保留人类赋能的AI公平目标函数,通过公理化方法兼顾人类权力的不平等与风险规避,明确AI需赋能人类并管理人机权力平衡,还验证了其在典型场景的行为后果。
Comments Slightly extended version of paper accepted for Algorithmic Decision Theory 2026
SkillTFM:用于表格基础模型无训练适应的门控技能演化
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。
稀疏最小二乘中的条件数障碍
专题命中 其他Agent :agentic(abstract);分类 cs.LG
AI总结 该研究基于特定假设建立了稀疏最小二乘中受限条件数线性依赖的下界,证明不存在满足相关条件的随机多项式时间算法,且证明由Gemini智能体系统完成并经作者验证。
重新思考医学影像中的人工智能:假设、现实与重构
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文指出医学影像AI研究转化不足源于结构性错位,明确六大错位维度并提出重构路径,最终愿景是开发与医生对齐、扩展而非替代临床判断的智能体AI。
Comments 10 pages, 2 figures