Science Done on a Machine by a Machine: AI Agents in Computational Chemistry
机器完成的科学:计算化学中的AI智能体
专题命中 其他Agent :AI agent(title);agentic(abstract);分类 cs.AI
AI总结 该文综述了截至2026年8月计算化学AI智能体的发展现状,指出其正从辅助任务向自主科研迈进,通用智能体或取代专用系统,引发领域未来走向的困惑。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
机器完成的科学:计算化学中的AI智能体
专题命中 其他Agent :AI agent(title);agentic(abstract);分类 cs.AI
AI总结 该文综述了截至2026年8月计算化学AI智能体的发展现状,指出其正从辅助任务向自主科研迈进,通用智能体或取代专用系统,引发领域未来走向的困惑。
MMD-Flagger:利用最大均值差异检测幻觉
机构 * Université Côte d’Azur, CNRS, LJAD, France(法国埃克塞特大学、法国国家科学研究中心、LJAD研究所) ; Center for Artificial Intelligence and Data Science (CAIDAS)(人工智能与数据科学中心) ; Julius-Maximilans-Universität Würzburg, Germany(德国维尔茨堡约利乌斯-马克斯米利安大学)
专题命中 其他Agent :autonomous agent(abstract);agentic(abstract);分类 cs.CL
AI总结 针对智能体AI系统中大型语言模型的幻觉问题,提出基于最大均值差异(MMD)的MMD-Flagger方法,通过监控不同解码温度下的输出轨迹检测幻觉,在MUCH基准上用Llama-3、Gemma-3模型完成评估。
事后辩论评判理论
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文提出适用于智能体辩论场景的事后辩论评判理论,探究两种评判方法的属性满足情况,发现辩论语义是辩论驱动型AI原则性评判者的理想候选。
TrojanGYM:一种检测器在环的大语言模型用于自适应RTL硬件木马插入
机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) ; NYU Abu Dhabi(纽约大学阿布扎克分校)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 提出TrojanGYM框架,利用大语言模型智能体自动生成多样化的硬件木马,暴露基于GNN的检测器盲点,并设计鲁棒检测器Robust-GNN4TJ,在生成的基准上将检测率从0%提升至60%。
REST3D: 从单张图像重建物理稳定的3D场景
机构 * Carnegie Mellon University(卡内基梅隆大学)
专题命中 其他Agent :agentic(abstract)
AI总结 提出REST3D框架,通过物理场景理解与物理约束优化,从单张RGB图像重建物理稳定的3D场景,显著减少物理错误并提升仿真稳定性。
Comments SIGGRAPH Asia 2026, Project page: this https URL (https://shirleymaxx.github.io/REST3D/)