Predictive capabilities of the integrated modeling TRANSP code for tokamak plasmas
整合建模TRANSP代码对托卡马克等离子体的预测能力
专题命中 软件智能体 :workflow(abstract)
AI总结 本文探讨TRANSP代码在预测托卡马克等离子体中的能力,重点介绍PT_SOLVER模块和高保真T3D/GX框架的开发,用于基于高保真gyrokinetic模型的湍流输运预测。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
整合建模TRANSP代码对托卡马克等离子体的预测能力
专题命中 软件智能体 :workflow(abstract)
AI总结 本文探讨TRANSP代码在预测托卡马克等离子体中的能力,重点介绍PT_SOLVER模块和高保真T3D/GX框架的开发,用于基于高保真gyrokinetic模型的湍流输运预测。
基于语音AI的可扩展与个性化口头评估
专题命中 软件智能体 :agent(abstract)
AI总结 本文提出利用语音AI进行个性化口头评估,通过Viva系统实现高效评估,降低成本,并发现需分解模块、约束行为、保持随机化、多模型评分等改进方法。
Comments 34 pages, 6 figures, 9 tables. Author's version of a paper published in Communications of the ACM
Journal ref Communications of the ACM (2026)
TANDE:在与年轻人的情感人工智能-虚拟化身对话中区分言语和非言语反馈渠道
专题命中 软件智能体 :agent(abstract)
AI总结 研究在与年轻人的情感人工智能-虚拟化身对话中反馈渠道模式的影响,引入TANDE这个由LLM驱动的ECA,通过实验探讨其对融洽关系、同理心和参与度的作用及性别差异,得出相关设计启示。
Comments This paper has been accepted for publication at the 28th ACM International Conference on Multimodal Interaction (ICMI 2026)
混合视觉与文本代码
专题命中 软件智能体 :workflow(abstract)
AI总结 本文提出Hybrid ClojureScript,一种混合编程语言,允许开发者结合视觉和文本语法表达领域特定概念,同时保持静态推理和工作流程流畅。
Comments to be published in JFP
公平稳定资源共享的动态访问定价控制
专题命中 软件智能体 :autonomous agent(abstract)
AI总结 研究不同价格敏感度用户在动态定价下的共存问题,提出基于非单调价格函数的新动态定价方案,该方案能让各类用户更公平共存,通过研究非线性常微分方程刻画平衡点及吸引域,数值模拟验证了方案有效性。
Comments 41 pages, 7 figures
C-BerryTrans:用于贝里曲率驱动反常霍尔和能斯特电导率第一性原理计算的C++代码
专题命中 软件智能体 :workflow(abstract)
AI总结 研究利用C++代码C-BerryTrans进行贝里曲率驱动的反常霍尔和能斯特电导率第一性原理计算,通过提取数据、评估曲率并并行化处理,在多种铁磁材料上测试,结果与报告数据相符,为相关研究提供有力工具。
Comments arXiv admin note: substantial text overlap with arXiv:2504.00123, arXiv:2505.19280
代码语义缩放
专题命中 软件智能体 :agent(abstract)
AI总结 提出基于伪代码的CodeZoom方法,通过多层语义抽象迭代探索、理解和优化代码,在用户研究中相比Claude Code显著提升代码理解与控制感。
骨骼的新视角:X射线和超声中的鲁棒姿态估计
机构 * Medical Informatics, University of Lübeck(吕贝克大学医学信息学系) ; Institut of Radiology and Nuclear Medicine, University Hospital Schleswig-Holstein(石勒苏益格-荷尔斯泰因大学医院放射学与核医学研究所) ; Paediatric Surgery, University Hospital Schleswig-Holstein(石勒苏益格-荷尔斯泰因大学医院小儿外科) ; EchoScout GmbH
专题命中 软件智能体 :planning(abstract)
AI总结 提出基于学习的关键点候选和鲁棒线模型(RANSAC、霍夫变换)的自动骨骼姿态估计方法,在儿科骨折和髋关节发育不良评估中达到临床可接受的误差并优于地标方法。
Comments Accepted at MIUA 2026 (oral presentation); Code and annotations for fracture angle assessment in radiographs: https://github.com/multimodallearning/RobustBonePoseEstimation
OmniRobotHome:一个多摄像头平台用于实时多对多人机交互
机构 * Seoul National University(首尔国立大学) ; RLWRLD
专题命中 软件智能体 :agent(abstract)
AI总结 OmniRobotHome通过多摄像头和双Franka机械臂实现多对多人机协作的实时3D感知与协同动作,解决了近距离交互中的遮挡和状态变化问题,为多对多协作实验提供了可行平台。
Comments Project Page: https://junc0ng.github.io/omnirobothome
数值相对论代码AMSS-NCKU的用户友好型Python接口
专题命中 软件智能体 :workflow(abstract)
AI总结 为数值相对论代码AMSS-NCKU开发用户友好的Python接口,实现模拟初始化、执行和输出数据可视化的自动化,降低技术门槛,并通过双黑洞和三黑洞并合示例验证其有效性。
Comments 14 pages, 4 figures, 1 appendix. V2: minor revisions; V3: formulas used to exact gravitational waves were added; V4: modifying some background discussions and figures; V5: published version
Journal ref Astronomy and Computing 55 (2026) 101093
当小问题重要时:基于相似性观点动力学中的对称性、多元性与极化
专题命中 软件智能体 :agent(abstract)
AI总结 通过随机主体模型研究议题权重异质性对观点演化的影响,发现极小权重议题可破坏稳定态,增加收敛时间,并基于对称性分类揭示极化与议题重要性分布的关系。
Comments The supplement is provided as a pdf
GCD: 乱码、修正、证明——修复并验证Go语言的扩展GCD实现
专题命中 软件智能体 :AI agent(abstract)
AI总结 本文修复了Go标准库中extendedGCD实现的两个偏差,并使用Gobra和Lean进行了形式化验证,证明了正确性和终止性,同时发现AI代理可辅助验证过程。
工具使用作为行动:迈向移动核心网络中的智能体控制
专题命中 GUI与网页智能体 :agentic(title,abstract);tool use(title);agent(abstract);AI agent(abstract)
AI总结 本文提出基于智能体AI的移动核心网络工具接口设计与原型,利用MCP和A2A协议实现意图驱动任务,并分析端到端延迟。
Comments Accepted for presentation at IEEE PIMRC 2026
ARC:将大型多模态需求文档编译为可运行软件系统
专题命中 GUI与网页智能体 :agentic(title,summary_cn);workflow(abstract);分类 cs.SE
AI总结 提出Agentic需求编译(ARC)技术,通过双向测试驱动智能体循环,将多模态DSL文档直接编译为可运行Web系统,在GUI测试通过率上平均提升50.6%。
Comments This work is accepted at issta'26 (SIGSOFT International Symposium on Software Testing and Analysis)
基于移动具身AI网络的数字孪生同步
专题命中 GUI与网页智能体 :agentic(title,abstract);agent(abstract);workflow(abstract);multi-agent(abstract)
AI总结 本文提出基于移动具身AI网络的数字孪生同步框架,通过五阶段闭环工作流和分层优化算法,实现高保真同步并降低偏差。
下一代验证码:利用认知差距实现可扩展且多样化的GUI智能体防御
机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) ; MetaAgentX ; University College London(伦敦大学学院)
专题命中 GUI与网页智能体 :agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出Next-Gen CAPTCHAs框架,通过利用人机在交互感知、记忆、决策和行动上的认知差距,设计动态任务以区分生物用户与AI智能体,实现可扩展的防御。
Comments Project page at https://greenoso.github.io/NextGen-CAPTCHAs_webpage/
代理奖励建模:通过在线主动交互验证GUI代理
机构 * MAIS, Institute of Automation, Chinese Academy of Sciences ; School of Artificial Intelligence, University of Chinese Academy of Sciences ; School of Computer Science \& Technology, Beijing Jiaotong University
专题命中 GUI与网页智能体 :agent(title,abstract);agentic(title)
AI总结 VAGEN通过引入代理交互验证范式,解决GUI代理评估中的视觉限制问题,提升评估准确性与性能。
Comments 25 pages, 12 figures
AgentGUI:用于观测与调控长期运行AI智能体的界面
机构 * ETH Zürich(苏黎世联邦理工学院)
专题命中 GUI与网页智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI、cs.CL
AI总结 针对AI智能体观测与调控的界面缺失问题,研究人员推出AgentGUI,通过轨迹可视化、手动自动调控等功能提升智能体任务处理效率,成果已开源。
Vision2Web: 一个用于视觉网站开发的分层基准,包含代理验证
机构 * Tsinghua University(清华大学)
专题命中 GUI与网页智能体 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.SE
AI总结 本文提出Vision2Web基准,用于评估视觉网站开发能力,包含193个任务和16类,通过GUI代理验证器和基于VLM的裁判器评估多个视觉语言模型,揭示了在全栈开发中现有模型的性能差距。
MUZZLE: 针对间接提示注入攻击的自适应智能体红队测试框架
机构 * Northeastern University(东北大学) ; Mozilla Corporation(Mozilla公司)
专题命中 GUI与网页智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 提出MUZZLE框架,利用智能体轨迹自动识别高显著性注入面,自适应生成上下文相关的恶意指令,评估网络智能体对间接提示注入攻击的安全性,发现44种新攻击和跨应用攻击策略。
OpenForgeRL:在任何环境中训练原生利用工具的智能体
机构 * Columbia University(哥伦比亚大学) ; Dartmouth College(达特茅斯学院) ; Microsoft Research(微软研究院)
专题命中 GUI与网页智能体 :agent(abstract);AI agent(abstract);tool use(abstract);agentic(abstract)
AI总结 研究针对现代AI智能体依赖复杂推理工具难端到端训练的问题,提出OpenForgeRL框架,通过轻量级代理和Kubernetes编排器,在多环境下对基于工具的智能体端到端训练,验证了框架效果并分析了工具选择和RL对智能体行为的影响。
Comments added github link
PhoneWorld: 扩展手机使用代理环境
机构 * Tencent Hunyuan(腾讯文英) ; The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院( Gallagher 学院))
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出PhoneWorld,一个可复用的管道,将真实GUI轨迹和截图转化为可控的手机使用环境、可执行任务、自动验证器和训练回滚,从而规模化构建手机代理环境。
Comments work in progress
面向质量多样性的Web智能体模仿的推测性回滚修正
机构 * Beihang University(北京航空航天大学) ; Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ; The Hong Kong University of Science and Technology(香港科技大学) ; Northwestern Polytechnical University(西北工业大学) ; Tsinghua University(清华大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) ; Peking University(北京大学)
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI、cs.LG
AI总结 提出推测性回滚修正(SRC)框架,通过固定视野分支审查和回滚机制,在减少教师查询的同时保持轨迹多样性,在WebArena-Infinity上收集了977条通过验证的轨迹和9183个下一步动作示例。
基于大语言模型和链式推理的智能AI框架用于无人机辅助物流调度与移动边缘计算
机构 * Nanyang Technological University(南洋理工大学) ; Singapore Institute of Technology(新加坡理工学院) ; Seatrium New Energy Laboratory(Seatrium 新能源实验室) ; Ministry of Education (MOE) Tier 1(教育部 Tier 1) ; Research Innovation and Enterprise (RIE) 2025 Industry Alignment Fund-Industry Collaboration Projects (IAF-ICP)(研究创新与企业 (RIE) 2025 行业对齐基金-行业合作项目 (IAF-ICP))
专题命中 GUI与网页智能体 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 本文提出结合大语言模型和链式推理的智能AI框架,用于解决无人机辅助物流调度中的混合调度问题,通过分层深度强化学习实现无人机路由和任务执行优化,提升物流效率与任务完成率。
Comments 37 pages
InfiniteWeb: 面向GUI智能体训练的可扩展Web环境合成
机构 * Peking University(北京大学) ; Nanjing University(南京大学) ; Microsoft Research Asia(微软亚洲研究院)
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI、cs.CL
AI总结 提出InfiniteWeb系统,通过统一规范、任务驱动测试和多样化种子设计自动生成功能完备的Web环境,解决GUI智能体训练数据稀缺问题,在OSWorld和Online-Mind2Web上取得显著性能提升。
Comments Accepted to ACL 2026 Main
MAESTRO:在具有GUI的对话代理中通过用户偏好适应GUI并引导导航
专题命中 GUI与网页智能体 :workflow(abstract,abstract_cn);agent(abstract);agentic(abstract)
AI总结 MAESTRO通过提取用户偏好并指导工作流导航,提升对话代理中GUI的适应性和导航效率,通过实验验证其有效性。
Comments 19 pages, 6 figures, 2 tables. Published at UIST '26. This is the camera-ready version, posted under CC BY 4.0
Journal ref Proceedings of the 39th Annual ACM Symposium on User Interface Software and Technology (UIST '26), November 2-5, 2026, Detroit, MI, USA
SEE:用于长视野GUI代理轨迹合成的结构感知探索与利用
机构 * Harbin Institute of Technology, Weihai(哈尔滨工业大学(威海)) ; Harbin Institute of Technology (Weihai) Qingdao Research Institute(哈尔滨工业大学(威海)青岛研究院)
专题命中 GUI与网页智能体 :agent(title);planning(abstract);分类 cs.LG
AI总结 针对GUI代理轨迹合成中缺乏高覆盖率长视野轨迹的问题,提出SEE两阶段数据合成框架,通过高效探索和基于图的合成,产生可重复可解释数据,避免虚假循环,提升代理任务成功率和泛化能力,还将发布代码和数据集。
Comments Accepted (Oral) by ACM International Conference on Multimedia 2026 (ACM MM 2026)
截图还是工具?在混合GUI-MCP计算机使用智能体中引出工具使用并管理多模态上下文
专题命中 GUI与网页智能体 :tool use(title);agent(abstract);分类 cs.AI
AI总结 该研究针对混合GUI-MCP计算机使用智能体,发现工具使用存在采用缺口,通过调整工具奖励与上下文压缩优化,提升了智能体性能并降低输入成本。
交互式奖励智能体:通过环境状态验证进行图形用户界面任务评估
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI
AI总结 研究图形用户界面任务评估难题,提出交互式奖励智能体IRA,基于提议验证框架,结合可见界面与环境状态证据。IRA在GUI-RewardBench基准测试中准确率达86.9%,应用于强化学习时实现34.0%的OSWorld成功率,能为训练图形用户界面智能体提供有效奖励信号。
理解计算机使用代理的用户体验:构建代理用户体验原型的设计空间与机会
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Apple(苹果公司)
专题命中 GUI与网页智能体 :agent(title,abstract);分类 cs.AI
AI总结 研究计算机使用代理的用户体验,开发其设计考量分类法,经需求引出研究确定原型设计所需活动与能力,创建AgentUXlab,通过用户研究得出代理用户体验原型设计工具的见解与启示。