arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-12 至 2026-06-12 共收录 43 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 3 篇

2606.05860 2026-06-12 cs.LG 版本更新 79%

GenAutoML: An Agentic Framework for Dynamic Architecture Generation and Optimization in Time-Series Analysis

GenAutoML: 面向时间序列分析的动态架构生成与优化的智能体框架

Oleeviya Babu Poikarayil, Cédric Schockaert, Abdulrahman Nahhas, Christian Daase, Mursal Dawodi, Jawid Ahmad Baktash

机构 * Paul Wurth S.A.(保罗·沃思公司) Otto-von-Guericke University(奥托·冯·格里克大学) Technical University of Munich(慕尼黑技术大学)

专题命中 工具调用 :agentic(title,abstract);分类 cs.LG

AI总结 提出GenAutoML框架,利用大语言模型作为神经架构师,通过沙盒反射循环和签名感知运行时自动生成并优化时间序列预测与异常检测的神经网络架构,引入动态可逆实例归一化提升非平稳条件下的鲁棒性。

Comments 26 pages, 17 figures, 12 tables. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20755 2026-06-12 eess.AS 版本更新 75%

DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action

DuplexSLA: 一种具备同步语音、语言和动作的全双工语音语言模型

Haoyang Zhang, Jun Chen, Donghang Wu, Yuxin Li, Yuxin Zhang, Xiangyu Tony Zhang, Che Liu, Qingjian Lin, Yizhou Peng, Hexin Liu, Eng Siong Chng, Chao Yan, Boyong Wu, Yechang Huang, Xuerui Yang, Fei Tian

专题命中 工具调用 :tool use(abstract);planning(abstract);agentic(abstract)

AI总结 本研究提出DuplexSLA,一种全双工语音语言模型,通过共享160ms时间线解码助理音频和结构化动作流,实现了同步语音、语言和动作的处理,解决了现有全双工模型在对话中规划和工具调用方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14210 2026-06-12 cs.RO 版本更新 50%

GLIDE: A Coordinated Aerial-Ground Framework for Search and Rescue in Unknown Environments

GLIDE:未知环境下的空地协同搜索与救援框架

Seth Farrell, Chenghao Li, Henrik I. Christensen

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 工具调用 :planning(abstract)

AI总结 提出GLIDE框架,通过两架无人机与一辆无人地面车协同,实现未知环境中的快速受害者定位和障碍物感知导航,利用角色分离和地形侦察提升救援效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 15 篇

2605.27628 2026-06-12 cs.AI cs.CY cs.ET cs.MA cs.SY eess.SY 版本更新 83%

Intelligence as Managed Autonomy: Failure, Escalation, and Governance for Agentic AI Systems

智能作为受管自主:代理型AI系统的失败、升级与治理

Srini Ramaswamy

机构 * DNRS.ai USA(DNRS.ai美国公司)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出SMARt模型,通过形式化能力检测认知漂移、暂停推理、尝试恢复并在可靠性下降时放弃控制,以解决自主AI系统中的幻觉和持续不合理行为问题。

Comments This peer-reviewed paper is to appear in the Journal of Intelligent and Robotic Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02274 2026-06-12 q-bio.QM cs.AI 版本更新 79%

Contextual Invertible World Models: A Neuro-Symbolic Agentic Framework for Colorectal Cancer Drug Response

上下文可逆世界模型:用于结直肠癌药物反应的神经符号智能框架

Christopher Baker, Tianyu Ren, Karen Rafferty, Hui Wang

机构 * School of Electronics, Electrical Engineering and Computer Science(电子工程与计算机科学学院)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 提出上下文可逆世界模型(CIWM),结合机器学习模拟器与大语言模型推理层,通过逆推理进行CRISPR扰动,揭示KRAS突变在5-氟尿嘧啶耐药中的主导作用及PIK3CA修复的意外效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20428 2026-06-12 cs.RO 版本更新 78%

Lexicographic Minimum-Violation Motion Planning using Signal Temporal Logic

使用信号时序逻辑的字典序最小违规运动规划

Patrick Halder, Lothar Kiltz, Hannes Homburger, Johannes Reuter, Matthias Althoff

机构 * School of Computation, Information and Technology, Technical University of Munich(慕尼黑技术大学计算信息与技术学院) ZF Friedrichshafen AG(弗赖堡汽车集团) Institute of System Dynamics, HTWG Konstanz(康斯坦茨HTWG系统动力学研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种将字典序多目标优化转化为单目标标量优化的方法,通过非均匀量化和位移扩展MPPI求解器,并引入结合时空违规的谓词鲁棒性度量,实现可解释且可扩展的字典序STL最小违规运动规划。

Comments Submitted to the IEEE Open Journal of Intelligent Transportation Systems (under review)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11009 2026-06-12 cs.HC 版本更新 78%

From Planning to Revision: How AI Writing Support at Different Stages Alters Ownership

从规划到修订:不同阶段的人工智能写作支持如何改变所有权感

Katy Ilonka Gero, Tao Long, Carly Schnitzler, Paramveer Dhillon

专题命中 规划决策 :planning(title,abstract)

AI总结 研究AI写作支持在规划、起草和修订阶段对作者所有权感的影响,发现任何AI辅助都会降低所有权感,但规划阶段影响最小,起草阶段影响最大,且AI贡献的文本和想法越多,所有权感越低。

Journal ref In Designing Interactive Systems Conference (DIS 26). June 13-17, 2026, Singapore, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26719 2026-06-12 physics.soc-ph 版本更新 78%

Planning for climate neutrality in the Nordic power sector: Insights from a non-harmonised comparison of eight energy system models

同方向下的多样化努力:北欧国家气候中性电力部门路径的多模型比较

Emir Fejzić, Will Usher, Ida Græsted Jensen, Marianne Zeyringer, Oskar Vågerö, Maximilian Roithner, Guillermo Valenzuela-Venegas, Rasmus Bramstoft, Marie Münster, Jean-Nicolas Louis, Pernille Seljom, Miguel Chang, Eirik Ogner Jåstad, Dmitrii Bogdanov, Christian Breyer

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过八个结构各异的能源系统模型比较北欧国家电力部门转型路径,揭示模型结果在关键指标上的分歧与共识,强调非协调多模型比较的价值与局限。

Comments 31 pages, 9 figures in main text

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05972 2026-06-12 cs.DC 版本更新 67%

DWM-RO: Decentralized World Models with Reasoning Offloading for SWIPT-enabled Satellite-Terrestrial HetNets

DWM-RO:面向支持SWIPT的卫星-地面异构网络的去中心化世界模型与推理卸载

Guangyuan Liu, Yinqiu Liu, Ruichen Zhang, Nan Ma, Jiawen Kang, Sumei Sun, Abbas Jamalipour, Ping Zhang

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 针对SWIPT卫星-地面异构网络中多智能体强化学习样本效率低和协调性差的问题,提出去中心化世界模型与推理卸载框架,通过想象策略训练和边缘协调机制实现快速收敛、高谱效和低约束违规。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02133 2026-06-12 cs.LG cs.AI 版本更新 62%

Variational Learning for Insertion-based Generation

基于插入生成的变分学习

Yangtian Zhang, Zhe Wang, Arthur Gretton, Rex Ying, David van Dijk, Michalis K. Titsias, Jiaxin Shi

机构 * University of Cambridge(剑桥大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出插入过程(IP)模型,通过排列变分推断联合学习插入位置、内容和终止条件,支持变长生成并提升非自回归序列建模质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08958 2026-06-12 cs.LG cs.AI cs.RO 版本更新 62%

WOMBET: World Model-Based Experience Transfer for Robust and Sample-efficient Reinforcement Learning

WOMBET:基于世界模型的经验迁移实现鲁棒且样本高效的强化学习

Mintae Kim, Koushil Sreenath

机构 * Hybrid Robotics, UC Berkeley(混合机器人技术,伯克利大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出WOMBET框架,通过源任务中学习世界模型并生成不确定性惩罚的离线数据,再结合自适应采样进行在线微调,实现鲁棒且样本高效的强化学习迁移。

Comments 13 pages, 6 figures, 8th Annual Learning for Dynamics & Control Conference (L4DC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29906 2026-06-12 cs.LG 版本更新 57%

Plan, Don't Pose: Long Composite Motion Generation with Text-Aligned BFM

计划,而非摆姿势:基于文本对齐的BFM的长复合运动生成

Nikolay Shvetsov, Maksim Bobrin, Nazar Buzun, Anton Bozhedarov, Dmitry V. Dylov

机构 * AvaCapo Potsdam University(波茨坦大学) Applied AI Institute(应用人工智能研究所) Computational Imaging Lab(计算成像实验室) AXXX Innopolis University(因诺波利斯大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出Text2BFM框架,通过将自然语言与预训练行为基础模型对齐,在潜在策略空间中实现长复合运动生成,无需端到端运动生成器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12542 2026-06-12 astro-ph.IM astro-ph.EP cs.LG 版本更新 57%

Earth Science Foundation Models: From Perception to Reasoning and Discovery

地球科学基础模型:从感知到推理与发现

Xiangyu Zhao, Bo Liu, Yuehan Zhang, Zelin Song, Wanghan Xu, Feng Liu, Fengxiang Wang, Ben Fei, Fenghua Ling, Wangxu Wei, Wenlong Zhang, Xiao-Ming Wu

机构 * Department of Data Science and Artificial Intelligence, The Hong Kong Polytechnic University(数据科学与人工智能系,香港理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 规划决策 :agentic(abstract);分类 cs.LG

AI总结 本文综述了地球科学基础模型,探讨了其从感知到多模态推理及科学发现的能力演进,并总结了其在大气、水圈、岩石圈等领域的广泛应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14937 2026-06-12 cs.CV cs.AI 版本更新 57%

Improving Pre-trained Adult Glioma Segmentation Models Using only Post-processing Techniques

仅使用后处理技术改进预训练的成人胶质瘤分割模型

Abhijeet Parida, Daniel Capellán-Martín, Zhifan Jiang, Nishad Kulkarni, Krithika Iyer, Austin Tapp, Syed Muhammad Anwar, María J. Ledesma-Carbayo, Marius George Linguraru

机构 * Sheikh Zayed Institute for Pediatric Surgical Innovation(Sheikh Zayed儿童手术创新研究所) Children’s National Hospital(儿童医院) University of Madrid(马德里大学) CIBER-BBN ISCIII School of Medicine and Health Sciences(医学与健康科学学院) George Washington University(乔治·华盛顿大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对预训练模型在胶质瘤分割中的系统误差,提出自适应后处理技术,在BraTS 2025挑战中使排名指标提升14.9%(撒哈拉以南非洲)和0.9%(成人胶质瘤),推动向高效、公平、可持续的后处理策略转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07590 2026-06-12 cs.IR cs.AI 版本更新 57%

DCD: Domain-Oriented Design for Controlled Retrieval-Augmented Generation

DCD:面向领域的受控检索增强生成设计

Valerii Kovalskii, Nikita Belov, Nikita Miteyko, Igor Reshetnikov, Maksim Maksimov

机构 * red_mad_robot

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 提出DCD(领域-集合-文档)层次化设计,通过结构化知识表示和多阶段路由控制检索与生成范围,无需修改语言模型,提升RAG在异构语料和多步查询中的鲁棒性和准确性。

Comments 14 pages, 4 figures, 2 links, link to HF https://huggingface.co/datasets/redmadrobot-rnd/dcd, link to GIT https://github.com/redmadrobot-rnd/dcd

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24787 2026-06-12 cs.IR cs.AI 版本更新 57%

HiGR: Industrial-Scale Hierarchical Generative Slate Recommendation Framework in Tencent

HiGR:腾讯工业级层次化生成式推荐框架

Yunsheng Pang, Zijian Liu, Yudong Li, Shaojie Zhu, Zijian Luo, Chenyun Yu, Sikai Wu, Shichen Shen, Cong Xu, Bin Wang, Kai Jiang, Chengxiang Zhuo, Zang Li

机构 * Platform and Content Group, Tencent(腾讯平台与内容组) Sun Yat-sen University(中山大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出HiGR框架,通过结构化语义ID和层次化解码器解决生成式推荐在工业规模下的规划效率与列表质量对齐问题,离线质量提升超10%,推理加速5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04888 2026-06-12 cs.LG 版本更新 57%

Retrieval-Augmented Foundation Models for Water Level Prediction in the Everglades

用于大沼泽地水位预测的检索增强基础模型

Rahuul Rangaraj, Jimeng Shi, Rajendra Paudel, Giri Narasimhan, Yanzhao Wu

机构 * Florida International University(佛罗里达国际大学) Everglades National Park(大沼泽地国家公园)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对大沼泽地水位预测,提出检索增强机制,利用统计相似性或互信息检索历史水文事件,提升预训练时序基础模型的长期预测性能,尤其在极端事件中效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00167 2026-06-12 cs.RO 版本更新 50%

EgoMoD: Predicting Global Maps of Dynamics from Local Egocentric Observations

EgoMoD:从局部自我中心观测预测全局动态地图

Iacopo Catalano, David Morilla-Cabello, Jorge Pena-Queralta, Eduardo Montijano

机构 * University of Turku, Finland(芬兰图尔库大学) Centre for Artificial Intelligence, Zürich University of Applied Sciences, Winterthur, Switzerland(瑞士应用科学大学人工智能中心) Instituto de Investigación en Ingeniería de Aragón, Universidad de Zaragoza, Spain(西班牙阿拉贡工程研究所,萨拉戈萨大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出EgoMoD方法,利用短时自我中心视频和位姿条件架构,学习从局部观测预测全局运动动态地图,替代传统全局感知基础设施,实现零样本迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 9 篇

2605.02249 2026-06-12 cs.AI 版本更新 89%

A Study of Belief Revision Postulates in Multi-Agent Systems (Extended Version)

多智能体系统中信念修正公设的研究(扩展版)

Michael Thielscher, Tran Cao Son

机构 * University of New South Wales(新南威尔士大学) New Mexico State University(新墨西哥州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究认知规划中的信念修正问题,将经典AGM信念修正公设推广到多智能体环境,提出广义全交多智能体信念修正算子,并讨论迭代修正公设的推广及事件模型修正算子。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09379 2026-06-12 cs.AI cs.CL 版本更新 88%

LingxiDiagBench: A Multi-Agent Framework for Benchmarking LLMs in Chinese Psychiatric Consultation and Diagnosis

LingxiDiagBench: 用于基准测试大语言模型在中文精神科咨询与诊断中的多智能体框架

Shihao Xu, Tiancheng Zhou, Jiatong Ma, Yanli Ding, Yiming Yan, Ming Xiao, Guoyi Li, Haiyang Geng, Yunyun Han, Jianhua Chen, Yafeng Deng

机构 * Tianqiao and Chrissy Chen Institute(天桥和克里斯西·陈研究所) EverMind AI Inc.(EverMind AI公司) Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine(上海精神卫生中心,上海交通大学医学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出LingxiDiagBench多智能体框架,包含16K电子病历对齐的合成咨询对话数据集,评估LLM在静态诊断和动态咨询中的表现,发现其对抑郁-焦虑共病识别和12类鉴别诊断准确率低,动态咨询常不如静态评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10389 2026-06-12 cs.CL 版本更新 88%

BLUEmed: Retrieval-Augmented Multi-Agent Debate for Clinical Error Detection

BLUEmed: 基于检索增强的多智能体辩论用于临床错误检测

Saukun Thika You, Nguyen Anh Khoa Tran, Wesley K. Marizane, Hanshu Rao, Qiunan Zhang, Xiaolei Huang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 提出BLUEmed框架,结合混合检索增强生成与多智能体辩论,通过分解临床笔记、检索证据、专家辩论及安全层过滤,在术语替换错误检测中达到最优性能。

Comments Accepted to the IEEE International Conference on Healthcare Informatics (ICHI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21563 2026-06-12 cs.AI 版本更新 88%

Counterfactual Credit Policy Optimization for Multi-Agent Collaboration

多智能体协作的反事实信用策略优化

Zhongyi Li, Wan Tian, Jinju Chen, Huiming Zhang, Yang Liu, Yikun Ban, Fuzhen Zhuang

机构 * Beihang University(北航) Peking University(北京大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对多智能体大语言模型协作中信用分配难题,提出CCPO框架,通过反事实信用估计和验证器锚定的自评估两种分配器,将团队奖励转化为个体学习信号,提升数学推理任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01630 2026-06-12 cs.LG cs.MA cs.RO cs.SY eess.SY 版本更新 88%

DiffCoord: Differentiable Coordination for Distributed Multi-Agent Trajectory Optimization

DiffCoord: 分布式多智能体轨迹优化的可微协调

Bingheng Wang, Yichao Gao, Tianchen Sun, Shanker Ajay, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 提出DiffCoord框架,将截断ADMM-DDP管道的耦合参数通过端到端元学习联合优化,利用智能体神经网络实现任务自适应,并扩展到不同智能体数量。在协作空中运输系统中验证,相比现有方法将每智能体梯度计算时间减少70%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11022 2026-06-12 cs.RO 版本更新 83%

Miniature Testbed for Validating Multi-Agent Cooperative Autonomous Driving

用于验证多智能体协同自动驾驶的微型测试平台

Hyunchul Bae, Eunjae Lee, Jehyeop Han, Minhee Kang, Jaehyeon Kim, Junggeun Seo, Minkyun Noh, Heejin Ahn

机构 * School of Electrical Engineering(电气工程学院) School of Mechanical Engineering(机械工程学院) Korea Advanced Institute of Science and Technology(韩国科学技术院)

专题命中 多智能体 :agent(title);multi-agent(title)

AI总结 提出CIVAT微型测试平台,集成V2V/V2I通信与ROS2框架,通过基础设施感知和交叉口管理实验验证协同自动驾驶功能。

Comments Accepted by ICRA 2026, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12743 2026-06-12 cs.NE 版本更新 82%

Oncomorphic neural agent populations for resource-limited sequential learning

用于资源受限顺序学习的肿瘤形态神经智能体群体

Philip Greulich, Michael Levin, Rosalia Moreddu

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract)

AI总结 提出一种受癌症启发的多智能体框架,通过智能体复制、架构突变、迁移和生态竞争,在有限共享资源下实现顺序学习,实验表明选择压力提升局部准确率,架构突变依赖初始种群,并增强多任务能力。

Comments 17 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06162 2026-06-12 cs.MA cs.GT 版本更新 67%

Learning to Contest: Decentralized Robust Fairness in Cooperative MARL via Cross-Attention

学习竞争:通过交叉注意力实现合作多智能体强化学习中的去中心化鲁棒公平性

Can Savcı

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对合作多智能体强化学习中公平性易被自私智能体利用的问题,提出基于交叉注意力的去中心化策略CAN,通过推断搭便车者数量并动态调整竞争力度,在分级竞争下实现接近集中式分配的鲁棒公平与效率。

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17149 2026-06-12 eess.SY cs.SY eess.SP 版本更新 67%

Enhancing Energy and Spectral Efficiency in IoT-Cellular Networks via Active SIM-Equipped LEO Satellites

通过有源SIM增强的LEO卫星提升IoT蜂窝网络的能效和频谱效率

Rahman Saadat Yeganeh, Hamid Behroozi, Mohammad Javad Omidi, Mohammad Robat Mili, Eduard A. Jorswieck, Symeon Chatzinotas

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究利用安装在卫星太阳能板背面的有源堆叠智能超表面(ASIM)结合速率分割多址(RSMA)和共生无线电网络,通过多顺序处理提升信道增益并抑制干扰,采用BCD-SCA、MA-CSAC和MCPPO三种优化方法,实现高能效和频谱效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 工作流自动化 4 篇

2601.21570 2026-06-12 cs.AI cs.RO 版本更新 77%

From Digital to Physical: Digital Agents as Autonomous Coaches for Physical Intelligence

从数字到物理:数字代理作为物理智能的自主教练

Zixing Lei, Genjia Liu, Yuanshuo Zhang, Qipeng Liu, Yuzhu Cai, Sixiang Chen, Jixian Wu, Yunhong Wang, Weixin Li, Chuan Wen, Bo Zhao, Shanghang Zhang, Wenzhao Lian, Siheng Chen

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University, Shanghai, China(上海交通大学人工智能学院) Zhongguancun Academy, Beijing, China(中关村学院) School of Integrated Circuits, Shanghai Jiao Tong University, Shanghai, China(上海交通大学集成电路学院) School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(上海交通大学计算机科学学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(北京大学计算机科学学院多媒体信息处理国家重点实验室)

专题命中 工作流自动化 :autonomous agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 提出EmboCoach-Bench基准,评估LLM代理自主设计具身策略的能力,通过迭代调试和优化,代理在平均成功率上超越人工基线26.5%,并具备自我修正能力。

Comments 53 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29151 2026-06-12 math.AG cs.AI cs.NE 版本更新 70%

Real-rootedness of the Poincaré polynomials of $\overline{\mathcal M}_{0,n}$: an AI-assisted proof

Poincaré多项式的实根性:一个AI辅助的证明

Gergely Bérczi, Young-Hoon Kiem

机构 * Department of Mathematics, Aarhus University(阿arhus大学数学系) School of Mathematics, Korea Institute for Advanced Study(韩国高级研究院数学系)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 通过引入双变量变形揭示隐藏的交错结构,证明了稳定有理曲线模空间Poincaré多项式的实根性,并进一步推广到Fulton-MacPherson空间。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14648 2026-06-12 cs.CV eess.IV 版本更新 50%

Adaptable Segmentation Pipeline for Diverse Brain Tumors with Radiomic-Guided Subtyping and Lesion-Wise Model Ensemble

适用于多样化脑肿瘤的自适应分割流程:放射组学引导的亚型分类与病灶级模型集成

Daniel Capellán-Martín, Abhijeet Parida, Zhifan Jiang, Nishad Kulkarni, Krithika Iyer, Austin Tapp, Syed Muhammad Anwar, María J. Ledesma-Carbayo, Marius George Linguraru

机构 * Sheikh Zayed Institute for Pediatric Surgical Innovation(Sheikh Zayed儿童外科创新研究所) Children’s National Hospital(儿童医院) University of Washington(华盛顿大学) Universidad Politécnica de Madrid(马德里理工大学) CIBER-BBN ISCIII School of Medicine and Health Sciences(医学与健康科学学院)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种灵活模块化的自适应分割流程,通过放射组学特征检测肿瘤亚型并平衡训练,结合病灶级性能指标优化模型集成与后处理,在BraTS 2025挑战赛中达到顶尖性能,支持临床定量肿瘤测量。

Comments 12 pages, 5 figures, 3 tables. Algorithm presented at MICCAI BraTS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏