arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-18 至 2026-03-18 共收录 44 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 44 篇

2601.09295 2026-03-18 cs.MA 89%

MACRO-LLM: LLM-Empowered Multi-Agent Collaborative Reasoning under Spatiotemporal Partial Observability

MACRO-LLM:基于时空部分可观测性的LLM赋能多智能体协作推理

Handi Chen, Running Zhao, Xiuzhe Wu, Edith C. H. Ngai

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出MACRO-LLM,通过三个模块解决多智能体在时空部分可观测性下的协作推理问题,验证了其在复杂任务中的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20078 2026-03-18 cs.MA cs.AI cs.LG 88%

Descent-Guided Policy Gradient for Scalable Cooperative Multi-Agent Learning

基于下降引导的策略梯度方法用于可扩展的协作多智能体学习

Shan Yang, Yang Liu

机构 * National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出Descent-Guided Policy Gradient方法,通过利用可微解析模型降低梯度方差,实现协作多智能体学习的可扩展性,验证了在200个智能体任务中收敛性能。

Comments 10 pages, 5 figures, 5 tables; plus 16 pages of appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16777 2026-03-18 cs.AI 88%

Anticipatory Planning for Multimodal AI Agents

多模态AI代理的前瞻性规划

Yongyuan Liang, Shijie Zhou, Yu Gu, Hao Tan, Gang Wu, Franck Dernoncourt, Jihyung Kil, Ryan A. Rossi, Ruiyi Zhang

机构 * University of Maryland, College Park(马里兰大学学院公园分校) The Ohio State University(俄亥俄州立大学) Adobe Research(Adobe研究) State University of New York at Buffalo(纽约州立大学布法罗分校)

专题命中 规划决策 :planning(title,abstract);AI agent(title);tool-use(abstract);分类 cs.AI

AI总结 本文提出TraceR1框架,通过前瞻性轨迹推理提升多模态代理的规划能力,实现更稳定的执行和泛化性能。

Comments Published at CVPR 2026 Findings Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15663 2026-03-18 cs.CV cs.AI 88%

OrthoAI v2: From Single-Agent Segmentation to Dual-Agent Treatment Planning for Clear Aligners

OrthoAI v2:从单智能体分割到双智能体治疗计划的清晰矫治器

Lansiaux Edouard, Leman Margaux

机构 * STaR-AI Research Group, Emergency Department, Lille University Hospital(STaR-AI研究组,急诊科,里尔大学医院)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);分类 cs.AI

AI总结 OrthoAI v2通过双智能体框架提升正畸治疗计划精度,实现牙科地标检测、复合生物力学评分模型和多帧治疗模拟,显著提升规划质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15255 2026-03-18 cs.AI cs.MA 86%

SAGE: Multi-Agent Self-Evolution for LLM Reasoning

SAGE:多智能体自进化用于大语言模型推理

Yulin Peng, Xinxin Zhu, Chenxing Wei, Nianbo Zeng, Leilei Wang, Ying Tiffany He, F. Richard Yu

机构 * College of Computer Science and Software Engineering, Shenzhen University, China(深圳大学计算机科学与软件工程学院,中国) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ), China(广东省人工智能与数字经济实验室(深圳)) School of Information Technology, Carleton University, Canada(卡尔顿大学信息科技学院,加拿大)

专题命中 规划决策 :agent(title);multi-agent(title);planning(abstract);分类 cs.AI

AI总结 SAGE通过四智能体协同进化提升LLM推理能力,利用小种子集实现稳定自训练,在数学和代码生成基准上取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09037 2026-03-18 cs.AI cs.CL 86%

A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems

大语言模型推理前沿的综述:推理扩展、学习推理与代理系统

Zixuan Ke, Fangkai Jiao, Yifei Ming, Xuan-Phi Nguyen, Austin Xu, Do Xuan Long, Minzhi Li, Chengwei Qin, Peifeng Wang, Silvio Savarese, Caiming Xiong, Shafiq Joty

机构 * Salesforce AI Research(Salesforce AI研究) National University of Singapore(国立新加坡大学) Nanyang Technological University(南洋理工大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) A*STAR, Singapore(新加坡A*STAR)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文综述了大语言模型推理的前沿方法,从推理阶段和架构两个维度分类,探讨了推理扩展到学习推理及代理系统的发展趋势,涵盖监督微调、强化学习等算法及代理工作流设计。

Comments 72 pages, 6 figures. Accepted to TMLR, with Survey Certification award

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15900 2026-03-18 cs.NI cs.AI 85%

The Internet of Physical AI Agents: Interoperability, Longevity, and the Cost of Getting It Wrong

物理AI代理的互联网:互操作性、持久性与搞错的成本

Roberto Morabito, Mallik Tatipamula

机构 * EURECOM Ericsson Silicon Valley(爱立信硅谷)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨物理AI代理的互联网发展,提出设计原则以构建可靠、可进化和可信的代理系统,强调互操作性、信任和进化作为首要需求,避免技术与经济成本。

Comments A related version of this work is currently under review for publication in an IEEE magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14730 2026-03-18 cs.LG 83%

GNNVerifier: Graph-based Verifier for LLM Task Planning

GNNVerifier:基于图的LLM任务规划验证器

Yu Hao, Qiuyu Wang, Cheng Yang, Yawen Li, Zhiqiang Zhang, Chuan Shi

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :planning(title,abstract);autonomous agent(abstract);分类 cs.LG

AI总结 本文提出基于图的验证器,通过构建任务计划的图结构,利用图神经网络评估计划的合理性,从而纠正LLM生成的计划中的错误。

Comments 17pages,12figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06993 2026-03-18 cs.AI cs.CV 83%

IMAIA: Interactive Maps AI Assistant for Travel Planning and Geo-Spatial Intelligence

IMAIA:交互式地图AI助手用于旅行规划和地理空间智能

Jieren Deng, Zhizhang Hu, Ziyan He, Aleksandar Cvetkovic, Pak Kiu Chung, Dragomir Yankov, Chiqun Zhang

机构 * Microsoft(微软) Amazon(亚马逊)

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 IMAIA通过自然语言交互整合矢量地图和卫星影像,结合地理空间信息提升地图相关问答和摄像头到地点的关联能力,实现空间感知的对话式地图系统。

Comments Accepted to The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23592 2026-03-18 cs.RO cs.AI cs.SE 81%

KEEP: A KV-Cache-Centric Memory Management System for Efficient Embodied Planning

KEEP: 一种面向高效具身规划的KV缓存中心化内存管理系统

Zebin Yang, Tong Xie, Baotong Lu, Shaoshan Liu, Bo Yu, Meng Li

机构 * Institute for Artificial Intelligence(人工智能研究院) School of Integrated Circuits, Peking University(集成电路学院,北京大学) Shenzhen Institute of Artificial Intelligence(深圳人工智能研究院) Microsoft Research(微软研究院) Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路先进创新中心)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出KEEP系统,通过静态动态内存构建算法、多跳内存重计算算法和层平衡内存加载,提升具身规划效率,实验表明在ALFRED数据集上速度提升2.68倍,优于CacheBlend方法。

Comments DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25140 2026-03-18 cs.AI cs.CL 81%

ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory

ReasoningBank: 通过推理记忆扩展智能体自我进化

Siru Ouyang, Jun Yan, I-Hung Hsu, Yanfei Chen, Ke Jiang, Zifeng Wang, Rujun Han, Long T. Le, Samira Daruki, Xiangru Tang, Vishy Tirumalashetty, George Lee, Mahsan Rofouei, Hangfei Lin, Jiawei Han, Chen-Yu Lee, Tomas Pfister

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google Cloud AI Research(谷歌云人工智能研究) Yale University(耶鲁大学) Google Cloud AI(谷歌云人工智能)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出ReasoningBank,通过整合智能体自我评估的成功与失败经验,提升其持续学习能力,并引入MaTTS加速学习过程,提升任务表现与效率。

Comments Accepted to ICLR 2026; Code: https://github.com/google-research/reasoning-bank

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15726 2026-03-18 cs.CL cs.AI cs.IR cs.LG 80%

MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification

MiroThinker-1.7 与 H1:通过验证实现重型研究代理

MiroMind Team, S. Bai, L. Bing, L. Lei, R. Li, X. Li, X. Lin, E. Min, L. Su, B. Wang, L. Wang, L. Wang, S. Wang, X. Wang, Y. Zhang, Z. Zhang, G. Chen, L. Chen, Z. Cheng, Y. Deng, Z. Huang, D. Ng, J. Ni, Q. Ren, X. Tang, B. L. Wang, H. Wang, N. Wang, C. Wei, Q. Wu, J. Xia, Y. Xiao, H. Xu, X. Xu, C. Xue, Z. Yang, Z. Yang, F. Ye, H. Ye, J. Yu, C. Zhang, W. Zhang, H. Zhao, P. Zhu

机构 * MiroMind Team(MiroMind团队)

专题命中 规划决策 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出MiroThinker-1.7和H1,通过结构化规划和验证机制提升多步推理能力,在复杂任务中实现高效可靠的研究代理。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15643 2026-03-18 cs.AI 79%

GSI Agent: Domain Knowledge Enhancement for Large Language Models in Green Stormwater Infrastructure

GSI代理:面向绿色雨水基础设施的大语言模型领域知识增强

Shaohuang Wang

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出GSI代理,通过监督微调、检索增强生成和代理推理流程,提升大语言模型在绿色雨水基础设施任务中的领域知识能力,实验表明其在领域任务中的表现显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16110 2026-03-18 cs.AI 79%

VIGIL: Towards Edge-Extended Agentic AI for Enterprise IT Support

VIGIL:迈向企业IT支持的边缘扩展代理AI

Sarthak Ahuja, Neda Kordjazi, Evren Yortucboylu, Vishaal Kapoor, Mariam Dundua, Yiming Li, Derek Ho, Vaibhavi Padala, Jennifer Whitted, Rebecca Steinert

机构 * Amazon Engine, AI Center of Excellence(亚马逊引擎,人工智能卓越中心)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 VIGIL通过在用户设备上部署桌面驻留代理,实现本地诊断、企业知识检索和政策驱动的修复,减少交互轮次,提升诊断速度,支持82%的自助解决,用户反馈显示透明度对信任至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15563 2026-03-18 cs.LG cs.AI 79%

The PokeAgent Challenge: Competitive and Long-Context Learning at Scale

PokeAgent挑战:在大规模中实现竞争性和长上下文学习

Seth Karten, Jake Grigsby, Tersoo Upaa, Junik Bae, Seonghun Hong, Hyunyoung Jeong, Jaeyoon Jung, Kun Kerdthaisong, Gyungbo Kim, Hyeokgi Kim, Yujin Kim, Eunju Kwon, Dongyu Liu, Patrick Mariglia, Sangyeon Park, Benedikt Schink, Xianwei Shi, Anthony Sistilli, Joseph Twin, Arian Urdu, Matin Urdu, Qiao Wang, Ling Wu, Wenli Zhang, Kunsheng Zhou, Stephanie Milani, Kiran Vodrahalli, Amy Zhang, Fei Fang, Yuke Zhu, Chi Jin

机构 * Princeton(普林斯顿大学) UT-Austin(得克萨斯大学奥斯汀分校) CMU(卡内基梅隆大学) NYU(纽约大学) Google DeepMind(谷歌DeepMind) Team Heatz(团队Heatz) Team PA-Agent(团队PA-Agent) Team FoulPlay(团队FoulPlay) Team 4thLesson(团队4thLesson) Team Q(团队Q) Team Anthonys(团队Anthonys) Team Hamburg(团队Hamburg) Team Porygon2AI(团队Porygon2AI) Team Deepest(团队Deepest) Team August(团队August)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 PokeAgent挑战通过两个互补赛道,解决部分可观测性、博弈推理和长周期规划问题,提供大规模基准测试和首个RPG速run评估框架,揭示通用(LLM)、专业(RL)和精英人类表现间的差距。

Comments 41 pages, 26 figures, 5 tables. NeurIPS 2025 Competition Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16510 2026-03-18 cs.CG 78%

Minimum Exposure Motion Planning

最小暴露运动规划

Sarita de Berg, Joachim Gudmundsson, Peter Kramer, Christian Rieck, Sampson Wong

专题命中 规划决策 :planning(title,abstract)

AI总结 本文研究了平面中单位正方形机器人协调运动规划问题的多种变体,提出新的Min-Exposure目标函数,并给出了计算暴露最小调度的算法。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16028 2026-03-18 cs.RO 78%

Geometry-Aligned LLM Fine-Tuning for Sequential Narrow-Opening Planning

几何对齐的LLM微调用于序列狭窄开口规划

Al Jaber Mahmud, Xuan Wang

机构 * George Mason University(乔治·马歇尔大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出几何对齐的LLM微调框架,通过多阶段狭窄开口序列规划实现长视距几何推理,采用失败驱动LoRA监督微调与GRPO优化提升路径可行性。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15777 2026-03-18 cs.HC 78%

Lessons from Real-World Deployment of a Cognition-Preserving Writing Tool: Students Actively Engage with Critical Thinking and Planning Affordances

从真实世界部署认知保留写作工具中的经验:学生主动参与批判性思维和规划 affordances

Yinuo Yang, Zheng Zhang, Ningzhi Tang, Xu Wang, Alex Ambrose, Nathaniel Myers, Patrick Clauss, Toby Jia-Jun Li

专题命中 规划决策 :planning(title,abstract)

AI总结 本文研究了AI写作工具VISAR在真实课堂中的应用,发现学生通过认知保留支架获得学习提升,且与写作质量、概念理解及批判性AI素养正相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16843 2026-03-18 cs.AI 77%

Internalizing Agency from Reflective Experience

从反思经验中内化代理性

Rui Ge, Yichao Fu, Yuyang Qian, Junda Su, Yiming Zhao, Peng Zhao, Hao Zhang

机构 * University of California San Diego(加州大学圣地亚哥分校) Nanjing University(南京大学)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出LEAFE框架,通过反思经验内化恢复代理性,提升长周期任务中的问题解决能力,实验显示在Pass@k任务中优于传统方法。

Comments 17 pages, 5 figures; Submitted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14440 2026-03-18 cs.AI cs.CL cs.LG 75%

VisTIRA: Closing the Image-Text Modality Gap in Visual Math Reasoning via Structured Tool Integration

VisTIRA: 通过结构化工具集成缩小图像-文本模态差距以提升视觉数学推理

Saeed Khaki, Ashudeep Singh, Nima Safaei, Kamal Ginotra

机构 * Microsoft AI(微软人工智能)

专题命中 规划决策 :agent(abstract);tool-use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 VisTIRA通过结构化工具集成框架,解决图像形式数学问题的推理难题,改进视觉数学推理能力,实验表明工具监督和OCR定位能有效缩小模态差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21676 2026-03-18 cs.RO cs.NI 75%

Real-World Deployment of Cloud-based Autonomous Mobility Systems for Outdoor and Indoor Environments

云原生自主移动系统在户外和室内环境中的实际部署

Yufeng Yang, Minghao Ning, Keqi Shu, Aladdin Saleh, Ehsan Hashemi, Amir Khajepour

机构 * Department of Mechanical and Mechatronics Engineering, University of Waterloo(滑铁卢大学机械与机电工程系) Technology Partnerships and Innovations, Rogers Communications, Canada Inc.(罗杰斯通讯加拿大有限公司技术伙伴关系与创新部) Mechanical Engineering Department, University of Alberta(阿尔伯塔大学机械工程系)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文提出云原生自主移动框架,通过基础设施智能传感与云计算协调提升自主操作能力,实验证明在城市环岛和医院类室内环境中的感知鲁棒性和安全性提升。

Comments This paper has been submitted to IEEE Robotics and Automation Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15946 2026-03-18 cs.AI 74%

Argumentative Human-AI Decision-Making: Toward AI Agents That Reason With Us, Not For Us

论证型人机决策:迈向与我们共思而非为我们决策的AI代理

Stylianos Loukas Vasileiou, Antonio Rago, Francesca Toni, William Yeoh

机构 * New Mexico State University(新墨西哥州立大学) King's College London(伦敦国王学院) Imperial College London(伦敦帝国学院) Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 规划决策 :AI agent(title);分类 cs.AI

AI总结 本文探讨论证型人机决策的新范式,结合论证框架挖掘、合成与推理,使AI代理能与人类进行辩证互动,提升高风险领域的人工智能可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03378 2026-03-18 cs.LG cs.AI 73%

AOI: Turning Failed Trajectories into Training Signals for Autonomous Cloud Diagnosis

AOI: 将失败轨迹转化为自主云诊断的训练信号

Pei Yang, Wanyi Chen, Asuka Yuxi Zheng, Xueqian Li, Xiang Li, Haoqin Tu, Jie Xiao, Yifan Pang, Dongdong Zhang, Fuqiang Li, Alfred Long, Lynn Ai, Eric Yang, Bill Shi

机构 * Gradient Soochow University(苏州大学) UC Santa Cruz Georgia Institute of Technology(佐治亚理工学院) University College London(伦敦大学学院) WeJoy ByteDance(字节跳动)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 AOI通过结构化轨迹学习框架,在安全约束下实现自动化操作,结合可训练诊断系统、读写分离执行架构和失败轨迹闭环演进器,提升云诊断性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16564 2026-03-18 cs.LG cs.CR 70%

A Scalable Approach to Solving Simulation-Based Network Security Games

一种可扩展的解决基于模拟的网络安全博弈的方法

Michael Lanier, Yevgeniy Vorobeychik

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 MetaDOAR通过引入轻量级元控制器和学习过滤层,实现了在大规模网络环境中高效多智能体强化学习,提升决策质量并减少计算冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09736 2026-03-18 cs.AI 70%

Analyzing Planner Design Trade-offs for MAPF under ADG-based Realistic Execution

基于ADG的MAPF规划器设计权衡分析

Jingtian Yan, Zhifei Li, William Kang, Stephen F. Smith, Jiaoyang Li

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文基于ADG模型探讨MAPF规划器设计中优化性与执行性能的关系,分析模型精度与路径最优性之间的权衡,揭示实际场景下的挑战与研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15725 2026-03-18 cs.MA cs.ET cs.LG cs.RO 70%

S2Act: Simple Spiking Actor

S2Act: 简单的脉冲行为者

Ugur Akcal, Seung Hyun Kim, Mikihisa Yuasa, Hamid Osooli, Jiarui Sun, Ribhav Sahu, Mattia Gazzola, Huy T. Tran, Girish Chowdhary

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 S2Act通过构建基于速率脉冲神经元的actor-critic模型,利用梯度训练并转换为物理参数,有效解决SNN中的梯度消失问题,提升多机器人任务的实时推理性能。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15015 2026-03-18 cs.MA 67%

MetaCrit: A Critical Thinking Framework for Self-Regulated LLM Reasoning

MetaCrit: 一种用于自主LLM推理的批判性思维框架

Xinmeng Hou, Ziting Chang, Zhouquan Lu, Chen Wenli, Liang Wan, Wei Feng, Hai Hu, Qing Guo

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出MetaCrit框架,通过多智能体机制提升LLM在多跳问题中的推理能力,增强逻辑严谨性并消除有毒输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16054 2026-03-18 cs.DC 67%

inference-fleet-sim: A Queueing-Theory-Grounded Fleet Capacity Planner for LLM Inference

inference-fleet-sim: 一个基于排队论的LLM推理舰队容量规划器

Huamin Chen, Xunzhuo Liu, Yuhan Liu, Junchen Jiang, Bowei He, Xue Liu

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出inference-fleet-sim,结合分析排队模型与离散事件模拟,解决LLM推理GPU舰队的容量规划问题,通过物理感知的GPU性能模型和多种拓扑结构,实现实验验证。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10349 2026-03-18 cs.CV 67%

EmoStory: Emotion-Aware Story Generation

EmoStory:情感感知的故事生成

Jingyuan Yang, Rucong Chen, Weibin Luo, Hui Huang

机构 * CSSE, Shenzhen University(安全科学与工程学院,深圳大学)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出EmoStory,一种情感感知的故事生成方法,通过两阶段框架整合基于代理的故事规划与区域感知生成,提升情感准确性、提示对齐和主体一致性。

Comments accepted to ICME

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06227 2026-03-18 cs.MA 67%

LOPT: Learning Optimal Pigovian Tax in Sequential Social Dilemmas

LOPT:在序列社会困境中学习最优庇克税

Yun Hua, Shang Gao, Wenhao Li, Haosheng Chen, Bo Jin, Xiangfeng Wang, Jun Luo, Hongyuan Zha

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出LOPT方法,通过引入额外智能体学习税收分配策略以解决多智能体强化学习中的社会困境,提升集体福利。

Comments 20 pages,13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏