arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-19 至 2026-03-19 共收录 142 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 48 篇

2603.17169 2026-03-19 cs.AI cs.CL 73%

How Clued up are LLMs? Evaluating Multi-Step Deductive Reasoning in a Text-Based Game Environment

LLMs有多好?在文本基于的游戏环境中评估多步骤演绎推理

Rebecca Ansell, Autumn Toney-Wails

机构 * Georgetown University(乔治城大学) Syntheos, Corp(Syntheos公司) UNU-Merit

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文通过文本多智能体版经典棋盘游戏Clue评估LLM的多步骤演绎推理能力,发现即使在结构化逻辑谜题微调后,推理一致性仍难以维持,且推理精度未显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16448 2026-03-19 cs.AI 70%

TRUST-SQL: Tool-Integrated Multi-Turn Reinforcement Learning for Text-to-SQL over Unknown Schemas

TRUST-SQL:基于工具的多轮强化学习用于未知模式下的文本到SQL

Ai Jian, Xiaoyun Zhang, Wanrou Du, Jingqing Ruan, Jiangbo Pei, Weipeng Zhang, Ke Zeng, Xunliang Cai

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Meituan(美团)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出TRUST-SQL,通过工具集成的多轮强化学习解决文本到SQL在未知模式下的问题,通过结构化四阶段协议和Dual-Track GRPO策略提升性能,实验表明在多个基准上取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10063 2026-03-19 cs.AI 70%

Chain of Mindset: Reasoning with Adaptive Cognitive Modes

思维链:具有适应性认知模式的推理

Tianyi Jiang, Arctanx An, Hengyi Feng, Naixin Zhai, Haodong Li, Xiaomin Yu, Jiahui Liu, Hanwen Du, Shuo Zhang, Zhi Yang, Jie Huang, Youhua Li, Yongxin Ni, Huacan Wang, Ronghao Chen

机构 * PKU(北京大学) BJTU(北京理工大学) StepFun SUFE(上海财经大学) NUS(新加坡国立大学) CityUHK(香港城市大学) QuantaAlpha(量子阿尔法)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出Chain of Mindset框架,通过动态选择不同认知模式提升推理效率,实验显示在多个基准测试中表现优异,准确率超越基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17339 2026-03-19 cs.DL 67%

citecheck: An MCP Server for Automated Bibliographic Verification and Repair in Scholarly Manuscripts

citecheck: 一种MCP服务器,用于学术手稿中的自动文献验证与修复

Junhyeok Lee

专题命中 规划决策 :planning(abstract);agentic(abstract)

AI总结 citecheck通过自动化验证和修复学术手稿中的文献错误,包括识别错误、元数据不完整、作者归属错误及预印本与发表版本不一致等问题,提供结构化修复建议和安全诊断。

Comments 6 pages, 1 figure. Software paper on bibliography verification and repair for scholarly manuscripts; includes MCP server implementation and evaluation on repository-backed tests

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20095 2026-03-19 cs.CV 67%

WPT: World-to-Policy Transfer via Online World Model Distillation

WPT: 通过在线世界模型蒸馏实现世界到策略的迁移

Guangfeng Jiang, Yueru Luo, Jun Liu, Yi Huang, Yiyao Zhu, Zhan Qu, Dave Zhenyu Chen, Bingbing Liu, Xu Yan

机构 * University of Science and Technology of China(科学技术大学) CUHK-SZ(香港中文大学(深圳)) HKUST(香港理工大学) Huawei Foundation Model Department(华为基金会模型部)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出WPT方法,通过在线世界模型蒸馏实现策略迁移,提升规划性能并保持实时部署能力,实验表明其在开放环和闭合环基准上表现优异。

Comments CVPR2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17544 2026-03-19 cs.AI cs.LG 62%

Per-Domain Generalizing Policies: On Learning Efficient and Robust Q-Value Functions (Extended Version with Technical Appendix)

领域特定泛化策略:关于学习高效且鲁棒的Q值函数(含技术附录的扩展版本)

Nicola J. Müller, Moritz Oster, Isabel Valera, Jörg Hoffmann, Timo P. Gros

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过学习Q值函数来实现领域特定泛化策略,相比传统状态值函数方法,Q值函数在多个领域中表现更优,且在规划器LAMA-first上具有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16969 2026-03-19 cs.CR cs.AI cs.LG 62%

DeepStage: Learning Autonomous Defense Policies Against Multi-Stage APT Campaigns

DeepStage: 通过多阶段APT攻击学习自主防御策略

Trung V. Phan, Tri Gia Nguyen, Thomas Bauschert

机构 * Department of Information Assurance, FPT University(信息保障系,FPT大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DeepStage框架,利用深度强化学习对抗多阶段APT攻击,通过融合主机溯源和网络 telemetry 构建统一溯源图,结合StageFinder进行攻击阶段估计,采用分层PPO算法实现自适应防御,实验显示其在真实企业环境中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16901 2026-03-19 cs.LG cs.AI 62%

From Language to Action in Arabic: Reliable Structured Tool Calling via Data-Centric Fine-Tuning

从阿拉伯语到行动:通过数据驱动的微调实现可靠的结构化工具调用

Omer Nacar, Deema Alquffari, Saleh Alsharideh, Adeem AlOtaibi, Abdulaziz Alabdulkarim, Leen Alhazmi, Nada Alomar, Wareef Alzubaidi, Nada Alsultan, Ahmed Alrabghi, Demah Alhoshan, Rana Alsayyari, Hamed Alruwaili, Albaraa Jaafar, Khaled Alusmani, Abdulaziz Alsohimy, Munirah Alsubaie, Shahd Aldukhayil, Arwa Alali, Yazeed BinShihah, Razan Alsulaymi, Nourah Alhumaid, Razan Abdulsalam, Reem Alamoudi, Mohammed Alkhalifa

机构 * Tuwaiq Academy(图瓦伊克学院) Tahakom(塔哈科姆) Wakeb Company(沃克公司) Qatmeer Co.(卡提迈尔公司) NCGR Vision Bank(视觉银行)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AISA-AR-FunctionCall框架,通过数据审计、模式修复和提示重构等方法,显著提升阿拉伯语函数调用模型的稳定性与准确性,减少解析失败率并提高功能名称识别精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17948 2026-03-19 cs.CV cs.AI 57%

VideoAtlas: Navigating Long-Form Video in Logarithmic Compute

VideoAtlas: 在对数计算中导航长视频

Mohamed Eltahir, Ali Habibullah, Yazan Alshoibi, Lama Ayash, Tanveer Hussain, Naeemullah Khan

机构 * King Abdullah University of Science and Technology (KAUST)(卡斯特大学) Department of Computer Science, King Khalid University (KKU)(国王 Khalid 大学计算机科学系) Department of Computer Science, Edge Hill University(Edge Hill 大学计算机科学系)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 VideoAtlas通过层次化网格结构实现长视频的无损表示,解决视频表示和长上下文问题,提出Video-RLM架构,展示对数计算增长、环境预算和自适应计算分配等贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17947 2026-03-19 cs.LG q-bio.NC 57%

Unified Policy Value Decomposition for Rapid Adaptation

统一的策略价值分解用于快速适应

Cristiano Capone, Luca Falorsi, Andrea Ciardiello, Luca Manneschi

机构 * Computational Neuroscience Unit, Istituto Superiore di Sanità(国家卫生研究院计算神经科学单位) School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出一种统一的策略价值分解框架,通过共享低维系数向量实现快速任务适应。该方法结合了结构化价值基础和兼容策略基础,利用乘法门控机制在无需重新训练的情况下适应新任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17333 2026-03-19 cs.CL 57%

Grid Spatial Understanding: A Dataset for Textual Spatial Reasoning over Grids, Embodied Settings, and Coordinate Structures

网格空间理解:一个用于文本空间推理、具身场景和坐标结构的数据集

Risham Sidhu, Julia Hockenmaier

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 本文提出GSU数据集,用于评估LLM在导航、物体定位和结构组合任务中的空间推理能力,发现模型在具身代理参考框架和坐标列表识别上存在困难,且微调小模型可能达到前沿模型性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17208 2026-03-19 cs.CL cs.PL 57%

SYMDIREC: A Neuro-Symbolic Divide-Retrieve-Conquer Framework for Enhanced RTL Synthesis and Summarization

SYMDIREC:一种用于增强RTL综合与摘要的神经符号分割-检索-解决框架

Prashanth Vijayaraghavan, Apoorva Nitsure, Luyao Shi, Charles Mackin, Ashutosh Jadhav, David Beymer, Ehsan Degan, Vandana Mukherjee

机构 * IBM Research(IBM研究院)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 SYMDIREC通过结合符号规划与LLM推理,提升RTL综合与摘要的准确性,实现比基线方法更高的Pass@1率和ROUGE-L分数。

Journal ref EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17133 2026-03-19 cs.SE cs.CR 57%

A Longitudinal Study of Usability in Identity-Based Software Signing

基于身份的软件签名工具的纵向研究

Kelechi G. Kalu, Hieu Tran, Santiago Torres-Arias, Sooyeon Jeong, James C. Davis

专题命中 规划决策 :workflow(abstract);分类 cs.SE

AI总结 研究分析了五个开源身份签名生态系统中用户界面问题的演变,发现验证流程和配置界面仍是主要摩擦点,尽管多数系统问题呈下降趋势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16948 2026-03-19 physics.geo-ph cs.LG 57%

A Framework for Modeling Liquefaction-Induced Road Disruptions After Earthquakes: Implications for Emergency Response and Access in the Cascadia Region of North America

一种用于地震诱发道路中断建模的框架:对北美 Cascadia 地区应急响应和通行的启示

Morgan D. Sanger, Olyvia B. Smith, Brett W. Maurer, Liam Wotherspoon, Marc O. Eberhard, Jeffrey W. Berman

机构 * Dept. of Civil and Environmental Engineering, University of Washington(华盛顿大学土木与环境工程系) Dept. of Civil and Environmental Engineering, University of Auckland(奥克兰大学土木与环境工程系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种基于力学和数据驱动的框架,用于估算地震诱发的道路关闭和服务减少,重点分析 Cascadia 地区的交通影响及应急响应需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16938 2026-03-19 cs.CR cs.AI cs.CY 57%

Cryptographic Runtime Governance for Autonomous AI Systems: The Aegis Architecture for Verifiable Policy Enforcement

面向自主AI系统的加密运行时治理:Aegis架构用于可验证的政策执行

Adam Massimo Mazzocchetti

机构 * SPQR Technologies Inc.(SPQR技术公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出Aegis架构,通过加密技术将政策约束作为执行条件,实现自主AI系统的可验证政策执行,通过实验验证其在运行时治理中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16928 2026-03-19 cs.CR cs.LG 57%

Noticing the Watcher: LLM Agents Can Infer CoT Monitoring from Blocking Feedback

察觉观察者:LLM代理可通过阻塞反馈推断CoT监控

Thomas Jiralerspong, Flemming Kondrup, Yoshua Bengio

机构 * Mila Université de Montréal(蒙特利尔大学) McGill University(麦吉尔大学) LawZero

专题命中 规划决策 :agentic(abstract);分类 cs.LG

AI总结 研究探讨LLM代理是否能自主推断其内部推理被监控,并在无显式训练的情况下产生逃避策略,发现高能力模型能通过阻塞反馈推断监控存在,但无法有效执行逃避意图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17993 2026-03-19 cs.CV cs.RO 50%

GMT: Goal-Conditioned Multimodal Transformer for 6-DOF Object Trajectory Synthesis in 3D Scenes

GMT:用于3D场景中6自由度物体轨迹合成的目标条件多模态Transformer

Huajian Zeng, Abhishek Saroha, Daniel Cremers, Xi Wang

机构 * TU München(慕尼黑工业大学) MCML ETH Zürich(苏黎世联邦理工学院) MBZUAI(穆桑大学人工智能研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出GMT,一种多模态Transformer框架,通过结合3D边界框几何、点云上下文、语义物体类别和目标末端姿态,生成真实且目标导向的物体轨迹,提升了空间精度和方向控制。

Comments Accpeted by 3DV 2026. Project Page: https://huajian-zeng.github.io/projects/gmt/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17652 2026-03-19 cs.RO cs.CV 50%

VectorWorld: Efficient Streaming World Model via Diffusion Flow on Vector Graphs

VectorWorld: 通过向量图上的扩散流实现高效的流式世界模型

Chaokang Jiang, Desen Zhou, Jiuming Liu, Kevin Li Sun

机构 * University of Cambridge, Cambridge, United Kingdom(剑桥大学)

专题命中 规划决策 :agent(abstract)

AI总结 VectorWorld通过向量图上的扩散流实现高效的流式世界模型,解决了自动驾驶政策闭环评估中的初始化不匹配、采样延迟和运动可行性问题,提升了地图结构精度和闭环运行稳定性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11903 2026-03-19 cs.RO cs.CV 50%

Aion: Towards Hierarchical 4D Scene Graphs with Temporal Flow Dynamics

Aion:面向具有时间流动态的分层4D场景图

Iacopo Catalano, Eduardo Montijano, Javier Civera, Julio A. Placed, Jorge Pena-Queralta

机构 * University of Turku(图尔库大学) Centre for Artificial Intelligence, Zürich University of Applied Sciences(应用科学大学人工智能中心) Instituto Tecnológico de Aragón (ITA) and the University of Zaragoza(阿兰理工大学和萨拉戈萨大学) University of Zaragoza(萨拉戈萨大学)

专题命中 规划决策 :planning(abstract)

AI总结 Aion通过在分层3D场景图中嵌入时间流动态,提升动态环境中导航规划和交互的可解释性和可扩展性。

Comments Accepted at ICRA 2026, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17634 2026-03-19 eess.SY cs.SY 50%

Hierarchical Decision-Making under Uncertainty: A Hybrid MDP and Chance-Constrained MPC Approach

在不确定性下的分层决策:一种混合MDP和机会约束MPC方法

Siyuan Li, Chengyuan Liu, Wen-Hua Chen

专题命中 规划决策 :agent(abstract)

AI总结 本文提出一种混合MDP和机会约束MPC的分层决策框架,用于自动驾驶中处理不确定性,通过多模态预测与安全约束实现 maneuver 选择与动态可行性的统一,验证了其在高速公路和城市环境中的安全性和效率。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09513 2026-03-19 cs.RO 50%

Beyond Short-Horizon: VQ-Memory for Robust Long-Horizon Manipulation in Non-Markovian Simulation Benchmarks

超越短时间 horizon:VQ-记忆用于非马尔可夫仿真基准中的鲁棒长时间 manipulation

Honghui Wang, Zhi Jing, Jicong Ao, Shiji Song, Xuelong Li, Gao Huang, Chenjia Bai

机构 * Tsinghua University(清华大学) Fudan University(复旦大学) Institute of Artificial Intelligence (TeleAI)(人工智能研究院(TeleAI))

专题命中 规划决策 :planning(abstract)

AI总结 本文提出 RuleSafe 基准,通过 LLM 辅助仿真框架构建非马尔可夫任务,引入 VQ-Memory 以提升长时间规划和泛化能力。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09506 2026-03-19 cs.CV cs.RO 50%

Context-Nav: Context-Driven Exploration and Viewpoint-Aware 3D Spatial Reasoning for Instance Navigation

Context-Nav: 基于上下文的探索与视点感知的3D空间推理用于实例导航

Won Shik Jang, Ue-Hwan Kim

机构 * Department of AI Convergence(人工智能融合系)

专题命中 规划决策 :agent(abstract)

AI总结 Context-Nav通过上下文驱动的探索和视点感知的3D空间推理,提升实例导航任务的性能,无需特定任务训练,实现最先进的结果。

Comments Accepted to CVPR 2026. Code is available at https://github.com/AutoCompSysLab/ContextNav

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02705 2026-03-19 cs.CY 50%

Small Bottle, Big Pipe: Quantifying and Addressing the Impact of Data Centers on Public Water Systems

小瓶,大管:量化并解决数据中心对公共水系统的影响

Yuelin Han, Pengfei Li, Adam Wierman, Shaolei Ren

专题命中 规划决策 :planning(abstract)

AI总结 本文研究了美国数据中心冷却用水需求对公共水系统的影响,指出若2024年用水强度持续,到2030年可能需要697-1,451百万加仑的新水容量,提出通过报告峰值用水、社区合作、水容量中性等措施应对需求。

Comments 51 pages; updates include the EPA's nationwide statistics of water treatment surplus capacity

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02458 2026-03-19 cs.CV 50%

Vision to Geometry: 3D Spatial Memory for Sequential Embodied MLLM Reasoning and Exploration

视觉到几何:用于连续具身MLLM推理和探索的3D空间记忆

Zhongyi Cai, Yi Du, Chen Wang, Yu Kong

机构 * ACTION Lab, Michigan State University(密歇根州立大学ACTION实验室) SAIR Lab, University at Buffalo(布法罗大学SAIR实验室)

专题命中 规划决策 :agent(abstract)

AI总结 本文提出3DSPMR框架,利用视场覆盖作为几何先验,提升具身智能在连续任务中的记忆、推理与探索能力,并引入SEER-Bench基准测试连续具身探索与推理任务。

Comments Computer Vision

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17777 2026-03-19 cs.RO 50%

See, Plan, Cut: MPC-Based Autonomous Volumetric Robotic Laser Surgery with OCT Guidance

看见、规划、切割:基于MPC的自主体积分机器人激光手术与OCT引导

Ravi Prakash, Vincent Y. Wang, Arpit Mishra, Devi Yuliarti, Pei Zhong, Ryan P. McNabb, Patrick J. Codd, Leila J. Bridgeman

机构 * Duke University(杜克大学) Duke University School of Medicine(杜克大学医学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出RATS平台,结合RGB-D成像、OCT和激光,实现自主体积分软组织切除。通过MPC框架生成约束-aware切除轨迹,提升手术精度和临床可行性。

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11005 2026-03-19 cs.CV 50%

Draft and Refine with Visual Experts

草稿与润色:借助视觉专家

Sungheon Jeong, Ryozo Masukawa, Jihong Park, Sanggeon Yun, Wenjun Huang, Hanning Chen, Mahdi Imani, Mohsen Imani

机构 * University of California, Irvine(加州大学尔湾分校) Northeastern University(东北大学) MOLOCO

专题命中 规划决策 :agent(abstract)

AI总结 本文提出DnR框架,通过可视化专家反馈提升模型视觉利用能力,减少幻觉并提高多模态系统可解释性。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19405 2026-03-19 cs.CV 50%

Multi-modal 3D Pose and Shape Estimation with Computed Tomography

基于计算机断层扫描的多模态3D姿态和形状估计

Mingxiao Tu, Hoijoon Jung, Alireza Moghadam, Jineel Raythatha, Lachlan Allan, Jeremy Hsu, Andre Kyme, Jinman Kim

机构 * School of Computer Science, The University of Sydney, Sydney, NSW 2006, Australia(悉尼大学计算机科学学院) School of Biomedical Engineering, The University of Sydney, Sydney, NSW 2006, Australia(悉尼大学生物医学工程学院) Trauma Service, Westmead Hospital, Australia(西墨迪医院创伤服务)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种多模态在床患者3D姿态和形状估计网络,融合CT扫描的几何特征和深度图,有效重建遮挡区域并提升估计精度,实验表明其在姿态和形状估计上分别优于现有方法23%和49.16%。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 19 篇

2603.17613 2026-03-19 cs.CL cs.PL 89%

VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation

VeriAgent:一种集成工具的多智能体系统,具有进化记忆,用于PPA感知的RTL代码生成

Yaoxiang Wang, Qi Shi, ShangZhan Li, Qingguo Hu, Xinyu Yin, Bo Guo, Xu Han, Maosong Sun, Jinsong Su

机构 * Xiamen University(厦门大学) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.CL

AI总结 本文提出一种集成EDA工具的多智能体框架,用于高质量Verilog代码生成,通过进化记忆机制实现功能正确性和PPA指标的联合优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17204 2026-03-19 cs.CL cs.AR cs.PL 89%

CODMAS: A Dialectic Multi-Agent Collaborative Framework for Structured RTL Optimization

CODMAS:一种基于辩证多智能体协作的结构化RTL优化框架

Che-Ming Chang, Prashanth Vijayaraghavan, Ashutosh Jadhav, Charles Mackin, Vandana Mukherjee, Hsinyu Tsai, Ehsan Degan

机构 * National Taiwan University(国立台湾大学) IBM Research(IBM研究院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.CL

AI总结 CODMAS通过结合结构化辩证推理与领域感知代码生成和确定性评估,实现RTL优化自动化,显著提升了时钟门控的功耗降低和流水线的延迟减少效果。

Journal ref EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16888 2026-03-19 cs.LG cs.AI 88%

Multi-Agent Reinforcement Learning for Dynamic Pricing: Balancing Profitability,Stability and Fairness

多智能体强化学习在动态定价中的应用:平衡盈利、稳定性和公平性

Krishna Kumar Neelakanta Pillai Santha Kumari Amma

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文通过模拟市场环境评估了多智能体强化学习方法在动态定价中的表现,发现MAPPO在盈利、稳定性和公平性方面表现更优。

Journal ref International Journal of Science and Research (IJSR), Volume 14 Issue 9, September 2025, Paper ID: SR25927034247

详情

展开后加载摘要…

URL PDF HTML 收藏