arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15729 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15729 篇

2401.03993 2024-01-09 cs.LG cs.AI cs.CV 73%

Behavioural Cloning in VizDoom

Ryan Spick, Timothy Bradley, Ayush Raina, Pierluigi Vito Amadori, Guy Moss

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01824 2023-12-29 cs.AI cs.LG cs.RO 73%

Mini-BEHAVIOR: A Procedurally Generated Benchmark for Long-horizon Decision-Making in Embodied AI

Emily Jin, Jiaheng Hu, Zhuoyi Huang, Ruohan Zhang, Jiajun Wu, Li Fei-Fei, Roberto Martín-Martín

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15339 2023-12-27 cs.LG cs.AI cs.CV cs.RO 73%

MaDi: Learning to Mask Distractions for Generalization in Visual Deep Reinforcement Learning

Bram Grooten, Tristan Tomilin, Gautham Vasan, Matthew E. Taylor, A. Rupam Mahmood, Meng Fang, Mykola Pechenizkiy, Decebal Constantin Mocanu

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Accepted as full-paper (oral) at AAMAS 2024. Code is available at https://github.com/bramgrooten/mask-distractions and see our 40-second video at https://youtu.be/2oImF0h1k48

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10809 2023-12-19 cs.AI cs.LG 73%

Deep-Dispatch: A Deep Reinforcement Learning-Based Vehicle Dispatch Algorithm for Advanced Air Mobility

Elaheh Sabziyan Varnousfaderani, Syed A. M. Shihab, Esrat F. Dulia

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08837 2023-12-15 cs.LG cs.AI 73%

Learning Safety Constraints From Demonstration Using One-Class Decision Trees

Mattijs Baert, Sam Leroux, Pieter Simoens

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments accepted for AAAI 2024 Workshop on Neuro-Symbolic Learning and Reasoning in the Era of Large Language Models (NucLeaR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01007 2023-11-09 cs.LG cs.AI cs.HC 73%

Effective Human-AI Teams via Learned Natural Language Rules and Onboarding

Hussein Mozannar, Jimin J Lee, Dennis Wei, Prasanna Sattigeri, Subhro Das, David Sontag

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2023 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05036 2023-11-09 cs.AI cs.CL 73%

AvalonBench: Evaluating LLMs Playing the Game of Avalon

Jonathan Light, Min Cai, Sheng Shen, Ziniu Hu

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03196 2023-11-02 cs.GT cs.AI cs.LG cs.MA 73%

Population-based Evaluation in Repeated Rock-Paper-Scissors as a Benchmark for Multiagent Reinforcement Learning

Marc Lanctot, John Schultz, Neil Burch, Max Olan Smith, Daniel Hennes, Thomas Anthony, Julien Perolat

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 25 pages, 8 figures, Accepted at TMLR October 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02265 2023-10-31 cs.AI cs.LG 73%

Learning to Influence Human Behavior with Offline Reinforcement Learning

Joey Hong, Sergey Levine, Anca Dragan

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments Published at NeurIPS 2023; 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14993 2023-10-30 cs.AI cs.LG 73%

Thinker: Learning to Plan and Act

Stephen Chung, Ivan Anokhin, David Krueger

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

Comments 38 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.13565 2023-10-23 cs.LG cs.AI 73%

Reward Shaping for Happier Autonomous Cyber Security Agents

Elizabeth Bates, Vasilios Mavroudis, Chris Hicks

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments 12 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08901 2023-10-16 cs.MA cs.AI cs.CL 73%

Welfare Diplomacy: Benchmarking Language Model Cooperation

Gabriel Mukobi, Hannah Erlebach, Niklas Lauffer, Lewis Hammond, Alan Chan, Jesse Clifton

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.08483 2023-10-12 cs.LG cs.AI 73%

Honor of Kings Arena: an Environment for Generalization in Competitive Reinforcement Learning

Hua Wei, Jingxiao Chen, Xiyang Ji, Hongyang Qin, Minwen Deng, Siqin Li, Liang Wang, Weinan Zhang, Yong Yu, Lin Liu, Lanxiao Huang, Deheng Ye, Qiang Fu, Wei Yang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2022

Journal ref Advances in Neural Information Processing Systems, 2022, 35: 11881-11892

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09476 2023-10-06 cs.AI cs.LG 73%

Mechanic Maker 2.0: Reinforcement Learning for Evaluating Generated Rules

Johor Jara Gonzalez, Seth Cooper, Matthew Guzdial

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 6 figures, Artificial Intelligence and Interactive Digital Entertainment

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04905 2023-08-10 cs.NI cs.AI cs.LG cs.MA 73%

GraphCC: A Practical Graph Learning-based Approach to Congestion Control in Datacenters

Guillermo Bernárdez, José Suárez-Varela, Xiang Shi, Shihan Xiao, Xiangle Cheng, Pere Barlet-Ros, Albert Cabellos-Aparicio

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03442 2023-08-08 cs.HC cs.AI cs.LG 73%

Generative Agents: Interactive Simulacra of Human Behavior

Joon Sung Park, Joseph C. O'Brien, Carrie J. Cai, Meredith Ringel Morris, Percy Liang, Michael S. Bernstein

专题命中 Agent评测 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.14891 2023-07-25 cs.LG cs.AI 73%

Broken Neural Scaling Laws

Ethan Caballero, Kshitij Gupta, Irina Rish, David Krueger

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at International Conference on Learning Representations (ICLR) 2023

Journal ref International Conference on Learning Representations (ICLR), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07529 2023-07-18 cs.LG cs.AI cs.MA 73%

Learning Multiple Coordinated Agents under Directed Acyclic Graph Constraints

Jaeyeon Jang, Diego Klabjan, Han Liu, Nital S. Patel, Xiuqi Li, Balakrishnan Ananthanarayanan, Husam Dauod, Tzung-Han Juang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.10553 2023-07-04 cs.LG cs.AI cs.CV cs.MA 73%

MABe22: A Multi-Species Multi-Task Benchmark for Learned Representations of Behavior

Jennifer J. Sun, Markus Marks, Andrew Ulmer, Dipam Chakraborty, Brian Geuther, Edward Hayes, Heng Jia, Vivek Kumar, Sebastian Oleszko, Zachary Partridge, Milan Peelman, Alice Robie, Catherine E. Schretter, Keith Sheppard, Chao Sun, Param Uttarwar, Julian M. Wagner, Eric Werner, Joseph Parker, Pietro Perona, Yisong Yue, Kristin Branson, Ann Kennedy

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments To appear in ICML 2023, Project website: https://sites.google.com/view/computational-behavior/our-datasets/mabe2022-dataset

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09064 2023-05-17 cs.LG cs.AI cs.HC 73%

Capturing Humans' Mental Models of AI: An Item Response Theory Approach

Markelle Kelly, Aakriti Kumar, Padhraic Smyth, Mark Steyvers

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments FAccT 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.14602 2023-04-14 cs.RO cs.AI cs.LG 73%

Modified DDPG car-following model with a real-world human driving experience with CARLA simulator

Dianzhao Li, Ostap Okhrin

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.02807 2023-04-13 cs.SE cs.LG 73%

MDPFuzz: Testing Models Solving Markov Decision Processes

Qi Pang, Yuanyuan Yuan, Shuai Wang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.LG、cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13360 2023-03-24 cs.CL cs.LG 73%

Towards the Scalable Evaluation of Cooperativeness in Language Models

Alan Chan, Maxime Riché, Jesse Clifton

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.14604 2023-03-07 cs.MA cs.AI cs.GT cs.LG 73%

IQ-Flow: Mechanism Design for Inducing Cooperative Behavior to Self-Interested Agents in Sequential Social Dilemmas

Bengisu Guresti, Abdullah Vanlioglu, Nazim Kemal Ure

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments AAMAS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.10445 2023-03-03 cs.LG cs.AI 73%

Building a Subspace of Policies for Scalable Continual Learning

Jean-Baptiste Gaya, Thang Doan, Lucas Caccia, Laure Soulier, Ludovic Denoyer, Roberta Raileanu

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICLR2023 (notable-top-25%). website: https://continual-subspace-policies-streamlit-app-gofujp.streamlit.app/ code: https://github.com/facebookresearch/salina/tree/main/salina_cl

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.11892 2023-01-30 cs.LG cs.AI cs.CV 73%

Streaming LifeLong Learning With Any-Time Inference

Soumya Banerjee, Vinay Kumar Verma, Vinay P. Namboodiri

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: substantial text overlap with arXiv:2110.10741

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.00637 2023-01-03 cs.GT cs.AI cs.LG cs.MA 73%

Large-Scale Traffic Signal Control by a Nash Deep Q-network Approach

Yuli. Zhang, Shangbo. Wang, Ruiyuan. Jiang

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 7 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.05437 2022-11-29 cs.RO cs.AI cs.LG cs.NE 73%

Autonomous Racing using a Hybrid Imitation-Reinforcement Learning Architecture

Chinmay Vilas Samak, Tanmay Vilas Samak, Sivanathan Kandhasamy

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11513 2022-11-22 q-fin.ST cs.AI cs.LG 73%

DSLOB: A Synthetic Limit Order Book Dataset for Benchmarking Forecasting Algorithms under Distributional Shift

Defu Cao, Yousef El-Laham, Loc Trinh, Svitlana Vyetrenko, Yan Liu

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

Comments 11 pages, 5 figures, already accepted by NeurIPS 2022 Distribution Shifts Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05500 2022-11-11 cs.LG cs.AI 73%

Reinforcement Learning in an Adaptable Chess Environment for Detecting Human-understandable Concepts

Patrik Hammersborg, Inga Strümke

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

Comments For associated code, see https://github.com/patrik-ha/explainable-minichess

详情

展开后加载摘要…

URL PDF HTML 收藏