arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-03 至 2026-04-03 共收录 38 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 38 篇

2510.16082 2026-04-03 q-bio.QM cs.AI cs.LG 90%

BIOGEN: Evidence-Grounded Multi-Agent Reasoning Framework for Transcriptomic Interpretation in Antimicrobial Resistance

BIOGEN:基于证据的多智能体推理框架用于抗菌药物耐药性中的转录组解释

Elias Hossain, Mehrdad Shoeibi, Ivan Garibay, Niloofar Yousefi

机构 * College of Engineering and Computer Science, University of Central Florida(中佛罗里达大学工程与计算机科学学院)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 BIOGEN通过结合生物信息检索、结构化推理和多批评验证,生成可追溯的转录组模块解释,其在抗菌药物耐药性研究中表现出强生物学基础和零幻觉率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01681 2026-04-03 cs.RO cs.AI 88%

Bridging Large-Model Reasoning and Real-Time Control via Agentic Fast-Slow Planning

通过代理快慢规划弥合大模型推理与实时控制

Jiayi Chen, Shuai Wang, Guangxu Zhu, Chengzhong Xu

机构 * Shenzhen Research Institute of Big Data, The Chinese University of Hong Kong (Shenzhen)(深圳市大数据研究院,香港中文大学(深圳)) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究院) State Key Laboratory of Internet of Things for Smart City (SKL-IOTSC), University of Macau(澳门大学智慧城市物联网国家重点实验室)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 本文提出一种分层框架,通过感知-决策-轨迹-控制的分离,提升自动驾驶系统在扰动下的鲁棒性,减少侧向偏移和完成时间。

Comments 8 pages, 12figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02279 2026-04-03 cs.AI cs.MA q-fin.GN q-fin.PM 85%

The Self Driving Portfolio: Agentic Architecture for Institutional Asset Management

自主驾驶型投资组合:面向机构资产管理部门的智能架构

Andrew Ang, Nazym Azimbayev, Andrey Kim

机构 * Tau Balance Columbia University(哥伦比亚大学) Altbridge

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一个智能架构,通过50个专门代理生成资本市场假设,使用20种竞争方法构建投资组合,并相互批评和投票。研究代理提出新方法,元代理比较历史预测与实际回报,优化代理代码和提示以提高未来表现。

Comments 31 pages, 11 exhibits

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01599 2026-04-03 cs.AI 83%

ByteRover: Agent-Native Memory Through LLM-Curated Hierarchical Context

ByteRover:通过LLM-curated分层上下文实现代理原生内存

Andy Nguyen, Danh Doan, Hoang Pham, Bao Ha, Dat Pham, Linh Nguyen, Hieu Nguyen, Thien Nguyen, Cuong Do, Phat Nguyen, Toan Nguyen

机构 * ByteRover

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出ByteRover,一种代理原生内存架构,通过LLM-curated分层上下文实现知识的结构化存储与检索,实验显示其在LoCoMo和LongMemEval上表现优异,无需外部基础设施。

Comments 19 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02289 2026-04-03 cs.DB 82%

Multi-Objective Agentic Rewrites for Unstructured Data Processing

多目标代理重写用于无结构数据处理

Lindsey Linxi Wei, Shreya Shankar, Sepanta Zeighami, Yeounoh Chung, Fatma Ozcan, Aditya G. Parameswaran

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 MOAR通过引入新的指令类别和全局搜索算法,提升DocETL在准确性和成本上的优化能力,实现更高的准确性并匹配最佳成本。

Comments 24 pages, 8 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09219 2026-04-03 cs.LG 79%

Planning in Branch-and-Bound: Model-Based Reinforcement Learning for Exact Combinatorial Optimization

在分支定界中的规划:基于模型的强化学习用于精确组合优化

Paul Strang, Zacharie Alès, Côme Bissuel, Olivier Juan, Safia Kedad-Sidhoum, Emmanuel Rachelson

专题命中 规划决策 :planning(title);agent(abstract);分类 cs.LG

AI总结 本文提出PlanB&B,一种基于模型的强化学习方法,用于改进分支定界中的分支策略,通过在四个标准MILP基准上优于现有方法的实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02006 2026-04-03 cs.AI 79%

ProCeedRL: Process Critic with Exploratory Demonstration Reinforcement Learning for LLM Agentic Reasoning

ProCeedRL: 带探索演示的强化学习过程批评用于LLM代理推理

Jingyue Gao, Yanjiang Guo, Xiaoshuai Chen, Jianyu Chen

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) Independent Researcher(独立研究者) Shanghai Qizhi Institute(上海期智研究院)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出ProCeedRL,通过过程批评和探索性演示提升LLM在多轮代理任务中的推理能力,解决探索过程中错误累积问题,提高探索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01765 2026-04-03 cs.CV cs.AI cs.RO 79%

DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning

DriveDreamer-Policy: 一种基于几何的世界-动作模型用于统一生成与规划

Yang Zhou, Xiaofeng Wang, Hao Shao, Letian Wang, Guosheng Zhao, Jiangnan Shao, Jiagang Zhu, Tingdong Yu, Zheng Zhu, Guan Huang, Steven L. Waslander

机构 * GigaAI University of Toronto(多伦多大学) CUHK MMLab(香港中文大学多媒体实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出DriveDreamer-Policy,结合深度生成、未来视频生成与运动规划,通过几何感知的世界表示提升生成与规划的连贯性与准确性。

Comments 11 pages, 4 figures; Project Website: https://drivedreamer-policy.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01434 2026-04-03 cs.AI 79%

Leveraging the Value of Information in POMDP Planning

利用信息价值进行POMDP规划

Zakariya Laouar, Qi Heng Ho, Zachary Sunberg

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出基于信息价值的动态规划框架和VOIMCP算法,通过高效利用信息价值减少计算开销,提升POMDP规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02190 2026-04-03 cs.CV cs.RO 78%

UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving

UniDriveVLA: 联合理解、感知与行动规划以实现自动驾驶

Yongkang Li, Lijun Zhou, Sixu Yan, Bencheng Liao, Tianyi Yan, Kaixin Xiong, Long Chen, Hongwei Xie, Bing Wang, Guang Chen, Hangjun Ye, Wenyu Liu, Haiyang Sun, Xinggang Wang

机构 * Huazhong University of Science and Technology(华中科技大学) SKL-IOTSC, University of Macau(澳门大学智慧城市物联网国家重点实验室)

专题命中 规划决策 :planning(title,abstract)

AI总结 UniDriveVLA通过专家解耦和三阶段训练策略,解决自动驾驶中感知与推理的冲突,实现空间感知与语义推理的统一,取得nuScenes和Bench2Drive的优异性能。

Comments code has been released at https://github.com/xiaomi-research/unidrivevla

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07576 2026-04-03 math.OC 78%

Optimizing a Worldwide-Scale Shipper Transportation Planning in a Carmaker Inbound Supply Chain

优化全球规模的汽车制造商 inbound 供应链货运规划

Mathis Brichet, Maximilian Schiffer, Axel Parmentier

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种定制化的迭代局部搜索算法,解决大规模货运规划问题,实现70万商品和120万条弧的计算实验,展示23.2%的成本节约潜力,并在雷诺汽车部署,年节省约2000万欧元。

Comments 40 pages, 27 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01882 2026-04-03 cs.CV 78%

A3R: Agentic Affordance Reasoning via Cross-Dimensional Evidence in 3D Gaussian Scenes

A3R: 通过跨维度证据进行3D高斯场景中的代理 affordance 推理

Di Li, Jie Feng, Guanbin Li, Ronghua Shang, Yuhui Zheng, Weisheng Dong, Guangming Shi

机构 * Xidian University(西安电子科技大学) Sun Yat-sen University(中山大学) Qinghai Normal University(青海师范大学)

专题命中 规划决策 :agentic(title,abstract)

AI总结 本文提出A3R框架,通过跨维度证据获取提升复杂3D高斯场景中细粒度affordance推理的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01428 2026-04-03 math.OC 78%

Rendezvous Planning from Sparse Observations of Optimally Controlled Targets

从最优控制目标的稀疏观测中进行会合规划

Thomas A. Scott, Lukas Taus, Yen-Hsi Richard Tsai, Tan Bui-Thanh, Justin G. R. Delva

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种概率框架,用于在稀疏、噪声观测下规划会合点,结合滤波方法和高斯过程校正,以估计目标轨迹并选择最优会合点,确保在不确定性下做出统计一致的决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15961 2026-04-03 cs.RO 78%

IA-TIGRIS: An Incremental and Adaptive Sampling-Based Planner for Online Informative Path Planning

IA-TIGRIS: 一种用于在线信息路径规划的增量和自适应采样规划器

Brady Moon, Nayana Suvarna, Andrew Jong, Satrajit Chatterjee, Junbin Yuan, Muqing Cao, Sebastian Scherer

机构 * Robotics Institute, School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院机器人研究所) Department of Mechanical Engineering, Brigham Young University(杨百翰大学机械工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出IA-TIGRIS,一种用于实时任务的增量和自适应采样路径规划方法,通过增量优化和动态更新信念地图,提升信息获取效率,实验证明其在无人机应用中信息增益提升达38%。

Comments Published in IEEE Transactions on Robotics, 19 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01738 2026-04-03 cs.AI 70%

AeroTherm-GPT: A Verification-Centered LLM Framework for Thermal Protection System Engineering Workflows

AeroTherm-GPT:一种面向热防护系统工程工作流的验证中心LLM框架

Chuhan Qiao, Jinglai Zheng, Jie Huang, Buyue Zhao, Fan Li, Haiming Huang

机构 * School of Civil Engineering, Beijing Jiaotong University(北京交通大学土木工程学院) Beijing Research Institute of Telemetry(北京遥测技术研究所)

专题命中 规划决策 :agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出AeroTherm-GPT,一种专为热防护系统设计的LLM代理,通过约束闭环生成框架解决超音速热防护系统设计中生成可执行仿真工具时的约束冲突问题,实现高效率的根因修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02318 2026-04-03 cs.RO cs.CV 67%

Stop Wandering: Efficient Vision-Language Navigation via Metacognitive Reasoning

停止游荡:通过元认知推理实现高效的视觉-语言导航

Xueying Li, Feng Lyu, Hao Wu, Mingliu Liu, Jia-Nan Liu, Guozi Liu

机构 * Central South University(中南大学) Nanjing University(南京大学) State Grid Hubei Electric Power Research Institute(国网湖北省电力有限公司电力科学研究院) Dongguan University of Technology(东莞理工学院)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出MetaNav,通过整合空间记忆、历史感知规划和反思修正,提升视觉-语言导航的效率与鲁棒性,实验显示其在多个基准上表现优异,减少了20.7%的VLM查询。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02226 2026-04-03 cs.AI cs.LG 62%

When to ASK: Uncertainty-Gated Language Assistance for Reinforcement Learning

何时提问:用于强化学习的不确定性门控语言帮助

Juarez Monteiro, Nathan Gavenski, Gianlucca Zuin, Adriano Veloso

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ASK方法,通过结合小型语言模型和训练好的RL策略,提升模型在分布外任务中的泛化能力,通过不确定性门控机制选择性利用语言模型进行决策,实验显示其在迁移任务中表现稳健。

Comments In Proceedings of International Joint Conference on Neural Networks (IJCNN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01264 2026-04-03 eess.IV cs.AI cs.IR cs.LG cs.NE 62%

OkanNet: A Lightweight Deep Learning Architecture for Classification of Brain Tumor from MRI Images

OkanNet:一种轻量级深度学习架构用于从MRI图像中分类脑肿瘤

Okan Uçar, Murat Kurt

机构 * Graduate School of Natural Applied Sciences Department of Computer Engineering Ege University Izmir, Turkey International Computer Institute Ege University Izmir, Turkey

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出OkanNet和基于ResNet-50的迁移学习方法,用于自动检测和分类脑肿瘤,OkanNet在计算效率上表现优异,训练时间较ResNet-50快3.2倍,准确率88.10%。

Comments 7 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25040 2026-04-03 cs.LG cs.CL cs.CV 62%

Intern-S1-Pro: Scientific Multimodal Foundation Model at Trillion Scale

Intern-S1-Pro:万亿参数科学多模态基础模型

Yicheng Zou, Dongsheng Zhu, Lin Zhu, Tong Zhu, Yunhua Zhou, Peiheng Zhou, Xinyu Zhou, Dongzhan Zhou, Zhiwang Zhou, Yuhao Zhou, Bowen Zhou, Zhanping Zhong, Zhijie Zhong, Haiteng Zhao, Penghao Zhao, Xiaomeng Zhao, Zhiyuan Zhao, Yechen Zhang, Jin Zhang, Wenwei Zhang, Hongjie Zhang, Zhuo Zhang, Wenlong Zhang, Bo Zhang, Chao Zhang, Chen Zhang, Yuhang Zang, Fei Yuan, Jiakang Yuan, Jiashuo Yu, Jinhui Yin, Haochen Ye, Qian Yao, Bowen Yang, Danni Yang, Kaichen Yang, Ziang Yan, Jun Xu, Yicheng Xu, Wanghan Xu, Xuenan Xu, Chao Xu, Ruiliang Xu, Shuhao Xing, Long Xing, Xinchen Xie, Ling-I Wu, Zijian Wu, Zhenyu Wu, Lijun Wu, Yue Wu, Jianyu Wu, Wen Wu, Fan Wu, Xilin Wei, Qi Wei, Bingli Wang, Rui Wang, Ziyi Wang, Zun Wang, Yi Wang, Haomin Wang, Yizhou Wang, Lintao Wang, Yiheng Wang, Longjiang Wang, Bin Wang, Jian Tong, Zhongbo Tian, Huanze Tang, Chen Tang, Shixiang Tang, Yu Sun, Qiushi Sun, Xuerui Su, Qisheng Su, Chenlin Su, Demin Song, Jin Shi, Fukai Shang, Yuchen Ren, Pengli Ren, Xiaoye Qu, Yuan Qu, Jiantao Qiu, Yu Qiao, Biqing Qi, Runyu Peng, Tianshuo Peng, Jiahui Peng, Qizhi Pei, Zhuoshi Pan, Linke Ouyang, Wenchang Ning, Yichuan Ma, Zerun Ma, Ningsheng Ma, Runyuan Ma, Chengqi Lyu, Haijun Lv, Han Lv, Lindong Lu, Kuikun Liu, Jiangning Liu, Yuhong Liu, Kai Liu, Hongwei Liu, Zhoumianze Liu, Mengjie Liu, Ziyu Liu, Wenran Liu, Yang Liu, Liwei Liu, Kaiwen Liu, Junyao Lin, Junming Lin, Tianyang Lin, Dahua Lin, Jianze Liang, Linyang Li, Peiji Li, Zonglin Li, Zehao Li, Pengze Li, Guoyan Li, Lingkai Kong, Linglin Jing, Zhenjiang Jin, Feifei Jiang, Qian Jiang, Junhao Huang, Zixian Huang, Haian Huang, Zhouqi Hua, Ermo Hua, Han Hu, Linfeng Hou, Yinan He, Conghui He, Tianyao He, Xu Guo, Qipeng Guo, Aijia Guo, Yuzhe Gu, Lixin Gu, Jingyang Gong, Qiming Ge, Jiaye Ge, Songyang Gao, Jianfei Gao, Xinyu Fang, Caihua fan, Yue Fan, Yanhui Duan, Zichen Ding, Shengyuan Ding, Ning Ding, Xuanlang Dai, Erfei Cui, Ganqu Cui, Pei Chu, Tao Chu, Guangran Cheng, Yu Cheng, Kai Chen, Yongkang Chen, Chiyu Chen, Guanzhou Chen, Qiaosheng Chen, Sitao Chen, Xin Chen, Haojiong Chen, Yicheng Chen, Weihan Cao, Yuhang Cao, Qinglong Cao, Lei Bai

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 规划决策 :agent(abstract);分类 cs.CL、cs.LG

AI总结 Intern-S1-Pro是首个万亿参数科学多模态基础模型,具备跨通用与科学领域的能力提升,融合强推理、图像-文本理解及先进代理能力,专精于100余项科学任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08640 2026-04-03 cs.SE cs.AI 62%

Automating Android Build Repair: Bridging the Reasoning-Execution Gap in LLM Agents with Domain-Specific Tools

自动化Android构建修复:通过领域特定工具弥合LLM代理中的推理-执行差距

Ha Min Son, Huan Ren, Xin Liu, Zhe Zhao

机构 * University of California, Davis(加州大学戴维斯分校) CodeDroid LLC(CodeDroid有限责任公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出AndroidBuildBench基准和GradleFixer工具,通过领域特定抽象提升LLM修复Android构建错误的效率,解决LLM在低层执行中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02097 2026-04-03 cs.CV cs.LG 57%

LatentUM: Unleashing the Potential of Interleaved Cross-Modal Reasoning via a Latent-Space Unified Model

LatentUM:通过潜在空间统一模型释放交错跨模态推理的潜力

Jiachun Jin, Zetong Zhou, Xiao Yang, Hao Zhang, Pengfei Liu, Jun Zhu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出LatentUM,通过共享语义潜在空间实现跨模态推理与生成,提升计算效率并减少编码器偏差,取得视觉空间规划基准的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02035 2026-04-03 q-fin.MF cs.LG math.OC q-fin.CP q-fin.TR 57%

Reinforcement Learning for Speculative Trading under Exploratory Framework

在探索框架下用于投机交易的强化学习

Yun Zhao, Alex S. L. Tse, Harry Zheng

机构 * Imperial College(帝国理工学院) University College London(伦敦大学学院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文研究了在探索强化学习框架下,基于一般效用函数和价格过程的连续最优停止问题,提出了一种基于Cox过程的跳跃时间模型,并通过熵正则化得到最优策略。

Comments 37 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01775 2026-04-03 cs.LG 57%

Bridging Deep Learning and Integer Linear Programming: A Predictive-to-Prescriptive Framework for Supply Chain Analytics

弥合深度学习与整数线性规划:面向供应链分析的预测到规划框架

Khai Banh Nghiep, Duc Nguyen Minh, Lan Hoang Thi

机构 * Tran Dai Nghia Secondary and High School(陈大义中学) University of Languages and International Studies(语言与国际研究大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出结合预测与运营分析的三阶段框架,通过探索性数据分析、对比统计时间序列分解模型与深度学习架构的预测性能,并利用整数线性规划优化物流配送计划,以降低总配送时间。

Comments 12 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01630 2026-04-03 cs.CL 57%

Grounding AI-in-Education Development in Teachers' Voices: Findings from a National Survey in Indonesia

将教育中的AI发展扎根于教师的声音:来自印度尼西亚全国调查的结果

Nurul Aisyah, Muhammad Dehan Al Kautsar, Arif Hidayat, Fajri Koto

机构 * Quantic School of Business and Technology(昆蒂克商业与技术学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Indonesia University of Education(印度尼西亚教育大学)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 研究通过全国性调查揭示印尼教师对AI在教育中的应用现状,发现AI在教学、内容开发和教学媒体中日益普及,但应用不均,教师更倾向于利用AI减轻教学准备负担。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01610 2026-04-03 cs.AI 57%

GraphWalk: Enabling Reasoning in Large Language Models through Tool-Based Graph Navigation

GraphWalk: 通过基于工具的图导航在大语言模型中实现推理

Taraneh Ghandi, Hamidreza Mahyar, Shachar Klaiman

机构 * McMaster University(麦克马斯特大学) BASF Digital Solutions(巴斯夫数字解决方案)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 GraphWalk通过基于工具的图导航框架,使大语言模型能够高效进行多跳推理,提升在不同任务中的性能,尤其在大规模知识图谱中表现更优。

Comments 22 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01594 2026-04-03 cs.AI 57%

Do Large Language Models Mentalize When They Teach?

大型语言模型在教学时是否具备心智化能力?

Sevan K. Harootonian, Mark K. Ho, Thomas L. Griffiths, Yael Niv, Ilia Sucholutsky

机构 * Princeton University(普林斯顿大学) New York University(纽约大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究通过控制任务探讨LLM教学决策机制,发现LLM在教学策略上与人类相似,但Bayes-Optimal模型最佳解释其选择,提示提示合规性不等于教学效果提升。

Comments 9 pages, 5 figures. Workshop paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01477 2026-04-03 cs.LG cs.SY eess.SY 57%

Soft MPCritic: Amortized Model Predictive Value Iteration

软MPCritic: amortized模型预测价值迭代

Thomas Banker, Nathan P. Lawrence, Ali Mesbah

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 软MPCritic结合了强化学习与模型预测控制,通过价值空间学习和基于样本的规划实现高效控制,保留了规划 horizon 的有效性。

Comments submitted to CDC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01354 2026-04-03 cs.CL 57%

Open-Domain Safety Policy Construction

开放领域安全政策构建

Di Wu, Siyue Liu, Zixiang Ji, Ya-Liang Chang, Zhe-Yu Liu, Andrew Pleffer, Kai-Wei Chang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Taboola

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 本文提出Deep Policy Research(DPR),通过仅使用人类撰写的种子领域信息,构建完整的内容审核政策。DPR利用单一网络搜索工具和轻量级框架,迭代提出搜索查询,提炼多样化网络资源为政策规则,并将规则组织成索引文档。

Comments EACL 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02788 2026-04-03 cs.AI 57%

Agentified Assessment of Logical Reasoning Agents

具有代理特性的逻辑推理代理评估

Zhiyu Ni, Yifeng Xiao, Zheng Liang

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出一种评估和基准测试逻辑推理代理的框架,通过代理评估实现可重复、可审计和抗执行失败的评估。案例研究中,自动形式化代理在FOLIO验证集上以86.70%的准确率超越了基线方法。

Comments Accepted at ICLR 2026 Agents in the Wild (AIWILD) Workshop. 5 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02154 2026-04-03 cs.HC 50%

Designing Transformational Games to Support Socio-ethical Reasoning about Generative AI

设计转型游戏以支持关于生成式人工智能的社伦理推理

Jaemarie Solyst, Ruth Karen Nakigozi, Chloe Fong, R. Benjamin Shapiro

专题命中 规划决策 :agent(abstract)

AI总结 本文设计了两款游戏,通过同伴评估、基于约束的创造力和社会推理元素,促进青少年对生成式人工智能的社伦理推理。

详情

展开后加载摘要…

URL PDF HTML 收藏