arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-07 至 2026-04-07 共收录 232 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 78 篇

2604.04741 2026-04-07 cs.CY cs.AI 57%

Artificial Intelligence and Cost Reduction in Public Higher Education: A Scoping Review of Emerging Evidence

人工智能与公共高等教育成本削减:一项新兴证据的综述研究

Diamanto Tzanoulinou, Loukas Triantafyllopoulos, George Vorvilas, Evgenia Paxinou, Nikolaos Karousos, Thomas Dasaklis, Athanassios Mihiotis, Manolis Koutouzis, Dimitris Kalles, Vassilios S. Verykios

机构 * School of Science and Technology, Hellenic Open University(希腊开放大学科学与技术学院) School of Humanities, Hellenic Open University(希腊开放大学人文学院) School of Social Sciences, Hellenic Open University(希腊开放大学社会科学学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文通过系统检索Scopus和IEEE Xplore数据库,综述了人工智能在公共高等教育中的应用,发现AI可通过自动化任务、优化资源配置等实现成本节约,但也面临实施成本和数字鸿沟等挑战。

Comments 19 pages, 2 tables, 4 figures, ICBE-HOU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04443 2026-04-07 cs.CL 57%

DeonticBench: A Benchmark for Reasoning over Rules

DeonticBench: 一个用于规则推理的基准

Guangyao Dou, Luis Brena, Akhil Deo, William Jurayj, Jingyu Zhang, Nils Holzenberger, Benjamin Van Durme

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划决策 :workflow(abstract);分类 cs.CL

AI总结 本文提出DeonticBench,包含6232个任务,涵盖美国联邦税收、航空行李政策等真实领域,研究复杂规则推理问题,结合语言推理与符号计算,评估LLM在非符号和符号环境下的规则推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04157 2026-04-07 cs.AI 57%

Readable Minds: Emergent Theory-of-Mind-Like Behavior in LLM Poker Agents

可读心智:LLM扑克代理中涌现的理论心智行为

Hsieh-Ting Lin, Tsung-Yu Hou

机构 * Department of Oncology, Koo Foundation Sun Yat-Sen Cancer Center(辜公亮基金会和信治癌中心医院肿瘤科) Department of Digital Content and Technologies, National Chengchi University(国立政治大学数位内容与科技学系)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文研究LLM在动态互动中发展理论心智行为的能力,发现持久记忆是必要且充分条件,使代理达到高级对手建模水平,且领域知识增强应用效果。

Comments 7 pages (PNAS format), 4 figures, 2 tables, 49 references. Submitted to PNAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28498 2026-04-07 eess.IV cs.AI cs.CV 57%

MRI-to-CT synthesis using drifting models

利用漂移模型进行MRI到CT合成

Qing Lyu, Jianxu Wang, Jeremy Hudson, Ge Wang, Chirstopher T. Whitlow

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文研究了漂移模型在MRI到CT合成中的应用,通过对比不同方法验证了其在图像质量和效率上的优势,为快速高质量的骨盆合成CT生成提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24936 2026-04-07 cs.CV cs.AI 57%

TIGFlow-GRPO: Trajectory Forecasting via Interaction-Aware Flow Matching and Reward-Guided Optimization

TIGFlow-GRPO:通过交互感知的流匹配和奖励引导优化进行轨迹预测

Xuepeng Jing, Wenhuan Lu, Hao Meng, Zhizhi Yu, Jianguo Wei

机构 * Tianjin University(天津大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出TIGFlow-GRPO,通过交互感知的流匹配和奖励引导优化,提升复杂环境下的轨迹预测准确性与稳定性,生成更符合社会规范和物理可行的轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00495 2026-04-07 cs.AI 57%

AI Runtime Infrastructure

AI 运行时基础设施

Christopher Cruz

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出AI运行时基础设施,通过在模型与应用之间引入执行层,主动监控和干预智能体行为,优化任务成功率、延迟、令牌效率、可靠性和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08565 2026-04-07 cs.HC cs.AI 57%

Rewriting Video: Text-Driven Reauthoring of Video Footage

重写视频:基于文本的视频重写

Sitong Wang, Anh Truong, Lydia B. Chilton, Dingzeyu Li

机构 * Columbia University(哥伦比亚大学) Adobe Research(Adobe研究院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出基于文本的视频重写方法,通过生成重建算法将视频转为可编辑文本提示,并通过交互式工具Rewrite Kit实现视频内容的重写,探讨了文本驱动视频重写的新范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03795 2026-04-07 cs.RO cs.AI 57%

MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving

MPCFormer: 一种融合物理信息的数据驱动方法用于可解释的社交感知自主驾驶

Jia Hu, Zhexi Lian, Xuerun Yan, Ruiang Bi, Dou Shen, Yu Ruan, Chunlong Xia, Haoran Wang

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 MPCFormer通过融合物理信息和数据驱动的方法,提升自主驾驶在复杂交通场景中的社交交互能力,实现更安全的人类行为模拟,实验显示其在轨迹预测和碰撞率控制方面表现优异。

Comments 17 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26433 2026-04-07 cs.LG 57%

Co-Evolving Latent Action World Models

共演潜在动作世界模型

Yucen Wang, Fengming Zhang, De-Chuan Zhan, Li Zhao, Kaixin Wang, Jiang Bian

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出CoLA-World,通过关键预热阶段实现联合学习,解决世界模型与动作模型的协同问题,提升视频模拟质量和下游视觉规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03152 2026-04-07 cs.CV cs.CE cs.LG cs.SI 57%

Markovian Reeb Graphs for Simulating Spatiotemporal Patterns of Life

马尔可夫里eb图用于模拟生命模式的时空图案

Anantajit Subrahmanya, Chandrakanth Gudavalli, Connor Levenson, B. S. Manjunath

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出马尔可夫里eb图,通过将里eb图从描述工具转变为生成模型,用于模拟时空轨迹中的个体和群体生命模式,通过概率转换生成真实轨迹。

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05145 2026-04-07 cs.LG 57%

From Restless to Contextual: A Thresholding Bandit Reformulation For Finite-horizon Improvement

从动态到上下文:一种有限时间 horizon 改进的阈值老虎机重新公式化

Jiamin Xu, Ivan Nazarov, Aditya Rastogi, África Periáñez, Kyra Gan

机构 * Cornell Tech(康奈尔科技) Causal Foundry

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文通过将在线动态老虎机重新公式化为预算阈值上下文老虎机,解决了现有算法在有限时间 horizon 性能差的问题,提出了一种实用学习策略,实现了亚线性遗憾,提升了累积奖励。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03759 2026-04-07 cs.RO cs.AI 57%

Build on Priors: Vision--Language--Guided Neuro-Symbolic Imitation Learning for Data-Efficient Real-World Robot Manipulation

基于先验知识:视觉-语言引导的神经符号模仿学习用于数据高效的现实机器人操作

Pierrick Lorang, Johannes Huemer, Timothy Duggan, Kai Goebel, Patrik Zips, Matthias Scheutz

机构 * Tufts University(塔夫茨大学) Austrian Institute of Technology GmbH (AIT)(奥地利技术研究所(AIT))

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种可扩展的神经符号框架,通过少量未标注的示范数据自动构建符号规划领域和高效控制策略,无需手动领域工程,提升现实机器人操作的效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03325 2026-04-07 cs.CV cs.AI cs.RO 57%

Safety-Aligned 3D Object Detection: Single-Vehicle, Cooperative, and End-to-End Perspectives

安全对齐的3D目标检测:单车辆、协同和端到端视角

Brian Hsuan-Cheng Liao, Chih-Hong Cheng, Hasan Esen, Alois Knoll

机构 * DENSO AUTOMOTIVE Deutschland GmbH(电装汽车德国有限公司) Carl von Ossietzky University of Oldenburg(奥尔登堡大学) Technical University of Munich(慕尼黑工业大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文探讨了安全对齐的3D目标检测评估与优化,通过单车辆、协同和端到端视角,提出EC-IoU损失函数,改进安全关键检测性能,并在SparseDrive中验证安全感知强化对碰撞率降低和系统安全性的提升。

Comments 10 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02007 2026-04-07 cs.LG 57%

Apriel-1.5-OpenReasoner: RL Post-Training for General-Purpose and Efficient Reasoning

阿普里尔-1.5-开放式推理机:基于强化学习的后训练通用高效推理

Rafael Pardinas, Ehsan Kamalloo, David Vazquez, Alexandre Drouin

机构 * ServiceNow

专题命中 规划决策 :function calling(abstract);分类 cs.LG

AI总结 本文提出Apriel-1.5-OpenReasoner,通过可复现的多领域强化学习后训练方法,在Apriel-Base上实现跨五个领域的通用高效推理,提升推理效率并优化不同难度问题的推理长度。

Comments 20 pages, 4 tables, 6 figures, appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18633 2026-04-07 cs.AI cs.ET 57%

An Onto-Relational-Sophic Framework for Governing Synthetic Minds

一个面向合成智能的本体-关系-Sophic框架

Huansheng Ning, Jianguo Ding

机构 * University of Science and Technology Beijing(北京科技大学) Blekinge Institute of Technology(布莱金厄理工学院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文提出ORS框架,通过本体论、数字人格谱系和Cybersophy三支柱,解决合成智能的治理问题,展示其在自主研究代理和医疗AI等场景中的适应性治理能力。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02335 2026-04-07 cs.RO cs.LG cs.SY eess.SY 57%

An Adaptive Grasping Force Tracking Strategy for Nonlinear and Time-Varying Object Behaviors

一种针对非线性和时变物体行为的自适应抓取力跟踪策略

Ziyang Cheng, Xiangyu Tian, Ruomin Sui, Tiemin Li, Yao Jiang

机构 * Tsinghua University(清华大学) Department of Mechanical Engineering, Tsinghua University(清华大学机械工程系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出基于LSTM网络的通用刚度估计器,解决非线性和时变物体抓取力跟踪问题,提升机器人在非结构化环境中的抓取能力。

Journal ref IEEE Transactions on Automation Science and Engineering, vol. 22, pp. 17063-17076, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04602 2026-04-07 eess.SY cs.SY math.OC 50%

Stochastic Model Predictive Control with Online Risk Allocation and Feedback Gain Selection

具有在线风险分配和反馈增益选择的随机模型预测控制

Filipe Marques Barbosa, Johan Löfberg

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种方法,通过离散凸机会约束和预计算的反馈策略集,将非凸问题转化为混合整数锥优化问题,有效解决随机模型预测控制中的风险分配与反馈策略优化问题。

Comments Updated preprint with a revised title, typographical corrections, and mathematical refinements made after its initial submission for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04459 2026-04-07 physics.soc-ph cs.CY 50%

Intercity mobility reveals the hyperbolic geometry of city systems

城际流动性揭示城市系统的双曲几何

Zhaoya Gong, Bin Liu, Chenglong Wang, Pengjun Zhao, Xiang Li, Kaixiang Zhang, Changcheng Kan, Xingjian Liu

专题命中 规划决策 :planning(abstract)

AI总结 研究通过双曲几何模型揭示城市系统中层级与接近度的交互关系,验证了12个全国城际流动性数据集,发现城市层级自下而上形成,其 hinterland 关系呈现非平稳特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04277 2026-04-07 cs.IT cs.ET math.IT 50%

Would Learning Help? Adaptive CRC-QC-LDPC Selection for Integrity in 5G-NR V2X

学习能帮助吗?面向5G-NR V2X的自适应CRC-QC-LDPC选择以提升完整性

Sarah Al-Shareeda, Gulcihan Özdemir, Arouj Fatima, Madalin-Dorin Pop, Bander A. Jabr, Yasser Bin Salamah, Jacques Demerjian

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了在5G-NR V2X通信中,通过自适应选择CRC多项式和QC-LDPC编码率是否能降低静默错误概率,采用上下文老虎机模型评估学习策略的效果。

Comments 8 pages, 6 figures, IEEE MENACOMM26, Tunisia

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20669 2026-04-07 physics.app-ph cond-mat.mtrl-sci 50%

Integrating Domain-Specialized Language Models with AI Measurement Tools for Deterministic Atomic-Resolution Experimentation

将领域专用语言模型与AI测量工具整合用于确定性原子分辨率实验

Zhuo Diao, Kouma Matsumoto, Linfeng Hou, Masahiro Ohara, Hayato Yamashita, Masayuki Abe

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种框架,通过专门的小语言模型实现扫描探针显微镜的自主控制,结合AI驱动的测量工具,实现室温下的原子分辨率SPM实验,提升实验可靠性和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18599 2026-04-07 cs.CV 50%

Restore-R1: Efficient Image Restoration Agents via Reinforcement Learning with Multimodal LLM Perceptual Feedback

Restore-R1: 通过多模态大语言模型感知反馈的强化学习图像修复代理

Jianglin Lu, Yuanwei Wu, Ziyi Zhao, Hongcheng Wang, Felix Jimenez, Abrar Majeedi, Yun Fu

机构 * Amazon(亚马逊) Northeastern University(东北大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 规划决策 :agent(abstract)

AI总结 本文提出Restore-R1框架,利用强化学习和多模态大语言模型感知反馈,高效解决图像修复问题,无需标注数据即可实现高质量修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11750 2026-04-07 cond-mat.mtrl-sci 50%

High-throughput computational framework for lattice dynamics and thermal transport including high-order anharmonicity: an application to cubic and tetragonal inorganic compounds

高通量计算框架用于晶格动力学和热传输,包括高阶非谐效应:应用于立方和四方无机化合物

Zhi Li, Huiju Lee, Chris Wolverton, Yi Xia

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出一个高通量工作流,整合高阶非谐效应以准确预测晶格热导率,针对773种立方和四方无机化合物,揭示高阶非谐效应的层次影响。

Comments 40 pages, 5 figures

Journal ref npj Comput Mater 12, 51 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12197 2026-04-07 eess.SY cs.RO cs.SY 50%

Anti-bullying Adaptive Cruise Control: A proactive right-of-way protection approach

反欺凌自适应跟车控制:一种主动优先权保护方法

Jia Hu, Zhexi Lian, Haoran Wang, Zihan Zhang, Ruoxi Qian, Duo Li, Jaehyun, So, Junnian Zheng

机构 * Key Laboratory of Road and Traffic Engineering of the Ministry of Education, Tongji University(同济大学道路与交通工程教育部重点实验室) Shanghai Motor Vehicle Inspection Certification and Tech Innovation Center Co., LTD(上海机动车检测认证技术研究中心有限公司) University College London(伦敦大学学院) Department of Transportation System Engineering, Ajou University(亚洲大学交通系统工程系) Hyperview Mobility (Shanghai) Co., Ltd.(弘景智驾(上海)科技有限公司)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出反欺凌自适应跟车控制方法,通过在线逆最优控制识别驾驶风格,并基于Stackelberg竞争构建博弈论运动规划框架,以主动保护优先权免受近距变道行为影响,提升安全性和舒适性。

Comments 16 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04082 2026-04-07 cs.CR 50%

Styx: Collaborative and Private Data Processing With TEE-Enforced Sticky Policy

Styx:基于TEE强制粘性策略的协同与隐私数据处理

Shixuan Zhao, Weicheng Wang, Ninghui Li, Zhiqiang Lin

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出Styx框架,通过整合粘性策略与可信执行环境,实现数据驱动协作中的隐私保护与政策合规,支持灵活的数据生命周期保护和动态协作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03999 2026-04-07 cs.RO 50%

Dynamic Whole-Body Dancing with Humanoid Robots -- A Model-Based Control Approach

动态全身体舞与人形机器人——一种基于模型的控制方法

Shibowen Zhang, Jiayang Wu, Guannan Liu, Helin Zhu, Junjie Liu, Zhehan Li, Junhong Guo, Xiaokun Leng, Hangxin Liu, Jingwen Zhang, Jikai Wang, Zonghai Chen, Zhicheng He, Jiayi Wang, Yao Su

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) Beijing Institute for General Artificial Intelligence (BIGAI)(北京通用人工智能研究院) Xidian University(西安电子科技大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于模型的框架,用于生成和执行人形机器人上的动态全身体舞动作。框架分为离线动作生成和在线动作执行两个阶段,利用未来状态预测实现鲁棒且动态的舞动动作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03890 2026-04-07 cs.RO 50%

From Prompt to Physical Action: Structured Backdoor Attacks on LLM-Mediated Robotic Control Systems

从提示到物理行动:针对LLM介导机器人控制系统结构后门攻击

Mingyang Xie, Jin Wei-Kocsis

机构 * School of Applied and Creative Computing, Purdue University(普渡大学应用与创意计算学院)

专题命中 规划决策 :agentic(abstract)

AI总结 研究探讨了LLM介导的机器人控制系统中结构后门攻击的影响,通过LoRA技术验证了后门在不同命令生成阶段的传播效果,并提出基于二次LLM的验证防御方法,揭示了实时机器人系统中的安全与响应权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03872 2026-04-07 cs.LO cs.MA 50%

Strategies in Sabotage Games: Temporal and Epistemic Perspectives

博弈策略:时间与认知视角

Nina Gierasimczuk, Katrine B. P. Thoft

专题命中 规划决策 :agent(abstract)

AI总结 本文从时间视角用ATL$^\ast$分析Sabotage游戏,并探讨其认知扩展中的玩家不确定性,为动态图的时间属性推理提供新框架。

Comments 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03581 2026-04-07 cs.RO cs.CV 50%

HAD: Combining Hierarchical Diffusion with Metric-Decoupled RL for End-to-End Driving

HAD:结合分层扩散与度量解耦RL的端到端驾驶

Wenhao Yao, Xinglong Sun, Zhenxin Li, Shiyi Lan, Zi Wang, Jose M. Alvarez, Zuxuan Wu

机构 * Fudan University(复旦大学) NVIDIA(英伟达)

专题命中 规划决策 :planning(abstract)

AI总结 HAD提出一种端到端规划框架,结合分层扩散策略与度量解耦RL,通过结构保持轨迹扩展生成真实轨迹并提升驾驶目标优化效果,实验表明在NAVSIM和HUGSIM上取得新突破。

Comments 17 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03543 2026-04-07 cs.HC 50%

YT-Pilot: Turning YouTube into Structured Learning Pathways with Context-Aware AI Support

YT-Pilot:利用上下文感知的AI支持将YouTube转化为结构化学习路径

Dina Albassam, Kexin Quan, Mengke Wu, Sanika Pande, ChengXiang Zhai, Yun Huang

专题命中 规划决策 :planning(abstract)

AI总结 YT-Pilot基于自我调节学习理论,通过结构化学习路径提升用户在YouTube上的目标清晰度、路径连贯性和进度跟踪能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03505 2026-04-07 cs.CV 50%

Multimodal Urban Tree Detection from Satellite and Street-Level Imagery via Annotation-Efficient Deep Learning Strategies

通过高效深度学习策略实现多模态城市树木检测:结合卫星和街景图像

In Seon Kim, Ali Moghimi

机构 * Department of Computer Science, University of California, Davis(加州大学戴维斯分校计算机科学系) Department of Biological and Agricultural Engineering, University of California, Davis(加州大学戴维斯分校生物与农业工程系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出多模态框架,结合高分辨率卫星图像与地面Google街景图像,实现低标注条件下城市树木的高效检测。通过领域自适应和三种学习策略(半监督、主动学习、混合策略),提升检测精度,混合策略F1-score达0.90,显著优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏