arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1921 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1921 篇

2607.00622 2026-07-02 cs.CV 新提交 50%

Learning to Watch: Active Video Anomaly Understanding via Interleaved Policy Optimization

学习观察:通过交错策略优化的主动视频异常理解

Mengjingcheng Mo, Jiaxu Leng, Xinbo Gao

机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications, Chongqing, China(重庆邮电大学计算机科学与技术学院) School of Computer Science(计算机科学学院) Chongqing College of Artificial Intelligence, Chongqing, China(重庆人工智能学院)

专题命中 规划决策 :agent(abstract)

AI总结 提出Anom-π闭环框架,将视频异常理解建模为主动序列决策过程,通过交错策略统一内部推理与证据获取,并设计iDPO实现轨迹级策略对齐,仅2B参数即超越大规模模型。

Comments Accepted at ICML 2026; 25 pages, 8 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00420 2026-07-02 cs.HC 新提交 50%

A Simple Solution to Improving Human Supervision of Algorithms: Evidence from Smart Vending

改善人类对算法监督的简单解决方案:来自智能售货机的证据

Minda Zhao, Brian Rongqing Han, Xin Chen, Tao Zhu

专题命中 规划决策 :planning(abstract)

AI总结 通过限制人工干预次数,让工人优先选择高价值干预,在减少库存的同时不损害销售,为人类监督AI提供低成本可扩展方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00399 2026-07-02 cs.CV 新提交 50%

DriveVer: Lightweight Trajectory Evaluator as Test-Time Verifier for Autonomous Driving

DriveVer: 自动驾驶的轻量级轨迹评估器作为测试时验证器

Chong He, Yuechen Luo, Fang Li, Shaoqing Xu, Fuxi Wen

机构 * Tsinghua University(清华大学) University of Macau(澳门大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出DriveVer,一种轻量级即插即用的测试时验证器,通过双头架构融合候选轨迹与多视图视觉特征,预测安全置信度和几何修正向量,在不增加训练成本下提升规划模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00189 2026-07-02 cs.CV 新提交 50%

VOCA: Visual Odometry with Codec Awareness

VOCA: 具有编解码感知的视觉里程计

Nouri Alexander Hilscher, Mateo de Mayo, Dominik Muhle, Christoph Otten genannt Hermes, Daniel Cremers

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 规划决策 :planning(abstract)

AI总结 提出VOCA方法,利用视频编解码信息改进压缩流上的立体视觉里程计跟踪性能,在因果VO上达到最先进的相对轨迹误差和效率。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00160 2026-07-02 cs.RO 新提交 50%

Distributed Multi Robot Lunar Cargo Transportation via Phase Decomposed Reinforcement Learning

基于相位分解强化学习的分布式多机器人月球货物运输

Ashutosh Mishra, Elian Neppel, Shreya Santra, Antoine Jonquières, Muhammad Athallah Naufal, Kentaro Uno, Kazuya Yoshida

机构 * Tohoku University(东北大学) École Centrale de Lille(里尔中央理工学院) Institut Teknologi Bandung(万隆理工学院)

专题命中 规划决策 :agent(abstract)

AI总结 提出相位分解强化学习框架,将月球货物运输分解为提升、运输和放置三个阶段,分别优化联合状态策略,实现分布式机器人协同运输,仿真和硬件实验验证了可靠性。

Comments 8 pages, 9 Figures, Accepted at IROS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00148 2026-07-02 cs.RO cs.CV 新提交 50%

3D Point World Models: Point Completion Enables More Accurate Dynamics Learning

3D点云世界模型:点云补全实现更准确的动力学学习

Skand Peri, Hung Nguyen, Chanho Kim, Li Fuxin, Stefan Lee

机构 * Oregon State University(俄勒冈州立大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出3D点云世界模型(3DPWM),通过先补全部分点云再学习动作条件动力学,实现长时程可靠推演和精确成本评估,支持多种机器人操作任务。

Comments 21 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00115 2026-07-02 cs.CV 新提交 50%

PixelEyes: Decoupling Perception and Reasoning for Pinpoint Visual Evidence Seeking

PixelEyes: 解耦感知与推理以实现精准视觉证据查找

Dengxian Gong, Yuanzheng Wu, Haobo Yuan, Zhengdong Hu, Tao Zhang, Yikang Zhou, Shihao Chen, Quanzhu Niu, Kai Wang, Jason Li, Haochen Wang, Lu Qi, Shunping Ji, Ming-Hsuan Yang

机构 * Wuhan University(武汉大学) UC Merced(加州大学默塞德分校) UTS(UTS大学) NUS(新加坡国立大学) NTU(南洋理工大学) CASIA(中国科学院自动化所)

专题命中 规划决策 :agent(abstract)

AI总结 针对多轮视觉推理中目标定位失败导致轨迹冗余的问题,提出PixelEyes,通过解耦推理与感知(推理器决定查找目标,专用感知工具定位),引入掩码引导视觉搜索和语义区域广度优先搜索,构建PixelEyes-6K数据集和Pinpoint-Bench基准,显著提升定位准确性。

Comments 22pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00024 2026-07-02 cs.RO cs.MA cs.SY eess.SY 新提交 50%

Decentralized Geometric Control for Cable-Suspended Payload Transport with Adaptive Mass Estimation

基于自适应质量估计的缆绳悬挂载荷运输的分散几何控制

Hadi Hajieghrary, Benedikt Walter, Paul Schmitt, Miguel Hurtado

机构 * MassRobotics

专题命中 规划决策 :agent(abstract)

AI总结 提出GPAC四层分层架构,通过隐式协调实现多四旋翼无中心协调运输缆绳悬挂载荷,结合几何控制、自适应质量估计和CBF安全滤波,仿真显示低计算成本下平均跟踪误差33.8厘米。

Comments Accepted to be presented at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31483 2026-07-02 cs.RO 新提交 50%

A Large-Language-Model Supported Personalized Driving Framework for Lane Change in Highway Scenarios

大语言模型支持的高速公路换道场景个性化驾驶框架

Dong Bi, Yongqi Zhao, Paul Kovacevic, Tomislav Mihalj, Ji Zhou, Jiayuan Gong, Arno Eichberger

机构 * Hubei University of Automotive Technology(湖北汽车工业学院) Graz University of Technology(格拉茨技术大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种LLM支持的个性化驾驶框架,通过映射自然语言指令到Apollo规划参数,结合聚类和风格强度排序生成可区分的换道行为,并利用检索增强生成解释隐式指令。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31433 2026-07-02 physics.space-ph astro-ph.HE astro-ph.SR 新提交 50%

A new model for long-term forecasting of Galactic cosmic rays

银河宇宙线长期预测的新模型

David Pelosi, Fernando Barão, Bruna Bertucci, Emanuele Fiandrini, Miguel Orcinha, Nicola Tomassetti

专题命中 规划决策 :planning(abstract)

AI总结 提出基于日球层带电粒子输运数值模型的银河宇宙线长期预测框架,通过希尔伯特-黄变换滤波和太阳代理参数延迟相关性,实现多物种通量准确预测,支持空间辐射监测与十年尺度预测。

Comments 21 pages, 12 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31780 2026-07-01 econ.TH 新提交 50%

A Cost-and-Place-Utility Model of the Move-versus-Commute Decision

移动与通勤决策的成本与地点效用模型

Shawn Berry

专题命中 规划决策 :agent(abstract)

AI总结 提出一个代数模型,将住房成本、通勤费用、收入约束、社会联系和地点效用纳入统一框架,基于30%住房可负担规则推导决策规则,用于分析家庭在通勤与搬迁之间的选择。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30816 2026-07-01 stat.AP 新提交 50%

Spatial Dependence in the Self-Response: Spatial Dependence, Modeling, and Operational Consequences

自我响应中的空间依赖性:空间依赖、建模与操作后果

Emanuel Ben-David

专题命中 规划决策 :planning(abstract)

AI总结 本文使用2010年美国人口普查数据,通过比较空间自回归模型族,发现OLS残差存在强空间自相关,且误差型依赖(SEM/SDEM)比全局内生滞后过程更优,建议采用空间交叉验证评估响应模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31487 2026-07-01 cs.RO 新提交 50%

Energy-Optimal Spatial Iterative Learning within a Virtual Tube

虚拟管道内的能量最优空间迭代学习

Chen Min, Shuli Lv, Pengda Mao, Huixin Cao, Li Hong, Quan Quan

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Tianmushan Laboratory, Beihang University(北京航空航天大学天目山实验室)

专题命中 规划决策 :planning(abstract)

AI总结 针对无人机续航受限问题,提出一种无模型在线迭代学习框架,通过O(n)复杂度的空间迭代优化降低能耗,在实验中比基于模型的IPOPT快50-60倍。

Comments 9 pages, 7 figures, submitted to RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31293 2026-07-01 cs.CV 新提交 50%

Deep Spectral Models for Robust Dental Shape Generation

用于鲁棒牙齿形状生成的深度谱模型

Tibor Kubík, François Guibault, Michal Španěl, Hervé Lombaert

机构 * Polytechnique Montréal(蒙特利尔理工学院) Brno University of Technology(布尔诺理工大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出 ToothForge 框架,利用谱域同步嵌入学习紧凑的牙齿冠部几何生成模型,在有限数据集上实现与空间方法相当的性能,并保持紧凑性和几何可解释性。

Comments Accepted for publication at the Journal of Machine Learning for Biomedical Imaging (MELBA) https://melba-journal.org/2026:016

Journal ref Machine.Learning.for.Biomedical.Imaging. 2026 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31101 2026-07-01 cs.RO 新提交 50%

Efficient Sim-to-Real Transfer of World-Action Models from Synthetic Priors

基于合成先验的世界-动作模型的高效仿真到现实迁移

Zixing Wang, Kausik Sivakumar, Jinghuan Shang, Yafei Hu, Zhaoming Xie, Ran Gong, Xiaohan Zhang, Karl Schmeckpeper

机构 * Purdue University(普渡大学) Robotics and AI Institute(机器人与人工智能研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文研究从合成先验训练世界-动作模型并零样本部署到真实机器人操作,通过域随机化和AnyTask运动规划生成演示,首次成功实现仿真到现实的迁移。

Comments This work is accepted by CVPR'26, Embodied AI Workshop. This paper represent a part of early result of our official world-action model zero-shot sim-to-real transfer work, which will be released soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31029 2026-07-01 cs.CV 新提交 50%

TerraDiT-$Ω$: Unified Spatial Control for Satellite Image Synthesis with Any Geospatial Primitive

TerraDiT-$\Omega$:任意地理基元的卫星图像合成统一空间控制

Brian Wei, Srikumar Sastry, Daniel Cher, Eric Xing, Nathan Jacobs

机构 * Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出TerraDiT-Ω框架,通过几何感知局部注意力机制,支持从任意原生地理基元(多边形、折线、边界框、点)直接生成卫星图像,在多种控制格式下优于密集和稀疏控制基线,并提升下游任务性能。

Comments European Conference on Computer Vision 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22973 2026-07-01 cs.DC 新提交 50%

Decentralized Operations of Decarbonized Chemical Plants with Renewable-driven Transmission Systems

脱碳化化工厂与可再生能源驱动输电系统的去中心化运营

Richard Reed, Kazi Arman Ahmed, Saba Ghasemi, Zheyu Jiang, Paritosh Ramanan

专题命中 规划决策 :planning(abstract)

AI总结 提出基于数据隔离的隐私友好去中心化框架,联合优化电力系统机组组合与电化学裂解厂微电网调度,采用ADMM加速收敛,在德州电网模型上验证了数据隔离导致的最优性间隙小且排放影响非单调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15305 2026-07-01 cs.CV 新提交 50%

CoMNet: A MedNeXt-CorrDiff Framework for Multi-Site Brain Tumor Segmentation

CoMNeT: 一种用于体积脑肿瘤分割的MedNeXt-CorrDiff框架

Michael L. Evans, MD Fayaz Bin Hossen, MD Shibly Sadique, Walia Farzana, Khan M. Iftekharuddin

机构 * Old Dominion University(欧道明大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出CoMNeT框架,结合3D卷积分割模型MedNeXt与校正扩散后处理CorrDiff,通过集成学习提升胶质瘤分割精度,在UTSW-Glioma数据集上取得优于基线模型的Dice分数。

Comments 15 pages, 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27966 2026-06-29 cs.CR 新提交 50%

Decoys Cannot Go Everywhere: Mapping the Deception Surface in MITRE ATT&CK

诱饵无法无处不在:映射MITRE ATT&CK中的欺骗面

Veronica Valeros, Carlos Catania, Viliam Lisý, Harm Griffioen

专题命中 规划决策 :planning(abstract)

AI总结 本文提出四准则评估框架,分析MITRE ATT&CK v18.1中250种技术,发现仅32%可部署诱饵,并总结出Sweep和Seek两种部署模式。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27671 2026-06-29 cs.CV 新提交 50%

Multi-Modal Conditioned High-Resolution Transformer for Urban Electromagnetic Field Map Prediction Download PDF

面向城市电磁场地图预测的多模态条件高分辨率Transformer

Do-Eon Kim, Dongryul Park, Seungyoung Ahn, Namwoo Kang, Seong-heum Kim, Seongsin Kim

机构 * Soongsil University(崇实大学) Cho Chun Shik Graduate School of Mobility, Korea Advanced Institute of Science and Technology(韩国科学技术院赵春植移动研究生院) Department of Intelligent Semiconductors, Soongsil University(崇实大学智能半导体系)

专题命中 规划决策 :planning(abstract)

AI总结 提出多条件密集预测框架,利用高分辨率Transformer骨干网络,结合特征线性调制和交叉注意力机制,从建筑布局和天线配置生成500×500电磁场地图,通过复合损失函数和测试时增强提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27644 2026-06-29 cs.CV 新提交 50%

CascadeOcc: Rethinking 3D Occupancy World Models with Cascaded VQ Representations

CascadeOcc: 用级联VQ表示重新思考3D占用世界模型

Kyumin Hwang, Wonhyeok Choi, Jaeyeul Kim, Jihun Park, Daehee Park, Sunghoon Im

机构 * Daegu Gyeongbuk Institute of Science and Technology (DGIST)(大邱庆北科学技术院)

专题命中 规划决策 :planning(abstract)

AI总结 提出CascadeOcc,一种通过级联向量量化机制在自回归框架中利用占用表示内在结构层次,实现从粗到细的3D场景预测和运动规划,在4D占用预测和运动规划基准上取得优越性能。

Comments Accepted to IEEE Signal Processing Letters (SPL), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28312 2026-06-29 math.OC q-fin.MF 新提交 50%

Optimal Deployment of Electric Aircraft for Canadian Domestic Flights

加拿大国内航班的电动飞机优化部署

Elham Soufiani, Mehrdad Pirnia

专题命中 规划决策 :planning(abstract)

AI总结 提出多周期混合整数线性规划框架,联合优化机队、基础设施和服务分配,以加拿大Helijet短途网络为例,表明电动化可在五年内减排超70%且经济可行,但受机队容量限制导致需求未满足。

Comments 6 pages, 4 images, Presented at the IEEE ITEC EATS 2026 (Transportation Electrification Conference and Expo or Electric Aircraft Technologies Symposium) took place from June 10-12, 2026, at the VIBE Credit Union Showplace in Novi, Michigan

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26567 2026-06-26 eess.SP 新提交 50%

Multi-Modal Environment-Aware Beam Management for Massive MIMO: A Geometry-Driven Virtual Base Station Framework

大规模MIMO的多模态环境感知波束管理:一种几何驱动的虚拟基站框架

Yijie Bian, Wei Guo, Jie Yang, Shenghui Song, Jun Zhang, Shi Jin, Khaled B. Letaief

专题命中 规划决策 :agent(abstract)

AI总结 提出几何驱动框架,利用3D LiDAR点云和位置信息构建虚拟基站数据库,通过镜像对称建模主导反射路径,实现粗信道重建和低开销波束训练,并采用双智能体深度强化学习协调波束选择,提升波束管理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26828 2026-06-26 cs.CV 新提交 50%

Learning Adversarial Augmentation Policies for Robust Garlic Seedling Detection

学习对抗性增强策略以实现鲁棒的大蒜幼苗检测

Soeun Lee, Chanho Kim, Yeji Kang, YoungKi Hong, Byeongkeun Kang

机构 * Chung-Ang University(中央大学) National Institute of Agricultural Sciences(国立农业科学研究院)

专题命中 规划决策 :agent(abstract)

AI总结 针对地面监测中光照不均导致的幼苗检测鲁棒性问题,提出基于对抗性增强策略学习的框架,联合优化增强策略与检测器,在自建数据集上AP50达91.6%,且不增加推理开销。

Comments 16 pages

Journal ref Computers and Electronics in Agriculture, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26706 2026-06-26 cs.CV 新提交 50%

Intracranial Aneurysm Classification and Segmentation via Tri-Axial ROI and Multi-Task Learning

基于三轴ROI和多任务学习的颅内动脉瘤分类与分割

Pengcheng Shi, Kaiyuan Yang, Houjing Huang, Jiawei Chen, Yan Lu, Jiaqi Liu, Murong Xu, Bjoern Menze, Xinglin Zhang

机构 * Medical Image Insights Co. Ltd.(医学影像洞察有限公司) University of Zurich(苏黎世大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出多任务框架,结合2D三轴ROI提取与3D多任务nnU-Net,同时实现13个解剖位置的动脉瘤多标签分类、多类分割和血管分割,在RSNA 2025挑战中获第二名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26377 2026-06-26 cs.CR 新提交 50%

Verifying Intent and Harm: A Unified Defense Against LLM-Generated Threats

验证意图与危害:针对LLM生成威胁的统一防御

Poojitha Thota, Yun Lei, Santhosh Thangaraj, Siddhartha Reddy Jonnalagadda, Shirin Nilizadeh

专题命中 规划决策 :agent(abstract)

AI总结 提出一种联合验证用户提示意图和模型响应危害的防御框架,通过专门分析器与裁决器协同工作,在五个威胁类别上平均F1提升至0.95,攻击成功率降至4.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26341 2026-06-26 cs.RO 新提交 50%

Scaling Nonlinear Optimization: Many Problems One GPU

扩展非线性优化:多问题单GPU

John Viljoen, Johanna Haffner, Masayoshi Tomizuka, Negar Mehr

机构 * Department of Mechanical Engineering, University of California, Berkeley(加州大学伯克利分校机械工程系) Department of Biosystems Science and Engineering, ETH Zürich(苏黎世联邦理工学院生物系统科学与工程系)

专题命中 规划决策 :planning(abstract)

AI总结 提出首个基于JAX的GPU批处理NLP求解器jaxipm,通过异构迭代融合和迭代级批处理实现多问题并发求解,在四旋翼控制任务中吞吐量提升达32.85倍。

Comments 8 pages, 6 figures, ieeeconf style, submission for RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26201 2026-06-26 cs.RO 新提交 50%

OmniContact: Chaining Meta-Skills via Contact Flow for Generalizable Humanoid Loco-Manipulation

OmniContact: 通过接触流链接元技能实现可泛化的人形移动操作

Runyi Yu, Xiaoyi Lin, Ji Ma, Yinhuai Wang, Koukou Luo, Jiahao Ji, Huayi Wang, Wenjia Wang, Runhan Zhang, Ping Tan, Ting Wu, Ruoli Dai, Qifeng Chen, Lei Han

机构 * Noitom Robotics(诺亦腾机器人) The Hong Kong University of Science and Technology(香港科技大学) Wuhan University(武汉大学) The University of Hong Kong(香港大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出以接触流为核心的分层框架,通过低层策略学习统一技能库、高层模块合成未来接触流序列,实现人形机器人长时程任务的鲁棒执行与自主恢复,在搬运箱子和推叠箱子任务上分别达到98.7%和76.5%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26175 2026-06-26 cs.RO 新提交 50%

RMTL: Reinforced Micro-task Learning for Long-Horizon Manipulation with VLM Rewards

RMTL: 基于强化微任务学习与VLM奖励的长时域操作

Anıl Can Ateş, Orhan Kahraman, Cihan Topal

机构 * Istanbul Technical University(伊斯坦布尔理工大学)

专题命中 规划决策 :agent(abstract)

AI总结 针对长时域操作中单提示VLM奖励信号稀疏的问题,提出RMTL方法,将任务分解为语言描述的微任务,通过多视角VLM奖励和反向课程学习加速训练,并学习层次化策略切换微任务。

Comments 16 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26765 2026-06-26 cs.PF math.OC 新提交 50%

On-Demand Service Zone Design for Energy-Constrained Spatial Queueing Systems

面向能量受限空间排队系统的按需服务区域设计

Peng Lin, Cheng Hua, Wei Qi, Kai Wang

专题命中 规划决策 :planning(abstract)

AI总结 针对电动服务车辆(ESV)的电池限制,提出能量受限超立方体空间排队模型,结合半马尔可夫过程估计稳态性能,并构建联合选址-分区问题,通过分支-定价-评估框架求解,发现能量建模可减少虚假服务承诺,且需求增加时更紧的区域划分更有利。

详情

展开后加载摘要…

URL PDF HTML 收藏