arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 6674 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1921 篇

2607.08449 2026-07-10 cs.CV cs.LG 新提交 57%

Predicting Viticulture Potential through an Ensemble of U-Net and a Geospatial Foundation Model

通过U-Net和地理空间基础模型的集成预测葡萄种植潜力

Jorge Ignacio Perez, Hwaai Kang Kee, Lucas Rassbach

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对ImageCLEF AI4Agri 2026法国南部葡萄种植潜力预测子任务,DS@GT ARC团队采用U-Net和地理空间基础模型集成方法,其最佳模型准确率达68.32,在7个团队中排第二,且实现已公开。

Comments To be published in CLEF 2026 Working Notes

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08443 2026-07-10 cs.NI cs.AI 新提交 57%

ADORN: Adaptive Drift handling for Open RAN using Reinforcement Learning

ADORN:使用强化学习的开放式RAN自适应漂移处理

Ashit Kumar Subudhi, Bhargav Chirumamilla, Shubham Vaishnav, Mduduzi C. Hlophe, Praveen Kumar Donta, Andrea Fumagalli, Venkateswarlu Gudepu, Koteswararao Kondepu

机构 * Indian Institute of Technology Dharwad, Karnataka, India(印度理工学院达拉德分校) University of Pretoria, Pretoria, South Africa(南非彼得里亚大学) Johns Hopkins University, USA(约翰霍普金斯大学) Stockholm University, Sweden(斯德哥尔摩大学) Open Networking Advanced Research (OpNeAR) Lab, The University of Texas at Dallas, TX, USA(开放网络高级研究实验室,德克萨斯大学达拉斯分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 针对开放式无线接入网络中因动态流量变化导致的模型性能下降问题,提出基于Q学习的自适应重新训练方法,通过将决策制定为马尔可夫决策过程,结合多专家长短期记忆集成,有效降低重新训练开销并维持系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08436 2026-07-10 cs.RO cs.AI 新提交 57%

EgoWAM: World Action Models Beyond Pixels with In-the-Wild Egocentric Human Data

EgoWAM:利用野外自我中心人类数据超越像素的世界行动模型

Baoyu Li, Xinchen Yin, Mengying Lin, Yixin Zhang, Danfei Xu

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究利用野外自我中心人类数据训练机器人操纵模型,引入EgoWAM框架,固定部分设置仅改变世界预测目标,比较不同方法。结果表明WAM协同训练更有效,DINO和3D流提升显著,为机器人操纵提供新训练思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08357 2026-07-10 cs.AI 新提交 57%

MobiDiff: Semantic-Aware Multi-Channel Discrete Diffusion for Human Mobility Data Generation

MobiDiff:用于人类移动性数据生成的语义感知多通道离散扩散

Rongchao Xu, Lin Jiang, Dahai Yu, Ximiao Li, Taichi Liu, Desheng Zhang, Yuan Tian, Guang Wang

机构 * Florida State University(佛罗里达州立大学) Rutgers University(罗格斯大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究旨在解决人类移动性数据生成难题,提出MobiDiff框架,通过直接对多通道语义骨架去噪生成数据,避免复杂管道。该框架能分解事件通道并采用掩码捕获移动模式与依赖性,实验证明其在保真度、隐私保护和效率上表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07763 2026-07-10 cs.LG 新提交 57%

Unlocking Temporal Generalization in Hamiltonian Video Dynamics Models

解锁哈密顿视频动力学模型中的时间泛化

Eli Laird, Corey Clark

机构 * Department of Computer Science, Southern Methodist University(南卫理公会大学计算机科学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究世界模型在可变时间分辨率下预测动力学的问题,利用哈密顿生成网络(HGN),指出其在非保守环境中时间泛化失效的问题及原因,通过针对性修复实现稳定动力学预测,推荐连续时间视频生成中时间泛化的策略。

Comments To appear in the 1st Workshop on Physics-Aware Video Generation and Restoration at the 28th International Conference on Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07761 2026-07-10 cs.AI 新提交 57%

Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning

对齐临床需求与人工智能能力:医学推理大语言模型综述

Qi Peng, Jiatong Li, Sirui Huang, Yiyang Jiang, Kaisong Gong, Ronger Ding, Shijie Ye, Changmeng Zheng, Yi Cai, Xiaobo Yang, Jin Huang, Xiao-Yong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Hong Kong University(香港大学) South China University of Technology(华南理工大学) University of Toronto(多伦多大学) Peking Union Medical College Hospital(北京地坛医院) West China Hospital, Sichuan University(四川大学华西医院)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 综述医学大语言模型在医疗领域的进展,提出双视角方法,连接临床实践与计算方法,建立五级能力方案并关联推理模式与医学任务,引入基准数据集并报告模型结果,讨论进展与挑战及未来方向。

Comments Accepted by Machine Intelligence Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07292 2026-07-09 cs.CV cs.AI 新提交 57%

CarbonCLIP: Enhance Carbon Prediction from Satellite Imagery via Integrated Street-View Semantics and Temporal Context Training

CarbonCLIP:通过集成街景语义和时间上下文训练增强卫星图像的碳排放预测

Zeru Yang, Fang-Ying Gong, Steve H. L. Yim, Chau Yuen

机构 * Energy Research Institute at NTU(国立理工学院能源研究所) Interdisciplinary Graduate Programme(跨学科研究生项目) School of Electrical and Electronic Engineering(电气电子工程学院) School of Public Administration and Policy(公共管理与政策学院) Asian School of the Environment(亚洲环境学院) Center for Climate Change and Environmental Health(气候变化与环境健康中心)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对城市碳排放预测难题,CarbonCLIP提出多模态蒸馏框架,通过双分支对比学习,利用街景语义和时间上下文训练增强卫星图像碳排放预测,实验证明该方法优于基线,为卫星碳建模提供有力支持。

Comments Accepted by IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing. 21 pages, 6 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07252 2026-07-09 cs.LG cs.RO 新提交 57%

Safe Reinforcement Learning using Ideas from Model Predictive Control

利用模型预测控制思想的安全强化学习

Georg Schäfer, Jakob Rehrl, Stefan Huber, Simon Hirlaender

机构 * Salzburg University of Applied Sciences(萨尔茨堡应用科学大学) Paris Lodron University of Salzburg(萨尔茨堡巴黎洛德伦大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 针对强化学习在安全约束方面的挑战,提出结合深度强化学习与模型预测控制的通用框架,利用系统动力学模型定义可行状态 - 动作空间,经安全过滤器投影动作,在实验室试验台验证该方法可成功探索并稳定收敛。

Comments Accepted at Eurocast 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06820 2026-07-09 cs.AI 新提交 57%

Evaluating SageMath-Augmented LLM Agents for Computational and Experimental Mathematics

评估用于计算和实验数学的SageMath增强型大语言模型智能体

Pavel Snopov, German Magai

机构 * The Sage Developers(Sage开发者团队)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 研究聚焦AI在数学领域进展,提出结合大语言模型推理与SageMath反馈的智能体设置,改进RealMath基准。实验表明该设置能提升模型性能,缩小模型差距,CAS增强型智能体在计算探索上有潜力,朝自动猜想发现迈进。

Comments 37 pages, 16 figures, accepted to 3rd AI for Math Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06642 2026-07-09 cs.LG 新提交 57%

The Approximation Ratio for the Risk of Myopic Bayesian Active Learning for Linear Regression

线性回归中近视贝叶斯主动学习风险的近似率

Stephen Mussmann

机构 * School of Computer Science(计算机科学学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究线性回归中近视贝叶斯主动学习风险的近似率,核心方法是证明贪心算法风险的近似率,主要贡献是得出该近似率在最大初始杠杆得分上线性相关,并通过数值模拟说明结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06622 2026-07-09 eess.SY cs.LG cs.SY 新提交 57%

Creating Power Distribution Network Layouts Using Generative Adversarial Networks and Image-Based Representations

使用生成对抗网络和基于图像的表示创建配电网布局

Juan Manuel Garcia-Perez, Carlos Mateo

机构 * School of Engineering (ICAI), Comillas Pontifical University(工程学院(ICAI),卡利斯大学) Institute for Research in Technology (IIT), School of Engineering (ICAI), Comillas Pontifical University(技术研究所(IIT),工程学院(ICAI),卡利斯大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究提出基于生成对抗网络的框架,用基于图像的表示创建配电网布局,通过GIS数据集准备、GAN架构设计等进行训练,能再现馈线拓扑并与地理结构对齐,构成现有方法的数据驱动补充,为新区域电气化布局提供思路。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06619 2026-07-09 cs.AR cs.LG 新提交 57%

HiFuzz: Hierarchical Reinforcement Learning for Semantic-Aware and Adaptive CPU Fuzzing

HiFuzz:用于语义感知和自适应CPU模糊测试的分层强化学习

Ya Wang, Hanwei Fan, Zhenguo Liu, Xiaofeng Zhou, Yangdi Lyu, Jiang Xu, Wei Zhang

机构 * Hong Kong University of Science and Technology (HKUST), Hong Kong(香港科技大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 针对传统变异模糊测试在处理器验证中效率低的问题,提出HiFuzz框架,采用分层强化学习及结构化生成过程,集成自适应机制与编码器,经实验验证,该框架在覆盖率和漏洞检测上显著优于现有工具。

Comments Accepted by the 2026 IEEE International Test Conference (ITC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06522 2026-07-08 cs.AI cs.CV 新提交 57%

Bridging Physical Reasoning and Task Generalization via Visual Action Outcome Reasoning Alignment

通过视觉动作结果推理对齐实现物理推理与任务泛化的桥梁

Han-Jun Ko, Jr-Jen Chen, Haobo Yuan, Hsin-Ying Lee, Tiancheng Shen, Ming-Hsuan Yang, Yu-Chiang Frank Wang

机构 * National Taiwan University(国立台湾大学) The University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究针对视觉语言模型在物理推理中难以泛化的问题,提出VAORA奖励设计,包括视觉对齐奖励和视觉-动作对齐奖励,通过预训练专家估计概率实现平滑密集奖励,经实验验证可有效提升模型在新任务和未见环境中的物理推理性能。

Comments ICML'26 Workshop RLxF: Reinforcement Learning from World Feedback

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06223 2026-07-08 cs.AI 新提交 57%

Information Gain-based Rollout Policy Optimization: An Adaptive Tree-Structured Rollout Approach for Multi-Turn LLM Agents

基于信息增益的展开策略优化:一种用于多轮语言模型智能体的自适应树结构展开方法

Yijun Zhang, Fan Xu, Jiaxin Ding, Yule Xie, Shiqing Gao, Xin Ding, Haoxiang Zhang, Luoyi Fu, Xinbing Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究针对LLM智能体长期搜索任务中展开预算分配不合理问题,提出基于信息增益的展开策略优化(IGRPO),通过按节点信息性分配预算进行树结构展开,并利用诱导教师分布指导策略优化,实验验证该方法在相同预算下优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06004 2026-07-08 cs.SE 新提交 57%

Large Language Models Have Unreliable Understanding of Software Engineering Terminology

大语言模型对软件工程术语的理解不可靠

Huzaifa Ejaz, Fabian C. Peña, Steffen Herbold

专题命中 规划决策 :agentic(abstract);分类 cs.SE

AI总结 研究大语言模型对软件工程术语的理解程度,通过用正确及伪造定义提示,测量分类准确率与推理令牌合理性,发现多数模型虽能检测伪造定义,但存在拒绝正确定义的偏差,明确推理未持续改善结果,揭示了LLMs在术语理解上的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05722 2026-07-08 cs.CL 新提交 57%

Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

Nemotron-Labs-Diffusion:一种统一自回归、扩散和自推测解码的三模式语言模型

Yonggan Fu, Lexington Whalen, Abhinav Garg, Chengyue Wu, Maksim Khadkevich, Nicolai Oswald, Enze Xie, Daniel Egert, Sharath Turuvekere Sreenivas, Shizhe Diao, Chenhan Yu, Ye Yu, Weijia Chen, Sajad Norouzi, Jingyu Liu, Shiyi Lan, Ligeng Zhu, Jin Wang, Jindong Jiang, Morteza Mardani, Mehran Maghoumi, Song Han, Ante Jukić, Nima Tajbakhsh, Jan Kautz, Pavlo Molchanov

机构 * Nemotron-Labs(Nemotron实验室)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 介绍了统一AR、扩散和自推测解码的三模式语言模型Nemotron-Labs-Diffusion,通过联合目标训练,能切换模式。研究表明其目标互补,自推测模式表现优,有长期潜力,该模型家族在精度和速度上优于现有开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06017 2026-07-08 cs.LG math.OC 新提交 57%

Learning When to Automate: Queue Control in Human-AI Service Systems

学习何时自动化:人机服务系统中的队列控制

Giovanni Montanari, Marco Scarsini, Vianney Perchet

机构 * Inria(法国国家信息与自动化研究所) CREST(法国国立统计与经济管理学院) ENSAE(法国国立统计与经济管理学院) Institut Polytechnique de Paris(巴黎综合理工学院) Luiss University(罗马路易斯大学) Criteo AI Lab(Criteo人工智能实验室)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究人机服务系统中任务处理的资源分配问题,提出UCB - DPP策略,结合上置信界与漂移加惩罚控制学习未知参数并做队列感知决策,实现\(\widetilde{\mathcal{O}}(K\sqrt{T})\)遗憾值,保证人工服务队列平均速率稳定性,优于自然基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05758 2026-07-08 cond-mat.mtrl-sci cs.LG 新提交 57%

From Closed-Loop Optimization to Open Decision Making: Coupled Digital Twins for Predictive and Autonomous Microscopy

从闭环优化到开放决策:用于预测性和自主性显微镜的耦合数字孪生

Yu Liu, Boris Slautin, Ian Mercer, Jon-Paul Maria, Sergei V. Kalinin

机构 * Department of Materials Science and Engineering, University of Tennessee, Knoxville, Tennessee, 37996, USA(田纳西大学材料科学与工程系) Materials Science and Engineering Department, Materials Research Institute, the Pennsylvania State University, University Park, Pennsylvania, 16802, USA(宾夕法尼亚州立大学材料研究学院材料科学与工程系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究从闭环优化到开放决策的自动化实验,提出耦合数字孪生框架,通过样本孪生和仪器孪生分别编码材料状态与信号等,用于预测显微镜操作等,以力 - 距离曲线编码器等实现框架,为预测性操作和自主实验规划奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03593 2026-07-07 eess.IV cs.AI cs.CV 新提交 57%

An Interpretable Deep Learning Framework for Discovery and Clinical Validation of Deep Radiomic Signatures in Tumor Classification

用于深度影像组学特征在肿瘤分类中发现与临床验证的可解释深度学习框架

Chengkun Sun, Jinqian Pan, Renjie Liang, Zhengkang Fan, Xin Miao, Yi Guo, Mei Liu, Muxuan Liang, Russell Terry, Jie Xu

机构 * Department of Health Outcomes and Biomedical Informatics, University of Florida(健康结果与生物医学信息学系,佛罗里达大学) Tiktok Department of Biostatistics, MD Anderson Cancer Center(生物统计学系,MD安德森癌症中心) Department of Urology, University of Florida(泌尿科,佛罗里达大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对深度学习影像特征可解释性差阻碍临床落地的问题,该框架融合分割、可解释分类与影像组学分析,多数据集验证可提升肿瘤分类性能与生物可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05378 2026-07-07 cs.LG 新提交 57%

CompactionRL: Reinforcement Learning with Context Compaction for Long-Horizon Agents

CompactionRL:面向长视界智能体的带上下文压缩强化学习

Yujiang Li, Zhenyu Hou, Yi Jing, Jie Tang, Yuxiao Dong

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :agentic(abstract);分类 cs.LG

AI总结 针对长视界大语言模型智能体受上下文窗口限制的问题,提出结合上下文压缩的强化学习方法,联合优化任务执行与摘要生成,在智能体编码任务上取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05257 2026-07-07 cs.LG 新提交 57%

GeoFlow: Geo-Aware Modeling of Inter-Area Relationships in Origin-Destination Flow Prediction and Generation

GeoFlow:用于起讫点流预测与生成的区域间关系地理感知建模

Zherui Huang, Guanjie Zheng, Hao Xue, Linghe Kong

机构 * Zherui Huang(黄泽睿) Guanjie Zheng(郑冠杰) Hao Xue(徐浩) Linghe Kong(孔令和)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对现有OD流建模忽略地理属性的缺陷,提出GeoFlow框架融合多类地理特征与定制编解码器,提升OD流预测精度与生成样本的真实性多样性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05174 2026-07-07 cs.AI 新提交 57%

AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments

AgentGym2:在去理想化真实世界环境中评测大语言模型智能体

Zhiheng Xi, Dingwen Yang, Jiaqi Liu, Jixuan Huang, Honglin Guo, Baodai Huang, Tinggang Chen, Qi Zhang, Zhonghang Lu, Chenyu Liu, Jiajun Sun, Jiazheng Zhang, Dingwei Zhu, Xin Guo, Junzhe Wang, Zhihao Zhang, Yuming Yang, Junjie Ye, Minghe Gao, Dongrui Liu, Jiaming Ji, Guohao Li, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Shanghaijiaotong University(上海交通大学) Peking University(北京大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对现有LLM智能体基准过于理想化的问题,提出去理想化评测框架AgentGym2,可全面测查智能体实操能力,实验显示当前SOTA模型仍存在明显性能缺口。

Comments Accepted as a main conference paper at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04978 2026-07-07 cs.LG cs.CV cs.RO 新提交 57%

Qantara: Bridge-Flow Training for Multi-Paradigm JEPA Control

Qantara:用于多范式联合嵌入预测架构控制的桥流训练

Ruslan Rakhimov, George Bredis, Yuriy Maksyuta, Daniil Gavrilov

机构 * T-Tech

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对联合嵌入预测架构(JEPAs)单一推理范式问题,提出Qantara,通过端到端联合训练目标,同一检查点服务三种推理范式,提升控制性能,推动JEPAs从单范式规划器向多范式控制器转变。

Comments 16 pages, 3 figures, 6 tables. Project page: https://corl-team.github.io/qantara

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04953 2026-07-07 cs.SE cs.RO 新提交 57%

Real-World Perturbation Testing of Autonomous Driving Systems

自动驾驶系统的真实世界扰动测试

Stefano Carlo Lambertenghi, Matthias Weil, Andrea Stocco

机构 * Technical University of Munich(慕尼黑技术大学) fortiss GmbH(fortiss公司)

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 研究自动驾驶系统在多样条件下的可靠性,通过72种相机和激光雷达扰动,在三种测试模式下评估,揭示测试水平差距及实时可行性的关键作用。

Comments In proceedings of the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04449 2026-07-07 cs.CV cs.LG 新提交 57%

Fields of the Planet: Field Boundary Mapping Beyond 10m

行星的田地:超越10米的田地边界测绘

Isaac Corley, Caleb Robinson, Jennifer Marcus, Hannah Kerner

机构 * Taylor Geospatial(泰勒地理空间公司) Microsoft AI for Good Research Lab(微软公益人工智能研究实验室) Arizona State University(亚利桑那州立大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 介绍Fields of the Planet(FTP),作为Fields of The World(FTW)的3米分辨率配套产品,通过矢量预测评估田地划分,在匹配架构和训练方法下,3米图像提升了全景质量等指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04129 2026-07-07 cs.SE 新提交 57%

Toward the Right Analytical Model and System Software for Autonomous Driving Systems: Open Problems and Research Directions

迈向自动驾驶系统的正确分析模型和系统软件:开放问题与研究方向

Atsushi Yano, Takuya Azumi

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 探讨自动驾驶系统中,需何种分析模型及系统软件来处理定时问题。通过调研相关工作,从定时约束单元等五个维度找出差距。

Journal ref RTSOPS 2026 invited paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04096 2026-07-07 cs.AI 新提交 57%

Forethought: Verifiable Reasoning from Neurosymbolic Primitive Programming

预思考:神经符号原始编程的可验证推理

Vishvesh Bhat, Jay Vaghasiya, Emmanuel Anaya Gonzalez

机构 * CoreThink AI UC San Diego(加州大学圣地亚哥分校)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 研究改进智能体工作流推理能力问题,提出神经符号推理系统Forethought,将推理视为可验证程序,由符号和神经原语库构建,经特定语言组合,提升了基础模型准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03449 2026-07-07 cs.RO cs.AI 新提交 57%

HiMe: Hierarchical Embodied Memory for Long-Horizon Vision-Language-Action Control

HiMe:用于长距离视觉-语言-动作控制的分层具身记忆

Li Ji, Siyin Wang, Pengfang Qian, Xiaopeng Yu, Yihai Tian, Zhaoye Fei, Jingjing Gong, Xipeng Qiu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) East China Normal University(华东师范大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对视觉-语言-动作模型处理非马尔可夫任务的不足,提出HiMe分层具身记忆框架,解耦智能为高频执行器等,引入动态知识系统,平衡实时执行与思考规划冲突,提升长距离任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02963 2026-07-07 cs.CV cs.AI cs.MM 新提交 57%

Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning

用于全模态密集视频字幕的并行自回归解码

Wenzheng Zeng, Siyi Jiao, Chen Gao, Hwee Tou Ng, Mike Zheng Shou

机构 * National University of Singapore(新加坡国立大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究密集视频字幕生成,提出并行自回归框架,利用事件间弱局部依赖重组因果依赖图,引入全局规划和事件分解并行解码机制,提升效率与字幕性能。

Comments ECCV 2026. Project website: https://github.com/showlab/PadCaptioner

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02590 2026-07-07 cs.SE 新提交 57%

OmniPresent: Generating Coherent Presentation Suites from Scientific Papers

OmniPresent:从科学论文生成连贯的演示文稿套件

Qianli Ma, Jipeng Xiao, Siyu Wang, Zhiheng Tian, Wangyu Feng, Shibo Wang, Chang Guo, Shuochen Chang, Qingyang Liu, Zhipeng Zhang

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 研究如何将静态论文转化为动态媒体,提出OmniPresent框架,采用可渲染HTML表示和自校正循环解决模态冲突,还发布数据集与评估协议,生成的演示文稿套件质量高。

Comments In progress

详情

展开后加载摘要…

URL PDF HTML 收藏