arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-22 至 2026-07-22 共收录 78 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 4 篇

2607.05462 2026-07-22 cs.CR cs.AI 版本更新 83%

BioSecBench-Refusal: A paired metric for performance and alignment in agentic biosecurity risk assessment

评估两用生物学环境中的校准拒绝和安全有用性

Edwin H. Wintermute, Harmon Bhasin, Christina M. Agapakis, Dianzhuo Wang, Evan Seeyave, Arjun Banerjee, Daniel Fulop, Matthew C. Watson, Adam J. Meyer, Sandrine Boissel, Jens H. Kuhn, Rishi Jain, Noah D. Taylor, Helena Shomar, Patrick M. Boyle, Kenny Workman

机构 * American Wetware(美国湿科公司) LatchBio

专题命中 工具调用 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 研究针对人工智能用于生命科学工作流可能导致滥用的问题,提出BioSecBench-Refusal基准,将常规与红队任务配对,测试16种配置下模型拒绝率,发现多数配置对常规工作拒绝率高,有推理空间的模型能识别更多威胁,为开发者提供校准工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17384 2026-07-22 cs.AI cs.LG cs.LO cs.MA 版本更新 73%

Quantifying Diversity of Thought: A Predictive Law of Weighted LLM Ensemble Lift

量化思维多样性:加权大语言模型集成提升的预测定律

Junade Ali

机构 * The Alan Turing Institute(艾伦·图灵研究所)

专题命中 工具调用 :tool use(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究量化思维多样性在大语言模型集成中提升效果的预测定律,通过原理推导得出计算提升的启发式方法及相关指标,经多基准测试验证,该方法能有效预测集成性能,且准确性调整后的指标表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07055 2026-07-22 cs.AI 版本更新 70%

Dr. Zero: Self-Evolving Search Agents without Training Data

零博士:无需训练数据的自我进化搜索智能体

Zhenrui Yue, Kartikeya Upasani, Xianjun Yang, Suyu Ge, Shaoliang Nie, Yuning Mao, Zhe Liu, Dong Wang

机构 * Meta Superintelligence Labs(Meta超级智能实验室) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 工具调用 :tool use(abstract);agentic(abstract);分类 cs.AI

AI总结 研究在高质量数据难获取时智能体自我进化问题,提出零博士框架,通过自我进化反馈循环和HRPO方法,使搜索智能体无需训练数据自我进化,在问答基准测试中表现出色,证明可仅通过自我进化实现强大智能搜索和推理。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07473 2026-07-22 cs.CR cs.AI 版本更新 57%

Give Them an Inch and They Will Take a Mile:Understanding and Measuring Caller Identity Confusion in MCP-Based AI Systems

给予一寸,他们将索取一英里:理解和测量基于MCP的AI系统中的调用者身份混淆

Yuhang Huang, Boyang Ma, Biwei Yan, Xuelong Dai, Yechao Zhang, Minghui Xu, Kaidi Xu, Yue Zhang

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克Quantin 研究院) Rajiv Gandhi University(拉朱·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Shandong University(山东省大学) City University of Hong Kong(香港城市大学)

专题命中 工具调用 :AI agent(abstract);分类 cs.AI

AI总结 研究发现基于MCP的AI系统因缺乏调用者身份验证和细粒度授权而存在安全风险,需改进认证机制以减少攻击面。

Comments Withdrawal due to some flaws in experimental methodology and unresolved ethical issues in data collection. We need to redesign the experiments and obtain proper ethical clearance before resubmission

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 27 篇

2508.00429 2026-07-22 cs.CL cs.LG cs.MA 版本更新 90%

Node-as-Agent: Graph Agentic Network

节点即智能体:图智能体网络

Minghao Guo, Xi Zhu, Qingyue Jiao, Xiujin Liu, Haochen Xue, Chong Zhang, Shuhang Lin, Jingyuan Huang, Ziyi Ye, Yongfeng Zhang

机构 * Rutgers University(罗格斯大学) University of Liverpool(利物浦大学) Fudan University(复旦大学)

专题命中 规划决策 :agent(title,abstract);agentic(title,abstract);planning(abstract);分类 cs.CL、cs.LG

AI总结 研究针对图神经网络不能处理节点信息不平衡及忽略全局语义关系的局限,提出检索增强图智能体网络ReaGAN,赋予节点自主决策能力,通过智能体规划和局部 - 全局检索实现自适应消息传播,在少样本设置下性能优异。

Comments 11 pages, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14512 2026-07-22 cs.AI cs.CL cs.LG 版本更新 89%

RetroAgent: Harnessing LLMs to Search Over Structured Memory for Agentic Retrosynthesis Planning

RetroAgent:利用大语言模型在结构化记忆中进行搜索以实现智能逆合成规划

Yanqiao Zhu, Jingru Gan, Xiaoqi Sun, Fang Sun, Yidan Shi, Md Mofijul Islam, Chao Shang, Wenhao Gao, Connor W. Coley, Yizhou Sun, Wei Wang

机构 * UCLA(加利福尼亚大学洛杉矶分校) MIT(麻省理工学院) Amazon(亚马逊公司) UPenn(宾夕法尼亚大学)

专题命中 规划决策 :planning(title,abstract);agentic(title);agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究多步逆合成规划难题,提出RetroAgent智能体,通过结合结构化记忆桥接符号搜索与神经推理,利用记忆和化学工具观察搜索状态,实验证明其在分布内和分布外基准测试中性能强且泛化能力好。

Comments To appear at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29932 2026-07-22 cs.AI 版本更新 86%

SAGA: Scene-Aware, Goal-Evolving Agents for Long-Horizon Strategy Game Planning

SAGA: 场景感知、目标演化的长时域CivRealm策略规划智能体

Tianyu Jin, Shuo Chen, Yida Wang, Liuyu Xiang, Yingzhuo Liu, Yexin Li, Peipei Li, Zhaofeng He

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对长时域策略游戏中场景盲视、上下文溢出和跨游戏学习浅层化问题,提出SAGA多智能体框架,通过地图语义场景图、工具增强规划器和双时域反馈循环,在FreeCiv中取得最高文明评分并降低输出令牌27%。

Comments 18 pages, 4 figures. Code https://github.com/Kazecloudk/SAGA-Scene-Aware-Goal-Evolving-Agents-for-Long-Horizon-Strategy-Game-Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26182 2026-07-22 cs.CV cs.AI cs.LG 版本更新 81%

Lifting Embodied World Models for Planning and Control

提升具身世界模型用于规划与控制

Alex N. Wang, Trevor Darrell, Pavel Izmailov, Yutong Bai, Amir Bar

机构 * Computer Science, New York University(纽约大学计算机科学系) BAIR, UC Berkeley(伯克利大学BAIR)

专题命中 规划决策 :planning(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种轻量级策略,将高层动作映射到低层关节动作序列,结合冻结的世界模型,实现预测未来观察的提升世界模型,有效降低规划复杂度。

Comments Accepted to ECCV2026. Edited policy masking

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16299 2026-07-22 cs.CL 版本更新 79%

PyPhonPlan: Simulating phonetic planning with dynamic neural fields and task dynamics

PyPhonPlan:基于动态神经场和任务动态的语音规划模拟

Sam Kirkham

机构 * Phonetics Laboratory, Lancaster University, United Kingdom(兰卡斯特大学语音实验室,英国)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 PyPhonPlan通过动态神经场和任务动态模拟,提供模块化组件实现语音规划建模,展示了交互性语音动态建模能力。

Comments Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15875 2026-07-22 cs.RO cs.AI 版本更新 79%

Fly0: Persistent Metric Anchoring for Zero-Shot Aerial Vision-Language Navigation

Fly0: 解耦语义定位与几何规划以实现零样本空中导航

Zhenxing Xu, Yihong Lu, Weidong Bao, Zhengqiu Zhu, Jingxuan Zhou, Zhichuang Wang, Ji Wang, Lihua Liu, Wei He

机构 * National Key Laboratory of Big Data and Decision(大数据与决策国家重点实验室) National University of Defense Technology(国防科技大学) State Key Laboratory of Digital Intelligent Modeling and Simulation(数字智能建模与仿真国家重点实验室) Information Support Force Engineering University(信息支援力量工程大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 Fly0通过解耦语义推理与几何规划,实现零样本空中导航,提升导航成功率和减少导航误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03642 2026-07-22 cs.CG 版本更新 78%

Generalized k-Cell Decomposition for Visibility Planning in Polygons

多边形中用于可见性规划的广义 k 单元分解

Yeganeh Bahoo, Sajad Saeedi, Roni Sherman

专题命中 规划决策 :planning(title,abstract)

AI总结 研究多边形环境追逃问题,提出广义 k 单元分解方法,通过纳入特定可见性多边形扩展现有工作,构建分割线并证明正确性,实现可靠路径规划,为机器人监控开辟新途径,难点在于计算多边形和找分割线交点。

Comments Presented at the 32nd Annual Fall Workshop on Computational Geometry (FWCG 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14751 2026-07-22 cs.LG 版本更新 70%

HERAKLES: Hierarchical Skill Compilation for Open-ended LLM Agents

HERAKLES:用于开放式语言模型智能体的分层技能编译

Thomas Carta, Clément Romac, Loris Gaven, Pierre-Yves Oudeyer, Olivier Sigaud, Sylvain Lamprier

机构 * Inria(Flowers)(Inria) University of Bordeaux(波尔多大学) Sorbonne Université (ISIR)(索邦大学) Univ Angers (LERIA) SFR MATHSTIC(昂格斯大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 研究部分可观测、稀疏奖励且目标空间大的环境中目标条件强化学习,提出HERAKLES分层智能体,联合学习高级语言模型策略与低级控制器,通过同时训练实现可扩展技能组合,提升开放式组合环境下的效率和适应性。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13070 2026-07-22 cs.SE cs.AI 版本更新 62%

Falsifiable Release Gates for Self-Improving Systems: Standing Invariants at Scale

用于自我改进系统的可证伪发布门限

Deepak Soni

机构 * AI Architect(人工智能架构师)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究自我改进系统安全声明,提出可证伪发布门限及构建验证方法,在Antahkarana运行时应用,经机器检查确保安全,发布验收结果,明确范围,使结果可重现、门限可在其他框架运行。

Comments 23 pages, 14 figures. Major revision merging the follow-up "Standing Invariants at Scale" into this paper per arXiv moderation: the machine-checked action-safety core preserved across six further releases, six new invariant families with teeth, and real-hardware self-improvement; suite grown from 122 to 563 tests. Software, gate suite, run artifacts, and TLA+ spec are open source

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03087 2026-07-22 cs.RO cs.AI cs.LG 版本更新 62%

Training and Simulation of Quadrupedal Robot in Adaptive Stair Climbing and Descending for Indoor Firefighting: An End-to-End Reinforcement Learning Approach

四足机器人在室内灭火中的自适应爬楼梯训练与仿真:一种端到端强化学习方法

Baixiao Huang, Baiyu Huang, Yu Hou

机构 * Independent Researcher(独立研究者) Department of Construction Management, Western New England University(西雅图新英格兰大学建设管理系)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出一种两阶段端到端强化学习方法,用于四足机器人在复杂室内环境中适应不同楼梯形状的爬行任务。

Comments 8 pages, 9 figures, 43rd International Symposium on Automation and Robotics in Construction

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10946 2026-07-22 cs.RO cs.AI cs.LG 版本更新 62%

ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learning

ImplicitRDP:一种具有结构快慢学习的端到端视觉-力扩散策略

Wendi Chen, Han Xue, Yi Wang, Fangyuan Zhou, Jun Lv, Yang Jin, Shirun Tang, Chuan Wen, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix Ltd.(诺姆矩阵有限公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究人类水平接触操作中视觉与力感测信号整合难题,提出ImplicitRDP策略,用结构快慢学习机制及虚拟目标表示正则化,经实验验证其在丰富接触任务中显著优于基线,有卓越反应性与成功率。

Comments Accepted to RA-L 2026. Project page: https://implicit-rdp.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08654 2026-07-22 quant-ph cs.AI cs.LG cs.NI 版本更新 62%

Robust Belief-State Policy Learning for Quantum Network Routing Under Decoherence and Time-Varying Conditions

在退相干和时变条件下量子网络路由的鲁棒信念状态策略学习

Amirhossein Taherpour, Abbas Taherpour, Tamer Khattab, Mazen Hasna

机构 * Department of Electrical Engineering, Columbia University(哥伦比亚大学电气工程系) Department of Electrical Engineering, Imam Khomeini International University(伊玛目·霍梅尼国际大学电气工程系) Department of Electrical Engineering, Qatar University(卡塔尔大学电气工程系)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对量子网络路由在复杂条件下的在线决策问题,基于q-POMDP和GNN开发鲁棒信念状态路由框架,通过原子微纪元等方法考虑多种因素,引入多种策略实现可扩展性,经融合与规则提供理论保证,模拟显示该混合控制器性能优于多种基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12527 2026-07-22 cs.AI 版本更新 57%

Evidence-Grounded AI for Musculoskeletal Care

用于肌肉骨骼护理的基于证据的人工智能

Wenjie Li, Yujie Zhang, Fanrui Zhang, Haoran Sun, Renhao Yang, Junjun He, Weiran Huang, Yuanfeng Ji, Chenrun Wang, Kailing Wang, Hongcheng Gao, Kaipeng Zhang, Hanyu Wang, Angela Lin Wang, Xingqi He, Yilin Huang, Shiyi Yao, Lilong Wang, Yankai Jiang, Yirong Chen, Chenglong Ma, Jiyao Liu, Ming Hu, Gen Li, Yidong Xu, Chengyu Zhuang, Jiawei Liu, Yin Zhang, Lequan Yu, Lu Chen, Yinpeng Dong, Lei Liu, Carlos Gutierrez Sanroman, Yu Qiao, Weijie Ma, Xiaosong Wang, Lei Wang

机构 * Ruijin Hospital, College of Health Science and Technology, Shanghai Jiao Tong University School of Medicine(上海交通大学医学院附属瑞金医院,健康科学技术学院) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(中国科学技术大学脑启发智能感知与认知教育部重点实验室) School of Basic Medical Sciences, Intelligent Medicine Institute, Fudan University(复旦大学基础医学院智能医学研究院) Department of Radiation Oncology, Stanford University School of Medicine(斯坦福大学医学院放射肿瘤学系) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院) College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对肌肉骨骼护理中证据分散问题,提出基于大语言模型的OrthoPilot系统,整合多源数据进行持续管理。该系统在诊断推理等方面超越专家,优于其他智能系统,还提升了管理成功率和病床病例数等,推动临床人工智能实现纵向管理。

Comments All co-authors have now consented to the submission and approved the authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06936 2026-07-22 cs.AR cs.AI cs.MA 版本更新 57%

Bridging the Last Mile of Circuit Design: PostEDA-Bench, a Hierarchical Benchmark for PPA Convergence and DRC Fixing

跨越电路设计的最后一英里:PostEDA-Bench,一个用于PPA收敛和DRC修复的分层基准

Pengju Liu, Nuo Xu, Jinwei Tang, Yu Cao, Caiwen Ding

机构 * University of Minnesota(明尼苏达大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 提出PostEDA-Bench分层基准,包含145个任务,覆盖DRC修复和PPA优化,实验发现现有LLM代理在复杂DRC推理和多目标PPA优化上表现不佳,视觉增强可提升DRC性能,权衡推理是PPA多目标瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08216 2026-07-22 eess.IV cs.CV cs.LG 版本更新 57%

Tumor-anchored deep feature random forests for out-of-distribution detection in lung cancer segmentation

基于肿瘤锚定的深度特征随机森林用于肺癌分割中的分布外检测

Aneesh Rangnekar, Harini Veeraraghavan

机构 * Memorial Sloan Kettering Cancer Center(纪念斯隆凯特林癌症中心)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出RF-Deep框架,利用深度特征提升CT扫描的分布外检测性能,通过少量标注数据改进分割管道的安全性。

Comments Accepted for publication in Transactions on Machine Learning Research (TMLR), 2026. Code available at: https://github.com/aneesh3108/RF-Deep

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17787 2026-07-22 cs.RO cs.AI 版本更新 57%

AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models

AnchorRefine:基于轨迹锚点和残差细化的轨迹-锚点与残差细化的视觉-语言-动作模型

Tingzheng Jia, Kan Guo, Lanping Qian, Yongli Hu, Daxin Tian, Guixian Qu, Chunmian Lin, Baocai Yin, Jiapu Wang

机构 * Beijing University of Technology(北京理工大学) Beihang University(北航) Nanjing University of Science and Technology(南京理工大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出AnchorRefine框架,通过分解视觉-语言-动作动作建模为轨迹锚点和残差细化,提升几何和接触精度,实验表明在模拟和现实任务中均取得显著提升。

Comments The authors have decided to withdraw this manuscript because the work requires substantial revision and further experimental validation

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22442 2026-07-22 cs.CR cs.SE 版本更新 57%

Architecture-Derived CBOMs for Cryptographic Migration: A Security-Aware Architecture Tradeoff Method

基于架构的CBOMs用于密码迁移:一种安全感知的架构权衡方法

Eduard Hirsch, Kristina Raab

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 本文提出SATAM方法,通过整合ATAM、arc42等方法,生成包含安全意图和迁移关键元数据的架构基础CBOM,提升密码迁移规划的信息可用性。

Comments Accepted at the International Workshop on Migration and Agility in Cryptographic Systems (MAgiCS 2026). This version matches the open-access conference paper published by Springer

Journal ref CCIS, vol. 3002, pp. 20-39 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04843 2026-07-22 cs.AI 版本更新 57%

Fluid Reasoning Representations

推理模型中的流体表示

Dmitrii Kharlapenko, Terry Jingchen Zhang, Arth Singh, Alessandro Stolfo, Arthur Conmy, Mrinmaya Sachan, Zhijing Jin

机构 * ETH Zurich(苏黎世联邦理工学院) University of Toronto(多伦多大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究揭示了推理模型通过上下文细化令牌表示提升抽象问题解决能力的机制,提出流体推理表示概念。

Comments EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17049 2026-07-22 cs.SE cs.RO 版本更新 57%

Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots

评估具有视觉语言动作能力的机器人的不确定性和质量

Pablo Valle, Chengjie Lu, Shaukat Ali, Aitor Arrieta

机构 * Mondragon University(蒙dragon大学) Simula Research Laboratory(Simula研究实验室)

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 研究针对具有视觉语言动作能力的机器人,采用八个不确定性指标和五个质量指标,通过大规模实证研究评估其有效性,发现部分指标与人类评估有相关性且能区分任务执行质量,挑战了仅依赖成功率的评估做法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11340 2026-07-22 cs.RO 版本更新 50%

CR-Solver: GPU-Accelerated Kinematics Solver for Tendon-driven Continuum Robots

CR-Solver:用于腱驱动连续体机器人的GPU加速运动学求解器

Heqing Yang, Yang Yi, Linqing Zhong, Linjiang Huang, Si Liu

机构 * Beihang University(北京航空航天大学)

专题命中 规划决策 :planning(abstract)

AI总结 针对连续体机器人运动规划问题,提出CR-Solver求解器,它基于优化框架统一逆运动学等,利用GPU加速并行优化,在三项任务验证中比传统CPU求解器显著加速,成功率超95%精度达毫米级,且用纯Python实现,为高性能运动规划提供基础。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17551 2026-07-22 math.OC 版本更新 50%

The Algorithmic Geometry of Decompression Schedules

迈向减压计划的最优控制与算法结构

Benjamin Marsh

专题命中 规划决策 :planning(abstract)

AI总结 本文将减压计划建模为最优控制问题,探讨了气体可行性窗口、仿射上限和凸惩罚等要素,提出了非光滑驻留时间KKT条件,并给出了有限停止网格下的动态规划和标签设定方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13660 2026-07-22 stat.AP 版本更新 50%

Improving ecological inference and uncertainty quantification from camera trap data through the fusion of AI confidences and manual annotations

通过融合AI置信度和人工标注提升相机陷阱数据的生态推断与不确定性量化

Adira Cohen, Erin M. Schliep, Roland Kays, Mohammad Alyetama, Matthew Snider

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出一种新的贝叶斯分层数据融合模型,结合人工标注和AI预测,提升相机陷阱数据的推断和预测能力,并通过模拟研究和白尾鹿体况分析展示其在生态推断中的优势。

Comments 45 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13632 2026-07-22 cs.RO cs.CV 版本更新 50%

Guide, Think, Act: Interactive Embodied Reasoning in Vision-Language-Action Models

引导、思考、行动:面向视觉-语言-动作模型的交互式具身推理

Yiran Ling, Qing Lian, Jinghang Li, Qing Jiang, Tianming Zhang, Xiaoke Jiang, Chuanxiu Liu, Jie Liu, Lei Zhang

机构 * Futian Laboratory(福田实验室) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) International Digital Economy Academy (IDEA)(国际数字经济学院(IDEA)) School of Robotics, Hunan University(湖南大学机器人学院) South China University of Technology(华南理工大学) Visincept(Visincept公司) National Key Laboratory of Smart Farm Technologies and Systems(智能农业技术与系统国家重点实验室)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出GTA-VLA框架,通过允许用户用显式视觉提示引导机器人策略,实现空间可调节的具身推理。该框架整合了外部指导与内部任务规划,提升了在视觉歧义和错误恢复中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08745 2026-07-22 cs.IR 版本更新 50%

Towards Full Candidate Interaction: A Comprehensive Comparison Network for Better Route Recommendation

迈向完整候选交互:一种全面比较网络用于更好的路线推荐

Hanyu Guo, Chao Chen, Longfei Xu, Chengzhang Wang, Kaikui Liu, Xiangxiang Chu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出全面比较网络(CCN)用于改进路线推荐,通过比较非重叠段构建特征,解决路线推荐中的独特挑战,并在AMAP中成功部署。

Comments Accepted by the ACM Conference on Recommender Systems 2026 (RecSys '26), Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10389 2026-07-22 cs.GT cond-mat.stat-mech physics.soc-ph 版本更新 50%

The $k$-flip Ising game

k 翻转伊辛博弈

Aleksandr Kovalenko, Andrey Leonidov

专题命中 规划决策 :agent(abstract)

AI总结 研究伊辛博弈中多个智能体同时决策的差异,分析完全图上伊辛型系统部分并行离散时间动力学,通过解析计算转移矩阵及相关矩,探讨亚稳态衰减的 k 依赖性及 k_min 处最小值成因。

Comments 34 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03596 2026-07-22 econ.GN q-fin.EC 版本更新 50%

vop_poc_nz: A Python Framework for Distributional Cost-Effectiveness and Value of Perspective Analysis

vop_poc_nz:用于分布成本效益和视角价值分析的Python框架

Dylan A Mordaunt

专题命中 规划决策 :workflow(abstract)

AI总结 介绍用于分布成本效益等分析的Python包vop_poc_nz,定义视角价值为定向预期机会损失,通过五个合成模型验证软件工作流程,给出戒烟和住房隔热的视角价值估计,版本0.2.3支持特定Python版本并利于可重复分析。

Comments 14 pages, 5 figures. Software release 0.2.3

详情

展开后加载摘要…

URL PDF HTML 收藏