arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 4066 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 880 篇

2607.10463 2026-07-14 cs.AI cs.IR 新提交 57%

GRASP: GRanularity-Aware Search Policy for Agentic RAG

GRASP:用于智能检索增强生成的粒度感知搜索策略

Varun Gandhi, Jaewook Lee, Shantanu Todmal, Franck Dernoncourt, Ryan Rossi, Zichao Wang, Andrew Lan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Adobe Research(Adobe 研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究智能体检索增强生成中模型决策难题,提出GRASP强化学习框架,训练智能体协调互补检索工具,实验表明其提升检索召回率和问答性能,还展现出可解释行为,凸显协调检索信号和上下文粒度对智能体推理的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09787 2026-07-14 cs.CV cs.LG 新提交 57%

Adversarially Guided Diffusion for LiDAR Range Image Synthesis

用于激光雷达距离图像合成的对抗引导扩散

Stavros Bouras, Antonios Makris, Alexandros Gkillas, Aris S. Lalos, Konstantinos Tserpes

机构 * School of Electrical and Computer Engineering, National Technical University of Athens(雅典国立技术大学电气与计算机工程学院) Industrial Systems Institute, Athena Research Center(雅典娜研究中心工业系统研究所)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 研究针对二维距离图像分割的无限制对抗攻击,提出基于扩散并利用分割损失对抗引导的方法,在SemanticKITTI数据集实验,能跨架构转移,相比基线在有效性与现实性间有独特权衡,实现可控退化。

Comments Accepted at the 1st Workshop on Secure and Trustworthy AI (STAI 2026), co-located with the European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09092 2026-07-13 cs.CL 新提交 57%

AgentKGV: Agentic LLM-RAG Framework with Two-Stage Training for the Fact Verification of Knowledge Graphs

AgentKGV:用于知识图谱事实验证的两阶段训练的智能语言模型-检索增强生成框架

Yumin Heo, Hyeon-gu Lee, Sumin Seo, Youngjoong Ko

机构 * SungKyunKwan University(成均馆大学) NAVER(纳维)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 针对知识图谱事实错误验证难题,提出AgentKGV框架,集成动态路由等处理表面形式不匹配。引入两阶段训练策略,在开放域T-REx基准上,该框架提升了宏观F1,减少搜索调用次数,提高了验证准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09076 2026-07-13 cs.AI 新提交 57%

Neuro-Agentic Control: A Deep Learning-based LLM-Powered Agentic AI Framework for Controlling Security Controls

神经代理控制:一种基于深度学习的由大型语言模型驱动的用于控制安全控制的代理人工智能框架

Saroj Gopali, Bipin Chhetri, Deepika Giri, Sima Siami-Namini, Akbar Siami Namin

机构 * Texas Tech University(德克萨斯理工大学) Cumberland University(坎伯兰大学) Advanced Academic Programs Science(高级学术项目科学部) Johns Hopkins University(约翰·霍普金斯大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 针对运营技术网络攻击问题,提出神经代理控制框架,结合基于LLM的规划器与预训练的TimesFM,并引入“反事实物理注入”机制,在工业数据集评估中表现优于基线,能有效保障关键基础设施中代理人工智能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08449 2026-07-10 cs.CV cs.LG 新提交 57%

Predicting Viticulture Potential through an Ensemble of U-Net and a Geospatial Foundation Model

通过U-Net和地理空间基础模型的集成预测葡萄种植潜力

Jorge Ignacio Perez, Hwaai Kang Kee, Lucas Rassbach

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 针对ImageCLEF AI4Agri 2026法国南部葡萄种植潜力预测子任务,DS@GT ARC团队采用U-Net和地理空间基础模型集成方法,其最佳模型准确率达68.32,在7个团队中排第二,且实现已公开。

Comments To be published in CLEF 2026 Working Notes

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06127 2026-07-10 cs.CL 新提交 57%

Measuring the practice of shared-decision making (OPTION12): An Investigation into Open-sourced Smaller LLMs (OS-sLLMs) for Better Privacy and Sustainability

衡量共享决策的实践(OPTION12):对用于更好隐私和可持续性的开源小型语言模型(OS - sLLMs)的调查

Tamara Wit, Lifeng Han, Carly Heipon, David Lindevelt, Anne Stiggelbout, Suzan Verberne

机构 * Leiden University Medical Centre(莱顿大学医学中心) The Leiden Institute of Advanced Computer Science(莱顿高级计算机科学研究所)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 研究利用Observer OPTION12框架,对开源小型语言模型进行共享决策自动评估,聚焦隐私保护与本地部署。通过专家注释临床咨询评估多个模型,发现通用领域模型表现更好,还引入共识框架,为隐私保护的人在回路SDM评估提供基础。

Comments Pilot study. Preliminary findings on open-source smaller LLMs for OPTION12 shared decision-making assessment

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07612 2026-07-09 cs.CY cs.AI 新提交 57%

Towards Agentic AI Governance: A Preliminary Assessment

迈向智能体人工智能治理:初步评估

Mubarak Raji, Masooda Bashir

机构 * School of Information Sciences, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校信息科学学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文针对智能体人工智能快速发展带来的新挑战,对其治理新兴文献做系统综述,分析其与传统系统不同的特征及治理需求,综合治理重点、机制和利益相关者角色,为制定指导智能体人工智能治理的路线图奠定基础。

Comments International Conference on the AI Revolution: Research, Ethics, and Society (AIR-RES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07467 2026-07-09 cs.AI 新提交 57%

SpaCellAgent: A Self-Evolving LLM-Based Multi-Agent Framework for Trajectory Analysis

SpaCellAgent:一种基于自进化大语言模型的轨迹分析多智能体框架

Songhan Wang, Haoang Chi, He Li, Zhiheng Zhang, Jiayan Yuan, Cheems Wang, Hao Peng, Xinwang Liu, Wenjing Yang

机构 * University of Shanghai for Science and Technology(上海理工大学) National University of Defense Technology(国防科技大学) Hong Kong Baptist University(香港浸会大学) Shanghai University of Finance and Economics(上海财经大学) Tsinghua University(清华大学) Beihang University(北京航空航天大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究针对轨迹推断现有方法需大量人工干预的问题,提出基于大语言模型的多智能体框架SpaCellAgent,利用多智能体架构、动态工具编排引擎和自进化模块,经实验验证其能大幅提高分析效率,推动先进时空建模民主化。

Comments 27 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06595 2026-07-09 cs.CR cs.AI 新提交 57%

When Agents Remember Too Much: Memory Poisoning Attacks on Large Language Model Agents

当智能体记忆过多时:对大语言模型智能体的内存中毒攻击

George Torres, Sharad Shrestha, Satyajayant Misra

机构 * George Torres3(乔治·托雷斯(第三作者)) Sharad Shrestha1(沙拉德·什雷斯塔(第一作者)) Satyajayant Misra4(萨蒂亚扬特·米什拉(第四作者))

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究大语言模型驱动的个人智能体因缺乏内存安全治理存在安全漏洞,提出攻击向量GhostWriter,实现近98%注入率和约60%激活率,还提出AM-Sentry缓解技术,显著降低GhostWriter成功率并保持智能体效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06461 2026-07-08 eess.AS cs.CL cs.SD 新提交 57%

WordVoice: Explicit and Decoupled Multi-Dimensional Word-Level Control for LLM-Based TTS

WordVoice:基于大语言模型的文本转语音中显式且解耦的多维词级控制

Sihang Nie, Jinxin Ji, Xiaofen Xing, Deyi Tuo, Chengbin Jin, Jialong Mai, Xiangmin Xu

机构 * South China University of Technology(南方科技大学) Huya Inc.(Huya公司) Tongji University(同济大学) The Hongkong polytechnic university(香港理工大学) Foshan University(佛山大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 研究针对基于LLM的TTS系统词级控制粗糙的问题,提出统一框架。构建含五维注释的数据集,引入WordVoice将隐式生成变为显式可控范式,经实验验证其在多声学维度上实现卓越解耦控制且保持零样本合成稳定性。

Comments 10 pages, 4 figures, 6 tables; Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06001 2026-07-08 cs.AI cs.MA 新提交 57%

Information Limits and Attractor Dynamics in Economies of Frontier LLM Agents: A Pre-Registered Test

前沿语言模型智能体经济中的信息限制与吸引子动力学:一项预注册测试

Cheng Qian

机构 * Independent Researcher(独立研究者)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 该研究对前沿语言模型智能体小型经济体进行预注册实验,测试耦合多智能体系统的两个预测。通过实验验证了比例投注耦合经济体中一些信息论相关定律,同时发现残差缩放测试结果否定了平滑平均场模型假设,还发布了相关代码等资料。

Comments 15 pages. Preprint. Zenodo: https://doi.org/10.5281/zenodo.21185866. Companion synthesis: arXiv:2606.12502

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05722 2026-07-08 cs.CL 新提交 57%

Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

Nemotron-Labs-Diffusion:一种统一自回归、扩散和自推测解码的三模式语言模型

Yonggan Fu, Lexington Whalen, Abhinav Garg, Chengyue Wu, Maksim Khadkevich, Nicolai Oswald, Enze Xie, Daniel Egert, Sharath Turuvekere Sreenivas, Shizhe Diao, Chenhan Yu, Ye Yu, Weijia Chen, Sajad Norouzi, Jingyu Liu, Shiyi Lan, Ligeng Zhu, Jin Wang, Jindong Jiang, Morteza Mardani, Mehran Maghoumi, Song Han, Ante Jukić, Nima Tajbakhsh, Jan Kautz, Pavlo Molchanov

机构 * Nemotron-Labs(Nemotron实验室)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 介绍了统一AR、扩散和自推测解码的三模式语言模型Nemotron-Labs-Diffusion,通过联合目标训练,能切换模式。研究表明其目标互补,自推测模式表现优,有长期潜力,该模型家族在精度和速度上优于现有开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05758 2026-07-08 cond-mat.mtrl-sci cs.LG 新提交 57%

From Closed-Loop Optimization to Open Decision Making: Coupled Digital Twins for Predictive and Autonomous Microscopy

从闭环优化到开放决策:用于预测性和自主性显微镜的耦合数字孪生

Yu Liu, Boris Slautin, Ian Mercer, Jon-Paul Maria, Sergei V. Kalinin

机构 * Department of Materials Science and Engineering, University of Tennessee, Knoxville, Tennessee, 37996, USA(田纳西大学材料科学与工程系) Materials Science and Engineering Department, Materials Research Institute, the Pennsylvania State University, University Park, Pennsylvania, 16802, USA(宾夕法尼亚州立大学材料研究学院材料科学与工程系)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 研究从闭环优化到开放决策的自动化实验,提出耦合数字孪生框架,通过样本孪生和仪器孪生分别编码材料状态与信号等,用于预测显微镜操作等,以力 - 距离曲线编码器等实现框架,为预测性操作和自主实验规划奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05377 2026-07-07 cs.RO cs.AI cs.CV 新提交 57%

Cortex: A Bidirectionally Aligned Embodied Agent Framework for Long-horizon Manipulation

Cortex:一种用于长视距操作的双向对齐具身智能体框架

Jiaqi Peng, Xiqian Yu, Delin Feng, Yuqiang Yang, Wenzhe Cai, Jing Xiong, Ganlin Yang, Jinliang Zheng, Jiafei Cao, Xueyuan Wei, Jiangmiao Pang, Yuan Shen, Tai Wang

机构 * Tsinghua University(清华大学) Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) USTC(中国科学技术大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对现有VLA模型长视距任务短板及分层方法语义-运动鸿沟问题,提出双向对齐框架Cortex,标准化技能原语、优化数据与采样策略,提升长视距操作性能与零样本泛化能力。

Comments Project website: https://steinate.github.io/cortex.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04907 2026-07-07 cs.AI 新提交 57%

Medi-Gemma: A Hybrid Clinical Decision Support System Integrating Deterministic EMR Analytics and Retrieval-Augmented Generation

Medi-Gemma:一种集成确定性电子病历分析与检索增强生成的混合临床决策支持系统

Mohammed Saim Ahmed Quadri, Yunzhe Xue, Justin W. Ady, Usman Roshan

机构 * New Jersey Institute of Technology(新泽西理工学院) Robert Wood Johnson Hospital(罗伯特·伍德·约翰逊医院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 介绍用于伤口病理分类和工作流程自动化的临床决策支持系统Medi-Gemma,其采用解耦框架,经多阶段管道处理数据请求,关键贡献是地面真值注入模块,验证表明该架构有诸多优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04673 2026-07-07 cs.CV cs.LG 新提交 57%

GlaKG: A Biomarker-Centric Fundus Knowledge Graph for Explainable Glaucoma Diagnosis and Risk Assessment

GlaKG:用于可解释性青光眼诊断和风险评估的以生物标志物为中心的眼底知识图谱

Cheng Huang, Jia Zhang, Yi Jiang, Yang Liu, Karanjit Kooner, Yadi Liu, Tsengdar Lee, Yang Xie, Wenqi Shi, Guanghua Xiao

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 研究针对青光眼自动化诊断缺乏临床可解释性问题,构建以生物标志物为中心的眼底知识图谱GlaKG,整合多种信息进行诊断和风险分层,贡献了可临床审核的推理框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04508 2026-07-07 cs.AI cs.RO 新提交 57%

Compressing the Validation Bottleneck: An Agentic Self-Driving Lab for Scientific Discovery

压缩验证瓶颈:用于科学发现的智能自动驾驶实验室

Kyunghoon Hur, Chihun Lee

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对智能科学发现中自动驾驶实验室的验证瓶颈,提出先验感知的智能实验设计循环和成本感知代理,通过利用领域知识和预测测量,减少实验循环次数和每次实验成本来加速实验循环。

Comments Accepted at ICML 2026 AI for Science Workshop ; AI Scientist Competition

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04409 2026-07-07 cs.LG 新提交 57%

Learning Task-Sufficient World Models by Synergizing Agentic Exploration and Structured Modeling

通过协同能动探索和结构化建模学习任务充分的世界模型

Fan Feng, Yujia Zheng, Minghao Fu, Yongqiang Chen, Guangyi Chen, Kevin Murphy, Biwei Huang, Kun Zhang

机构 * UCSD(加州大学圣地亚哥分校) MBZUAI(Mubarakzai Institute of Artificial Intelligence) CMU(卡内基梅隆大学) UBC(不列颠哥伦比亚大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 研究如何让智能体学习特定于任务、最小且足以决策的世界模型表示,通过智能体与世界模型闭环协同,智能体主动探索收集信息轨迹,世界模型学习结构化表示,提升样本效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03730 2026-07-07 cs.CL 新提交 57%

ProACT: Towards Breakdown-Aware Proactive Agent in Multi-User Collaboration

ProACT:迈向多用户协作中具有故障感知的主动智能体

Shu Yang, Difei Xu, Jiaxin Pei, Di Wang

机构 * PRADA Lab, King Abdullah University of Science and Technology(阿卜杜拉国王科技大学PRADA实验室) Stanford University(斯坦福大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 研究旨在使智能体在多用户协作中从被动变为主动,引入基于共同基础等理论的ProACT框架,通过观察对话历史判断是否需干预并决策,还介绍首个多用户协作基准,实验显示其性能优于直接聊天。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03220 2026-07-07 cs.CR cs.AI 新提交 57%

CONTRA: Red-Teaming Configurations of Personalizable Agents

CONTRA:可个性化代理的红队配置

Jonathan Nöther, Adish Singla, Goran Radanovic

机构 * Max Planck Institute for Software Systems(马克斯·普朗克软件研究所)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 探讨代理配置与执行危险行为风险的关系,提出CONTRA算法,通过推理评估良性但危险的配置发现导致恶意行为的代理配置,构建数据集分析发现多数技能有恶意配置,CONTRA能成功识别部分危险配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02959 2026-07-07 cs.CV cs.LG 新提交 57%

Incentivizing Vision Language Models to Search for Long Video Question Answering

激励视觉语言模型进行长视频问答搜索

Harsh Goel, S P Sharan, Sahil Shah, Minkyu Choi, Joungbin An, Kristen Grauman, Sandeep P. Chinchali

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 研究将长视频问答从被动单流程感知任务转变为多轮检索过程,核心方法是自然语言驱动搜索及强化学习后训练,贡献是提升长视频理解基准测试分数。

Comments To appear at the European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02703 2026-07-07 cs.SE cs.AI cs.DC cs.MA 新提交 57%

LLMoxie: Exploring Agentic AI for Scientific Software Development

LLMoxie:探索用于科学软件开发的智能AI

Landung Setiawan, Anant Mittal, Cordero Core, Anshul Tambay, Carlos Garcia Jurado Suarez, David A. C. Beck, Andrew J. Connolly, Vani Mandava

机构 * eScience Institute University of Washington(eScience研究院华盛顿大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对科学软件开发中现有AI编码代理的不足,介绍LLMoxie平台及其插件生态系统,通过实践总结多域研究软件工程师中心采用智能AI的挑战、平台设计及操作经验,提升AI编码代理能力。

Comments 9 pages, 4 figures. Accepted to ACM SIGKDD 2026 Workshop: Agentic AI for Scientific and Societal Advances (SciSoc Agents and LLMs). Describes an agentic AI platform for scientific software engineering with governed multi-cloud inference, structured multiagent workflows, and domain-aware coding support (cs.SE, cs.MA, cs.AI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02531 2026-07-07 cs.CY cs.AI 新提交 57%

The Hidden Water Geography of U.S. Hyperscale Data Centers in the AI Era

人工智能时代美国超大规模数据中心隐藏的水地理情况

Gianluca Guidi, Francesca Dominici

机构 * Harvard University(哈佛大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究美国超大规模数据中心用水路径,通过关联设施位置与电力区域等数据绘制472个设施的两种用水路径图,明确不同路径热点地理分布及占比,指出决策重点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01767 2026-07-07 cs.AI 新提交 57%

Repair the Amplifier, Not the Symptom: Stable World-Model Correction for Agent Rollouts

修复放大器,而非症状:面向智能体轨迹的稳定世界模型修正

Xinyuan Song, Zekun Cai

机构 * Emory University(埃默里大学) The University of Tokyo(东京大学) LocationMind

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对长流程规划中的图级错误,提出WM-SAR方法,通过子图放大反向定位因果子图进行修复,在有限token预算下优于传统扫描修复方法。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00597 2026-07-07 cs.CL cs.IR 新提交 57%

Multi-Turn Agentic Scientific Literature Search via Workflow Induction

通过工作流归纳实现多轮智能科学文献搜索

Jisen Li, Bingxuan Li, Nanyi Jiang, Xuying Ning, Xiyao Wang, Yifan Shen, Heng Wang, Yuqing Jian, Xiaoxia Wu, Ben Athiwaratkun, Pan Lu, Jiaxuan You, Bingxin Zhao

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Together AI University of Pennsylvania(宾夕法尼亚大学) Stanford University(斯坦福大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出PaperPilot,通过构建可执行DAG工作流进行多轮文献搜索,利用用户反馈优化查询和工作流,显著提升搜索性能并消除执行错误。

Comments 17 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31422 2026-07-07 cs.AI 新提交 57%

Ask the World Before Acting: Environment Probing for Calibrated Agent World Models

行动前先询问世界:预算受限的环境探测用于世界模型校准

Xinyuan Song, Zekun Cai

机构 * Emory University(埃默里大学) The University of Tokyo(东京大学) LocationMind

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出预算受限的环境探测算子,通过结构化信念表在行动前校准世界模型,减少长期任务中的终端误差。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27780 2026-07-07 cs.AI 新提交 57%

Understanding Rollout Error in Graph World Models

理解图世界模型中的展开误差

Xinyuan Song, Zekun Cai

机构 * Emory University(埃默里大学) The University of Tokyo(东京大学) LocationMind

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文研究图世界模型中的长时域展开误差,提出统一框架分析拓扑与模型引起的误差放大,并设计误差感知图世界模型,通过谱正则化、展开一致性和关键节点加权防止长时域发散。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02387 2026-07-03 cs.IR cs.LG 新提交 57%

Bringing Agentic Search to Earth Observation Data Discovery

将智能搜索引入地球观测数据发现

Minghan Yu, Youran Sun, Chugang Yi, Yixin Wen, Haizhao Yang

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 提出一个基于智能搜索的系统,利用知识图谱和大型语言模型,从自然语言查询中返回匹配的地球科学数据集和工具,显著提升检索性能。

Comments 19 pages, 1 figure, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01919 2026-07-03 cs.AI cs.CR 新提交 57%

ElephantAgent: Contextual State Continuity in Agentic Systems

ElephantAgent: 智能体系统中的上下文状态连续性

Jiankai Jin, Xiangzheng Zhang, Zhao Liu, Wenzhuo Xu, Dongdong Yang, Deyue Zhang, Quanchen Zou

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对工具和记忆投毒攻击,提出ElephantAgent协议,通过强制上下文状态连续性防御状态篡改,并利用历史可追溯性实现事后审计与恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01639 2026-07-03 cs.AI 新提交 57%

Autonomous discovery of traffic laws with AI traffic scientists

AI交通科学家自主发现交通规律

Xingyuan Dai, Yue Liu, Xiaoyan Gong, Qinghai Miao, Junyou Shang, Yutong Wang, Chao Guo, Yonglin Tian, Yizhang Chai, Chao Xiang, Yisheng Lv, Fei-Yue Wang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) China Telecom Research Institute(中国电信研究院) Macau Institute of Systems Engineering, Macau University of Science and Technology(澳门科技大学澳门系统工程研究所) State Key Laboratory for Management and Control of Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统管理与控制国家重点实验室)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出TrafficSci智能体系统,通过迭代工作流自主发现交通规律,在四个案例中重现已知规律并发现城市驾驶行为中的内在时间记忆尺度。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏