arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 4155 信号源:cs.CL, cs.AI, cs.LG

1. 复杂问题求解 362 篇

2607.25155 2026-07-29 eess.SY cs.SY 新提交 50%

VeraGrid-Agent: Tool-Augmented LLMs for Distribution Optimal Power Flow at the Grid Edge

VeraGrid-Agent:用于电网边缘分布式最优潮流的工具增强大语言模型

Shivanshu Tripathi, Hamed Mohsenian-Rad, Maziar Raissi

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对电网边缘分布式最优潮流问题,提出工具增强大语言模型VeraGrid-Agent,通过自主编写模拟器输入、执行求解器并读取输出作答。引入VeraGrid-MCQ-150测试评估,相比无工具推理,该模型显著提升准确率,且剩余错误源于推理而非求解器执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24554 2026-07-28 cs.IR cs.CV 新提交 50%

DeCoRAG: Cognitive Decoupling and Semantic-Aware Cropping for Complex Document Understanding

DeCoRAG:用于复杂文档理解的认知解耦和语义感知裁剪

Shuo Wang, Kai Zhang, Wenyuan Huang, Yizheng Yu, Xia Liao, Junming Su, Qing Wang, Fang Xi

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对复杂文档理解中多模态检索增强生成的难题,提出DeCoRAG方法,通过认知解耦、建立语义锚及区域感知裁剪机制,提升语义通过率,减少提示令牌,在复杂文档基准测试中取得良好效果。

Comments 11 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24116 2026-07-28 cs.CR 新提交 50%

A Cybersecurity MLPS Large Language Model with Multi-Path Retrieval Fusion

一种具有多路径检索融合的网络安全多级保护方案大语言模型

Qian Li, Zhenyan Qi, Liang Shen, Yuan Zhang, Yifan Wan, Junyuan Ma, Yining Hu

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 针对网络安全MLPS,提出集成多种检索策略的大语言模型框架,结合分层、基于树及基于词元化的匹配检索,减少无关干扰,采用多维加权评分评估,在十个典型问题实验中该特定领域模型总分更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22082 2026-07-27 cs.MA 新提交 50%

When Language Models Meet NeuroGraphs: Exploring Enhanced Agentic LLM Framework Towards Brain Network Analysis

当语言模型遇上神经图谱:探索用于脑网络分析的增强型智能语言模型框架

Jiaxing Li, Rui Dong, Muyao Tang, Youyong Kong

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对脑网络分析中现有方法解释性有限等问题,提出BrainAgent智能语言模型框架,将连接组分类设为迭代过程,经特定工具转换、知识检索等步骤生成结构化预测,实验证明其优于基线,为脑网络分析提供实用路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21519 2026-07-24 cs.IR 新提交 50%

Diffusion Language Model for Recommendation

用于推荐的扩散语言模型

Chengyi Liu, Yongqi Zhou, Junwei Pan, Zhixiang Feng, Chengguo Yin, Haijie Gu, Jie Jiang, Yinghao Liu, Yujuan Ding, Qing Li, Wenqi Fan

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对现有推荐系统中自回归范式的不足,受扩散语言模型启发,提出 DLMRec。该模型引入协作感知随机分词器、课程驱动训练策略、稳定性感知投票机制,为推荐提供了新的离散扩散语言模型及有效方法。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20207 2026-07-23 cs.RO 新提交 50%

SeededGrasp: Language-Guided Grasping in Complex Scenes with Multiple Embodiments

SeededGrasp:复杂场景中多实体语言引导抓取

Yang Xu, Gurpreet Singh Mukker, Raymond Wang, Jasper Gerigk, Maria Attarian, Igor Gilitschenski

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) University of British Columbia(英属哥伦比亚大学) Google Deepmind(谷歌DeepMind)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 针对复杂场景中机器人抓取问题,提出 SeededGrasp 框架,通过 VLM 预测种子点,结合轻量级抓取生成模型,解耦语义与几何执行,无需端到端训练,发布多实体数据集,实验证明该方法优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18869 2026-07-22 cs.CR 新提交 50%

Tracing the Shadows: Automatic Tracking and Analysis of Crypto Money Laundering via Transaction Semantic Analysis

追踪阴影:通过交易语义分析对加密货币洗钱进行自动跟踪与分析

Hao Wu, Haijun Wang, Shangwang Li, Yin Wu, Ming Fan, Ting Liu, Xiapu Luo

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对加密货币洗钱问题,提出AMLGuard语义感知框架,结合静态规则分析与LLM推理,对复杂DeFi交易语义分析,实现非法资金流追踪,在真实案例评估中取得高精度召回率,有效应对加密货币洗钱。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17527 2026-07-21 cs.HC 新提交 50%

Sidekick: Designing Communication for Effective Multitasking with Computer Use Agents

Sidekick:与计算机使用代理进行有效多任务通信的设计

Ruei-Che Chang, Wenqian Xu, Dingzeyu Li, Bryan Wang, Anhong Guo

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对计算机使用代理文本反馈问题,开发Sidekick原型系统,在不同交互阶段用多模态反馈传达其状态,经30人参与的研究验证其能显著提升多任务性能,有效支持进度感知等,还展示了应用前景及对人机协作的意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17012 2026-07-21 cs.SE cond-mat.mtrl-sci physics.ins-det 新提交 50%

Schema-Bound LLM Control of Scientific Instrumentation through Model Context Protocol Skills

通过模型上下文协议技能对科学仪器进行模式绑定的大语言模型控制

Roberto dos Reis, Vinayak P. Dravid

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究如何通过模型上下文协议将本地大语言模型与科学仪器相连,结合多种技术实现连接,开源服务器展示相关工具等,通过软件验证,为闭环智能仪器研究提供基础。

Comments 36 pages, 8 figures, 7 tables. Open-source reference implementation, physics-plausible simulator, and validation suite. Software-only validation; live-instrument validation is not reported

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13792 2026-07-16 cs.CV 新提交 50%

EgoProceVQA: A Novel Egocentric Procedural Understanding Task with Self-Skill-Exploration Agent

EgoProceVQA:一种具有自我技能探索代理的新型自我中心程序理解任务

Junlong Li, Junxi Li, Yuxiang Yang, Wenbin Zou, Lap-Pui Chau, Yi Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) South China University of Technology(华南理工大学)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对现有自我中心视频理解评估忽视程序理解的问题,引入EgoProceVQA任务,开发EgoProceGen数据生成平台并构建基准。通过评估发现模型不足,进而提出EgoProceAgent框架,设计相关工具库,使其在多任务上获最优性能,为该任务奠定统一基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13087 2026-07-16 cs.CR 新提交 50%

GDM AI Control Roadmap

GDM人工智能控制路线图

Mary Phuong, Erik Jenner, Laurent Simon, Lewis Ho, Rohin Shah, Sebastian Farquhar, Scott Coull

专题命中 复杂问题求解 :chain-of-thought(abstract)

AI总结 研究如何保障人工智能代理融入系统时的安全,提出GDM人工智能控制路线图,通过保守威胁建模、基于能力的缓解措施及一系列实际防御构建多层防御体系,平衡安全与开发者速度,为内部安全提供蓝图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12621 2026-07-15 cs.CV cs.IR 新提交 50%

Towards Vision-Free CIR: Attribute-Augmented Scoring and LLM-Based Reranking for Zero-Shot Composed Image Retrieval

迈向无视觉的合成图像检索:基于属性增强评分和基于大语言模型的重排的零样本合成图像检索

Ryotaro Shimada, Yu-Chieh Lin, Yuji Nozawa, Youyang Ng, Osamu Torii, Yusuke Matsui

机构 * The University of Tokyo(东京大学) Kioxia Corporation(铠侠株式会社)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究如何让无视觉方法有效处理合成图像检索任务,通过属性增强混合评分和基于大语言模型的重排两项关键技术构建框架,在开放域CIRR数据集实验中优于现有零样本方法,在FashionIQ上凸显语义推理与视觉匹配权衡,消融研究验证技术有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11339 2026-07-14 cs.CV 新提交 50%

HierCAD: Hierarchical Text-to-CAD Design via Structure Alignment and Parameter Grounding

HierCAD:通过结构对齐和参数接地实现分层文本到CAD设计

Jimin Xu, Tianbao Wang, Tao Jin, Zhou Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 针对文本到CAD设计中结构一致性和参数确定问题,提出HierCAD框架,通过分解CAD构造树进行渐进推理,并引入SAPG学习策略,在CAD序列生成和模型评估上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11159 2026-07-14 cs.IR 新提交 50%

NGM-RAG: Neural Graph Matching based Retrieval-Augmented Generation

NGM-RAG:基于神经图匹配的检索增强生成

Guo Chen, Ziwen Li, Maolin Zheng, Hao Gao, Junjie Huang, Tao Jia

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对传统RAG方法在处理复杂问题时的局限,提出基于神经图匹配的检索增强生成框架NGM-RAG,将图构建、匹配与答案生成统一,结合文本匹配和GNN,采用自适应加权策略,实验证明该模型在多跳问答等任务中性能优越。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11087 2026-07-14 cs.DC cs.PF 新提交 50%

Energy Calculus: A Compositional Algebra of Energy in Computational Systems

能量演算:计算系统中能量的组合代数

Mosharaf Chowdhury, Jae-Won Chung, Jeff J. Ma, Nishil Talati, Ruofan Wu

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对能量缺乏形式化处理的问题,提出能量演算这一组合代数,基于能量元素及三个运算符,通过七条公理构建代数,有归约定理,不确定性可传播,运算符还能扩展到时间-能量帕累托前沿,实现节能策略组合及权衡推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09128 2026-07-13 cs.LO cs.PL 新提交 50%

Elusive but Coverable: The Recursion-Theoretic Structure of Complete Abstract Interpretations

难以捉摸但可覆盖:完全抽象解释的递归理论结构

Nicklas Carpenter, Roberto Giacobazzi

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 从递归理论角度研究抽象解释的局部完备性与不完备性,刻画静态和动态程序分析区别,证明诱导局部完备谓词变换器的程序类难以捉摸但有可判定覆盖,可通过程序转换构造有效枚举。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09123 2026-07-13 cs.SE 新提交 50%

ReProAgent: Tool-Augmented Multi-Stage Agentic Generation of Bug Reproduction Tests from Issue Reports

ReProAgent:从问题报告中通过工具增强的多阶段代理生成错误重现测试

Quanjun Zhang, Yi Zheng, Ye Shang, Weifeng Sun, Haichuan Hu, Chunrong Fang, Zhenyu Chen, Liang Xiao

专题命中 复杂问题求解 :planning(abstract)

AI总结 研究提出ReProAgent多阶段代理框架,从问题报告生成错误重现测试,将任务分解为四个阶段,集成多种工具支持各阶段,实验表明其能成功重现较多问题,优于基线,还可跨模型泛化并提升下游问题解决性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07192 2026-07-09 cs.CV 新提交 50%

Prototype-Anchored Generalized Manifold Regression for Unknown-Domain Object Detection

用于未知域目标检测的原型锚定广义流形回归

Zihao Zhang, Aming Wu, Yang Li, Yahong Han

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院)

专题命中 复杂问题求解 :chain-of-thought(abstract)

AI总结 研究单域广义目标检测,提出MR-DCoT方法,通过视觉-文本双思维链生成离群示例,利用类特定原型锚定学习校正算子,将未知域泛化建模为流形回归问题,实验验证了该方法在多场景下的有效性和通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07108 2026-07-09 cs.IR 新提交 50%

Seeing and Reflecting: Multimodal Memory-Enhanced Agent Collaboration for Recommendation

视觉与反思:用于推荐的多模态记忆增强智能体协作

Hao Cong, Huizu Lin, Zihan Wang, Chengkai Huang, Quan Z. Sheng, Lina Yao

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 针对基于LLM的推荐系统局限,提出MMEACR框架,采用双轨记忆架构,通过属性引导机制更新记忆,构建多模态嵌入记忆,经加权倒数排名融合两轨道,实验证明其在多领域表现出色,尤其视觉推荐场景有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06403 2026-07-08 cs.RO 新提交 50%

From Foundation to Application: Improving VLA Models in Practice

从基础到应用:在实践中改进VLA模型

Wei Wu, Fangjing Wang, Fan Lu, He Sun, Shi Liu, Yunnan Wang, Yibin Yan, Yong Wang, Shuailei Ma, Xinyang Wang, Yibin Liu, Shuai Yang, Tianxiang Zhou, Kejia Zhang, Lei Zhou, Cheng Su, Nan Xue, Bin Tan, Han Zhang, Youchao Zhang, Fei Liao, Xing Zhu, Yujun Shen, Kecheng Zheng

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 针对VLA模型实验室与实际应用差距问题,提出LingBot-VLA 2.0。通过改进数据处理、扩展动作空间及预测动力学建模等方法,经GM-100基准测试验证,提升了模型跨实体长距离移动操作能力。

Comments Website: https://technology.robbyant.com/lingbot-vla-v2, Github: https://github.com/robbyant/lingbot-vla-v2, Checkpoints: https://huggingface.co/collections/robbyant/lingbot-vla-v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04561 2026-07-07 cs.CG 新提交 50%

An Exact Generalized k-Cell Decomposition

一种精确的广义k细胞分解

Yeganeh Bahoo, Sajad Saeedi, Roni Sherman

专题命中 复杂问题求解 :planning(abstract)

AI总结 研究为配备k调制解调器的智能体在多边形环境中进行可见性规划提出精确k细胞分解,通过消除冗余线,确保可见性事件发生在分解线上,改进复杂度,明确关键事件位置并适用于带孔多边形,有实际应用。

Comments To appear in the Proceedings of the 38th Canadian Conference on Computational Geometry (CCCG 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03048 2026-07-07 cs.SE 新提交 50%

Compression, structure, and executor capability: a controlled real-cost decomposition of language-model agent skill optimisation

压缩、结构与执行能力:语言模型智能体技能优化的可控实际成本分解

Xiaonan Xu, Wenjing Wu

专题命中 复杂问题求解 :verifier(abstract)

AI总结 研究通过对多种条件下的技能交付进行可控分解,分离出无技能执行、原始技能等因素,对比质量(任务级验证通过率)和成本(解决阶段令牌成本),发现执行能力是主导因素,无优化表示比原始技能更优。

Comments 18 pages, 3 figures, 5 tables. Data and reproduction script: https://doi.org/10.5281/zenodo.21148499

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04009 2026-07-07 physics.flu-dyn 新提交 50%

PhysMiner: An Agentic AI Framework for Discovering Turbulence Physics

PhysMiner:用于发现湍流物理的智能体人工智能框架

Jiawei Chen, Han Gao, Ping He

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 研究针对湍流物理机制发现难题,提出PhysMiner框架,结合速度梯度张量三重分解与大语言模型推理,经多模块协作及库积累知识,实现自动分析并验证,为湍流物理发现奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00672 2026-07-02 cs.CV 新提交 50%

DART: Difficulty-Adaptive Routing for Zero-Shot Video Temporal Grounding

DART: 难度自适应路由用于零样本视频时间定位

Zhengbo Zhang, Mark He Huang, Zhigang Tu, Ming-Hsuan Yang

机构 * Singapore University of Technology and Design(新加坡科技设计大学) Wuhan University(武汉大学) University of California, Merced(加州大学默塞德分校)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 提出DART方法,通过难度感知路由和结构化推理,利用DPP选择关键帧并评估难度,对简单查询快速预测,复杂查询使用时间标记提示分解定位,在零样本视频时间定位中取得SOTA性能。

Comments Accepted to the European Conference on Computer Vision (ECCV) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00038 2026-07-02 cs.SE 新提交 50%

Stop Hand-Holding Your Coding Agent: Engineering the Loops that Replace Step-by-Step Prompting

停止手把手指导你的编码智能体:设计替代逐步提示的循环机制

Sandeco Macedo

专题命中 复杂问题求解 :self-correction(abstract)

AI总结 本文提出循环规范作为替代逐步提示的编码智能体新范式,定义其结构、分类与设计原则,并通过真实语料分析验证其成熟度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26201 2026-06-26 cs.RO 新提交 50%

OmniContact: Chaining Meta-Skills via Contact Flow for Generalizable Humanoid Loco-Manipulation

OmniContact: 通过接触流链接元技能实现可泛化的人形移动操作

Runyi Yu, Xiaoyi Lin, Ji Ma, Yinhuai Wang, Koukou Luo, Jiahao Ji, Huayi Wang, Wenjia Wang, Runhan Zhang, Ping Tan, Ting Wu, Ruoli Dai, Qifeng Chen, Lei Han

机构 * Noitom Robotics(诺亦腾机器人) The Hong Kong University of Science and Technology(香港科技大学) Wuhan University(武汉大学) The University of Hong Kong(香港大学)

专题命中 复杂问题求解 :planning(abstract)

AI总结 提出以接触流为核心的分层框架,通过低层策略学习统一技能库、高层模块合成未来接触流序列,实现人形机器人长时程任务的鲁棒执行与自主恢复,在搬运箱子和推叠箱子任务上分别达到98.7%和76.5%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24094 2026-06-24 cs.CV 新提交 50%

Universal Guideline-Driven Image Clustering via a Hybrid LLM Agent

通用指南驱动图像聚类:基于混合LLM代理

Wenliang Zhong, Rob Barton, Lucas Goncalves, Kushal Kumar, Feng Jiang, Hehuan Ma, Yuzhi Guo, Vidit Bansal, Karim Bouyarmane, Junzhou Huang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校) Amazon(亚马逊)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 提出首个通用图像聚类框架,通过文本指南弥合任务差异,利用生成式概念代理建模和基于最小生成树的LLM遍历,在多种聚类场景中超越专用方法。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23866 2026-06-24 cs.LO 新提交 50%

Complex Autonomous UAV Task Execution and Decision-Making With s(CASP)

基于s(CASP)的复杂自主无人机任务执行与决策

Keegan Kimbrell, Alexis R. Tudor, Peter Van, Trevor Bihl, Doug Slattery, Gopal Gupta

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 提出使用s(CASP)回答集编程系统构建符号状态中心的无人机代理,在虚幻引擎5环境中实现基于约束的常识推理,支持多步骤自主行为并动态调整计划,确保决策正确可解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23280 2026-06-23 cs.RO 新提交 50%

Causal Reward World Models: Zero-shot Reward Design for Automated Skill Generation

因果奖励世界模型:面向自动化技能生成的零样本奖励设计

Yang Yang, Yuchuang Tong, Zhengtao Zhang, Xu Ding, Ning Yang, Yifan Zhang, Haipeng Li, Kehu Yang, Miao Xin

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Intelligent Manufacturing Institute, HFUT(合肥工业大学智能制造研究院) School of Electrical Engineering and Automation, Anhui University(安徽大学电气工程与自动化学院) School of Artificial Intelligence, China University of Mining and Technology (Beijing)(中国矿业大学(北京)人工智能学院) National Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institution of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能全国重点实验室)

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 提出因果奖励世界模型(CRWM),通过离线预训练学习候选奖励组件与任务目标物理变量间的因果拓扑关系,结合显式机制解耦与置信感知软融合的联合优化模块构建因果骨架,使LLM在零样本下生成可执行奖励函数,无需反馈迭代,显著降低新技能设计延迟并保持或超越现有性能。

Comments 22 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19758 2026-06-19 cs.MA 新提交 50%

SIGMA: Skill-Incidence Graphs for Compositional Multi-Agent Design

SIGMA: 用于组合式多智能体设计的技能-关联图

Kun Zeng, Yu Huo, Siyu Zhang, Yuecheng Zhuo, Yuquan Lu, Haoyue Liu, Siyue Chen, Xiaoying Tang

专题命中 复杂问题求解 :reasoning(abstract)

AI总结 提出SIGMA框架,通过技能-智能体关联图将智能体构建为可复用技能的任务条件组合,并解码通信拓扑,在六个基准测试中优于基线方法,并展现出对未见技能库的鲁棒性。

Comments EMNLP2026

详情

展开后加载摘要…

URL PDF HTML 收藏