arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-08 至 2026-07-08 共收录 162 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 48 篇

2511.17649 2026-07-08 cs.CV cs.AI cs.RO 版本更新 70%

SWITCH: Benchmarking Modeling and Handling of Tangible Interfaces in Long-horizon Embodied Scenarios

SWITCH:在长时程具身场景中评估和处理具象接口的基准测试

Juntao Cheng, Wanyue Zhang, Zhiwei Yu, Shuo Ren, Zheqi He, Shaoxuan Xie, Guocai Yao, Jieru Lin, Börje F. Karlsson, Jiajun Zhang

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 SWITCH基准测试通过1170个时间交互视频,评估具象接口在真实第一人称环境中的闭环交互推理,揭示多模态模型在细粒度视觉-时间感知、结果验证和错误恢复方面的不足。

Comments The dataset is available at https://huggingface.co/datasets/BAAI-Agents/SWITCH

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05196 2026-07-08 cs.CL cs.AI cs.LG cs.SD eess.AS 新提交 67%

Unified Audio Intelligence Without Regressing on Text Intelligence

不退化文本智能的统一音频智能

Zhifeng Kong, Sang-gil Lee, Jaehyeon Kim, Boxin Wang, Zihan Liu, Sungwon Kim, Yang Chen, Arushi Goel, Rajarshi Roy, Wenliang Dai, Zhuolin Yang, Yangyi Chen, Dongfu Jiang, Sreyan Ghosh, Tuomas Rintamaki, Andrew Tao, Jonathan Raiman, Mohammad Shoeybi, Bryan Catanzaro, Wei Ping

机构 * Nemotron-Labs(Nemotron实验室)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出统一音频-文本大语言模型Audex,通过单Transformer解码器架构与多阶段训练,在实现多音频任务SOTA性能的同时,几乎不损失骨干文本LLM的原有文本智能能力。

Comments We release the Audex models at https://huggingface.co/collections/nvidia/nemotron-labs-audex

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05888 2026-07-08 cs.CR cs.AI 新提交 61%

i-EXAM: Instructable and Explainable Attack Connectivity Graph Modeler

i-EXAM:可指导且可解释的攻击连通性图建模器

Rakesh Podder, Wadia Ganim, Sarath Sreedharan, Indrajit Ray, Indrakshi Ray

机构 * Colorado State University(科罗拉多州立大学)

专题命中 规划决策 :planning(abstract,comments);分类 cs.AI

AI总结 i-EXAM工具借助规划编译,帮系统管理员创建复杂网络安全配置文件并做假设分析,可识别攻击路径、评估指标、生成强化策略,还能用大语言模型解释策略。

Comments In the Proceedings of the International Conference on Automated Planning and Scheduling (ICAPS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06522 2026-07-08 cs.AI cs.CV 新提交 57%

Bridging Physical Reasoning and Task Generalization via Visual Action Outcome Reasoning Alignment

通过视觉动作结果推理对齐实现物理推理与任务泛化的桥梁

Han-Jun Ko, Jr-Jen Chen, Haobo Yuan, Hsin-Ying Lee, Tiancheng Shen, Ming-Hsuan Yang, Yu-Chiang Frank Wang

机构 * National Taiwan University(国立台湾大学) The University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究针对视觉语言模型在物理推理中难以泛化的问题,提出VAORA奖励设计,包括视觉对齐奖励和视觉-动作对齐奖励,通过预训练专家估计概率实现平滑密集奖励,经实验验证可有效提升模型在新任务和未见环境中的物理推理性能。

Comments ICML'26 Workshop RLxF: Reinforcement Learning from World Feedback

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06223 2026-07-08 cs.AI 新提交 57%

Information Gain-based Rollout Policy Optimization: An Adaptive Tree-Structured Rollout Approach for Multi-Turn LLM Agents

基于信息增益的展开策略优化:一种用于多轮语言模型智能体的自适应树结构展开方法

Yijun Zhang, Fan Xu, Jiaxin Ding, Yule Xie, Shiqing Gao, Xin Ding, Haoxiang Zhang, Luoyi Fu, Xinbing Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究针对LLM智能体长期搜索任务中展开预算分配不合理问题,提出基于信息增益的展开策略优化(IGRPO),通过按节点信息性分配预算进行树结构展开,并利用诱导教师分布指导策略优化,实验验证该方法在相同预算下优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06004 2026-07-08 cs.SE 新提交 57%

Large Language Models Have Unreliable Understanding of Software Engineering Terminology

大语言模型对软件工程术语的理解不可靠

Huzaifa Ejaz, Fabian C. Peña, Steffen Herbold

专题命中 规划决策 :agentic(abstract);分类 cs.SE

AI总结 研究大语言模型对软件工程术语的理解程度,通过用正确及伪造定义提示,测量分类准确率与推理令牌合理性,发现多数模型虽能检测伪造定义,但存在拒绝正确定义的偏差,明确推理未持续改善结果,揭示了LLMs在术语理解上的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05722 2026-07-08 cs.CL 新提交 57%

Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

Nemotron-Labs-Diffusion:一种统一自回归、扩散和自推测解码的三模式语言模型

Yonggan Fu, Lexington Whalen, Abhinav Garg, Chengyue Wu, Maksim Khadkevich, Nicolai Oswald, Enze Xie, Daniel Egert, Sharath Turuvekere Sreenivas, Shizhe Diao, Chenhan Yu, Ye Yu, Weijia Chen, Sajad Norouzi, Jingyu Liu, Shiyi Lan, Ligeng Zhu, Jin Wang, Jindong Jiang, Morteza Mardani, Mehran Maghoumi, Song Han, Ante Jukić, Nima Tajbakhsh, Jan Kautz, Pavlo Molchanov

机构 * Nemotron-Labs(Nemotron实验室)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 介绍了统一AR、扩散和自推测解码的三模式语言模型Nemotron-Labs-Diffusion,通过联合目标训练,能切换模式。研究表明其目标互补,自推测模式表现优,有长期潜力,该模型家族在精度和速度上优于现有开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06017 2026-07-08 cs.LG math.OC 新提交 57%

Learning When to Automate: Queue Control in Human-AI Service Systems

学习何时自动化:人机服务系统中的队列控制

Giovanni Montanari, Marco Scarsini, Vianney Perchet

机构 * Inria(法国国家信息与自动化研究所) CREST(法国国立统计与经济管理学院) ENSAE(法国国立统计与经济管理学院) Institut Polytechnique de Paris(巴黎综合理工学院) Luiss University(罗马路易斯大学) Criteo AI Lab(Criteo人工智能实验室)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究人机服务系统中任务处理的资源分配问题,提出UCB - DPP策略,结合上置信界与漂移加惩罚控制学习未知参数并做队列感知决策,实现\(\widetilde{\mathcal{O}}(K\sqrt{T})\)遗憾值,保证人工服务队列平均速率稳定性,优于自然基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05758 2026-07-08 cond-mat.mtrl-sci cs.LG 新提交 57%

From Closed-Loop Optimization to Open Decision Making: Coupled Digital Twins for Predictive and Autonomous Microscopy

从闭环优化到开放决策:用于预测性和自主性显微镜的耦合数字孪生

Yu Liu, Boris Slautin, Ian Mercer, Jon-Paul Maria, Sergei V. Kalinin

机构 * Department of Materials Science and Engineering, University of Tennessee, Knoxville, Tennessee, 37996, USA(田纳西大学材料科学与工程系) Materials Science and Engineering Department, Materials Research Institute, the Pennsylvania State University, University Park, Pennsylvania, 16802, USA(宾夕法尼亚州立大学材料研究学院材料科学与工程系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究从闭环优化到开放决策的自动化实验,提出耦合数字孪生框架,通过样本孪生和仪器孪生分别编码材料状态与信号等,用于预测显微镜操作等,以力 - 距离曲线编码器等实现框架,为预测性操作和自主实验规划奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00582 2026-07-08 q-bio.PE cs.LG 交叉投稿 57%

How Environment and Urbanization Shape Bird Diversity in Sri Lanka

斯里兰卡的环境与城市化如何塑造鸟类多样性

Dilusha Chandrasiri, Maneesha Herath, Yasith Hewarathna, Muditha Herath, Gishan Bandara, Madara Mendis, Nathali Athukorala, Nisansa de Silva, Sandareka Wickramanayake

机构 * Dept. of Computer Science & Engineering, University of Moratuwa, Sri Lanka(斯里兰卡莫拉图瓦大学计算机科学与工程系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本研究整合空间、时间和环境数据,分析斯里兰卡鸟类多样性,发现土地覆盖类型比NDVI或温度更能预测鸟类多样性,城市化(以ALAN衡量)具有尺度依赖性效应,支持少数泛化种的高丰度但降低整体丰富度。

Comments IEEE conference paper. Dept. of Computer Science and Engineering, University of Moratuwa, Sri Lanka. Dataset and code publicly available on Hugging Face and GitHub

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04935 2026-07-08 cs.AI 版本更新 57%

What Type of Inference is Active Inference?

主动推理是一种什么类型的推理?

Wouter W. L. Nuijten, Mykola Lukashchuk, Thijs van de Laar, Bert de Vries

机构 * Department of Electrical Engineering(电气工程系) Eindhoven University of Technology(埃因霍温理工大学) Eindhoven, the Netherlands(荷兰埃因霍温) Lazy Dynamics Utrecht, the Netherlands(荷兰乌得勒支)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文通过变分自由能框架将主动推理中的期望自由能最小化分解为熵校正项和规划校正项,揭示了其推理本质,并在网格世界实验中验证了不同校正项的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13919 2026-07-08 cs.LG cs.NA math.NA 版本更新 57%

Adaptive digital twins for predictive decision-making: Online Bayesian learning of transition dynamics

自适应数字孪生用于预测决策:基于概率图模型的在线贝叶斯学习转移动力学

Eugenio Varetti, Matteo Torzoni, Marco Tezzele, Andrea Manzoni

机构 * MOX – Dipartimento di Matematica, Politecnico di Milano(MOX——数学系,米兰理工大学) Dipartimento di Ingegneria Civile e Ambientale, Politecnico di Milano(土木工程与环境工程系,米兰理工大学) Mathematics Department, Emory University(埃默里大学数学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出通过概率图模型实现数字孪生状态转移模型的自适应学习,利用动态贝叶斯网络建模物理与虚拟域的双向交互,通过贝叶斯更新实现转移动力学的分层在线学习,提升数字孪生的个性化、鲁棒性和成本效益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06229 2026-07-08 cs.LG 版本更新 57%

Deep Reinforcement Learning for Dynamic Origin-Destination Matrix Estimation in Microscopic Traffic Simulations Considering Credit Assignment

基于深度强化学习的微观交通模拟中考虑信用分配的动态OD矩阵估计

Donggyu Min, Seongjin Choi, Dong-Kyu Kim

机构 * Department of Civil and Environmental Engineering, Seoul National University(首尔国立大学土木与环境工程系) Institute of Construction and Environmental Engineering, Seoul National University(首尔国立大学建设与环境工程院) Department of Civil, Environmental, and Geo-Engineering, University of Minnesota(明尼苏达大学土木、环境与地球工程系)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出利用深度强化学习解决动态OD矩阵估计问题,通过序列决策方法提升交通模拟的校准精度,实验表明其在MSE上优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19771 2026-07-08 cs.AI 版本更新 57%

Beyond Reactivity: Measuring Proactive Problem Solving in LLM Agents

超越反应性:衡量大语言模型智能体中的主动解决问题能力

Gil Pasternak, Dheeraj Rajagopal, Julia White, Dhruv Atreja, Matthew Thomas, George Hurn-Maloney, Ash Lewis

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 研究旨在衡量大语言模型智能体的主动解决问题能力。提出PROBE方法,将主动性分解为三个核心能力。应用该方法评估领先模型和框架,发现即使最先进的模型表现也不佳,GPT-5和Claude Opus-4.1最佳端到端性能为40%,突出局限并揭示未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05740 2026-07-08 q-bio.PE 新提交 50%

Network amplification of dengue declines as endemicity rises: climate-adjusted directional spread across Costa Rican cantons, 1993-2012

登革热的网络传播随着地方流行性增加而下降:1993 - 2012年哥斯达黎加各县经气候调整的定向传播

Fabio Sanchez

专题命中 规划决策 :planning(abstract)

AI总结 研究哥斯达黎加1993 - 2012年登革热传播,通过每周病例数重建县间传播地图,经气候调整后发现传播具方向性且集中在特定区域,局部疫情会放大,随病例数增加放大效应下降,可为监测和控制提供依据。

Comments 20 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06499 2026-07-08 cs.RO 新提交 50%

Clustering-Embedded Model Predictive Path Integral Control: Avoiding Averaging-Induced Failure and Enabling Efficient Cluster Selection for Dynamic Obstacles

聚类嵌入模型预测路径积分控制:避免平均诱导失效并实现动态障碍物的高效聚类选择

Zidong Liu, Kaixin Chang, Xu Chen

机构 * University of Washington(华盛顿大学)

专题命中 规划决策 :planning(abstract)

AI总结 研究针对MPPI在杂乱环境中平均诱导失效问题,提出聚类嵌入MPPI框架。通过集成高保真修剪和聚类阶段重新定义控制律,利用DBSCAN等分离可行轨迹模式,结合智能选择逻辑。实验表明该方法能减轻障碍物前犹豫,缩短目标到达时间和末端执行器路径。

Journal ref IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06278 2026-07-08 cs.NI 新提交 50%

Quality-Aware Personalized AI Service Provisioning in UAV-Assisted 6G Networks

无人机辅助6G网络中质量感知的个性化人工智能服务供应

Mohammad Farhoudi, Masoud Shokrnezhad, Tarik Taleb

专题命中 规划决策 :planning(abstract)

AI总结 研究无人机辅助6G网络中质量感知的个性化AI服务供应问题,提出HyPE框架,集成移动感知预测、学习增强决策和启发式服务放置与路由,模拟实验显示其在覆盖范围、延迟、服务个性化等方面优于基线,突出预测学习增强供应的前景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06234 2026-07-08 cs.CV 新提交 50%

WING: A Window-Prior-Based Generative Network with Gated Inception for Cross-Modality CT Synthesis

WING:一种基于窗口先验的带门控inception的生成网络用于跨模态CT合成

Siyuan Mei, Yan Xia, Yipeng Sun, Siming Bayer, Zirong Li, Chengze Ye, Daiqi Liu, Fuxin Fan, Yixing Huang, Andreas Maier

机构 * Pattern Recognition Lab, Friedrich-Alexander-Universität Erlangen-Nürnberg(模式识别实验室,埃尔朗根-纽伦堡弗里德里希-亚历山大大学) Department of Orthodontics and Orofacial Orthopaedics, Friedrich-Alexander-Universität Erlangen-Nürnberg(正畸与口腔颌面正畸科,埃尔朗根-纽伦堡弗里德里希-亚历山大大学) Siemens Healthineers(西门子医疗) Institute of Medical Technology, Peking University(北京大学医学技术研究所)

专题命中 规划决策 :planning(abstract)

AI总结 研究旨在从MRI和CBCT生成CT体积改善放疗计划。核心方法是将回归目标重构成窗口表示,引入WING网络,含门控inception生成器、融合与细化变压器及联合对抗训练目标。主要贡献是在相关基准上达最优性能且支持单模型多解剖合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06165 2026-07-08 cs.RO 新提交 50%

EAGOR: Embodied Reasoning in Omni-direction

EAGOR:全方位的具身推理

Shriram Damodaran, Soumyaratna Debnath, Yan Wu, Wei-Yun Yau, Addison Lin Wang

机构 * EmPACT Lab, NTU Singapore Institute for Infocomm Research, A*STAR Singapore(EmPACT实验室,南洋理工大学信息与通信研究所,A*STAR新加坡)

专题命中 规划决策 :agent(abstract)

AI总结 研究针对现有视觉语言模型在处理360°观测时方向估计不一致的问题,提出无需训练的几何感知框架EAGOR,将方向推理表述为球面上的递归贝叶斯估计,引入球谐信念场,实验证明其性能优于现有方法。

Comments 12 Pages, 7 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06162 2026-07-08 cs.CV 新提交 50%

High-Resolution Artwork Outpainting with Global Blueprint Guidance and Layout Control

基于全局蓝图引导和布局控制的高分辨率艺术作品外绘画

Junha Kim, Hyunjoon Park, Donghyeon Cho

机构 * Hanyang University(汉阳大学)

专题命中 规划决策 :planning(abstract)

AI总结 研究针对高分辨率艺术作品外绘画存在的问题,提出全局蓝图引导的两阶段扩散框架,通过布局适配器生成蓝图并提取特征,并行合成局部补丁,实现高效合成与布局控制,提升视觉保真度、语义一致性并减少推理时间。

Comments Accepted at ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06123 2026-07-08 cs.RO 新提交 50%

MP-MPPI: A Motion Primitive Guided Sampling-Based Optimizer for Model Predictive Control

MP-MPPI:一种用于模型预测控制的基于运动原语引导采样的优化器

Marlon Mathisen, Aksel Vaaler, Olav Egeland, Eleni Kelasidi

机构 * Norwegian University of Science and Technology(挪威科技大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出MP-MPPI方法,通过运动原语扩展MPPI进行结构化采样,增强收敛。在实时采样优化循环中评估相关序列,解决路径规划局限。在四旋翼模拟器及导航任务中测试,增强控制空间探索且保持实时控制特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06018 2026-07-08 cs.RO 新提交 50%

RoboTALES: Learning Reasoning-Guided Robot Policies via Task-Aligned Simulated Futures

RoboTALES:通过任务对齐的模拟未来学习推理引导的机器人策略

Hanan Gani, Tejal Kulkarni, Madhoolika Chodavarapu, Nicklas Hansen, Manmohan Chandraker

机构 * University of California, San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 规划决策 :planning(abstract)

AI总结 针对预训练视频生成模型用于机器人策略规划的局限,提出RoboTALES框架,通过基于分层语言模型的规划器和基于视觉语言模型的评论家两大创新,学习任务对齐的模拟未来以训练机器人策略,在多样操纵任务中表现优于现有方法。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05869 2026-07-08 cs.RO cs.CV 新提交 50%

GraspIT: A Dataset Bridging the Sim-to-Real gap and back for Validated Grasping SE(3) Pose Generation

GraspIT:一个弥合模拟与现实差距并用于验证抓取SE(3)姿态生成的数据集

Paul Koch. Adem Karakurt, André Sers

机构 * Fraunhofer IPK(弗劳恩霍夫研究所)

专题命中 规划决策 :planning(abstract)

AI总结 研究针对新型物体抓取,提出GraspIT数据集。通过在Isaac Sim中对桌面场景进行物理滑动测试标注,经Real↔Sim循环反向投影到真实场景。贡献约31.6万个带注释RGBD帧集及开源工具,可用于桌面操作策略学习等。

Comments Preprint, release soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05818 2026-07-08 cs.AR 新提交 50%

GPU-Accelerated Effective Resistance Analysis for 3D IC Power Delivery Network

用于3D集成电路电源传输网络的GPU加速有效电阻分析

Jingchao Hu, Cheng Zhuo, Zhou Jin

专题命中 规划决策 :planning(abstract)

AI总结 研究3D集成电路电源传输网络,提出GPU加速框架用于早期精确有效电阻分析,相比传统直接求解器实现5至6个数量级加速,且误差偏差可忽略不计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05733 2026-07-08 cs.CV 新提交 50%

ARMS: Anchor-Relational Motion Streaming for Seamless Solo-Social Motion Transitions

ARMS:用于无缝单人-社交运动转换的锚定关系运动流

Huakun Liu, Qing Yu, Kent Fujiwara, Hideaki Uchiyama, Kiyoshi Kiyokawa

机构 * Nara Institute of Science and Technology(奈良科学技术研究所) LY Corporation(LY 公司)

专题命中 规划决策 :agent(abstract)

AI总结 研究旨在从文本生成连续且连贯的人类运动。提出ARMS框架,统一单人运动和人际互动,引入动态不对称表示,用因果关系扩散模型及关系门控实现。实验表明其提升了转换平滑度与社会连贯性,在互动基准测试中表现良好。

Comments Accepted by ECCV 2026. Project page: https://hkliu.com/arms

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06385 2026-07-08 physics.optics 新提交 50%

Sectorial customized corneal crosslinking for keratoconus: an inverse biomechanical design study with an anisotropic reduced shell finite-element surrogate

圆锥角膜的扇形定制角膜交联:基于各向异性简化壳有限元替代模型的逆生物力学设计研究

J. Sumaya-Martinez, A. Altamirano-Torres

专题命中 规划决策 :planning(abstract)

AI总结 针对圆锥角膜,提出逆生物力学设计框架,将角膜建模为各向异性简化壳以优化局部治疗模式。数值模拟显示扇形硬化能改善角膜情况,支持患者定制计算规划,为相关整合提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06128 2026-07-08 astro-ph.CO astro-ph.IM 新提交 50%

Executable verification through formalized expert reasoning in astronomical spectroscopy

通过天文光谱学中的形式化专家推理进行可执行验证

Haosong Wang, Ting Tan, Ji Yao, Jiajun Zhang, Qian Zheng, Christophe Yeche, Jean-Paul Kneib, Huanyuan Shan

专题命中 规划决策 :workflow(abstract)

AI总结 研究针对人工智能时代科学验证的人为瓶颈问题,提出FORMA可执行验证协议,将专家推理转化为工作流程,应用于天文光谱学的暗能量光谱仪目视检查目录,实现自动化推理与明确验证结合,评估候选输出。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03261 2026-07-08 cs.CV 新提交 50%

OmniLayout: A Schematic-Coupled Multimodal Benchmark for Constraint-Aware Geometric Reasoning in PCB Layout

OmniLayout:用于印刷电路板布局中约束感知几何推理的原理图耦合多模态基准测试

Taiting Lu, Kaiyuan Lin, Mingjia Wang, Haolin Ye, Runze Liu, Yuxin Tian, Vahe Melkonyan, Haoyu Wang, Muchuan Wang, Chufan Hong, Yifan Yang, Sung-Liang Chen, Yi-Chao Chen, Yicheng Jin, Mahanth Gowda

机构 * Pennsylvania State University(宾夕法尼亚州立大学) Shanghai Jiao Tong University(上海交通大学) Microsoft Research(微软研究院) Binghamton University(宾汉姆顿大学)

专题命中 规划决策 :agentic(abstract)

AI总结 介绍OmniLayout基准测试,用于评估大语言模型在印刷电路板布局放置推理。含1681个工业级原理图耦合PCB布局及四项任务,揭示当前大语言模型在PCB布局放置上有诸多局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01148 2026-07-08 cs.SI cs.SY eess.SY 新提交 50%

Emergence of Preferential Attachment and Glass-Ceiling Effects in Autonomous Networks of LLMs

LLM自主网络中优先连接与玻璃天花板效应的涌现

Yiming Zhang, Vikram Krishnamurthy

专题命中 规划决策 :agent(abstract)

AI总结 研究LLM代理自主选择合作者时网络结构的涌现,发现优先连接和类型依赖的玻璃天花板效应,通过平均场模型证明中心性收敛,实验验证了网络动态对集体性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25126 2026-07-08 cs.RO 版本更新 50%

HANDFUL: Sequential Grasp-Conditioned Dexterous Manipulation with Resource Awareness

HANDFUL: 有意识资源利用的顺序抓取-条件灵活操作

Ethan Foong, Yunshuang Li, Hao Jiang, Gaurav S. Sukhatme, Daniel Seita

机构 * Northwestern University(西北大学) University of Southern California(南加州大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出HANDFUL框架,通过资源感知抓取提升多任务操作的灵活性和鲁棒性,结合仿真与现实验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏