arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35471 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35471 篇

2602.13622 2026-02-17 cs.HC 82%

The Shadow Boss: Identifying Atomized Manipulations in Agentic Employment of XR Users using Scenario Constructions

影子老板:通过场景构建识别代理雇佣中XR用户原子化操控

Lik-Hang Lee

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract)

AI总结 本文通过场景构建方法,识别代理雇佣中XR用户面临的七个关键风险,揭示AI代理对人类劳动的原子化操控问题,呼吁需以用户为中心的XR和政策干预。

Comments 28 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13577 2026-02-17 cs.RO 82%

ONRAP: Occupancy-driven Noise-Resilient Autonomous Path Planning

ONRAP:基于占用度的抗噪声自主路径规划

Faizan M. Tariq, Avinash Singh, Vipul Ramtekkar, Jovin D'sa, David Isele, Yosuke Sakamoto, Sangjae Bae

机构 * Honda Research Institute, CA, USA(本田研究院,美国加利福尼亚州) Honda Research and Development(本田研发)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 ONRAP 提出了一种基于占用网格的抗噪声路径规划方法,结合占用流预测以生成安全可行的路径,实现实时运行并有效应对不确定环境。

Comments 8 pages, 9 figures - Presented at 2026 IEEE Intelligent Vehicles Symposium (IV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13086 2026-02-16 cs.RO 82%

UniManip: General-Purpose Zero-Shot Robotic Manipulation with Agentic Operational Graph

UniManip: 通用目的零样本机器人操作的代理操作图

Haichao Liu, Yuanjiang Xue, Yuheng Zhou, Haoyuan Deng, Yinan Liang, Lihua Xie, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(南洋理工大学电子与电气工程学院) Department of Automation, Tsinghua University, China(清华大学自动化系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 UniManip通过双层代理操作图实现通用零样本机器人操作,结合高层任务协调与底层动态状态表示,提升无监督环境下的执行鲁棒性。

Comments 15 pages, 12 figures, 6 tables, project page: https://henryhcliu.github.io/unimanip

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08987 2026-02-13 cs.CE 82%

Rapid prediction of cardiac activation in the left ventricle with geometric deep learning: a step towards cardiac resynchronization therapy planning

基于几何深度学习的左心室心脏激活快速预测:迈向心脏再同步治疗规划的一步

Ehsan Naghavi, Haifeng Wang, Vahid Ziaei Rad, Julius Guccione, Ghassan Kassab, Vishnu Boddeti, Seungik Baek, Lik-Chuan Lee

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本研究利用几何深度学习模型预测左心室激活时间图,以提高CRT治疗规划的精准度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09227 2026-02-11 cs.RO 82%

From Legible to Inscrutable Trajectories: (Il)legible Motion Planning Accounting for Multiple Observers

从可理解到不可理解的轨迹:考虑多个观察者的(不)可理解运动规划

Ananya Yammanuru, Maria Lusardi, Nancy M. Amato, Katherine Driggs-Campbell

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出MMLO-LMP问题,设计DUBIOUS算法,实现对不同动机观察者的轨迹可理解性与可见性限制的平衡。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04333 2026-02-10 cs.CV cs.RO 82%

RAP: 3D Rasterization Augmented End-to-End Planning

RAP: 3D 像素化增强端到端规划

Lan Feng, Yang Gao, Eloi Zablocki, Quanyi Li, Wuyang Li, Sichao Liu, Matthieu Cord, Alexandre Alahi

机构 * EPFL(苏黎世联邦理工学院) Sorbonne Université(索邦大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 RAP通过3D像素化增强端到端规划,利用轻量级像素化和特征对齐实现可扩展的数据增强,提升闭环鲁棒性和长尾泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23646 2026-02-06 cs.CV 82%

Active Perception Agent for Omnimodal Audio-Video Understanding

多模态音频视频理解的主动感知代理

Keda Tao, Wenjie Du, Bohan Yu, Weiqiang Wang, Jian Liu, Huan Wang

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 OmniAgent通过动态规划和音频引导感知范式,实现多模态细粒度推理,无需训练即超越现有模型性能。

Comments Website:https://kd-tao.github.io/OmniAgent/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03376 2026-02-04 cs.RO cs.CV 82%

PlanTRansformer: Unified Prediction and Planning with Goal-conditioned Transformer

PlanTRansformer: 一种结合目标条件变换器的统一预测与规划

Constantin Selzer, Fabina B. Flohr

机构 * Department of Electrical Engineering and Information Technology, Intelligent Vehicles Lab (IVL), Munich University of Applied Science(电气工程与信息科技系,智能车辆实验室(IVL),慕尼黑应用科学大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 PlanTRansformer通过整合目标条件预测、动态可行性等技术,提升自动驾驶中的预测与规划性能。

Comments Submitted and accepted at IEEE IV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01756 2026-02-03 cs.CV 82%

Mind-Brush: Integrating Agentic Cognitive Search and Reasoning into Image Generation

Mind-Brush: 将代理认知搜索与推理整合到图像生成中

Jun He, Junyan Ye, Zilong Huang, Dongzhi Jiang, Chenjue Zhang, Leqi Zhu, Renrui Zhang, Xiang Zhang, Weijia Li

机构 * Sun Yat-sen University(中山大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract)

AI总结 Mind-Brush通过整合代理认知搜索与推理,提升图像生成模型对复杂知识推理和动态适应能力,实现性能显著跃升。

Comments 36 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00325 2026-02-03 eess.SY cs.RO cs.SY 82%

Motion Planning with Metric Temporal Logic Using Reachability Analysis and Hybrid Zonotopes

使用可达性分析和混合容积集进行基于度量时序逻辑的运动规划

Andrew F. Thompson, Joshua A. Robbins, Jonah J. Glunt, Sean B. Brennan, Herschel C. Pangborn

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种基于可达性分析和混合容积集的运动规划方法,用于满足时间依赖任务需求,展示了其在处理动态环境和多智能体协调方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21504 2026-01-30 cs.RO 82%

Don't double it: Efficient Agent Prediction in Occlusions

不要双倍:遮挡中的高效代理预测

Anna Rothenhäusler, Markus Mazzola, Andreas Look, Raghu Rajan, Joschka Bödecker

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文提出MatchInformer方法,通过整合Hungarian匹配和分离航向与运动,提升遮挡场景下的代理预测准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20764 2026-01-29 cs.DC cs.MA 82%

Agentic Fog: A Policy-driven Framework for Distributed Intelligence in Fog Computing

代理雾:一种基于策略的雾计算分布式智能框架

Saeed Akbar, Muhammad Waqas, Rahmat Ullah

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract)

AI总结 本文提出了一种基于策略的雾计算框架,通过将雾节点建模为自主代理并利用势博弈理论,实现了动态环境下的高效资源管理和稳定系统收敛。

Comments 09 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18543 2026-01-29 cs.CV 82%

GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning

GenAgent:通过代理多模态推理扩展文本到图像生成

Kaixun Jiang, Yuzheng Wang, Junjie Zhou, Pandeng Li, Zhihang Liu, Chen-Wei Xie, Zhaoyu Chen, Yun Zheng, Wenqiang Zhang

机构 * Fudan University(复旦大学) Tongyi Lab(通义实验室) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 GenAgent通过代理多模态推理提升文本到图像生成性能,采用两阶段训练策略实现自主多轮交互与任务自适应推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19593 2026-01-28 cs.CV 82%

Localized Latent Editing for Dose-Response Modeling in Botulinum Toxin Injection Planning

局部潜在编辑用于肉毒素注射计划中的剂量-反应建模

Estèphe Arnaud, Mohamed Daoudi, Pierre Guerreschi

机构 * Univ. Lille, CNRS, Centrale Lille, Institut Mines-Télécom, UMR 9189 CRIStAL(里尔大学、国家科学研究中心、Centrale Lille、Institut Mines-Télécom、UMR 9189 CRIStAL) IMT Nord Europe, Institut Mines-Télécom, Univ. Lille, Centre for Digital Systems(IMT Nord Europe、Institut Mines-Télécom、里尔大学、数字系统中心) Lille University Hospital (CHU), Department of Plastic Surgery(里尔大学医院(CHU)、整形外科部门) SATT Nord

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本文提出了一种局部潜在编辑框架,通过剂量-反应建模实现肉毒素注射计划,利用区域特定潜在轴发现方法实现对特定面部区域的精确控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19303 2026-01-28 cs.HC cs.GR cs.MM 82%

A Collaborative Extended Reality Prototype for 3D Surgical Planning and Visualization

一种用于3D手术规划和可视化协作扩展现实原型

Shi Qiu, Ruiyang Li, Qixuan Liu, Yuqi Tong, Yue Qiu, Yinqiao Wang, Yan Li, Chi-Wing Fu, Pheng-Ann Heng

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本文提出了一种协作扩展现实原型,用于3D手术规划和可视化,通过用户研究验证了其有效性并为未来医疗XR协作提供启示。

Comments IEEE VR 2026 Posters

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17227 2026-01-27 cs.RO 82%

Hierarchical Informative Path Planning via Graph Guidance and Trajectory Optimization

基于图引导和轨迹优化的分层信息路径规划

Avraiem Iskandar, Shamak Dutta, Kevin Murrant, Yash Vardhan Pant, Stephen L. Smith

机构 * Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系) National Research Council Canada(加拿大国家研究理事会)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 本文提出一种分层信息路径规划方法,结合图引导和轨迹优化,通过分段预算分配和样条细化,实现更低的后验不确定性与更快的运行速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17915 2026-01-23 cs.MA 82%

DISPATCH -- Decentralized Informed Spatial Planning and Assignment of Tasks for Cooperative Heterogeneous Agents

DISPATCH -- 分布式知情空间规划与任务分配以实现协作异构代理

Yao Liu, Sampad Mohanty, Elizabeth Ondula, Bhaskar Krishnamachari

专题命中 规划决策 :planning(title);agent(abstract);multi-agent(abstract)

AI总结 DISPATCH提出两种算法,通过整合公平性和效率,在分布式环境下实现异构代理任务分配的公平与效率平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14601 2026-01-22 cs.CR cs.NI 82%

Holmes: An Evidence-Grounded LLM Agent for Auditable DDoS Investigation in Cloud Networks

Holmes:一种基于证据的LLM代理,用于可审计的云网络DDoS调查

Haodong Chen, Ziheng Zhang, Jinghui Jiang, Qiang Su, Qiao Xiang

专题命中 规划决策 :agent(title,abstract);workflow(abstract)

AI总结 Holmes是一种基于LLM的DDoS检测代理,通过结构化证据和可追溯的审计日志,实现云网络中可解释、可审计的DDoS调查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05516 2026-01-22 cs.LG cs.AI cs.CL 82%

BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling

BayesAgent: 通过 verbalized 概率图模型实现不确定性下的贝叶斯代理推理

Hengguan Huang, Xing Shen, Songtao Wang, Lingfa Meng, Dianbo Liu, David Alejandro Duchene, Hao Wang, Samir Bhatt

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 BayesAgent 通过 verbalized 概率图模型实现不确定性下的贝叶斯代理推理,提升置信度校准和文本生成质量。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06373 2026-01-13 cs.MA 82%

DemMA: Dementia Multi-Turn Dialogue Agent with Expert-Guided Reasoning and Action Simulation

DemMA:具有专家引导推理和行动模拟的痴呆多轮对话代理

Yutong Song, Jiang Wu, Kazi Sharif, Honghui Xu, Nikil Dutt, Amir Rahmani

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 DemMA通过专家引导的推理和行动模拟,实现了高保真的痴呆症患者多轮对话模拟,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02172 2026-01-12 cs.SI 82%

RumorSphere: A Framework for Million-scale Agent-based Dynamic Simulation of Rumor Propagation

RumorSphere: 用于百万级基于代理的动态谣言传播模拟的框架

Yijun Liu, Wu Liu, Xiaoyan Gu, Hantao Yao, Weiping Wang, Jiebo Luo, Yongdong Zhang

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 RumorSphere通过动态和分层的共振框架,实现百万级代理的谣言传播模拟,有效提升模拟精度并减少偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05087 2026-01-09 eess.SY cs.SY 82%

Online Bayesian Learning of Agent Behavior in Differential Games

在线贝叶斯学习差分博弈中的智能体行为

Francesco Bianchin, Robert Lefringhausen, Sandra Hirche

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出了一种在线贝叶斯方法,用于多智能体系统中行为识别,通过参数残差实现快速更新和鲁棒预测,适用于非线性动态和价值函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04878 2026-01-09 cs.AI cond-mat.mtrl-sci cs.CL cs.LG 82%

Higher-Order Knowledge Representations for Agentic Scientific Reasoning

高阶知识表示用于代理科学推理

Isabella A. Stewart, Markus J. Buehler

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出基于超图的知识表示方法,用于代理科学推理,通过高阶路径生成机理假设,提升科学发现效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01416 2026-01-06 cs.CV 82%

AirSpatialBot: A Spatially-Aware Aerial Agent for Fine-Grained Vehicle Attribute Recognization and Retrieval

AirSpatialBot: 一种空间感知的空中智能体用于细粒度车辆属性识别与检索

Yue Zhou, Ran Ding, Xue Yang, Xue Jiang, Xingzhao Liu

机构 * Department of Electronic Engineering, Shanghai Jiao Tong University(电子工程系,上海交通大学) Department of Automation, Shanghai Jiao Tong University(自动化系,上海交通大学)

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 AirSpatialBot通过空间感知的VLM和两阶段训练策略,实现细粒度车辆属性识别与检索,解决遥感图像中的空间理解难题。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01101 2026-01-06 cs.CY 82%

An Agentic Software Framework for Data Governance under DPDP

基于DPDP的数据治理代理软件框架

Apurva Kulkarni, Chandrashekar Ramanathan

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文提出基于DPDP的数据治理代理框架,通过协作代理和动态政策执行实现透明、合规的数据治理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00685 2026-01-05 physics.med-ph 82%

Human-like AI-based Auto-Field-in-Field Whole-Brain Radiotherapy Treatment Planning With Conversation Large Language Model Feedback

类人AI驱动的自动场内场全脑放疗治疗计划与对话大语言模型反馈

Adnan Jafar, An Qin, Gavin Atkins, Xiaoyu Hu, Yin Gao, Xun Jia

专题命中 规划决策 :planning(title,abstract);workflow(abstract)

AI总结 本研究提出基于深度学习和大语言模型的自动化全脑放疗计划制定方法,通过对话接口实现交互式优化,提升计划质量和效率。

Comments 22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24940 2026-01-01 cs.AI cs.CL cs.LG 82%

Iterative Deployment Improves Planning Skills in LLMs

迭代部署提升大语言模型的规划能力

Augusto B. Corrêa, Yoav Gelberg, Luckeciano C. Melo, Ilia Shumailov, André G. Pereira, Yarin Gal

机构 * University of Oxford(牛津大学) AI Sequrity Company(AI安全公司) UFRGS(乌拉圭联邦大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 通过迭代部署大语言模型,利用用户编纂的数据提升规划能力,展现隐含奖励函数的强化学习机制,具有AI安全和训练制度替代的双重意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20848 2025-12-25 cs.CL cs.AI cs.LG 82%

Nemotron 3 Nano: Open, Efficient Mixture-of-Experts Hybrid Mamba-Transformer Model for Agentic Reasoning

Nemotron 3 Nano:开放、高效专家混合混合Mamba-Transformer模型用于代理推理

NVIDIA, :, Aaron Blakeman, Aaron Grattafiori, Aarti Basant, Abhibha Gupta, Abhinav Khattar, Adi Renduchintala, Aditya Vavre, Akanksha Shukla, Akhiad Bercovich, Aleksander Ficek, Aleksandr Shaposhnikov, Alex Kondratenko, Alexander Bukharin, Alexandre Milesi, Ali Taghibakhshi, Alisa Liu, Amelia Barton, Ameya Sunil Mahabaleshwarkar, Amir Klein, Amit Zuker, Amnon Geifman, Amy Shen, Anahita Bhiwandiwalla, Andrew Tao, Ann Guan, Anubhav Mandarwal, Arham Mehta, Ashwath Aithal, Ashwin Poojary, Asif Ahamed, Asma Kuriparambil Thekkumpate, Ayush Dattagupta, Banghua Zhu, Bardiya Sadeghi, Barnaby Simkin, Ben Lanir, Benedikt Schifferer, Besmira Nushi, Bilal Kartal, Bita Darvish Rouhani, Boris Ginsburg, Brandon Norick, Brandon Soubasis, Branislav Kisacanin, Brian Yu, Bryan Catanzaro, Carlo del Mundo, Chantal Hwang, Charles Wang, Cheng-Ping Hsieh, Chenghao Zhang, Chenhan Yu, Chetan Mungekar, Chintan Patel, Chris Alexiuk, Christopher Parisien, Collin Neale, Damon Mosk-Aoyama, Dan Su, Dane Corneil, Daniel Afrimi, Daniel Rohrer, Daniel Serebrenik, Daria Gitman, Daria Levy, Darko Stosic, David Mosallanezhad, Deepak Narayanan, Dhruv Nathawani, Dima Rekesh, Dina Yared, Divyanshu Kakwani, Dong Ahn, Duncan Riach, Dusan Stosic, Edgar Minasyan, Edward Lin, Eileen Long, Eileen Peters Long, Elena Lantz, Ellie Evans, Elliott Ning, Eric Chung, Eric Harper, Eric Tramel, Erick Galinkin, Erik Pounds, Evan Briones, Evelina Bakhturina, Faisal Ladhak, Fay Wang, Fei Jia, Felipe Soares, Feng Chen, Ferenc Galko, Frankie Siino, Gal Hubara Agam, Ganesh Ajjanagadde, Gantavya Bhatt, Gargi Prasad, George Armstrong, Gerald Shen, Gorkem Batmaz, Grigor Nalbandyan, Haifeng Qian, Harsh Sharma, Hayley Ross, Helen Ngo, Herman Sahota, Hexin Wang, Himanshu Soni, Hiren Upadhyay, Huizi Mao, Huy C Nguyen, Huy Q Nguyen, Iain Cunningham, Ido Shahaf, Igor Gitman, Ilya Loshchilov, Ivan Moshkov, Izzy Putterman, Jan Kautz, Jane Polak Scowcroft, Jared Casper, Jatin Mitra, Jeffrey Glick, Jenny Chen, Jesse Oliver, Jian Zhang, Jiaqi Zeng, Jie Lou, Jimmy Zhang, Jining Huang, Joey Conway, Joey Guman, John Kamalu, Johnny Greco, Jonathan Cohen, Joseph Jennings, Joyjit Daw, Julien Veron Vialard, Junkeun Yi, Jupinder Parmar, Kai Xu, Kan Zhu, Kari Briski, Katherine Cheung, Katherine Luna, Keshav Santhanam, Kevin Shih, Kezhi Kong, Khushi Bhardwaj, Krishna C. Puvvada, Krzysztof Pawelec, Kumar Anik, Lawrence McAfee, Laya Sleiman, Leon Derczynski, Li Ding, Lucas Liebenwein, Luis Vega, Maanu Grover, Maarten Van Segbroeck, Maer Rodrigues de Melo, Makesh Narsimhan Sreedhar, Manoj Kilaru, Maor Ashkenazi, Marc Romeijn, Mark Cai, Markus Kliegl, Maryam Moosaei, Matvei Novikov, Mehrzad Samadi, Melissa Corpuz, Mengru Wang, Meredith Price, Michael Boone, Michael Evans, Miguel Martinez, Mike Chrzanowski, Mohammad Shoeybi, Mostofa Patwary, Nabin Mulepati, Natalie Hereth, Nave Assaf, Negar Habibi, Neta Zmora, Netanel Haber, Nicola Sessions, Nidhi Bhatia, Nikhil Jukar, Nikki Pope, Nikolai Ludwig, Nima Tajbakhsh, Nirmal Juluru, Oleksii Hrinchuk, Oleksii Kuchaiev, Olivier Delalleau, Oluwatobi Olabiyi, Omer Ullman Argov, Ouye Xie, Parth Chadha, Pasha Shamis, Pavlo Molchanov, Pawel Morkisz, Peter Dykas, Peter Jin, Pinky Xu, Piotr Januszewski, Pranav Prashant Thombre, Prasoon Varshney, Pritam Gundecha, Qing Miao, Rabeeh Karimi Mahabadi, Ran El-Yaniv, Ran Zilberstein, Rasoul Shafipour, Rich Harang, Rick Izzo, Rima Shahbazyan, Rishabh Garg, Ritika Borkar, Ritu Gala, Riyad Islam, Roger Waleffe, Rohit Watve, Roi Koren, Ruoxi Zhang, Russell J. Hewett, Ryan Prenger, Ryan Timbrook, Sadegh Mahdavi, Sahil Modi, Samuel Kriman, Sanjay Kariyappa, Sanjeev Satheesh, Saori Kaji, Satish Pasumarthi, Sean Narentharen, Sean Narenthiran, Seonmyeong Bak, Sergey Kashirsky, Seth Poulos, Shahar Mor, Shanmugam Ramasamy, Shantanu Acharya, Shaona Ghosh, Sharath Turuvekere Sreenivas, Shelby Thomas, Shiqing Fan, Shreya Gopal, Shrimai Prabhumoye, Shubham Pachori, Shubham Toshniwal, Shuoyang Ding, Siddharth Singh, Simeng Sun, Smita Ithape, Somshubra Majumdar, Soumye Singhal, Stefania Alborghetti, Stephen Ge, Sugam Dipak Devare, Sumeet Kumar Barua, Suseella Panguluri, Suyog Gupta, Sweta Priyadarshi, Syeda Nahida Akter, Tan Bui, Teodor-Dumitru Ene, Terry Kong, Thanh Do, Tijmen Blankevoort, Tom Balough, Tomer Asida, Tomer Bar Natan, Tugrul Konuk, Twinkle Vashishth, Udi Karpas, Ushnish De, Vahid Noorozi, Vahid Noroozi, Venkat Srinivasan, Venmugil Elango, Vijay Korthikanti, Vitaly Kurin, Vitaly Lavrukhin, Wanli Jiang, Wasi Uddin Ahmad, Wei Du, Wei Ping, Wenfei Zhou, Will Jennings, William Zhang, Wojciech Prazuch, Xiaowei Ren, Yashaswi Karnati, Yejin Choi, Yev Meyer, Yi-Fu Wu, Yian Zhang, Ying Lin, Yonatan Geifman, Yonggan Fu, Yoshi Subara, Yoshi Suhara, Yubo Gao, Zach Moshe, Zhen Dong, Zihan Liu, Zijia Chen, Zijie Yan

机构 * NVIDIA

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Nemotron 3 Nano是一种高效混合Mamba-Transformer模型,通过预训练和微调在代理推理任务中实现更高准确性和吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15705 2025-12-19 cs.CV 82%

GeoVista: Web-Augmented Agentic Visual Reasoning for Geolocalization

GeoVista: 基于网络增强的代理视觉推理用于地理定位

Yikun Wang, Zuyan Liu, Ziyi Wang, Han Hu, Pengfei Liu, Yongming Rao

机构 * Fudan University(复旦大学) Tencent Hunyuan(腾讯文元) Tsinghua University(清华大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract)

AI总结 GeoVista通过整合图像缩放和网络搜索工具,提升地理定位任务的代理模型性能,实现优于开源模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09081 2025-12-11 cs.CV 82%

AgentComp: From Agentic Reasoning to Compositional Mastery in Text-to-Image Models

AgentComp: 从代理推理到文本-图像模型中的组合性 mastery

Arman Zarei, Jiacheng Pan, Matthew Gwilliam, Soheil Feizi, Zhenheng Yang

机构 * TikTok University of Maryland(马里兰大学)

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract)

AI总结 AgentComp通过训练模型区分组合性相似的提示和图像,提升文本-图像模型的组合性生成能力,实现更准确的图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏