arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-02 至 2026-04-02 共收录 30 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 30 篇

2604.00510 2026-04-02 cs.AI 83%

Adaptive Parallel Monte Carlo Tree Search for Efficient Test-time Compute Scaling

自适应并行蒙特卡洛树搜索用于高效测试时间计算扩展

Hongbeen Kim, Juhyun Lee, Sanghyeon Lee, Kwanghoon Choi, Jaehyuk Huh

机构 * School of Computing, Korea Advanced Institute of Science and Technology(韩国科学技术院计算学院)

专题命中 规划推理 :test-time compute(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 本文提出负早退和自适应提升机制,通过优化MCTS执行效率,降低端到端延迟并提升吞吐量,同时保持推理准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10441 2026-04-02 cs.RO 82%

KnowDiffuser: A Knowledge-Guided Diffusion Planner with LLM Reasoning

KnowDiffuser: 一种基于知识的扩散规划器与大语言模型推理

Fan Ding, Xuewen Luo, Fengze Yang, Bo Yu, HwaHui Tew, Ganesh Krishnasamy, Junn Yong Loo

机构 * Monash University Malaysia(莫纳什大学马来西亚校区) University of Utah(犹他大学)

专题命中 规划推理 :reasoning(title,abstract);planning(abstract)

AI总结 本文提出KnowDiffuser,结合大语言模型的语义理解和扩散模型的生成能力,有效解决自动驾驶中语义到物理的鸿沟问题,实验表明其在开放环和闭环评估中表现优异。

Comments 10pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01212 2026-04-02 cs.CL cs.AI 81%

$\texttt{YC-Bench}$: Benchmarking AI Agents for Long-Term Planning and Consistent Execution

YC-Bench:评估长期规划和一致执行的AI代理基准测试

Muyu He, Adit Jain, Anand Kumar, Vincent Tu, Soumyadeep Bakshi, Sachin Patro, Nazneen Rajani

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出YC-Bench基准测试,评估AI代理在长期任务中维持战略一致性的能力,通过模拟一年初创公司运营,测试代理在不确定环境中的规划、学习与适应能力,发现仅三模型能持续超越初始资金,Scratchpad使用是成功关键,对抗性客户检测是主要失败模式。

Comments 16 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11536 2026-04-02 cs.CL cs.AI 81%

HARP: Hallucination Detection via Reasoning Subspace Projection

通过推理子空间投影进行幻觉检测:HARP

Junjie Hu, Gang Tu, ShengYu Cheng, Jinxin Li, Jinting Wang, Rui Chen, Zhilong Zhou, Dongbo Shan

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 HARP通过推理子空间投影方法检测大语言模型中的幻觉,通过分解隐藏状态空间并应用SVD提升鲁棒性,实验显示在TriviaQA上达到92.8%的AUROC。

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13841 2026-04-02 cs.AI 80%

LocationReasoner: Evaluating LLMs on Real-World Site Selection Reasoning

LocationReasoner: 评估大语言模型在真实世界选址推理中的能力

Miho Koda, Yu Zheng, Ruixian Ma, Mingyang Sun, Devesh Pansare, Fabio Duarte, Paolo Santi

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出LocationReasoner基准测试,评估大语言模型在复杂现实选址场景中的推理能力,发现先进模型在实际应用中表现有限,且代理策略常因过度推理而效果不佳。

Comments ICLR 2026 Workshop on Efficient Spatial Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14295 2026-04-02 cs.CL cs.AI cs.LG 80%

Demystifying Chains, Trees, and Graphs of Thoughts

解开思维链、树和图的谜团

Maciej Besta, Florim Memedi, Zhenyu Zhang, Robert Gerstenberger, Guangyuan Piao, Nils Blach, Piotr Nyczyk, Marcin Copik, Grzegorz Kwaśniewski, Jürgen Müller, Lukas Gianinazzi, Ales Kubicek, Hubert Niewiadomski, Aidan O'Mahony, Onur Mutlu, Torsten Hoefler

机构 * ETH Zurich(苏黎世联邦理工学院) Dell(戴尔) Cledar BASF SE(巴斯夫欧洲公司)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过分析提示执行流程,构建了首个结构增强的大语言模型推理方案分类法,揭示了不同结构对推理性能和成本的影响,并探讨了提示工程与语言模型生态系统的理论基础。

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, Volume 47, Issue 12, pages 10967-10989 (December 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01113 2026-04-02 cs.CL 79%

CARE: Privacy-Compliant Agentic Reasoning with Evidence Discordance

CARE:具有证据不一致性的隐私合规代理推理

Haochen Liu, Weien Li, Rui Song, Zeyu Li, Chun Jason Xue, Xiao-Yang Liu, Sam Nallaperuma, Xue Liu, Ye Yuan

机构 * University of Cambridge(剑桥大学) McGill University(麦吉尔大学) MBZUAI - Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Columbia University(哥伦比亚大学) Mila - Quebec AI Institute(米拉-魁北克人工智能研究所)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 针对医疗领域中症状与体征矛盾的问题,CARE框架通过多阶段隐私合规的代理推理,在不访问敏感数据的情况下提升冲突证据处理能力。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01213 2026-04-02 cs.RO cs.MA 78%

Collaborative Task and Path Planning for Heterogeneous Robotic Teams using Multi-Agent PPO

异构机器人团队协同任务与路径规划的多智能体PPO方法

Matthias Rubio, Julia Richter, Hendrik Kolvenbach, Marco Hutter

机构 * Robotic Systems Lab (RSL), ETH Zürich(苏黎世联邦理工学院机器人系统实验室(RSL))

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出基于多智能体PPO的协同规划策略,用于解决复杂的目标分配与调度问题,通过对比穷举搜索得到的单目标最优解,评估其在行星探索场景中的在线重规划能力。

Comments 8 pages, 3 figures, associated code on https://github.com/leggedrobotics/multi_robot_global_planner

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00213 2026-04-02 cs.RO math.OC 78%

A Player Selection Network for Scalable Game-Theoretic Prediction and Planning

一种用于可扩展博弈论预测与规划的玩家选择网络

Tianyu Qiu, Eric Ouano, Fernando Palafox, Christian Ellis, David Fridovich-Keil

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出PSN Game框架,通过学习玩家选择网络减少博弈规模,提升预测准确性和规划安全性,同时利用目标推断网络处理信息不完全场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00320 2026-04-02 cs.RO cs.SY eess.SY 78%

Hierarchical Motion Planning and Control under Unknown Nonlinear Dynamics via Predicted Reachability

通过预测可达性在未知非线性动力学下进行分层运动规划与控制

Zhiquan Zhang, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出一种分层规划-控制框架,通过分步逼近未知非线性系统,利用可达性理论和预测可达性条件保证运动规划的正式可达性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08545 2026-04-02 cs.CL cs.AI cs.CV cs.MA 73%

Curriculum Guided Massive Multi Agent System Solving For Robust Long Horizon Tasks

课程引导的大规模多智能体系统解决稳健长周期任务

Indrajit Kar, Kalathur Chenchu Kishore Kumar

机构 * Wipro Innovation Networks(威普罗创新网络)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种分层多智能体架构,通过空间课程逐步扩展网格区域,使智能体先掌握中央任务再处理外围任务,提升长周期任务的稳定性和推理能力。

Comments 22 pages, 2 tables, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00451 2026-04-02 cs.MA cs.SY eess.SY 71%

CASCADE: Cascaded Scoped Communication for Multi-Agent Re-planning in Disrupted Industrial Environments

CASCADE:多智能体重新规划中的级联作用域通信

Mingjie Bi

专题命中 规划推理 :planning(title)

AI总结 本文提出CASCADE机制,通过显式作用域控制实现多智能体在受扰工业环境中的重新规划,解决通信预算和延迟约束下的协调问题,提升鲁棒性。

Comments Published at ICLR 2026 Workshop on AI for Mechanism Design and Strategic Decision Making

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00317 2026-04-02 cs.DC cs.NI 71%

From Skew to Symmetry: Node-Interconnect Multi-Path Balancing with Execution-time Planning for Modern GPU Clusters

从倾斜到对称:节点-互连多路径平衡与执行时间规划用于现代GPU集群

Jinghan Yao, Kaushik Kandadi, Bharath Ramesh, Hari Subramoni, Dhabaleswar K. Panda

专题命中 规划推理 :planning(title)

AI总结 本文提出NIMBLE系统,通过动态重分布流量平衡节点内和节点间路径的利用率,提升GPU集群的通信性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01020 2026-04-02 cs.MA cs.AI 70%

OrgAgent: Organize Your Multi-Agent System like a Company

OrgAgent: 以公司式层级结构组织你的多智能体系统

Yiru Wang, Xinyue Shen, Yaohui Han, Michael Backes, Pin-Yu Chen, Tsung-Yi Ho

机构 * The Chinese University of Hong Kong(香港中文大学) IBM Research(IBM研究院) CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出OrgAgent框架,通过治理、执行、合规三层结构提升多智能体系统的推理性能,实验显示层级结构在任务稳定性、信息控制和验证方面表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00186 2026-04-02 eess.SY cs.AI cs.CY cs.SY econ.GN q-fin.EC stat.AP 70%

Agentic AI and Occupational Displacement: A Multi-Regional Task Exposure Analysis of Emerging Labor Market Disruption

代理AI与职业替代:新兴劳动力市场破坏的多地区任务暴露分析

Ravish Gupta, Saket Kumar

机构 * BigCommerce University at Buffalo, The State University of New York(纽约州立大学布法罗分校)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文扩展了Acemoglu-Restrepo的任务暴露框架,分析代理AI系统对劳动力市场的影响,提出Agentic Task Exposure(ATE)评分,揭示职业替代风险及新兴职业领域。

Comments 26 pages, 2 figures, 6 tables. Submitted to IMF-OECD-PIIE-World Bank Conference on Labor Markets and Structural Transformation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02976 2026-04-02 cs.AI 70%

Teaching AI to Handle Exceptions: Supervised Fine-Tuning with Human-Aligned Judgment

教AI处理例外:基于人类对齐判断的监督微调

Matthew DosSantos DiSorbo, Harang Ju, Sinan Aral

机构 * Harvard Business School(哈佛商学院) Johns Hopkins University(约翰霍普金斯大学) MIT Sloan School of Management(麻省理工学院斯隆管理学院)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 研究探讨了如何通过监督微调使AI处理例外,发现使用人类解释的微调能显著提升模型决策能力,揭示了对齐人类判断需明确训练决策过程而非仅决策结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00061 2026-04-02 cs.RO cs.SY eess.SP eess.SY 67%

Advancing Multi-Robot Networks via MLLM-Driven Sensing, Communication, and Computation: A Comprehensive Survey

通过MLLM驱动的感知、通信与计算推进多机器人网络:综述

Hyun Jong Yang, Howon Lee, Kyuhong Shim, Jeongho Kwak, Hyunsoo Kim, Donghoon Kim, Khoa Anh Ngo, Sehyun Ryu, Jaehyun Choi, Youbin Kim, Chanjun Moon, Michael Ryoo, Byonghyo Shim

机构 * Seoul National University(首尔大学) Ajou University(亚洲大学) Sungkyunkwan University(成均馆大学) Korea University(高丽大学) POSTECH(浦项科技大学) Stony Brook University(石溪大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文综述了MLLM指导下的多机器人协调,探讨了集成设计对多机器人协作的影响,展示了四种端到端演示,强调了系统级指标的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00324 2026-04-02 cs.LG cs.AI 62%

The Persistent Vulnerability of Aligned AI Systems

对齐AI系统持续的脆弱性

Aengus Lynch

机构 * University College London(伦敦大学学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了自主AI代理在文件系统访问、电子邮件控制和多步骤规划中的部署问题,提出ACDC、LAT等方法以解决AI安全四大难题,通过实验展示对抗性攻击的成功率及模型对齐测试结果。

Comments PhD thesis, University College London, 2025. 157 pages. Supervised by Ricardo Silva

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00010 2026-04-02 cs.CL cs.AI 62%

Can LLMs Perceive Time? An Empirical Investigation

大语言模型能感知时间吗?一项实证研究

Aniketh Garikaparthi

机构 * TCS Research(塔塔咨询服务公司研究院)

专题命中 规划推理 :planning(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨大语言模型在时间估计上的局限性,通过68项任务和四类模型进行实验,发现模型在预任务估计、相对排序和事后回忆中均存在显著误差,表明模型缺乏对自身推理时间的体验性认知。

Comments ICLR 2026 I Can't Believe It's Not Better Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01221 2026-04-02 cs.AI cs.CV 57%

HippoCamp: Benchmarking Contextual Agents on Personal Computers

HippoCamp:在个人电脑上对上下文代理进行基准测试

Zhe Yang, Shulin Tian, Kairui Hu, Shuai Liu, Hoang-Nhat Nguyen, Yichi Zhang, Zujin Guo, Mengying Yu, Zinan Zhang, Jingkang Yang, Chen Change Loy, Ziwei Liu

机构 * S-Lab, Nanyang Technological University, Singapore(新加坡南洋理工大学S-Lab)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 HippoCamp是一个新的基准,用于评估代理在多模态文件管理中的能力,通过用户为中心的环境建模个体用户档案并搜索大规模个人文件进行上下文感知推理,揭示了当前代理在真实环境中的局限性。

Comments Project Page: https://hippocamp-ai.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28183 2026-04-02 cs.AI 57%

PReD: An LLM-based Foundation Multimodal Model for Electromagnetic Perception, Recognition, and Decision

PReD:基于大语言模型的电磁感知、识别与决策基础多模态模型

Zehua Han, Jing Xiao, Yiqi Duan, Mengyu Xiang, Yuheng Ji, Xiaolong Zheng, Chenghanyu Zhang, Zhendong She, Junyu Shen, Dingwei Tan, Shichu Sun, Zhou Cong, Mingxuan Liu, Fengxiang Wang, Jinping Sun, Yangang Sun

机构 * Tsinghua University(清华大学) National University of Defense Technology(国防科技大学) Beihang University(北京航空航天大学) Tianjin University(天津大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) Institute of Microelectronics, Chinese Academy of Sciences(中国科学院微电子研究所) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) The Hong Kong University of Science and Technology(香港科技大学) Civil Aviation University of China(中国民航大学) Beijing Institute of Technology(北京理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出PReD,首个电磁领域基础模型,涵盖感知、识别与决策闭环,构建高质量多任务电磁数据集和评估基准,通过多阶段训练策略提升电磁领域能力,实验显示在PReD-Bench上达到最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19846 2026-04-02 cs.AI 57%

HiMA-Ecom: Enabling Joint Training of Hierarchical Multi-Agent E-commerce Assistants

HiMA-Ecom:面向电商场景的分层多智能体助手联合训练

Junxing Hu, Ai Han, Haolan Zhan, Pu Wei, Zhiqian Zhang, Yuhang Guo, Jiawei Lu, Zhen Chen, Haoran Li, Zicheng Zhang

机构 * JD Retail, JD.com, Inc.(京东零售,京东集团) Faculty of Engineering and Information Technology, The University of Melbourne(墨尔本大学工程与信息技术学院) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出HiMA-Ecom电商多智能体基准,通过VR-GRPO算法实现多智能体联合训练,基于3B/7B开源模型在电商场景中取得优于DeepSeek-V3的性能。

Comments 39 pages, 10 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00281 2026-04-02 cs.AI 57%

Human-in-the-Loop Control of Objective Drift in LLM-Assisted Computer Science Education

人机协同控制LLM辅助计算机科学教育中的目标漂移

Mark Dranias, Adam Whitley

机构 * Asheville Institute for Memory and Longevity(阿什维尔记忆与长寿研究所) University of North Carolina Asheville(北卡罗来纳大学阿什维尔分校)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出一种人机协同的教学方法,通过分离规划与执行,训练学生在代码生成前指定接受标准和架构约束,以稳定AI辅助学习过程。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00074 2026-04-02 cs.LG cs.CY 57%

PASM: Population Adaptive Symbolic Mixture-of-Experts Model for Cross-location Hurricane Evacuation Decision Prediction

PASM:用于跨地点飓风疏散决策预测的群体自适应符号混合专家模型

Xiao Qian, Shangjia Dong

机构 * University of Delaware(特拉华大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 本文提出PASM模型,通过符号回归与混合专家架构,解决跨地点疏散决策预测中的泛化问题,实现高准确率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00659 2026-04-02 eess.SY cs.SY 50%

Battery Electric Truck Infrastructure Co-design via Joint Optimization and Agent-based Simulation

通过联合优化和基于代理的仿真设计电池电动卡车基础设施

Juan Pablo Bertucci, Mauro Salazar, Theo Hofman

专题命中 规划推理 :planning(abstract)

AI总结 本文通过联合优化和基于代理的仿真,研究了物流配送网络中充电基础设施与调度的协同设计,验证了优化框架在荷兰案例中的有效性,展示了优化策略在降低成本和减少排队时间方面的优势。

Journal ref IEEE Transactions on Transportation Electrification, vol. 11, no. 5, pp. 11296-11306, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00428 2026-04-02 cs.RO 50%

Certificate-Driven Closed-Loop Multi-Agent Path Finding with Inheritable Factorization

基于证书的闭环多智能体路径寻找与可继承分解

Jiarui Li, Runyu Zhang, Gioele Zardini

机构 * Laboratory for Information and Decision Systems, Massachusetts Institute of Technology(麻省理工学院信息与决策系统实验室)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出基于证书的闭环多智能体路径寻找方法,通过可继承分解提升密集场景下的路径规划一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22514 2026-04-02 eess.SY cs.SY 50%

Robust Multi-Agent Safety via Tube-Based Tightened Exponential Barrier Functions

通过管状紧缩指数屏障函数实现多智能体系统鲁棒安全性

Armel Koulong, Ali Pakniyat

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种构造性框架,用于合成非线性多智能体系统在有界扰动下的可证明安全控制器。核心贡献是通过约束紧缩方法将鲁棒误差反馈与名义轨迹规划相结合,利用RPI管的几何特性推导状态依赖的安全余量,从而保证轨迹安全性。

Comments Joint submission to IFAC World Congress 2026 and NAHS journal (Reference: NAHS_101717). Accepted for NAHS journal; under review by World Congress

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09744 2026-04-02 cs.MA 50%

Inferring Occluded Agent Behavior in Dynamic Games from Noise Corrupted Observations

从噪声受损观测中推断动态博弈中被遮挡行为

Tianyu Qiu, David Fridovich-Keil

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种考虑遮挡的博弈推理方法,用于估计可能被遮挡的智能体位置,并推断可见和被遮挡智能体的意图,同时验证了在噪声观测下的导航安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22588 2026-04-02 cs.HC cs.ET 50%

Practitioner Voices Summit: How Teachers Evaluate AI Tools through Deliberative Sensemaking

实践者声音峰会:教师如何通过 deliberative sensemaking 评估 AI 工具

Dorottya Demszky, Christopher Mah, Helen Higgins

专题命中 规划推理 :reasoning(abstract)

AI总结 本文探讨教师在整合AI工具时的评估标准及支持条件,通过全国峰会收集61名数学教师制定的200余条评估标准,揭示了 deliberative sensemaking 的五种机制及TPACK与代理的相互促进循环。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22690 2026-04-02 cs.CV 50%

Ar2Can: An Architect and an Artist Leveraging a Canvas for Multi-Human Generation

Ar2Can:利用画布进行多人体生成的架构与艺术家

Shubhankar Borse, Phuc Pham, Farzad Farhadzadeh, Seokeon Choi, Phong Ha Nguyen, Anh Tuan Tran, Sungrack Yun, Munawar Hayat, Fatih Porikli

机构 * Qualcomm AI Research, an initiative of Qualcomm Technologies, Inc.(高通人工智能研究院,高通技术公司旗下)

专题命中 规划推理 :planning(abstract)

AI总结 Ar2Can提出一种两阶段框架,通过分离空间规划与身份渲染,解决多人体生成中人脸身份丢失问题,采用空间引导的面部匹配奖励提升生成质量,使用合成数据实现高精度和保真度。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏