arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-08 至 2026-04-08 共收录 107 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 1 篇

2604.01591 2026-04-08 cs.AI 79%

ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement

ThinkTwice:联合优化大型语言模型以进行推理和自我完善

Difan Jiao, Qianfeng Wen, Blair Yang, Zhenwei Tang, Ashton Anderson

机构 * Department of Computer Science, University of Toronto(多伦多大学计算机科学系) Coolwei AI Lab(Coolwei AI实验室)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.AI

AI总结 ThinkTwice通过两阶段框架联合优化LLM,提升推理和自我完善性能,基于GRPO方法,在多个数学推理基准上优于现有基线。

Comments 27 pages,7 figures,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码与定理证明 3 篇

2402.09664 2026-04-08 cs.SE cs.AI cs.CL cs.PL 81%

CodeMind: Evaluating Large Language Models for Code Reasoning

CodeMind: 评估大型语言模型的代码推理能力

Changshu Liu, Yang Chen, Reyhaneh Jabbarvand

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出CodeMind框架,通过独立执行推理、规范推理和动态语义推理任务评估LLM的代码推理能力,发现LLM在处理复杂代码时性能下降,且bug修复性能与代码推理任务无关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05080 2026-04-08 cs.SE cs.AI cs.LO cs.MA 79%

Nidus: Externalized Reasoning for AI-Assisted Engineering

Nidus:面向AI辅助工程的外部化推理

Danil Gorinevski

机构 * cybiont GmbH(cybiont有限公司)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.AI

AI总结 Nidus通过外部化推理机制,实现了AI辅助软件交付中的V模型机械化,通过约束表面确保工程不变量的可靠性,提出递归自治理、协同机制、规范强化和治理剧场预防四项贡献。

Comments 19 pages, 3 figures, 5 tables. Evaluated on self-hosting deployment. Patent pending (CH000371/2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01346 2026-04-08 cs.CR cs.AI cs.LG cs.RO 62%

Safety, Security, and Cognitive Risks in World Models

世界模型中的安全性、安全性和认知风险

Manoj Parmar

机构 * SovereignAI Security Labs(SovereignAI安全实验室)

专题命中 代码与定理证明 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了世界模型在自主决策中的安全、安全及认知风险,提出了轨迹持久性和表征风险的定义,并通过实验验证了对抗攻击的效果,强调了对世界模型的严谨性要求。

Comments version 2, 29 pages, 1 figure (6 panels), 3 tables. Empirical proof-of-concept on GRU/RSSM/DreamerV3 architectures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 逻辑推理 6 篇

2604.05649 2026-04-08 cs.CV cs.AI 88%

Analogical Reasoning as a Doctor: A Foundation Model for Gastrointestinal Endoscopy Diagnosis

作为医生的类比推理:一种胃肠内镜诊断的基础模型

Peixi Peng, Housheng Xie, Yanling Wei, Guangcong Ruan, Xiaoyang Zou, Qian Cao, Yongjian Nian, Guoyan Zheng

专题命中 逻辑推理 :reasoning(title,abstract);logical reasoning(title,abstract);分类 cs.AI

AI总结 本文提出RATNet基础模型,通过类比推理提升胃肠内镜诊断的泛化能力与鲁棒性,在六个场景中超越现有模型,支持联邦学习隐私保护部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07432 2026-04-08 cs.AI 80%

TS-Agent: Understanding and Reasoning Over Raw Time Series via Iterative Insight Gathering

TS-Agent:通过迭代洞察获取理解并推理原始时间序列

Penghang Liu, Elizabeth Fons, Annita Vapsi, Mohsen Ghassemi, Svitlana Vyetrenko, Daniel Borrajo, Vamsi K. Potluru, Manuela Veloso

机构 * JPMorgan AI Research, NY, USA(摩根大通人工智能研究院,纽约,美国)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 TS-Agent通过迭代洞察获取机制,在时间序列理解和推理任务中匹配或超越文本、视觉及时间序列语言模型基线,尤其在零样本设置下表现更优。

Comments NeurIPS 2025 Workshop on Foundations of Reasoning in Language Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15079 2026-04-08 cs.SE 78%

Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models

通过大型语言模型评估代码执行推理的连贯性与一致性

Changshu Liu, Yang Chen, Reyhaneh Jabbarvand

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 本文提出CES任务,评估大语言模型在模拟程序执行和编程任务中的推理能力,引入连贯性概念以判断执行逻辑是否符合常识,提出新的度量标准以衡量推理一致性,发现LLM在编程任务中存在路径敏感分析的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05383 2026-04-08 cs.AI 70%

Towards Effective In-context Cross-domain Knowledge Transfer via Domain-invariant-neurons-based Retrieval

通过领域不变神经元的检索实现有效的跨领域知识转移

Jianzhi Yan, Zhiming Li, Le Liu, Zike Yuan, Shiwei Chen, Youcheng Pan, Buzhou Tang, Yang Xiang, Danny Dongning Sun

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Pengcheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本文提出领域不变神经元检索方法,用于提升大语言模型在跨领域推理中的性能,实验表明方法在数学和逻辑推理迁移中平均提升1.8。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06015 2026-04-08 cs.AI 57%

How LLMs Follow Instructions: Skillful Coordination, Not a Universal Mechanism

大语言模型如何遵循指令:技能协调,而非通用机制

Elisabetta Rocchetti, Alfio Ferrara

机构 * Department of Computer Science, Università degli Studi di Milano(米兰大学计算机科学系)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 研究通过九种不同任务分析发现,大语言模型遵循指令并非依赖通用机制,而是通过协调多种语言能力实现,且存在任务间转移弱、依赖稀疏等特点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05955 2026-04-08 cs.SE cs.AI 57%

Does Pass Rate Tell the Whole Story? Evaluating Design Constraint Compliance in LLM-based Issue Resolution

通过率能讲述全部故事吗?评估基于LLM的问题解决的设计约束合规性

Kai Yu, Zhenhao Zhou, Junhao Zeng, Ying Wang, Xueying Du, Zhiqiang Yuan, Junwei Liu, Ziyu Zhou, Yujia Wang, Chong Wang, Xin Peng

机构 * Fudan University(复旦大学) Nanyang Technological University(南洋理工大学)

专题命中 逻辑推理 :verifier(abstract);分类 cs.AI

AI总结 本文提出设计感知问题解决方法,引入bench基准,通过挖掘和验证真实项目中的设计约束,评估LLM在问题解决中设计约束的合规性,发现测试通过率高并不代表设计合规性好。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 规划推理 20 篇

2603.26684 2026-04-08 cs.MA cs.RO 82%

Decoupling Geometric Planning and Execution in Scalable Multi-Agent Path Finding

解耦几何规划与执行的可扩展多智能体路径寻找

Fernando Salanova, Eduardo Montijano, Cristian Mahulea

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出一种混合优先级框架,将几何规划与执行时的冲突解决解耦,通过几何冲突预emption和去中心化局部控制器实现高效多智能体路径寻找,实验表明方法在大规模实例中具有线性运行时间趋势和100%成功率。

Comments 6 pages, 3 figures, WODES conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05424 2026-04-08 cs.AI cs.CL 81%

PRISM-MCTS: Learning from Reasoning Trajectories with Metacognitive Reflection

PRISM-MCTS: 通过元认知反思学习推理轨迹

Siyuan Cheng, Bozhong Tian, YanChao Hao, Zheng Wei

机构 * Tencent PCG(腾讯PCG)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 PRISM-MCTS通过整合过程奖励模型和动态共享内存,有效捕捉启发式与谬误,提升推理效率,减少轨迹需求,在多个推理基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05159 2026-04-08 cs.SE cs.AI cs.CL 81%

Planning to Explore: Curiosity-Driven Planning for LLM Test Generation

规划以探索:基于好奇心的规划用于LLM测试生成

Alfonso Amayuelas, Firas Laakom, Piotr Piękos, Wenyi Wang, Yifan Xu, Yuhui Wang, Jürgen Schmidhuber, William Wang

机构 * University of California, Santa Barbara(加州大学圣塔芭芭拉分校) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出CovQValue方法,通过将覆盖地图反馈给LLM生成多样化计划,并利用LLM估计的Q值选择最信息量的计划,以平衡即时分支发现与未来可达性,优于贪心策略,在测试生成任务中取得更高覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05075 2026-04-08 cs.AI cs.CL 81%

MMORF: A Multi-agent Framework for Designing Multi-objective Retrosynthesis Planning Systems

MMORF:一种用于设计多目标逆合成规划系统的多智能体框架

Frazier N. Baker, Trieu Nguyen, Reza Averly, Botao Yu, Daniel Adu-Ampratwum, Huan Sun, Xia Ning

机构 * Department of Computer Science and Engineering, The Ohio State University(俄亥俄州立大学计算机科学与工程系) Department of Mathematics and Statistics, University of South Florida(南佛罗里达大学数学与统计系) Division of Medicinal Chemistry and Pharmacognosy, The Ohio State University(俄亥俄州立大学药物化学与生药学系) Department of Biomedical Informatics, The Ohio State University(俄亥俄州立大学生物医学信息学系) Translational Data Analytics Institute, The Ohio State University(俄亥俄州立大学转化数据分析研究所)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出MMORF框架,通过多智能体系统解决多目标逆合成规划问题,展示了MASIL和RFAS在安全、成本和约束任务中的优越性能。

Comments 36 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05449 2026-04-08 cs.CV 78%

Not All Agents Matter: From Global Attention Dilution to Risk-Prioritized Game Planning

并非所有智能体都重要:从全局注意力稀释到风险优先的游戏规划

Kang Ding, Hongsong Wang, Jie Gui, Lei He

机构 * School of Cyberspace Security, Southeast University(东南大学网络空间安全学院) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Vehicle and Mobility School, Tsinghua University(清华大学车辆与运载学院)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出风险优先游戏规划方法,通过GameAD框架提升自动驾驶轨迹安全性,实验表明其在复杂环境中表现更优。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05681 2026-04-08 cs.AI cs.CL cs.GT cs.LG cs.MA 75%

LUDOBENCH: Evaluating LLM Behavioural Decision-Making Through Spot-Based Board Game Scenarios in Ludo

LUDOBENCH:通过基于点的棋盘游戏场景评估LLM的行为决策

Ojas Jain, Dhruv Kumar

机构 * Department of Computer Science and Information Systems, BITS Pilani(比拉理工学院皮拉尼校区计算机科学与信息系统系)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LudoBench通过12种不同决策类别中的480个手工设计点场景,评估LLM在Ludo棋盘游戏中的战略推理能力,发现模型在行为上呈现不同特征,揭示了提示敏感性作为关键漏洞。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07663 2026-04-08 cs.DB cs.AI cs.LG 73%

Cortex AISQL: A Production SQL Engine for Unstructured Data

Cortex AISQL:面向非结构化数据的生产级SQL引擎

Paweł Liskowski, Benjamin Han, Paritosh Aggarwal, Bowei Chen, Boxin Jiang, Nitish Jindal, Zihan Li, Aaron Lin, Kyle Schmaus, Jay Tayade, Weicheng Zhao, Anupam Datta, Nathan Wiegand, Dimitris Tsirogiannis

机构 * Snowflake Inc.(雪花公司)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 Cortex AISQL通过AI-aware优化、自适应模型级联和语义连接重写技术,解决大规模语义操作效率问题,提升非结构化数据查询性能。

Comments Published in SIGMOD Companion '26 (Industry Track), Bengaluru, India, May 31-June 5, 2026. ACM DOI: 10.1145/3788853.3803093. This version is the published ACM Version of Record under the Creative Commons Attribution 4.0 International (CC BY 4.0) license

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22653 2026-04-08 cs.AI 70%

URSA: The Universal Research and Scientific Agent

URSA:通用研究与科学代理

Michael Grosskopf, Nathan Debardeleben, Russell Bent, Rahul Somasundaram, Isaac Michaud, Arthur Lui, Alexius Wadell, Warren D. Graham, Golo A Wimmer, Sachin Shivakumar, Joan Vendrell Gallart, Harsha Nagarajan, Earl Lawrence

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 URSA通过模块化代理和工具加速科研任务,结合先进物理模拟代码,解决复杂科学问题,展现系统潜力。

Comments 24 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05952 2026-04-08 cs.AI cs.CL 62%

Towards Trustworthy Report Generation: A Deep Research Agent with Progressive Confidence Estimation and Calibration

迈向可信报告生成:一种带有逐步置信度估计和校准的深度研究代理

Yi Yuan, Xuhong Wang, Shanzhe Lei

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Southeast University(东南大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种深度研究代理,通过逐步置信度估计和校准提升报告生成的可信度,增强透明度和用户信任。

Comments 20 pages, 3 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04949 2026-04-08 cs.IR cs.AI cs.CL 62%

Learning to Retrieve from Agent Trajectories

从智能体轨迹中学习检索

Yuqi Zhou, Sunhao Dai, Changle Qu, Liang Pang, Jun Xu, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) CAS Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全重点实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出从智能体交互数据直接训练检索模型的新方法,通过分析轨迹中的行为信号,提出LRAT框架提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25454 2026-04-08 cs.AI cs.CL 62%

DeepSearch: Overcome the Bottleneck of Reinforcement Learning with Verifiable Rewards via Monte Carlo Tree Search

DeepSearch: 通过蒙特卡洛树搜索克服强化学习中的瓶颈问题

Fang Wu, Weihao Xuan, Heli Qi, Ximing Lu, Aaron Tu, Li Erran Li, Yejin Choi

机构 * Stanford University(斯坦福大学) University of Tokyo(东京大学) RIKEN AIP(日本理化学研究所革新智能研究中心) UC Berkeley(加州大学伯克利分校) University of Washington(华盛顿大学) Amazon AWS(亚马逊云科技)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 DeepSearch通过将蒙特卡洛树搜索整合到强化学习中,解决探索不足的问题,提升数学推理能力,实验显示其在推理任务中达到62.95%的准确率,且效率显著高于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05987 2026-04-08 cs.AI 57%

Flowr -- Scaling Up Retail Supply Chain Operations Through Agentic AI in Large Scale Supermarket Chains

Flowr -- 通过大规模超市连锁中的代理AI实现零售供应链运营的扩展

Eranga Bandara, Ross Gore, Sachin Shetty, Piumi Siyambalapitiya, Sachini Rajapakse, Isurunima Kularathna, Pramoda Karunarathna, Ravi Mukkamala, Peter Foytik, Safdar H. Bouk, Abdul Rahman, Xueping Liang, Amin Hass, Tharaka Hewa, Ng Wee Keong, Kasun De Zoysa, Aruna Withanage, Nilaan Loganathan

机构 * Old Dominion University(老道明大学) Florida International University(佛罗里达国际大学) Nanyang Technological University(南洋理工大学) University of Colombo(科伦坡大学) Center for Wireless Communications, University of Oulu(奥卢大学无线通信中心) University of Sri Jayewardenepura(斯里贾亚瓦德纳普拉大学) Accenture Technology Labs(埃森哲技术实验室)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Flowr框架,通过代理AI自动化大规模超市连锁的端到端供应链流程,减少人工协调负担,提升供需匹配度和异常处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05458 2026-04-08 cs.CR cs.AI 57%

MA-IDS: Multi-Agent RAG Framework for IoT Network Intrusion Detection with an Experience Library

MA-IDS:基于经验库的多智能体RAG框架用于物联网网络入侵检测

Md Shamimul Islam, Luis G. Jaimes, Ayesha S. Dina

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出MA-IDS框架,结合大语言模型与RAG技术,通过经验库实现自学习的入侵检测,实验表明其在物联网网络中具有高准确率和可解释性。

Comments Preprint. Submitted to IEEE conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05416 2026-04-08 cs.AI 57%

Multi-Agent Pathfinding with Non-Unit Integer Edge Costs via Enhanced Conflict-Based Search and Graph Discretization

具有非单位整数边成本的多智能体路径规划:通过增强的基于冲突搜索和图离散化

Hongkai Fan, Qinjing Xie, Bo Ouyang, Yaonan Wang, Zhi Yan, Jiawen He, Zheng Fang

机构 * China Mobile Group Hunan Company Limited(中国移动通信集团湖南有限公司)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出MAPFZ,一种处理非单位整数边成本的多智能体路径规划变种,通过增强的基于冲突搜索框架和图离散化方法,提升了求解效率和现实准确性。

Comments 16 pages, 7 figures, submitted to cs.AI, Multi-Agent Systems, Pathfinding Optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04936 2026-04-08 cs.IR cs.AI 57%

Web Retrieval-Aware Chunking (W-RAC) for Efficient and Cost-Effective Retrieval-Augmented Generation Systems

面向高效且经济的检索增强生成系统的网页检索感知分块(W-RAC)

Uday Allu, Sonu Kedia, Tanmay Odapally, Biddwan Ahmed

机构 * AI Research Team, Yellow.ai(Yellow.ai AI研究团队)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出W-RAC,一种针对网页文档的高效分块框架,通过分离文本提取与语义分块规划,减少LLM token消耗,提升系统可观察性。

Comments 13 pages, 9 tables, 0 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00472 2026-04-08 cs.AI cs.DC cs.MA cs.NI 57%

UserCentrix: An Agentic Memory-augmented AI Framework for Smart Spaces

UserCentrix: 一种面向智能空间的代理增强型AI框架

Alaa Saleh, Sasu Tarkoma, Praveen Kumar Donta, Anders Lindgren, Naser Hossein Motlagh, Schahram Dustdar, Susanna Pirttikangas, Lauri Lovén

机构 * RISE Research Institutes of Sweden(瑞典RISE研究所) ICREA Barcelona(巴塞罗那ICREA)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出UserCentrix框架,通过紧急意识和意图驱动决策机制优化资源管理,提升用户体验,在边缘计算条件下实现高效意图处理与实时监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23202 2026-04-08 cs.CV 50%

Gaze-Regularized Vision-Language-Action Models for Robotic Manipulation

用于机器人操作的视觉-语言-动作模型中的目光正则化

Anupam Pani, Yanchao Yang

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种目光正则化框架,通过将目光热图转换为补丁分布,并利用KL散度正则化Transformer注意力,提升机器人操作任务的性能和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05376 2026-04-08 eess.SY cs.SY 50%

To Defer or To Shift? The Role of AI Data Center Flexibility on Grid Interconnection

延迟还是转移?AI数据中心灵活性对电网互联的作用

Yize Chen, Xiaogui Zheng

专题命中 规划推理 :planning(abstract)

AI总结 本文研究AI数据中心灵活性对电网互联的影响,通过建模评估其对发电、成本和拥堵的影响,发现灵活性不总是降低所需发电容量,且延迟AI计算会减少电网压力但边际效益递减。

Comments 8 pages, 5 figures, in submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05079 2026-04-08 cs.CV 50%

SVAgent: Storyline-Guided Long Video Understanding via Cross-Modal Multi-Agent Collaboration

SVAgent:通过跨模态多智能体协作实现故事线引导的长视频理解

Zhongyu Yang, Zuhao Yang, Shuo Zhan, Tan Yue, Wei Pang, Yingfang Yuan

机构 * BCML, Heriot-Watt University(赫瑞瓦特大学BCML) Nanyang Technological University(南洋理工大学) Peking University(北京大学)

专题命中 规划推理 :reasoning(abstract)

AI总结 SVAgent通过跨模态多智能体协作,利用故事线引导实现视频问答的高效理解,提升推理鲁棒性和答案一致性。

Comments Published in CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00181 2026-04-08 cs.CV cs.CR 50%

From Evidence to Verdict: An Agent-Based Forensic Framework for AI-Generated Image Detection

从证据到判决:一种基于智能体的AI生成图像检测框架

Mengfei Liang, Yiting Qu, Yukun Jiang, Michael Backes, Yang Zhang

机构 * CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心)

专题命中 规划推理 :reasoning(abstract)

AI总结 本文提出AIFo框架,通过多智能体协作进行多阶段取证分析,整合逆向图像搜索、元数据提取等工具,实现高准确率的AI生成图像检测。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏