arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45051 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3033 篇

2602.12889 2026-02-16 cs.CL 79%

BaziQA-Benchmark: Evaluating Symbolic and Temporally Compositional Reasoning in Large Language Models

BaziQA-Benchmark:评估大语言模型中的符号性和时间组合推理

Jiangxi Chen, Qian Liu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 BaziQA-Benchmark通过结构化推理协议评估大语言模型在符号性和时间组合推理中的表现,揭示其在时间难度和推理顺序上的敏感性及系统性缺陷。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11609 2026-02-13 cs.AI q-bio.GN 79%

scPilot: Large Language Model Reasoning Toward Automated Single-Cell Analysis and Discovery

scPilot:面向自动化单细胞分析与发现的大型语言模型推理

Yiming Gao, Zhen Wang, Jefferson Chen, Mark Antkowiak, Mengzhou Hu, JungHo Kong, Dexter Pratt, Jieyuan Liu, Enze Ma, Zhiting Hu, Eric P. Xing

机构 * UC San Diego(UC圣地亚哥大学) MBZUAI CMU(卡内基梅隆大学) Texas A&M(德克萨斯A&M大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 scPilot通过组学原生推理提升单细胞分析的准确性与可解释性,实现自动化细胞类型注释和轨迹重建。

Comments Accepted at NeurIPS 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11516 2026-02-13 cs.AI 79%

Human-Inspired Continuous Learning of Internal Reasoning Processes: Learning How to Think for Adaptive AI Systems

启发式连续学习内部推理过程:学习如何思考以实现自适应AI系统

Hong Su

机构 * School of Computer Science, Chengdu University of information Technology(信息科技大学计算机学院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种受人类启发的连续学习框架,通过统一推理、行动、反思和验证,实现AI系统在动态环境中的持续适应与自我进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09443 2026-02-11 cs.AI 79%

P1-VL: Bridging Visual Perception and Scientific Reasoning in Physics Olympiads

P1-VL: 联结视觉感知与物理竞赛中的科学推理

Yun Luo, Futing Wang, Qianjia Cheng, Fangchen Yu, Haodi Lei, Jianhao Yan, Chenxi Li, Jiacheng Chen, Yufeng Zhao, Haiyuan Wan, Yuchen Zhang, Shenghe Zheng, Junchi Yao, Qingyang Zhang, Haonan He, Wenxuan Zeng, Li Sheng, Chengxing Xie, Yuxin Zuo, Yizhuo Li, Yulun Wu, Rui Huang, Dongzhan Zhou, Kai Chen, Yu Qiao, Lei Bai, Yu Cheng, Ning Ding, Bowen Zhou, Peng Ye, Ganqu Cui

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 P1-VL通过融合课程强化学习和代理增强技术,成为首个在物理竞赛中获得12枚金牌的开源视觉-语言模型,展示了卓越的科学推理能力和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08658 2026-02-11 cs.CL 79%

Fundamental Reasoning Paradigms Induce Out-of-Domain Generalization in Language Models

基本推理范式诱导语言模型的领域外泛化

Mingzi Cao, Xingwei Tan, Mahmud Elahi Akhter, Marco Valentino, Maria Liakata, Xi Wang, Nikolaos Aletras

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本研究通过诱导基本推理范式提升语言模型的领域外泛化能力,实验表明方法在现实任务中性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05342 2026-02-10 cs.RO cs.AI 79%

Information-Theoretic Graph Fusion with Vision-Language-Action Model for Policy Reasoning and Dual Robotic Control

信息论图融合:基于视觉-语言-动作模型的政策推理与双臂机器人控制

Shunlei Li, Longsen Gao, Jin Wang, Chang Che, Xi Xiao, Jiuwen Cao, Yingbai Hu, Hamid Reza Karimi

机构 * Electrical and Computer Engineering Department, University of New Mexico, Albuquerque, United States, 87106(电气与计算机工程系,新墨西哥大学,阿尔伯克基,美国,87106) Dynamic Robot Systems Group, Oxford Robotics Institute, University of Oxford, United Kingdom, OX26NN(动态机器人系统组,牛津机器人研究所,牛津大学,英国,OX26NN) Mechanical and Aerospace Engineering Department, The George Washington University, DC, United States, 22202(机械与航空航天工程系,乔治华盛顿大学,华盛顿特区,美国,22202) Department of Computer Science, University of Alabama at Birmingham, Alabama, United States, 35294(计算机科学系,阿拉巴马大学伯明翰分校,阿拉巴马,美国,35294) The School of Computation, Information and Technology, Technical University of Munich, Germany, 85748(计算、信息与技术学院,慕尼黑技术大学,德国,85748) Department of Mechanical Engineering, Politecnico di Milano, Milan, Italy, 20156(机械工程系,米兰理工学院,米兰,意大利,20156)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 GF-VLA通过信息论图融合视觉-语言-动作模型,实现双臂机器人任务推理与执行,提升空间泛化与任务成功率。

Comments Journal accepted by Information Fusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05758 2026-02-06 cs.CL 79%

LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards

LongR: 通过密集效用奖励的强化学习解锁长上下文推理

Bowen Ping, Zijun Chen, Yiyao Yu, Tingfeng Hui, Junchi Yan, Baobao Chang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 LongR通过整合动态'思考与阅读'机制和上下文密度奖励,提升长上下文推理性能,在多个基准测试中取得显著成效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25497 2026-02-02 cs.LG 79%

Right for the Right Reasons: Avoiding Reasoning Shortcuts via Prototypical Neurosymbolic AI

为正确的理由而正确:通过原型神经符号AI避免推理捷径

Luca Andolfi, Eleonora Giunchiglia

机构 * Imperial College London(帝国理工学院伦敦分校) Sapienza University of Rome(罗马萨皮恩扎大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.LG

AI总结 本文提出原型神经符号架构,通过学习正确基本概念避免推理捷径,提升神经符号学习的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21335 2026-01-30 cs.AI 79%

Modeling Endogenous Logic: Causal Neuro-Symbolic Reasoning Model for Explainable Multi-Behavior Recommendation

内生逻辑建模:可解释的多行为推荐因果神经符号推理模型

Yuzhe Chen, Jie Cao, Youquan Wang, Haicheng Tao, Darko B. Vukovic, Jia Wu

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Nanjing University of Science and Technology(南京理工大学) School of Management(管理学院) Hefei University of Technology(合肥工业大学) School of Computer Science and Artificial Intelligence(计算机科学与人工智能学院) Nanjing University of Finance and Economics(南京财经大学) Department of Finance and Accounting(金融与会计系) Saint Petersburg State University(圣彼得堡国立大学) School of Computing(计算机学院) Macquarie University(麦考瑞大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种因果神经符号推理模型,用于可解释的多行为推荐,通过内生逻辑建模和因果推断提升推荐系统的可解释性和泛化能力。

Comments Accepted to The Web Conference (WWW) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21231 2026-01-27 cs.LG cond-mat.mtrl-sci 79%

MiST: Understanding the Role of Mid-Stage Scientific Training in Developing Chemical Reasoning Models

MiST:理解中期科学训练在开发化学推理模型中的作用

Andres M Bran, Tong Xie, Shai Pranesh, Jeffrey Meng, Xuan Vu Nguyen, Jeremy Goumaz, David Ming Segura, Ruizhi Xu, Dongzhan Zhou, Wenjie Zhang, Bram Hoex, Philippe Schwaller

机构 * Laboratory of Artificial Chemical Intelligence (LIAC), Institute of Chemical Sciences and Engineering (ISIC)(人工化学智能实验室(LIAC)、化学科学与工程研究所) National Centre of Competence in Research (NCCR) Catalysis(催化研究国家级竞争力中心) School of Photovoltaic and Renewable Energy engineering(光伏与可再生能源工程学院) School of Computer Science and Engineering(计算机科学与工程学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Green Dynamics

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.LG

AI总结 MiST通过中期科学训练提升化学推理模型的潜在可解性,显著提高有机反应命名和无机材料生成任务的准确率,同时产生可解释的推理轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13470 2026-01-27 cs.CL 79%

Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive Reasoning

诱导、对齐、预测:通过认知归纳推理实现零样本立场检测

Bowen Zhang, Jun Ma, Fuqiang Niu, Li Dong, Jinzhou Cao, Genan Dai

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出CIRF框架,通过认知归纳推理实现零样本立场检测,实现高效且可解释的推理,在低资源环境下取得新突破。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17426 2026-01-27 cs.AI cs.LO 79%

A Syllogistic Probe: Tracing the Evolution of Logic Reasoning in Large Language Models

直言探针:追踪大型语言模型中逻辑推理的演变

Zhengqing Zang, Yuqi Ding, Yanmei Gu, Changkai Song, Zhengkai Yang, Guoping Du, Junbo Zhao, Haobo Wang

机构 * Zhejiang University(浙江大学) University of Chinese Academy of Social Sciences(中国社会科学院大学) Ant Group(蚂蚁集团) Chinese Academy of Social Sciences(中国社会科学院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本研究通过三段论测试揭示大型语言模型在逻辑推理演变中的特性,发现模型规模、思考机制和基础模型对逻辑发展有重要影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14932 2026-01-27 cs.AI 79%

FOL-Traces: Verified First-Order Logic Reasoning Traces at Scale

FOL-Traces: 在大规模上验证的首阶逻辑推理轨迹

Isabelle Lee, Sarah Liaw, Dani Yogatama

机构 * USC(美国大学) Harvard University(哈佛大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 FOL-Traces是一个大规模验证的首阶逻辑推理轨迹数据集,用于严格评估结构逻辑推理,通过挑战性任务揭示模型在语法意识和推理过程忠实度上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04744 2026-01-26 cs.SD cs.CL eess.AS 79%

WildScore: Benchmarking MLLMs in-the-Wild Symbolic Music Reasoning

WildScore: 多模态符号音乐推理在现实中的基准测试

Gagan Mundada, Yash Vishe, Amit Namburi, Xin Xu, Zachary Novack, Julian McAuley, Junda Wu

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 WildScore是首个用于评估多模态大语言模型在现实世界中符号音乐推理能力的基准测试,通过真实音乐作品和用户生成问题,系统性评估模型在音乐学分析中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14696 2026-01-22 cs.CL 79%

AdaTIR: Adaptive Tool-Integrated Reasoning via Difficulty-Aware Policy Optimization

AdaTIR: 通过难度感知策略优化实现自适应工具集成推理

Zhaiyu Fang, Ruipeng Sun

机构 * Trip.com Group(Trip.com集团)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 AdaTIR通过难度感知策略优化实现自适应工具集成推理,有效减少工具调用并提升推理准确性。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12822 2026-01-21 cs.AI 79%

MirrorGuard: Toward Secure Computer-Use Agents via Simulation-to-Real Reasoning Correction

MirrorGuard:通过模拟到现实推理校正实现安全的计算机使用代理

Wenqi Zhang, Yulin Shen, Changyue Jiang, Jiarun Dai, Geng Hong, Xudong Pan

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MirrorGuard通过模拟到现实推理校正提升计算机使用代理的安全性,有效降低系统风险并保持代理实用性

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07300 2026-01-09 cs.CL 79%

Think Natively: Unlocking Multilingual Reasoning with Consistency-Enhanced Reinforcement Learning

原生思考:通过一致性增强强化学习解锁多语言推理

Xue Zhang, Yunlong Liang, Fandong Meng, Songming Zhang, Kaiyu Huang, Yufeng Chen, Jinan Xu, Jie Zhou

机构 * Key Laboratory of Big Data & Artificial Intelligence in Transportation, Beijing Jiaotong University(大数据与人工智能在交通中的关键实验室,北京交通大学) School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学) Pattern Recognition Center, WeChat AI, Tencent Inc(模式识别中心,微信AI,腾讯公司)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 M-Thinker通过一致性增强强化学习提升多语言推理能力,实现高语言一致性和多语言基准优异表现。

Comments 17 pages, 14 tables, 4 figures. Code is available at: https://github.com/XZhang00/M-Thinker

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11830 2026-01-08 cs.CV cs.AI 79%

VISTA: Mitigating Semantic Inertia in Video-LLMs via Training-Free Dynamic Chain-of-Thought Routing

VISTA: 通过无训练动态推理路由缓解视频大语言模型中的语义惯性

Hongbo Jin, Jiayu Ding, Siyi Xie, Guibo Luo, Ge Li

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学)

专题命中 逻辑推理 :chain-of-thought(title);reasoning(abstract);分类 cs.AI

AI总结 VISTA通过动态推理路由和潜在推理共识机制,缓解视频大语言模型中的语义惯性问题,提升视频理解性能。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01544 2026-01-06 cs.AI 79%

Causal Consistency Regularization: Training Verifiably Sensitive Reasoning in Large Language Models

因果一致性正则化:在大型语言模型中训练可验证的敏感推理

Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建筑与环境工程系,爱荷华州立大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 CSR通过强制因果一致性提升大语言模型的推理忠实性,实现更可靠的结构化领域推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01875 2026-01-06 cs.AI q-bio.QM 79%

Toward Auditable Neuro-Symbolic Reasoning in Pathology: SQL as an Explicit Trace of Evidence

迈向病理学中的可审计神经符号推理:SQL作为证据的显式轨迹

Kewen Cao, Jianxu Chen, Yongbing Zhang, Ye Zhang, Hongxiao Wang

机构 * Capital Normal University, Beijing, China(首都师范大学) Leibniz-Institut für Analytische Wissenschaften-ISAS, Dortmund, Germany(莱比锡分析科学研究所-ISAS) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳校区)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种基于SQL的神经符号推理框架,通过可执行的SQL轨迹实现病理分析的可审计性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21583 2025-12-29 cs.AI 79%

A Medical Multimodal Diagnostic Framework Integrating Vision-Language Models and Logic Tree Reasoning

一种整合视觉-语言模型和逻辑树推理的医学多模态诊断框架

Zelin Zang, Wenyi Gu, Siqi Ma, Dan Yang, Yue Shen, Zhu Zhang, Guohui Fan, Wing-Kuen Ling, Fuji Yang

机构 * Tsientang Institute of Advanced Study (TIAS)(钱塘先进研究所) Westlake University(西湖大学) Ant Group(蚂蚁集团) China-Japan Friendship Hospital(中日友好医院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种整合视觉-语言模型与逻辑树推理的医学诊断框架,旨在提升多模态医学AI的可信度和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20812 2025-12-25 cs.CL 79%

Semantic Deception: When Reasoning Models Can't Compute an Addition

语义欺骗:当推理模型无法计算加法时

Nathaniël de Leeuw, Marceau Nahon, Mathis Reymond, Raja Chatila, Mehdi Khamassi

机构 * Institute of Intelligent Systems and Robotics(智能系统与机器人研究所) CNRS(法国国家科学研究中心) Sorbonne University(索邦大学) Paris Cité University(巴黎城市大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 研究发现LLMs在面对语义欺骗时表现不佳,揭示其在符号操作上的局限性及对表面语义的依赖。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20664 2025-12-25 cs.AI cs.LO 79%

Eidoku: A Neuro-Symbolic Verification Gate for LLM Reasoning via Structural Constraint Satisfaction

Eidoku:一种通过结构约束满足的神经符号验证门用于LLM推理

Shinobu Miya

机构 * Independent Researcher(独立研究者)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 Eidoku通过结构约束满足方法有效检测LLM推理中的结构不一致幻觉,提供神经符号验证机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15816 2025-12-19 cs.PL cs.AI cs.LO 79%

A Neurosymbolic Approach to Loop Invariant Generation via Weakest Precondition Reasoning

通过最弱前条件推理的神经符号方法生成循环不变式

Daragh King, Vasileios Koutavas, Laura Kovacs

机构 * Trinity College Dublin(都柏林三一学院) Lero, Research Ireland Centre for Software(爱尔兰软件研究中心) Faculty of Informatics, TU Wien(信息学院,维也纳技术大学)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 NeuroInv通过结合神经推理和符号验证方法,高效生成循环不变式,成功率达到99.5%,在复杂验证场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05365 2025-12-08 cs.AI q-bio.QM 79%

MCP-AI: Protocol-Driven Intelligence Framework for Autonomous Reasoning in Healthcare

MCP-AI:面向医疗领域自主推理的协议驱动智能框架

Zag ElSayed, Craig Erickson, Ernest Pedapati

机构 * School of Information Technology University of Cincinnati Ohio, USA(信息科技学院 俄亥俄州立大学 奥哈伊俄州) Adolescent Psychiatry Cincinnati Children’s Hospital Medical Center Ohio, USA(青少年精神病学 奥克兰儿童医院医疗中心 奥哈伊俄州)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MCP-AI是一种基于模型上下文协议的医疗自主推理框架,通过整合临床逻辑和安全协作,提升医疗决策的可解释性和适应性。

Comments 6 pages, 4 figures

Journal ref IEEE ICMLA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17909 2025-11-25 cs.AI 79%

ChemVTS-Bench: Evaluating Visual-Textual-Symbolic Reasoning of Multimodal Large Language Models in Chemistry

ChemVTS-Bench: 评估多模态大语言模型在化学中的视觉-文本-符号推理能力

Zhiyuan Huang, Baichuan Yang, Zikun He, Yanhong Wu, Fang Hongyu, Zhenhe Liu, Lin Dongsheng, Bing Su

机构 * Renmin University of China(中国人民大学) Beijing University of Posts and Telecommunications(北京邮电大学) South China University of Technology(华南理工大学) Gaotu Techedu Inc(高图科技公司)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 ChemVTS-Bench通过多模态输入评估大语言模型在化学中的视觉-文本-符号推理能力,揭示了结构化学的挑战及多模态融合的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17728 2025-11-25 math.RA cs.AI 79%

Ternary Gamma Semirings as a Novel Algebraic Framework for Learnable Symbolic Reasoning

三元Gamma半环作为可学习符号推理的新代数框架

Chandrasekhar Gokavarapu, D. Madhusudhana Rao

机构 * Government College (A), Rajahmundry, A.P., India(印度安得拉邦拉贾姆ун迪政府学院) Department of Mathematics, Acharya Nagarjuna University, Guntur, A.P., India(安得拉邦古尔塔阿查里亚纳加普大学数学系) Government College For Women(A), Guntur, Andhra Pradesh, India(印度安得拉邦古尔塔政府女子学院) Dept. of Mathematics,Acharya Nagarjuna University, Guntur, A.P., India(安得拉邦古尔塔阿查里亚纳加普大学数学系)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出神经三元半环,通过三元运算符替代传统二元乘法,为可学习符号推理提供数学严谨且有效的代数框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17672 2025-11-25 cs.AI 79%

Cognitive Inception: Agentic Reasoning against Visual Deceptions by Injecting Skepticism

认知 inception:通过注入怀疑进行视觉欺骗的代理推理

Yinjie Zhao, Heng Zhao, Bihan Wen, Joey Tianyi Zhou

机构 * CFAR, Agency for Science, Technology and Research (A*STAR), Singapore(科技研究局(A*STAR)认知智能研究所,新加坡) IHPC, Agency for Science, Technology and Research (A*STAR), Singapore(科技研究局(A*STAR)信息处理中心,新加坡) ROSE Lab, School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电子与电气工程学院ROSE实验室)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出Inception框架,通过注入怀疑提升LLM对视觉欺骗的抵御能力,实现可推广的真伪验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12163 2025-11-14 cs.AI cs.LO 79%

Discussion Graph Semantics of First-Order Logic with Equality for Reasoning about Discussion and Argumentation

Ryuta Arisaka

机构 * Department of Informatics, Kyoto University, Japan(信息学系,京都大学,日本)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

Comments Typos have been corrected. 1. Definition 14: there were two formulas given to 1 \leq k case. One was longer than the other. The longer one has been deleted. 2. Definition 20: corrected a wrong (..) scope in the last conjunct. 3. Theorem 6: the formula after "iff*" contained t_1, ..., t_k, ...., .... They have been corrected. c_1, ..., c_t, ..., 4. Corollary 2: a minor typo corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12667 2025-11-03 cs.AI cs.LO 79%

Building Trustworthy AI by Addressing its 16+2 Desiderata with Goal-Directed Commonsense Reasoning

Alexis R. Tudor, Yankai Zeng, Huaduo Wang, Joaquin Arias, Gopal Gupta

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏