arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18837 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18837 篇

2504.09440 2025-06-23 cs.AI 88%

Enhancing Mathematical Reasoning in Large Language Models with Self-Consistency-Based Hallucination Detection

MingShan Liu, Jialing Fang

机构 * The Hong Kong University of Science and Technology(香港理工大学) Fudan University(复旦大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11635 2025-06-16 cs.CR cs.AI 88%

FAA Framework: A Large Language Model-Based Approach for Credit Card Fraud Investigations

Shaun Shuster, Eyal Zaloof, Asaf Shabtai, Rami Puzis

机构 * Ben-Gurion University of the Negev(贝纳尔吉翁内盖夫大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07196 2025-06-16 cs.CV cs.CL 88%

SAP-Bench: Benchmarking Multimodal Large Language Models in Surgical Action Planning

Mengya Xu, Zhongzhen Huang, Dillan Imans, Yiru Ye, Xiaofan Zhang, Qi Dou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments The authors could not reach a consensus on the final version of this paper, necessitating its withdrawal

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10853 2025-06-13 cs.AI cs.CY 88%

A Study on Individual Spatiotemporal Activity Generation Method Using MCP-Enhanced Chain-of-Thought Large Language Models

Yu Zhang, Yang Hu, De Wang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10415 2025-06-13 cs.CL cs.CV 88%

Burn After Reading: Do Multimodal Large Language Models Truly Capture Order of Events in Image Sequences?

Yingjin Song, Yupei Du, Denis Paperno, Albert Gatt

机构 * Utrecht University(乌特雷赫大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 27 pages, 14 figures. Accepted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11314 2025-06-12 cs.CL 88%

Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering

Xinyu Tang, Xiaolei Wang, Zhihao Lv, Yingqian Min, Wayne Xin Zhao, Binbin Hu, Ziqi Liu, Zhiqiang Zhang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Ant Group(蚂蚁集团)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02830 2025-06-03 cs.CL 88%

RARE: Retrieval-Augmented Reasoning Enhancement for Large Language Models

Hieu Tran, Zonghai Yao, Junda Wang, Yifan Zhang, Zhichao Yang, Hong Yu

机构 * University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校) University of Massachusetts, Lowell(马萨诸塞大学洛厄尔分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Proceedings of ACL 2025 (main track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00334 2025-06-03 cs.CL 88%

Beyond Context to Cognitive Appraisal: Emotion Reasoning as a Theory of Mind Benchmark for Large Language Models

Gerard Christopher Yeo, Kokil Jaidka

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11404 2025-06-02 cs.CL 88%

ToolCoder: A Systematic Code-Empowered Tool Learning Framework for Large Language Models

Hanxing Ding, Shuchang Tao, Liang Pang, Zihao Wei, Jinyang Gao, Bolin Ding, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Alibaba Group(阿里巴巴集团)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08105 2025-05-28 cs.CV cs.AI 88%

Multimodal Causal Reasoning Benchmark: Challenging Vision Large Language Models to Discern Causal Links Across Modalities

Zhiyuan Li, Heng Wang, Dongnan Liu, Chaoyi Zhang, Ao Ma, Jieting Long, Weidong Cai

机构 * School of Computer Science, The University of Sydney(计算机科学学院,悉尼大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments ACL2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19505 2025-05-27 cs.IR cs.AI 88%

Hierarchical Tree Search-based User Lifelong Behavior Modeling on Large Language Model

Yu Xia, Rui Zhong, Hao Gu, Wei Yang, Chi Lu, Peng Jiang, Kun Gai

机构 * University of Chinese Academy of Sciences(中国科学院大学) Kuaishou Technology(快手科技) Unaffiliated(无隶属)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18978 2025-05-27 cs.CL 88%

AI4Math: A Native Spanish Benchmark for University-Level Mathematical Reasoning in Large Language Models

Miguel Angel Peñaloza Perez, Bruno Lopez Orozco, Jesus Tadeo Cruz Soto, Michelle Bruno Hernandez, Miguel Angel Alvarado Gonzalez, Sandra Malagon

机构 * Centro de Investigación Científica y de Educación Superior de Ensenada(恩森亚达科学与高等教育研究中心) Facultad de Ciencias, UNAM(科学学院,国立自治大学) Facultad de Matemáticas, Universidad Veracruzana(数学学院,韦拉克鲁斯大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 36 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16114 2025-05-23 cs.AI 88%

Logic-of-Thought: Empowering Large Language Models with Logic Programs for Solving Puzzles in Natural Language

Naiqi Li, Peiyuan Liu, Zheng Liu, Tao Dai, Yong Jiang, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院) Shenzhen University(深圳大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12132 2025-05-20 cs.AI 88%

Automating construction contract review using knowledge graph-enhanced large language models

Chunmo Zheng, Saika Wong, Xing Su, Yinqiu Tang, Ahsan Nawaz, Mohamad Kassem

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11643 2025-05-20 cs.CL 88%

Can an Easy-to-Hard Curriculum Make Reasoning Emerge in Small Language Models? Evidence from a Four-Stage Curriculum on GPT-2

Xiang Fu

机构 * Faculty of Computing and Data Sciences, Boston University(计算与数据科学学院,波士顿大学)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20771 2025-05-20 cs.CL 88%

Computational Reasoning of Large Language Models

Haitao Wu, Zongbo Han, Joey Tianyi Zhou, Huaxi Huang, Changqing Zhang

机构 * Tianjin University(天津大学) Shanghai AI Laboratory(上海人工智能实验室) A ∗ STAR Centre for Frontier AI Research(A STAR前沿人工智能研究中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10772 2025-05-19 cs.CL 88%

Ranked Voting based Self-Consistency of Large Language Models

Weiqin Wang, Yile Wang, Hui Huang

机构 * College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10594 2025-05-19 cs.SE cs.AI 88%

CRPE: Expanding The Reasoning Capability of Large Language Model for Code Generation

Ningxin Gui, Qianghuai Jia, Feijun Jiang, Yuling Jiao, dechun wang, Jerry Zhijian Yang

机构 * School of Mathematics and Statistics(数学与统计学学院) Alibaba International Digital Commerce(阿里巴巴国际数字商务)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08532 2025-05-14 cs.SI cs.AI 88%

The Truth Becomes Clearer Through Debate! Multi-Agent Systems with Large Language Models Unmask Fake News

Yuhan Liu, Yuxuan Liu, Xiaoqing Zhang, Xiuying Chen, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(仁爱大学人工智能学院) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04728 2025-05-09 cs.AI 88%

Generating Symbolic World Models via Test-time Scaling of Large Language Models

Zhouliang Yu, Yuhuan Yuan, Tim Z. Xiao, Fuxiang Frank Xia, Jie Fu, Ge Zhang, Ge Lin, Weiyang Liu

机构 * Westlake University(西湖大学) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Max Planck Institute for Intelligent Systems, Tübingen(智能系统马克斯·普朗克研究所(图宾根)) Environmental Systems Research Institute, Inc.(环境系统研究所) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) SEED, Bytedance(字节跳动SEED团队) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted by TMLR2025 (32 pages, 6 figures)

Journal ref Transactions on Machine Learning Research, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01009 2025-05-05 cs.AI 88%

Improving Large Language Model Planning with Action Sequence Similarity

Xinran Zhao, Hanie Sedghi, Bernd Bohnet, Dale Schuurmans, Azade Nova

机构 * Google DeepMind(谷歌DeepMind) Carnegie Mellon University(卡内基梅隆大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 25 pages, 11 figures

Journal ref The Thirteenth International Conference on Learning Representations (ICLR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19255 2025-04-29 cs.AI cs.CY 88%

The Convergent Ethics of AI? Analyzing Moral Foundation Priorities in Large Language Models with a Multi-Framework Approach

Chad Coleman, W. Russell Neuman, Ali Dasdan, Safinah Ali, Manan Shah

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 25 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04476 2025-04-28 cs.CY cs.AI 88%

The Moral Mind(s) of Large Language Models

Avner Seror

机构 * Aix Marseille Univ, CNRS, AMSE, Marseille, France(阿维尼翁-马赛大学,国家科学研究中心,AMSE,马赛,法国)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07263 2025-04-25 cs.RO cs.AI 88%

CoPAL: Corrective Planning of Robot Actions with Large Language Models

Frank Joublin, Antonello Ceravola, Pavel Smirnov, Felix Ocker, Joerg Deigmoeller, Anna Belardinelli, Chao Wang, Stephan Hasler, Daniel Tanneberg, Michael Gienger

机构 * Honda Research Institute Europe(本田欧洲研究院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments IEEE International Conference on Robotics and Automation (ICRA) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16855 2025-04-24 cs.CL 88%

Monte Carlo Planning with Large Language Model for Text-Based Game Agents

Zijing Shi, Meng Fang, Ling Chen

机构 * AAII, University of Technology Sydney(AAII,悉尼技术大学) University of Liverpool(利物浦大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15716 2025-04-23 cs.AI 88%

DianJin-R1: Evaluating and Enhancing Financial Reasoning in Large Language Models

Jie Zhu, Qian Chen, Huaixia Dou, Junhui Li, Lifan Guo, Feng Chen, Chi Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13500 2025-04-21 cs.CL 88%

Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning

Jianing Wang, Jin Jiang, Yang Liu, Mengdi Zhang, Xunliang Cai

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13187 2025-04-21 cs.CL 88%

Benchmarking Large Language Models for Calculus Problem-Solving: A Comparative Analysis

In Hak Moon

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07521 2025-04-18 cs.AI cs.MM 88%

Why We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models

Yuxiang Lin, Jingdong Sun, Zhi-Qi Cheng, Jue Wang, Haomin Liang, Zebang Cheng, Yifei Dong, Jun-Yan He, Xiaojiang Peng, Xian-Sheng Hua

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted at CVPR Workshop NEXD 2025. 21 pages, Project: https://github.com/Lum1104/EIBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12229 2025-04-18 cs.IR cs.AI 88%

Comprehending Knowledge Graphs with Large Language Models for Recommender Systems

Ziqiang Cui, Yunpeng Weng, Xing Tang, Fuyuan Lyu, Dugang Liu, Xiuqiang He, Chen Ma

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted as a full paper by SIGIR'25

详情

展开后加载摘要…

URL PDF HTML 收藏