arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3222 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3222 篇

2407.21009 2025-02-04 cs.AI cs.LG 62%

AI-Assisted Generation of Difficult Math Questions

Vedant Shah, Dingli Yu, Kaifeng Lyu, Simon Park, Jiatong Yu, Yinghui He, Nan Rosemary Ke, Michael Mozer, Yoshua Bengio, Sanjeev Arora, Anirudh Goyal

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05078 2025-01-10 cs.LG cs.AI 62%

Analyzing Memorization in Large Language Models through the Lens of Model Attribution

Tarun Ram Menta, Susmit Agrawal, Chirag Agarwal

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00059 2025-01-03 cs.CL cs.AI 62%

Large Language Models for Mathematical Analysis

Ziye Chen, Hao Qi

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20891 2024-12-31 cs.CL cs.LG 62%

DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models

Xiaolin Hu, Xiang Cheng, Peiyu Liu, Wei Liu, Jian Luan, Bin Wang, Yong Liu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13690 2024-12-24 cs.CL cs.AI 62%

DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving

Yuxuan Tong, Xiwen Zhang, Rui Wang, Ruidong Wu, Junxian He

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2024. Data and model checkpoints are available at https://github.com/hkust-nlp/dart-math

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06289 2024-12-20 cs.LG cs.AI 62%

S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity

Xinyu Yang, Jixuan Leng, Geyang Guo, Jiawei Zhao, Ryumei Nakada, Linjun Zhang, Huaxiu Yao, Beidi Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06438 2024-12-17 cs.CV cs.CL cs.LG 62%

SOLO: A Single Transformer for Scalable Vision-Language Modeling

Yangyi Chen, Xingyao Wang, Hao Peng, Heng Ji

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09544 2024-12-13 cs.LG cs.AI math.OC math.ST stat.ML stat.TH 62%

Sail into the Headwind: Alignment via Robust Rewards and Dynamic Labels against Reward Hacking

Paria Rashidinejad, Yuandong Tian

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 46 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06827 2024-12-11 cs.LG cs.AI 62%

Enhancing LLMs for Physics Problem-Solving using Reinforcement Learning with Human-AI Feedback

Avinash Anand, Kritarth Prasad, Chhavi Kirtani, Ashwin R Nair, Mohit Gupta, Saloni Garg, Anurag Gautam, Snehal Buldeo, Rajiv Ratn Shah

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06176 2024-12-10 cs.LG cs.AI 62%

AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement

Pranjal Aggarwal, Bryan Parno, Sean Welleck

专题命中 数学推理 :verifier(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01109 2024-12-06 cs.AI cs.CE cs.CL 62%

Mixing It Up: The Cocktail Effect of Multi-Task Fine-Tuning on LLM Performance -- A Case Study in Finance

Meni Brief, Oded Ovadia, Gil Shenderovitz, Noga Ben Yoash, Rachel Lemberg, Eitam Sheetrit

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13729 2024-12-03 cs.CL cs.AI 62%

MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model

Zhen Yang, Jinhao Chen, Zhengxiao Du, Wenmeng Yu, Weihan Wang, Wenyi Hong, Zhihuan Jiang, Bin Xu, Jie Tang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 30 pages,19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18226 2024-11-28 cs.SE cs.AI cs.LG cs.MA 62%

Feature-Factory: Automating Software Feature Integration Using Generative AI

Ruslan Idelfonso Magana Vsevolodovna

专题命中 数学推理 :planning(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16489 2024-11-26 cs.CL cs.AI 62%

O1 Replication Journey -- Part 2: Surpassing O1-preview through Simple Distillation, Big Progress or Bitter Lesson?

Zhen Huang, Haoyang Zou, Xuefeng Li, Yixiu Liu, Yuxiang Zheng, Ethan Chern, Shijie Xia, Yiwei Qin, Weizhe Yuan, Pengfei Liu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16189 2024-11-26 cs.AI cs.CL cs.MA 62%

Enhancing Multi-Agent Consensus through Third-Party LLM Integration: Analyzing Uncertainty and Mitigating Hallucinations in Large Language Models

Zhihua Duan, Jialin Wang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20131 2024-11-19 cs.LG cs.CL 62%

Language Models Need Inductive Biases to Count Inductively

Yingshan Chang, Yonatan Bisk

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02170 2024-11-18 cs.CL cs.AI cs.MA 62%

A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration

Zijun Liu, Yanzhe Zhang, Peng Li, Yang Liu, Diyi Yang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Published in COLM2024. Code Repo: https://github.com/SALT-NLP/DyLAN

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04799 2024-11-13 cs.CL cs.AI 62%

Kwai-STaR: Transform LLMs into State-Transition Reasoners

Xingyu Lu, Yuhang Hu, Changyi Liu, Tianke Zhang, Zhenyu Yang, Zhixiang Ding, Shengsheng Qian, Meng Du, Ruiwen Kang, Kaiyu Tang, Fan Yang, Tingting Gao, Di Zhang, Hai-Tao Zheng, Bin Wen

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13293 2024-11-12 cs.LG cs.AI cs.IR 62%

SBI-RAG: Enhancing Math Word Problem Solving for Students through Schema-Based Instruction and Retrieval-Augmented Generation

Prakhar Dixit, Tim Oates

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted to the 4th MATH-AI Workshop at NeurIPS'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05915 2024-11-12 cs.CL cs.AI cs.CV 62%

Give me a hint: Can LLMs take a hint to solve math problems?

Vansh Agrawal, Pratham Singla, Amitoj Singh Miglani, Shivank Garg, Ayush Mangal

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05369 2024-10-31 cs.LG cs.CL 62%

Noise Contrastive Alignment of Language Models with Explicit Rewards

Huayu Chen, Guande He, Lifan Yuan, Ganqu Cui, Hang Su, Jun Zhu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18336 2024-10-25 cs.CL cs.AI 62%

Assessing the Creativity of LLMs in Proposing Novel Solutions to Mathematical Problems

Junyi Ye, Jingyi Gu, Xinyun Zhao, Wenpeng Yin, Guiling Wang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15466 2024-10-22 cs.CL cs.AI 62%

Keep Guessing? When Considering Inference Scaling, Mind the Baselines

Gal Yona, Or Honovich, Omer Levy, Roee Aharoni

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13029 2024-10-18 cs.CL cs.LG 62%

When Not to Answer: Evaluating Prompts on GPT Models for Effective Abstention in Unanswerable Math Word Problems

Asir Saadat, Tasmia Binte Sogir, Md Taukir Azam Chowdhury, Syem Aziz

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10093 2024-10-15 cs.CL cs.LG 62%

How to Leverage Demonstration Data in Alignment for Large Language Model? A Self-Imitation Learning Perspective

Teng Xiao, Mingxiao Li, Yige Yuan, Huaisheng Zhu, Chao Cui, Vasant G Honavar

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2024 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03211 2024-10-15 cs.CL cs.LG 62%

How Does Quantization Affect Multilingual LLMs?

Kelly Marchisio, Saurabh Dash, Hongyu Chen, Dennis Aumiller, Ahmet Üstün, Sara Hooker, Sebastian Ruder

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

Comments Findings of EMNLP 2024 Camera-Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07035 2024-10-10 cs.CL cs.AI 62%

PositionID: LLMs can Control Lengths, Copy and Paste with Explicit Positional Awareness

Zekun Wang, Feiyu Duan, Yibo Zhang, Wangchunshu Zhou, Ke Xu, Wenhao Huang, Jie Fu

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 39 pages. CP-Bench and LenCtrl-Bench are available in https://huggingface.co/datasets/ZenMoore/CP-Bench and https://huggingface.co/datasets/ZenMoore/LenCtrl-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10382 2024-10-08 cs.AI cs.CL 62%

Efficient Prompting for LLM-based Generative Internet of Things

Bin Xiao, Burak Kantarci, Jiawen Kang, Dusit Niyato, Mohsen Guizani

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 11 figures. IEEE Internet of Things Journal, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13538 2024-10-08 cs.AI cs.LG 62%

AlignedCoT: Prompting Large Language Models via Native-Speaking Demonstrations

Zhicheng Yang, Yinya Huang, Jing Xiong, Liang Feng, Xiaodan Liang, Yiwei Wang, Jing Tang

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

Comments Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16851 2024-10-07 cs.CL cs.AI cs.CV 62%

Losing Visual Needles in Image Haystacks: Vision Language Models are Easily Distracted in Short and Long Contexts

Aditya Sharma, Michael Saxon, William Yang Wang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏