arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45006 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 3222 篇

2508.04278 2025-08-07 cs.AI 57%

Large Language Model's Multi-Capability Alignment in Biomedical Domain

Wentao Wu, Linqing Chen, Hanmeng Zhong, Weilei Wang

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03533 2025-08-06 cs.CL 57%

EmbedGrad: Gradient-Based Prompt Optimization in Embedding Space for Large Language Models

Xiaoming Hou, Jiquan Zhang, Zibin Lin, DaCheng Tao, Shengli Zhang

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23407 2025-08-01 cs.CL 57%

Beyond Passive Critical Thinking: Fostering Proactive Questioning to Enhance Human-AI Collaboration

Ante Wang, Yujie Lin, Jingyao Liu, Suhang Wu, Hao Liu, Xinyan Xiao, Jinsong Su

机构 * School of Informatics, Xiamen University, China(厦门大学信息学院) Department of Digital Media Technology, Xiamen University, China(厦门大学数字媒体技术系) Baidu Inc., Beijing, China(百度公司)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21645 2025-07-30 cs.CL 57%

Libra: Assessing and Improving Reward Model by Learning to Think

Meng Zhou, Bei Li, Jiahao Liu, Xiaowen Shi, Yang Bai, Rongxiang Weng, Jingang Wang, Xunliang Cai

机构 * Meituan(美团)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments Work In Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21636 2025-07-30 cs.AI 57%

StaffPro: an LLM Agent for Joint Staffing and Profiling

Alessio Maritan

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20509 2025-07-29 cs.RO cs.AI cs.SY eess.SY 57%

LLMs-guided adaptive compensator: Bringing Adaptivity to Automatic Control Systems with Large Language Models

Zhongchao Zhou, Yuxi Lu, Yaonan Zhu, Yifan Zhao, Bin He, Liang He, Wenwen Yu, Yusuke Iwasawa

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19227 2025-07-28 cs.CL 57%

Jailbreaking Large Language Diffusion Models: Revealing Hidden Safety Flaws in Diffusion-Based Text Generation

Yuanhe Zhang, Fangzhou Xie, Zhenhong Zhou, Zherui Li, Hao Chen, Kun Wang, Yufei Guo

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17728 2025-07-24 cs.CL 57%

Megrez2 Technical Report

Boxun Li, Yadong Li, Zhiyuan Li, Congyi Liu, Weilin Liu, Guowei Niu, Zheyue Tan, Haiyang Xu, Zhuyu Yao, Tao Yuan, Dong Zhou, Yueqing Zhuang, Bo Zhao, Guohao Dai, Yu Wang

机构 * Infinigence-AI Aalto University(Aalto大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02951 2025-07-24 cs.CL cs.MA 57%

Adaptive Graph Pruning for Multi-Agent Communication

Boyi Li, Zhonghan Zhao, Der-Horng Lee, Gaoang Wang

机构 * Zhejiang University - University of Illinois Urbana-Champaign Institute(浙江大学 - 印第安纳大学厄巴纳-香槟分校研究所) Zhejiang University, College of Computer Science and Technology(浙江大学计算机科学与技术学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments ECAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11275 2025-07-16 cs.CL 57%

FMC: Formalization of Natural Language Mathematical Competition Problems

Jiaxuan Xie, Chengwu Liu, Ye Yuan, Siqi Li, Zhiping Xiao, Ming Zhang

机构 * State Key Laboratory for Multimedia Information Processing, School of Computer Science, PKU-Anker LLM Lab, Peking University, Beijing, China(多媒体信息处理国家重点实验室,计算机科学学院,PKU-Anker LLM实验室,北京大学,北京,中国) Paul G. Allen School of Computer Science(保罗·G·阿伦计算机科学学校) Engineering, University of Washington, U.S.A.(工程,华盛顿大学,美国)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments Accepted in ICML 2025 AI4MATH Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00700 2025-07-15 cs.CV cs.LG 57%

WeGeFT: Weight-Generative Fine-Tuning for Multi-Faceted Efficient Adaptation of Large Models

Chinmay Savadikar, Xi Song, Tianfu Wu

机构 * Department of Electrical and Computer Engineering, North Carolina State University, Raleigh, USA(电气与计算机工程系,北卡罗来纳州立大学,拉leys,美国)

专题命中 数学推理 :reasoning(abstract);分类 cs.LG

Comments Accepted to ICML25

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08538 2025-07-14 cs.CL 57%

The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks

David Pomerenke, Jonas Nothnagel, Simon Ostermann

机构 * Bundesministerium für wirtschaftliche Zusammenarbeit und Entwicklung (BMZ)(经济合作与发展部) Gesellschaft für Internationale Zusammenarbeit (GIZ)(国际发展合作署) Deutsches Forschungszentrum für Künstliche Intelligenz (DFKI)(德国人工智能研究中心)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06167 2025-07-11 cs.CL cs.CV 57%

Skywork-R1V3 Technical Report

Wei Shen, Jiangbo Pei, Yi Peng, Xuchen Song, Yang Liu, Jian Peng, Haofeng Sun, Yunzhuo Hao, Peiyu Wang, Jianhao Zhang, Yahui Zhou

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07017 2025-07-10 cs.AI 57%

First Return, Entropy-Eliciting Explore

Tianyu Zheng, Tianshun Xing, Qingshui Gu, Taoran Liang, Xingwei Qu, Xin Zhou, Yizhi Li, Zhoufutu Wen, Chenghua Lin, Wenhao Huang, Qian Liu, Ge Zhang, Zejun Ma

机构 * The University of Manchester(曼彻斯特大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06798 2025-07-10 cs.AI math.LO 57%

Comparing Dialectical Systems: Contradiction and Counterexample in Belief Change (Extended Version)

Uri Andrews, Luca San Mauro

机构 * University of Wiscosin--Madison(威斯康星大学麦迪逊分校) University of Bari(巴里大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

Comments 25 pages, accepted at JELIA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06127 2025-07-09 cs.AR cs.AI 57%

PrefixAgent: An LLM-Powered Design Framework for Efficient Prefix Adder Optimization

Dongsheng Zuo, Jiadong Zhu, Yang Luo, Yuzhe Ma

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02873 2025-07-08 math.HO cs.AI 57%

Using Large Language Models to Study Mathematical Practice

William D'Alessandro

机构 * William D’Alessandro(独立研究者)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01701 2025-07-03 cs.MA cs.AI 57%

Exploring Advanced LLM Multi-Agent Systems Based on Blackboard Architecture

Bochen Han, Songmao Zhang

机构 * State Key Laboratory of Mathematical Sciences Academy of Mathematics and Systems Science, CAS(数学科学国家重点实验室,数学与系统科学研究院,中国科学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09432 2025-07-01 cs.DC cs.CL cs.CV 57%

FedEx-LoRA: Exact Aggregation for Federated and Efficient Fine-Tuning of Foundation Models

Raghav Singhal, Kaustubh Ponkshe, Praneeth Vepakomma

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments ACL 2025 - Oral. Raghav Singhal and Kaustubh Ponkshe contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22157 2025-06-30 cs.CL 57%

Training Language Model to Critique for Better Refinement

Tianshu Yu, Chao Xiang, Mingchuan Yang, Pei Ke, Bosi Wen, Cunxiang Wang, Jiale Cheng, Li Zhang, Xinyu Mu, Chuxiong Sun, Minlie Huang

机构 * China Telecom Research Institute(中国电信研究院) The Conversational Artificial Intelligence (CoAI) Group, Tsinghua University(清华大学对话人工智能(CoAI)小组) University of Electronic Science and Technology of China(电子科技大学) The Knowledge Engineering Group (KEG), Tsinghua University(清华大学知识工程小组) Zhipu AI(智谱AI)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments Accepted to ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14470 2025-06-24 cs.CL 57%

Step-by-Step Unmasking for Parameter-Efficient Fine-tuning of Large Language Models

Aradhye Agarwal, Suhas K Ramesh, Ayan Sengupta, Tanmoy Chakraborty

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments 15 pages, 7 tables, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16500 2025-06-23 cs.LG 57%

SparseLoRA: Accelerating LLM Fine-Tuning with Contextual Sparsity

Samir Khaki, Xiuyu Li, Junxian Guo, Ligeng Zhu, Chenfeng Xu, Konstantinos N. Plataniotis, Amir Yazdanbakhsh, Kurt Keutzer, Song Han, Zhijian Liu

机构 * University of Toronto(多伦多大学) MIT(麻省理工学院) Google DeepMind(谷歌DeepMind)

专题命中 数学推理 :reasoning(abstract);分类 cs.LG

Comments ICML 2025. The first three authors contributed equally to this work. Project page: https://z-lab.ai/projects/sparselora

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16389 2025-06-23 cs.CL 57%

RiOT: Efficient Prompt Refinement with Residual Optimization Tree

Chenyi Zhou, Zhengyan Shi, Yuan Yao, Lei Liang, Huajun Chen, Qiang Zhang

机构 * Zhejiang University(浙江大学) University College London(伦敦大学学院) Ant Group(蚂蚁集团)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14728 2025-06-18 cs.AI 57%

AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes

Jiahao Qiu, Xinzhe Juan, Yimin Wang, Ling Yang, Xuan Qi, Tongcheng Zhang, Jiacheng Guo, Yifu Lu, Zixin Yao, Hongru Wang, Shilong Liu, Xun Jiang, Liu Leqi, Mengdi Wang

机构 * AI Lab, Princeton University(普林斯顿大学人工智能实验室) University of Michigan(密歇根大学) IIIS, Tsinghua University(清华大学人工智能研究院) Shanghai Jiao Tong University(上海交通大学) Columbia University(哥伦比亚大学) The Chinese University of Hong Kong(香港中文大学) Tianqiao and Chrissy Chen Institute(田桥和克里斯蒂·陈研究所) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 数学推理 :planning(abstract);分类 cs.AI

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15639 2025-06-11 cs.CL 57%

Can Large Language Models Invent Algorithms to Improve Themselves?: Algorithm Discovery for Recursive Self-Improvement through Reinforcement Learning

Yoichi Ishibashi, Taro Yano, Masafumi Oyamada

机构 * NEC Corporation(日本电报电话株式会社)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments Accepted at NAACL 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06686 2025-06-10 cs.CL 57%

Learning Distribution-Wise Control in Representation Space for Language Models

Chunyuan Deng, Ruidi Chang, Hanjie Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04481 2025-06-06 cs.AI 57%

CogMath: Assessing LLMs' Authentic Mathematical Ability from a Human Cognitive Perspective

Jiayu Liu, Zhenya Huang, Wei Dai, Cheng Cheng, Jinze Wu, Jing Sha, Song Li, Qi Liu, Shijin Wang, Enhong Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19887 2025-06-06 cs.SE cs.AI cs.CR 57%

Deconstructing Obfuscation: A four-dimensional framework for evaluating Large Language Models assembly code deobfuscation capabilities

Anton Tkachenko, Dmitrij Suskevic, Benjamin Adolphi

机构 * Research department Promon AS(Promon AS 研究部门)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00921 2025-06-06 cs.LG 57%

Blink of an eye: a simple theory for feature localization in generative models

Marvin Li, Aayush Karan, Sitan Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01704 2025-06-06 cs.CL 57%

An Exploration of Self-Supervised Mutual Information Alignment for Multi-Task Settings

Soham V. Govande

机构 * Stanford University(斯坦福大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏