arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5804 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5804 篇

2309.15427 2024-01-01 cs.CL cs.AI cs.LG 67%

Graph Neural Prompting with Large Language Models

Yijun Tian, Huan Song, Zichen Wang, Haozhu Wang, Ziqing Hu, Fang Wang, Nitesh V. Chawla, Panpan Xu

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06820 2023-12-13 cs.AI cs.CL cs.LG stat.ME 67%

Extracting Self-Consistent Causal Insights from Users Feedback with LLMs and In-context Learning

Sara Abdali, Anjali Parikh, Steve Lim, Emre Kiciman

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16079 2023-11-28 cs.CL cs.AI cs.LG 67%

MEDITRON-70B: Scaling Medical Pretraining for Large Language Models

Zeming Chen, Alejandro Hernández Cano, Angelika Romanou, Antoine Bonnet, Kyle Matoba, Francesco Salvi, Matteo Pagliardini, Simin Fan, Andreas Köpf, Amirkeivan Mohtashami, Alexandre Sallinen, Alireza Sakhaeirad, Vinitra Swamy, Igor Krawczuk, Deniz Bayazit, Axel Marmet, Syrielle Montariol, Mary-Anne Hartley, Martin Jaggi, Antoine Bosselut

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14930 2023-11-28 cs.AI cs.CL cs.LG 67%

In-Context Impersonation Reveals Large Language Models' Strengths and Biases

Leonard Salewski, Stephan Alaniz, Isabel Rio-Torto, Eric Schulz, Zeynep Akata

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published in NeurIPS 2023 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00034 2023-11-09 cs.LG cs.AI cs.CL 67%

PB-LLM: Partially Binarized Large Language Models

Yuzhang Shang, Zhihang Yuan, Qiang Wu, Zhen Dong

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Frist work using network binarization for large language model compression

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14926 2023-10-24 cs.CL cs.AI cs.LG 67%

Universal Self-Adaptive Prompting

Xingchen Wan, Ruoxi Sun, Hootan Nakhost, Hanjun Dai, Julian Martin Eisenschlos, Sercan O. Arik, Tomas Pfister

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023 (Main). 10 pages, 5 figures, 4 tables (26 pages, 9 figures and 13 tables including references and appendices)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.08732 2023-10-12 cs.CL cs.AI cs.IR cs.LG 67%

Knowledge Rumination for Pre-trained Language Models

Yunzhi Yao, Peng Wang, Shengyu Mao, Chuanqi Tan, Fei Huang, Huajun Chen, Ningyu Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06825 2023-10-11 cs.CL cs.AI cs.LG 67%

Mistral 7B

Albert Q. Jiang, Alexandre Sablayrolles, Arthur Mensch, Chris Bamford, Devendra Singh Chaplot, Diego de las Casas, Florian Bressand, Gianna Lengyel, Guillaume Lample, Lucile Saulnier, Lélio Renard Lavaud, Marie-Anne Lachaux, Pierre Stock, Teven Le Scao, Thibaut Lavril, Thomas Wang, Timothée Lacroix, William El Sayed

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Models and code are available at https://mistral.ai/news/announcing-mistral-7b/

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10346 2023-09-20 cs.LG cs.AI cs.CL 67%

Explaining Agent Behavior with Large Language Models

Xijia Zhang, Yue Guo, Simon Stepputtis, Katia Sycara, Joseph Campbell

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Human Multi-Robot Interaction Workshop at IROS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.09960 2023-09-15 cs.CL cs.AI cs.LG 67%

A Latent Space Theory for Emergent Abilities in Large Language Models

Hui Jiang

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01093 2023-09-06 cs.CV 67%

CoTDet: Affordance Knowledge Prompting for Task Driven Object Detection

Jiajin Tang, Ge Zheng, Jingyi Yu, Sibei Yang

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract)

Comments Accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11578 2023-08-23 cs.CL cs.AI cs.LG 67%

Refashioning Emotion Recognition Modelling: The Advent of Generalised Large Models

Zixing Zhang, Liyizhe Peng, Tao Pang, Jing Han, Huan Zhao, Bjorn W. Schuller

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11483 2023-08-23 cs.CL cs.AI cs.LG 67%

Large Language Models Sensitivity to The Order of Options in Multiple-Choice Questions

Pouya Pezeshkpour, Estevam Hruschka

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.11787 2023-08-17 cs.CL cs.AI cs.LG 67%

LLM Cognitive Judgements Differ From Human

Sotiris Lamprinidis

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 1 figure. License changed to CC BY-NC-SA

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09163 2023-07-19 cs.SE 67%

Generative Type Inference for Python

Yun Peng, Chaozheng Wang, Wenxuan Wang, Cuiyun Gao, Michael R. Lyu

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract)

Comments This paper has been accepted by ASE'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04964 2023-07-19 cs.CL cs.AI cs.LG 67%

Secrets of RLHF in Large Language Models Part I: PPO

Rui Zheng, Shihan Dou, Songyang Gao, Yuan Hua, Wei Shen, Binghai Wang, Yan Liu, Senjie Jin, Qin Liu, Yuhao Zhou, Limao Xiong, Lu Chen, Zhiheng Xi, Nuo Xu, Wenbin Lai, Minghao Zhu, Cheng Chang, Zhangyue Yin, Rongxiang Weng, Wensen Cheng, Haoran Huang, Tianxiang Sun, Hang Yan, Tao Gui, Qi Zhang, Xipeng Qiu, Xuanjing Huang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08678 2023-07-18 cs.CL cs.AI cs.LG 67%

Do Models Explain Themselves? Counterfactual Simulatability of Natural Language Explanations

Yanda Chen, Ruiqi Zhong, Narutatsu Ri, Chen Zhao, He He, Jacob Steinhardt, Zhou Yu, Kathleen McKeown

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.00215 2023-07-11 cs.CL cs.AI cs.LG 67%

Inductive Relation Prediction from Relational Paths and Context with Hierarchical Transformers

Jiaang Li, Quan Wang, Zhendong Mao

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICASSP 2023 (Oral). The code is available at: https://github.com/JiaangL/REPORT

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10062 2023-06-21 cs.CL cs.AI cs.LG 67%

Revealing the structure of language model capabilities

Ryan Burnell, Han Hao, Andrew R. A. Conway, Jose Hernandez Orallo

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 3 figures + references and appendices, for data and analysis code see https://github.com/RyanBurnell/revealing-LLM-capabilities

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02388 2023-06-06 cs.CL cs.AI cs.LG 67%

Commonsense Knowledge Transfer for Pre-trained Language Models

Wangchunshu Zhou, Ronan Le Bras, Yejin Choi

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16349 2023-05-29 cs.CL cs.AI cs.LG 67%

Lexinvariant Language Models

Qian Huang, Eric Zelikman, Sarah Li Chen, Yuhuai Wu, Gregory Valiant, Percy Liang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05364 2023-05-10 cs.LG cs.AI cs.CL 67%

Large Language Model Programs

Imanol Schlag, Sainbayar Sukhbaatar, Asli Celikyilmaz, Wen-tau Yih, Jason Weston, Jürgen Schmidhuber, Xian Li

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02499 2023-05-05 cs.CL cs.AI cs.CV cs.LG stat.ML 67%

AutoML-GPT: Automatic Machine Learning with GPT

Shujian Zhang, Chengyue Gong, Lemeng Wu, Xingchao Liu, Mingyuan Zhou

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09173 2023-05-04 cs.AI cs.CL cs.LG 67%

Unsupervised Task Graph Generation from Instructional Video Transcripts

Lajanugen Logeswaran, Sungryull Sohn, Yunseok Jang, Moontae Lee, Honglak Lee

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Findings of ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.05742 2023-01-26 cs.CL cs.AI cs.DB cs.IR cs.LG 67%

Kformer: Knowledge Injection in Transformer Feed-Forward Layers

Yunzhi Yao, Shaohan Huang, Li Dong, Furu Wei, Huajun Chen, Ningyu Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by NLPCC 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.10591 2022-12-26 cs.AI cs.CL cs.LG 67%

Can Foundation Models Talk Causality?

Moritz Willig, Matej Zečević, Devendra Singh Dhami, Kristian Kersting

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Main paper: 6 pages, References: 1.5 pages, Supplement: 11.5 pages. Main paper: 4 figures, Supplement: 3 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2005.13407 2022-11-15 cs.CL cs.AI cs.LG 67%

CausaLM: Causal Model Explanation Through Counterfactual Language Models

Amir Feder, Nadav Oved, Uri Shalit, Roi Reichart

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Our code and data are available at: https://amirfeder.github.io/CausaLM/ Accepted for publication in Computational Linguistics journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.01478 2022-10-28 cs.CL cs.AI cs.CY cs.LG 67%

When to Make Exceptions: Exploring Language Models as Accounts of Human Moral Judgment

Zhijing Jin, Sydney Levine, Fernando Gonzalez, Ojasv Kamal, Maarten Sap, Mrinmaya Sachan, Rada Mihalcea, Josh Tenenbaum, Bernhard Schölkopf

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2022 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12530 2022-10-25 cs.LG cs.AI cs.CL 67%

LMPriors: Pre-Trained Language Models as Task-Specific Priors

Kristy Choi, Chris Cundy, Sanjari Srivastava, Stefano Ermon

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.07686 2022-10-17 cs.CL cs.AI cs.LG 67%

Text and Patterns: For Effective Chain of Thought, It Takes Two to Tango

Aman Madaan, Amir Yazdanbakhsh

专题命中 其他推理 :CoT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Shortened version with additional results from CODEX and GPT-3. The authors contributed equally. Work done when Aman Madaan was a student researcher at Google Research, Brain Team

详情

展开后加载摘要…

URL PDF HTML 收藏