arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 1997 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 1997 篇

2402.10691 2024-11-19 cs.CL 57%

Python is Not Always the Best Choice: Embracing Multilingual Program of Thoughts

Xianzhen Luo, Qingfu Zhu, Zhiming Zhang, Libo Qin, Xuanyu Zhang, Qing Yang, Dongliang Xu, Wanxiang Che

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted by EMNLP 2024. Code and data are released at https://github.com/Luowaterbi/MultiPoT

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07641 2024-11-13 cs.LG 57%

Top-$nσ$: Not All Logits Are You Need

Chenxia Tang, Jianchun Liu, Hongli Xu, Liusheng Huang

专题命中 测试时计算 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09215 2024-11-08 cs.IR cs.AI 57%

On Softmax Direct Preference Optimization for Recommendation

Yuxin Chen, Junfei Tan, An Zhang, Zhengyi Yang, Leheng Sheng, Enzhi Zhang, Xiang Wang, Tat-Seng Chua

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03590 2024-11-07 cs.CL 57%

From Medprompt to o1: Exploration of Run-Time Strategies for Medical Challenge Problems and Beyond

Harsha Nori, Naoto Usuyama, Nicholas King, Scott Mayer McKinney, Xavier Fernandes, Sheng Zhang, Eric Horvitz

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01563 2024-11-01 cs.CL 57%

LoFiT: Localized Fine-tuning on LLM Representations

Fangcong Yin, Xi Ye, Greg Durrett

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments NeurIPS 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17518 2024-10-02 cs.CR cs.AI 57%

Multi-Designated Detector Watermarking for Language Models

Zhengan Huang, Gongxian Zeng, Xin Mu, Yu Wang, Yue Yu

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14507 2024-09-19 cs.CL 57%

Internal Consistency and Self-Feedback in Large Language Models: A Survey

Xun Liang, Shichao Song, Zifan Zheng, Hanyu Wang, Qingchen Yu, Xunkai Li, Rong-Hua Li, Yi Wang, Zhonghao Wang, Feiyu Xiong, Zhiyu Li

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments 20 pages, 10 figures, 6 tables, 13 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08463 2024-08-19 cs.AI 57%

A theory of understanding for artificial intelligence: composability, catalysts, and learning

Zijian Zhang, Sara Aronowitz, Alán Aspuru-Guzik

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15363 2024-08-15 cs.CL 57%

Exploring LLM Multi-Agents for ICD Coding

Rumeng Li, Xun Wang, Hong Yu

专题命中 测试时计算 :CoT(abstract);分类 cs.CL

Comments 12pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17361 2024-07-25 cs.CV cs.AI 57%

MuST: Multi-Scale Transformers for Surgical Phase Recognition

Alejandra Pérez, Santiago Rodríguez, Nicolás Ayobi, Nicolás Aparicio, Eugénie Dessevres, Pablo Arbeláez

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12423 2024-06-21 cs.CV cs.AI 57%

Jack of All Tasks, Master of Many: Designing General-purpose Coarse-to-Fine Vision-Language Model

Shraman Pramanick, Guangxing Han, Rui Hou, Sayan Nag, Ser-Nam Lim, Nicolas Ballas, Qifan Wang, Rama Chellappa, Amjad Almahairi

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

Comments CVPR 2024 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12392 2024-05-31 cs.CL 57%

PiVe: Prompting with Iterative Verification Improving Graph-based Generative Capability of LLMs

Jiuzhou Han, Nigel Collier, Wray Buntine, Ehsan Shareghi

专题命中 测试时计算 :verifier(abstract);分类 cs.CL

Comments Our code and data are at https://github.com/Jiuzhouh/PiVe (accepted to ACL 2024 Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15264 2024-04-29 cs.CL 57%

DEEM: Dynamic Experienced Expert Modeling for Stance Detection

Xiaolong Wang, Yile Wang, Sijie Cheng, Peng Li, Yang Liu

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted by LREC-COLING 2024, Oral presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14564 2024-03-22 cs.CL 57%

Language Models Hallucinate, but May Excel at Fact Verification

Jian Guan, Jesse Dodge, David Wadden, Minlie Huang, Hao Peng

专题命中 测试时计算 :verifier(abstract);分类 cs.CL

Comments Accepted in NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06173 2024-03-12 cs.RO cs.LG 57%

Speeding up 6-DoF Grasp Sampling with Quality-Diversity

Johann Huber, François Hélénon, Mathilde Kappel, Elie Chelly, Mahdi Khoramshahi, Faïz Ben Amar, Stéphane Doncieux

专题命中 测试时计算 :planning(abstract);分类 cs.LG

Comments 7 pages, 8 figures. Preprint version

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10151 2024-02-16 cs.CL 57%

ControlLM: Crafting Diverse Personalities for Language Models

Yixuan Weng, Shizhu He, Kang Liu, Shengping Liu, Jun Zhao

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14262 2023-12-25 cs.SE cs.AI 57%

Exploring the intersection of Generative AI and Software Development

Filipe Calegario, Vanilson Burégio, Francisco Erivaldo, Daniel Moraes Costa Andrade, Kailane Felix, Nathalia Barbosa, Pedro Lucas da Silva Lucena, César França

专题命中 测试时计算 :chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02541 2023-11-29 cs.CR cs.AI 57%

PCPT and ACPT: Copyright Protection and Traceability Scheme for DNN Models

Xuefeng Fan, Dahao Fu, Hangyu Gui, Xinpeng Zhang, Xiaoyi Zhou

专题命中 测试时计算 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04495 2023-11-09 cs.CL 57%

Multi-label and Multi-target Sampling of Machine Annotation for Computational Stance Detection

Zhengyuan Liu, Hai Leong Chieu, Nancy F. Chen

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Findings of EMNLP 2023. arXiv admin note: text overlap with arXiv:2305.19845

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08303 2023-09-18 cs.CL 57%

Self-Consistent Narrative Prompts on Abductive Natural Language Inference

Chunkit Chan, Xin Liu, Tsz Ho Chan, Jiayang Cheng, Yangqiu Song, Ginny Wong, Simon See

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments Accepted at IJCNLP-AACL 2023 main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07645 2023-08-21 cs.CL 57%

Steering Language Generation: Harnessing Contrastive Expert Guidance and Negative Prompting for Coherent and Diverse Synthetic Data Generation

Charles O'Neill, Yuan-Sen Ting, Ioana Ciuca, Jack Miller, Thang Bui

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00108 2023-08-21 cs.SE cs.LG 57%

Better patching using LLM prompting, via Self-Consistency

Toufique Ahmed, Premkumar Devanbu

专题命中 测试时计算 :CoT(abstract);分类 cs.LG

Comments Accepted at ASE-NIER (2023) track

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08204 2023-08-17 cs.CL 57%

MoCoSA: Momentum Contrast for Knowledge Graph Completion with Structure-Augmented Pre-trained Language Models

Jiabang He, Liu Jia, Lei Wang, Xiyao Li, Xing Xu

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02072 2022-11-02 cs.LG cs.IT math.IT stat.ML 57%

Deciding What to Model: Value-Equivalent Sampling for Reinforcement Learning

Dilip Arumugam, Benjamin Van Roy

专题命中 测试时计算 :planning(abstract);分类 cs.LG

Comments Accepted to Neural Information Processing Systems (NeurIPS) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.01975 2022-09-07 cs.CL 57%

Selective Annotation Makes Language Models Better Few-Shot Learners

Hongjin Su, Jungo Kasai, Chen Henry Wu, Weijia Shi, Tianlu Wang, Jiayi Xin, Rui Zhang, Mari Ostendorf, Luke Zettlemoyer, Noah A. Smith, Tao Yu

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.10615 2022-05-23 cs.CL cs.LO 57%

Generalized Quantifiers as a Source of Error in Multilingual NLU Benchmarks

Ruixiang Cui, Daniel Hershcovich, Anders Søgaard

专题命中 测试时计算 :reasoning(abstract);分类 cs.CL

Comments To appear at NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.04061 2022-05-10 cs.CV cs.AI 57%

Multilevel Hierarchical Network with Multiscale Sampling for Video Question Answering

Min Peng, Chongyang Wang, Yuan Gao, Yu Shi, Xiang-Dong Zhou

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

Comments Accepted by IJCAI 2022. arXiv admin note: text overlap with arXiv:2109.04735

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.09093 2021-11-18 cs.AI 57%

The Faulty GPS Problem: Shortest Time Paths in Networks with Unreliable Directions

Steve Alpern

专题命中 测试时计算 :planning(abstract);分类 cs.AI

Comments 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.07495 2021-02-16 cs.GT cs.AI cs.NE 57%

ScrofaZero: Mastering Trick-taking Poker Game Gongzhu by Deep Reinforcement Learning

Naichen Shi, Ruichen Li, Sun Youran

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI

Comments The very first versoin. Will be improved in the future

详情

展开后加载摘要…

URL PDF HTML 收藏
1811.04471 2018-11-13 cs.LG stat.ML 57%

Thompson Sampling for Pursuit-Evasion Problems

Zhen Li, Nicholas J. Meyer, Eric B. Laber, Robert Brigantic

专题命中 测试时计算 :planning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏