LLMTabBench: Evaluating LLMs on Binary Tabular Classification From Zero to Few Shots
LLMTabBench:从零样本到少样本的二元表格分类中评估LLM
机构 * Sb AI Lab, HSE, NES(Sb AI Lab,HSE,NES) ; Sb AI Lab, HSE(Sb AI Lab,HSE) ; Sb AI Lab, HSE University(Sb AI Lab,HSE大学) ; Sb AI Lab
专题命中 预训练与数据 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);pretraining(abstract)
AI总结 提出LLMTabBench基准,系统评估LLM在数据稀缺条件下进行表格分类时,先验知识与上下文信息(任务描述和少样本示例)的交互作用,以及性能随数据复杂度的扩展规律。