TQA-Bench: Evaluating LLMs for Multi-Table Question Answering
TQA-Bench:评估大语言模型在多表问答中的表现
机构 * Hong Kong University of Science and Technology(香港科技大学) ; Tsinghua University(清华大学)
专题命中 跨模态检索 :multi-modal(abstract);分类 cs.CL、cs.AI
AI总结 提出TQA-Bench基准,通过长上下文多表问答任务评估LLM,揭示其在复杂数据驱动环境中的挑战与机遇。
Comments Accepted by IEEE Transactions on Big Data