Text-Driven 3D Indoor Scene Synthesis in Non-Manhattan Environments
非曼哈顿环境下的文本驱动3D室内场景合成
Xianhui Meng, Zirui Song, Yuchen Zhang, Li Zhang, Yongxuan Lv, Xiuying Chen, Kun Wang, Yan Luo, Kai Chen, Hangjun Ye, Long Chen, Jun Liu, Xiaoshuai Hao
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
The Calibration Turn in AI-Assisted Research: A Conceptual and Methodological Framework for Evidence-Licensed Claims
AI辅助研究中的校准转向:证据许可主张的概念与方法论框架
Hongmin Li
机构
*
School of Life Science and Technology, Institute of Science Tokyo(东京科学大学生命科学与技术学院)
;
Department of Computational Biology and Medical Sciences, Graduate School of Frontier Sciences, The University of Tokyo(东京大学前沿科学研究生院计算生物学与医学科学系)
The Benchmark Illusion: Pruned LLMs Can Pass Multiple Choice but Fail to Answer
基准测试幻觉:剪枝后的大语言模型能通过多项选择但无法回答问题
Rui Wen, Lu Sun, Jiayang Liu, Zesheng Xu, Tianshuo Cong, Zheng Li
机构
*
Institute of Science Tokyo(东京科学大学)
;
Tohoku University(东北大学)
;
Nanyang Technological University(南洋理工大学)
;
KTH Royal Institute of Technology(瑞典皇家理工学院)
;
Shandong University(山东大学)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Meituan(美团)
;
The University of Hong Kong(香港大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Nanjing University(南京大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Australian Institute for Machine Learning, Adelaide University(阿德莱德大学澳大利亚机器学习研究所)
;
Ludwig Maximilian University of Munich(慕尼黑大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Queen Mary University of London(伦敦玛丽女王大学)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
Polar: A Benchmark for Evaluating Political Bias in LLMs
Polar: 评估大语言模型中政治偏见的基准
Sangho Kim, Heejin Kim, Yoonhee Park, Hyunggeun Jeon, Jaejin Lee
机构
*
Graduate School of Data Science, Seoul National University(首尔大学数据科学研究生院)
;
Dept. of Computer Science and Engineering, Seoul National University(首尔大学计算机科学与工程系)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
BenSyc: Benchmarking Conversational Sycophancy and Human Alignment in LLMs for Bengali Contexts
BenSyc: 孟加拉语上下文中大语言模型对话谄媚与人类对齐的基准测试
Kazi Noshin, Sajib Acharjee Dip, Ranat Das Prangon, Fardin Hassan Tamim, Syed Ishtiaque Ahmed, Liqing Zhang, Sharifa Sultana
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Virginia Tech(弗吉尼亚理工大学)
;
Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)
;
BRAC University(BRAC大学)
;
University of Toronto(多伦多大学)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL