Disentangling Similarity and Relatedness in Topic Models
在主题模型中区分相似性和相关性
Hanlin Xiao, Yang Wang, Mauricio A. Álvarez, Rainer Breitling
机构
*
Manchester Institute of Biotechnology, The University of Manchester, UK(曼彻斯特生物技术研究所,曼彻斯特大学,英国)
;
Department of Computer Science, The University of Manchester, UK(计算机科学系,曼彻斯特大学,英国)
;
Department of Chemistry, The University of Manchester, UK(化学系,曼彻斯特大学,英国)
机构
*
School of Data Science, Fudan University(复旦大学数据科学学院)
;
Shanghai Innovation Institute(上海创新研究院)
;
Shanghai University of Finance and Economics(上海财经大学)
;
MOE laboratory for National Development and Intelligent Governance, Fudan University(复旦大学国家发展与智能治理实验室)
;
Research Institute of Intelligent Complex Systems, Fudan University(复旦大学智能复杂系统研究院)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
BioProBench: A Corpus and Benchmark for Biological Protocol Reasoning in Autonomous Science
BioProBench: 一个全面的数据集和生物协议理解与推理基准
Yuyang Liu, Liuzhenghao Lv, Xiancheng Zhang, Jingya Wang Li Yuan, Yonghong Tian
机构
*
School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院)
;
School of Chemical Biology&Biotechnology, Peking University(北京大学化学生物学与生物技术学院)
Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment
迈向拟人化对话:一个用于类人聊天生成、评估和偏好对齐的闭环框架
Wentao Liu, Siyu Song, Xi Chen, Youjia Li, Xiaokun Wang, Min Ji, Ji Wang
机构
*
Shanghai Institute of Innovation(上海创新研究院)
;
East China Normal University(华东师范大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Chabiyue (Shanghai) Information Technology Co., Ltd.(上海叉叉悦信息技术有限公司)
;
Shanghai Tianyou Software Co., Ltd.(上海天游软件有限公司)
;
Zhejiang Century Huatong Group Co., Ltd.(浙江世纪华通集团有限公司)
JobHop v2: A Large-Scale Career Trajectory Dataset from Unstructured Resumes
JobHop v2:一个来自非结构化简历的大规模职业轨迹数据集
Iman Johary, Guillaume Bied, Alexandru C. Mara, Tijl De Bie
机构
*
AIDA-IDLab, Department of Electronics and Information Systems, Ghent University, Ghent, Belgium(AIDA-ID实验室,电子与信息系统系,根特大学,根特,比利时)
;
AIDA-IDLab, Department of Electronics(AIDA-ID实验室,电子系)
;
Information Systems, Ghent University, Ghent, Belgium(信息系统,根特大学,根特,比利时)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
Linked Multi-Modal Data on Russian Domestic and Foreign Policy Speeches
连接多模型数据:俄罗斯国内与对外政策演讲
Daria Blinova, Gayathri Emuru, Rakesh Emuru, Kushagradheer Shridheer Srivastava, Mina Rulis, Sunita Chandrasekaran, Benjamin E. Bagozzi
机构
*
University of Delaware, Department of Political Science & International Relations(德克萨斯大学,政治科学与国际关系系)
;
University of Delaware, Masters of Science in Data Science Program(德克萨斯大学,数据科学硕士项目)
;
University of Delaware, Department of Computer & Information Sciences(德克萨斯大学,计算机与信息科学系)
;
University of Pennsylvania, Department of Political Science(宾夕法尼亚大学,政治科学系)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
Query2Diagram: Answering Developer Queries with UML Diagrams
Query2Diagram:通过UML图回答开发者查询
Oleg Baryshnikov, Anton M. Alekseev, Sergey I. Nikolenko
机构
*
HSE University(俄罗斯高等经济学院)
;
St. Petersburg Department of Steklov Mathematical Institute, RAS(圣彼得堡斯捷克洛夫数学研究所(俄罗斯科学院))
;
St. Petersburg State University(圣彼得堡国立大学)
QEDBENCH: Quantifying the Alignment Gap in Automated Evaluation of University-Level Mathematical Proofs
QEDBENCH:量化大学水平数学证明自动评估中的对齐差距
Santiago Gonzalez, Alireza Amiri Bavandpour, Peter Ye, Edward Zhang, Ruslans Aleksejevs, Todor Antić, Polina Baron, Sujeet Bhalerao, Shubhrajit Bhattacharya, Zachary Burton, John Byrne, Hyungjun Choi, Nujhat Ahmed Disha, Koppany István Encz, Yuchen Fang, Robert Joseph George, Ebrahim Ghorbani, Alan Goldfarb, Jing Guo, Meghal Gupta, Stefano Huber, Annika Kanckos, Minjung Kang, Hyun Jong Kim, Dino Lorenzini, Levi Lorenzo, Tianyi Mao, Giovanni Marzenta, Ariane M. Masuda, Lukas Mauth, Ana Mickovic, Andres Miniguano-Trujillo, Antoine Moulin, Wenqi Ni, Tomos Parry, Kevin Ren, Hossein Roodbarani, Mathieu Rundström, Manjil Saikia, Detchat Samart, Rebecca Steiner, Connor Stewart, Dhara Thakkar, Jeffrey Tse, Vasiliki Velona, Yunhai Xiang, Sibel Yalçın, Jun Yan, Ji Zeng, Arman Cohan, Quanquan C. Liu
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG
EvoAgent: An Evolvable Agent Framework with Skill Learning and Multi-Agent Delegation
EvoAgent:一种具备技能学习和多智能体委托的可进化代理框架
Aimin Zhang, Jiajing Guo, Fuwei Jia, Chen Lv, Boyu Wang, Fangzheng Li
机构
*
Focus AI Center, Focus Technology Co., Ltd.(Focus技术有限公司人工智能中心)
;
Engineering Research Center of Digital Forensics, Ministry of Education, Nanjing University of Information Science and Technology(信息科学技术大学南京教育部长数字取证工程研究中心)
;
Nanjing University of Science and Technology(南京理工大学)
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI
机构
*
BenchFlow
;
OSU
;
Amazon
;
UC Berkeley
;
UC Santa Cruz
;
UC Davis
;
Dartmouth
;
RLWRLD
;
Independent
;
Princeton University
;
Oxford University
;
Stanford University
;
USC
;
CMU
;
Foxconn
;
Zenity
;
UNSW
;
UT Austin
;
MSU
;
Duke University
;
ByteDance
;
UT Dallas
;
UC San Diego
;
Columbia University
;
University of Rochester
;
Cornell Tech
;
Georgia Tech
;
Cornell University
;
NEU
;
UCLA
;
Snap Inc.
;
Fanshawe College
;
University of Science and Technology of China
;
HKUST(GZ)
;
Anyscale
专题命中
评测与基准
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI
DecompSR: A dataset for decomposed analyses of compositional multihop spatial reasoning
DecompSR:用于组合多跳空间推理分解分析的数据集
Lachlan McPheat, Navdeep Kaur, Robert Blackwell, Alessandra Russo, Anthony G. Cohn, Pranava Madhyastha
机构
*
The Alan Turing Institute(艾伦·图灵研究所)
;
Imperial College London(帝国理工学院伦敦分校)
;
The University of Leeds(利兹大学)
;
City St George’s University of London(伦敦城市圣乔治大学)
专题命中
评测与基准
:LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
CommentsThe authors have withdrawn this article because the current version is still undergoing substantial revision. Several components of the data synthesis framework, consistency-filtering procedure, evaluation protocol, and experimental analysis are being refined and expanded. As a result, the current manuscript should not be considered a complete or final representation of the work