机构
*
University of North Carolina at Chapel Hill(北卡罗来纳大学切里波因特分校)
;
Stanford University(斯坦福大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Southern California(南加州大学)
;
University of California, Santa Cruz(加州大学圣克鲁兹分校)
机构
*
Wuhan University(武汉大学)
;
Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所)
;
University of Technology Sydney(悉尼大学)
;
University of Bologna(博洛尼亚大学)
;
Zhejiang University(浙江大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
Huazhong University of Science and Technology(华中科技大学)
;
Great Wall Motor(长城汽车)
;
ROVR Labs, Inc.(ROVR实验室)
Improving Cross-Cultural Survey Simulation with Calibrated Value Personas
通过校准价值人设提升跨文化调查模拟
Axel Abels, Elias Fernandez Domingos, Apurva Shah, Tom Lenaerts
机构
*
Machine Learning Group, Université Libre de Bruxelles(布鲁塞尔自由大学机器学习小组)
;
AI Lab, Vrije Universiteit Brussel(布鲁塞尔自由大学人工智能实验室)
;
FARI Institute, Université Libre de Bruxelles - Vrije Universiteit Brussel(布鲁塞尔自由大学-布鲁塞尔自由大学FARI研究所)
;
Center for Human-Compatible AI, UC Berkeley(伯克利大学人机兼容人工智能中心)
FinReporting: An Agentic Workflow for Localized Reporting of Cross-Jurisdiction Financial Disclosures
FinReporting: 一种用于跨司法管辖区财务披露本地化报告的代理工作流
Fan Zhang, Mingzi Song, Rania Elbadry, Yankai Chen, Shaobo Wang, Yixi Zhou, Xunwen Zheng, Yueru He, Yuyang Dai, Georgi Georgiev, Ayesha Gull, Muhammad Usman Safder, Fan Wu, Liyuan Meng, Fengxian Ji, Junning Zhao, Xueqing Peng, Jimin Huang, Yu Chen, Xue, Liu, Preslav Nakov, Zhuohan Xie
机构
*
MBZUAI
;
The University of Tokyo(东京大学)
;
Meiji Gakuin University(明治大学)
;
McGill University(麦吉尔大学)
;
Kyoto University(京都大学)
;
Columbia University(哥伦比亚大学)
;
University of California, Berkeley(加州大学伯克利分校)
CryptoBench: A Dynamic Benchmark for Expert-Level Evaluation of LLM Agents in Cryptocurrency
CryptoBench: 一种动态基准,用于评估LLM代理在加密货币领域的专家级能力
Jiacheng Guo, Suozhi Huang, Zixin Yao, Yifan Zhang, Yifu Lu, Jiashuo Liu, Zihao Li, Nicholas Deng, Qixin Xiao, Jia Tian, Kanghong Zhan, Tianyi Li, Xiaochen Liu, Jason Ge, Chaoyang He, Kaixuan Huang, Lin Yang, Wenhao Huang, Mengdi Wang
机构
*
Princeton University(普林斯顿大学)
;
Zenith Lab(Zenith实验室)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
University of California, Berkeley(加州大学伯克利分校)
;
University of Michigan(密歇根大学)
DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research
DR Tulu:基于演进标准的深度研究强化学习
Rulin Shao, Akari Asai, Shannon Zejiang Shen, Hamish Ivison, Varsha Kishore, Jingming Zhuo, Xinran Zhao, Molly Park, Samuel G. Finlayson, David Sontag, Tyler Murray, Sewon Min, Pradeep Dasigi, Luca Soldaini, Faeze Brahman, Wen-tau Yih, Tongshuang Wu, Luke Zettlemoyer, Yoon Kim, Hannaneh Hajishirzi, Pang Wei Koh
机构
*
University of Washington(华盛顿大学)
;
Allen Institute for AI(人工智能研究院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Seattle Children's Hospital(西雅图儿童医院)
;
University of California, Berkeley(加州大学伯克利分校)
SAE-RNA: A Sparse Autoencoder Model for Interpreting RNA Language Model Representations
SAE-RNA:一种用于解释RNA语言模型表示的稀疏自编码器模型
Taehan Kim, Sangdae Nam
机构
*
Department of Computer Science, University of California, Berkeley(加州大学伯克利分校计算机科学系)
;
Department of Development Engineering, University of California, Berkeley(加州大学伯克利分校发展工程系)
Comments12 pages, 7 figures. v2: Updated bibliography to improve reference accuracy and reflect updated publication venues. Refined claims for better alignment with results and added an Appendix
机构
*
Department of Statistics, University of California, Berkeley, CA 94720, USA(加州大学伯克利分校统计系)
;
Department of Biostatistics, University of California, Berkeley, CA 94720, USA(加州大学伯克利分校生物统计学系)