Shrinking the Generation-Verification Gap with Weak Verifiers
缩小生成-验证差距的弱验证器
Jon Saad-Falcon, E. Kelly Buchanan, Mayee F. Chen, Tzu-Heng Huang, Brendan McLaughlin, Tanvir Bhathal, Shang Zhu, Ben Athiwaratkun, Frederic Sala, Scott Linderman, Azalia Mirhoseini, Christopher Ré
机构
*
Stanford University(斯坦福大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
Together AI
A Neurosymbolic Approach to Natural Language Formalization and Verification
一种用于自然语言形式化和验证的神经符号方法
Chenyang An, Sam Bayless, Stefano Buliani, Darion Cassel, Byron Cook, Duncan Clough, Rémi Delmas, Nafi Diallo, Ferhat Erata, Nick Feng, Dimitra Giannakopoulou, Aman Goel, Aditya Gokhale, Joe Hendrix, Victor Heorhiadi, Marc Hudak, Dejan Jovanović, Andrew M. Kent, Benjamin Kiesl-Reiter, Jeffrey J. Kuna, Nadia Labai, Joseph Lilien, Divya Raghunathan, Zvonimir Rakamarić, Niloofar Razavi, Michael Tautschnig, Ali Torkamani, Nathaniel Weir, Michael W. Whalen, Jianan Yao
机构
*
Amazon Web Services(亚马逊网络服务)
;
University College London(伦敦大学学院)
;
University of Toronto(多伦多大学)
;
Queen Mary University of London(伦敦大学女王学院)
CommentsThis Guideline has been developed through revision and refinement based on the first edition. The element label system has been adjusted, and the annotation granularity and annotation workflow have been further optimized
Human agency in initial human-AI proof formalization workflows
表征初始人机交互的证明形式化工作流
Katherine M. Collins, Simon Frieder, Jonas Bayer, Jacob Loader, Jeck Lim, Peiyang Song, Fabian Zaiser, Lexin Zhou, Shanda Li, Sam Looi, Joshua B. Tenenbaum, Umang Bhatt, Adrian Weller, Jose Hernandez-Orallo, Cameron E. Freer, Valerie Chen, Ilia Sucholutsky
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
University of Cambridge(剑桥大学)
;
Princeton University(普林斯顿大学)
;
University of Oxford(牛津大学)
;
Caltech(加州理工学院)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Universitat Politècnica de València(瓦伦西亚理工大学)
;
New York University(纽约大学)
Goedel-Code-Prover: Hierarchical Proof Search for Open State-of-the-Art Code Verification
Goedel-Code-Prover:面向开放状态的最新代码验证的分层证明搜索
Zenan Li, Ziran Yang, Deyuan He, Haoyu Zhao, Andrew Zhao, Shange Tang, Kaiyu Yang, Aarti Gupta, Zhendong Su, Chi Jin
机构
*
ETH Zürich(苏黎世联邦理工学院)
;
Princeton Language and Intelligence(普林斯顿语言与智能实验室)
;
Department of Computer Science, Princeton University(普林斯顿大学计算机科学系)
;
MiroMind
The LLMbda Calculus: AI Agents, Conversations, and Information Flow
LLMlambda 计算:人工智能代理、对话与信息流
Zac Garby, Andrew D. Gordon, David Sands
机构
*
University of Nottingham, UK(诺丁汉大学)
;
University of Edinburgh, UK(爱丁堡大学)
;
Chalmers University of Technology(查尔姆斯理工大学)
;
The University of Gothenburg, Sweden(哥德堡大学)
To Use AI as Dice of Possibilities with Timing Computation
将AI用作带有时序计算的可能性骰子
Jia Li, Vipin Kumar, Rui Zhang
机构
*
Department of Surgery, University of Minnesota(明尼苏达大学外科系)
;
Department of Computer Science & Engineering, University of Minnesota(明尼苏达大学计算机科学与工程系)
Evaluating LLM-Driven Summarisation of Parliamentary Debates with Computational Argumentation
评估基于大语言模型的议会辩论总结的论证内容
Eoghan Cunningham, Derek Greene, James Cross, Antonio Rago
机构
*
School of Computer Science, University College Dublin(都柏林大学计算机科学学院)
;
School of Politics and International Relations, University College Dublin(都柏林大学政治与国际关系学院)
;
Department of Informatics, King’s College London(伦敦国王学院信息学院)