Budget-Aware Tool Use Enables Effective Agent Scaling
预算感知的工具使用实现有效的代理扩展
Tengxiao Liu, Zifeng Wang, Jin Miao, I-Hung Hsu, Jun Yan, Jiefeng Chen, Rujun Han, Fangyuan Xu, Yanfei Chen, Ke Jiang, Samira Daruki, Yi Liang, William Yang Wang, Tomas Pfister, Chen-Yu Lee
机构
*
Google Cloud AI Research(谷歌云人工智能研究)
;
Google DeepMind(谷歌DeepMind)
;
New York University(纽约大学)
;
UC Santa Barbara(加州大学圣塔芭芭拉分校)
ROC-n-reroll: How verifier imperfection affects test-time scaling
ROC-n-reroll:验证器缺陷对测试时缩放的影响
Florian E. Dorner, Yatong Chen, André F. Cruz, Fanny Yang
机构
*
ETH Zürich(苏黎世联邦理工学院)
;
Max Planck ETH Center for Learning Systems(马克斯·普朗克ETH学习系统中心)
;
Max Planck Institute for Intelligent Systems, Tübingen(图宾根马克斯·普朗克智能系统研究所)
;
Tübingen AI Center(图宾根人工智能中心)
GridVAD: Open-Set Video Anomaly Detection via Spatial Reasoning over Stratified Frame Grids
GridVAD: 通过分层帧网格上的空间推理实现开放集视频异常检测
Mohamed Eltahir, Ahmed O. Ibrahim, Obada Siralkhatim, Tabarak Abdallah, Sondos Mohamed
机构
*
King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学)
;
Independent Researcher(独立研究员)
;
National Center for Research (NCR)(国家研究中心)
Language-Guided Generation for Personalized Inspection Planning
语言引导的个性化巡检规划生成
Xingpeng Sun, Zherong Pan, Xifeng Gao, Kui Wu, Aniket Bera
机构
*
Faculty of Electrical Engineering, Mathematics and Computer Science, University of Twente(代尔夫特理工大学电子工程、数学和计算机科学学院)
;
Department of Electrical Engineering, Wright State University(电气工程系,怀特州立大学)
PerFACT: Motion Policy with LLM-Powered Dataset Synthesis and Fusion Action-Chunking Transformers
PerFACT: 基于LLM驱动的数据集合成与融合动作分块变换器的运动策略
Davood Soleymanzadeh, Xiao Liang, Minghui Zheng
机构
*
J. Mike Walker ’66 Department of Mechanical Engineering, Texas A&M University(J. Mike Walker ’66机械工程系,德克萨斯A&M大学)
;
Zachry Department of Civil and Environmental Engineering, Texas A&M University(Zachry土木与环境工程系,德克萨斯A&M大学)
专题命中
评测与基准
:LLM(title,title_cn);large language model(abstract);language model(abstract)
LLM Safety Alignment in Low-Resource Languages: A Systematic Literature Review
低资源语言下的大语言模型安全对齐:系统文献综述
Valdini Douglace Lemofouet, Blessing Ngozi Uzor, Paula Chikaodinaka Anyanwu, Danielle Blanche Kapsa, Sukairaj Hafiz Imam, P Sam Sahil, Abigail Oppong, Tassallah Abdullahi, Clemencia Siro, Idris Abdulmumin, Seid Muhie Yimam, Shamsuddeen Hassan Muhammad
机构
*
African Institute for Mathematical Sciences (AIMS)(非洲数学科学研究所)
;
Bayero University Kano(卡诺贝罗大学)
;
Brown University(布朗大学)
;
Centrum Wiskunde & Informatica(数学与计算机科学中心)
;
University of Pretoria(比勒陀利亚大学)
;
University of Hamburg(汉堡大学)
;
Imperial College London(伦敦帝国学院)
专题命中
评测与基准
:LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
机构
*
University of Ottawa(渥太华大学)
;
École de technologie supérieure(超技术学院)
;
Research Ireland Lero Centre for Software Research(爱尔兰Lero软件研究中心)
;
University of Limerick(利默里克大学)
;
General Motors(通用汽车公司)
专题命中
评测与基准
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI
Characterizing Rhetorical Misalignment in Decision-Making with Language Models
表征语言模型决策中的修辞失配问题
Zirui Cheng, Joey Chan, Simo Du, Chenhao Tan, Yue Guo, Hao Peng
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
NYC Health + Hospitals/Jacobi Medical Center(纽约市健康与医院公司雅各比医学中心)
;
University of Chicago(芝加哥大学)
专题命中
评测与基准
:LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI