arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-04-20 至 2026-04-20 共收录 7
2508.06094 2026-04-20 cs.CL

ConlangCrafter: Constructing Languages with a Multi-Hop LLM Pipeline

ConlangCrafter:基于多跳LLM流水线的语言构建

Morris Alper, Moran Yanuka, Raja Giryes, Gašper Beguš

机构 * Tel Aviv University(特拉维夫大学) Carnegie Mellon University(卡内基梅隆大学) UC Berkeley(伯克利大学)

AI总结 本文提出ConlangCrafter,通过多阶段流水线实现语言构建,利用LLM的元语言能力生成一致且多样化的构想语言。

Comments Accepted to ACL 2026. Project page: https://conlangcrafter.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15709 2026-04-20 cs.AI

Bilevel Optimization of Agent Skills via Monte Carlo Tree Search

通过蒙特卡洛树搜索优化代理技能

Chenyi Huang, Haoting Zhang, Jingxu Xu, Zeyu Zheng, Yunduan Lin

机构 * Department of Mathematics(数学系) National University of Singapore(国立新加坡大学) Department of Industrial Engineering and Operations Research(工业工程与运营管理系) University of California at Berkeley(加州大学伯克利分校) Department of Decision, Operation and Technology(决策、运营与技术系) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出通过蒙特卡洛树搜索优化代理技能的双层优化框架,提升任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15475 2026-04-20 cs.RO cs.MA

NeuroMesh: A Unified Neural Inference Framework for Decentralized Multi-Robot Collaboration

NeuroMesh:一种用于去中心化多机器人协作的统一神经推理框架

Yang Zhou, Yash Shetye, Long Quang, Devon Super, Jesse Milzman, Manohari Goarin, Aditya Azad, Devang Sunil Dhake, Jeffery Mao, Carlos Nieto-Granda, Giuseppe Loianno

机构 * New York University(纽约大学) U.S. Army Combat Capabilities Development Command, Army Research Laboratory(美国陆军作战能力发展司令部,陆军研究实验室) Vanderbilt University(范德比尔特大学) University of California Berkeley, Department of Electrical Engineering and Computer Sciences(加州大学伯克利分校,电气工程与计算机科学系)

AI总结 本文提出NeuroMesh框架,通过统一的管道标准化观察编码、消息传递、聚合和任务解码,解决异构机器人部署多机器人模型的挑战,支持混合GPU/CPU推理并在不同任务结构中展示鲁棒性。

Comments 8 page, 8 figures, Accepted at the IEEE Robotics Automation Letter (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11251 2026-04-20 cs.RO

CLAW: Composable Language-Annotated Whole-body Motion Generation

CLAW:可组合的语言标注全身运动生成

Jianuo Cao, Yuxin Chen, Masayoshi Tomizuka

机构 * Nanjing University(南京大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 CLAW通过结合运动规划和模板引擎,为Unitree G1人形机器人生成可扩展的语言标注全身运动数据,提供实时键盘模式和时间轴序列编辑器,实现物理可行的运动轨迹生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07774 2026-04-20 cs.CL

Curing Miracle Steps in LLM Mathematical Reasoning with Rubric Rewards

用评分奖励模型治愈大语言模型数学推理中的奇迹步骤

Youliang Yuan, Qiuyang Mang, Jingbang Chen, Hong Wan, Xiaoyuan Liu, Junjielong Xu, Jen-tse Huang, Wenxuan Wang, Wenxiang Jiao, Pinjia He

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen, China(数据科学学院,香港中文大学(深圳)) UC Berkeley(加州大学伯克利分校) Zhejiang University(浙江大学) Johns Hopkins University(约翰霍普金斯大学) Renmin University of China(中国人民大学) Xiaohongshu Inc.(小红书公司)

AI总结 本文通过评分奖励模型解决大语言模型数学推理中的奇迹步骤问题,通过系统分析和人类验证建立失败模式分类,提升推理准确性和可靠性。

Comments Accepted by ACL 2026 Main, 22 pages, 10 figures, 7 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07043 2026-04-20 cs.LG

COMPASS: Benchmarking Constrained Optimization in LLM Agents

COMPASS:评估LLM代理在约束优化中的表现

Tian Qin, Felix Bai, Ting-Yao Hu, Raviteja Vemulapalli, Hema Swetha Koppula, Zhiyang Xu, Bowen Jin, Mert Cemri, Jiarui Lu, Zirui Wang, Meng Cao

机构 * Harvard University(哈佛大学) Apple(苹果公司) Virginia Tech(弗吉尼亚理工学院) UIUC(伊利诺伊大学香槟分校) UC Berkeley(加州大学伯克利分校)

AI总结 COMPASS基准测试评估LLM代理在真实旅行规划中的约束优化能力,揭示当前模型在可行性与最优性之间存在显著差距,表明搜索空间探索不足是核心限制,编码代理提供潜在解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09355 2026-04-20 cs.GT cs.AI cs.LG

Prices, Bids, Values: One ML-Powered Combinatorial Auction to Rule Them All

价格、出价、价值:一种由机器学习驱动的综合拍卖以统御它们所有

Ermis Soumalias, Jakob Heiss, Jakob Weissteiner, Sven Seuken

机构 * Department of Informatics, University of Zurich, Zurich, Switzerland(苏黎世大学信息学院) ETH AI Center, Zurich, Switzerland(苏黎世联邦理工学院AI中心) Department of Mathematics, ETH Zurich, Zurich, Switzerland(苏黎世联邦理工学院数学系) Department of Statistics, University of California, Berkeley, USA(加州大学伯克利分校统计系)

AI总结 本文提出一种基于机器学习的综合拍卖,通过结合价值和需求查询提升效率,减少查询次数并降低投标人认知负担,建立新的实践和效率基准。

Comments ICML 2025 (Oral Presentation) 8 pages + appendix

Journal ref Proceedings of the 42nd International Conference on Machine Learning, PMLR 267:56570-56614, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏