arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-08-20 至 2026-08-20 共收录 3
2608.18409 2026-08-20 cs.AI 新提交

Improving Natural-Language Combinatorial-Optimization Accuracy in Resource-Constrained Language Models via Formal Abstractions

通过形式化抽象提升资源受限语言模型的自然语言组合优化准确率

Shrenil Shaun Sharma, Avi Sharma

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 针对资源受限语言模型在自然语言组合调度中可行性不足的问题,提出神经符号框架SDDL,其在300实例调度子集上大幅提升小模型的可行调度准确率,逼近大模型性能

Comments 17 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18227 2026-08-20 cs.RO 新提交

Revisiting the "Push-T" Robot Manipulation Task with Agentic Robotics

用智能体机器人技术重新审视“Push-T”机器人操作任务

Shuangyu Xie, Kaiyuan Chen, Ken Goldberg

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 该研究在智能体机器人技术背景下,借助带Fable 5的Claude Code编码智能体,无需演示数据解决Push-T等机器人操作任务,其策略成功率达100%,步骤比基准扩散策略少46%,还支持多字母操作及跨实体机械臂仿真。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19151 2026-08-20 cs.LG math.OC stat.ML 新提交

Continuous-Time Reinforcement Learning for Controlled Hawkes Jump-Diffusions

受控霍克斯跳扩散过程的连续时间强化学习

Tomasz R. Bielecki, Thibaut Mastrolia, Haoze Yan

机构 * UC Berkeley(加州大学伯克利分校)

AI总结 针对非马尔可夫环境下霍克斯驱动随机微分方程的随机控制问题,提出Hawkes-CT DDPG算法,通过马尔可夫化近似实现无模型学习,并在三类核上与离散时间强化学习方法对比。

详情

展开后加载摘要…

URL PDF HTML 收藏