arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

2026-07-15 至 2026-07-15 共收录 2
2607.13033 2026-07-15 cs.RO 新提交

DenseReward: Dense Reward Learning via Failure Synthesis for Robotic Manipulation

DenseReward:通过失败合成进行密集奖励学习以实现机器人操作

Yu Fang, Wanxi Dong, Jiaqi Liu, Yue Yang, Mingxiao Huo, Yao Mu, Huaxiu Yao, Li Erran Li, Daniel Szafir, Mingyu Ding

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学) Amazon AWS AI(亚马逊AWS人工智能)

AI总结 研究针对强化学习中缺乏可靠奖励模型的问题,提出DenseReward模型,通过自动生成失败数据合成逼真轨迹,从视觉和语言预测密集奖励分数,在模拟和现实操作中表现优异,还为下游任务提供指导并发布相关资源。

Comments Website: https://dense-reward.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11940 2026-07-15 cs.LG cs.AI 新提交

CARE-LoRA: Compressed Activation REconstruction for Memory-Efficient LoRA

CARE-LoRA:用于内存高效LoRA的压缩激活重建

Gengyu Zhang, Haiyin Ran, Zhengbao He, Yuhang Liu, Hanling Tian, Zhehao Huang, Xiaolin Huang

机构 * Institute of Image Processing and Pattern Recognition, Shanghai Jiao Tong University(上海交通大学图像处理与模式识别研究所)

AI总结 研究在有限内存下微调大型预训练模型的问题,提出CARE-LoRA框架,利用LoRA投影结构,用低秩压缩激活取代完整输入激活,并计算重建矩阵,大幅减少内存占用,性能与标准LoRA及变体相当甚至更优。

Comments 15 pages, 2 figures, 12 tables. Code available at https://github.com/fishandyu/CARE-LoRA

详情

展开后加载摘要…

URL PDF HTML 收藏