arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Edinburgh(爱丁堡大学)

2026-03-04 至 2026-03-04 共收录 4
2603.03142 2026-03-04 cs.CL cs.AI

APRES: An Agentic Paper Revision and Evaluation System

APRES:一种代理论文修订与评估系统

Bingchen Zhao, Jenny Zhang, Chenxi Whitehouse, Minqi Jiang, Michael Shvartsman, Abhishek Charnalia, Despoina Magka, Tatiana Shavrina, Derek Dunfield, Oisin Mac Aodha, Yoram Bachrach

机构 * Meta Superintelligence Labs(Meta 超智能实验室) University of Edinburgh(爱丁堡大学)

AI总结 APRES利用大型语言模型改进论文质量,通过评估标准提升引用预测,79%的专家更喜欢修订后的论文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02935 2026-03-04 cs.LG

Contextual Latent World Models for Offline Meta Reinforcement Learning

上下文潜在世界模型用于离线元强化学习

Mohammadreza Nakheai, Aidan Scannell, Kevin Luck, Joni Pajarinen

机构 * Aalto University(阿alto大学) University of Edinburgh(爱丁堡大学)

AI总结 本文提出上下文潜在世界模型,通过联合训练潜在世界模型和上下文编码器,提升任务表示的表达能力,从而增强跨任务泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02840 2026-03-04 cs.LG stat.ML

Adapting Time Series Foundation Models through Data Mixtures

通过数据混合适应时间序列基础模型

Thomas L. Lee, Edoardo M. Ponti, Amos Storkey

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院)

AI总结 MixFT通过数据混合重新划分数据,以更好地适应不同子领域,提升时间序列基础模型的零样本预测性能。

Comments Preprint, 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10917 2026-03-04 cs.LG

Near-Constant Strong Violation and Last-Iterate Convergence for Online CMDPs via Decaying Safety Margins

在线CMDP中近常数强违反与最后迭代收敛 via 递减安全边际

Qian Zuo, Zhiyong Wang, Fengxiang He

机构 * School of Informatics, University of Edinburgh, Edinburgh, United Kingdom(爱丁堡大学信息学院) School of Mathematics, University of Edinburgh, Edinburgh, United Kingdom(爱丁堡大学数学学院)

AI总结 FlexDOME算法通过递减安全边际和正则化项,在在线CMDP中实现了近常数强约束违反、次线性强遗憾和非渐近最后迭代收敛。

详情

展开后加载摘要…

URL PDF HTML 收藏