arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-25 至 2026-03-25 共收录 246 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 14 篇

2505.20881 2026-03-25 cs.LG cs.AI 73%

Generalizable Heuristic Generation Through LLMs with Meta-Optimization

通过元优化实现通用启发式生成

Yiding Shi, Jianan Zhou, Wen Song, Jieyi Bi, Yaoxin Wu, Zhiguang Cao, Jie Zhang

机构 * Nanyang Technological University(南洋理工大学) Shandong University(山东大学) Singapore Management University(新加坡国立大学) Eindhoven University of Technology(埃因霍温理工大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出MoH框架,利用LLM进行元学习,自主构建多样化的启发式优化器,提升跨任务的泛化能力。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22892 2026-03-25 cs.LG 70%

VLGOR: Visual-Language Knowledge Guided Offline Reinforcement Learning for Generalizable Agents

VLGOR:基于视觉-语言知识的离线强化学习用于通用智能体

Pengsen Liu, Maosen Zeng, Nan Tang, Kaiyuan Li, Jing-Cheng Pang, Yunan Liu, Yang Yu

机构 * National Key Laboratory for Novel Software Technology, Nanjing University, China \& School of Artificial Intelligence, Nanjing University, China Computational Intelligence Center (CIC), School of Computer Artificial Intelligence, Shandong Jianzhu University, Jinan, 250101, China

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出VLGOR框架,结合视觉和语言知识生成虚拟轨迹,提升智能体在未见任务中的泛化能力,实验显示其性能比基线方法高24%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23265 2026-03-25 cs.CL cs.CV 57%

PaperBanana: Automating Academic Illustration for AI Scientists

PaperBanana:为AI科学家自动化学术插图

Dawei Zhu, Rui Meng, Yale Song, Xiyu Wei, Sujian Li, Tomas Pfister, Jinsung Yoon

机构 * Peking University(北京大学) Google Cloud AI Research(谷歌云AI研究)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 PaperBanana通过整合先进视觉语言模型和图像生成模型,自动化生成出版级学术插图,提升了科研流程中插图制作的效率与质量。

Comments Add Citations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23190 2026-03-25 cs.CV 50%

Gaze-Regularized VLMs for Ego-Centric Behavior Understanding

基于目光调节的视觉语言模型用于以自身为中心的行为理解

Anupam Pani, Yanchao Yang

机构 * HKU Musketeers Foundation Institute of Data Science, The University of Hong Kong(香港大学穆凯特基金会数据科学研究所,香港大学)

专题命中 其他LLM :language model(abstract)

AI总结 本文提出一种基于目光调节的视觉语言模型框架,通过整合目光信息提升以自身为中心的行为理解能力,实验结果显示在语义得分上提升了近13%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22450 2026-03-25 cs.CV cs.GR 50%

Static Scene Reconstruction from Dynamic Egocentric Videos

从动态第一人称视频中进行静态场景重建

Qifei Cui, Patrick Chen

机构 * Department of Computer and Information Science(计算机与信息科学系)

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出了一种适应长时动态第一人称视频的鲁棒静态重建方法,通过抑制动态前景和分块重建策略提升全局一致性,有效减少轨迹漂移,实验表明在HD-EPIC和室内无人机数据集上显著提高了绝对轨迹误差和静态几何的视觉质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22405 2026-03-25 astro-ph.GA astro-ph.CO 50%

Reinterpreting the puzzling properties of z>6 galaxies within a variable IMF framework

在变量初始质量函数框架内重新解释z>6星系的神秘性质

Fabio Fontanot, Gabriella De Lucia, Lizhi Xie, Stefano Zibetti, Francesco La Barbera, Sebastiano Cantarella, Michaela Hirschmann, Stephane Charlot, Gustavo Bruzual

专题命中 其他LLM :prompting(abstract)

AI总结 本文通过变量IMF框架解释z>6星系的异常性质,展示该模型能再现其紫外光度函数和恒星质量函数的演化,强调变量IMF对恒星质量估计误差预算的重要性。

Comments 10 Pages, 7 Figures, 1 Appendix, Submitted to A&A

详情

展开后加载摘要…

URL PDF HTML 收藏