arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-05-12 至 2026-05-12 共收录 876 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 41 篇

2605.09055 2026-05-12 cs.RO cs.AI cs.MA 57%

Octopus Protocol: One-Shot Hardware Discovery and Control for AI Agents via Infrastructure-as-Prompts

Octopus Protocol:通过基础设施即提示实现AI代理的一次性硬件发现与控制

Quilee Simeon, Justin M. Wei, Yile Fan

机构 * MIT(麻省理工学院)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 Octopus Protocol通过五阶段流程实现硬件发现与控制,利用语言模型API生成MCP协议服务器,使AI代理能自主完成硬件集成与闭环视觉-运动控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08980 2026-05-12 cs.LG math.OC stat.ML 57%

Muon Does Not Converge on Convex Lipschitz Functions

Muon 不收敛于凸 Lipschitz 函数

Tetiana Parshakova, Ahmed Khaled, Michael Crawshaw, Guillaume Garrigos, Robert M. Gower

机构 * Center for Computational Mathematics, Flatiron Institute, Simons Foundation(计算数学中心,Flatiron研究所,Simons基金会) Princeton University, Google DeepMind(普林斯顿大学,谷歌DeepMind) George Mason University(乔治·梅森大学) Université Paris Cité and Sorbonne Université, CNRS, Laboratoire de Probabilités, Statistique et Modélisation(巴黎cité大学和索邦大学,CNRS,概率、统计和建模实验室)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文指出 Muon 在凸 Lipschitz 函数上不收敛,尽管误差反馈可恢复其收敛性,但性能在图像分类和语言模型任务中下降,表明 Muon 的成功可能源于该模型未包含的结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21677 2026-05-12 cs.LG cs.SE 57%

Prophecy: Inferring Formal Properties from Neuron Activations

预言:从神经元激活推断形式属性

Divya Gopinath, Corina S. Pasareanu, Muhammad Usman

机构 * NASA Ames(NASA阿姆斯研究中心) KBR(KBR公司) CMU(卡内基梅隆大学)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 Prophecy通过分析神经网络内部层的神经元激活状态,自动推断前馈网络的形式属性,适用于不同模型和输出属性的验证与监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10672 2026-05-12 cs.HC 50%

When Should Teachers Control AI Generation for Mathematics Visuals?

教师何时应控制AI生成数学视觉内容?

Zhengxu Li, Junling Wang, April Yi Wang

专题命中 其他LLM :prompting(abstract)

AI总结 研究探讨教师在AI辅助生成中何时控制以提升数学视觉材料的正确性,发现后生成控制在可预测性和正确性上评分更高,但不同控制阶段各有优劣。

Comments Zhengxu Li and Junling Wang contributed equally to this work. Accepted at ACM Learning@Scale 2026

Journal ref Proceedings of the Thirteenth ACM Conference on Learning @ Scale (L@S 2026), Seoul, Republic of Korea, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09976 2026-05-12 cs.CV 50%

OZ-TAL: Online Zero-Shot Temporal Action Localization

OZ-TAL:在线零样本时间动作定位

Chaolei Han, Hongsong Wang, Xin Gong, Jie Gui

机构 * School of Cyber Science and Engineering, Southeast University(东南大学信息科学与工程学院) Engineering Research Center of Blockchain Application, Supervision and Management (Southeast University), Ministry of Education(教育部区块链应用、监督与管理工程研究中心(东南大学)) Purple Mountain Laboratories, Nanjing(紫金山实验室(南京)) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)

专题命中 其他LLM :language model(abstract)

AI总结 本文提出OZ-TAL任务,旨在在线检测未见过的动作,提出无需训练的框架利用VLMs并增强视觉表示,实验表明方法在离线和在线零样本设置中优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09418 2026-05-12 cs.CV cs.RO 50%

MAG-VLAQ: Multi-modal Aerial-Ground Query Aggregation for Cross-View Place Recognition

MAG-VLAQ:多模态空-地查询聚合用于跨视角地点识别

Zhengyi Xu, Yuhang Ming, Zhihao Zhan, Hanyu Zhu, Javier Civera, Wanzeng Kong

机构 * Hangzhou Dianzi University(杭州电子科技大学) TopXGun Robotics(TopXGun机器人) University of Zaragoza(萨拉戈萨大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出MAG-VLAQ框架,通过预训练基础模型提取多模态特征并融合,提升空地跨视角地点识别性能,实验表明在KITTI360-AG数据集上性能提升显著。

Comments 16 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏