arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-21 至 2026-07-21 共收录 490 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 32 篇

2607.17005 2026-07-21 cs.AR cs.DS 新提交 67%

Provably Good Prim-Dijkstra Revisited: New Theory and a Practical Algorithm for a Classical VLSI Routing Problem with LLMs

重温可证明良好的Prim-Dijkstra算法:针对经典VLSI路由问题的新理论及基于大语言模型的实用算法

Keren Zhu

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 针对经典VLSI路由问题,通过Prim-Dijkstra算法,证明弱NP完全性,推导成本-半径权衡,构建多模式求解器HP-RCRST,在开发实例上表现出色,重新开启被忽视问题,展现大语言模型对算法研究的推动作用。

Comments 23 pages, 6 figures. Code and reproducibility materials: https://github.com/CODA-Team/hp-rcrst

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18235 2026-07-21 cs.CL cs.AI 新提交 62%

Automated Discovery Has No Universally Superior Harness

自动化发现没有普遍优越的框架

Akshat Gupta, Jermaine Lei, Alexander Lu, Gopala Anumanchipalli, Leshem Choshen

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究自主发现系统框架,通过系统分解和评估发现其存在泛化问题,无固定框架普遍优越,OpenEvolve变体表现不佳。利用早期发现进展预测性能,提出自适应分配实验,优于固定和非自适应选择,推动从固定框架选择转向在线适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18482 2026-07-21 cs.CL cs.LG stat.ML 版本更新 62%

The Truncation Blind Spot: How Decoding Strategies Systematically Exclude Human-Like Token Choices

截断盲区:解码策略如何系统性地排除人类样式的令牌选择

Esteban Garces Arias, Nurzhan Sapargali, Christian Heumann, Matthias Aßenmacher

机构 * Department of Statistics, Ludwig Maximilian University, Munich, Germany(统计系,路德维希-马克西米利安大学,慕尼黑,德国) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 研究探讨了文本生成中解码策略与人类语言生成的差异,发现基于概率的解码方法排除了人类可选但统计上稀有的令牌,导致生成文本可检测性增强。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16355 2026-07-21 cs.CV cs.AI 新提交 57%

PhysAgent: Reflective Agentic Physics Control for Physically Plausible Video Generation

PhysAgent:用于物理上合理的视频生成的反射式智能体物理控制

Qirui Li, Jinkun Hao, Yibo Li, Ran Yi, Paul L. Rosin, Yu-Kun Lai

机构 * Shanghai Jiao Tong University(上海交通大学) Cardiff University(卡迪夫大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 研究物理上合理的视频生成问题,提出PhysAgent反射式智能体框架,通过闭环设计及物理控制API,改善参数控制,实现复杂轨迹等,实验证明其能生成更合理视频,有更好提示对齐及泛化效果。

Comments For project page, see https://iapple233.github.io/PhysAgent

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16214 2026-07-21 cs.CV cs.AI 新提交 57%

What Makes Linguistic Representations Good Models of High-Level Visual Perception in the Human Brain?

是什么让语言表征成为人类大脑中高级视觉感知的良好模型?

Anna Bavaresco, Ina Klarić, Raquel Fernández, Marie-Francine Moens

机构 * European Commission, Joint Research Centre (JRC)(欧盟委员会,联合研究中心 (JRC))

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 研究语言模型图像描述对人类大脑高级视觉感知的预测性,考虑六种字幕类型和五种语言模型,发现机器生成字幕表现优,文本嵌入器优于自回归语言模型,大脑预测性和行为一致性在中间网络深度达峰值,确立字幕嵌入为研究工具。

Comments Supplementary Materials in the public GitHub repository referenced in the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17388 2026-07-21 math.FA cs.AI 新提交 57%

Mathematical Discovery in the Wild: AI-Guided Proofs in Banach Space Theory

野生环境中的数学发现:巴拿赫空间理论中的人工智能引导证明

Antonio Acuaviva, Pablo Acuaviva

机构 * School of Mathematical Sciences, Fylde College, Lancaster University, LA1 4YF, United Kingdom(数学科学学院,兰卡斯特大学) Institute of Computer Science, University of Bern, Neubrückstrasse 10, 3012 Bern, Switzerland(计算机科学研究所,伯尔尼大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 研究当前语言模型对数学研究的贡献,在巴拿赫空间理论中,AI系统生成关键思想和证明,经人类验证完善,还开发自动化系统搜索开放问题并尝试解决,展现了语言模型潜力与专家验证的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17827 2026-07-21 econ.GN q-fin.EC 新提交 50%

A Gate-and-Menu Theory of Collective Tourism Brand Value

集体旅游品牌价值的门与菜单理论

Johan Fourie

专题命中 其他LLM :language model(abstract)

AI总结 研究集体旅游品牌价值,将目的地建模为门与菜单,用奥曼 - 沙普利核算分配品牌价值,发现分散管理者对门质量维护不足,还通过语言模型测量框架结构并举例说明品牌内污染排序。

Comments 32 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17970 2026-07-21 cs.RO 新提交 50%

MEVION: Low-Cost Open-Source Data Collection System for Powerful and High-Speed Dual-Arm Manipulation

MEVION:用于强大高速双臂操作的低成本开源数据收集系统

Kento Kawaharazuka, Yoshiki Obinata, Hirokazu Ishida, Jihoon Oh, Temma Suzuki, Shintaro Inoue, Keita Yoneda, Ayumu Iwata, Kei Okada

机构 * The University of Tokyo(东京大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 在开发机器人基础模型竞争激烈的背景下,针对ALOHA产生高力和速度能力有限的问题,开发了低成本开源的MEVION双臂机器人数据收集系统,介绍其结构、性能,证明其能为特定任务收集数据及支持相关运动生成。

Comments Accepted to IEEE Robotics and Automation Practice, website: https://haraduka.github.io/mevion-hardware/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16219 2026-07-21 cs.CY 新提交 50%

MDAF: A Multi-Dimensional Annotation Framework for Automated Foreign Policy Analysis

MDAF:一种用于自动外交政策分析的多维注释框架

Songruowen Ma, Songting Ding, Fangyin Zhou, Jörg Friedrichs

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对政府网站外交政策文本未被充分利用的问题,提出MDAF框架,集成大语言模型工作流程,应用于五眼联盟国家与中国相关文本,实现文本识别、信息提取和事件分类自动化,支持跨国比较等,为外交政策分析等做贡献。

Comments 32 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13924 2026-07-21 cs.HC 版本更新 50%

ExpressionCueLens: A Cross-Cultural Analysis of Human-AI Companion Conversations on Social Media

表情线索透镜:社交媒体上人类与人工智能伴侣对话的跨文化分析

Lynnette Hui Xian Ng, Yunze Xiao, Lionel Z. Wang, Weihao Xuan, Mona Diab

专题命中 其他LLM :LLM(abstract)

AI总结 研究社交媒体上人类与人工智能伴侣对话,引入表情线索透镜框架,将语言等线索归为十类。通过分析约3500篇Reddit和小红书帖子发现,文化和平台规范影响对陪伴智能体的认知,为具文化敏感性的智能体设计提供启示。

Comments Accepted at Journal of Ambient Intelligence and Humanized Computing

详情

展开后加载摘要…

URL PDF HTML 收藏