arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 745 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 745 篇

2607.20713 2026-07-24 cs.CR cs.SE 新提交 50%

Security Vulnerability Patterns in AI-Generated Code: A Cross-Model Comparative Study

人工智能生成代码中的安全漏洞模式:跨模型比较研究

Shanna M. Kahn, John D. Hastings

专题命中 其他LLM :LLM(abstract)

AI总结 研究基于大语言模型的编码工具生成的自动化脚本安全风险,通过跨模型收集代码并审查漏洞,发现风险与任务类别有关,各模型漏洞情况相似,组织应思考是否不经审查就部署此类自动化代码。

Comments 9 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19513 2026-07-23 math.RA math.RT 新提交 50%

Constructing a complex Lie algebra isomorphic to its complex conjugate but not definable over reals

构建一个同构于其复共轭但不能在实数域上定义的复李代数

Mikhail Borovoi, Willem A. de Graaf, Robert M. Guralnick

专题命中 其他LLM :LLM(abstract)

AI总结 该研究利用特定想法及计算,构建出一个10维复两步幂零李代数,它同构于自身复共轭却无法在实数域定义。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17827 2026-07-21 econ.GN q-fin.EC 新提交 50%

A Gate-and-Menu Theory of Collective Tourism Brand Value

集体旅游品牌价值的门与菜单理论

Johan Fourie

专题命中 其他LLM :language model(abstract)

AI总结 研究集体旅游品牌价值,将目的地建模为门与菜单,用奥曼 - 沙普利核算分配品牌价值,发现分散管理者对门质量维护不足,还通过语言模型测量框架结构并举例说明品牌内污染排序。

Comments 32 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17970 2026-07-21 cs.RO 新提交 50%

MEVION: Low-Cost Open-Source Data Collection System for Powerful and High-Speed Dual-Arm Manipulation

MEVION:用于强大高速双臂操作的低成本开源数据收集系统

Kento Kawaharazuka, Yoshiki Obinata, Hirokazu Ishida, Jihoon Oh, Temma Suzuki, Shintaro Inoue, Keita Yoneda, Ayumu Iwata, Kei Okada

机构 * The University of Tokyo(东京大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 在开发机器人基础模型竞争激烈的背景下,针对ALOHA产生高力和速度能力有限的问题,开发了低成本开源的MEVION双臂机器人数据收集系统,介绍其结构、性能,证明其能为特定任务收集数据及支持相关运动生成。

Comments Accepted to IEEE Robotics and Automation Practice, website: https://haraduka.github.io/mevion-hardware/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16219 2026-07-21 cs.CY 新提交 50%

MDAF: A Multi-Dimensional Annotation Framework for Automated Foreign Policy Analysis

MDAF:一种用于自动外交政策分析的多维注释框架

Songruowen Ma, Songting Ding, Fangyin Zhou, Jörg Friedrichs

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对政府网站外交政策文本未被充分利用的问题,提出MDAF框架,集成大语言模型工作流程,应用于五眼联盟国家与中国相关文本,实现文本识别、信息提取和事件分类自动化,支持跨国比较等,为外交政策分析等做贡献。

Comments 32 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15714 2026-07-20 cs.RO 新提交 50%

AC-VLA: Robust Out-of-Distribution Action Execution via Compositional Learning

AC-VLA:通过组合学习实现稳健的分布外动作执行

Xiaojiang Peng, Kai Peng, Jie Lu, Zheng Lian, Zitong YU, Xiaobo Wang

机构 * Shenzhen Technology University(深圳技术大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Tongji University(同济大学) Great Bay University(大湾区大学)

专题命中 其他LLM :LLM(abstract)

AI总结 研究VLA模型在分布外泛化的问题,提出AC-VLA框架,含组合学习模块和状态条件不对称掩码策略,无需修改架构可集成到VLA主干,在LIBERO和LIBERO-OOD基准测试中,该框架在组合OOD任务上有显著改进,分布内性能良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14588 2026-07-17 cs.HC 新提交 50%

Conversational Tactile Data Interfaces: Co-Designing Accessible Data Experiences with Blind Users Using Refreshable Tactile Displays and Conversational AI

对话式触觉数据接口:使用可刷新触觉显示器和对话式人工智能与盲人用户共同设计无障碍数据体验

Samuel Reinders, Munazza Zaib, Bongshin Lee, Ingrid Zukerman, Matthew Butler, Thien Autran, Sascha Cowley, Francois Jacobs, Lizhen Qu, Kim Marriott

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对盲人或视力低下者数据可视化问题,通过与盲人共同设计师协同设计,创建结合可刷新触觉显示器与对话代理的CTDI(Graphy系统),贡献设计知识与建议,得出分层展示等关键发现。

Comments Accepted to be presented at IEEE VIS 2026 and published in IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14357 2026-07-17 cs.GT cs.MA econ.TH 新提交 50%

When Is Delegated Play Truthful? Within-Range Regret and the Trilemma of Aligned Delegation

委托策略何时是真实的?范围内遗憾与对齐委托的三难困境

Taksch Dube

专题命中 其他LLM :language model(abstract)

AI总结 研究广告商和用户委托代理的最优诚实描述问题,核心方法是基于代理的范围内遗憾,主要贡献是统一特定拍卖自动出价结果、确定语言模型诱导代理假设成立条件,揭示护栏三难困境及生产模型诚实报告存在未认领剩余等情况。

Comments 31 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13930 2026-07-16 nucl-th astro-ph.HE physics.comp-ph 新提交 50%

NNStar: An end-to-end AI agent for nuclear matter and neutron star physics

NNStar:用于核物质和中子星物理的端到端人工智能代理

Yao Ma, Yong-Liang Ma, Jia-Ying Xiong

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对核物质和中子星物理中约束致密物质状态方程需处理大量数据及高维耦合空间微调难的问题,提出NNStar这一端到端人工智能代理,可自动化工作流程,为相关观测分析提供新的AI驱动框架。

Comments 14 pages; comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12647 2026-07-15 eess.AS 新提交 50%

Investigating the Integration of Spatial Information in Foundation-Model-Based Speaker Diarization

研究基于基础模型的说话人聚类中空间信息的整合

Marc Deegen, Adrian Meise, Reinhold Haeb-Umbach

专题命中 其他LLM :foundation model(abstract)

AI总结 研究基于基础模型的说话人聚类中空间信息整合,比较波束形成器与基础模型级联、多通道基础模型、基于提取空间特征对下游网络条件设定三种方法,发现条件设定法性能最佳且能消除相关错误,是有竞争力的方法。

Comments Accepted at IWAENC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11111 2026-07-14 cs.SE 新提交 50%

Know Before Fix: QA-Driven Repository Knowledge Acquisition for Software Issue Resolution

修复前先了解:用于软件问题解决的基于问答的仓库知识获取

Haotian Lin, Silin Chen, Xiaodong Gu, Yuling Shi, Chengxi Pan, Jiaqi Ge, Mengfan Li, Jianghong Huang, Mengchieh Chuang, Beijun Shen, Haibing Guan

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对基于大语言模型的编码代理解决软件问题易因仓库理解不足出错的问题,提出ACQUIRE框架,通过问答驱动在修复前获取仓库知识,经两阶段解耦知识获取与补丁生成,实验证明该框架能提升问题解决准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10736 2026-07-14 cs.CY 新提交 50%

Robo-Reporters: Evaluating Autonomous AI Agents as Algorithmic Gatekeepers in Computational Journalism

机器人记者:评估作为计算新闻学中算法把关人的自主人工智能代理

Obada Kraishan, Kulsawasd Jitkajornwanich, Kerk Kee

专题命中 其他LLM :language model(abstract)

AI总结 研究对比四种人工智能代理架构在新闻任务中的表现,通过200个对照实验,发现架构对任务时长和计算策略有显著影响,多智能体协作准确率最高,整体式架构有特定信息源拒绝率,还揭示了透明度方面差异,为新闻编辑室提供架构选择指导。

Comments 12 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10684 2026-07-14 cs.CV 新提交 50%

HyperBank: A Differentiable Bank of Classical Priors for Few-Shot Spheroid Microscopy Segmentation

HyperBank:用于少样本球体显微镜分割的可微经典先验库

M. Průšek, A. Novozámský, F. Šroubek, T. Volfová, V. Svobodová Pavlíčková, S. Rimpelová

机构 * The Czech Academy of Sciences, Institute of Information Theory and Automation(捷克科学院,信息理论与自动化研究所) Czech Technical University in Prague, Faculty of Nuclear Sciences and Physical Engineering(布拉格捷克技术大学,核科学与物理工程学院) University of Chemistry and Technology Prague, Department of Biochemistry and Microbiology(布拉格化学与技术大学,生物化学与微生物学系) Charles University, Faculty of Science, BIOCEV(查理大学,科学学院,BIOCEV)

专题命中 其他LLM :foundation model(abstract)

AI总结 研究少样本球体分割问题,提出可微经典图像处理算子库HyperBank,通过在支持图像上拟合并在验证图像上评估,发现其在小簇、对比度驱动数据上有竞争力,且能揭示少样本信号分布及受支持集形态学影响。

Comments Accepted for publication in the IEEE Xplore ICIP 2026 Workshop Proceedings, Computational Optical Microscopy Satellite Workshop of the 2026 IEEE International Conference on Image Processing (ICIP), Tampere, Finland

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09900 2026-07-14 cs.SE 新提交 50%

AfterVibe: What Remains When the Conversation Ends

AfterVibe:对话结束后留下了什么

Matteo Paltenghi, Satish Chandra

专题命中 其他LLM :LLM(abstract)

AI总结 AfterVibe框架从vibe编码会话恢复自然语言规范,用语言模型提取规范并经再生测试验证,在72个项目上评估发现其恢复的规范抽象且强,优于人工描述,可迭代加强,意味着规范或成人工审查主要工件和记录来源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08912 2026-07-13 cs.HC 新提交 50%

MemeBuddy: Dialog-Style Audio Representations for Engaging Non-Visual Meme Experiences

MemeBuddy:用于引人入胜的非视觉表情包体验的对话式音频表示

Chirag Bhansali, Vikas Ashok, Hae-Na Lee

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对盲人用户无法充分理解表情包的问题,提出MemeBuddy系统,将表情包建模为对话,结合文本与多模态大语言模型隐含知识生成音频表示。用户研究表明,该方式能提升盲人用户参与度与满意度,且理解能力相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07593 2026-07-09 cs.SE 新提交 50%

What Makes a Good Bug Report for an AI Agent?

什么是适合人工智能代理的优质错误报告?

Lara Khatib, Noble Saji Mathews, Meiyappan Nagappan, Pengyu Nie, Thomas Zimmermann

专题命中 其他LLM :LLM(abstract)

AI总结 研究自动化程序修复代理的优质错误报告,通过统计建模和受控消融分析发现,代理受益于具体可执行且定位好的信息,与人类优质报告有别,如自然语言重现步骤等对代理作用不大,不同模型处理缺失信息方式有差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07013 2026-07-09 cs.GT 新提交 50%

What Semivalues Cannot See: The Information Content of Anonymous Marginal Values

半值无法看到的内容:匿名边际值的信息含量

Matthew Fried

专题命中 其他LLM :prompting(abstract)

AI总结 研究半值族核心结构,通过哈萨尼股息坐标揭示其为协同效应封闭回路,证明了混合差异审计等相关性质,给出不同博弈情况及扰动阈值,n = 5普查展示规则特点,比较经典与随机博弈可见度。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05774 2026-07-08 stat.ME 新提交 50%

AI-Augmented Statistical Network Estimation with Proxy Gene Embeddings

基于代理基因嵌入的人工智能增强统计网络估计

Yan Chen, Weijing Tang, Jin-Hong Du

专题命中 其他LLM :foundation model(abstract)

AI总结 研究利用现代生物医学基础模型提供的代理基因嵌入改善部分观察目标网络的潜在结构恢复,提出PLANE模型,结合两种信息源,经分析得出网络嵌入权重的最优选择,模拟等验证其能提升潜在恢复等效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05883 2026-07-08 cs.RO 新提交 50%

DexTele: A Dual-Arm Dexterous Teleoperation System Based on Motion Retargeting and Adaptive Force Control

DexTele:一种基于运动重定向和自适应力控制的双臂灵巧遥操作系统

Yuanchuan Lai, Qing Gao, Ziyan Liang, Xianfeng Cheng, Junjie Hu, Zhaojie Ju

机构 * School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳)) School of Computing, University of Portsmouth(计算学院,朴茨茅斯大学)

专题命中 其他LLM :language model(abstract)

AI总结 研究针对双臂灵巧遥操作中运动重定向和抓取的挑战,提出DexTele系统,通过视觉运动重定向模块和自适应抓取模块,结合运动图编码器、视觉语言模型等技术,实现多平台精确运动重定向与柔顺抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05253 2026-07-08 cs.CV 新提交 50%

Repurposing CLIP to Localize at Pixel Level

复用CLIP实现像素级定位

Jiaxiang Fang, Shiqiang Ma, Jing Wang, Siyu Chen, Fei Guo, Shengfeng He

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Advanced Technology Center Beijing AI Laboratory(北京人工智能先进技术中心) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院)

专题命中 其他LLM :language model(abstract)

AI总结 针对CLIP全局特征偏差导致难以适配像素级预测的问题,提出CLIPix框架,结合抗噪校正与定位嵌入策略,保留CLIP泛化性,在PASCAL、COCO上取得最优像素级定位性能。

Comments Accepted by IEEE TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05034 2026-07-07 cs.CY 新提交 50%

Understanding Student Perceptions, Mistakes, and Debugging Approaches when Solving Natural Language Programming Tasks

理解学生在解决自然语言编程任务时的认知、错误及调试方法

Victor-Alexandru Pădurean, Kaitlin Riegel, Gweneth Barbre, Musa Blake, Paul Denny, Alkis Gotovos, Juho Leinonen, Stephen MacNeil, James Prather, Adish Singla

专题命中 其他LLM :prompting(abstract)

AI总结 研究新手程序员解决自然语言编程任务时的提示错误、沟通问题及调试策略。通过分析超900名学生尝试解决基于对话的提示问题,发现提示更易且有趣,常见错误是遗漏关键细节,失败时注重澄清意图。

Comments ICER'26 paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04761 2026-07-07 cs.CV 新提交 50%

DeGenseGS: Geometrically and Semantically Decoupled Surgical Scene Understanding in 4D Gaussian Splatting

DeGenseGS:4D高斯点云渲染中几何与语义解耦的手术场景理解

Yimo Wang, Bin Kang, Shuojue Yang, Yueming Jin

机构 * School of Automation, Southeast University(东南大学自动化学院) School of Internet of Things, Nanjing University of Posts and Telecommunications(南京邮电大学物联网学院) Department of Biomedical Engineering, National University of Singapore(新加坡国立大学生物医学工程系)

专题命中 其他LLM :language model(abstract)

AI总结 研究针对自主手术交互中语义与解剖错位问题,提出DeGenseGS框架,独立建模语义演变与几何变形,用时空纠缠模块同步语义与场景动态,还设计机制确保鲁棒性,提升了手术场景理解性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04559 2026-07-07 cs.CV 新提交 50%

QSVideo: Query-Conditioned Semantic Temporal Retrieval for Video Understanding

QSVideo:用于视频理解的查询条件语义时间检索

Wei Ao, Lan Wang, Vishnu Naresh Boddeti

机构 * Michigan State University(密歇根州立大学)

专题命中 其他LLM :language model(abstract)

AI总结 针对视频理解中视觉语言模型性能随视频时长下降问题,提出QSVideo框架,通过查询条件语义排序器、联合优化相关性和多样性及时间对齐策略,提升视频VLM性能。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04382 2026-07-07 cs.GT 新提交 50%

Beyond Self-Resolution: Settlement Factorization for Robust Natural Language Mechanism

超越自我解析:用于稳健自然语言机制的结算分解

Nicolas Della Penna

专题命中 其他LLM :language model(abstract)

AI总结 研究语言模型中介付费建议时的结算分解问题,核心方法是将报告硬化为官方记录等,主要贡献是得出类似揭示原理的结果,确定自身报告泄漏量是机制固有不变量等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03419 2026-07-07 cs.CY cs.SE 新提交 50%

Analyzing the Difficulty of Programming Assignments with Interpretable Knowledge Component Metrics

用可解释的知识组件指标分析编程作业的难度

Tsvetomila Mihaylova, Jing Fan, Bita Akram, Narges Norouzi, Peter Brusilovsky, Juho Leinonen, Arto Hellas

专题命中 其他LLM :LLM(abstract)

AI总结 研究如何用知识组件(KC)理解编程入门课程作业难度与学生学习困境,分析基于KC的指标,如作业KC数量及连续作业间KC覆盖变化,揭示相关规律并提出分析框架。

Comments Accepted to IEEE FIE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02949 2026-07-07 cs.SE 新提交 50%

BeSpec: Behavior-Level Specification Alignment for Code Generation

BeSpec:用于代码生成的行为级规范对齐

Qinghua Xu, Guancheng Wang, Boxi Yu, Lionel Briand

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对代码生成中规范不匹配问题,提出基于行为模型的BeSpec方法,通过构建行为模型、生成候选程序并对比行为来对齐规范,在多基准测试中效果优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01339 2026-07-03 hep-ph astro-ph.HE hep-ex hep-th 新提交 50%

Electron stability constrains neutrino time delays

电子稳定性限制中微子时间延迟

Mauricio Bustamante, José Manuel Carmona, José Luis Cortés, Ardit Gkioni, Maykoll A. Reyes

专题命中 其他LLM :prompting(abstract)

AI总结 通过分析电子稳定性,约束洛伦兹不变性破缺(LIV)对中微子时间延迟的解释,排除亚光速LIV解释高能宇宙中微子延迟的可能性。

Comments 6 pages, 2 figures, plus appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31363 2026-07-03 cs.CV 新提交 50%

Language-Assisted Super-Resolution from Real-World Low-Resolution Patches

语言辅助的真实世界低分辨率图像超分辨率

Joonkyu Park, Kyoung Mu Lee

机构 * IPAI, Seoul National University(首尔大学IPAI)

专题命中 其他LLM :language model(abstract)

AI总结 提出LA-SR框架,利用视觉语言模型在语言空间中对齐LR和HR图像,通过语言内容损失和语言质量损失实现无配对真实LR图像的超分辨率。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00804 2026-07-02 cs.CV 新提交 50%

Spotted: Location-informed Reidentification of Hyenas and Leopards in Camera Trap Surveys

Spotted: 基于位置信息的相机陷阱调查中鬣狗和豹子的重新识别

Halil Sina Kelebek, Julia Hindel, Kobus Hoffman, Lauren Hoffman, Andrew Loveridge, Bob Mandinyenya, Kudakwashe Ncube, Justin Seymour-Smith, Andrea Sibanda, Abhinav Valada, Matthew Wijers, Daniele De Martini

机构 * Oxford Robotics Institute, University of Oxford(牛津大学牛津机器人研究所) Department of Computer Science, University of Freiburg(弗莱堡大学计算机科学系) Bubye Valley Conservancy(布比耶谷保护区) Wildlife Conservation Research Unit, Department of Biology, University of Oxford(牛津大学生物系野生动物保护研究组) Gonarezhou National Park(戈纳雷若国家公园) Oxford e-Research Centre, University of Oxford(牛津大学牛津电子研究中心)

专题命中 其他LLM :foundation model(abstract)

AI总结 提出Spotted框架,结合视觉相似性与时空可行性先验,减少专家审核量,在三个数据集上Top-5准确率提升最高9pp,查询比较量减少69pp。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00635 2026-07-02 cs.SE 新提交 50%

Checked Program Recovery from Execution Video: A Sound Oracle for Untrusted Generators

从执行视频中检查程序恢复:针对不可信生成器的可靠预言机

Yuan Si, Jialu Zhang

专题命中 其他LLM :language model(abstract)

AI总结 提出一种双层验证预言机,通过静态检查证明镜头等价性并颁发证书,确保从不正确程序中拒绝,从而可靠恢复Scratch程序。

详情

展开后加载摘要…

URL PDF HTML 收藏