arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2606.19630 2026-06-19 cs.AI cs.DL cs.SY eess.SY 新提交 70%

AI4SE and SE4AI Exploration: A Decade Looking Back and Forward

AI4SE 与 SE4AI 探索:回顾与展望的十年

H. Sinan Bank, Daniel R. Herber, Thomas Bradley

机构 * Colorado State University(科罗拉多州立大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文回顾了人工智能与系统工程在三个阶段的进展,通过人机一致性文献综述识别出五个关键研究空白,并提供了AI采纳、保障和劳动力转型的指导。

Comments 10 pages, 5 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15531 2026-06-17 cs.LG cs.CR 新提交 70%

Greedy Coordinate Diffusion: Effective and Semantically Coherent Adversarial Attacks via Diffusion Guidance

贪婪坐标扩散:通过扩散引导实现有效且语义一致的对抗攻击

Bohdan Turbal, Blossom Metevier, Max Springer, Aleksandra Korolova

机构 * University of Maryland(马里兰大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出贪婪坐标扩散方法,利用扩散模型引导生成语义连贯的对抗样本,在保持自然性的同时实现高攻击成功率。

Journal ref ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13991 2026-06-15 cs.CL 新提交 70%

Fusing Stylometric and Embedding Systems to Estimate Authorship Likelihood Ratios in Japanese

融合文体特征与嵌入系统以估计日语作者身份似然比

Praju Ghatpande, Satoru Tsuge, Shunichi Ishihara, Wataru Zaitsu, Mitsuyuki Inaba

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 首次将似然比框架应用于日语数字文本,通过融合文体特征系统与基于嵌入的系统,提高了似然比量值和判别能力,最佳融合的log-likelihood-ratio成本为0.32484。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14560 2026-06-15 math.OC cs.LG stat.ML 新提交 70%

Free Heavy-Tailed Lunch for Muon: A Theoretical Justification of Empirical Success

Muon 的免费重尾午餐:实证成功的理论证明

Florian Hübler, Thomas Pethick, Suvrit Sra

机构 * Department of Computer Science, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机科学系) Department of Mathematics, Technical University of Munich, Germany(慕尼黑技术大学数学系) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文在重尾非凸优化中证明,Muon 等非欧几里得方法在核范数平稳性下达到最优样本复杂度,避免了欧几里得方法的维度依赖,并通过大语言模型实验验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13256 2026-06-12 cs.RO cs.AI 新提交 70%

Humor Style Drives Laughter, Topic Shapes Acceptability: Evaluating Bilingual Personal and Political Robot-Delivered AI Jokes

幽默风格驱动笑声,话题塑造可接受性:评估双语个人与政治机器人交付的AI笑话

Anna-Maria Velentza, Anne-Gwenn Bosser

机构 * Univ Brest-Bretagne INP, COMMEDIA team, Lab-STICC CNRS UMR 6285(布列塔尼大学-INP,COMMEDIA团队,Lab-STICC CNRS UMR 6285)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究通过混合因素设计,评估机器人用双语讲AI生成笑话时,幽默类型(亲和、自我增强、攻击、自贬)和内容(个人vs政治)对趣味性和适当性的影响,发现幽默类型显著影响趣味性,内容影响适当性,语言偏好受内容及参与者流利度影响。

Comments Accepted in the 35th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN 2026), Kitakyushu, Fukuoka, Japan

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10302 2026-06-10 cs.CL 新提交 70%

Where You Inject Diversity Matters: A Unified Framework for Diverse Generation

注入多样性的位置至关重要:统一框架下的多样化生成

Cheng Zhang, Rui Xin, Chudi Zhong

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) University of Washington(华盛顿大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出统一框架,通过多样性源和传输分数衡量测试时多样化生成方法,并基于此提出全自动规范级方法,在五个开放任务中提升输出多样性且保持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09301 2026-06-09 cs.LG 新提交 70%

PRISM: Topology-Aware Cross-Modal Imputation for Modality-Deficient Federated Graph Learning

PRISM: 面向模态缺失联邦图学习的拓扑感知跨模态插补

Zekai Chen, Miao Zhang, Jiayang Xing, Xunkai Li, Xun Wu, Rong-Hua Li, Guoren Wang

机构 * Beijing Institute of Technology(北京理工大学)

专题命中 其他LLM :prompting(abstract,abstract_cn);分类 cs.LG

AI总结 针对联邦图学习中客户端级模态缺失问题,提出拓扑感知跨模态插补框架PRISM,通过联邦检索缺失模态语义并利用拓扑控制注入局部图传播,在六个多模态图数据集上平均提升4.48%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09024 2026-06-09 cs.IR cs.CL cs.HC cs.SI 新提交 70%

Personal Salience: Highlighting Is Social, but Individuality Lives in Selection

个人显著性:高亮是社交性的,但个性存在于选择中

Kazuki Nakayashiki, Keisuke Watanabe

机构 * Glasp Inc.(Glasp公司)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 通过共同阅读身份控制实验,发现高亮行为主要受群体影响(群体模型预测显著优于个人模型),但个人历史在选择已显著段落时表现出强预测力(差距+0.14),揭示个性更多体现在选择而非显著性上。

Comments 12 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16484 2026-08-18 cs.CV 新提交 67%

Remote-Sensing City Layout Extraction with MLLM

基于多模态大语言模型(MLLM)的遥感城市布局提取

Zigan Zhou, Kai Li, Yupeng Deng

机构 * City University of Hong Kong(香港城市大学) University of Chinese Academy of Sciences(中国科学院大学) Aerospace Information Research Institute(空天信息创新研究院)

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本研究提出Code-as-City方法,利用MLLM将遥感顶视图图像转化为含平面与3D输出的可编辑城市布局,在CityLayout-100数据集上取得41.1%、48.3%的交并比,验证了视觉观测转城市代码的可行性。

Comments 4 pages, 2 figures, 4 tables. Accepted to IEEE APGARSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15948 2026-08-18 cs.DB 新提交 67%

Evidence-Carrying Validation for Knowledge Graphs

带证据的知识图谱验证

Gabe Fierro

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 针对知识图谱现有验证接口无法说明检查通过原因的问题,提出带证据的验证接口,在SHACL验证器Shifty中实现,实验表明其开销为仅一致性验证的1.54-2.07倍,可辅助程序诊断并修复知识图谱缺失信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14977 2026-08-18 cs.GT 新提交 67%

Watermarked Game Solving via Perturbed Regret Minimization

基于扰动遗憾最小化的带水印博弈求解

Juho Kim, Tuomas Sandholm

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文针对现有博弈智能体水印技术仅适用于完美信息博弈的局限,提出集成于学习过程、可用于不完美信息博弈的扰动遗憾最小化水印方法,其水印代价小且易检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14893 2026-08-18 cs.SI physics.soc-ph 新提交 67%

Weaker Coherence, Weaker Reciprocity: Comparing the Semantic and Social Organization of Moltbook and Reddit

连贯性更弱,互惠性更弱:对比Moltbook与Reddit的语义及社交组织

Favio Di Ciocco, Lucas Díaz Celauro, Sebastián Pinto, Marcelo Kuperman, Pablo Balenzuela

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究对比AI智能体社交网络Moltbook与早期Reddit,发现Reddit在语义连贯性、多样性及交互互惠性上更优,且未被Moltbook复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12172 2026-08-13 cs.MA 新提交 67%

Rethinking Agent Security as a Networking Problem

将智能体安全重新思考为一个网络问题

Van Tran, Taveesh Sharma, Tajveer Singh Dhesi, Nick Feamster

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 该研究针对现有以智能体为中心的安全防御无法可靠防范AI智能体风险的问题,借鉴网络领域原则,提出结合确定性执行与语义策略的AI智能体安全系统设计思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08839 2026-08-11 cs.RO cs.CV 新提交 67%

SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models

SG-WAM:面向世界-动作模型的文本 grounded 与空间感知语义引导

Junjie He, Junfeng Li, Zhide Zhong, Haodong Yan, Ruixin Li, Yangyang Zheng, Jiaguan Zhu, Tianran Zhang, Yuqiao Du, Wen Chen, Shunbo Zhou, Haoang Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Ola Dimensions(奥拉维度公司)

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 针对现有世界-动作模型(WAM)存在的视频与指令语义不对齐问题,提出基于视觉-语言模型(VLM)的SG-WAM语义引导方法,通过注入文本接地且空间感知的语义前瞻,提升了WAM的指令遵循与操纵精度,经仿真和真实实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08637 2026-08-11 cs.SE 新提交 67%

Generics-Aware Fuzz Target Generation for Rust Libraries via Structured API Analysis

基于结构化API分析的Rust库泛型感知模糊测试目标生成

Yiming Chen, Kaiwen Zhang, Guanjun Liu, Xiaofeng Li, Xiaogang Dong

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 该研究针对Rust库模糊测试中现有工具约束处理不足导致覆盖率低的问题,提出GRAFT方法,通过结构化API分析生成可编译模糊目标,在13个Rust crate上的API覆盖率和编译成功率均优于现有工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 67%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08038 2026-08-11 cs.SE 新提交 67%

Stateful Multi-Agent LLMs for Cross-View Interface Alignment in Automotive Model-Based Systems Engineering

面向汽车基于模型的系统工程的有状态多智能体大语言模型,用于跨视图接口对齐

Aleksei Velsh, Nenad Petrovic, Alois Knoll

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 针对LLMs在汽车MBSE中引发的架构漂移问题,提出有状态多智能体验证流水线,在ADAS场景中实现97%实体可追溯性等指标,证明对抗性审核可让LLMs可靠生成零错误MBSE架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07396 2026-08-10 math.FA 新提交 67%

Banach lattices and phase retrieval: A case study for the use of AI in mathematics

巴拿赫格与相位检索:AI在数学中应用的案例研究

Jaume de Dios Pont, Lukas Liehr, David Muñoz-Lahoz, Mitchell A. Taylor, Pedro Tradacete

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文以巴拿赫格与相位检索领域为例,研究大型语言模型辅助数学研究时,结合Lean验证可形成更团结的学术共同体、加深领域理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05855 2026-08-07 cs.DC 新提交 67%

RepoOMP: Repository-Aware Hotspot OpenMP Parallelization via Dependency-Aware Context Reduction

RepoOMP:基于仓库感知的热点OpenMP并行化方法——通过依赖感知的上下文缩减

Yongjie Qian, Ke Gao, Zhibin Zhang, Shaohui Peng, Ling Li

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 RepoOMP是一种混合框架,通过构建MAP和STC,在951个热点上实现平均加速比8.23×至8.96×,降低智能体令牌成本,为仓库热点并行化提供证据引导的工作流。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05843 2026-08-07 cs.CV 新提交 67%

Overcoming Attention Drift: Homogeneity-Heterogeneity Guided Feature Aggregation for Low-Light Remote Sensing Image Enhancement

克服注意力漂移:面向低光照遥感图像增强的同质性-异质性引导特征聚合

Yaozi Zhong, Xingxing Yang, Shaohui Mei, Mingyang Ma

机构 * School of Information and Artificial Intelligence, Yunnan University of Finance and Economics(云南财经大学信息与人工智能学院) Department of Computer Science, Hong Kong Baptist University(香港浸会大学计算机科学系) School of Electronics and Information, Northwestern Polytechnical University(西北工业大学电子信息学院)

专题命中 其他LLM :foundation model(abstract,abstract_cn)

AI总结 针对低光照遥感图像增强中现有方法的注意力漂移问题,提出双先验驱动的HALO框架,通过H2CAM模块融合同质性与异质性先验,在8个基准上实现SOTA性能,提升边界清晰度与色彩保真度。

Comments 10 pages, 7 figures, 7 tables. Yaozi Zhong and Xingxing Yang contributed equally. Code: https://github.com/AlexYangxx/HALO

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04755 2026-08-06 cs.CR 新提交 67%

"Allow" to Achieve, Over-Privileged Inadvertently: The Unintended Cost of Task-Completion-Driven Pop-up Decisions in Mobile GUI Agents

“允许”达成目标:移动GUI智能体中任务完成驱动的弹窗决策的意外代价

Dongsheng Chen, Yuxuan Li, Guanhua Chen, Jiaxin Zhang, Xiangyu Zhao, Lei Ma, Xin Yao, Xuetao Wei

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究移动GUI智能体的权限素养,发现其存在应用信任偏差、任务优先级覆盖等问题,提示干预效果不一,建议将任务执行与权限授权分离。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04480 2026-08-06 cs.CV 新提交 67%

REZE: Recognition-Based Zero-Shot Extraction for Video Temporal Grounding

REZE:基于识别的视频时间定位零样本提取方法

Boyang Li, Chenhui Gou, Jianfei Cai

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 该研究提出无训练的REZE方法,通过拆分视频为片段并聚合模型置信度,适配多种VTG任务,在多个数据集上优于现有无训练方法,部分指标超全监督SoTA,还能让旧模型性能接近同家族新模型。

Comments 18 pages, 7 figures, 13 tables. Appendices included

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02792 2026-08-05 cs.CV 新提交 67%

PixelUp: Zero-Shot Semantic Feature Upsampling for Fine-Grained Vision Tasks

PixelUp:用于细粒度视觉任务的零样本语义特征上采样

Deepank Singh, Anurag Nihal, Vedhus Hoskere

专题命中 其他LLM :foundation model(abstract,abstract_cn)

AI总结 PixelUp是一种零样本、与视觉基础模型无关的语义特征上采样器,通过多尺度语义引导的窗口交叉注意力架构实现细粒度视觉任务的最优性能,可提升语义分割、深度估计等任务的精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02764 2026-08-05 cs.MA cs.DB 新提交 67%

Stateful Governance for Concurrent Agentic Systems

并发智能体系统的有状态治理

Yuxiang Peng, Xiaodi Wu

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文针对并发智能体系统的有状态治理问题,提出Provenact运行时架构,可防止失效授权,在采购工作流中避免策略违规,为智能体框架的有状态治理提供了可行路径。

Comments 18 pages, 8 figures. Revision notes: system terminology updated; technical content and results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02607 2026-08-05 cs.DB cs.CY 新提交 67%

Extracting ODRL Policies from Business Process Models: A Graph Traversal Approach to Compliance-by-Extraction

从业务流程模型中提取ODRL策略:一种用于“通过提取实现合规性”的图遍历方法

Meem Arafat Manab, Marinella Quaranta, Ilaria Angela Amantea, Sheyla Leyva-Sánchez, Víctor Rodríguez-Doncel

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究提出一种图遍历流程管线,可自动从BPMN流程模型中提取ODRL策略,解决了大规模编写ODRL效率低、大型语言模型生成存在结构无效性的问题,捕捉了现有方法遗漏的等待语义,实现了可审计、互操作的合规策略生成。

Comments 10 pages, 2 figures, ODRL and beyond: practical applications and challenges for policy-base access and usage control. OPAL 2026, 2nd edition Co-located with the Extended Semantic Web Conference Dubrovnik , Croatia, 10th-11th MAY (half-day), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02064 2026-08-04 cs.LG cs.AI cs.CL 新提交 67%

Geometry-Guided Layerwise FFN Width Allocation in Transformers

Transformer中基于几何引导的分层前馈网络宽度分配

Timur Mudarisov, Mikhail Burtsev, Radu State

机构 * University of Luxembourg(卢森堡大学) London Institute of Mathematical Sciences(伦敦数学科学研究所)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究针对Transformer中FFN宽度恒定的问题,提出基于几何特征的分层宽度分配方法,在多个预训练语言模型实验中,其可降低验证损失且效果优于均匀宽度和余弦衰减方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00721 2026-08-04 cs.RO 新提交 67%

OmniAI: A Surface-Adaptive Aerial Projection Interface for Human--Drone Interaction

OmniAI:一种面向人机交互的表面自适应空中投影界面

Nikita Kuzmin, Yuhua Jin, Georgii Demianchuk, Mariya Lezina, Fawad Mehboob, Ivan Valuev, Nikolai Lutsenko, Miguel Altamirano Cabrera, Dzmitry Tsetserukou

机构 * Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究院) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院)

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 OmniAI是一种具现化空中智能体,通过自适应投影实现人机交互,采用RGB-D与RANSAC检测投影表面,支持语音、手势控制,为情境感知人机交互提供移动空间AR界面。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28798 2026-08-03 physics.soc-ph 新提交 67%

Occupational Convergence or Divergence? Mapping Labor Market Structural Shifts Driven by AI Penetration

职业的趋同还是分化?绘制由AI渗透驱动的劳动力市场结构转变图

Rafiazka Hilman, Julia Koltai

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本研究利用10国在线职位空缺数据,结合NLP、大语言模型等方法,发现AI相关技能在核心STEM职业间趋同,但核心与其他职业间分化,强化了职业分层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28576 2026-07-31 cs.CL cs.AI cs.LG 新提交 67%

Sample More, Reflect Less: Self-Refine and Reflexion Lose to Repeated Sampling at Equal Token Cost, from 1.5B to 7B

更多采样,更少反思:在相同 token 成本下,自改进(Self-Refine)和反思(Reflexion)不敌重复采样,模型规模从 15 亿到 70 亿参数

Iliya Mirzaei

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究发现,在相同 token 成本下,自改进、反思等含自我检查的语言模型方法均不敌重复采样,且模型规模增长会使自我检查方法的性能优势减弱,70 亿参数模型上的改写方法仍显著弱于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28550 2026-07-31 cs.CY 新提交 67%

Correcting Mode Collapse in Silicon Sampling with Semantic Similarity Rating

用语义相似度评分修正硅采样中的模式崩溃问题

Oscar Heath, Rohan Alexander

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究针对硅采样中LLMs生成回复的模式崩溃问题,提出语义相似度评分法,通过文本嵌入将LLMs生成的文本回复映射为数值尺度,提升了回复分布保真度且校准参数少。

详情

展开后加载摘要…

URL PDF HTML 收藏