arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2608.16409 2026-08-18 cs.LG 新提交 70%

SoftModel: A Neural Model That Grows Its Own Topology -- Governed Structural Growth for Continual In-Service Learning

SoftModel:一种自行扩展拓扑的神经模型——面向持续服务中学习的受控结构增长

Zhoumin Xie

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究提出了软模型(SoftModel),其结构可随非平稳数据流持续受控增长,在标准持续学习基准上保留了长任务序列的持续学习能力,为终身学习提供了新方案。

Comments 99 pages, 16 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14913 2026-08-18 cs.GT cs.AI cs.MA 新提交 70%

The Open-Strategy Dictator Game: Cooperation Under Mutual Transparency

开放策略独裁者博弈:相互透明下的合作

Michael Glass

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出开放策略独裁者博弈,借助大语言模型裁决互动,通过循环锦标赛分析发现条件合作策略占优,证明在智能体可互查决策程序的环境中条件合作具备进化稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14697 2026-08-18 cs.AI 新提交 70%

Synchronized Logit Steering: Real-world Steganography

同步对数几率调控:面向真实场景的隐写术

Andrew Rufail, Aadi Dash, Onir Narahari, Ethan Mui, Mahi Gajare, Prakhar Tiwari, Shrija Makapothula, Nick Cui

机构 * Algoverse AI

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出同步对数几率调控(SLS),一种无需发送方与接收方共享相同提示上下文的确定性隐写方案,通过代理提示编码有效载荷,在多数据集上验证其低 KL 散度、高信息密度及强隐蔽性,实现实用隐蔽通信。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14035 2026-08-17 cs.AI 新提交 70%

Agent-Orchestration in Autonomous Chip Design

自主芯片设计中的智能体编排

Linyang Li

机构 * Nova Silicon(诺瓦硅公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对芯片设计领域,结合大型语言模型与工具使用智能体,提出将芯片设计超级智能建模为庞大AI组织的思路,探索适用于该复杂行业的AI类型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13674 2026-08-17 cs.CY cs.CL cs.SI 新提交 70%

Asymmetric Discourse Homogenization and Shared Language Technology: Evidence from Reddit

不对称话语同质化与共享语言技术:来自Reddit的证据

Fengming Liu

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文基于Reddit数据发现2022年末出现政治话语多元化趋势的不对称断裂,保守派用户话语多元化轨迹中断,进步派无类似变化,机制更可能是社区层面的话语趋同。

Comments 36 pages, 5 figures, 6 tables. Replication package available (code and instructions). Keywords: political discourse; semantic similarity; discourse homogenization; generative AI; computational text analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13589 2026-08-17 cs.HC cs.AI 新提交 70%

Context Aware AI Assistant and AR Interface for Lunar Extravehicular Activity (EVA) Procedural Guidance

面向月球舱外活动(EVA)程序指导的上下文感知AI助手与AR界面

Rodrigo Gallardo, Qilmeg Doudatcz, Ganit Goldstein, Ilkyaz Sarimehmetoglu, Sergio Mutis, Alexander Htet Kyaw, Anita Lin, Clara Emmerling, Berfin Ataman, Skylar Tibbits

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对月球EVA中宇航员注意力分散导致的信息适配难题,提出GAIN-AI系统,通过两层架构结合大语言模型与AR界面,在111个合成EVA场景中取得良好表现。

Comments 4 pages, 4 figures, 1 table. Accepted to ACM SIGGRAPH 2026 Conference Posters, July 19-23, 2026, Los Angeles, California, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12674 2026-08-14 cs.AI 新提交 70%

Lines and Ladders: A Context-Aware Multi-Agent Framework for Large-Scale Retail Price Taxonomy

Lines and Ladders:面向大规模零售价格分类的上下文感知多智能体框架

Ravi Teja Chunduri, Srikaran Reddy Boya, Deep Narayan Mishra, Ajay Kumar B, Karthik Kumaran, Pranay Kona

机构 * Walmart Global Tech(沃尔玛全球科技)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对大规模零售商品定价管理难题,提出上下文感知多智能体框架自动化构建Lines and Ladders价格分类,3智能体系统在Lines任务F1达0.83,在多品类数据上表现优异且已投入生产。

Comments 8 pages. Accepted in the Main Conference of IEEE ICMLA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12582 2026-08-14 cs.HC cs.AI 新提交 70%

Not All Nudges Land: Behavioral Controllability and Elaboration Quality in AI-Supported Journaling

并非所有助推都能落地:AI辅助日记中的行为可控性与阐述质量

Nadia Mehjabin, Henry Kautz, Subigya Nepal

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究针对AI辅助日记,分析369篇条目后发现,涉及他人的行为改善率仅15%-22%,个人可独立实施的行为改善率达50%-63%,文本特征影响较小,为AI日记助推的适用方向提供了探索性结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12511 2026-08-14 cs.CR cs.CL 新提交 70%

SoK: From Generation to Consumption of Privacy Documents in Software Systems

SoK:软件系统中隐私文档的生成与使用

Shidong Pan, Clark LaChance, Zhen Tao, Sepideh Ghanavati

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本SoK从软件工程视角,系统分析2010-2025年290篇论文,梳理隐私文档全生命周期研究,识别趋势与开放机会,为相关研究提供统一基础。

Comments This SoK paper has been accepted by NDSS 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12361 2026-08-14 cs.CL cs.CY 新提交 70%

New Terms, New Toxicity: Consensus-based Chinese Neologism Toxicity Detection via Search-Augmented LLMs

新术语,新毒性:基于共识的新词毒性检测——通过搜索增强型大语言模型(LLMs)

Shiyao Cui, QingLin Zhang, Di Wang, Yida Lu, Zhexin Zhang, Jinhua Gao, Jinglin Yang, Min He, Han Qiu, Minlie Huang

机构 * Tsinghua University(清华大学) ICT, CAS(中国科学院计算技术研究所) National Computer Network Emergency Response Technical Team Coordination Center of China(国家计算机网络应急技术处理协调中心) IIE, CAS(中国科学院工程热物理研究所) School of Cyber Security, UCAS(中国科学院大学网络空间安全学院) JCSS, Tsinghua University(清华大学软件学院) Science City (Guangzhou) Digital Technology Group Co., Ltd.(广州科学城数字科技集团有限公司)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对毒性新词的检测问题,提出捕捉毒性新词起源与共识标准的分类法,构建风险词表,引入搜索增强型框架SeTox,实验显示3B规模的SeTox性能优于近期大规模模型。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10050 2026-08-12 cs.LG 新提交 70%

Observational Policy Ranking for SMB Financial Guidance from Multi-Action Accounting Logs

基于多动作会计日志的中小企业财务指导观测策略排序

Shrutendra Harsola, Vignesh Subrahmaniam, Vikas Raturi, Kamalika Das, Xiang Gao, Kratika Gupta, Ruocheng Guo, Padmaja Jonnalagedda, Ananya Pramod, Sricharan Kumar

机构 * Foresight-AI(预见人工智能) Intuit(英图易公司)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对中小企业财务指导的观测策略排序问题,提出CAR-PL方法,通过85078个公司-月度数据验证,其在毛利润等指标上表现优异,可实现多动作会计日志下的财务指导类别排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08510 2026-08-11 cs.CL 新提交 70%

From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios

从语音到交互:鸡尾酒会场景下多模态系统的分析

Thai-Binh Nguyen, Zhaolin Li, Jan Niehues, Alexander Waibel

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究分析了CHiME-9 MCoRec任务中不同多模态系统解决鸡尾酒会场景的策略,发现最优系统实现57%相对错误减少,且高语音重叠并非性能差异的主要原因。

Comments Accepted at ICMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08026 2026-08-11 cs.AI 新提交 70%

The Authority Expectancy Effect in Multi-User Conflict

多用户冲突中的权威预期效应

Eunna Lee

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究在Claude、Gemini、GPT、Grok四个LLMs上开展三类实验,发现社会权威信号可重构模型判断,提出并表征了具有参考依赖、证据重新解释、方向敏感性特性的权威预期效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07808 2026-08-11 cs.CR cs.AI 新提交 70%

The Anatomy of a Prompt Injection: A Component Model for Structured Analysis

提示注入的剖析:用于结构化分析的组件模型

Jeremy McHugh

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出七个组件的提示注入结构化分析模型,统一相关分类法,结合实例与CTI模式,助力标记、分析提示注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07541 2026-08-11 cs.CV cs.AI cs.MA 新提交 70%

NeuroPilot: An Agent-Driven Smart Pipeline for Processing, Quality Control, and Managing Neuroimages

NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程

Yiyao Chen, Yucheng Li, Jungong Tong, Shaoqi Wang, Kunhao Zhou, Ziquan Wei, Monica Murea, Marissa DiPiero, Tingting Dan, Guorong Wu

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07283 2026-08-10 cs.CL 新提交 70%

Grammar Engineering Meets LLMs: Development of Cantonese and Irish ParGram Treebanks

语法工程与大语言模型(LLMs)的结合:粤语与爱尔兰语平行语法(ParGram)树库的开发

Chit-Fung Lam, Elaine Uí Dhonnchadha

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 该研究开发了粤语与爱尔兰语ParGram树库,探究多语言LLMs在语法工程中的应用,发现其翻译表现差、跨语言抽象任务效果不佳,但可提供参考,凸显其潜力与专家分析的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05732 2026-08-07 cs.LG 新提交 70%

CircuitSteer: Geometrically Aligned Multi-Layer Steering via Sparse Autoencoder Circuits

CircuitSteer:基于稀疏自编码器回路的几何对齐多层引导方法

Mehrshad Saadatinia, Parsa Razmara, Ardalan Aryashad, Ali Abbasi, Seyedarmin Azizi

机构 * University of Southern California(南加利福尼亚大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 CircuitSteer是利用SAEs识别多层语义回路的新型框架,通过几何对齐合成引导向量实现多点干预,在多任务多模型上,其引导效果优于牺牲流畅性或覆盖不足的对比方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05510 2026-08-07 cs.CL 新提交 70%

Different Perturbations, Different Mechanisms: Understanding Continued Pre-training for Zero-Shot Dialect Robustness

不同扰动,不同机制:理解用于零样本方言鲁棒性的持续预训练

Aarohi Srivastava, David Chiang

机构 * University of Notre Dame(圣母大学)

专题命中 其他LLM :LLM(abstract_cn);language model(abstract);分类 cs.CL

AI总结 本研究针对大型语言模型,系统对比6种训练条件下的6种扰动持续预训练策略,发现字符噪声CPT可提升零样本方言鲁棒性且保留标准性能,不同策略的鲁棒机制存在差异,为相关策略选择提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05233 2026-08-07 cs.AI cs.CV 新提交 70%

Coherence-Oriented Dream Scene Visualisation

面向连贯性的梦境场景可视化

Azra Açıl, Simon Colton

机构 * School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦玛丽女王大学电子工程与计算机科学学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出DSV系统,通过大型语言模型拆分梦境描述为四部分,结合文本到图像模型生成连贯的四面板图像序列,经DreamBank数据集50次可视化评估,用CLIP等模型指标验证了其质量、保真度与连贯性。

Comments short paper accepted at ICCC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04554 2026-08-06 cs.CL cs.CV 新提交 70%

Representing Visual Evidence for Item Difficulty Prediction: Visual Textualization and Image-Native Modeling

为题目难度预测表征视觉证据:视觉文本化与原生图像建模

Han Chen, Ming Li, Hong Jiao, Tianyi Zhou

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) University of Maryland(马里兰大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文针对题目难度预测的视觉证据表征问题,对比仅用文本、视觉文本化与原生图像建模三种方式,发现原生图像建模是有竞争力的替代方案,其有效性取决于VLMs的适配方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04336 2026-08-06 cs.SE cs.AI 新提交 70%

COMPAS: Difficulty-Aware Joint Search for Optimizing Code Generation

COMPAS:面向优化代码生成的感知难度联合搜索

Jingzhi Gong, Jie M. Zhang, Gunel Jahangirova, Dong Huang, Mohammad Reza Mousavi, Mark Harman

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出感知难度的 COMPAS 方法,通过联合搜索模型、提示词和解码设置优化代码生成,在 LiveCodeBench 和 SWE-bench 上均实现性能提升且成本降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02005 2026-08-04 cs.AI 新提交 70%

Evolving in the Agent Jungle via History-Informed Opponent Awareness

在智能体丛林中通过历史感知的对手意识进化

Zhaofeng Zhang, Linhan Xia, Rui Liu, Yihao Wang, Binrui Shen, Shengxin Zhu

机构 * University of Edinburgh(爱丁堡大学) University of Oklahoma(俄克拉荷马大学) Imperial College London(伦敦帝国学院) University of Michigan(密歇根大学) University of Southern California(南加州大学) Tencent(腾讯) Beijing Normal University(北京师范大学) Beijing Normal–Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对多智能体环境中对手策略持续进化导致静态技能修改方法失效的问题,提出OASE方法,通过历史快照锚定的配对比较选择有益技能修改,在两类场景中实现更低均衡距离与更少无效策略变更。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00119 2026-08-04 cs.CV cs.AI 新提交 70%

Counting the Cost of War Under Satellite Embargo: Zero-Shot Estimation of Impacted Infrastructure

卫星禁运下的战争损失统计:受影响基础设施的零样本估计

Saleh Sakib Ahmed, M. Sohel Rahman

机构 * Bangladesh University of Engineering and Technology(孟加拉国工程技术大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对冲突区人道主义救援中受影响建筑估计受卫星数据禁运阻碍的问题,提出基于打击前地图的零样本几何投影方法,引入两项技术创新,在2026年中东冲突数据上验证了深度增强大视觉语言模型的优势,确立了混合零样本危机映射范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27529 2026-07-31 cs.LG 新提交 70%

Latent-Kernel Discrete Flow Maps for Few-Step Generation

用于少步生成的隐核离散流图

Mansoor Ahmed, Yue-Tsz Fan, Hemanth Venkateswara, Murray Patterson

专题命中 其他LLM :language model(abstract,abstract_cn);分类 cs.LG

AI总结 提出隐核离散流图(LKF)模型,通过共享隐变量绑定分解组件实现少步生成,在两个文本基准上较似然基线提升困惑度2.1-3.3倍,M=8时优于现有少步采样器

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27167 2026-07-30 cs.SE cs.CL 新提交 70%

SpecFirst: Behavioral Specification Elicitation as a First-Class Step in Agent-Based Program Synthesis from Scratch

SpecFirst:将行为规范提取作为从零开始的基于智能体的程序合成中的一等步骤

Yihao Chen, Shi Chang, Feng Lin, Khaled Chawa, Boyuan Chen, Shaowei Wang, Ahmed E. Hassan

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 SpecFirst是将行为规范提取设为独立前置阶段的两阶段框架,在ProgramBench上显著提升了从零开始的程序合成的测试通过率与二进制探索覆盖率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26735 2026-07-30 cs.CV cs.AI cs.MM 新提交 70%

Dual Inversion for Text-to-Image Diffusion Models: From Both Prompt and Noise Perspectives

文本到图像扩散模型的双重逆推:从提示与噪声双视角

Xiaolong Liu, Junjian Li, Yuan Xiao, Jiaqi Deng, Dayong Ye, Tianqing Zhu, Huan Huo

机构 * University of Technology Sydney(悉尼科技大学) Geely(吉利) City University of Hong Kong(香港城市大学) City University of Macau(澳门城市大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对现有文本到图像扩散模型提示逆推方法的局限,提出联合恢复语义提示与潜在噪声的Dualin方法,实现了高质量逆推提示与最优图像保真度,为可控图像编辑奠定基础。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26726 2026-07-30 cs.CL 新提交 70%

AtmosERC: Modeling Dialogue-Level Affective Atmosphere for Emotion Recognition in Conversation

AtmosERC:面向对话情感识别的对话级情感氛围建模

Weijie Feng, Tongwei Zhang, Binbin Liu, Zhiyong Cheng

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文提出AtmosERC框架,通过建模对话级情感氛围提升对话情感识别性能,其可作为插件线索增强基于大语言模型的ERC,且在局部情感偏差下预测更稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26340 2026-07-30 cs.NI cs.DC cs.LG 新提交 70%

Incast-Free MoE Rate-Based Scheduling

无内爆的MoE基于速率的调度

Evyatar Cohen, Jose Yallouz, Alexander Shpiner, Mark Silberstein, Sylvia Ratnasamy, Isaac Keslassy

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对MoE架构轮询调度引发的指数级内爆瓶颈,提出主动公平调度框架,可消除内爆、维持高链路利用率并降低集体完成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25527 2026-07-29 cs.CV cs.AI 新提交 70%

Argus-Unified: Towards A Compact and Economical Unified Model for Image Understanding and Generation

阿格斯统一模型:迈向紧凑且经济的图像理解与生成统一模型

Weiming Zhuang, Jiabo Huang, Jingtao Li, Zhizhong Li, Chen Chen, Sina Sajadmanesh, Lingjuan Lyu

机构 * Sony AI(索尼人工智能公司)

专题命中 其他LLM :LLM(abstract);language model(abstract);分类 cs.AI

AI总结 研究旨在统一图像理解与生成,提出阿格斯统一模型,利用预训练视觉语言模型,引入混合视觉令牌,分两阶段训练,以最少数据和低成本实现良好性能,达当前最优,可作统一模型开发基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24539 2026-07-28 cs.AI cs.SY eess.SY 新提交 70%

Task-Conditional Faithfulness Auditing of Multimodal LLMs for Grid Diagnosis

用于电网诊断的多模态大语言模型的任务条件忠实性审计

Tianqiao Zhao, Meng Yue, Jianhui Wang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校) Brookhaven National Laboratory(布鲁克海文国家实验室) Southern Methodist University(南卫理公会大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对多模态大语言模型用于电网诊断时答案准确性与证据使用的问题,提出通用框架进行任务条件忠实性审计,通过比较多种依赖并设计校正和重新审计机制,经案例研究验证了框架检测、诊断及纠正相关失败的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏