arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-25 至 2026-06-25 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 16 篇

2605.13076 2026-06-25 cs.CL cs.FL cs.SE 版本更新 90%

TruncProof: A Guardrail for LLM-based JSON Generation under Token-Length Constraints

TruncProof: 一种用于在令牌长度限制下基于LLM的JSON生成的防护机制

Yoshio Kato, Shuhei Tarashima

机构 * NTT DOCOMO BUSINESS, Inc., Japan(NTT DOCOMO商务公司,日本)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.CL

AI总结 本文提出TruncProof,一种基于文法约束的生成方法,使LLM在限定令牌数下生成语法正确的JSON。实验表明其在严格令牌限制下仍能生成语法正确且语义准确的输出。

Comments Main paper (8 pages). Accepted at the International Joint Conference on Neural Networks (IJCNN 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15031 2026-06-25 econ.EM 新提交 89%

Partial Identification from LLM Prompts

从LLM提示中的部分识别

Xiaohong Chen, Ashesh Rambachan, Elie Tamer

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究利用大语言模型作为二元分类器时,在真实标签未知且报告误差可能任意相关的情况下,通过外部校准分数和事件来部分识别真实流行度θ,并刻画识别边界。

Comments 31 PAGES TOTAL. NO FIGURES

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31220 2026-06-25 cs.CL cs.AI cs.LG 版本更新 88%

Shared Doubt: Zero-Shot Cross-Lingual Confidence Estimation for Language Models

共享疑虑:语言模型的零样本跨语言置信度估计

Athina Kyriakou, Dennis Ulmer, Ivan Titov

机构 * ILLC, University of Amsterdam(阿姆斯特丹大学ILLC) ILCC, University of Edinburgh(爱丁堡大学ILCC)

专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究多语言大语言模型是否编码共享的、可跨语言迁移的置信度特征,通过轻量级线性探针从中间表示直接预测答案正确性,实现零样本跨语言泛化,并发现置信度特征集中在中间层。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25852 2026-06-25 cs.LG cs.AI 新提交 88%

Semantic Consistency Policy Optimization for Reinforcement Learning of LLM Agents

语义一致性策略优化:用于LLM智能体强化学习

Peng Xu, Sijia Chen, Junzhuo Li, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 针对基于组的强化学习中语义一致的中间步骤因轨迹成败获得相反信用的问题,提出无价值奖励塑造方法SCPO,通过从组内成功兄弟步骤恢复信用,在ALFWorld和WebShop上达到93.7%和74.8%的成功率。

Comments 16 pages, 7 figures, 5 tables. Under review at EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25550 2026-06-25 cs.SE 新提交 86%

On the Viability of Requirements Generation From Code: An Experience Report

从代码生成需求的可行性:经验报告

Alexander Korn, Jone Bartel, Max Unterbusch, Andreas Vogelsang

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过实验评估基于LLM和RAG的代理方法从源代码生成需求,发现LLM无法可靠生成未实现需求、高质量需求或引入需求气味,且单一人工难以检测气味,表明该方法尚不可行。

Comments Accepted for publication at the 13th International Workshop on Artificial Intelligence and Requirements Engineering (AIRE'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13317 2026-06-25 cs.CL cs.AI cs.CY cs.LG cs.SI 版本更新 86%

Paid Voices vs. Public Feeds: Interpretable Cross-Platform Theme-Based Analysis of Climate Discourse

付费声音 vs. 公共信息流:可解释的跨平台主题式气候话语分析

Samantha Sudhoff, Pranav Perumal, Zhaoqing Wu, Tunazzina Islam

机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系)

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出可解释的主题发现流程,通过语义聚类和LLM标注,比较Meta付费广告与Bluesky公共帖子中的气候话语,发现两者在主题、语气和焦点上存在系统性差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24895 2026-06-25 cs.DL 新提交 83%

Hybrid Metadata Extraction from League of Nations Index Cards: From Feasibility Study to Archival System Integration

国联索引卡片的混合元数据提取:从可行性研究到档案系统集成

Florian Cafiero, Grégoire Mallard

专题命中 其他LLM :LLM(summary_cn,abstract);language model(abstract)

AI总结 提出混合AI工作流从国联索引卡片中提取并整合档案元数据,结合YOLO、TrOCR、本地LLM后校正及微调视觉语言模型,实现从布局感知管道到混合架构的演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25444 2026-06-25 eess.AS cs.CL cs.SD 交叉投稿 81%

Does Translation-Enhanced Speech Encoder Pre-training Affect Speech LLMs?

翻译增强的语音编码器预训练是否影响语音大语言模型?

Tomoya Mizumoto, Yusuke Fujita

机构 * SB Intuitions

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究翻译增强的语音编码器预训练对语音大语言模型的影响,通过实验证明该方法能改善跨模态整合并提升下游任务性能。

Comments Accepted to Interspeech2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25421 2026-06-25 cs.CL 新提交 81%

Beyond Next-Observation Prediction: Agent-Authored World Modeling for Sequential Decision Making

超越下一观测预测:面向序贯决策的智能体自创世界建模

Guangfeng Cai, Kaibing Yang, Shuo He, Yu Li, Shengtian Yang, Jiaqi Lv, Lei Feng

机构 * Southeast University(东南大学) Meituan(美团)

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出智能体自创世界建模(AAWM),根据策略决策需求构建训练目标,而非预测下一观测,实验证明其比下一观测预测提供更有效的学习信号。

Comments 16 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25657 2026-06-25 cs.CV cs.AI 新提交 79%

Steering Vision-Language Models with Joint Sparse Autoencoders

用联合稀疏自编码器引导视觉-语言模型

Huizhen Shu, Xuying Li, Hongxu Lin, Wenjie Sun, Hui Li

机构 * yunshanai(云山AI) HKUST(Guangzhou)(香港科技大学(广州)) Zidongtaichu(紫东太初) University of British Columbia(不列颠哥伦比亚大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 提出联合稀疏自编码器(JSAE),通过显式对齐约束联合分解视觉和语言激活,得到可解释的跨模态特征,并在LLaVA等模型上验证了层依赖的干预效果。

Comments 19pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25143 2026-06-25 cs.CL 新提交 70%

The cognitive, affective, and behavioral expression of self-stigma among people who use drugs in online substance use communities

药物使用在线社区中药物使用者的自我污名认知、情感和行为表达

Layla Bouzoubaa, Hyung Wook Choi, Milan Varghese, Valerie Earnshaw, Rezvaneh Rezapour

机构 * Department of Information Science, Drexel University(德雷塞尔大学信息科学系) Department of Human Development and Family Sciences, University of Delaware(特拉华大学人类发展与家庭科学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究开发了涵盖认知、情感和行为三个领域的自我污名编码本,利用大语言模型分析Reddit帖子,发现自我污名普遍存在且行为指标常先于核心指标出现,挑战了渐进模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02384 2026-06-25 cs.SE cs.HC 版本更新 67%

A Low-Code Approach for the Automatic Personalization of Conversational Agents

一种低代码方法用于对话代理的自动个性化

Aaron Conrardy, Alfredo Capozucca, Jordi Cabot

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过系统文献综述,研究MDE领域用户建模现状,发现现有提案分散且维度覆盖有限,提出应建立统一可重用用户模型并利用ML自动推导用户画像以实现个性化。

Comments Published in the main track of the International Conference on Web Engineering (ICWE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26083 2026-06-25 cs.CL eess.AS 新提交 57%

Real-Time Voice AI Hears but Does Not Listen

实时语音AI能听到但不倾听

Martijn Bartelds, Federico Bianchi, James Zou

机构 * Together AI Stanford University(斯坦福大学)

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 评估四个领先实时语音系统,发现它们依赖文字而非声学线索,在情感理解上存在感知与行动脱节,提示需谨慎用于依赖语调的场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25743 2026-06-25 cs.LG 新提交 57%

Black-Box Assisted Regression: Phase Transitions and Minimax Optimality

黑盒辅助回归:相变与极小化最优性

Yan Zhou

机构 * School of Mathematics and Statistics(数学与统计学学院)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 研究有限标注下利用固定黑盒预测器进行非参数回归的问题,发现风险在临界半径处发生相变,并提出安全残差估计器以避免负迁移,达到极小化最优。

Comments 23 pages, 3 figures. Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09170 2026-06-25 cs.RO cs.AI 版本更新 57%

ZeroWBC: Learning Natural Whole-Body Humanoid Interaction from Human Egocentric Data

ZeroWBC: 从人类自我中心数据学习自然全身人形交互

Haoran Yang, Jiacheng Bao, Yucheng Xin, Haoming Song, Yuyang Tian, Bin Zhao, Dong Wang, Xuelong Li

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) TeleAI, China Telecom(TeleAI,中国电信)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 提出ZeroWBC框架,利用人类自我中心视频和同步全身运动数据,通过生成-跟踪方法实现无遥操作的人形机器人全身交互控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26075 2026-06-25 astro-ph.EP 新提交 50%

Glossy Silicate Clouds on the Scorched Dayside of LTT9779b

LTT9779b灼热昼侧的硅酸盐云

Suman Saha, James S. Jenkins, Jonathan Brande, Reza Ashtari, Ian J. M. Crossfield, Sarah Stamer, Diana Dragomir, Kevin B. Stevenson, Vivien Parmentier, Thomas M. Evans-Soma, Tansu Daylan, Hayley Beltz, Emma Esparza-Borges

专题命中 其他LLM :prompting(abstract)

AI总结 利用JWST NIRISS和NIRSpec/GH95观测,首次在LTT9779b昼侧以3-5σ置信度探测到硅酸盐云,并发现高反射云层而非高金属丰度是其高光学反照率的原因。

Comments 18 pages, 11 figures, 2 tables. Accepted for publication in ApJ Letters

详情

展开后加载摘要…

URL PDF HTML 收藏