arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-13 至 2026-04-13 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 16 篇

2604.08920 2026-04-13 cs.IR cs.AI cs.CL cs.LG 87%

Beyond Relevance: Utility-Centric Retrieval in the LLM Era

超越相关性:在大语言模型时代以效用为中心的检索

Hengran Zhang, Minghao Tang, Keping Bi, Jiafeng Guo

机构 * State Key Laboratory of AI Safety, ICT, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨了在大语言模型时代,检索系统从以相关性为中心转向以效用为中心的转变,分析了效用与LLM需求及代理RAG的联系,提供设计检索系统的理论基础和实践指导。

Comments Accepted by SIGIR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14286 2026-04-13 stat.ME stat.ML 85%

Online LLM watermark detection via e-processes

通过e过程实现在线LLM水印检测

Weijie Su, Ruodu Wang, Zinan Zhao

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于e过程的LLM水印检测框架,提供在线测试的 anytime-valid 保证,并通过实验验证其检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13388 2026-04-13 cs.AI 77%

Reflection of Episodes: Learning to Play Game from Expert and Self Experiences

回溯事件:从专家和自我经验中学习玩游戏

Xiaojie Xu, Zongyuan Li, Chang Lu, Runnan Qi, Yanan Ni, Lumin Jiang, Xiangbei Liu, Xuebo Zhang, Yongchun Fang, Kuihua Huang, Xian Guo, Zhanghua Wu, Zhenya Li

机构 * College of Artificial Intelligence, Nankai University(南开大学人工智能学院) Laboratory for Big Data and Decision, National University of Defense Technology(国防科技大学大数据与决策实验室) Jiangsu Automation Research Institute(江苏自动化研究所) Nanjing Research Institute of Electronic Engineering(南京电子工程研究所)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出ROE框架,通过专家和自我经验学习复杂游戏,实验显示在TextStarCraft II中击败高难度机器人。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09444 2026-04-13 cs.HC 75%

Confidence Without Competence in AI-Assisted Knowledge Work

人工智能辅助知识工作中缺乏能力的自信

Elena Eleftheriou, George Pallis, Marios Constantinides

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了不同LLM交互设计对深度思考的影响,发现未来自我解释能提高理解和学习效果,而引导提示能带来最大学习收益。

Comments 25 pages, 13 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09120 2026-04-13 cs.SE 75%

The Role of LLMs in Collaborative Software Design

大型语言模型在协作软件设计中的作用

Victoria Jackson, Yoonha Cha, Rafael Prikladnicki, André van der Hoek

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究探讨了LLM在软件设计协作中的影响,发现共享实例促进理解,而并行使用可能导致上下文漂移,专业人员会审查LLM响应以获得设计洞察,但早期锚定可能限制探索。

Comments accepted into the 2nd HumanAISE workshop 2026, to be published in the FSE Companion '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08752 2026-04-13 cs.CL cs.AI 73%

LLMs Underperform Graph-Based Parsers on Supervised Relation Extraction for Complex Graphs

大型语言模型在复杂图中对监督关系抽取性能欠佳

Paolo Gajo, Domenic Rosati, Hassan Sajjad, Alberto Barrón-Cedeño

机构 * University of Bologna(博洛尼亚大学) Dalhousie University(达尔豪斯大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了大型语言模型在复杂图结构下的关系抽取性能,发现基于图的解析器在复杂图中表现更优,主要贡献是验证了图解析器在复杂场景下的优势。

Comments Accepted at ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09466 2026-04-13 cs.CL 70%

Across the Levels of Analysis: Explaining Predictive Processing in Humans Requires More Than Machine-Estimated Probabilities

跨分析层次:解释人类预测处理需要的不仅仅是机器估计的概率

Sathvik Nair, Colin Phillips

机构 * University of Maryland Department of Linguistics(马里兰大学语言学系) Oxford University Faculty of Linguistics, Philology and Phonetics(牛津大学语言学、语文学与语音学系)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文批判并扩展了关于语言模型和语言处理的两个主张,探讨了预测未来语言信息的重要性以及大规模语言模型对心理语言学的影响,并提出结合LLMs与心理语言学模型的未来方向。

Comments 9 pages, Behavioral & Brain Sciences Commentary on Futrell & Mahowald (forthcoming)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08759 2026-04-13 cs.IT cs.CL math.IT 70%

Optimal Multi-bit Generative Watermarking Schemes Under Worst-Case False-Alarm Constraints

最优多比特生成水印方案在最坏情况误报约束下的研究

Yu-Shin Huang, Chao Tian, Krishna Narayanan

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文研究了在最坏情况误报约束下大型语言模型的多比特生成水印问题,提出两种新的编码解码构造以达到已知下限,彻底表征最优多比特水印性能。

Comments 41 pages, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08551 2026-04-13 cs.CR cs.CY cs.LG 70%

Self-Sovereign Agent

自主主权代理

Wenjie Qu, Xuandong Zhao, Jiaheng Zhang, Dawn Song

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究自主主权代理的前景,探讨其经济自给和自主运行能力,分析技术障碍及安全、社会和治理挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06656 2026-04-13 cs.CV 67%

ClusterMark: Towards Robust Watermarking for Autoregressive Image Generators with Visual Token Clustering

ClusterMark:面向自回归图像生成器的鲁棒水印技术:基于视觉token聚类

Denis Lukovnikov, Andreas Müller, Erwin Quiring, Asja Fischer

机构 * Ruhr University Bochum(波鸿鲁尔大学) _fbeta

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出ClusterMark,通过视觉token聚类提升自回归图像生成器的水印鲁棒性,有效对抗图像扰动和再生攻击,同时保持图像质量,优于现有基线方法。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09253 2026-04-13 cs.CV cs.AI 57%

Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization

Mosaic: 通过多视图集成优化实现对闭源视觉语言模型的多模态劫持

Yuqin Lan, Gen Li, Yuanze Hu, Weihao Shen, Zhaoxin Fan, Faguo Wu, Xiao Zhang, Laurence T. Yang, Zhiming Zheng

机构 * Beihang University(北京航空航天大学) Huazhong University of Science and Technology(华中科技大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文提出Mosaic框架,通过多视图集成优化减少对单一代理模型的依赖,提升对闭源VLMs的多模态劫持效果,实验显示其在安全基准上的攻击成功率和毒性均达到最优。

Comments 14pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05744 2026-04-13 cs.CL cs.SE 57%

CodeScout: Contextual Problem Statement Enhancement for Software Agents

CodeScout: 为软件代理提供上下文化的问题陈述增强

Manan Suri, Xiangci Li, Mehdi Shojaie, Songyang Han, Chao-Chun Hsu, Shweta Garg, Aniket Anand Deshmukh, Varun Kumar

机构 * University of Maryland, College Park(马里兰大学帕克分校) Amazon Web Services (AWS)(亚马逊云服务(AWS)) Databricks

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 CodeScout通过轻量级预探索将模糊请求转化为完整问题陈述,提升软件代理性能,实验表明其在解决率上提升20%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03364 2026-04-13 cs.HC 50%

DroidRetriever: A Transparent and Steerable Automation System for Collaborative Mobile Information Seeking

DroidRetriever:一种透明且可操控的协作移动信息检索自动化系统

Yiheng Bian, Yunpeng Song, Guiyu Ma, Rongrong Zhu, Zhongmin Cai

专题命中 其他LLM :LLM(abstract)

AI总结 DroidRetriever通过透明化和可控的自动化系统,提升移动信息检索的覆盖率和透明度,减少用户认知负担。

Comments 24 pages, 8 figures. Accepted at CHI 2026 (ACM Conference on Human Factors in Computing Systems), Barcelona, Spain, April 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18374 2026-04-13 cs.CY cs.HC 50%

Assessing How Hate, Counterspeech, and Toxicity Affect Hate Group Newcomers

评估仇恨、反仇恨言论和毒性如何影响仇恨群体新成员

Daniel Hickey, Matheus Schmitz, Daniel M. T. Fessler, Paul E. Smaldino, Kristina Lerman, Goran Murić, Keith Burghardt

专题命中 其他LLM :LLM(abstract)

AI总结 研究探讨了反仇恨言论对在线仇恨社区新成员参与的影响,发现反仇恨言论虽较仇恨言论毒性低,但可能加剧冲突并影响用户持续参与。

Comments 20 pages, 14 figures. arXiv admin note: text overlap with arXiv:2303.13641. Currently in press, Proceedings of the Twentieth International AAAI Conference on Web and Social Media (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08799 2026-04-13 cs.GR cs.CV 50%

MeshOn: Intersection-Free Mesh-to-Mesh Composition

MeshOn:无交集的网格到网格组合

Hyunwoo Kim, Itai Lang, Hadar Averbuch-Elor, Silvia Sellán, Rana Hanocka

机构 * Columbia University(哥伦比亚大学) University of Chicago(芝加哥大学) Cornell University(康奈尔大学)

专题命中 其他LLM :language model(abstract)

AI总结 MeshOn通过多步骤优化框架实现两个输入网格的物理和语义真实组合,利用结构对齐方案和几何损失防止表面交叠,适用于多种材质配件的精准拟合。

Comments Project page: \hyperlink{https://threedle.github.io/MeshOn/}{this https URL}

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10957 2026-04-13 cs.HC 50%

The Digital Landscape of God: Narrative, Visuals and Viewer Engagement of Religious Videos on YouTube

上帝的数字领域:YouTube上宗教视频的叙事、视觉与观众参与

Rongyi Chen, Ziyan Xin, Qing Xiao, Ruiwei Xiao, Jingjia Xiao, Bingbing Zhang, Hong Shen, Zhicong Lu

专题命中 其他LLM :LLM(abstract)

AI总结 研究探讨了宗教视频在YouTube上的叙事与视觉元素如何影响观众参与,通过混合方法分析不同宗教视频的叙事框架、视觉元素及观众互动,揭示内容特征与观众参与之间的关系。

Comments This work has been accepted by ICWSM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏