arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-22 至 2026-07-22 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 9 篇

2511.19166 2026-07-22 cs.CL 版本更新 90%

Epistemic Familiarity is Associated With Belief Stability in Large Language Models

大语言模型中真理的表示与行为稳定性

Samantha Dies, Courtney Maynard, Germans Savcisens, Tina Eliassi-Rad

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学计算机科学学院) Network Science Institute, Northeastern University(东北大学网络科学研究所) Santa Fe Institute(圣达菲研究所)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本研究提出P-StaT框架,通过对比虚构与合成内容的稳定性,揭示认知熟悉性对大语言模型真理判断稳定性的影响。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18250 2026-07-22 cs.HC 新提交 89%

Anthropomorphism in Children's Interactions with LLM Chatbots: A Systematic Review of Drivers and Outcomes

儿童与基于大语言模型的聊天机器人互动中的拟人化:驱动因素和结果的系统综述

Hansinie Madushika Jayathilake, Renkai Ma

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过分析35项实证研究,系统综述儿童与LLM聊天机器人互动中拟人化的驱动因素及结果,发现类人角色构建等驱动互动,出现五种拟人化结果,可为相关聊天机器人设计开发提供参考。

Comments Accepted by ACM IDC '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19300 2026-07-22 cs.AI cs.GT 新提交 87%

LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior

作为一种干预手段的大语言模型检测:战略用户行为下的下游影响

Meena Jagadeesan, Tatsunori Hashimoto, Jon Kleinberg

机构 * Stanford University(斯坦福大学) University of Pennsylvania(宾夕法尼亚大学) Cornell University(康奈尔大学)

专题命中 其他LLM :LLM(title,summary_cn);分类 cs.AI

AI总结 研究LLM检测对下游指标的影响,开发程式化模型捕捉用户策略行为。发现不完善的检测器会扭曲LLM使用及输出质量,导致用户增加使用量且输出质量可能降低,还呈现“先升后降”检测模式,揭示了检测干预的失效模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18566 2026-07-22 cs.CL cs.AI 新提交 84%

The Story Shapes the Agent: Narrative Priors in LLM Behavior

故事塑造智能体:大语言模型行为中的叙事先验

Yixuan Wang, James Lester, Shashank Srivastava

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) North Carolina State University(北卡罗来纳州立大学)

专题命中 其他LLM :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究探索大语言模型行为中叙事框架的影响,通过构建游戏识别叙事先验,发现其解释行为方差能力强且与任务成功相关,还明确跨叙事角色效应源于行为锚点,框架可推广并产生改进跨叙事转移的角色选择方法。

Comments Accepted at COLM 2026. 10 pages, 3 figures, 16 tables in appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18711 2026-07-22 cs.SE 新提交 78%

LLM-Based Invariant Testing for Software Functional Bugs

基于大语言模型的软件功能缺陷不变式测试

Ruogu Yang, Yifeng He, Yundi Xu, Yuqing Wei, Hao Chen

专题命中 其他LLM :LLM(title,abstract)

AI总结 研究针对软件功能缺陷,提出基于大语言模型的LISA不变式测试框架,在API n-gram反馈指导下迭代生成API序列和程序不变式,相比其他方法有更高缺陷检测率和代码覆盖率,能为开发者提供高可信度缺陷候选。

Comments Accepted for publication at ISSRE 2026 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18256 2026-07-22 cs.AI cs.LG 新提交 73%

PEARL: Solver-in-the-Loop Interactive Optimization Modeling from Natural Language

PEARL:基于自然语言的循环求解器交互式优化建模

Hongliang Lu, Zhong Li, Yuxuan Chen, Yuan Lan, Fan Zhang, Zaiwen Wen

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旨在解决优化建模问题,提出PEARL系统,通过在循环中使用Python执行和数学编程求解器,学习优化策略,在多轮工具集成设置下提升求解率,在优化建模任务中表现优于强大基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18859 2026-07-22 cs.AI 新提交 70%

PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents

PhoenixRepair:重新思考软件代理中的修复策略探索

Tianyue Jiang, Yanlin Wang, Xin He, Daya Guo, Jiachi Chen, Ming Wen, Ensheng Shi, Xilin Liu, Yuchi Ma, Guanbin Li

机构 * Zhejiang University(浙江大学) Huazhong University of Science and Technology(华中科技大学) Huawei CodeArts Model Team(华为代码艺术模型团队)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对现有软件代理修复策略探索不足的问题,提出PhoenixRepair多代理框架,通过多位置采样、迭代反思优化等扩大搜索空间,实验表明该框架在解决率和故障定位精度上有提升,实现了7.8%的相对改进及76.0%的最高解决率Pass@1。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07473 2026-07-22 cs.CR cs.AI 版本更新 70%

Give Them an Inch and They Will Take a Mile:Understanding and Measuring Caller Identity Confusion in MCP-Based AI Systems

给予一寸,他们将索取一英里:理解和测量基于MCP的AI系统中的调用者身份混淆

Yuhang Huang, Boyang Ma, Biwei Yan, Xuelong Dai, Yechao Zhang, Minghui Xu, Kaidi Xu, Yue Zhang

机构 * Institute for Clarity in Documentation(清晰文档研究所) Inria Paris-Rocquencourt(巴黎-罗克Quantin 研究院) Rajiv Gandhi University(拉朱·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒尔研究实验室) Shandong University(山东省大学) City University of Hong Kong(香港城市大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究发现基于MCP的AI系统因缺乏调用者身份验证和细粒度授权而存在安全风险,需改进认证机制以减少攻击面。

Comments Withdrawal due to some flaws in experimental methodology and unresolved ethical issues in data collection. We need to redesign the experiments and obtain proper ethical clearance before resubmission

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19344 2026-07-22 cs.CV cs.AI cs.GR 新提交 57%

Appearance Pointers -- Multimodal Region Control of Diffusion Transformers

外观指针——扩散变压器的多模态区域控制

Rahul Sajnani, Yulia Gryaditskaya, Radomír Měch, Srinath Sridhar, Matheus Gadelha

机构 * Brown University(布朗大学) Adobe Research(Adobe 研究院)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 针对可控图像生成难题,提出外观指针方法,通过区域对应网络和空间聚合机制生成并细化指针,为扩散变压器引入模态无关的局部多模态控制接口,单一模型性能达或超现有技术。

Comments 38 Pages, Preprint with supplement

详情

展开后加载摘要…

URL PDF HTML 收藏