arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-26 至 2026-03-26 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 19 篇

2603.23626 2026-03-26 cs.LG cond-mat.stat-mech cs.AI cs.CL nlin.AO 87%

A Theory of LLM Information Susceptibility

大语言模型信息易感性理论

Zhuo-Yang Song, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Center for High Energy Physics, Peking University(北京大学高能物理中心)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出大语言模型信息易感性理论,探讨计算资源充足时固定LLM对策略集预算敏感性的影响,通过多变量效用函数框架分析多预算通道架构,并验证了共缩放架构在提升性能方面的有效性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23979 2026-03-26 cs.ET 85%

BRIDG-Q: Barren-Plateau-Resilient Initialisation with Data-Aware LLM-Generated Quantum Circuits

BRIDG-Q: 基于数据感知的大语言模型生成量子电路的 barren-plateau 抵抗初始化

Ngoc Nhi Nguyen, Thai T Vu, John Le, Hoa Khanh Dam, Dung Hoang Duong, Dinh Thai Hoang

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 BRIDG-Q结合大语言模型生成的量子电路架构与经验贝叶斯参数初始化,提升变分量子算法的优化鲁棒性,实验表明数据驱动初始化在LLM生成电路中仍有效,可减少残余能量约10%。

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23714 2026-03-26 cs.AI cs.CL 79%

LLMs Do Not Grade Essays Like Humans

大型语言模型并不像人类那样评分作文

Jerin George Mathew, Sumayya Taher, Anindita Kundu, Denilson Barbosa

机构 * University of Alberta(阿尔伯塔大学)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文评估了LLM生成的评分与人类评分的一致性,发现LLM在评分时存在偏差,倾向于给短或不充分的作文高分,而给较长但有小错误的作文低分,表明LLM的评分机制与人类不同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22171 2026-03-26 cs.CR cs.AI 78%

Enhancing Jailbreak Attacks on LLMs via Persona Prompts

通过人格提示增强大语言模型的劫持攻击

Zheng Zhang, Peilin Zhao, Deheng Ye, Hao Wang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tencent(腾讯)

专题命中 其他LLM :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过遗传算法生成人格提示,有效降低大语言模型拒绝率,提升劫持攻击成功率,揭示人格提示对模型安全机制的影响。

Comments Workshop on LLM Persona Modeling at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23788 2026-03-26 cs.CV 78%

Re-Prompting SAM 3 via Object Retrieval: 3rd of the 5th PVUW MOSE Track

通过目标检索重新提示SAM 3:5th PVUW MOSE Track的第三篇

Mingqi Gao, Sijie Li, Jungong Han

机构 * School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院) Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 其他LLM :prompting(title,abstract)

AI总结 本文基于SAM 3开发自动重新提示框架,通过目标检索提升视频目标分割的鲁棒性,实现51.17%的J&F成绩,在MOSEv2 Track中排名第三。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24218 2026-03-26 cs.IR cs.AI 77%

Who Benefits from RAG? The Role of Exposure, Utility and Attribution Bias

谁从RAG中受益?曝光、效用和归因偏差的作用

Mahdi Dehghan, Graham McDonald

机构 * University of Glasgow, Glasgow, UK(格拉斯哥大学,格拉斯哥,英国)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究RAG中查询组公平性的影响因素,发现RAG系统在不同组查询的平均准确率和改进上存在偏差,揭示了曝光、效用和归因对公平性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17946 2026-03-26 cs.HC 75%

"I Use ChatGPT to Humanize My Words": Affordances and Risks of ChatGPT to Autistic Users

我用ChatGPT让话语更有人性化:ChatGPT对自闭症用户的影响与风险

Renkai Ma, Ben Zefeng Zhang, Chen Chen, Fan Yang, Xiaoshan Huang, Haolun Wu, Lingyao Li

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文通过分析3984条自闭症用户社交媒体帖子,探讨ChatGPT在缓解自闭症用户执行功能障碍、情绪调节等方面的作用,同时指出其对用户心理健康带来的风险。

Comments Accepted to ACM Interactive Health '2026 extended abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23880 2026-03-26 cs.SI 75%

ProcureGym: A Multi-Agent Markov Game Framework for Modeling National Volume-based Drug Procurement

ProcureGym: 一个用于建模国家基于体积的药品采购的多智能体马尔可夫游戏框架

Jia Wang, Qian Xu, Xuanwen Ding, Zhuangqi Li, Chao He, Bao Liu, Zhongyu Wei

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出ProcureGym,通过真实数据模拟中国基于体积的药品采购,评估RL、LLM等智能体模型,发现RL在收益和利润上表现更优,揭示最大有效报价和采购量对战略结果的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23852 2026-03-26 cs.SE 75%

APISENSOR: Robust Discovery of Web API from Runtime Traffic Logs

APISENSOR: 从运行时流量日志中鲁棒地发现Web API

Yanjing Yang, Chenxing Zhong, Ke Han, Zeru Cheng, Jinwei Xu, Xin Zhou, He Zhang, Bohan Liu

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 APISENSOR通过无监督方法从混合运行时流量中恢复准确API,提升了API发现的鲁棒性和准确性,优于现有方法。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23650 2026-03-26 cs.CV 71%

Foundation Model Embeddings Meet Blended Emotions: A Multimodal Fusion Approach for the BLEMORE Challenge

基础模型嵌入与混合情感:一种多模态融合方法用于BLEMORE挑战

Masoumeh Chapariniya, Aref Farhadipour, Sarah Ebling, Volker Dellwo, Teodora Vukovic

机构 * Department of Computational Linguistics, University of Zürich(苏黎世大学计算语言学系)

专题命中 其他LLM :foundation model(title)

AI总结 本文提出了一种多模态融合方法,结合六个编码器家族进行后期概率融合,通过选择冻结的Wav2Vec2的语调编码层和Gemini Embedding 2.0,提升了混合情感识别的性能,最终在测试集上获得0.279的分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23772 2026-03-26 cs.NI cs.AI 70%

AI-driven Intent-Based Networking Approach for Self-configuration of Next Generation Networks

基于人工智能的意图驱动网络方法用于下一代网络的自配置

Md. Kamrul Hossain, Walid Aljoby

机构 * Information and Computer Science Department, King Fahd University of Petroleum and Minerals(信息与计算机科学系,国王法赫德石油与矿物大学) IRC for Intelligent Secure Systems, King Fahd University of Petroleum and Minerals(智能安全系统研究院,国王法赫德石油与矿物大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种端到端闭环IBN流程,利用大语言模型和结构化验证将自然语言意图转化为可执行策略,并通过多意图故障预测提升自动化可靠性。

Comments Accepted for presentation in IEEE/IFIP NOMS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23624 2026-03-26 cs.CL 70%

Revisiting Real-Time Digging-In Effects: No Evidence from NP/Z Garden-Paths

重新审视实时挖掘效应:从NP/Z路径效应中未发现证据

Amani Maina-Kilaas, Roger Levy

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过两项实验对比人类与大型语言模型的行为,发现无实时挖掘效应证据,非最终歧义项显示与神经模型预测一致的反向趋势。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13942 2026-03-26 cs.AI 70%

The Collaboration Paradox: Why Generative AI Requires Both Strategic Intelligence and Operational Stability in Supply Chain Management

协同悖论:为何生成式AI需要在供应链管理中兼具战略智能与操作稳定性

Soumyadeep Dhar

机构 * Department of Industrial & Systems Engineering(工业与系统工程系) Indian Institute of Technology, Kharagpur (IIT-KGP)(印度理工学院,克拉格浦尔(IIT-KGP))

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究生成式AI在多级供应链中的协同行为,揭示其因库存积压导致的系统性失败,并提出通过战略智能与操作稳定性的结合实现供应链稳定的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24454 2026-03-26 cs.CV 67%

Unleashing Vision-Language Semantics for Deepfake Video Detection

释放视觉-语言语义以进行深度伪造视频检测

Jiawen Zhu, Yunqi Miao, Xueyi Zhang, Jiankang Deng, Guansong Pang

机构 * Singapore Management University(新加坡管理学院) The University of Warwick(沃里克大学) Nanyang Technological University(南洋理工大学) Imperial College London(伦敦帝国理工学院)

专题命中 其他LLM :language model(abstract);prompting(abstract)

AI总结 本文提出VLAForge框架,通过ForgePerceiver增强视觉感知并引入身份感知VLA评分,利用跨模态语义提升深度伪造检测的判别能力。

Comments 14 pages, 7 figures, accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24284 2026-03-26 cs.SE cs.AI cs.MA 57%

The Specification Gap: Coordination Failure Under Partial Knowledge in Code Agents

规范鸿沟:在代码代理中部分知识下的协调失败

Camilo Chacón Sartori

机构 * Catalan Institute of Nanoscience and Nanotechnology (ICN2), CSIC and BIST(加泰罗尼亚纳米科学与纳米技术研究所(ICN2),西班牙国家科研 council(CSIC)和巴塞罗那技术研究所(BIST))

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 研究代码代理在部分知识下的协调失败问题,发现规范鸿沟导致两代理整合准确率下降,信息不对称和协调成本是主要因素,支持以规范为导向的多代理代码生成观点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23831 2026-03-26 cs.LG eess.SP stat.ML 57%

Unveiling Hidden Convexity in Deep Learning: a Sparse Signal Processing Perspective

揭示深度学习中的隐藏凸性:一种稀疏信号处理视角

Emi Zeger, Mert Pilanci

机构 * Department of Electrical Engineering, Stanford University(斯坦福大学电气工程系)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 本文从稀疏信号处理角度探讨深度学习中隐藏的凸性,通过分析ReLU网络的凸等价关系,解决训练和理解神经网络的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24528 2026-03-26 cs.CV 50%

Cross-Modal Prototype Alignment and Mixing for Training-Free Few-Shot Classification

跨模态原型对齐与混合用于无训练少样本分类

Dipam Goswami, Simone Magistri, Gido M. van de Ven, Bartłomiej Twardowski, Andrew D. Bagdanov, Tinne Tuytelaars, Joost van de Weijer

机构 * Department of Computer Science, Universitat Autònoma de Barcelona, Spain(巴塞罗那自治大学计算机科学系) Computer Vision Center, Barcelona, Spain(巴塞罗那计算机视觉中心) Media Integration and Communication Center, University of Florence, Italy(佛罗伦萨大学媒体整合与传播中心) Bernoulli Institute, University of Groningen, the Netherlands(格罗宁根大学伯努利学院) IDEAS Research Institute, Poland(波兰IDEAS研究所) ESAT-PSI, KU Leuven, Belgium(比利时KU莱顿大学ESAT-PSI)

专题命中 其他LLM :language model(abstract)

AI总结 本文研究了直接混合图像与文本原型对少样本分类的影响,提出通过投影获取语义对齐的图像子空间,结合文本嵌入和图像特定LDA分类器提升性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12181 2026-03-26 cs.HC 50%

Negotiating Digital Identities with AI Companions: Motivations, Strategies, and Emotional Outcomes

与AI伴侣协商数字身份:动机、策略与情感结果

Renkai Ma, Shuo Niu, Lingyao Li, Alex Hirth, Ava Brehm, Rowajana Behterin Barbie

专题命中 其他LLM :LLM(abstract)

AI总结 研究探讨了用户与AI伴侣进行身份构建与协商的过程,识别了五种动机、三种沟通期望、四种身份共构策略及三种情感结果,提出设计建议以支持用户并降低风险。

Comments Accepted by ACM CHI '2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24856 2026-03-26 econ.TH cs.AR cs.CE cs.ET 50%

Advances in Agentic AI: Back to the Future

代理AI的进展:回到未来

Sergio Alvarez-Telena, Marta Diez-Fernandez

专题命中 其他LLM :LLM(abstract)

AI总结 本文探讨代理AI与算法化领域的融合,提出清晰的概念定义和分析框架,回顾过去十年的方法和技术进展,并提出M1和M2的架构概念,为未来二十年的研究和转型制定计划。

详情

展开后加载摘要…

URL PDF HTML 收藏