arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-04 至 2026-03-04 共收录 21 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 21 篇

2507.08207 2026-03-04 cs.AI 85%

Toward a Dynamic Stackelberg Game-Theoretic Framework for Agentic AI Defense Against LLM Jailbreaking

面向动态Stackelberg博弈框架的代理AI防御对抗大语言模型劫持

Zhengye Han, Quanyan Zhu

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出动态Stackelberg博弈框架,用于代理AI防御对抗大语言模型劫持,通过RRT搜索和博弈树分析提升防御效果。

Comments Accepted to ICLR 2026 AIMS Workshop. 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02983 2026-03-04 cs.CR cs.AI cs.CL 84%

Contextualized Privacy Defense for LLM Agents

上下文化隐私防御用于大语言模型代理

Yule Wen, Yanzhe Zhang, Jianxun Lian, Xiaoyuan Yi, Xing Xie, Diyi Yang

机构 * Tsinghua University(清华大学) Stanford University(斯坦福大学) Microsoft(微软)

专题命中 其他LLM :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出上下文化防御指导(CDI),通过强化学习优化框架,在大语言模型代理执行中主动塑造隐私保护与有用性之间的平衡。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13315 2026-03-04 cs.CV cs.AI 83%

Self-Aug: Query and Entropy Adaptive Decoding for Large Vision-Language Models

Self-Aug: 用于大视觉-语言模型的查询和熵自适应解码

Eun Woo Im, Muhammad Kashif Ali, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔兰根-纽伦堡弗里德里希-亚历山大大学)

专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 本研究提出Self-Aug,一种无需训练的解码策略,通过自增强提示和自适应阈值算法提升大视觉-语言模型的事实一致性。

Comments 10 pages, accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02547 2026-03-04 cs.CL cs.AI cs.LG 82%

CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think

CoDAR:连续扩散语言模型比你想象的更强大

Junzhe Shen, Jieru Zhao, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) School of Computer Science(计算机科学学院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 CoDAR通过改进的连续扩散模型和上下文自回归解码器,在生成质量上超越了潜在扩散,并与强离散DLMs相竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02952 2026-03-04 q-bio.GN cs.LG q-bio.CB 79%

Sparse autoencoders reveal organized biological knowledge but minimal regulatory logic in single-cell foundation models: a comparative atlas of Geneformer and scGPT

稀疏自编码器揭示了组织化的生物知识,但在单细胞基础模型中包含最小的调控逻辑:Geneformer和scGPT的比较图谱

Ihor Kendiukhov

机构 * Department of Computer Science, University of Tübingen(图宾根大学计算机科学系)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

AI总结 本研究通过稀疏自编码器分析单细胞基础模型Geneformer和scGPT,揭示其包含组织化的生物知识,但缺乏显著的因果调控逻辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18962 2026-03-04 cs.HC cs.AI cs.CY cs.IR cs.MA 79%

NeuroWise: A Multi-Agent LLM "Glass-Box" System for Practicing Double-Empathy Communication with Autistic Partners

NeuroWise:一种多智能体大语言模型"玻璃箱"系统,用于与自闭症伙伴练习双 empathy 交流

Albert Tang, Yifan Mo, Jie Li, Yue Su, Mengyuan Zhang, Sander L. Koole, Koen Hindriks, Jiahuan Pei

机构 * Marriotts Ridge High School(马里奥茨岭高中) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Cake Researcher(蛋糕研究员)

专题命中 其他LLM :LLM(title,abstract);分类 cs.AI

AI总结 NeuroWise通过多智能体大语言模型帮助神经典型用户改善与自闭症伙伴的双 empathy 交流,减少缺陷归因并提高沟通效率。

Comments Accepted to ACM CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14086 2026-03-04 cs.CR cs.AI 79%

Every Language Model Has a Forgery-Resistant Signature

每个语言模型都有抗伪造的签名

Matthew Finlayson, Xiang Ren, Swabha Swayamdipta

机构 * University of Southern California(南加州大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.AI

AI总结 本研究提出了一种基于语言模型输出椭圆表面的抗伪造签名方法,通过几何约束验证模型输出来源,具有高安全性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02569 2026-03-04 cs.HC 78%

An LLM-Assisted Toolkit for Inspectable Multimodal Emotion Data Annotation

一种辅助多模态情绪数据标注的工具包

Zheyuan Kuang, Weiwei Jiang, Nicholas Koemel, Matthew Ahmadi, Emmanuel Stamatakis, Benjamin Tag, Anusha Withana, Zhanna Sarsenbayeva

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文提出一种LLM辅助的多模态情绪数据标注工具包,通过可检查的工作流实现细粒度标注,提升跨模态一致性检查效率。

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02787 2026-03-04 cs.AI 77%

Rethinking Code Similarity for Automated Algorithm Design with LLMs

重新思考基于LLM的自动算法设计中的代码相似性

Rui Zhang, Zhichao Lu

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 BehaveSim通过分析问题解决行为轨迹,提升LLM-AAD性能并促进算法分析。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02895 2026-03-04 cs.AR cs.PL 75%

SpecLoop: An Agentic RTL-to-Specification Framework with Formal Verification Feedback Loop

SpecLoop:一种带有形式验证反馈循环的代理RTL到规范框架

Fu-Chieh Chang, Yu-Hsin Yang, Hung-Ming Huang, Yun-Chia Hsu, Yin-Yu Lin, Ming-Fang Tsai, Chun-Chih Yang, Pei-Yuan Wu

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SpecLoop通过形式验证驱动的反馈循环提升RTL到规范生成的准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12386 2026-03-04 cs.HC 75%

Hey Dashboard!: Supporting Voice, Text, and Pointing Modalities in Dashboard Onboarding

Hey Dashboard!:在仪表盘引导中支持语音、文本和指向模态

Vaishali Dhanoa, Gabriela Molina León, Eve Hoggan, Eduard Gröller, Marc Streit, Niklas Elmqvist

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 DIANA通过语音、文本和指向等多种模态,为仪表盘引导提供自助导航和分析支持,提升用户在复杂仪表盘中的使用效率。

Journal ref Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI '26), April 13--17, 2026, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02789 2026-03-04 cs.CL cs.AI 73%

OCR or Not? Rethinking Document Information Extraction in the MLLMs Era with Real-World Large-Scale Datasets

OCR 或不是?在 MLLMs 时代重新思考文档信息提取:基于真实世界的大规模数据集

Jiyuan Shen, Peiyue Yuan, Atin Ghosh, Yifan Mai, Daniel Dahlmeier

机构 * SAP(SAP公司) Stanford University(斯坦福大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨了在 MLLMs 时代是否仍需 OCR,通过大规模数据集评估发现,仅图像输入可达到与 OCR 增强方法相当的性能,并展示了通过精心设计的模式、示例和指示可进一步提升 MLLMs 的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11896 2026-03-04 cs.CL cs.CY 70%

Focal Inferential Infusion Coupled with Tractable Density Discrimination for Implicit Hate Detection

焦点推断注入结合可计算密度辨别用于隐含仇恨检测

Sarah Masud, Ashutosh Bajpai, Tanmoy Chakraborty

机构 * Indraprastha Institute of Information Technology(印度德里印度理工学院) Indian Institute of Technology Delhi(印度德里理工学院) Wipro Research(惠普研究)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 FiADD通过结合焦点推断和可计算密度辨别,提升隐含仇恨检测的准确性和泛化能力。

Comments 23 pages, 6 Figures, 9 Tables. Accepted at NLE

Journal ref Nat. lang. process. 31 (2025) 1323-1349

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02366 2026-03-04 cs.HC cs.AI 70%

PlayWrite: A Multimodal System for AI Supported Narrative Co-Authoring Through Play in XR

PlayWrite: 一种通过XR中的游戏化互动实现AI支持的叙事协作写作的多模态系统

Esen K. Tütüncü, Qian Zhou, Frederik Brudy, George Fitzmaurice, Fraser Anderson

机构 * Institute of Neurosciences of the University of Barcelona(巴塞罗那大学神经科学研究所) Autodesk Research(Autodesk研究)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PlayWrite是一种通过XR中的游戏化互动实现AI支持的叙事协作写作的多模态系统,通过直接操控虚拟角色和道具,结合多智能体AI管道和大型语言模型,促进高度即兴和游戏化的创作过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22903 2026-03-04 cs.IR cs.LG 70%

PSQE: A Theoretical-Practical Approach to Pseudo Seed Quality Enhancement for Unsupervised Multimodal Entity Alignment

PSQE:一种伪种子质量增强的理论-实践方法用于无监督多模态实体对齐

Yunpeng Hong, Chenyang Bu, Jie Zhang, Yi He, Di Wu, Xindong Wu

机构 * Key Laboratory of Knowledge Engineering with Big Data (the Ministry of Education of China), Hefei University of Technology(大数据知识工程重点实验室(教育部)、合肥工业大学) Department of Data Science, College of William and Mary(威廉与玛丽学院数据科学系) College of Computer and Information Science, Southwest University(西南大学计算机与信息科学学院)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 PSQE通过多模态信息和聚类重采样提升伪种子质量,改善无监督多模态实体对齐的精度与图覆盖平衡性。

Comments 2026 SIGKDD Accept

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03175 2026-03-04 cs.CL cs.AI cs.LG 67%

Part-of-Speech Tagger for Bodo Language using Deep Learning approach

使用深度学习方法的波多语词性标注器

Dhrubajyoti Pathak, Sanjib Narzary, Sukumar Nandi, Bidisha Som

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出BodoBERT语言模型及基于深度学习的波多语词性标注模型,实现了0.8041的F1分数,并比较了阿萨姆语词性标注器。

Comments Accepted to Natural Language Engineering

Journal ref Nat. lang. process. 31 (2025) 215-229

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16114 2026-03-04 cs.SI 67%

The Content Moderator's Dilemma: Removal of Toxic Content and Distortions to Online Discourse

内容管理员的困境:有毒内容的删除与在线讨论的扭曲

Mahyar Habibi, Dirk Hovy, Carlo Schwarz

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 本文提出利用生成式大语言模型重新表述有毒推文,以保留可挽救内容并减少在线讨论的扭曲。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15008 2026-03-04 cs.LG cs.AI stat.ML 62%

Know When to Abstain: Optimal Selective Classification with Likelihood Ratios

知何时退避:基于似然比的最优选择性分类

Alvin Heng, Harold Soh

机构 * Department of Computer Science, National University of Singapore(计算机科学系,国立新加坡大学) Smart Systems Institute, National University of Singapore(智能系统研究所,国立新加坡大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于似然比的最优选择性分类方法,通过 Neyman-Pearson 引理统一并改进了选择性分类在协变量偏移下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03121 2026-03-04 cs.SE 50%

RippleGUItester: Change-Aware Exploratory Testing

RippleGUItester: 基于变更的探索性测试

Yanqi Su, Michael Pradel, Chunyang Chen

专题命中 其他LLM :LLM(abstract)

AI总结 RippleGUItester通过基于大语言模型的变更影响分析,结合多模态bug检测,发现由代码变更引入的bug,提升测试效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02744 2026-03-04 quant-ph 50%

Generation of 12 dB squeezed light from a waveguide optical parametric amplifier using a machine-learning-controlled spatial light modulator

通过机器学习控制的光空间光调制器生成12 dB压缩光

Gyeongmin Ha, Kazuki Hirota, Takahiro Kashiwazaki, Takumi Suzuki, Akito Kawasaki, Warit Asavanant, Mamoru Endo, Akira Furusawa

专题命中 其他LLM :SLM(abstract)

AI总结 利用机器学习优化的光空间光调制器,实现通过波导光学参量放大器生成12 dB压缩光

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11922 2026-03-04 cs.CY cs.SE 50%

On Regulating Downstream AI Developers

对下游AI开发者进行监管

Sophie Williams, Jonas Schuett, Markus Anderljung

专题命中 其他LLM :foundation model(abstract)

AI总结 本文探讨了对下游AI开发者进行监管的必要性,提出通过要求上游开发者减轻下游修改风险或使用替代政策工具来平衡监管与创新。

Comments 39 pages, 2 figures, 7 tables

Journal ref Eur. j. risk regul. 17 (2026) 94-122

详情

展开后加载摘要…

URL PDF HTML 收藏