arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-05 至 2026-03-05 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 15 篇

2603.04276 2026-03-05 cs.LG cs.AI cs.CL econ.EM 89%

Causality Elicitation from Large Language Models

从大型语言模型中提取因果关系

Takashi Kameyama, Masahiro Kato, Yasuko Hio, Yasushi Takano, Naoto Minakawa

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种从大型语言模型中提取因果关系的方法,通过采样文档、提取事件列表、归组标准事件并构建二元向量,最终估计候选因果图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18039 2026-03-05 cs.HC 89%

Presenting Large Language Models as Companions Affects What Mental Capacities People Attribute to Them

将大型语言模型呈现为伴侣会影响人们赋予它们哪些心理能力

Allison Chen, Sunnie S. Y. Kim, Angel Franyutti, Amaya Dharmasiri, Kushin Mukherjee, Olga Russakovsky, Judith E. Fan

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 研究发现,将大型语言模型呈现为伴侣会影响人们对其心理能力的认知及依赖性。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19570 2026-03-05 cs.HC cs.AI 86%

The Epistemological Consequences of Large Language Models: Rethinking collective intelligence and institutional knowledge

大型语言模型的知识论后果:重新思考集体智慧与制度知识

Angjelin Hila

专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);分类 cs.AI

AI总结 本文探讨LLM对集体智慧和制度知识的影响,提出集体知识论理论,强调反思性知识的重要性,并提出三级规范计划以应对LLM带来的知识论风险。

Comments AI & Soc (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03811 2026-03-05 cs.SD cs.MM eess.AS 85%

Robust LLM-based Audio-Visual Speech Recognition with Sparse Modality Alignment and Visual Unit-Guided Refinement

鲁棒的基于大语言模型的音频视觉语音识别与稀疏模态对齐和视觉单元引导的细化

Fei Su, Cancan Li, Juan Liu, Wei Ju, Hongbin Suo, Ming Li

机构 * School of Computer Science, Wuhan University, China(武汉大学计算机学院) School of Artificial Intelligence, Wuhan University, China(武汉大学人工智能学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)人工智能学院) AI Center, OPPO, China(OPPO人工智能中心) Digital Innovation Research Center, Duke Kunshan University, China(杜克大学昆山数字创新研究中心)

专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出AVUR-LLM,通过稀疏模态对齐和视觉单元引导细化,提升音频视觉语音识别的鲁棒性,在LRS3数据集上取得显著性能提升。

Comments submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03301 2026-03-05 cs.CL cs.AI cs.LG 85%

From Exact Hits to Close Enough: Semantic Caching for LLM Embeddings

从精确命中到足够接近:LLM嵌入的语义缓存

Dvir David Biton, Roy Friedman

机构 * Department of Computer Science, Technion – Israel Institute of Technology(计算机科学系,技术离子技术研究所)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出语义缓存的离线和在线策略,通过多项式时间启发式方法提高LLM嵌入的语义准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03329 2026-03-05 cs.CL cs.AI 84%

AutoHarness: improving LLM agents by automatically synthesizing a code harness

AutoHarness: 通过自动合成代码框架提升大语言模型代理

Xinghua Lou, Miguel Lázaro-Gredilla, Antoine Dedieu, Carter Wendelken, Wolfgang Lehrach, Kevin P. Murphy

机构 * Google DeepMind(谷歌DeepMind)

专题命中 其他LLM :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 通过自动合成代码框架,Gemini-2.5-Flash在多个游戏中超越大模型,提升性能并降低成本。

Comments agent harness, code synthesis, self-improvement, code-as-policy, text games

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03317 2026-03-05 cs.CL 81%

Retcon -- a Prompt-Based Technique for Precise Control of LLMs in Conversations

Retcon -- 基于提示的LLM在对话中精确控制技术

David Kogan, Sam Nguyen, Masanori Suzuki, Feiyang Chen

机构 * Google(谷歌)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 Retcon是一种基于提示的LLM对话控制技术,通过少量示例实现轮次级控制,优于零样本和传统少量样本提示方法。

Comments 5 pages, 2 figures, 3 appendixes with prompts and examples

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03881 2026-03-05 cs.CR cs.AI cs.CL cs.CY cs.HC 81%

On the Suitability of LLM-Driven Agents for Dark Pattern Audits

关于LLM驱动代理在暗模式审计中的适用性

Chen Sun, Yash Vekaria, Rishab Nithyanand

机构 * University of Iowa(爱荷华大学) University of California, Davis(加州大学戴维斯分校)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究了LLM驱动代理在暗模式审计中的适用性,通过分析456个数据经纪人网站,评估了代理在识别和分类暗模式方面的性能及局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04317 2026-03-05 cs.CL cs.AI cs.LG 80%

World Properties without World Models: Recovering Spatial and Temporal Structure from Co-occurrence Statistics in Static Word Embeddings

无需世界模型的世界属性:从静态词嵌入的共现统计中恢复空间和时间结构

Elan Barenholtz

机构 * Department of Psychology & Center for Complex Systems and Brain Sciences(心理学系及复杂系统与脑科学中心)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究通过静态词嵌入的共现统计恢复空间和时间结构,发现文本本身保留了丰富的世界属性信息,挑战了传统对语言模型内部表示的理解。

Comments 12 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04074 2026-03-05 q-bio.QM 78%

Dose-Dependent Cardiac Complexity Changes in Children Following Prenatal Glucocorticoid Exposure: Complementary Evidence from Multiscale Entropy Analysis and ECG Foundation Models

孕期糖皮质激素暴露对儿童心脏复杂性的影响:多尺度熵分析和ECG基础模型的互补证据

Nicolas B. Garnier, Michelle Dreiling, Valeska Kozik, Matthias Schwab, Florian Rakers, Martin G Frasch

专题命中 其他LLM :foundation model(title,abstract)

AI总结 该研究通过多尺度熵分析和ECG基础模型探讨孕期糖皮质激素暴露对儿童心脏复杂性的影响,发现熵率衰减速率与剂量相关,而形态特征与剂量无关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18925 2026-03-05 cs.SE cs.AI cs.HC 77%

Beyond the Prompt: An Empirical Study of Cursor Rules

超越提示:关于光标规则的实证研究

Shaokang Jiang, Daye Nam

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文通过分析401个开源仓库中的光标规则,提出了项目上下文的分类法,并探讨了不同项目类型和编程语言中上下文的变化,为下一代上下文感知的AI开发者工具提供启示。

Comments To appear at MSR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04378 2026-03-05 cs.LG cs.AI cs.CR cs.MA 73%

Robustness of Agentic AI Systems via Adversarially-Aligned Jacobian Regularization

通过对抗性对齐雅可比正则化提升代理AI系统的鲁棒性

Furkan Mumcu, Yasin Yilmaz

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出对抗性对齐雅可比正则化方法,通过严格控制敏感性方向提升代理AI系统的鲁棒性,解耦极小极大稳定性与全局表达性限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03644 2026-03-05 cs.HC cs.AI 57%

Bridging Pedagogy and Play: Introducing a Language Mapping Interface for Human-AI Co-Creation in Educational Game Design

连接教学与游戏:引入一种语言映射接口用于教育游戏设计中的人机协同创作

Daijin Yang, Erica Kleinman, Casper Harteveld

机构 * Northeastern University(东北大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 本文提出一种基于语言映射的接口,通过人机协同设计教育游戏,以明确教学意图并降低非专业设计师的设计门槛。

Comments Accepted for CHI EA 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00251 2026-03-05 cs.SE cs.AI cs.SY eess.SY 57%

GENAI WORKBENCH: AI-Assisted Analysis and Synthesis of Engineering Systems from Multimodal Engineering Data

GenAI Workbench: 人工智能辅助从多模态工程数据中分析和合成工程系统

H. Sinan Bank, Daniel R. Herber

机构 * Colorado State University(科罗拉多州立大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 GenAI Workbench通过整合AI技术,实现从多模态工程数据中辅助分析和合成工程系统,促进更集成和数据驱动的工程设计方法。

Comments 7 pages, 3 figures, accepted to be presented at IISE Annual Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03732 2026-03-05 astro-ph.SR astro-ph.GA astro-ph.IM 50%

A Generalist Model Including Evolved Star Mass and Age

包含演化的恒星质量和年龄的通用模型

Mengmeng Zhang, Yude Bu, Siqi Wang, Shanshan Li, Jiangchuan Zhang, Jingzhen Sun, Yuhang Zhang, Ke Wang, Jian Liu, Hongliang Yan, Zhenping Yi, Meng Liu, Xiaoming Kong

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出一种通用模型,通过整合Gaia XP光谱与APOGEE数据,同时预测恒星大气参数和演化标签,实现高质量的质量和年龄预测,并有效区分星际消光与固有温度变化。

详情

展开后加载摘要…

URL PDF HTML 收藏