arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-21 至 2026-08-21 共收录 17 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 17 篇

2608.19527 2026-08-21 cs.HC cs.CL cs.SD 新提交 81%

Does Listening Matter? Backchanneling and Nodding in AI Clone

倾听重要吗?AI克隆中的反馈式回应与点头动作

Koji Inoue, Kazushi Kato, Tatsuya Kawahara, Shunichi Kasahara

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL

AI总结 本研究将口头反馈式回应与头部点头整合到配备语音克隆及LLM响应的AI克隆中,经35人被试内研究证实,添加互动倾听行为可提升AI克隆的感知专注度、真实感与共同在场感,其保真度需涵盖倾听行为。

Comments This paper has been accepted to the Late-Breaking Results (LBR) track of the 28th International Conference on Multimodal Interaction (ICMI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11256 2026-08-21 cs.LG cs.CY 版本更新 81%

Why AI Detection Fails for Academic Integrity

为什么AI检测无法保障学术诚信

Jonathan A. Karr Jr, Grigorii Khvatskii, Ting Hua, Nitesh V. Chawla

机构 * University of Notre Dame(圣母大学)

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.LG

AI总结 该研究发现商业AI检测器无法区分AI编辑与LLM完整生成稿,轻度AI辅助润色的论文标记率远高于未修改稿,且人性化处理可大幅规避检测,表明检测器分数不能单独作为学术不端证据。

Comments Accepted to ACM AI Leadership Summit

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19551 2026-08-21 cs.HC 新提交 80%

Delegating or Doing? Understanding User Behavior in Hybrid Human-Agent Interfaces

委托还是自行操作?理解混合人机界面中的用户行为

Gavin Raine Dizon, Tyrone Justin Sta Maria, Jordan Aiko Deja, Yasuyuki Sumi

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 该研究通过被试间实验对比三种交互模式,发现混合人机界面可降低交互成本,委托行为更多反映用户个体特征而非任务需求。

Comments 9 pages, In Proceedings of the 14th International Conference on Human-Agent Interaction at Osaka, Japan on November 16-19, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19441 2026-08-21 math.GT 新提交 80%

Pearl necklace knots with fewer vertices than an equivalent FCC lattice knot

与等效面心立方(FCC)格纽结相比,顶点数更少的珍珠项链纽结

Alexander R. Klotz

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 该研究通过大语言模型寻找满足珍珠项链数小于等效面心立方格纽结格点数的构型,发现5-7交叉数纽结等可实现$N_P=N_L-1$,$8_1$纽结可实现$N_P=N_L-2$,未找到三叶结的14顶点构型。

Comments 4 pages, 2 figures, tables in appendix, four ancillary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19227 2026-08-21 q-fin.CP cs.LG 新提交 79%

M3: A State-Event Generative Foundation Model for Market Microstructure Dynamics

M3:用于市场微观结构动态的状态-事件生成基础模型

Yanzhi Zhang, Yu Ma, Yilin Cheng, Jian Li, Yitong Duan

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

AI总结 针对现有金融生成模型忽略订单流与流动性动态交互的问题,提出M3状态-事件生成基础模型,经大规模订单级股票数据训练后可生成订单流轨迹,复现市场程式化事实,支持预测等反事实市场模拟应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27154 2026-08-21 cs.CV cs.AI 版本更新 79%

Anatomy Contextualized Adaptation of CT Foundation Models

CT基础模型的解剖学上下文适配

Roshan Kenia, Stephanie L McNamara, William Lotter

机构 * Harvard Medical School(哈佛医学院) Dana-Farber Cancer Institute(达纳-法伯癌症研究所) Massachusetts General Hospital(麻省总医院) Brigham and Women’s Hospital(布里格姆妇女医院)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI

AI总结 本研究提出轻量框架ACA,适配冻结CT基础模型实现解剖学级视觉-语言对齐,在Merlin、CT-RATE数据集上零样本发现分类性能优于基线,训练耗时短且可保留增强全局解剖学上下文。

Comments Proceedings of the European Conference on Computer Vision (ECCV) 2026 MedFM-Bench Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19281 2026-08-21 cs.RO cs.HC 新提交 75%

APPROVE: Visual End-User-in-the-Loop Robot Programming with LLMs

APPROVE:结合大型语言模型的面向视觉端用户的机器人编程

Bijan Kavousian, Miray Özakkas, Josefine Monnet, Oliver Petrovic, Christian Brecher

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 APPROVE是一种结合LLMs的多模态端用户机器人编程框架,通过Blockly可视化程序并支持用户确认、修改或拒绝,还可存储复用已确认功能,解决了现有系统透明度不足、意图对齐差、复用有限的问题,提升了用户信任与编程灵活性。

Comments Accepted for publication in Procedia CIRP, Proceedings of the 20th CIRP Conference on Intelligent Computation in Manufacturing Engineering (ICME 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05488 2026-08-21 cs.LG 版本更新 74%

A Robust In-Context Model for Conservation Laws: Injecting Context into Flux Neural Operators via Recurrent Vision Transformers

为守恒定律构建稳健的基模型:通过循环视觉变换器注入上下文到流神经算子

Taeyoung Kim, Joon-Hyuk Ko

机构 * Center for AI and Natural Sciences(人工智能与自然科学中心) Korea Institute for Advanced Study(韩国高级研究院)

专题命中 其他LLM :foundation model(title);分类 cs.LG

AI总结 本文提出一种结合循环视觉变换器的流神经算子架构,通过超网络提取解动态并生成上下文条件神经算子参数,实现无需显式访问守恒定律或PDE系数即可求解守恒定律。

Comments 19 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19875 2026-08-21 cs.CL cs.AI 新提交 73%

A knowledge-guided agentic framework for mitigating patient-context ambiguity in health queries

一种用于缓解医疗查询中患者上下文歧义的知识引导智能体框架

Mahyar Abbasian, Saba A. Farahani, Arshia Ilaty, Hung Cao, Ramesh Jain, Amir M. Rahmani

专题命中 其他LLM :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出知识引导智能体框架,通过解析医疗查询、构建假设、识别缺失上下文并提问,缓解患者上下文歧义,在诊断检索和饮食安全分类任务中显著提升了多种语言模型的性能。

Comments 48 pages, 3 figures, 6 tables, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19220 2026-08-21 cs.CL cs.AI 新提交 73%

Can Conversational AI loosen Us-Versus-Them Boundaries? The Effects of Common, Dual, and Separate Identity Framings on Pro-Immigrant Intergroup Helping

对话式AI能否弱化“我们与他们”的界限?共同、双重及分离身份框架对支持移民的群体间帮助的影响

Oluwadamilola Jeboda, John F. Dovidio, Jonas R. Kunst

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 该研究通过与GPT-4o开展五轮对话的预先注册实验,发现强调共同或双重身份的AI对话可弱化群体间界限,提升行动意愿,且效应在各调节变量中基本一致。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19549 2026-08-21 cs.CL cs.HC 新提交 70%

Generating Diverse Personas for User Simulators to Test Interview Dialogue Systems

为用户模拟器生成多样化角色以测试面试对话系统

Mikio Nakano, Kazunori Komatani, Hironori Takeuchi

机构 * C4A Research Institute, Inc.(C4A研究所) SANKEN, University of Osaka(大阪大学SANKEN研究所) Musashi University(武藏野大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对面试对话系统测试人力成本高的问题,提出用大语言模型自动生成带沟通风格人格特质的多样化角色的用户模拟器,实验显示其生成话语的变化性更大。

Comments Accepted for publication at SIGDIAL 2025, 19 pages, 18 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19430 2026-08-21 cs.IR cs.CL cs.CR 新提交 57%

HARP: Hierarchical Adaptive Ranking with Preference-Adaptive Fusion for Query-Based CVE Prioritization

HARP:用于基于查询的CVE优先级排序的分层自适应偏好融合排名方法

Haochen Liu, Zhengzhang Chen, Haoyu Wang, Yanchi Liu, Jundong Li, Haifeng Chen

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL

AI总结 本文针对基于查询的CVE优先级排序问题,提出HARP框架,结合漏洞知识图谱与历史标注示例,在多场景下优于多个基线方法,实现了更有效的优先级排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19369 2026-08-21 cs.CL cs.CR math.DG 新提交 57%

Linguistic Holonomy and Statistical Watermarks: Inner Geometry of Meaning-Preserving Transformations

语言完整性与统计水印:保留意义变换的内蕴几何

Daniele Corradetti

机构 * Instituto Superior Técnico(高等技术学院) Universidade do Algarve(阿尔加维大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究针对语言模型统计水印的失效问题,借助语言环形式体系与威尔逊环类比,推导得出残差统计量与种子窗口存活位置数的精确恒等式,揭示相同保留率下信号存活量随编辑位置变化的规律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18041 2026-08-21 cs.CL 版本更新 57%

Language Has Two Parameters: Narrative-Induced Semantic Plasticity and Phase-Sensitive Interpretation

语言具有两个参数:叙事诱导的语义可塑性与相位敏感的解读

Hollis Robbins (University of Utah)

机构 * University of Utah(犹他大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究提出语言解读需第二个带符号、持久且以个体与二元组为索引的相位参数,指出标准Transformer无相位显式表征,需构建承载相位语义状态的语言模型。

Comments 23 pages; 0 figuresCC

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20141 2026-08-21 cs.CV 新提交 50%

DPC-Net: Dual-Prior Collaborative Network for All-in-One Image Restoration

DPC-Net:用于一体化图像修复的双先验协同网络

Zhaokun He, Kangbiao Shi, Axi Niu, Jian Jin, Peng Wu, Wei Dong, Qingsen Yan

专题命中 其他LLM :language model(abstract)

AI总结 针对一体化图像修复现有方法的结构扭曲与语义不一致问题,提出双先验协同网络DPC-Net,联合利用退化-语义耦合与低层视觉先验,在多基准上实现优于现有最优方法的修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19350 2026-08-21 cs.HC cs.SD 新提交 50%

MultiVerse: A Creator-Centered Approach to Steering Context-Adaptive Lyrics

MultiVerse:一种以创作者为中心的引导上下文自适应歌词的方法

Alexander Wang, Chris Donahue, David Lindlbauer

专题命中 其他LLM :prompting(abstract)

AI总结 针对现有媒体适配系统忽视创作者意图的问题,提出以创作者为中心的MultiVerse系统,通过规则验证实现自适应歌词创作,经10位词曲作者研究验证了其有效性与创作价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17453 2026-08-21 cs.RO 版本更新 50%

EATR-Stereo: Embodiment-Aware Token Routing of Paired Stereo Evidence for Humanoid Vision-Language-Action Control

EATR-Stereo:面向人形机器人视觉-语言-动作控制的具身感知配对立体证据路由

Songwei Wu, Rui Zhao, Fan Yang, Zhongqiang Nie, Zhiduo Jiang, Wandong Sun, Yuwei Li, Jian Hu, Yang Liu, Hong Liu

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他LLM :language model(abstract)

AI总结 EATR-Stereo是具身感知的令牌路由框架,在冻结预训练VLA模型的前提下,通过选择性路由配对立体证据,提升了人形机器人长时程视觉-语言-动作控制的任务成功率。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏