arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-28 至 2026-04-28 共收录 35 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 35 篇

2604.24444 2026-04-28 cs.CL 92%

Can You Make It Sound Like You? Post-Editing LLM-Generated Text for Personal Style

你能让它听起来像你吗?为个人风格进行后编辑LLM生成文本

Connor Baumler, Calvin Bao, Huy Nghiem, Xinchen Yang, Marine Carpuat, Hal Daumé

机构 * III University of Maryland(III 马里兰大学)

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨用户通过后编辑LLM生成文本来塑造个人风格的效果,发现后编辑提高了文本与用户自身写作的相似性,但降低了与LLM生成文本的相似性,同时减少了风格多样性。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24712 2026-04-28 cs.SE 91%

When Prompt Under-Specification Improves Code Correctness: An Exploratory Study of Prompt Wording and Structure Effects on LLM-Based Code Generation

当提示不足提升代码正确性:对提示语言和结构影响LLM代码生成的探索性研究

Amal AKLI, Mike PAPADAKIS, Maxime CORDY, Yves Le TRAON

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究探讨提示结构、任务复杂度和说明丰富度如何影响LLM的鲁棒性,发现提示不足在某些情况下能提升代码正确性,且结构丰富任务描述可缓解提示不足的负面影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24373 2026-04-28 cs.SE 91%

Exploring Creativity in Human-Human-LLM Collaborative Software Design

探索人类-人类-LLM协作软件设计中的创造力

Victoria Jackson, Grischa Liebel, Rafael Prikladnicki, Andre van der Hoek

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究探讨了在软件设计任务中人类与LLM协作时创造力的产生与影响,发现人类设计师主导创造力,LLM提供新想法但可能阻碍创造力,强调人类洞察力的重要性。

Comments Accepted into EASE 2026, 9-12 June, 2026, Glasgow, Scotland, United Kingdom

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24118 2026-04-28 cs.CR 91%

AgentVisor: Defending LLM Agents Against Prompt Injection via Semantic Virtualization

AgentVisor: 通过语义虚拟化防御LLM代理的提示注入

Zonghao Ying, Haozheng Wang, Jiangfan Liu, Quanchen Zou, Aishan Liu, Jian Yang, Yaodong Yang, Xianglong Liu

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出AgentVisor框架,通过语义权限分离防御LLM代理的提示注入攻击,结合经典操作系统安全原语设计审计协议,并引入自修正机制,实验表明其在安全性和实用性上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16182 2026-04-28 cs.CR cs.CL 90%

DualGuard: Dual-stream Large Language Model Watermarking Defense against Paraphrase and Spoofing Attack

DualGuard: 双流大语言模型水印防御对抗同义词和伪装攻击

Hao Li, Yubing Ren, Yanan Cao, Yingjie Li, Fang Fang, Shi Wang, Li Guo

机构 * Institute of Information Engineering, Chinese Academy of Sciences(信息工程研究所,中国科学院) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络与信息安全学院) Institute of Computing Technology, Chinese Academy of Sciences(计算技术研究所,中国科学院)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL

AI总结 DualGuard通过双流水印机制有效防御同义词和伪装攻击,提升水印检测的可靠性与可追溯性,实验表明其在多数据集和语言模型上的检测性、鲁棒性和文本质量均表现优异。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15840 2026-04-28 cs.LO cs.FL 90%

Automatic Generation of Safety-compliant Linear Temporal Logic via Large Language Model: A Self-supervised Framework

基于大语言模型的自动安全合规线性时序逻辑生成:一种自监督框架

Junle Li, Siqi Chen, Jiakai Li, Meiqi Tian, Bingzhuo Zhong

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文提出AutoSafeLTL框架,利用大语言模型自动生成符合安全限制的LTL规范,通过语言包含检查与自动反例引导修改机制确保逻辑一致性和语义准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24703 2026-04-28 cs.SE cs.AI 90%

Defective Task Descriptions in LLM-Based Code Generation: Detection and Analysis

基于大语言模型的代码生成中的缺陷任务描述:检测与分析

Amal Akli, Mike Papadakis, Maxime Cordy, Yves Le Traon

机构 * University of Luxembourg(卢森堡大学)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出SpecValidator,通过轻量级模型检测任务描述缺陷,结果显示其在检测准确性与鲁棒性上优于其他模型,揭示了任务描述结构对LLM性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23283 2026-04-28 cs.LG 90%

Revisable by Design: A Theory of Streaming LLM Agent Execution

为设计而可逆:流式LLM代理执行的理论

Zhiyuan Zhai, Ming Li, Xin Wang

机构 * Fudan University(复旦大学) Guangming Lab(光明实验室)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.LG

AI总结 本文提出流式LLM代理执行的可逆性理论,通过定义可逆性分类,证明冲突可逆动作导致不可满足性,提出修订吸收器算法提升执行灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22888 2026-04-28 cs.CR cs.AI 90%

RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

RouteGuard: LLM代理中技能中毒的内部信号检测

Wenjie Xiao, Xuehai Tang, Biyu Zhou, Songlin Hu, Jizhong Han

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出RouteGuard,通过响应条件注意力和隐藏状态对齐检测LLM代理中的技能中毒,实验证明其在真实和合成数据上表现优异,有效恢复被词法筛选遗漏的攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24608 2026-04-28 cs.IR cs.AI cs.CL 90%

Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models

基于大语言模型的注意力重排序中查询依赖的头部选择学习

Yuxing Tian, Fengran Mo, Zhiqi Huang, Weixu Zhang, Jian-Yun Nie

机构 * McGill University \& MILA Montreal Canada McGill University \& MILA

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出RouteHead方法,通过学习轻量级路由器选择最优头部集合以提升注意力重排序性能,实验表明优于现有基线。

Comments Accepted by SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07011 2026-04-28 stat.ME stat.AP 89%

Recovering manifold structure in LLM responses through a joint Euclidean mirror

通过联合欧几里得镜面恢复LLM响应中的流形结构

Maximilian Baum, Aranyak Acharyya, Tianyi Chen, Avanti Athreya, Youngser Park, Francesco Sanna Passino, Carey E. Priebe, Zachary Lubberts

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文通过联合欧几里得镜面分析LLM响应分布的变化,揭示模型参数与响应分布之间的几何关系,提出估计镜面和推断模型参数的方法,用于预测不同调参下的响应分布。

Comments 13 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23579 2026-04-28 cs.MM 87%

CineAGI: Character-Consistent Movie Creation through LLM-Orchestrated Multi-Modal Generation and Cross-Scene Integration

CineAGI:通过LLM协同多模态生成与跨场景整合实现角色一致的电影创作

Tianyidan Xie, Zhentao Huang, Mingjie Wang, Xin Huang, Jun Zhou, Minglun Gong, Zili Yi

专题命中 其他LLM :LLM(title,title_cn)

AI总结 CineAGI通过多代理叙事合成模块、角色中心流水线和分层音视频同步机制,提升电影创作的一致性和质量,实现40%的整体一致性提升。

Comments Accepted to ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22773 2026-04-28 cs.HC 87%

Trace Mutation in Human-LLM Dialogue: The Transcript as Forensic and Mitigation Surface

人类-大语言模型对话中的痕迹突变: transcripts作为取证与缓解表面

William J. Bensen

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究探讨了人类-LLM对话中'痕迹突变'现象,分析了两种突变形式及其对对话连续性的影响,指出其与编造和阿谀不同,且难以通过常规对话修复机制解决。

Comments 15 pages, 2 figures, 6 tables. Submitted to CHIWORK 2026 as Late-Breaking Work. Supplementary data: https://doi.org/10.5281/zenodo.19153940

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16888 2026-04-28 cs.CR cs.AI cs.CL 85%

PARASITE: Conditional System Prompt Poisoning to Hijack LLMs

PARASITE: 条件系统提示污染以劫持大语言模型

Viet Pham, Thai Le

机构 * Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 其他LLM :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PARASITE通过条件系统提示污染技术,使LLM在特定查询下输出被篡改响应,同时保持正常输入的高实用性,且在黑盒环境下实现70%的F1降级。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24178 2026-04-28 cs.LG cs.AI 82%

Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment

Meta-Aligner: 多目标大语言模型对齐的双向偏好-策略优化

Wenzhe Xu, Biao Liu, Yiyang Sun, Xin Geng, Ning Xu

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Meta-Aligner框架,通过双向优化偏好与策略响应,生成动态偏好以提升训练稳定性,实验证明其在多目标基准上的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22776 2026-04-28 cs.CY cs.AI cs.LG 82%

Epicure: Multidimensional Flavor Structure in Food Ingredient Embeddings

Epicure:食品成分嵌入中的多维风味结构

Jakub Radzikowski, Josef Chen

专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 本文通过FlavorGraph的300维嵌入揭示了风味、质地、地理和文化等多维风味结构,并通过LLM增强的管道整合了6653种原料,提升了可恢复结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24082 2026-04-28 cs.CR cs.AI cs.CL 81%

Jailbreaking Frontier Foundation Models Through Intention Deception

通过意图欺骗突破前沿基础模型

Xinhe Wang, Katia Sycara, Yaqi Xie

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他LLM :foundation model(title);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种多轮欺骗方法,通过模拟良性意图和模型一致性,引导模型生成有害输出,并揭示了未被注意到的para-jailbreaking漏洞。

Comments Accepted at CVPR 2026 Findings Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18337 2026-04-28 cs.SE 80%

CoRaCMG: Contextual Retrieval-Augmented Framework for Commit Message Generation

CoRaCMG:基于上下文检索的提交信息生成框架

Bo Xiong, Linghao Zhang, Zongen Ren, Chong Wang, Peng Liang

专题命中 其他LLM :LLM(summary_cn,abstract)

AI总结 本文提出CoRaCMG框架,通过检索相似diff-消息对增强LLM生成提交信息的精度和信息量,实验表明其在BLEU、ROUGE-L、METEOR和CIDEr四项指标上显著提升性能。

Comments Preprint accepted for publication in Information and Software Technology, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23248 2026-04-28 cs.CR cs.HC 80%

PrivacyAssist: A User-Centric Agent Framework for Detecting Privacy Inconsistencies in Android Apps

PrivacyAssist:一种以用户为中心的代理框架,用于检测Android应用程序中的隐私不一致

Tran Thanh Lam Nguyen, Edoardo Di Tullio, Barbara Carminati, Elena Ferrari

专题命中 其他LLM :LLM(summary_cn,abstract)

AI总结 PrivacyAssist通过多代理LLM平台检测用户授权权限与开发者声明的敏感数据收集共享实践之间的不一致,提供简洁解释和实时警告以支持明智安装决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15483 2026-04-28 cs.LG cs.RO 79%

$π_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities

$π_{0.7}$: 一种可定向的通用机器人基础模型与涌现能力

Physical Intelligence, Bo Ai, Ali Amin, Raichelle Aniceto, Ashwin Balakrishna, Greg Balke, Kevin Black, George Bokinsky, Shihao Cao, Thomas Charbonnier, Vedant Choudhary, Foster Collins, Ken Conley, Grace Connors, James Darpinian, Karan Dhabalia, Maitrayee Dhaka, Jared DiCarlo, Danny Driess, Michael Equi, Adnan Esmail, Yunhao Fang, Chelsea Finn, Catherine Glossop, Thomas Godden, Ivan Goryachev, Lachlan Groom, Haroun Habeeb, Hunter Hancock, Karol Hausman, Gashon Hussein, Victor Hwang, Brian Ichter, Connor Jacobsen, Szymon Jakubczak, Rowan Jen, Tim Jones, Gregg Kammerer, Ben Katz, Liyiming Ke, Mairbek Khadikov, Chandra Kuchi, Marinda Lamb, Devin LeBlanc, Brendon LeCount, Sergey Levine, Xinyu Li, Adrian Li-Bell, Vladislav Lialin, Zhonglin Liang, Wallace Lim, Yao Lu, Enyu Luo, Vishnu Mano, Nandan Marwaha, Aikys Mongush, Liam Murphy, Suraj Nair, Tyler Patterson, Karl Pertsch, Allen Z. Ren, Gavin Schelske, Charvi Sharma, Baifeng Shi, Lucy Xiaoyang Shi, Laura Smith, Jost Tobias Springenberg, Kyle Stachowicz, Will Stoeckle, Jiaming Tang, Jimmy Tanner, Shalom Tekeste, Marcel Torne, Kyle Vedder, Quan Vuong, Anna Walling, Haohuan Wang, Jason Wang, XuDong Wang, Chris Whalen, Samuel Whitmore, Blake Williams, Charles Xu, Sukwon Yoo, Lili Yu, Wuming Zhang, Zhuoyang Zhang, Ury Zhilinsky

机构 * Physical Intelligence

专题命中 其他LLM :foundation model(title,abstract);分类 cs.LG

AI总结 $π_{0.7}$通过多样化的上下文条件训练,实现跨环境任务执行与零样本泛化,支持多阶段任务和复杂操作,如咖啡机操作,性能媲美专门强化学习微调模型。

Comments Website: https://www.pi.website/blog/pi07

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17703 2026-04-28 cs.MA 78%

Why Are We Moral? An LLM-based Agent Simulation Approach to Study Moral Evolution

为什么我们有道德?一种基于大语言模型的智能体模拟方法研究道德进化

Zhou Ziheng, Huacong Tang, Mingjie Bi, Yipeng Kang, Wanying He, Fang Sun, Yizhou Sun, Ying Nian Wu, Demetri Terzopoulos, Fangwei Zhong

专题命中 其他LLM :LLM(title,abstract)

AI总结 本文通过基于大语言模型的智能体模拟方法,探讨道德进化中的合作与互惠机制,发现普遍互惠道德在不同条件下表现稳定,而利己行为被强烈排斥,同时认知因素在道德演化中起关键作用。

Comments Accepted at ACL 2026 Main Conference. 51 pages including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18576 2026-04-28 cs.RO 71%

DriVerse: Navigation World Model for Driving Simulation via Multimodal Trajectory Prompting and Motion Alignment

DriVerse:通过多模态轨迹提示和运动对齐实现驾驶模拟的导航世界模型

Xiaofan Li, Chenming Wu, Zhao Yang, Zhihao Xu, Dingkang Liang, Yumeng Zhang, Ji Wan, Jun Wang

机构 * Baidu Inc.(百度公司)

专题命中 其他LLM :prompting(title)

AI总结 DriVerse通过多模态轨迹提示和运动对齐技术,实现从单张图像和未来轨迹生成导航驱动的驾驶场景,提升了动态对象的生成精度和时间一致性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17736 2026-04-28 cs.HC cs.AI 70%

From Static to Interactive: Authoring Interactive Visualizations via Natural Language

从静态到交互:通过自然语言实现交互式可视化

Can Liu, Jaeuk Lee, Tianhe Chen, Zhibang Jiang, Xiaolin Wen, Yong Wang

机构 * Nanyang Technological University(南洋理工大学) Ajou University(阿乔大学) Providence Health & Services(普罗维登斯健康与服务)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Athanor方法,利用多模态大语言模型和自然语言指令将静态可视化转为交互式,通过三种创新设计提升用户交互体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03191 2026-04-28 cs.CL 70%

CLIX: Cross-Lingual Explanations of Idiomatic Expressions

CLIX: 习语的跨语言解释

Aaron Gluck, Katharina von der Wense, Maria Leonor Pacheco

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) Johannes Gutenberg University Mainz(美因茨约翰尼斯·古腾堡大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究提出CLIX任务,探讨NLP模型在生成习语跨语言解释中的能力,发现大语言模型有潜力,但需进一步解决错误分析中的关键挑战。

Comments Accepted to Findings of ACL 2025

Journal ref Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23892 2026-04-28 cs.PF cs.SE 67%

Optimas: An Intelligent Analytics-Informed Generative AI Framework for Performance Optimization

Optimas: 一种基于智能分析的生成式AI框架,用于性能优化

Mohammad Zaeed, Tanzima Z. Islam, Vladimir Indic

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 Optimas通过多代理工作流构建的端到端生成式AI框架,实现了自动化代码优化,通过性能诊断映射到文献支持的代码转换,提升了代码正确性和性能效率。

Comments 11 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17092 2026-04-28 cs.CV 67%

SPAGS: Sparse-View Articulated Object Reconstruction from Single State via Planar Gaussian Splatting

SPAGS:基于单一状态的稀疏视角关节物体重建(通过平面高斯溅射)

Di Wu, Liu Liu, Xueyu Yuan, Wenxiao Chen, Lijun Yue, Liuzhu Chen, Yiming Tang, Meng Wang

机构 * Hefei University of Technology(合肥工业大学) Tencent RoboticsX(腾讯机器人院)

专题命中 其他LLM :language model(abstract);prompting(abstract)

AI总结 本文提出一种无需多视角观测的关节物体重建方法,通过平面高斯溅射实现稀疏视角下的高精度重建,结合视觉-语言模型实现开放词汇部分分割与参数估计。

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12084 2026-04-28 econ.GN q-fin.EC 67%

Geopolitical Barriers to Globalization

地缘政治对全球化的影响

Tianyu Fan, Mai Wo, Wei Xiang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 地缘政治恶化抵消了关税自由化促进贸易的效果,导致2007年后贸易全球化放缓,双边地缘政治对齐提升可使贸易增长22%,福利效应不均。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23340 2026-04-28 cs.SE 67%

Can LLMs be Effective Code Contributors? A Study on Open-source Projects

LLMs能否成为有效的代码贡献者?对开源项目的研究

Chun Jie Chong, Muyeed Ahmed, Zhihao, Yao, Iulian Neamtiu

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文研究了LLMs在开源项目中的代码贡献效果,通过评估框架发现LLMs在修复bug和添加功能时成功率低,存在语法错误和测试失败等问题,主要贡献是提出评估方法和改进建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23299 2026-04-28 cs.HC cs.MA 67%

Proteus: Shapeshifting Desktop Visualizations for Mobile via Multi-level Intelligent Adaptation

Proteus:通过多级智能适应实现移动端的桌面可视化变形

Can Liu, Sizhe Cheng, Feng Liang, Zhibang Jiang, Lingru Huang, Kavinda Athapaththu, Yong Wang

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 Proteus通过多级智能适应技术,自动将桌面可视化转换为移动端可读的可视化,解决移动端屏幕尺寸和交互方式差异导致的显示问题。

Comments accepted by ACM Designing Interactive Systems Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18771 2026-04-28 cs.SE 67%

Does AI Code Review Lead to Code Changes? A Case Study of GitHub Actions

AI代码审查是否导致代码更改?GitHub动作的案例研究

Kexin Sun, Hongyu Kuang, Sebastian Baltes, Xin Zhou, He Zhang, Xiaoxing Ma, Guoping Rong, Dong Shao, Christoph Treude

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文通过分析GitHub动作中的16种AI代码审查工具,探讨其使用情况、评论是否引发代码更改以及影响有效性因素,发现简洁、包含代码片段且手动触发的评论更可能引发更改。

详情

展开后加载摘要…

URL PDF HTML 收藏