How Robust are LLM-Generated Library Imports? An Empirical Study using Stack Overflow
机构 * Concordia University(康科迪亚大学)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
机构 * Concordia University(康科迪亚大学)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
机构 * EPFL(苏黎世联邦理工学院)
专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)
Comments 42 pages, 16 figures
机构 * Department of Electrical Engineering(电气工程系) ; Department of Neurological Surgery(神经外科系) ; Mortimer B. Zuckerman Mind Brain Behavior Institute(莫提默·B·祖克曼心智-脑-行为研究所) ; Hofstra Northwell School of Medicine(霍夫曼斯特拉北well医学院) ; The Feinstein Institutes for Medical Research(费森特医学研究所) ; Neurology Department(神经病学系)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)
Comments Accepted by ACL 2025 Main Conference
专题命中 其他LLM :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments 9 pages, 5 figures, 1 table
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments Accepted by ICSE'25
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
Journal ref 38th Conference on Neural Information Processing Systems (NeurIPS 2024)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)
Comments EMNLP 2024 Industry Track Accepted (Camera-Ready Version)
专题命中 其他LLM :prompting(title,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.CL、cs.AI
Comments Foundation Models, Large Language Models, Arabic NLP, LLMs, Native, Contextual Understanding, Arabic LLM
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)
Comments ICML 2024, 8 pages + appendix
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
Comments Preprint to be published in the MODELS Workshop "MDE Intelligence"
屈服还是信服:时序采样门控视频大语言模型的主张依从性
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 该研究针对视频大语言模型的两种失败情况,区分了可用性与权重两个原因,提出反转测试缓解屈服于错误主张的问题,提升了顺序准确率并使模型可弃权而非猜测。
Comments 11 pages, 2 figures
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
针对视频大语言模型中提示引导采样的投毒攻击
机构 * National University of Singapore(新加坡国立大学) ; University of New South Wales(新南威尔士大学) ; CSIRO’s Data61(CSIRO数据61)
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 该研究针对视频大语言模型的提示引导采样提出PoisonVID投毒攻击,在多种模型与采样器组合上实现高攻击成功率,揭示了PGS存在的结构性安全隐患。
Comments 16 pages, 5 figures
从联合国投票数据估计大语言模型的地缘政治偏好
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 研究如何从联合国投票数据估计大语言模型的地缘政治偏好,采用动态序数理想点方法,将模型视为对相关决议全文的回应者,得出不同模型支持率及与五常关系等结果,发现模型地缘政治立场与开发者母国可能不同。
SkyVLaM:用于遥感中无人机视频理解的多模态大语言模型
机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ; Peking University(北京大学) ; Beijing Wuzi University(北京物资学院)
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 针对无人机视频理解任务,提出多模态大语言模型SkyVLaM,通过时间基感知器构建稀疏令牌,正则化稀疏基,自适应选择密集段,联合大语言模型处理,还构建SkyVid,实验证明其能有效分配视觉令牌预算,提升语言条件视频分割效果。
Comments Accepted by WAICA 2026
利用设计感知上下文在大语言模型中生成代码注释
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本研究探讨利用设计文档作为上下文,通过大语言模型生成更实用的代码注释,以提高代码维护效率。
双BEATs:通过抖动在音频大语言模型中解锁零样本立体声音频感知
机构 * Institute of Information Science, Academia Sinica(台湾中央研究院资讯科学研究所)
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 研究针对多模态大语言模型空间感知局限,提出双BEATs架构,通过在编码前注入抖动噪声解决归一化问题,在三元方向分类任务中验证该方法有出色空间分辨率且能零样本泛化,证明标准模型经正则化可实现广义立体声音频理解。
Comments 14 pages, 3 figures
歧视性合规:LLM如何回答来自受保护群体的查询
专题命中 其他LLM :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract)
AI总结 研究LLM在回答受保护群体用户查询时表现出的歧视性合规现象,发现模型对少数群体身份角色提供的信息不一致且缺失关键信息。
评估大型语言模型对SQL的理解能力
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本文评估大型语言模型在SQL任务中的理解能力,通过检测语法错误、识别缺失token、预测查询性能等任务,揭示模型在语义理解和连贯性方面的局限。
Comments 12 pages conference submission
Journal ref Proc. EDBT 2025, pp. 909-921, 2025
闭环双向提示用于视觉语言模型的对抗鲁棒性
机构 * University of Macau(澳门大学) ; Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院) ; Peking University(北京大学) ; Independent Researcher(独立研究员) ; Institute of Science Tokyo(东京科学研究院) ; Morgan Stanley(摩根大通) ; Halmstad University(哈马碧大学)
专题命中 其他LLM :language model(title,abstract);prompting(title,abstract)
AI总结 针对视觉语言模型在对抗扰动下跨模态语义对齐脆弱的问题,提出闭环双向提示方法,通过动态反馈循环恢复跨模态一致性,并引入语义锚点约束循环更新,实现实例自适应保护,在11个数据集上达到最先进的鲁棒性和泛化性能。
Comments 24 pages, 8 figures
利用大语言模型重建大规模时间多关系企业网络:半导体行业案例
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本文利用大语言模型和开放网络数据重建半导体行业企业网络,识别供应链、合作关系和所有权链接,揭示2022年芯片短缺期间的网络变化及AI供应链瓶颈企业的中心性变化。
Comments 32 pages, 5 figures
学习你需要看到的东西:多模态大语言模型的注视注意力
机构 * NAVER AI Lab(NAVER AI实验室)
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本文提出Gaze Attention机制,使多模态大语言模型在生成过程中选择性关注任务相关的视觉区域,减少冗余计算并提升聚焦效果,实验表明其在图像和视频理解任务中性能优于密集注意力基线。
多模态模型中的跨模态后门
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 研究提出一种利用轻量级连接器漏洞的跨模态后门攻击,通过污染连接器实现跨模态后门激活,展示攻击的有效性和可迁移性,揭示多模态对齐中的基本漏洞。
通过种群化扩大大型语言模型毒性搜索
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本文提出ToxSearch-S,通过种群化方法在大型语言模型中扩展毒性搜索,提高毒性峰值并扩大语义覆盖范围,同时在嵌入空间中形成行为差异化的niche。
Comments Preprint. 4 pages, Accepted at GECCO as short paper
Assertain:利用大语言模型实现自动安全断言生成
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本文提出Assertain框架,通过RTL分析、CWE映射和威胁模型智能,利用大语言模型生成安全属性和可执行SystemVerilog断言,提升硬件安全验证效率与准确性。
Comments This paper will be presented at the 35th Microelectronics Design and Test Symposium (IEEE MDTS 2026)
面向基于logits的大语言模型水印的端到端模型
专题命中 其他LLM :large language model(title);language model(title);LLM(abstract);prompting(abstract)
AI总结 本文提出端到端logits扰动方法,提升大语言模型水印的鲁棒性与文本质量,在改写和下游任务中表现更优。
Togedule: 利用大语言模型和群体可用性自适应表示进行会议安排
专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)
AI总结 本文提出Togedule,一种利用大语言模型动态调整会议安排选项的工具,通过实验发现其能降低参会者认知负荷,提升组织者决策效率与质量。
Comments This paper has been accepted at CSCW 2025