Gender Bias in Machine Translation and The Era of Large Language Models
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI
Comments 24 pages
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.AI
Comments 24 pages
专题命中 其他LLM :large language model(title);language model(title);分类 cs.CL、cs.LG
专题命中 其他LLM :language model(title,abstract);foundation model(abstract,comments);分类 cs.LG;large language model(comments)
Comments Proceedings of ICML 2025 Workshop on Multi-modal Foundation Proceedings of ICML 2025 Workshop on Multi-modal Foundation Proceedings of ICML 2025 Workshop on Multi-modal Foundation Models and Large Language Models for Life Sciences
SapiensID 2.0:将人类识别基础模型与人类感知对齐
专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract)
AI总结 该研究针对现有人类识别模型与人类感知脱节的问题,提出兼具语义与时间感知的SapiensID 2.0框架,通过多项技术实现最优识别性能。
Transformer解释器:通过交互式可视化解释与实验学习大型语言模型Transformer
专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 针对非专家难以学习Transformer的问题,本文推出交互式可视化工具Transformer Explainer,可在浏览器运行GPT-2实例支持实验,经90人研究验证其提升理解与参与度的优势,已获超49万用户使用。
Comments CHI 2026 full paper. Extended version of the 2-page paper presented at IEEE VIS 2024, which won Best Poster Award and remains available as arXiv v1. Project page: https://poloclub.github.io/transformer-explainer/
Journal ref CHI '26: Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems, Article 7 (2026), 21 pages
对抗性错误报告:基于语言模型的自动程序修复中的安全风险
专题命中 其他LLM :language model(title,abstract);LLM(abstract);large language model(abstract)
AI总结 本文研究对抗性错误报告对基于大语言模型的自动程序修复系统的安全威胁,通过实证分析发现现有防御措施不足,并提出自动化生成对抗性错误报告的原型框架。
超越对话:虚拟现实中大型语言模型辅助几何编辑中用于意图消歧的空间锚定预览
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究虚拟现实中大型语言模型辅助几何编辑的意图消歧问题,通过结合澄清问题与空间锚定图形预览的混合方法,经实验验证其能提升交互稳定性、改善用户体验,为相关系统集成提供设计依据。
Comments Under review
用于漏洞发现的定向符号执行:KLEE中基于大语言模型的方法
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究针对符号执行的路径爆炸问题,提出基于KLEE的KLEECopilot方法,用大语言模型引导定向符号执行,标记潜在漏洞代码、指导路径优先级并集成循环退出优先级,相比基线提升显著,各组件对有效性有贡献。
从结果到行动:利用事后诸葛亮进行长期语言智能体训练
专题命中 其他LLM :language agent(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究长期语言智能体训练中现有强化学习方法面临的挑战,提出事后诸葛亮策略优化方法,通过投影到意图空间提取低方差学习信号,聚合相似状态和行动,理论和实证证明可稳定提升策略性能。
Comments Accepted at ICML 2026
基于知识的合成错误反馈用于基于大语言模型的单元测试生成
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究如何将历史真实错误机制转化为可执行反馈目标用于基于大语言模型的单元测试生成,提出相应框架,在Defects4J任务上评估,结果显示该机制引导的合成错误反馈能提高真实错误检测率,是引导测试的有效方式。
Comments 12 pages, 7 figures, 6 tables. Preprint
RISKTAGGER:用于Web3中洗钱事件后法医分析的证据引导大语言模型智能体
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 针对Web3加密货币洗钱法医分析面临的挑战,提出RISKTAGGER,将大语言模型作为证据约束决策组件,从公共事件材料提取线索,递归扩展资金流图并生成报告。经多案例评估,能恢复资金路径、识别风险账户,组织证据成可验证报告。
Comments 11 pages(main text), 6 figures
网络欺诈中心理操纵的取证模式:基于大语言模型驱动的受害者报告分析
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究网络欺诈中心理操纵取证模式,提出含四类35个问题的模式,增加相关指标和字段。经大语言模型驱动注释及与人类注释者验证,揭示欺诈类型操纵特征,发现取证细节差距,指出人工智能辅助及分层注释策略可缩小差距并提供模板。
Comments Accepted by the 23rd International Conference on Privacy, Security and Trust (PST 2026)
网络物理系统软件工程的基础模型:未来之路
专题命中 其他LLM :foundation model(title,abstract);large language model(abstract);language model(abstract)
AI总结 探讨基础模型在网络物理系统软件工程中的应用,指出除语言模型外其他模型潜力大。通过文献等得出前瞻性研究路线图,突出挑战与机会,还讨论了应用模型的常见挑战,为研究和实践提供指导。
Comments 3 figures, 20 tables, 53 pages
基于Transformer的语言模型中下一个词预测的泛化界
专题命中 其他LLM :language model(title,abstract);LLM(abstract,abstract_cn)
AI总结 针对文本数据特性,提出基于对数双线性语言模型扩展的数据分布,推导深度Transformer架构的泛化界,揭示其对网络结构、词汇量、文档数和文档长度的依赖。
提示顺序中的迷失:揭示语言模型因果注意力的局限性
机构 * POSTECH(POSTECH大学) ; HJ AILAB(HJ人工智能实验室)
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究揭示了语言模型对提示顺序的敏感性,通过系统分析发现因果注意力是核心机制,指出在多项选择问答中,上下文先于问题和选项的顺序能提升性能14%以上。
Comments ACL 2026 findings
通过选举领导力评估大语言模型社交群体中的合作
机构 * Jinesis Lab, University of Toronto \& Vector Institute(谷歌DeepMind) ; Google DeepMind ; ETH Z\" u rich ; Max Planck Institute for Intelligent Systems, T\" u bingen, Germany
专题命中 其他LLM :LLM(title,abstract_cn);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文通过多智能体模拟研究选举领导机制对大语言模型合作与社会福利的影响,实验显示选举领导能提升社会福利评分和生存时间。
Comments Main text: 11 pages, 4 figures, 4 tables
一个模型解决所有问题:通过LLM启发的双向 Tweedie 扩散实现任意姿态的统一试穿与试脱
机构 * Sun Yat-sen University(中山大学) ; Guangdong Key Laboratory of Big Data Analysis and Processing(广东大数据分析与处理重点实验室) ; X-Era AI Lab(X-Era人工智能实验室)
专题命中 其他LLM :LLM(title,title_cn);language model(abstract)
AI总结 本文提出OMFA模型,通过双向Tweedie扩散实现无需展示服装的试穿试脱,支持任意姿态,提升实际应用中的灵活性和实用性。
在开源大语言模型社区中识别颠覆性模型
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究通过构建大规模模型继承网络,提出模型颠覆指数(MDI),揭示开源LLM社区中大多数模型为巩固性而非颠覆性,强调大规模模型和微调策略更易产生颠覆性模型。
Comments 12 pages, 5 figures
增强的基于知识论的LLM对话自学习
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出CausaDisco系统,通过整合亚里士多德的四因框架,提升LLM在自学习中的认知支持,通过实验表明其能促进更深入的学习互动和多维度视角。
Comments Submitted to IJHCI
揭示计算机:通过反思对话实现的LLM中介计算
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出LLM中介计算新范式,通过反思对话实现动态交互,引入后现象学视角分析人与LLM-计算机关系,并提出基于共揭示的计算模式。
Comments CHI'26
通过e过程实现在线LLM水印检测
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出基于e过程的LLM水印检测框架,提供在线测试的 anytime-valid 保证,并通过实验验证其检测性能。
你的代理是我的:测量对LLM供应链的恶意中间人攻击
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 研究针对LLM供应链中恶意中间人攻击的系统性分析,提出两种核心攻击类型及适应性规避变种,通过实验发现多个路由器存在恶意注入和秘密外泄行为,并评估了三种客户端防御措施。
TRUSTDESC: 通过可信描述生成防止LLM应用中的工具污染
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 TRUSTDESC通过生成可信工具描述防止LLM中的工具污染攻击,采用三阶段流程提取代码片段、生成描述并动态验证,提升任务完成率并抑制隐式攻击。
网络游戏:基于人格驱动的LLM代理在网络游戏中模拟合作
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出NetworkGames框架,通过LLM代理和几何深度学习研究网络结构与人格异质性对集体福利的影响,发现网络连通性和人格分布共同决定合作行为。
REAgent:基于需求的LLM代理用于软件问题解决
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出REAgent框架,通过引入问题导向的需求作为结构化任务规范,提升补丁生成准确性,实验表明其在问题解决率上平均提升17.40%。
数字瓶中的信息:关于LLM聊天机器人与青少年孤独的青少年视角
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文从青少年视角探讨LLM聊天机器人对不同亚群体孤独感的影响,提出三个敏感性设计建议,未来将通过多群体面板验证框架。
基于种群的语义进化用于LLM引导的自动程序修复
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出EvolRepair框架,通过语义进化算法提升LLM引导的自动程序修复效果,解决修复假设多样性、语义相关修复家族识别等挑战。
通过语义三角化减少LLM生成代码中的幻觉
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出语义三角化框架,通过将问题转换为需要不同算法的变体,提高代码正确性。实验显示,该方法在多个基准测试中提升了代码选择的正确率和F1分数。
网页增强型大语言模型代码生成中的搜索诱导问题:检测与修复误导页面
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文研究了网页增强型LLM代码生成中因误导页面导致的搜索诱导问题,提出Sherlock框架用于检测、调试和修复问题页面,提升系统可靠性。
Comments 12 pages, 5 figures
BRIDG-Q: 基于数据感知的大语言模型生成量子电路的 barren-plateau 抵抗初始化
专题命中 其他LLM :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 BRIDG-Q结合大语言模型生成的量子电路架构与经验贝叶斯参数初始化,提升变分量子算法的优化鲁棒性,实验表明数据驱动初始化在LLM生成电路中仍有效,可减少残余能量约10%。
Comments 14 pages, 2 figures