Spotlight: Mobile UI Understanding using Vision-Language Models with a Focus
专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.LG
Comments Published as a conference paper at ICLR 2023
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.LG
Comments Published as a conference paper at ICLR 2023
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL
专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.LG
Comments 12 pages, 5 figures
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL
Journal ref EMNLP 2021 Findings
专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL
Comments 7 pages 7 figures. arXiv admin note: text overlap with arXiv:2103.14636 by other authors
专题命中 其他LLM :language model(title,abstract);SLM(abstract);分类 cs.LG
Comments Appeared in ICML'2020
专题命中 其他LLM :language model(title,abstract);SLM(abstract);分类 cs.CL
Comments Proceedings of ASRU 2001, 4 pages
专题命中 其他LLM :language model(title,abstract);large language model(abstract);foundation model(comments)
Comments 24 pages, 13 figures, submitted to Advanced Robotics Special Issue on Real-World Robot Applications of the Foundation Models
专题命中 其他LLM :foundation model(title,abstract);prompting(abstract)
Comments 4 pages,Forge 2024
Journal ref AI Foundation Models and Software Engineering (FORGE '24), April 14, 2024, Lisbon, Portugal
Aitomia:用于AI驱动的原子和量子化学模拟的智能助手
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG
AI总结 Aitomia结合LLM和MLatom平台,通过Gaussian、ORCA等接口支持AI驱动的原子模拟和传统量子化学计算,降低原子模拟门槛,推动相关领域研究。
在演绎推理中显式化隐含前提
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 本文提出了一种整合大型语言模型和神经符号推理器的管道,用于将隐含前提显式化并解码逻辑蕴含。
Comments Accepted at the 17th International Conference on Scalable Uncertainty Management (SUM 2026)
被遗漏的模式即罕见规则:连续代码世界模型中的采样-验证危险定律
机构 * AGILabs
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG
AI总结 该研究揭示连续代码世界模型中采样-验证机制的危险,通过理论分析与实验发现,LLM合成的模式盲模型易被利用,接受仅能证明样本一致性,无法保证连续控制任务的性能。
Comments 92 pages, 5 figures. Code, data and result artifacts: https://github.com/JaviMaligno/code-world-models
当AI设计AI:创新还是模仿?
机构 * University of Chinese Academy of Sciences(中国科学院大学) ; Northwestern University(西北大学)
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG
AI总结 该研究对比LLM智能体与人类设计AI方法的性能和算法差异,发现智能体偶达SOTA但无法泛化,96.8%的设计属人类推导空间,多为算法选择的复用重组。
当个性化成为偏见:AI生成金融建议中的结构性与话语性宗教框架
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究通过432次模拟互动分析3种LLMs在金融建议中的宗教偏见,揭示其结构性与话语性偏见机制,提出双维度框架并指出个性化与中立性的管理困境及相关启示。
Comments 50 pages
SkillComposer:学习可复用技能的自然语言机器人编程系统
机构 * School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 SkillComposer是一款仿真环境下的交互式自然语言机器人编程系统,采用生成-测试架构,通过在线库学习算法生成可复用宏技能,经实验验证可提升任务成功率与可用性并减少用户工作量。
Comments 8 pages, 6 figures. Submitted to IEEE Humanoids 2026
用于合成约束多目标先导化合物优化的模块化智能体框架
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG
AI总结 本研究提出开源模块化智能体框架SABLE,结合LLM与专用工具实现合成约束下的多目标先导化合物优化,可高效富集符合计算目标的候选集,为早期药物发现提供决策支持。
Comments 22 pages, 9 figures
AgentSnare:学习延迟、转移和瓦解自主渗透智能体
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 AgentSnare是一种轨迹自适应欺骗系统,通过动态构建诱饵环境,吸收渗透智能体工具调用、转移其轨迹并瓦解攻击,在CVE-Bench实验中成功阻止了所有真实目标被利用。
引导向量的安全代价是可分离且可降低的
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.CL、cs.LG
AI总结 本研究针对引导向量破坏LLM安全机制的问题,通过识别并移除其安全退化分量,提出带约束的原始对偶优化方法,可在保留引导效果的同时大幅降低安全退化。
Comments COLM 2026
结合衰减奖励的渐进式内容优化与联合LinUCB
机构 * Rakuten Group, Inc.(乐天集团)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 针对现有迭代优化方法忽略奖励衰减导致过度利用的问题,提出结合奖励衰减建模与EM算法的联合LinUCB算法,在Sentiment Reversal和GSM8K基准上显著优于强基线。
DualAnchor:无注释手语翻译中保留语言先验并提升词汇保真度
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 针对现有无注释手语翻译方法的语言先验退化与词汇保真度差距问题,提出结合TPA和OTA的DualAnchor框架,在两个基准数据集上取得良好性能。
自动化强化学习:综述
机构 * Eindhoven University of Technology(埃因霍温理工大学) ; Jheronimus Academy of Data Science(赫尔蒙尼乌斯数据科学学院) ; Shandong University(山东大学)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本文综述了自动化强化学习的发展,包括基于大语言模型的技术,并探讨了其挑战和未来研究方向。
白盒敏感性审计与引导向量
机构 * University of Virginia(弗吉尼亚大学)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 本文提出白盒敏感性审计框架,通过激活引导进行更严格的模型内部评估,用于检测大语言模型中的偏见,揭示模型对保护属性的依赖。
Comments Accepted to Transactions on Machine Learning Research (TMLR)
SOLAR: AI驱动的光速性能分析
机构 * NVIDIA(英伟达)
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG
AI总结 提出SOLAR框架,自动从PyTorch和JAX代码推导理论最小执行时间(光速界限),通过LLM前端和确定性分析实现无违反界限的多保真度性能分析。
SAGE: 保留感知的最终遗忘向量事后净化
机构 * Institute of Image Processing and Pattern Recognition, Shanghai Jiao Tong University(上海交通大学图像处理与模式识别研究所)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 提出SAGE方法,通过事后净化最终更新向量,在不重新运行原始遗忘流程的情况下,缓解大语言模型遗忘与保留能力之间的权衡。
基于上下文学习的深度学习工作负载迁移智能体框架
机构 * Google(谷歌)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 提出结合上下文学习与Oracle驱动的自调试的自主系统,实现从PyTorch到JAX的深度学习模型自动迁移,在神经模块上达到91%数值等价性。
多语言机器生成文本的作者归属
机构 * DIMES Department, University of Calabria(卡利博大学DIMES系) ; Kempelen Institute of Intelligent Technologies(智能技术研究所)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 提出多语言作者归属问题,研究单语言方法在18种语言和8个生成器上的跨语言迁移能力,发现显著局限。
Comments Accepted at ACL 2026 - Main
人类与AI生成语言的动态:语义如何在不同时间尺度上波动
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 提出语义时间尺度分析流程,通过自相关窗口度量(ACW-0)量化人类与AI生成语音中语义特异性与上下文相似性的时间组织,发现ACW-0长度与词汇通用性相关,且该关联在随机化后被削弱。
Comments 45 pages, 4 figures, 4 tables. Accepted manuscript; published in Computer Speech & Language
Journal ref Computer Speech & Language (2026) 102013
监督具有容量:将智能体守卫校准到主观且易疲劳的人类
专题命中 其他LLM :LLM(summary_cn,abstract);分类 cs.AI、cs.LG
AI总结 针对LLM智能体动作审批中人类评审者主观且易疲劳的问题,提出将守卫建模为成本敏感的选择性分类,并引入负载感知策略,发现过度监督反而降低安全性,形成倒U型曲线。
Comments 12 pages, 4 figures. Code and interactive demo: https://github.com/turangenesis/headroom
针对终端代理的技能注入攻击的防御与使能因素
机构 * Patronus AI ; NVIDIA
专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 研究基于大语言模型的代理在重用技能时面临的安全威胁,提出守护者防御(动态和静态)将攻击成功率降低过半,并测试了攻击重述的鲁棒性。
Comments First version, small updates and clarifications likely in v2