arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 366 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 366 篇

2606.28469 2026-07-09 cs.RO cs.HC 版本更新 67%

When May I Help You? On The Effect of Proactivity on Group Human-Robot Collaboration

我何时能帮你?主动性对群体人机协作的影响

Thomas Vitry, Vanessa Maeder, Kieran von Valeburg, Asihati Hazaiti, Doga Deniz Ates, Connor Gäde, Jan-Gerrit Habekost, Dennis Becker, Stefan Wermter

机构 * Knowledge Technology, University of Hamburg(汉堡大学知识技术研究所) Ecole Normale Superieure de Rennes(里昂大学)

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 研究在多人协作逃生室中,机器人采用反应式(仅被叫时响应)与主动式(持续监听并自主贡献)交互模型对协作效果的影响,发现主动模型增加交互频率但反应模型成功率更高,且用户先前经验和性格显著调节效果。

Comments Published at the RO-MAN 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29429 2026-07-07 cs.CV 版本更新 67%

One Click per Cell Type Suffices: Training-free Group Interaction for Cell Instance Segmentation

每细胞类型一次点击足矣:无需训练的组交互用于细胞实例分割

Sanghyun Jo, Seo Jin Lee, Seohyung Hong, Yoorim Gang, Hyeongsub Kim, Hyungseok Seo, Kyungsu Kim

机构 * OGQ, Korea(韩国OGQ) Seoul National University, Korea(韩国首尔国立大学) LG CNS, Korea(韩国LG CNS)

专题命中 其他LLM :foundation model(abstract);prompting(abstract)

AI总结 提出组提示范式,通过每细胞类型一次点击即可分割所有该类型实例,基于SAM冻结编码器的特征聚类性质,设计无需训练的Chain-of-Prompts框架递归扩展点击,在多个基准上保持高性能。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20619 2026-07-03 cs.SE 版本更新 67%

Generating Project-Specific Test Cases with Requirement Validation Intention

生成具有需求验证意图的项目特定测试用例

Binhang Qi, Yun Lin, Xinyi Weng, Yuhuan Huang, Chenyan Liu, Hailong Sun, Zhi Jin, Jin Song Dong

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出IntentionTest方法,通过检索-编辑方式,根据验证意图描述生成项目特定测试,相比基线方法杀死更多突变体并提高测试通过率。

Comments Accepted at ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16656 2026-06-29 cs.SE 版本更新 67%

GUIMigrator: Semantics-Preserving Transpilation from Android XML to Compose and SwiftUI

GUIMigrator: 从Android XML到Compose和SwiftUI的语义保持转译

Yi Gao, Xing Hu, Xin Xia, Xiaohu Yang

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 提出GUIMigrator框架,通过语义UI转译器(SUT)自动将Android XML UI迁移到Jetpack Compose和SwiftUI,保持视觉保真度和功能等价性,在31个开源应用上实现高迁移完整性和视觉相似度,减少90%以上手动工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08518 2026-06-26 physics.optics cond-mat.quant-gas physics.atom-ph 版本更新 67%

Fresnel zone plates for reconfigurable atomic waveguides

用于可重构原子波导的菲涅耳波带片

A. M. Pike, A. Dorne, L. Pickering, M. Jamieson, I. T. MacCuish, E. Riis, M. Y. H. Johnson, V. A. Henderson, P. F. Griffin, A. S. Arnold

专题命中 其他LLM :SLM(abstract,abstract_cn)

AI总结 提出一种结合菲涅耳波带片与空间光调制器优势的新型波带片,可生成大面积环形光场,用于超冷原子萨格纳克干涉测量。

Comments 10 pages, 5 figures, to appear in Optics Express

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02384 2026-06-25 cs.SE cs.HC 版本更新 67%

A Low-Code Approach for the Automatic Personalization of Conversational Agents

一种低代码方法用于对话代理的自动个性化

Aaron Conrardy, Alfredo Capozucca, Jordi Cabot

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 通过系统文献综述,研究MDE领域用户建模现状,发现现有提案分散且维度覆盖有限,提出应建立统一可重用用户模型并利用ML自动推导用户画像以实现个性化。

Comments Published in the main track of the International Conference on Web Engineering (ICWE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02345 2026-08-17 cs.CL cs.AI stat.AP 版本更新 62%

Can AI Agents Simulate A/B Test Outcomes? A Validation Framework for Agentic Experimentation

AI智能体能模拟A/B测试结果吗?智能体实验的验证框架

Stefan Hut, Lorenzo Masoero

机构 * Amazon(亚马逊公司)

专题命中 其他LLM :foundation model(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出智能体实验的验证框架S-RCT,用AI智能体模拟A/B测试结果,经67个营销A/B测试验证,校准后可降低预测误差,为实验者提供智能体信号支持。

Comments Accepted as a workshop paper at this https URL (https://www.aiagentbehavior.com/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21497 2026-08-17 cs.LG cs.AI cs.DS 版本更新 62%

Breaking Chains with Trees: Model-Parallel Deep Learning with $\mathcal{O}(\log N)$ Time Complexity

用树打破链:具有 $\mathcal{O}(\log N)$ 并行时间复杂度的深度学习

Neeraj Mohan Sushma, Aditya Nagarsekar, Cabrel Teguemne Fokam, Robin Schiewer, Amit Kumar Pal, Anand Subramoney, David Kappel

机构 * Center for Cognitive Interaction Technology, Bielefeld University(比勒费尔德大学认知交互技术中心) Ruhr Universität Bochum(波鸿鲁尔大学) Birla Institute of Technology and Science, Pilani, Goa Campus(比拉理工学院皮拉尼校区果阿分校) Royal Holloway, University of London(伦敦大学皇家霍洛威学院)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 提出分层块局部学习(HBLL)框架,通过变分局部目标分解网络,实现 $\mathcal{O}(\log N)$ 并行训练复杂度,在视觉和语言任务上取得竞争性能。

Comments 25 pages, 7 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07555 2026-08-11 cs.CL cs.LG 版本更新 62%

Persistent Priors, Preserved Targets: A Stroop-Style Paradigm for Lexical Override

先验通过抑制持续存在:词汇覆盖的斯特鲁普范式

Han-yu Wang

机构 * The University of Hong Kong(香港大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 通过斯特鲁普范式实验,发现语言模型中的词汇先验在局部规则覆盖后仍持续存在,并通过激活修补定位到源位置三元组,揭示了先验是干扰起源和覆盖痕迹的共同通道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13491 2026-08-10 cs.LG cs.AI 版本更新 62%

DeepLoop: Depth Scaling for Looped Transformers

DeepLoop:循环变换器的深度缩放

Shuzhen Li, Yifan Zhang, Jiacheng Guo, Quanquan Gu, Mengdi Wang

机构 * Princeton University(普林斯顿大学) University of California Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 研究循环变换器中深度缩放问题,提出DeepLoop方法,通过控制访问对齐系数形式化绑定深度效应,保持特定架构并设置参数,在不同规模GPT风格模型上实验,结果显示稳定循环深度需考虑参数访问的残差缩放规则。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00073 2026-08-06 cs.SE cs.AI cs.CL 版本更新 62%

Terminal Agents Suffice for Enterprise Automation

终端代理足以实现企业自动化

Patrice Bechard, Orlando Marquez Ayala, Emily Chen, Jordan Skelton, Sagar Davasam, Srinivas Sunkara, Vikas Yadav, Sai Rajeswar

机构 * Mila -- Quebec AI Institute(Mila — 魁北克人工智能研究所)

专题命中 其他LLM :foundation model(abstract);分类 cs.CL、cs.AI

AI总结 本文探讨终端代理通过直接调用平台API在企业自动化中表现优异,证明简单接口结合强大基础模型足以替代复杂代理架构。

Comments Pre-print. Under review. 51 pages, 6 figures, 21 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09935 2026-08-04 cs.CL cs.AI 版本更新 62%

Unpacking Hateful Memes: Presupposed Context and False Claims

解析仇恨表情包:预设语境与虚假主张

Weibin Cai, Jiayu Li, Reza Zafarani

机构 * Syracuse University(Syracuse大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文针对仇恨表情包检测中忽略仇恨本质的问题,提出含PCM与FACT模块的SHIELD框架,实验显示其检测性能优于现有最优方法,且可用于假新闻检测等任务。

Comments Accepted to SDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18482 2026-07-21 cs.CL cs.LG stat.ML 版本更新 62%

The Truncation Blind Spot: How Decoding Strategies Systematically Exclude Human-Like Token Choices

截断盲区:解码策略如何系统性地排除人类样式的令牌选择

Esteban Garces Arias, Nurzhan Sapargali, Christian Heumann, Matthias Aßenmacher

机构 * Department of Statistics, Ludwig Maximilian University, Munich, Germany(统计系,路德维希-马克西米利安大学,慕尼黑,德国) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 研究探讨了文本生成中解码策略与人类语言生成的差异,发现基于概率的解码方法排除了人类可选但统计上稀有的令牌,导致生成文本可检测性增强。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13921 2026-07-20 cs.PL cs.AI cs.LG 版本更新 62%

Generative Compilation: On-the-Fly Compiler Feedback as AI Generates Code

生成式编译:人工智能生成代码时的即时编译器反馈

Niels Mündler-Sasahara, Hristo Venev, Dawn Song, Martin Vechev, Jingxuan He

机构 * ETH Zurich(苏黎世联邦理工学院) Sofia University ``St. Kliment Ohridski''(索菲亚大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究针对人工智能生成代码时的问题,提出生成式编译方法,核心是sealor技术,能在生成中获取编译器反馈,在Rust编码任务中评估,减少非编译输出、提高功能正确性,使编译器在生成阶段发挥更重要作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17077 2026-07-09 cs.LG cs.AI cs.CV 版本更新 62%

ContrastiveCFG: Guiding Diffusion Sampling by Contrasting Positive and Negative Concepts

对比CFG:通过对比正负概念引导扩散采样

Jinho Chang, Changsun Lee, Hyungjin Chung, Jong Chul Ye

机构 * EverEx

专题命中 其他LLM :prompting(abstract);分类 cs.AI、cs.LG

AI总结 研究在条件扩散模型采样中,针对简单否定CFG引导存在的问题,提出用对比损失实现对给定条件引导的新方法,能在多样场景下有效注入或去除给定概念并保持样本质量。

Comments 20 pages, 11 figures. Poster in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02212 2026-07-07 cs.CL cs.AI q-bio.GN 版本更新 62%

Leveraging Natural Language Processing to Unravel the Mystery of Life: A Review of NLP Approaches in Genomics, Transcriptomics, and Proteomics

利用自然语言处理解开生命之谜:基因组学、转录组学和蛋白质组学中自然语言处理方法综述

Ella Rannon, David Burstein

机构 * The Shmunis School of Biomedicine and Cancer Research, George S. Wise Faculty of Life Sciences, Tel-Aviv University(谢蒙尼生物医学与癌症研究学院,乔治·S·威斯生命科学学院,特拉维夫大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 探讨自然语言处理方法在生物序列数据(基因组学、转录组学和蛋白质组学)中的应用,介绍从经典到先进模型的适配,分析分词策略与模型架构,提及生物数据应用进展及语言模型融入生物信息学的前景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04126 2026-07-01 cs.CL cs.AI cs.CV 版本更新 62%

InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training

InfiniteWeb: 面向GUI智能体训练的可扩展Web环境合成

Ziyun Zhang, Zezhou Wang, Xiaoyi Zhang, Zongyu Guo, Jiahao Li, Bin Li, Yan Lu

机构 * Peking University(北京大学) Nanjing University(南京大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 提出InfiniteWeb系统,通过统一规范、任务驱动测试和多样化种子设计自动生成功能完备的Web环境,解决GUI智能体训练数据稀缺问题,在OSWorld和Online-Mind2Web上取得显著性能提升。

Comments Accepted to ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20919 2026-06-26 cs.LG cs.AI cs.PL 版本更新 62%

Sutra: Tensor-Op RNNs as a Compilation Target for Vector Symbolic Architectures

Sutra: 以张量操作RNN作为向量符号架构的编译目标

Emma Leonhart

机构 * Emma Leonhart

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 Sutra是一种纯函数式编程语言,通过编译将整个程序降级为融合张量操作图,同时支持符号推理和神经网络训练,实现逻辑程序与可训练网络的统一。

Comments Modified NeurIPS submission, see AI declaration and replication materials at end of paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23816 2026-06-26 cs.LG cs.AI 版本更新 62%

Improved Bounds for Private and Robust Alignment

私有和鲁棒对齐的改进界

Wenqian Weng, Yi He, Xingyu Zhou

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文从理论角度研究语言模型的私有和鲁棒对齐,通过建立离线与在线设置下的次优性差距上界,分析隐私与对抗性腐败的两种交互模式,并给出改进的界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17388 2026-06-24 cs.CL cs.LG 版本更新 62%

Selective Rotary Position Embedding

选择性旋转位置嵌入

Sajad Movahedi, Timur Carstensen, Arshia Afzal, Frank Hutter, Antonio Orvieto, Volkan Cevher

机构 * ELLIS Institute Tübingen(图宾根埃利斯研究所) LIONS, EPFL(日内瓦理工学院LIONS实验室) University of Freiburg(弗赖堡大学) Max-Planck-Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) Prior Labs(Prior实验室)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出选择性RoPE,一种输入依赖的旋转嵌入机制,适用于线性和softmax变压器,通过任意角度旋转提升语言建模和复杂序列任务性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18106 2026-06-23 math.OC cs.AI cs.LG stat.ML 版本更新 62%

Symmetry-Compatible Principle for Optimizer Design: Embeddings, LM Heads, SwiGLU MLPs, and MoE Routers

优化器设计的对称性兼容原理:嵌入、LM头、SwiGLU MLP和MoE路由器

Tim Tsz-Kit Lau, Weijie Su

机构 * University of Pennsylvania(宾夕法尼亚大学) Wharton School(沃顿商学院)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 针对现代神经网络参数空间的对称性与坐标级优化器之间的几何不匹配,提出对称性兼容的优化器设计原则,并针对嵌入矩阵、LM头、SwiGLU MLP投影和MoE路由器等特殊参数块导出相应更新规则,实验证明其改善验证损失、负载平衡和训练稳定性。

Comments Corrected typos and updated the list of references

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02469 2026-06-23 cs.RO cs.AI cs.CL cs.CV 版本更新 62%

SIMSplat: Language-Aligned 4D Gaussian Splatting for Driving Scenario Generation

SIMSplat: 面向驾驶场景生成的语言对齐4D高斯泼溅

Sung-Yeon Park, Adam Lee, Juanwu Lu, Can Cui, Luyang Jiang, Rohit Gupta, Kyungtae Han, Ahmadreza Moradipari, Ziran Wang

机构 * Purdue University(普渡大学) University of California, Berkeley(加州大学伯克利分校) Toyota InfoTech Labs(丰田信息科技实验室)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 提出SIMSplat,一种基于场景图的4D高斯泼溅框架,通过嵌入语言对齐特征实现自由文本查询、对象级编辑和多智能体仿真,在驾驶场景生成中显著提升定位精度和任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00344 2026-06-16 cs.CV cs.AI cs.CL 版本更新 62%

When RAG Hurts: Diagnosing and Mitigating Attention Distraction in Retrieval-Augmented LVLMs

当RAG有害:诊断和缓解检索增强LVLMs中的注意力分散

Beidi Zhao, Wenlong Deng, Xinting Liao, Yushu Li, Nazim Shaikh, Yao Nie, Xiaoxiao Li

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 本文发现检索增强生成(RAG)在LVLMs中导致注意力分散(AD)问题,即检索文本抑制视觉注意力并偏离问题相关区域,提出MAD-RAG方法通过双问题公式和注意力混合来解耦视觉定位与上下文整合,在三个基准上提升性能并纠正大部分失败案例。

Comments 19 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06035 2026-06-16 cs.AI cs.CL 版本更新 62%

Attention, not scale, drives human-AI alignment in multimodal language prediction

注意力,而非规模,驱动多模态语言预测中的人机对齐

Viktor Kewenig, Andrew Lampinen, Samuel A. Nastase, Christopher Edwards, Quitterie Lacome D'Elascombe, Akilles Rechardt, Jeremy I Skipper, Gabriella Vigliocco

机构 * Psychology and Language Science, Experimental Psychology, University College London, London, UK(心理学与语言科学、实验心理学,伦敦大学学院,伦敦,英国) Google Deepmind, Mountain View, US(谷歌DeepMind,山景城,美国) Princeton Neuroscience Institute, Princeton University, Princeton, NJ, USA(普林斯顿神经科学研究所,普林斯顿大学,普林斯顿,新泽西州,美国) Computer Science Department, Exeter University(计算机科学系,埃克塞特大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过比较五种视觉-语言模型与600名人类在视觉世界范式中的表现,发现添加视觉上下文显著提升模型与人类在预测评分上的一致性,且注意力机制而非模型规模是主要驱动因素。

Comments 39 pages, 6 Figures, published in NPJ Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03244 2026-06-09 cs.LG cs.AI cs.CV 版本更新 62%

VFEM: Visual Feature Empowered Multivariate Time Series Forecasting with Cross-Modal Fusion

VFEM: 视觉特征赋能的多变量时间序列预测与跨模态融合

Yanlong Wang, Hang Yu, Jian Xu, Fei Ma, Hongkang Zhang, Tongtong Feng, Zijian Zhang, Shao-Lun Huang, Danny Dongning Sun, Xiao-Ping Zhang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Pengcheng Laboratory(鹏城实验室) Ant Group(蚂蚁集团) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳)) University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 提出VFEM模型,利用预训练大视觉模型通过跨模态注意力融合视觉与时间特征,仅训练7.45%参数即可捕捉跨变量依赖,提升多变量时间序列预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08005 2026-08-11 cs.LG 版本更新 61%

Preference Redirection via Attention Concentration: An Attack on Computer Use Agents

通过注意力集中进行偏好重定向:对计算机使用代理的一种攻击

Dominik Seip, Matthias Hein

机构 * Tübingen AI Center, University of Tübingen(图宾根大学图宾根人工智能中心)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG;language model(journal_ref)

AI总结 本文提出PRAC攻击,通过重定向模型注意力操纵CUA选择过程,揭示了视觉模态的漏洞,威胁到基于开放权重模型的CUA安全。

Journal ref Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11629 2026-08-17 cs.CR cs.LG 版本更新 57%

Semantic Differentiation for Tackling Challenges in Watermarking Low-Entropy Constrained Generation Outputs

语义分化用于解决水印标记低熵约束生成输出的挑战

Nghia T. Le, Alan Ritter, Kartik Goyal

机构 * School of Interactive Computing(交互计算学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 SeqMark通过语义分化解决低熵约束生成任务中水印标记的挑战,提升检测准确率并保持生成质量。

Comments 23 pages, 5 figures, COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01985 2026-08-13 cs.GT cs.AI 版本更新 57%

Proportional Committee Elections with Positive and Negative Votes

带有赞成票与反对票的比例代表委员会选举

Sonja Kraiczy, Georgios Papasotiropoulos, Grzegorz Pierczyński, Piotr Skowron

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 本研究针对允许投反对票的委员会选举场景,提出两种反对票解释及对应比例性公理,检验Phragmén规则、PAV、MES变体的公理满足情况,拓展了比例代表制的适用场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02078 2026-08-11 cs.CL cs.CV 版本更新 57%

CAVE: Competence-Aware Visual Boundary Evidence Alignment for Video Temporal Grounding

CAVE:面向视频时序定位的能力感知视觉边界证据对齐

Wei Jia, Zhicong Lu, Yu Chen, Xiang Wang, Shuai Li, Wenqian Lv, Jiayue Cao, Huaxing Liu

机构 * AMAP, Alibaba Group(阿里巴巴集团AMAP)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 针对视频时序定位中视觉证据与时间戳错位的问题,提出CAVE方法,通过边界证据奖励、轻量级热身及性能感知门控,在公开基准上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01043 2026-08-11 cs.CR cs.AI 版本更新 57%

Decoy Images Amplify Caption-Mediated Defenses Against Encoded Jailbreaks

诱饵图像增强针对编码越狱的字幕介导防御

Haoyu Zhang, Xiangchen Guan, Shibo Zheng, Mohammad Zandsalimy, Shanu Sushmita

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究发现附加诱饵图像可降低VLMs的编码越狱攻击成功率,通过编码输入检测器门控附加诱饵,可在保留安全增益的同时控制良性弃权率,该效应在多模型、多场景下可复现。

Comments There is bug in algorithm implementation

详情

展开后加载摘要…

URL PDF HTML 收藏