arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2607.21522 2026-07-24 cs.RO cs.AI cs.CL cs.CV 新提交 62%

GS-Agent: Creating 4D Physical Worlds With Generative Simulation

GS-Agent:通过生成式模拟创建4D物理世界

Hongxin Zhang, Chunru Lin, Junyan Li, Zhou Xian, Tsun-Hsuan Wang, Chuang Gan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Genesis AI(创世纪人工智能公司)

专题命中 其他LLM :foundation model(abstract);分类 cs.CL、cs.AI

AI总结 研究旨在从自然语言描述创建4D物理世界。核心方法是提出GS-Agent这一端到端多智能体框架,分解任务并让多智能体与物理引擎协作。主要贡献是能有效转换自然语言为物理合理的4D世界,实现相机和灯光控制,为新范式奠基。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20668 2026-07-24 cs.CL cs.AI 新提交 62%

From Agent Failures to Text Policies: What Works and What Breaks

从智能体失败到文本策略:可行与不可行之处

Jaideep Ray, Ankit Goyal

专题命中 其他LLM :prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究智能体中TextGrad应用问题,通过区分遵循与学习策略能力来研究。发现两者有差距,人工编写策略能提升智能体表现,而从轨迹生成的策略无法可靠超越固定提示,主要挑战是从经验中生成和选择策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18235 2026-07-21 cs.CL cs.AI 新提交 62%

Automated Discovery Has No Universally Superior Harness

自动化发现没有普遍优越的框架

Akshat Gupta, Jermaine Lei, Alexander Lu, Gopala Anumanchipalli, Leshem Choshen

专题命中 其他LLM :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究自主发现系统框架,通过系统分解和评估发现其存在泛化问题,无固定框架普遍优越,OpenEvolve变体表现不佳。利用早期发现进展预测性能,提出自适应分配实验,优于固定和非自适应选择,推动从固定框架选择转向在线适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13319 2026-07-16 cs.RO cs.AI cs.LG 新提交 62%

Adapting Generalist Vehicle Models for High-Speed MPC Across Terrains

使通用车辆模型适应不同地形的高速模型预测控制

Rwik Rana, Jesse Quattrociocchi, Christian Ellis, Nathan Tsoi, Garrett Warnell, Joydeep Biswas

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) DEVCOM Army Research Laboratory(陆军研究实验室)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究高速越野自主中通用车辆模型适应不同地形的问题,提出OptCar方法,通过历史条件动态适应模块,利用有限真实数据和合成展开微调通用模型,在多种实验中表现良好,提升了跨地形性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09705 2026-07-14 cs.OH cs.AI cs.CY cs.LG 新提交 62%

Model Collapse: On Recursion, Noise, and Uncharted Machine Visions

模型崩溃:关于递归、噪声和未知的机器视觉

Violaine Boutet de Monvel

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究模型崩溃现象,通过历史视频合成技术和当代机器学习艺术应用案例,探讨递归训练揭示的AI生成数据依赖性本质,指出崩溃挑战超人类主义理想,引入美学视角,视噪声和递归为理解艺术创作与AI生态系统的关键概念。

Comments Preprint for Ethics and Aesthetics of Artificial Intelligence (Naples: Orthotes Edizioni), October 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09678 2026-07-14 cs.AI cs.LG 新提交 62%

Faithful, Not Corrective: Message-Format Effects in Multi-Hop Agent Relays Are Tier-Dependent

忠实而非纠正:多跳智能体中继中的消息格式效应取决于层级

Zayx Shawn

专题命中 其他LLM :LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究多跳智能体中继中消息格式效应,引入可控测试平台,发现格式效应取决于层级,强中继近乎无损,弱中继下跨格式差异增大,配对分叉注入中错误值保留情况与真实值保留匹配,结构提供错误定位通道,格式选择应依最弱中继。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08193 2026-07-10 cs.LG cs.AI 新提交 62%

Open-ended Multi-agent Autocurricula via Visual Inspection of Policies with Multi-modal LLMs

通过多模态大语言模型对策略进行视觉检查实现开放式多智能体自动课程

Lorenzo Pantè, Andrea Fanti, Roberto Capobianco

机构 * Sapienza University of Rome(罗马第一大学) Sony AI(索尼人工智能)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 研究强化学习中开放式多智能体自动课程设计难题,提出通过策略视觉检查(VIP)利用视频语言模型处理视频并提供课程建议,经星际争霸多智能体挑战赛实证,显示该方法能生成更有效课程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04523 2026-07-07 cs.CL cs.AI 新提交 62%

Failures and Successes to Learn a Core Conceptual Distinction from the Statistics of Language

从语言统计中学习核心概念区分的失败与成功

Zhimin Hu, Jeroen van Paridon, Gary Lupyan

机构 * Department of Psychology, University of Wisconsin-Madison(威斯康星大学麦迪逊分校心理学系)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 研究人们能否从语言中学习原则性与统计性属性的区分,发现语言模型对统计流行度敏感,但在表示该区分上有困难,GPT - 4成功做到。

Comments Published at Evolang XV, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27881 2026-06-29 cs.CL cs.AI 新提交 62%

A Study of Temporal Fusion Strategies for Named Entity Recognition in Historical Texts

历史文本中命名实体识别的时间融合策略研究

Emanuela Boros

机构 * Digital Humanities Laboratory, EPFL, Lausanne, Switzerland(瑞士洛桑联邦理工学院数字人文实验室)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI

AI总结 针对历史文本中实体随时间漂移的问题,系统研究了将时间元数据嵌入NER模型的轻量级融合策略,实验表明后期融合在早期和噪声时期表现更鲁棒。

Journal ref International Conference on Theory and Practice of Digital Libraries 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22748 2026-06-24 cs.CL cs.AI cs.CY 新提交 62%

AI Fiction in the Wild

野生的AI小说

Neel Gupta, Maria Antoniak, Melanie Walsh

机构 * University of Washington(华盛顿大学) University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 分析50万条ChatGPT用户对话,发现超三分之一涉及小说生成,包括原创故事、角色扮演、同人和色情文学,用户倾向于同人、色情及重复叙事,提出“唯我读者-作者”概念。

Comments Presented at the MFS Cultural AI Conference, Purdue University, September 19, 2025. This essay is provisionally forthcoming in MFS: Modern Fiction Studies

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23679 2026-06-23 cs.CV cs.AI cs.GR cs.LG 新提交 62%

Semantic Browsing: Controllable Diversity for Image Generation

语义浏览:图像生成的可控多样性

Sara Dorfman, Maya Vishnevsky, Omer Dahary, Or Patashnik, Daniel Cohen-Or

机构 * Tel Aviv University(特拉维夫大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 针对文本到图像模型生成多样性不足且缺乏语义结构的问题,提出一种在文本层面引入多样性的方法,通过视觉语言模型和代理工作流实现用户可导航的语义变化空间。

Comments ECCV 2026. Project page: https://saradorfman1.github.io/SemanticBrowsing-webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22769 2026-06-23 cs.LG cs.AI 新提交 62%

Noise is Signal: Density-Based Outliers as Leading Indicators of Occupational Emergence in Labor Market Text

噪声即信号:基于密度的异常值作为劳动力市场文本中职业涌现的领先指标

Shreyash Rawat

机构 * Independent Researcher(独立研究员)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出涌现-密度反转假设,证明低密度异常值预示新职业涌现,通过时序分析验证并改进涌现职业评分,预测准确率从F1=0.61提升至0.74。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21718 2026-06-23 cs.CL cs.LG 新提交 62%

Leveraging LaBSE with Progressive Curriculum Learning for Multicultural Polarization

利用LaBSE与渐进式课程学习进行多元文化极化检测

Sachin Sundar, Sandeep Kumar, Mothish M

机构 * Indian Institute of Technology, Kharagpur(印度理工学院卡哈拉格普尔分校) Indian Institute of Technology, Madras(印度理工学院马德拉斯分校)

专题命中 其他LLM :prompting(abstract);分类 cs.CL、cs.LG

AI总结 提出基于LaBSE嵌入和渐进式课程学习的架构,解决多语言低资源环境下的在线极化检测,在低资源语言上提升macro F1达0.2。

Comments Accepted at Semeval, ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18057 2026-06-23 cs.HC cs.AI cs.CL cs.CY cs.SI 新提交 62%

When AI Says "I have been in similar situations": Synthetic Lived Experience in Peer-Like Caregiver Support

当AI说“我也有过类似经历”:同伴式照护支持中的合成生活经验

Drishti Goel, Agam Goyal, Veda Duddu, Olivia Pal, Violeta J. Rodriguez, Daniel S. Brown, Ravi Karkar, Dong Whi Yoo, Koustuv Saha

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 研究AI在同伴支持中生成“合成生活经验”的悖论,通过分析人类与AI在阿尔茨海默病照护社区中的叙事差异,揭示AI虽能模拟情感支持但缺乏真实经历,需建立机制区分支持性语言与虚构经历。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12708 2026-06-12 cs.CL cs.AI 新提交 62%

AfriSUD: A Dependency Treebank Collection for Evaluating Models on African Languages

AfriSUD:用于评估非洲语言模型的依存树库集合

Happy Buzaaba, Cheikh Mouhamadou Bamba Dione, David Ifeoluwa Adelani, Sylvain Kahane, Kim Gerdes, Bruno Guillaume, Kevin Guan, Aremu Anuoluwapo, Naome A. Etori, Shamsuddeen Hassan Muhammad, Utitofon Inyang, Peter Nabende, David Sabiiti Bamutura, Andiswa Bukula, Chinedu Uchechukwu, Rooweither Mabuya, Idris Akinade, Christiane Fellbaum

机构 * Princeton University(普林斯顿大学) Laboratory for Artificial Intelligence, Princeton University(普林斯顿大学人工智能实验室) Gaston Berger University(加斯顿·伯杰大学) Mila, McGill University(麦吉尔大学米拉研究所) Canada CIFAR AI Chair(加拿大CIFAR人工智能教席) Paris Nanterre University(巴黎南泰尔大学) Paris-Saclay University(巴黎-萨克雷大学) CNRS(法国国家科学研究中心) Inria(法国国家信息与自动化研究所) LORIA(洛林计算机科学实验室) Université de Lorraine(洛林大学) University of Trento(特伦托大学) University of Minnesota–Twin Cities(明尼苏达大学双城分校) Imperial College London(伦敦帝国学院) Binghamton University(宾汉姆顿大学) Makerere University(马凯雷雷大学) Penn State University(宾夕法尼亚州立大学) Mbarara University of Science and Technology(姆巴拉拉科技大学) Chalmers University of Technology(查尔姆斯理工大学) University of Ibadan(伊巴丹大学) Nnamdi Azikiwe University(纳姆迪·阿齐基韦大学) South African Centre for Digital Language Resources(南非数字语言资源中心)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL、cs.AI

AI总结 为弥补非洲语言在NLP资源上的不足,构建了首个大规模九种非洲语言句法标注树库AfriSUD,评估多种模型发现显著句法差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08365 2026-06-09 cs.LG cs.AI 新提交 62%

Pre-Intervention Prediction of Sparse Autoencoder Steering Side Effects

稀疏自编码器引导副作用的干预前预测

Evan Duan

机构 * University of Michigan(密歇根大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 提出一种干预前筛选框架,利用特征统计预测SAE引导的副作用(效果不稳定和附带扩散),在多个模型和字典上验证了解码器几何等信号优于基线,但预测效果因模型而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07780 2026-06-09 cs.AI cs.CV cs.LG 新提交 62%

Land cover and flood type govern the detection limits of satellite-based flood mapping across diverse global flood events

土地覆盖与洪水类型控制基于卫星的洪水测绘在不同全球洪水事件中的检测极限

Venkatesh Kolluru, Rajat Shinde, Abdelhak Marouane, Caden Helbling, Deepak Shah, Othneil Drew, Iksha Gurung, Manil Maskey, Rahul Ramachandran

机构 * Earth System Science Center, University of Alabama in Huntsville(阿拉巴马大学亨茨维尔分校地球系统科学中心) Space and Earth Science Data Analysis(空间与地球科学数据分析) NASA Marshall Space Flight Center(NASA马歇尔太空飞行中心)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究利用Prithvi-EO-2.0模型在19个全球洪水事件中评估卫星洪水测绘的检测能力,发现检测精度取决于土地覆盖和洪水类型,农田和河流洪水检测效果较好,而树木覆盖和建成区检测近乎为零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07598 2026-06-09 cs.LG cs.AI 新提交 62%

A Topological Characterization of Graph Neural Networks via Stochastic Block Model Embeddings on the n-Sphere

图神经网络的拓扑特征化:通过n-球面上的随机块模型嵌入

Gopal Anantharaman

机构 * KnotTheory.ai Inc.(KnotTheory.ai 公司) Dept. of Mathematics, Emporia State University(恩波利亚州立大学数学系)

专题命中 其他LLM :LLM(abstract);分类 cs.AI、cs.LG

AI总结 提出将消息传递神经网络诱导的随机块模型映射到单位n-球面的拓扑框架,用于比较训练后的图神经网络,并实现无需重新训练的迁移学习候选检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15910 2026-08-18 eess.AS cs.CL cs.SD 新提交 57%

Iterative Self-Learning for Expressive Text-to-Speech Synthesis

用于高表现力文本到语音合成的迭代自学习

Nicholas Sanders, Gustav Eje Henter, Simon King, Korin Richmond

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 针对低资源下高表现力TTS的标签稀缺问题,提出迭代自学习框架,基于Invert-Classify方法迭代优化伪标签,在词级突出性和情感任务上验证,提升了标签贴合度与合成质量,性能接近全监督模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15475 2026-08-18 cs.CR cs.AI 新提交 57%

Bit-Flip Attacks on Vision-Language-Action Models: Action-Decoding Architecture Shapes the Vulnerability

针对视觉-语言-动作模型的位翻转攻击:动作解码架构决定漏洞

Yudong Gao, Linghan Chen, Wenhan Wu, Mia Zhou, Jiyao Wang, Kaiyan Ji, Mingyu Guo, Honglong Chen

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 该研究针对视觉-语言-动作模型提出位翻转攻击,发现动作解码架构决定漏洞,少量梯度选择的位翻转可大幅降低闭环成功率,权重完整性是具身基础模型的安全边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13605 2026-08-17 cs.AI cs.RO 新提交 57%

Active Perception for Embodied Disambiguation

用于具身消歧的主动感知

Yiwei Liu, Luwei Yang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究针对具身环境中目标歧义问题,提出以主动观测为核心的主动感知框架,结合视觉语言模型实现信息获取与用户意图澄清,经真实机器人实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13433 2026-08-14 cs.FL cs.AI 新提交 57%

Algebraic Decomposition Theory for Transformer Length Generalization

Transformer长度泛化的代数分解理论

Andy Yang, Blerta Veseli, Corentin Barloy, Michaël Cadilhac, Andreas Krebs, Charles Paperman, Howard Straubing, Michael Hahn

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文针对Transformer的长度泛化问题,建立了正则语言上长度泛化的完整代数刻画,提出多项式时间决策算法,实验验证其能更准确捕捉Transformer的长度泛化行为。

Comments 54 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11424 2026-08-13 cs.LG cs.CV 新提交 57%

Click2Poly: A VLM for vector mapping buildings and walls

Click2Poly:用于建筑物和墙壁矢量绘制的VLM

Nicolas Girard, Jawher Ben Abdallah, Arno Gobbin, Liuyun Duan, Sacha Lepretre

机构 * LuxCarta

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 该研究提出基于Florence-2 VLM的人在环AI助手Click2Poly,以QGIS插件形式实现,可响应用户点击编辑矢量层,加快建筑物和墙壁矢量绘制的手动编辑流程。

Journal ref IGARSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12271 2026-08-13 cs.LG physics.ao-ph 新提交 57%

Earth observation embeddings are effective sub-grid descriptors for probabilistic weather downscaling

地球观测嵌入是概率性天气降尺度的有效亚网格描述符

Pedro Sousa, Will Tebbutt, Sadiq Jaffer, Robin Young, Anil Madhavapeddy, Richard E. Turner

机构 * University of Cambridge(剑桥大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 该研究提出用TESSERA嵌入增强卷积条件神经过程,用于概率性天气降尺度,在五个气候区提升了2米温度和10米风速的降尺度技能,且对不同变量和新站点均有效。

Comments 39 pages, 12 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06968 2026-08-10 physics.soc-ph cs.AI cs.CY 新提交 57%

Same physical state, different collective dynamics: state encodings select synchronization outcomes in language-model agents

相同物理状态,不同集体动力学:状态编码选择语言模型智能体的同步结果

Takahiro Ezaki, Naoto Imura, Katsuhiro Nishinari

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究通过循环同步实验发现,状态编码(低阶循环矩vs直方图)会影响语言模型智能体的同步结果,且效应因模型而异,状态编码是依赖模型的有效交互法则的组成部分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06154 2026-08-07 cs.RO cs.AI cs.CV 新提交 57%

Visual Grounding in Zero-Shot Vision-Language Control

零样本视觉语言控制中的视觉 grounding

J. de Curtò, Dayani Plasencia, Diego Sánchez, I. de Zarzà

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文针对零样本视觉语言控制中VLMs决策是否基于视觉输入的问题,通过多组消融实验分析了多种VLMs的表现,提出对称共识守护者方法,验证了VLMs可作为有界的危险助手。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05172 2026-08-07 cs.CY cs.AI 新提交 57%

Estimating time spent on work tasks

估算工作任务所花费的时间

Stephane Hatgis-Kessell, Tomás Aguirre, Alexander Wan, Rishi Bommasani

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本研究提出一种原则性方法估算美国近18000项任务的时间份额,用于分析AI对美国职业的影响,发现时间权重会改变AI暴露度的测量结果,可作为劳动经济研究的通用基础要素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04299 2026-08-06 cs.CL 新提交 57%

Searching for Sound-Meaning Collisions: Graph-Based Affordance Retrieval and Multi-Evaluator Ranking for Pun Translation at CLEF 2026 JOKER Task 2

寻找音义碰撞:CLEF 2026 JOKER任务2中基于图的可供性检索与多评估者排名的双关语翻译

Russell Taylor, Adam Brikman, Prateek Awate

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 该研究针对CLEF 2026 JOKER任务2,提出基于图的可供性检索与多评估者排名的双关语翻译方法,证实检索音义可供性是计算双关语翻译的核心瓶颈,结果契合Low的设想。

Comments CLEF 2026 Working Notes, 21-24 September 2026, Jena, Germany

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03270 2026-08-05 cs.CV cs.AI 新提交 57%

GUI-Lens: Coarse-to-Fine Cropping for GUI Grounding with General-Purpose VLMs

GUI-Lens:面向通用视觉语言模型(VLM)的GUI定位粗到精裁剪框架

Zichuan Fu, Shirong Wang, Wenlin Zhang, Guojing Li, Yimin Deng, Jingtong Gao, Junjia Qi, Hanyu Yan, Yefeng Zheng, Xiaopeng Li, Wanyu Wang, Xian Wu, Xiangyu Zhao

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 GUI-Lens是面向通用VLM的GUI定位粗到精裁剪框架,通过主动视觉观察逐步聚焦确定目标,在四个基准和三个VLM后端上使定位准确率最高提升24.9个百分点,在GPT-5.5上达SOTA性能。

Comments Preprint. Code: https://github.com/Fzkuji/GUI-Agent-Harness

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03210 2026-08-05 cs.CL 新提交 57%

ICO: Enhancing Semantic-Shift Jailbreaks via Iterative Context Optimization

ICO:通过迭代上下文优化增强语义偏移越狱攻击

Hujian Zhu, Yihao Huang, Felix Juefei-Xu, Xinfeng Li, Peng Zeng, Simeng Qin, Qing Guo, Geguang Pu

专题命中 其他LLM :foundation model(abstract);分类 cs.CL

AI总结 本研究针对现有语义偏移越狱攻击有效性有限的问题,提出带迭代上下文优化(ICO)的黑盒上下文感知框架,经多数据集与多模型实验,其攻击效果优于现有基线,平均成功率达74.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏