arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 557 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 557 篇

2607.10745 2026-07-14 cs.CL 新提交 57%

The First ChineseBabyLM Challenge: training data-efficient and cognitively plausible language models for Chinese

首个中文BabyLM挑战:训练数据高效且认知合理的中文语言模型

Siyuan Song, Zhiheng Qian, Yunhao Zhang, Linyang He, Xiaozhe Ji, Yingxin Lin, Hongao Zhu, Chongtian Shao, Chuhan Lang, Luan Li, Rui Wang, Renfen Hu, Shaonan Wang, Hai Hu

机构 * Princeton University(普林斯顿大学) Shanghai Jiao Tong University(上海交通大学) Chinese Academy of Sciences(中国科学院) Columbia University(哥伦比亚大学) Beijing Normal University(北京师范大学) Tsinghua University(清华大学) University of California San Diego(加利福尼亚大学圣地亚哥分校) The Hong Kong Polytechnic University(香港理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 首个中文BabyLM挑战将在2026年自然语言处理与中文计算会议举办,要求用1亿中文词元从头训练语言模型,在自然语言理解、认知对齐和汉字知识三轨道评估,不限分词器、模型架构和训练轮数。

Comments 8 pages, 4 tables; work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10590 2026-07-14 cs.CL 新提交 57%

Demographic Prompting at Scale: When More Attributes Hurt LLM--Human Agreement

大规模人口统计学提示:当更多属性损害大语言模型与人类的一致性时

Mahammed Kamruzzaman, Shrabon Kumar Das, Gene Louis Kim

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 研究人口统计学属性作提示线索对LLM预测与人类注释一致性的影响,通过五个开源LLM在五个任务中实验,发现一致性与属性数量有关,受属性可学习性等因素影响,表明人口统计学提示效用依赖上下文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10291 2026-07-14 cs.SE cs.AI 新提交 57%

Partial Contracts Suffice: Sound, LLM-Inferred Regression Verification

部分契约就足够了:可靠的、由大语言模型推断的回归验证

Yiannis Charalambous, Rafael Menezes, Youcheng Sun, Lucas C. Cordeiro

机构 * The University of Manchester(曼彻斯特大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 研究软件回归验证难题,提出基于契约的工具,探讨部分契约的充分性,通过强化契约、自动推断等方法,实现可靠验证,在多方面取得良好效果,证明安全保留条件等价性。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10165 2026-07-14 cs.CV cs.AI 新提交 57%

EmoStyle: Affective Conditioning of Style-Specialist Experts for Emotional Image Generation

EmoStyle:用于情感图像生成的风格专家情感调节

Dexiang Hong, Yijie Guo, Weidong Chen, Xinyan Liu, Zixuan Zou, Zhendong Mao, Yongdong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 针对情感感知艺术图像生成中训练与测试时属性不一致造成的控制差距问题,提出EmoStyle框架,利用语言模型推理器预测情感线索,编码情感字段指导生成,训练专用LoRA适配器结合风格表达情感,经视觉语言模型引导排序,在挑战赛中获佳绩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10074 2026-07-14 cs.LG 新提交 57%

Distance-Preserving Embeddings in Inhomogeneous Random Graphs

非均匀随机图中的距离保持嵌入

My Le, Luana Ruiz, Souvik Dhara

机构 * Johns Hopkins University(约翰斯·霍普金斯大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 研究非均匀随机图中距离保持嵌入,基于地标嵌入分析最短路径近似,扩展失真保证到全局平均并统一分析,引入GNN增强变体,使模型能从小图学习并推广到大型真实网络,保持或超越经典嵌入保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09674 2026-07-14 cs.CY 新提交 57%

From Tools to Teacher-Built Teammates: No-Code Pedagogical Plugin Authoring with LearnAdapt Agentic Studio and PedOS 1.1 Lumina

从工具到教师构建的队友:使用LearnAdapt智能工作室和PedOS 1.1 Lumina进行无代码教学插件创作

Nizam Kadir

专题命中 其他安全 :safety(abstract);分类 cs.CY

AI总结 该研究针对教师和研究人员难以定制教育AI的问题,介绍了基于PedOS 1.1 Lumina的LearnAdapt智能工作室,它能让非编码人员用英语描述学习交互,完成插件创作、安全检查等,展示了从提示到证据捕获的完整生命周期,实现从固定工具到教师构建队友的转变。

Comments 3 pages, 1 figure, Accepted into the 27th International Conference on Artificial Intelligence in Education Interactive Events Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09024 2026-07-13 cs.CV cs.AI 新提交 57%

Video Generation Models are General-Purpose Vision Learners

视频生成模型是通用视觉学习者

Letian Wang, Chuhan Zhang, Rishabh Kabra, Jasper Uijlings, Steven Waslander, Andrew Zisserman, Joao Carreira, Kaiming He, Misha Andriluka, Eduard Gabriel Bazavan, Andrei Zanfir, Cristian Sminchisescu

机构 * Google DeepMind(谷歌DeepMind)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究探讨计算机视觉中实现通用模型的催化剂,提出大规模文本到视频生成是预训练范式。介绍GenCeption模型,利用视频生成扩散主干定义感知模型。实验表明该模型在多任务中性能领先,有数据效率优势且具涌现行为,为通用视觉智能提供基础路径。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23964 2026-07-13 cs.LG cs.CV q-bio.QM 新提交 57%

3D Masked Autoencoders are Robust Learners of Volumetric and Multimodal Cellular Representations for Microscopy

3D掩码自编码器是显微镜体积和多模态细胞表示的鲁棒学习器

Amirhossein Kardoost, Lion Gleiter, Tingying Peng, Carsten Marr

机构 * Institute of AI for Health & Helmholtz AI, Computational Health Center, Helmholtz Munich – German Research Center for Environmental Health(亥姆霍兹慕尼黑中心 - 德国环境健康研究中心,计算健康中心,健康人工智能研究所与亥姆霍兹人工智能) Department of Medicine III, Ludwig-Maximilian-University Hospital(路德维希-马克西米利安大学医院第三内科) Department of Physics, Ludwig-Maximilian-University(路德维希-马克西米利安大学物理系) German Cancer Consortium (DKTK), partner site Munich(德国癌症联盟(DKTK)慕尼黑合作站点) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 系统比较2D和3D掩码自编码器在体积显微镜数据上的表现,发现3D模型在下游任务中更优,并通过跨模态对齐和频域正则化进一步提升性能,在蛋白质相互作用和定位任务上达到最先进水平。

Comments Code is available at: https://github.com/marrlab/mae3d-opencell

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07605 2026-07-09 cs.CY 新提交 57%

User identity conditions moral wrongness ratings in non-reasoning large language models

用户身份影响非推理大语言模型的道德错误评级

Willem Fourie, Isabel Ray, Gray Manicom

专题命中 其他安全 :alignment(abstract);分类 cs.CY

AI总结 研究通过行为自下而上方法,评估两个非推理大语言模型,发现用户身份影响其道德错误评级,严重伤害行为有上限效应,有争议规则行为有角色条件性变化,为人工智能价值对齐讨论提出问题并助力重构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07316 2026-07-09 cs.LG 新提交 57%

Mechanistic Interpretability for Neural Networks: Circuits, Sparse Features and Symbolic Reasoning

神经网络的机械可解释性:电路、稀疏特征和符号推理

Pranav Sawant, Jakub Krejčí

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校) VSB—Technical University of Ostrava(奥斯特拉瓦技术大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 研究神经网络机械可解释性,通过Transformer电路分析、Sparse Autoencoders等工具应对叠加等挑战,探索控制模型行为方法,还将机械见解与神经符号人工智能框架联系,以实现神经网络内部算法逆向工程及可解释。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07052 2026-07-09 cs.SE cs.AI cs.DC cs.ET cs.MA 新提交 57%

Progressive Crystallization: Turning Agent Exploration into Deterministic, Lower-Cost Workflows in Production

渐进式结晶:将代理探索转化为生产中确定性、低成本的工作流程

Arun Malik

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 研究针对IT运营中AI代理成本高问题,提出渐进式结晶方法,通过三阶段执行分类法及证据提升机制,将代理探索转化为低成本工作流程,在生产云网络AIOps系统上评估效果良好,提升确定性执行、降低成本并提高安全性。

Comments Conference-style paper; 10 pages (estimated from manuscript formatting if applicable); focuses on agentic AI, AIOps, workflow automation, deterministic execution, and LLM cost optimization

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07021 2026-07-09 cs.AI cs.HC 新提交 57%

Learning social norms enhances compatibility in dynamic human-AI coordination

学习社会规范可增强动态人机协作中的兼容性

Yi Yang, Siyuan Liu, Xin Gao, Huamu Sun, Chao Liu, Qing Zhou, Bingbing Nie

机构 * School of Vehicle and Mobility, Tsinghua University, Beijing, China(清华大学车辆与移动系统学院) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University, Beijing 100084, China(清华大学智能绿色车辆与移动系统国家重点实验室) State Key Laboratory of Cognitive Neuroscience and Learning & IDG/McGovern Institute for Brain Research, Beijing Normal University, Beijing, China(北京师范大学认知神经科学与学习国家重点实验室) Beijing Key Laboratory of Safe AI and Superalignment, Beijing, China(北京安全人工智能与超对齐关键实验室) Beijing Institute of AI Safety and Governance, Beijing, China(北京人工智能安全与治理研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究以行人与车辆互动为代表,搭建实验平台,识别出人类社会规范的三项原则,将其融入人工智能显著改善人机协作,在闭环互动任务中,融入社会规范的大语言模型总分比基线策略高出近四倍,比人际互动高出43%。

Comments 44 pages, 5 figures, supplementary information included

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06748 2026-07-09 cs.SE cs.AI 新提交 57%

SmartHomeSecure: Automated Detection and Repair of Smart Home Configuration Errors Using Large Language Models

智能家居安全:使用大语言模型自动检测和修复智能家居配置错误

Yizhi Wang, Xinghua Gao, Reachsak Ly, Alireza Shojaei

机构 * Myers-Lawson School of Construction, Virginia Polytechnic Institute and State University(Myers-Lawson工程学院,弗吉尼亚理工学院和州立大学) School of Technology, Eastern Illinois University(技术学院,东伊利诺伊大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 研究智能家居配置文件错误问题,提出SmartHomeSecure原型,结合轻量级程序分析与约束引导大语言模型生成,实现自动检测与修复,经实验评估,四个模型测试结果显示该方法能有效提高智能家居配置修复的可靠性和可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06626 2026-07-09 cs.LG q-bio.NC 新提交 57%

Reward Valuation in Vision Language Models: Causal Mechanisms Underlying Anhedonia

视觉语言模型中的奖励估值:快感缺乏背后的因果机制

Melika Honarmand, Samin Mahdipour Aghabagher, Martin Schrimpf

机构 * EPFL(苏黎世联邦理工学院)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 研究探讨视觉语言模型中奖励估值情况,基于神经科学观点,通过有针对性扰动识别奖励预期单元,测试其因果作用,发现模型存在奖励估值和预期缺陷,结果反映了人工智能模型与人类平行的奖励估值回路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06590 2026-07-09 cs.CV cs.LG 新提交 57%

AI for Cultural Heritage Textiles: Fine-Tuned Latent Diffusion for Novel Ulos Motif Synthesis

用于文化遗产纺织品的人工智能:针对新型乌洛花纹合成的微调潜在扩散模型

Humasak Tommy Argo Simanjuntak, Jesika Purba, Sitogab Girsang, Widya Manurung, Samuel Situmeang, Arlinta Barus, Daniel Oranova Siahaan

机构 * Information Systems Study Program, Faculty of Informatics and Electrical Engineering, Institut Teknologi Del(信息系统研究项目,信息与电气工程学院,技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 该研究针对传统乌洛编织局限,提出在高分辨率乌洛图案数据集上微调Protogen v3.4和Stable Diffusion v1.4两个潜在扩散模型来生成新颖设计,通过多种方式评估模型性能,发现特定引导尺度能平衡保真度与多样性,支持非物质文化遗产创新更新。

Comments 21 pages, 8 figures, 3 tables. The manuscript is currently under review at the 2026 4th International Conference on Data, Information and Computing Science (https://www.cdics.org/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06461 2026-07-08 eess.AS cs.CL cs.SD 新提交 57%

WordVoice: Explicit and Decoupled Multi-Dimensional Word-Level Control for LLM-Based TTS

WordVoice:基于大语言模型的文本转语音中显式且解耦的多维词级控制

Sihang Nie, Jinxin Ji, Xiaofen Xing, Deyi Tuo, Chengbin Jin, Jialong Mai, Xiangmin Xu

机构 * South China University of Technology(南方科技大学) Huya Inc.(Huya公司) Tongji University(同济大学) The Hongkong polytechnic university(香港理工大学) Foshan University(佛山大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 研究针对基于LLM的TTS系统词级控制粗糙的问题,提出统一框架。构建含五维注释的数据集,引入WordVoice将隐式生成变为显式可控范式,经实验验证其在多声学维度上实现卓越解耦控制且保持零样本合成稳定性。

Comments 10 pages, 4 figures, 6 tables; Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05790 2026-07-08 cs.AI 新提交 57%

Controlling Tool Use with Heading-Specific Activation Steering

通过特定标题激活控制工具使用

Yuqi Chen, Vincent Siu, Yang Liu, Dawn Song, Chenguang Wang

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究工具增强大语言模型中工具使用决策的稳定内部表示,通过从标题锚点位置提取引导向量对工具调用行为进行双向因果控制,发现其因果有效性与线性结构不符,还区分了工具使用引导向量与参数化概念的引导向量,二者关系待解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04906 2026-07-07 cs.LG 新提交 57%

RL-Ballast: Ship Ballast Water Path Planning and Clog Prediction via Reinforcement Learning

RL-Ballast:通过强化学习进行船舶压载水路径规划和堵塞预测

Ming-Kuan Lin, Yi-Chung Lai, Ming-Hsin Chiang, Tsung-Wei Pan, Jung-Hua Wang

机构 * National Taiwan Ocean University(台湾海洋大学) AI Research Center(人工智能研究中心) Shinsoft Corporation(Shinsoft公司) Department of Electrical Engineering(电子工程系)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 针对船舶压载水控制问题,提出基于图的深度强化学习框架RL-Ballast,将阀门排列问题转化为可行路径,利用堆叠水箱水位等近似部分可观测环境,能自适应规划路径并进行堵塞诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03978 2026-07-07 cs.HC cs.AI cs.CV 新提交 57%

Scalable Semantic Steering of Embedding Projections

嵌入投影的可扩展语义引导

Wei Liu, Eric Krokos, Kirsten Whitley, Rebecca Faust, Chris North

机构 * Virginia Tech(弗吉尼亚理工学院) Department of Defense(国防部) Tulane University(路易斯安那州立大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究高维数据嵌入的低维投影语义结构问题,提出可扩展语义引导方法,将语义计算从单个项目转移到用户定义组,通过单LLM调用为组生成结构化配置文件,减少LLM调用并在多模态嵌入中有效应用。

Comments Accepted as a short paper at IEEE VIS 2026. 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03925 2026-07-07 cs.LG 新提交 57%

NeuroOnline: Bridging Pretraining and Online Adaptation for EEG Foundation Models

NeuroOnline:为脑电图基础模型搭建预训练与在线适应的桥梁

Weibin Li, Wendu Li, Yushan You, Chen Wei, Quanying Liu

机构 * Southern University of Science and Technology(南方科技大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 研究脑电图基础模型,提出NeuroOnline框架,集成多视图一致性学习和上下文感知表示调制机制,统一表示对齐和动态适应,实验表明其在在线设置中性能优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03847 2026-07-07 cs.LG 新提交 57%

NeSy-CSA: A Neuro-Symbolic Framework for Open-Ended Critical Scenario Attribution

NeSy-CSA:一种用于开放式关键场景归因的神经符号框架

Qitong Chu, Xunjie He, Chen Deng, Huaxin Pei, Yufeng Yue

机构 * School of Automation, Beijing Institute of Technology(北京理工大学自动化学院) Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 研究如何理解场景测试中关键场景的成因,提出神经符号框架NeSy-CSA,通过选择相关因素缩小归因空间,经证据图使推理可追溯,结合符号与神经推理,提升关键场景归因有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03704 2026-07-07 cs.CL 新提交 57%

Optimizing Large Language Models for Causality Assessment in Pharmacovigilance: Developing a Performance Metric as Objective for Bayesian Hyperparameter Optimization

优化用于药物警戒中因果关系评估的大语言模型:开发一种性能指标作为贝叶斯超参数优化的目标

Nicole Sonne Heckmann, Arnault-Quentin Vermillet, Søren Norlin Mølgaard, Manuela Del Castillo Suero, Lars Melskens, Gerard Ompad, Maurizio Sessa

机构 * Department of Drug Design and Pharmacology, University of Copenhagen(哥本哈根大学药物设计与药理学系) Safety Operations, Novo Nordisk(诺和制药安全运营部) Clinical Development Centre Denmark, Novo Nordisk(丹麦临床开发中心,诺和制药) Statistical Data Science Lead, Pfizer(辉瑞统计数据科学负责人)

专题命中 其他安全 :safety(abstract);分类 cs.CL

AI总结 研究针对药物警戒中因果关系评估优化大语言模型,开发高斯过程兼容的优化目标,用链思维提示评估GPT-5.2,通过贝叶斯优化研究温度优化效果,EWACS指标优化提升了因果关系分类一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03478 2026-07-07 cs.AI 新提交 57%

Demonstrating Generalization Failures via Mixtures of Conditional Policies

通过条件策略混合展示泛化失败

Jou Barzdukas, Jack Peck, Julian Schulz, Paulius Rauba, Steven Basart, Lennie Wells

机构 * University of Virginia(弗吉尼亚大学) ETH Zurich(苏黎世联邦理工学院) MATS Meridian Visiting Researcher Program(子午访问研究员计划) University of Cambridge(剑桥大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 研究前沿语言模型训练后因环境分布变化导致泛化失败的问题。提出构建语言模型的方法,用监督微调基于条件策略混合数据集得到模型,经强化学习训练后出现可控泛化失败,还借此说明未来语言模型泛化失败的新方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03181 2026-07-07 cs.GT cs.AI 新提交 57%

Teaming Up with AI: Coordination and Cooperation

与人工智能合作:协调与协作

Nicole Immorlica, Inbal Talgam-Cohen

机构 * Yale University and Microsoft Research(耶鲁大学和微软研究院) Tel Aviv University(特拉维夫大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 探讨如何在劳动力中与人工智能协作以最大化经济价值并实现‘真正’协作。结合理论计算机科学和经济学,考虑协调与合作两层工具,展示基于算法和经济研究的方法可增强两者,为AI市场研究指明方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03009 2026-07-07 cs.LG 新提交 57%

Do ECG Foundation Models Transfer to Rare Cardiac Diseases? Evidence from Brugada Syndrome Detection

心电图基础模型能否迁移到罕见心脏疾病?来自Brugada综合征检测的证据

Beatrice Zanchi, Giuliana Monachino, Alvise Dei Rossi, Luigi Fiorillo, Georgia Sarquella-Brugada, Giulio Conte, Francesca Dalia Faraci

机构 * University of Applied Sciences and Arts of Southern Switzerland, Department of Innovative Technologies(瑞士南方应用科学与艺术大学创新技术系) University of Zurich, Department of Quantitative Biomedicine(苏黎世大学定量生物医学系) Università della Svizzera Italiana, Faculty of Informatics(瑞士意大利大学信息学院) Neurocenter of Southern Switzerland, Ente Ospedaliero Cantonale, Movement Disorder Research Group, Neurology Department(瑞士南方神经中心,坎达伦医院,运动障碍研究组,神经学系) Sleep Research Institute(睡眠研究 institutes) Hospital Sant Joan de Déu, Inherited Cardiac Diseases and Sudden Death Unit(圣约翰德德医院,遗传性心脏疾病和猝死单位) Cardiocentro Ticino Institute, Ente Ospedaliero Cantonale, Division of Cardiology(提奇诺心脏中心研究所,坎达伦医院,心血管科) Università della Svizzera Italiana, Faculty of Biomedical Sciences(瑞士意大利大学生物医学科学系)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 研究通过在两个队列上评估九种心电图基础模型,探讨其对罕见病检测的作用,采用多种策略和配置,发现预训练对某些架构必要但效果有限,挑战了大规模预训练能编码有意义表征的假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04277 2026-07-07 physics.soc-ph cs.AI 新提交 57%

Self-Reference in Large Language Models: The Introspection Threshold for Recursive Self-Improvement

大语言模型中的自我指涉:递归自我改进的内省阈值

Jiang Zhang, Bing Yuan, Qian Zhang

机构 * School of Systems Science, Beijing Normal University(北京师范大学系统科学学院) Swarma Research(Swarma研究院)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 探讨自我进化AI中自主自我改进可持续性的问题,类比冯·诺依曼自复制自动机的复杂性阈值,论证大语言模型中需内省,基于定理证明其理论存在,指出当前模型因结构瓶颈缺乏真正内省,并给出架构突破方向及安全影响。

Comments 21 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06857 2026-07-07 cs.CL 新提交 57%

Interpreting Brain Responses to Language with Sparse Features from Language Models

用语言模型稀疏特征解释大脑对语言的响应

Michael A. Lepori, Kendrick Kay, Greta Tuckute

机构 * Brown University(布朗大学) University of Minnesota(明尼苏达大学) Harvard University(哈佛大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 提出增强稀疏编码模型,用分层稀疏自编码器特征替代密集LM隐状态,并加入惊奇度预测器,解释大脑语言皮层响应,发现前颞叶语言网络由共同特征预测,且大脑响应与LM中最通用的特征对应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02046 2026-07-03 cs.LG 新提交 57%

Fast and Accurate Anomaly Detection in Time Series

时间序列中快速准确的异常检测

Emanuele Mele, Massimo Cafaro, Angelo Coluccia, Italo Epicoco

机构 * University of Salento(萨勒诺大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 提出一种基于Haar离散小波和t检验的无监督时间序列异常检测算法,在343个数据集上超越现有无监督和自监督方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01287 2026-07-03 cs.RO cs.AI cs.SY eess.SY 新提交 57%

Adaptive Companionship for Group-Following Robots: Handling Dynamically Changing Group Formations

群体跟随机器人的自适应陪伴:处理动态变化的群体编队

Cong-Thanh Vu, Yen-Chen Liu

机构 * National Cheng Kung University(国立成功大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 提出基于视觉语言模型的自适应群体陪伴方法,通过语义推理推断同伴位置、维持社交距离并理解群体动态,结合MPPI控制器实现稳定安全跟随,在五个场景中成功率提升15%,碰撞率降低25%。

Comments Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01065 2026-07-02 cs.LG 新提交 57%

GSRQ: Gain-Shape Residual Quantization for Sub-1-bit KV Cache

GSRQ: 面向亚1比特KV缓存的增益-形状残差量化

Soosung Kim, Minjae Park, Eui-Young Chung, Jaeyong Chung

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 针对大语言模型KV缓存压缩中向量量化导致的方向保持问题,提出增益-形状K均值(GSKM)替代标准K均值,并构建增益-形状残差量化(GSRQ),在1比特下将LongBench平均准确率从11.34提升至33.54。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏