arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, Berkeley(加州大学伯克利分校)

共收录 1884
2512.20111 2026-06-05 cs.CL cs.AI cs.LG

ABBEL: Learning Natural-Language Belief States for Memory-Efficient Interaction

ABBEL: 为高效交互学习自然语言信念状态

Aly Lidayan, Jakob Bjorner, Satvik Golechha, Kartik Goyal, Alane Suhr

机构 * University of California, Berkeley(加州大学伯克利分校) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本文提出ABBEL框架,通过显式自然语言信念状态直接监督每个摘要的信息内容,以解决传统方法在生成摘要时信息丢失或更新错误的问题,从而在保持高效内存使用的同时提升交互性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21667 2026-06-05 cs.LG cs.AI

Escaping the Verifier: Learning to Reason via Demonstrations

摆脱验证者:通过示范学习推理

Locke Cai, Max Ryabinin, Ivan Provilkov

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 本文提出RARO方法,通过逆强化学习从专家示范中学习强大的推理能力,无需任务特定的验证者,从而在多个评估任务中实现了显著的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08972 2026-06-05 cs.LG

Selective Sinkhorn Routing for Improved Sparse Mixture of Experts

选择性Sinkhorn路由以提高稀疏专家混合模型

Duc Anh Nguyen, Huu Binh Ta, Nhuan Le Duc, Tan Minh Nguyen, Toan Tran

机构 * University of California, Berkeley(加州大学伯克利分校) National University of Singapore(新加坡国立大学)

AI总结 本文提出了一种选择性Sinkhorn路由方法,通过将token到专家的分配问题转化为最优传输问题,并引入约束以确保专家利用率均衡,从而在不依赖辅助平衡损失的情况下提升稀疏专家混合模型的性能。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11974 2026-06-05 cs.CR cs.AI

CTIConnect: A Benchmark for Retrieval-Augmented LLMs over Heterogeneous Cyber Threat Intelligence

CTIConnect:一种用于异构网络威胁情报的检索增强大语言模型基准

Yutong Cheng, Yang Liu, Changze Li, Dawn Song, Peng Gao

机构 * Virginia Tech Department of Computer Science(弗吉尼亚理工大学计算机科学系) University of California, Berkeley Department of Computer Science(加州大学伯克利分校计算机科学系)

AI总结 本文提出CTIConnect基准,用于评估检索增强型大语言模型在网络威胁情报任务中的表现,通过整合五个异构数据源构建了1860个专家验证的问答对,揭示了不同任务类别中跨源语义差距的差异以及检索策略和性能瓶颈的变化,展示了领域特定策略在提升性能上的优势。

Comments Accepted to KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20324 2026-06-05 cs.CR cs.AI

RAG Security and Privacy: Formalizing the Threat Model and Attack Surface

RAG安全与隐私:形式化威胁模型和攻击面

Atousa Arzanipour, Rouzbeh Behnia, Reza Ebrahimi, Kaushik Dutta

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文研究了RAG系统中的安全与隐私问题,提出首个形式化的威胁模型,定义了攻击向量如文档级成员推断和数据中毒,以提升对RAG系统隐私和安全性的理解。

Comments Published at the 5th ICDM Workshop in November 2025

Journal ref 2025 IEEE International Conference on Data Mining Workshops (ICDMW), pp. 1387-1394, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06219 2026-06-05 cs.RO cs.AI cs.LG

Is Diversity All You Need for Scalable Robotic Manipulation?

多样性是否是可扩展机器人操作的全部需求?

Modi Shi, Li Chen, Jin Chen, Yuxiang Lu, Chiming Liu, Guanghui Ren, Ping Luo, Di Huang, Maoqing Yao, Hongyang Li

机构 * University of Science and Technology of China(中国科学技术大学) Tsinghua University(清华大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 本文研究了数据多样性在机器人学习中的作用,发现任务多样性比单任务演示量更重要,多身体预训练数据在跨身体转移中可选,专家多样性可能对策略学习产生干扰,提出分布去偏方法提升性能。

Comments Code is available at https://github.com/OpenDriveLab/AgiBot-World

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10145 2026-06-05 cs.CV

RoCA: Robust Cross-Domain End-to-End Autonomous Driving

RoCA: 面向鲁棒跨域端到端自动驾驶的框架

Rajeev Yasarla, Shizhong Han, Hsin-Pai Cheng, Apratim Bhattacharyya, Shweta Mahajan, Litian Liu, Yunxiao Shi, Risheek Garrepalli, Hong Cai, Fatih Porikli

机构 * University of California, Berkeley(加州大学伯克利分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of California, San Diego(加州大学圣地亚哥分校) University of California, Los Angeles(加州大学洛杉矶分校) University of California, Davis(加州大学戴维斯分校)

AI总结 本文提出RoCA框架,通过联合概率分布建模端到端自动驾驶管道中的 ego 和周围车辆信息,提升跨域自动驾驶的泛化能力和鲁棒性,无需额外推理计算。

Comments accepted for ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00188 2026-06-05 cs.LG stat.ML

Cluster-Aware Causal Mixer for Online Anomaly Detection in Multivariate Time Series

基于聚类的因果混合器用于多变量时间序列的在线异常检测

Md Mahmuddun Nabi Murad, Yasin Yilmaz

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出了一种基于聚类的因果混合器,用于多变量时间序列的在线异常检测,通过聚类处理通道间的相关性,结合因果混合器保持时间因果性,并开发了序列异常评分方法以提高检测准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10897 2026-06-05 cs.CV

Can Language Models Learn to Listen?

语言模型能否学会倾听?

Evonne Ng, Sanjay Subramanian, Dan Klein, Angjoo Kanazawa, Trevor Darrell, Shiry Ginosar

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出了一种基于说话人话语生成适当面部回应的框架,通过将量化后的面部动作元素作为额外语言token输入到基于transformer的大型语言模型中,从而提升监听响应的质量。

Comments ICCV 2023; Project page: https://people.eecs.berkeley.edu/~evonne_ng/projects/text2listen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.06847 2026-06-05 cs.CL cs.CY cs.SI physics.soc-ph

Ousiometrics: The essence of meaning aligns with a power-danger-structure framework instead of valence-arousal-dominance

Ousiometrics: 本质的意义与权力-危险-结构框架相一致,而非价值-唤醒-主导框架

P. S. Dodds, T. Alshaabi, M. I. Fudolig, J. W. Zimmerman, J. Lovato, S. Beaulieu, J. R. Minot, M. V. Arnold, A. J. Reagan, C. M. Danforth

机构 * Computational Story Lab, Vermont Advanced Computing Center, University of Vermont, Burlington, VT 05405, United States(计算故事实验室、佛蒙特高级计算中心、佛蒙特大学、伯灵顿,VT 05405,美国) Vermont Complex Systems Institute, MassMutual Center of Excellence for Complex Systems and Data Science, University of Vermont, Burlington, VT 05405, United States(佛蒙特复杂系统研究所、马斯穆特复杂系统和数据科学卓越中心、佛蒙特大学、伯灵顿,VT 05405,美国) Department of Computer Science, University of Vermont, Burlington, VT 05405, United States(计算机科学系、佛蒙特大学、伯灵顿,VT 05405,美国) Santa Fe Institute, 1399 Hyde Park Rd, Santa Fe, NM 87501, United States(圣达菲研究所、1399号海德公园路,圣达菲,NM 87501,美国) Howard Hughes Medical Institute, Janelia Research Campus, Ashburn, VA 20147, United States(霍华德·休斯医学研究所、贾能利亚研究校区、阿什伯恩,VA 20147,美国) Advanced Bioimaging Center, University of California Berkeley, Berkeley, CA 94720, United States(先进生物成像中心、加州大学伯克利分校、伯克利,CA 94720,美国) School of Computer and Mathematical Sciences, University of Adelaide, Adelaide, SA 5005, Australia(计算机与数学科学学院、阿德莱德大学、阿德莱德,SA 5005,澳大利亚) Computational Ethics Lab, University of Vermont, Burlington, VT 05405, United States(计算伦理实验室、佛蒙特大学、伯灵顿,VT 05405,美国)

AI总结 本文提出了一种新的意义本质描述框架GPADS,通过分析英语语料库发现,意义本质应由权力-危险-结构框架描述,并构建了ousiometer原型。

Comments 115 pages (30 page main manuscript, 85 page appendix), 82 figures (9 main, 73 appendix), 3 tables (2 main, 1 appendix)

Journal ref Science Advances, 12(9): eadr4039, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05129 2026-06-04 cs.CR cs.LG

Preserving Data Privacy in Learning Causal Structure with Fully Homomorphic Encryption

在全同态加密下学习因果结构时保护数据隐私

Jian Yang, Yuan Tong, Qinbin Li, Zeyi Wen, Xiaofang Zhou

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)) Hong Kong University of Science and Technology(香港理工大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 针对分布式因果结构学习中的隐私泄露问题,提出基于全同态加密的方法,通过电路简化、除法和对数近似以及SIMD批处理技术,在加密数据上高效完成因果结构学习,并支持扩展到差分隐私。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05101 2026-06-04 cs.SD cs.LG

FoeGlass: Simple In-Context Learning Is Enough for Red Teaming Audio Deepfake Detectors

FoeGlass: 简单的上下文学习足以对音频深度伪造检测器进行红队测试

Sepehr Dehdashtian, Jacob H Seidman, Vishnu N Boddeti, Gaurav Bharaj

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出FoeGlass,一种基于大语言模型上下文学习的黑盒自动红队方法,通过生成音频样本发现深度伪造检测器的盲点,将假阴性率降低高达94%。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05080 2026-06-04 cs.AI cs.LG

AutoLab: Can Frontier Models Solve Long-Horizon Auto Research and Engineering Tasks?

AutoLab:前沿模型能否解决长周期自动研究与工程任务?

Zhangchen Xu, Junda Chen, Yue Huang, Dongfu Jiang, Jiefeng Chen, Hang Hua, Zijian Wu, Zheyuan Liu, Zexue He, Lichi Li, Shizhe Diao, Jiaxin Pei, Jinsung Yoon, Hao Zhang, Mengdi Wang, Radha Poovendran, Misha Sra, Alex Pentland, Zichen Chen

机构 * MIT(麻省理工学院) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) University of California, Los Angeles(加州大学洛杉矶分校) University of California, San Diego(加州大学圣地亚哥分校) University of Washington(华盛顿大学) University of Toronto(多伦多大学) University of Michigan(密歇根大学) National University of Singapore(新加坡国立大学) University of Tokyo(东京大学)

AI总结 本文提出AutoLab基准,通过36个专家策划的长周期闭环优化任务评估前沿模型,发现持续迭代和利用经验反馈比初始尝试质量更重要。

Comments Code: https://github.com/autolabhq/autolab ; Website: https://autolab.moe/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04980 2026-06-04 cs.LG

AlphaQ: Calibration-Free Bit Allocation for Mixture-of-Experts Quantization

AlphaQ: 混合专家量化的免校准位分配

Wanqi Yang, Yuexiao Ma, Alexander Conzelmann, Xiawu Zheng, Michael W. Mahoney, T. Konstantin Rusch, Shiwei Liu

机构 * Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所) Tübingen AI Center(图宾根人工智能中心) Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Xiamen University(厦门大学多媒体可信感知与高效计算重点实验室) International Computer Science Institute(国际计算机科学研究所) Lawrence Berkeley National Laboratory(伯克利国家实验室) University of California, Berkeley(加州大学伯克利分校) Liquid AI

AI总结 针对混合专家模型量化中依赖校准数据导致位分配次优的问题,提出基于重尾自正则化理论的免校准位分配方法AlphaQ,通过专家权重谱的重尾程度分配位宽,在预算约束下最小化量化误差,实现接近全精度的性能。

Comments 28 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04876 2026-06-04 cs.LG

Towards Pretraining Text Encoders for TabPFN

面向TabPFN的文本编码器预训练

Mustafa Tajjar, Alexander Pfefferle, Lennart Purucker, Frank Hutter

机构 * University of California, Berkeley(加州大学伯克利分校) DeepMind(深度思维)

AI总结 提出TabPFN文本适配器,通过轻量级适配器将文本嵌入映射到TabPFN的嵌入空间,避免PCA瓶颈,保留TabPFN数值优势,训练效率更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04867 2026-06-04 cs.AI

AICompanionBench: Benchmarking LLMs-as-Judges for AI Companion Safety

AICompanionBench: 以LLM为评判标准的AI伴侣安全基准测试

Yanjing Ren, Reza Ebrahimi, TengTeng Ma

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 本文提出AICompanionBench,首个公开的细粒度安全风险标注的人机伴侣对话基准数据集,并评估20个LLM在检测不安全交互中的表现,发现强模型在显式有害内容上准确率高,但难以识别隐式不安全交互。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04853 2026-06-04 cs.RO

Teaching Robots to Say 'I Don't Know' : SENTINEL for Uncertainty-Aware SLAM

教机器人说‘我不知道’:用于不确定性感知SLAM的SENTINEL

Abhishek S, Badrikanath Praharaj, Sreeram MV

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出SENTINEL框架,通过几何扫描统计和跨模态深度一致性为低成本2D LiDAR提供无训练、无标签的可靠性评分,拒绝损坏扫描并回退到轮式里程计,防止SLAM无声损坏。

Comments 6 pages, 10 figures, 3 tables, This paper was accepted at Uncertainty in Open-World Robotics Workshop in conjunction with Internation conference of robotics and automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04665 2026-06-04 cs.LG

Towards Accurate Model Selection in Deep Unsupervised Domain Adaptation

面向深度无监督域适应的精确模型选择

Kaichao You, Ximei Wang, Mingsheng Long, Michael I. Jordan

机构 * University of California, Berkeley(加州大学伯克利分校) UC Berkeley(加州大学伯克利分校)

AI总结 针对深度无监督域适应中缺乏准确模型选择方法的问题,提出Deep Embedded Validation (DEV)方法,通过嵌入适应特征表示到验证过程中,获得目标风险的无偏估计,并利用控制变量技术降低方差,理论和实验证明了其有效性。

Comments upload to arxiv for record

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04569 2026-06-04 cs.RO

MineXplore: An Open-Source Reinforcement Learning Exploration Benchmark for GNSS-Denied Underground Environment

MineXplore: 面向GNSS拒止地下环境的开源强化学习探索基准

Abhishek S, Badrikanath Praharaj, Sreeram MV

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

AI总结 提出基于真实矿井数据的开源MuJoCo导航基准MineXplore,通过六阶段管道重建隧道网络,验证了在GNSS拒止、光照退化等极端条件下策略学习的稳定性与可复现性。

Comments 7 pages,11 figures, Submitted to the workshop Xplore:Cross-Disciplinary aspects of Exploration in Robotics, Reinforcement Learning and Search Held at International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04434 2026-06-04 cs.CV cs.LG

Hyper-ICL: Attention Calibration with Hyperbolic Anchor Distillation for Multimodal In-Context Learning

Hyper-ICL:基于双曲锚点蒸馏的注意力校准用于多模态上下文学习

Niloufar Alipour Talemi, Hossein Kashiani, Fatemeh Afghah

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出Hyper-ICL,一种轻量级训练框架,通过低秩logit适配器和双曲锚点蒸馏损失校准注意力分布,无需推理时提供上下文示例即可重建演示效果,提升多模态上下文学习的准确性和稳定性。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04433 2026-06-04 cs.CV cs.CL cs.LG

Stateful Visual Encoders for Vision-Language Models

用于视觉-语言模型的有状态视觉编码器

Zirui Wang, Junwei Yu, Adam Yala, David M. Chan, Joseph E. Gonzalez, Trevor Darrell

机构 * University of California, Berkeley(加州大学伯克利分校) UC Berkeley(加州大学伯克利分校)

AI总结 提出有状态视觉编码器,通过将每个视觉表示条件于先前的视觉特征,增强视觉-语言模型在多图像、多轮交互中的视觉变化感知能力,在跨图像空间聚合、多目标视觉差异和轨迹行为克隆等任务上取得一致改进。

Comments Project page: https://statefulvisualencoders.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04378 2026-06-04 cs.CL

DLLG: Dynamic Logit-Level Gating of LLM Experts

DLLG: 大语言模型专家的动态logit级门控

Bingnan Li, Zhaoyang Zhang, Xiaoze Liu, Yantao Shen, Shuli Jiang, Shuo Yang, Wei Xia, Zhuowen Tu, Stefano Soatto

机构 * University of California, Berkeley(加州大学伯克利分校) Princeton University(普林斯顿大学)

AI总结 提出DLLG框架,通过轻量级门控模块学习token级专家融合权重,利用稀疏的响应级监督实现动态logit级集成,无需token级标签或专家重训练,在推理和代码基准上优于路由、启发式集成和参数合并方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04328 2026-06-04 cs.NI cs.AI

Generalizable Multi-Task Learning for Wireless Networks Using Prompt Decision Transformers

基于提示决策变压器的无线网络可泛化多任务学习

Fatih Temiz, Shavbo Salehi, Melike Erol-Kantarci

机构 * IEEE University of California, Berkeley(加州大学伯克利分校)

AI总结 提出PromptDT框架,将多小区选择重构为序列建模问题,利用离线轨迹和任务特定提示实现跨异构网络配置的可扩展学习,在无需重训练的情况下提升多任务QoE达49%。

Comments Accepted paper at IEEE International Mediterranean Conference on Communications and Networking (MeditCom) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04261 2026-06-04 cs.AI cs.CL cs.CV cs.ET cs.LG

Can Generalist Agents Automate Data Curation?

通用智能体能否自动化数据筛选?

Feiyang Kang, Hanze Li, Adam Nguyen, Mahavir Dabas, Jiaqi W. Ma, Frederic Sala, Dawn Song, Ruoxi Jia

机构 * Virginia Tech(弗吉尼亚理工大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出Curation-Bench基准,通过通用编码智能体自动化数据筛选循环,实验表明现成智能体可达到强基线,但存在执行-研究差距,而结构化方法引导的智能体能在十分之一数据预算下自主组合出优于强基线的数据选择策略。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04244 2026-06-04 cs.AI cs.CL cs.CV cs.LG

VAMPS: Visual-Assisted Mathematical Problem Solving Benchmark

VAMPS: 视觉辅助数学问题求解基准

Amirhossein Dabiriaghdam, Shayan Vassef, Mohammadreza Bakhtiari, Yasamin Medghalchi, Ilker Hacihaliloglu, Mesrob Ohannessian, Lele Wang, Giuseppe Carenini

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出VAMPS基准,通过1,168道双语多选题评估多模态大模型在借助绘图工具进行数学推理时的表现,发现直接解析求解优于工具辅助视觉求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04222 2026-06-04 cs.RO

Towards Estimating Normal and Shear Interface Pressures in Prosthetic Sockets via Least Squares and Mechanics Modeling

通过最小二乘和力学建模估算假肢接受腔中的法向和剪切界面压力

Axel González Cornejo, Tianhao Yu, Chi Hwan Lee, Edgar Bolívar-Nieto

机构 * University of California, Berkeley(加州大学伯克利分校) University of Michigan(密歇根大学)

AI总结 针对假肢接受腔界面压力测量中剪切力缺失和传感器串扰问题,提出一种基于稀疏传感和最小二乘的准静态弹簧-质量接触模型,通过全局力/力矩和局部压力数据验证模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04194 2026-06-04 cs.LG cs.CL cs.IR

Training-Free Lexical-Dense Fusion for Conversational-Memory Retrieval

免训练的词汇-稠密融合用于对话记忆检索

Christian Lysenstøen

机构 * Inland Norway University of Applied Sciences(内陆挪威应用科学大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出一种免训练、仅CPU的检索方法,通过分数级融合最大查询-轮次相似度(后期交互)与BM25,显著提升多会话对话记忆检索的命中率,并分析了不同编码器和池化策略的影响。

Comments 9 pages, 3 figures, 10 tables. Code, data, and per-table receipts: https://github.com/Chrislysen/opsem

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04182 2026-06-04 cs.LG cs.AI stat.ML

Exact Unlearning in Reinforcement Learning

强化学习中的精确遗忘

Thanh Nguyen-Tang, Raman Arora

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 本文提出强化学习中的精确遗忘问题,通过ρ-TV稳定算法实现数据删除后输出与从未学习该数据时不可区分,并给出近乎最优的遗憾界。

Comments ICML Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04180 2026-06-04 cs.LG cs.IT math.IT

KODA: Contrastive Representation Comparison and Alignment for Vision-Language Foundation Models

KODA: 视觉-语言基础模型的对比表示比较与对齐

Youqi Wu, Mohammad Jalali, Farzan Farnia

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 提出KODA框架,通过核优化方法对比分析视觉-语言基础模型的表示差异,并识别弱聚类与强聚类的样本子集,实现表示对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04141 2026-06-04 cs.CR cs.AI

Caught in the Act(ivation): Toward Pre-Output and Multi-Turn Detection of Credential Exfiltration by LLM Agents

当场抓获(激活):面向LLM智能体的凭证泄露预输出和多轮检测

Kargi Chauhan, Pratibha Revankar

机构 * University of California, Berkeley(加州大学伯克利分校)

AI总结 研究通过激活探针、蜜令令牌和累积信息流追踪三种互补防御方法,在预输出和多轮对话中检测LLM智能体的凭证泄露。

详情

展开后加载摘要…

URL PDF HTML 收藏