arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-03-18 至 2026-03-18 共收录 29 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 29 篇

2603.15800 2026-03-18 cs.CV cs.CL cs.CR 83%

Evolving Contextual Safety in Multi-Modal Large Language Models via Inference-Time Self-Reflective Memory

通过推理时的自我反思记忆在多模态大语言模型中实现上下文安全演化

Ce Zhang, Jinxi He, Junyi He, Katia Sycara, Yaqi Xie

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 安全评测 :safety(title,abstract);jailbreak(abstract);分类 cs.CL

AI总结 本文提出MM-SafetyBench++基准和EchoSafe框架,通过自反思记忆实现多模态大语言模型的上下文安全演化,实验表明其在安全性能上表现优异。

Comments Accepted at CVPR 2026. Project page: https://echosafe-mllm.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06194 2026-03-18 cs.CY cs.AI cs.CL 82%

Political Alignment in Large Language Models: A Multidimensional Audit of Psychometric Identity and Behavioral Bias

大语言模型中的政治倾向:心理测量身份与行为偏见的多维审计

Adib Sakhawat, Tahsin Islam, Takia Farhin, Syed Rifat Raiyan, Hasan Mahmud, Md Kamrul Hasan

机构 * Systems and Software Lab (SSL) Department of Computer Science and Engineering(系统与软件实验室(SSL)计算机科学与工程系)

专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI、cs.CY

AI总结 研究通过多维心理测量工具审计26个大语言模型,发现模型在政治倾向上聚类于自由主义左 quadrant,且模型身份解释了大部分变异性,但心理测量意识形态未显著预测分类误差。

Comments Under review, 25 pages, 6 figures, 23 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16143 2026-03-18 eess.SP cs.AI 79%

Structure-Aware Multimodal LLM Framework for Trustworthy Near-Field Beam Prediction

面向可信近场波束预测的结构感知多模态大语言模型框架

Mengyuan Li, Qianfan Lu, Jiachen Tian, Hongjun Hu, Yu Han, Xiao Li, Chao-kai Wen, Shi Jin

机构 * School of Information Science and Engineering, Southeast University(信息科学与工程学院,东南大学) Institute of Communications Engineering, National Sun Yat-sen University(通讯工程学院,国立中山大学)

专题命中 安全评测 :trustworthy(title);alignment(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的多模态框架,融合历史GPS数据、RGB图像、LiDAR数据及任务特定文本提示,以提升复杂低空环境中的近场波束对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16052 2026-03-18 cs.AI 79%

A Context Alignment Pre-processor for Enhancing the Coherence of Human-LLM Dialog

一种增强人与大语言模型对话连贯性的上下文对齐预处理模块

Ding Wei

机构 * College of Architecture, Nanjing Tech University(南京工业大学建筑学院)

专题命中 安全评测 :alignment(title,abstract);分类 cs.AI

AI总结 本文提出C.A.P.预处理框架,通过语义扩展、时间加权上下文检索和对齐验证,解决长对话中的上下文错位问题,提升对话连贯性与协作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15655 2026-03-18 cs.LG cs.AI cs.CL cs.IT cs.MA math.IT 78%

Beyond Reward Suppression: Reshaping Steganographic Communication Protocols in MARL via Dynamic Representational Circuit Breaking

超越奖励压制:通过动态表示电路断开重塑MARL中的隐写通信协议

Liu Hung Ming

机构 * PARRAWA AI(PARRAWA人工智能)

专题命中 安全评测 :safety(abstract,comments);AI safety(abstract,comments);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出动态表示电路断开机制,用于检测MARL中的隐写协作,通过统计对象转换和动态干预提升观测准确性并降低波动性。

Comments 38 pages, includes 5 figures and 8 tables, preliminary version, AI safety / multi-agent reinforcement learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06183 2026-03-18 cs.CL cs.AI cs.CV 73%

CRIMSON: A Clinically-Grounded LLM-Based Metric for Generative Radiology Report Evaluation

CRIMSON:一种基于临床的LLM评估指标用于生成放射学报告评估

Mohammed Baharoon, Thibault Heintz, Siavash Raissi, Mahmoud Alabbad, Mona Alhammad, Hassan AlOmaish, Sung Eun Kim, Oishi Banerjee, Pranav Rajpurkar

机构 * Department of Biomedical Informatics, Harvard Medical School(生物医学信息学系,哈佛医学院) Department of Radiation Oncology, Mass General Brigham(放射肿瘤科,麻省总医院与布里奇沃特医院) King Fahad Hospital, Al-Ahsa Health Cluster, Al Hofuf, Saudi Arabia(国王法赫德医院,阿尔阿萨卫生集群,阿尔霍夫,沙特阿拉伯) Ras-Tanura General Hospital, Ministry of Health, Eastern Province, Saudi Arabia(拉斯-坦纳医院,卫生部,东部省,沙特阿拉伯) Department of Medical Imaging, King Abdulaziz Medical City, Ministry of National Guard, Riyadh, Saudi Arabia(医学影像科,国王阿卜杜勒-阿齐兹医疗城,国民卫队部,利雅得,沙特阿拉伯)

专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.CL、cs.AI

AI总结 CRIMSON是一种基于临床的LLM评估指标,用于评估生成的放射学报告,通过考虑诊断正确性、上下文相关性和患者安全,提供更全面的评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16445 2026-03-18 cs.AI 70%

Visual Distraction Undermines Moral Reasoning in Vision-Language Models

视觉干扰削弱了视觉语言模型中的道德推理

Xinyi Yang, Chenheng Xu, Weijun Hong, Ce Mo, Qian Wang, Fang Fang, Yixin Zhu

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Yuanpei College, Peking University(北京大学元培学院) Department of Psychology, Sun Yat-sen University(中山大学心理学系) State Key Lab of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京大学行为与心理健康北京市重点实验室)

专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.AI

AI总结 研究揭示视觉输入会改变视觉语言模型的道德决策,超越文本安全机制,提出多模态基准MDS以分析视觉与上下文变量对道德决策的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16260 2026-03-18 cs.CY cs.AI cs.HC 62%

Human/AI Collective Intelligence for Deliberative Democracy: A Human-Centred Design Approach

人类/人工智能集体智能用于审议民主:一种以人类为中心的设计方法

Anna De Liddo, Lucas Anastasiou, Simon Buckingham Shum

机构 * Knowledge Media Institute, The Open University(知识媒体研究所,开放大学) Connected Intelligence Centre, University of Technology Sydney(连接智能中心,技术悉尼大学)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.CY

AI总结 本文提出利用人工智能增强审议民主的集体智能概念,探讨以人类为中心的设计方法,通过协作设计方法识别挑战、细化用户场景并推导技术影响,展示AI支持下公民组织需求的实现案例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15950 2026-03-18 cs.CL cs.CY cs.SI 62%

POLAR:A Per-User Association Test in Embedding Space

POLAR:嵌入空间中的用户级关联测试

Pedro Bento, Arthur Buzelin, Arthur Chagas, Yan Aquino, Victoria Estanislau, Samira Malaquias, Pedro Robles Dutenhefner, Gisele L. Pappa, Virgilio Almeida, Wagner MeiraJr

专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.CY

AI总结 POLAR在嵌入空间中进行用户级词汇关联测试,通过定制化的词汇轴评估作者差异,区分LLM驱动的机器人与真实账号,并揭示极端论坛中词汇偏移趋势。

Comments Accepted paper at ICWSM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15897 2026-03-18 cs.CL cs.AI 62%

COGNAC at SemEval-2026 Task 5: LLM Ensembles for Human-Level Word Sense Plausibility Rating in Challenging Narratives

COGNAC在SemEval-2026任务5中的应用:用于挑战性叙事中人类水平词义可信度评估的LLM集成

Azwad Anjum Islam, Tisa Islam Erana

机构 * Florida International University Knight Foundation School of Computing and Information Sciences(佛罗里达国际大学骑士基金会计算与信息科学学院)

专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出使用多个闭源商业LLM的集成方法,通过三种提示策略提升短篇故事中多义词词义可信度评估的准确性,最终在比赛中获得第四名。

Comments System description paper in SemEval-2026, Task 5

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22223 2026-03-18 cs.LG cs.AI cs.CR cs.NI 62%

ReGAIN: Retrieval-Grounded AI Framework for Network Traffic Analysis

ReGAIN:基于检索的网络流量分析人工智能框架

Shaghayegh Shajarian, Kennedy Marsh, James Benson, Sajad Khorsandroo, Mahmoud Abdelsalam

机构 * Computer Science(计算机科学) North Carolina A\&T State University(北卡罗来纳A&T州立大学) Institute for Cyber Security(网络安全研究所) University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG

AI总结 ReGAIN结合流量摘要、检索增强生成和大语言模型推理,实现透明准确的网络流量分析,通过多阶段框架提升安全性和性能,验证结果显示其在不同攻击类型中准确率高达95.95%-98.82%。

Comments Accepted to ICNC 2026. This is the accepted author manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12832 2026-03-18 cs.CL cs.AI 62%

From Passive to Persuasive: Localized Activation Injection for Empathy and Negotiation

从被动到说服:局部激活注入用于共情与谈判

Niranjan Chebrolu, Kokil Jaidka, Gerard Christopher Yeo

机构 * Centre for Trusted Internet and Community(可信互联网与社区中心) Department of Communications and New Media(通讯与新媒体系)

专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出STAR方法,通过局部激活注入提升共情和谈判能力,实验证明其优于全局激活和指令预训练,表明复杂人际行为在LLM激活空间中以局部线性方向编码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23135 2026-03-18 cs.LG cs.AI cs.LO cs.PL cs.SE 62%

VERINA: Benchmarking Verifiable Code Generation

VERINA:可验证代码生成基准测试

Zhe Ye, Zhengxu Yan, Jingxuan He, Timothe Kasriel, Kaiyu Yang, Dawn Song

机构 * University of California, Berkeley(加州大学伯克利分校) Meta FAIR

专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出VERINA基准测试,用于全面评估代码、规范及证明生成能力,揭示LLM在可验证代码生成中的挑战,特别是证明生成的困难。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15713 2026-03-18 cs.LG cs.AI cs.IR 62%

Embedding-Aware Feature Discovery: Bridging Latent Representations and Interpretable Features in Event Sequences

嵌入感知特征发现:连接潜在表示与可解释特征在事件序列中

Artem Sakhno, Ivan Sergeev, Alexey Shestov, Omar Zoloev, Elizaveta Kovtun, Gleb Gusev, Andrey Savchenko, Maksim Makarenko

机构 * Sber AI Lab(Sber AI实验室) ISP RAS Research Center for Trusted AI(俄罗斯科学院信息与系统研究所可信人工智能研究中心)

专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出EAFD框架,通过结合预训练事件序列嵌入与自反思LLM驱动特征生成代理,解决嵌入与特征管道间的断层问题,实现特征的发现、评估与优化,提升事件序列处理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15634 2026-03-18 cs.AI cs.IR cs.LG 62%

NextMem: Towards Latent Factual Memory for LLM-based Agents

NextMem: 向基于大语言模型的智能体构建潜在事实记忆

Zeyu Zhang, Rui Li, Xiaoyan Zhao, Yang Zhang, Wenjie Wang, Xu Chen, Tat-Seng Chua

专题命中 安全评测 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 NextMem提出一种基于自回归自编码器的潜在事实记忆框架,通过两阶段训练和量化技术提升记忆构建效率与准确性,在检索、鲁棒性和扩展性方面表现优异。

Comments 17 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16581 2026-03-18 cs.AI 57%

V-DyKnow: A Dynamic Benchmark for Time-Sensitive Knowledge in Vision Language Models

V-DyKnow:面向视觉语言模型的时间敏感知识动态基准

Seyed Mahed Mousavi, Christian Moiola, Massimo Rizzoli, Simone Alghisi, Giuseppe Riccardi

机构 * Signals and Interactive Systems Lab, University of Trento(信号与交互系统实验室,特伦托大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出V-DyKnow基准,评估视觉语言模型对时间敏感事实知识的处理能力,分析模型响应可靠性、知识更新方法有效性及过时预测原因,揭示当前VLM在多模态时间敏感知识获取与更新中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16526 2026-03-18 cs.AI 57%

Exploring different approaches to customize language models for domain-specific text-to-code generation

探索不同方法以定制语言模型用于领域特定的文本到代码生成

Luís Freire, Fernanda A. Andaló, Nicki Skafte Detlefsen

机构 * Technical University of Denmark(丹麦技术大学) The LEGO Group(乐高集团)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文探讨了如何通过合成数据集定制小型语言模型用于领域特定的代码生成,比较了少样本提示、检索增强生成和LoRA微调三种方法,发现LoRA在准确性和领域对齐上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16215 2026-03-18 cs.MA cs.AI 57%

CoMAI: A Collaborative Multi-Agent Framework for Robust and Equitable Interview Evaluation

CoMAI:一种用于鲁棒且公平面试评估的协作多智能体框架

Gengxin Sun, Ruihao Yu, Liangyi Yin, Yunqi Yang, Bin Zhang, Zhiwei Xu

机构 * Shandong University(山东大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 安全评测 :prompt injection(abstract);分类 cs.AI

AI总结 CoMAI通过协作多智能体框架实现鲁棒且公平的面试评估,采用模块化任务分解架构,包含问题生成、安全、评分和总结四个智能体,提升评估的准确性和公平性。

Comments Gengxin Sun and Ruihao Yu contributed equally to this research. Bin Zhang and Zhiwei Xu are the corresponding authors. 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16113 2026-03-18 cs.CV cs.AI 57%

PathGLS: Evaluating Pathology Vision-Language Models without Ground Truth through Multi-Dimensional Consistency

PathGLS: 通过多维一致性评估病理视觉-语言模型无需真实数据

Minbing Chen, Zhu Meng, Fei Su

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出PathGLS,一种无需真实数据的病理VLM评估框架,从 grounding、logic 和 stability 三个维度评估模型性能,通过实验验证其在多个数据集上的优越性,显著优于其他方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15946 2026-03-18 cs.AI 57%

Argumentative Human-AI Decision-Making: Toward AI Agents That Reason With Us, Not For Us

论证型人机决策:迈向与我们共思而非为我们决策的AI代理

Stylianos Loukas Vasileiou, Antonio Rago, Francesca Toni, William Yeoh

机构 * New Mexico State University(新墨西哥州立大学) King's College London(伦敦国王学院) Imperial College London(伦敦帝国学院) Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 本文探讨论证型人机决策的新范式,结合论证框架挖掘、合成与推理,使AI代理能与人类进行辩证互动,提升高风险领域的人工智能可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07923 2026-03-18 cs.CV cs.AI 57%

Exploring the Underwater World Segmentation without Extra Training

探索无需额外训练的水下世界分割

Bingyu Li, Tao Huo, Da Zhang, Zhiyuan Zhao, Junyu Gao, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom, China(人工智能研究院(TeleAI),中国电信,中国) University of Science and Technology of China, China(中国科学技术大学,中国) Northwestern Polytechnical University, China(西北工业大学,中国)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出AquaOV255水下分割数据集及Earth2Ocean框架,通过几何引导视觉掩码生成和类别-视觉语义对齐模块,在无需额外训练的情况下实现高效的水下开放词汇分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20085 2026-03-18 cs.HC cs.AI 57%

Explanation User Interfaces: A Systematic Literature Review

解释用户界面:系统文献综述

Eleonora Cappuccio, Andrea Esposito, Francesco Greco, Giuseppe Desolda, Rosa Lanzilotti, Salvatore Rinzivillo

机构 * University of Pisa(比萨大学) University of Bari Aldo Moro(巴里阿尔多·莫罗大学)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 本文通过系统文献综述探讨了解释用户界面(XUIs)的设计与指南,提出HERMES平台以提升XUI的设计与评估效果。

Comments Second version

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19596 2026-03-18 eess.SP cs.LG 57%

Towards Robust Multimodal Physiological Foundation Models: Handling Arbitrary Missing Modalities

迈向稳健的多模态生理基础模型:处理任意缺失模态

Wei-Bang Jiang, Xi Fu, Yi Ding, Cuntai Guan

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 安全评测 :alignment(abstract);分类 cs.LG

AI总结 本文提出PhysioOmni模型,通过解耦多模态信号提取通用表示,解决现有方法在跨数据集泛化和缺失模态处理上的不足,实验显示其在情绪识别等任务中表现优异。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15672 2026-03-18 cs.AR cs.AI cs.SE 57%

DRCY: Agentic Hardware Design Reviews

DRCY:代理硬件设计审查

Kyle Dumont, Nicholas Herbert, Hayder Tirmazi, Shrikanth Upadhayaya

机构 * AllSpice Inc.(AllSpice公司)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 DRCY是首个生产级多代理LLM系统,通过自动获取元件数据表并进行引脚分析,提高硬件设计连接审查的准确性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06140 2026-03-18 cs.CV 56%

Boosting the Local Invariance for Better Adversarial Transferability

提升局部不变性以增强对抗迁移性

Bohan Liu, Xiaosen Wang

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院)

专题命中 安全评测 :trustworthy(abstract,comments)

AI总结 本文提出LI-Boost方法,通过提升对抗扰动的局部不变性来增强模型间对抗迁移性,实验表明其在多种攻击类型上均有效。

Comments Code is available at https://github.com/Trustworthy-AI-Group/TransferAttack

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16382 2026-03-18 cs.CR 50%

Rotated Robustness: A Training-Free Defense against Bit-Flip Attacks on Large Language Models

旋转鲁棒性:一种对抗大语言模型位翻转攻击的无训练防御方法

Deng Liu, Song Chen

专题命中 安全评测 :alignment(abstract)

AI总结 本文提出旋转鲁棒性(RoR),通过正交Householder变换对激活空间进行旋转,有效消除激活异常值与敏感权重之间的对齐,提升大语言模型的可靠性。

Comments 13 pages, 8 figures. Preprint. Under review at IEEE Transactions on Information Forensics and Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16372 2026-03-18 cs.CV 50%

InViC: Intent-aware Visual Cues for Medical Visual Question Answering

InViC:面向医疗视觉问答的意图感知视觉线索

Zhisong Wang, Ziyang Chen, Zanting Ye, Hongze Zhu, Yefeng Zheng, Yong Xia

机构 * National Engineering Laboratory for Integrated Aero-Space-Ground-Ocean Big Data Application Technology, School of Computer Science and Engineering, Northwestern Polytechnical University, Xi’an 710072, China(集成空天地海大数据应用技术国家工程实验室,计算机科学与工程学院,西北工业大学,西安710072,中国) Westlake University(西湖大学) Southern Medical University(南方医科大学)

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出InViC框架,通过引入Cue Tokens Extraction模块和两阶段微调策略,提升医疗视觉问答中意图对齐的视觉证据利用,验证了瓶颈化训练在提高可信度上的有效性。

Comments 10 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21676 2026-03-18 cs.RO cs.NI 50%

Real-World Deployment of Cloud-based Autonomous Mobility Systems for Outdoor and Indoor Environments

云原生自主移动系统在户外和室内环境中的实际部署

Yufeng Yang, Minghao Ning, Keqi Shu, Aladdin Saleh, Ehsan Hashemi, Amir Khajepour

机构 * Department of Mechanical and Mechatronics Engineering, University of Waterloo(滑铁卢大学机械与机电工程系) Technology Partnerships and Innovations, Rogers Communications, Canada Inc.(罗杰斯通讯加拿大有限公司技术伙伴关系与创新部) Mechanical Engineering Department, University of Alberta(阿尔伯塔大学机械工程系)

专题命中 安全评测 :safety(abstract)

AI总结 本文提出云原生自主移动框架,通过基础设施智能传感与云计算协调提升自主操作能力,实验证明在城市环岛和医院类室内环境中的感知鲁棒性和安全性提升。

Comments This paper has been submitted to IEEE Robotics and Automation Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15691 2026-03-18 cs.SE 50%

VibeContract: The Missing Quality Assurance Piece in Vibe Coding

VibeContract: vibe编码中缺失的质量保证环节

Song Wang

专题命中 安全评测 :trustworthy(abstract)

AI总结 本文提出VibeContract框架,通过将高层次自然语言意图分解为任务序列并生成任务级合同,以提升LLM生成代码的正确性、鲁棒性和可维护性。

详情

展开后加载摘要…

URL PDF HTML 收藏