arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-08-17 至 2026-08-17 共收录 14 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 14 篇

2608.13741 2026-08-17 cs.CL cs.LG 新提交 84%

GALA: Generation-Aware Cross-Modal Alignment for Text-to-Time-Series Synthesis

GALA:面向文本到时间序列合成的生成感知跨模态对齐

Haochen Zhang, Gengwei Zhang, Laura Yao, Nicholas Knoz, Tianlong Chen

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL、cs.LG

AI总结 本研究针对文本到时间序列合成中条件表示与信号模态不匹配的问题,提出GALA两阶段跨模态对齐方法,在TSFragment-600K数据集上实现SOTA,打破了生成器内部文本编码器的保真度与贴合度权衡。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13536 2026-08-17 cs.OS 版本更新 78%

Don't Let AI Agents YOLO Your Files: Information and Control in Agent-Native Filesystems

别让AI代理占用你的文件:将信息和控制移交给文件系统以实现代理安全和自主性

Shawn Wanxiang Zhong, Junxuan Liao, Jing Liu, Mai Zheng, Andrea C. Arpaci-Dusseau, Remzi H. Arpaci-Dusseau

专题命中 其他安全 :safety(title,abstract)

AI总结 本文研究了AI代理对文件系统的滥用问题,提出YoloFS文件系统通过三种技术提升代理的安全性和自主性,减少用户交互并提高任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13925 2026-08-17 cs.LG cs.AI cs.CL 新提交 67%

CForce: Boosting Parallel Decoding for dLLMs via Consistency Forcing

CForce:通过一致性强制提升扩散大语言模型(dLLMs)的并行解码性能

Yuji Ren, Chenkai Xu, Zhuocheng Gong, Jianguo Li, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Ant Group(蚂蚁集团)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出CForce方法,通过一致性强制提升dLLMs的并行解码性能,在LLaDA模型上实验证实其在高并行解码预算下可优化速度-质量权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13596 2026-08-17 cs.LG cs.AI 新提交 62%

Training-Free Knowledge Transfer Across Model Scales through Activation-Guided Pruning

通过激活引导剪枝实现跨模型规模的无训练知识迁移

Jiahe Fan, Si Chen, Yinghao Hou, Aiyuan Zhang, Hong Xie

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出激活剪枝融合框架APM,通过激活引导选择源模型的显著组件并注入目标模型,无需训练和显式语义对齐,在16个基准上将3B目标模型平均准确率从55.5%提升至60.6%。

Comments 9 pages, 3 figures, and 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13341 2026-08-17 cs.LG cs.AI 版本更新 62%

Simulation-to-real transfer learning for infrared spectroscopic chemical sensing and analysis from molecules to complex samples

面向红外光谱化学传感与分析的仿真到真实迁移学习:从分子到复杂样品

Yusen Tan, Yixuan Chen, Zheng Fang, Pan Liu, Yifan Li, Qinyu Guo, Zhedong Lin, Yuqiang Li, Xiangxiang Zeng, Tong Wang, Jun Xia

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Jilin University(吉林大学) University of Auckland(奥克兰大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Hunan University(湖南大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 研究针对红外光谱化学传感的迁移难题,提出超1亿参数的红外光谱基础模型UltraIR,经6000万仿真光谱预训练后,在多类化学分析任务中性能优于基线,且适配性与数据效率优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10492 2026-08-17 cs.AI cs.CY 版本更新 62%

INSIDE the Student's Mind: Jointly Modeling Latent Reasoning and Action in LLM Student Simulators

洞察学生的思维:在LLM学生模拟器中联合建模潜在推理与行动

Rose Niousha, Minwoo Kang, Narges Norouzi

机构 * University of California, Berkeley(加利福尼亚大学伯克利分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 该研究针对LLM学生模拟器仅复现学生行动却未捕捉其潜在推理的问题,提出INSIDE框架,通过在配对思考轨迹与行动上微调LLM,提升了模拟行动保真度与推理对齐度,最高对齐度达57.9%。

Comments Accepted at the Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13911 2026-08-17 cs.LG 新提交 57%

MedMix: Specialization-Consistent Federated Sparse MoEs under Modality Heterogeneity

MedMix:模态异质性下的专业化一致联邦稀疏混合专家模型

Adiba Orzikulova, Dong Min Kim, Jaehong Yoon, Sung-Ju Lee

机构 * KAIST(韩国科学技术院) NTU Singapore(新加坡南洋理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 针对联邦多模态医疗AI的客户端与样本级模态异质性问题,提出MedMix框架,通过模态上下文感知路由、共识引导路由对齐与客户端自适应专家聚合,在多模态医疗数据集上取得最优平均F1值,严重异质性下提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13690 2026-08-17 cs.CV cs.AI 新提交 57%

MedPlex: Deep Vision-Language Co-Adaptation for Clinically Grounded Medical Segmentation

MedPlex:用于临床基础医学分割的深度视觉-语言协同适配

Rafi Ibn Sultan, Hui Zhu, Chengyin Li, Dongxiao Zhu

机构 * Wayne State University(韦恩州立大学) Henry Ford Health(亨利福特医疗集团) Institute for AI and Data Science Wayne State University(韦恩州立大学人工智能与数据科学研究院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 MedPlex是一种端到端VLM框架,通过双向融合和两级概念对齐,实现医学图像分割的视觉-语言协同适配,在CT、MR的多类医学分割任务中达到最优性能。

Comments Accepted By BMVC-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13617 2026-08-17 cs.AI cs.SC 新提交 57%

How Compliant is Sepsis Treatment? An Expert-Guided Neuro-symbolic Pipeline for Generating Clinical Compliance Insights

脓毒症治疗的依从性如何?一种专家指导的神经符号管道用于生成临床依从性见解

Himanshu Tripathi, Kaushik Roy, Subash Neupane, Shahram Rahimi

机构 * The University of Alabama(阿拉巴马大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI

AI总结 该研究针对脓毒症治疗依从性验证问题,提出专家指导的神经符号管道,结合大语言模型语义规范化与Sugeno模糊推理系统,在MIMIC-IV数据集上揭示了抗生素时机等关键依从性问题及相关临床差异。

Comments This has been submitted and accepted in NeSy 2026 ( this https URL (https://2026.nesyconf.org/) )

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14301 2026-08-17 eess.SP 新提交 50%

Lightweight Beam Index Map Using Coupled Gaussian Mixture Models

基于耦合高斯混合模型的轻量波束索引图

Amar Kasibovic, Franz Weißer, Wolfgang Utschick

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对MIMO系统波束对齐问题,提出基于耦合高斯混合模型的轻量机器学习方法,构建波束索引图,在降低复杂度开销的同时,性能优于聚类指纹法且接近穷举搜索,适用于资源受限设备。

Comments 7 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13587 2026-08-17 cs.HC 新提交 50%

Student-ChatGPT Interaction Visible: Designing a Teacher Dashboard for EFL Writing Education

学生与ChatGPT交互可视化:为英语作为外语写作教育设计教师仪表盘

Minsun Kim, Seon Gyeom Kim, Suyoun Lee, Yoosang Yoon, Junho Myung, Haneul Yoo, Jieun Han, Hyunseung Lim, Yoonsu Kim, So-Yeon Ahn, Juho Kim, Alice Oh, Hwajung Hong, Tak Yeon Lee

专题命中 其他安全 :alignment(abstract)

AI总结 该研究设计了用于EFL写作教育的Prompt Analytics Dashboard,可追踪学生与LLM的交互,经教师测试后能降低监控负担并优化干预时机。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21532 2026-08-17 cs.PL cs.SE 版本更新 50%

Contract Based Verification of Non-functional Requirements for Embedded Automotive C Code

基于合同的嵌入式汽车C代码非功能需求验证

Jesper Amilon, Merlijn Sevenhuijsen, Mattias Nyberg, Karl Palmskog

专题命中 其他安全 :safety(abstract)

AI总结 本文提出了一种用于验证嵌入式汽车C代码非功能需求的合同方法,通过设计通用规则和接口规范语言,结合Frama-C插件实现对控制流和数据流的检查,确保模块调用安全函数并避免未初始化变量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21956 2026-08-17 cs.CV 版本更新 50%

Global-Local Dual Perception for MLLMs in High-Resolution Text-Rich Image Translation

全局-局部双感知用于高分辨率文本密集图像翻译的MLLMs

Junxin Lu, Tengfei Song, Zhanglin Wu, Pengfei Li, Xiaowei Liang, Hui Yang, Kun Chen, Ning Xie, Yunfei Lu, Jing Zhao, Shiliang Sun, Daimeng Wei

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Labs, Huawei Technologies Co., LTD(华为技术有限公司2012实验室) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出GLoTran框架,通过全局-局部双感知方法提升高分辨率文本密集图像翻译的准确性和完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03357 2026-08-17 cond-mat.stat-mech cond-mat.soft physics.bio-ph 版本更新 50%

Asymptotically exact scattering theory of the Kuramoto-Vicsek model

Kuramoto-Vicsek模型的渐近精确散射理论

Thomas Ihle, Horst-Holger Boltz, Rüdiger Kürsten, Benjamin Lindner

专题命中 其他安全 :alignment(abstract)

AI总结 该研究针对Kuramoto-Vicsek模型,突破平均场假设,采用单侧分子混沌假设解析计算低密度下粒子散射,其理论结果与模拟吻合,还推导了高密区噪声关联及正对齐强度下的Boltzmann碰撞算子。

详情

展开后加载摘要…

URL PDF HTML 收藏