arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

共收录 7971 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 7971 篇

2608.01473 2026-08-04 cs.CV cs.CL cs.LG 新提交 62%

Slot2Text: Object-Centric Visual Tokenization for Efficient and Spatially Traceable Surgical MLLMs

Slot2Text:面向高效且空间可追溯的手术多模态大语言模型的以对象为中心的视觉分词

Guiqiu Liao, Matjaz Jogan, Daniel A. Hashimoto

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 Slot2Text将视觉输入转为槽潜变量,推出双模式手术MLLM,在多基准上实现高效推理,Slot2Text-Fast大幅降本,Slot2Text-Reason支持可追溯空间推理。

Comments 17 pages, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00030 2026-08-04 cs.CL cs.AI 新提交 62%

SLMs as Multi-Agent Routers: A Progressive SFT and Reinforcement Learning Approach

小型语言模型(SLMs)作为多智能体路由器:一种渐进式监督微调与强化学习方法

Gayathri V Kondapalli, Alexander Ng, Hirsh Pithadia, Rahul Monish, Harvey Yorke, Amir Kayhani

机构 * Valyu AI University of Warwick(华威大学) University College London(伦敦大学学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出用小型语言模型(SLM)结合渐进式监督微调与强化学习的方法,解决多智能体路由中仅基于意图选择的局限,在智能体-查询不匹配子集及总体NDCG@10指标上均优于仅基于意图路由的大语言模型基线,且选择延迟更低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24310 2026-08-04 cs.CL cs.LG 62%

Discovering Lexical Gaps Using Embeddings from Multilingual LLMs

利用多语言大语言模型的嵌入发现词汇空缺

Yoonwon Jung, Aaron S. Cohen, Benjamin K. Bergen

机构 * Department of Cognitive Science, University of California San Diego(加州大学圣地亚哥分校认知科学系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 提出一种数据驱动框架,通过多语言大语言模型的上下文嵌入计算语义相似度,以识别跨语言词汇空缺,在韩英和英韩方向上分别达到0.81和0.76的AUC。

Comments CoNLL 2026

Journal ref Yoonwon Jung, Aaron S. Cohen, and Ben Bergen. 2026. Discovering Lexical Gaps Using Embeddings from Multilingual LLMs. In Proceedings of the 30th Conference on Computational Natural Language Learning, pages 641-660

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03519 2026-08-04 cs.CL cs.AI 版本更新 62%

TS-Reasoner: Aligning Time Series Foundation Models with LLM Reasoning

TS-Reasoner:将时间序列基础模型与大语言模型推理能力对齐

Fangxu Yu, Hongyu Zhao, Tianyi Zhou

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 TS-Reasoner通过两阶段训练将时间序列基础模型与大语言模型对齐,在多个基准上性能优于同类模型且数据效率更高,解决了时间序列模型推理能力不足的问题。

Comments Accepted to Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14142 2026-08-03 cs.CL cs.AI 版本更新 62%

Implicit Reasoning for Large Language Model-based Generative Recommendation

基于大语言模型的生成式推荐的隐式推理

Yinhan He, Liam Collins, Bhuvesh Kumar, Jundong Li, Neil Shah, Donald Loveland

机构 * University of Virginia(弗吉尼亚大学) Snap Inc.(Snap公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 针对大语言模型用于生成式推荐时显式推理的三大局限(世界知识表达弱化、语义ID与自然语言嵌入空间不对齐、推理质量敏感),提出轻量级隐式推理范式PauseRec,在性能、训练成本和推理速度上均优于显式方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04215 2026-08-03 cs.LG cs.AI 版本更新 62%

Predict-then-Diffuse: Adaptive Response Length for Compute-Budgeted Inference in Diffusion LLMs

预测后扩散:面向扩散大语言模型的自适应响应长度计算

Michael Rottoli, Subhankar Roy, Stefano Paraboschi

机构 * IEEE

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Predict-then-Diffuse框架,通过自适应响应长度预测器和安全机制,实现计算预算下的高效推理,减少计算成本并保持输出质量。

Comments Accepted for publication in IJCNN 2026 (International Joint Conference on Neural Networks)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27614 2026-07-31 cs.CL cs.AI 新提交 62%

DualAnchor: Preserving Language Priors and Improving Lexical Fidelity in Gloss-Free Sign Language Translation

DualAnchor:无注释手语翻译中保留语言先验并提升词汇保真度

Hongbin Zhang, Junhao Liu, Xuefeng Bai, Youcheng Pan, Yang Xiang, Kehai Chen

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 针对现有无注释手语翻译方法的语言先验退化与词汇保真度差距问题,提出结合TPA和OTA的DualAnchor框架,在两个基准数据集上取得良好性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27228 2026-07-31 cs.CL cs.AI cs.DL 新提交 62%

AI-assisted pre-review of open-source software submissions: an experience report from BOSC 2026

AI辅助的开源软件提交预评审:来自BOSC 2026的经验报告

Tazro Ohta, Nomi L. Harris, Seth Carbon

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI

AI总结 本研究针对BOSC 2026投稿激增问题,开发bosc-pre-review与Runabilly辅助评审,调查显示该预评审工具对志愿评审人员有用,需人工复核结论。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26389 2026-07-30 cs.CL cs.AI 新提交 62%

Misalignment Has a Personality: A Big Five Account of Emergent Misalignment

错位具有人格特质:对涌现错位的大五人格解释

Hasibur Rahman, Smit Desai

机构 * Northeastern University(东北大学)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI

AI总结 本文提出用大五人格向量解释语言模型微调引发的错位,发现错位语料具特定人格特征,该向量可诊断安全现象且能捕捉单一方向无法识别的谄媚特质。

Comments The paper is currently under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12250 2026-07-30 cs.AI cs.CL cs.GT cs.MA 版本更新 62%

How memory can affect collective and cooperative behaviors in an LLM-Based Social Particle Swarm

记忆如何影响基于LLM的社会粒子群中的集体和合作行为

Taisei Hishiki, Takaya Arita, Reiji Suzuki

机构 * Graduate School of Informatics(信息学研究生院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了大型语言模型代理的内部对齐特性如何影响记忆对其集体和合作动态的影响。通过将社会粒子群模型中的规则代理替换为具有大五人格特质和不同记忆长度的LLM代理,发现记忆长度是决定集体行为的关键参数,且不同模型对记忆的解读影响合作结果。

Comments 11 pages, 4 figures and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11586 2026-07-28 cs.CL cs.CY 62%

Survey Response Generation: Generating Closed-Ended Survey Responses In-Silico with Large Language Models

调查回应生成:利用大语言模型生成闭合式调查回应

Georg Ahnert, Anna-Carolina Haensch, Barbara Plank, Markus Strohmaier

机构 * University of Mannheim(曼海姆大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Maryland, College Park(马里兰大学学院公园分校) GESIS Cologne(科隆社会研究所) CSH Vienna(维也纳认知科学研究所)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.CY

AI总结 本文研究了不同调查回应生成方法对模拟调查回应的影响,发现受限生成方法效果最佳,推理输出不总能提升对齐度。

Journal ref ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07074 2026-07-28 cs.CL cs.AI 版本更新 62%

LuxInstruct: A Cross-Lingual Instruction Tuning Dataset For Luxembourgish

LuxInstruct:一个用于卢森堡语的跨语言指令微调数据集

Fred Philippy, Laura Bernardy, Siwen Guo, Jacques Klein, Tegawendé F. Bissyandé

机构 * SnT, University of Luxembourg(卢森堡大学SnT学院) Zortify Labs, Zortify S.A.(Zortify实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 针对卢森堡语缺乏高质量指令数据集问题,利用英、法、德对齐数据创建跨语言指令微调数据集,避免机器翻译弊端,提升模型在卢森堡语中的生成能力,为低资源语言发展提供新思路。

Comments Paper accepted at KONVENS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21660 2026-07-27 cond-mat.mtrl-sci cs.AI cs.LG 新提交 62%

Generative and multimodal AI for materials prediction and design: Progress, challenges, and perspectives

用于材料预测和设计的生成式和多模态人工智能:进展、挑战与展望

Xianyuan Liu, Charles Anjah, Benjamin E. Jolly, Jonathon F. S. Markanday, Joshua Berry, Haolin Wang, Nicola A. Morley, Robert D. J. Oliver, Alexandra J. Ramadan, Delvin Ce Zhang, Katerina A. Christofidou, Haiping Lu

机构 * School of Computer Science, University of Sheffield, Sheffield, UK(计算机科学学院,谢菲尔德大学) Centre for Machine Intelligence, University of Sheffield, Sheffield, UK(智能机器研究中心,谢菲尔德大学) School of Chemical, Materials and Biological Engineering, University of Sheffield, Sheffield, UK(化学、材料与生物工程学院,谢菲尔德大学) Henry Royce Institute, Royce Discovery Centre, University of Sheffield, Sheffield, UK(亨利·罗伊奇研究所,谢菲尔德大学) Materials Nexus Ltd., Salisbury House, Cambridge, UK(材料 nexus 有限公司,剑桥,英国) School of Mathematical and Physical Sciences, University of Sheffield, Sheffield, UK(数学与物理科学学院,谢菲尔德大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨生成式和多模态人工智能在材料预测与设计中的应用,引入材料属性层次结构框架,指出当前证据局限,强调需全社区标准支持多模态相关建模与基准测试,以设计具科学和实际新颖性、可实验实现的材料。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21291 2026-07-24 cs.CL cs.LG 新提交 62%

Adaptive Depth Sparse Framework: Similarity-Driven Resource Allocation for Pre-Trained LLMs

自适应深度稀疏框架:基于相似性驱动的预训练语言模型资源分配

Yidu Wu, Xiang Wang, Kejie Zhao, Zhangchi Wang, Qinghai Guo, Xiaoying Tang

机构 * Southern University of Science and Technology(南方科技大学) Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究针对预训练语言模型推理成本高的问题,提出自适应深度稀疏框架AdaDSF,基于层输入输出隐藏状态余弦相似性分配令牌保留率,用轻量级路由器选择信息令牌,在多任务中大幅降推理FLOPs且精度退化小。

Comments Accepted by ICIC 2026. 12 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27390 2026-07-24 cs.CL cs.AI 版本更新 62%

EvoSpec: Evolving Speculative Decoding via Real-Time Vocabulary and Parameter Adaptation

EvoSpec: 通过实时词汇和参数自适应进化推测解码

Shuyu Zhang, Lingfeng Pan, Qicheng Wang, Yaqi Shi, Yueyang Tan, Ruyu Yan, Jiaqi Chen, Lixing Du, Lu Wang

机构 * School of Computer Science and Technology(计算机科学与技术学院)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 提出EvoSpec框架,通过动态词汇和参数自适应实现推测解码中草稿模型的实时进化,解决静态方法在专业领域和主题切换场景下接受率骤降的问题,在EAGLE-3上实现1.13倍加速并降低27%内存开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23340 2026-07-24 cs.AI cs.CL cs.HC 62%

Planning Ahead with RSA: Efficient Signalling in Dynamic Environments by Projecting User Awareness across Future Timesteps

基于RSA的前瞻性规划:通过跨未来时间步投影用户意识实现动态环境中的高效信号传递

Anwesha Das, John Duff, Jörg Hoffmann, Vera Demberg

机构 * Saarland University(萨尔兰大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于RSA的前瞻性规划方法,通过跨未来时间步投影用户意识,优化动态环境中的人机协作效率。

Comments 11 pages, 3 figures

Journal ref Proc. of the 25th Int. Conf. on Autonomous Agents and Multiagent Systems (AAMAS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19598 2026-07-23 cs.CL cs.AI 62%

Cross-Model Consistency of AI-Generated Exercise Prescriptions: A Repeated Generation Study Across Three Large Language Models

跨模型一致性分析:AI生成运动处方的重复生成研究:在三个大型语言模型间

Kihyuk Lee

机构 * Data Convergence Team, Office of Hospital Information, Seoul National University Bundang Hospital(数据融合团队,医院信息办公室,首尔国立大学医院)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI

AI总结 研究比较了三种大型语言模型在重复生成运动处方时的一致性,发现GPT-4.1在语义相似度上最高,而Gemini 2.5 Flash表现出重复性,揭示了生成行为的差异,强调模型选择应作为临床决策。

Comments 24 Pages, 2 Figures, 6 Tables and 2 Supplementary Materials. v2: Removed personal contact information

Journal ref International Journal of Medical Informatics, 220 (2026) 106594

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00740 2026-07-23 cs.CL cs.LG 版本更新 62%

LaSEr-Edit: Localized Span-level Error Editing with Energy-based Localization

LaSEr-Edit:基于能量定位的局部跨度级错误编辑

Hye Ryung Son, Saehee Eom, Mooho Song, Jay-Yoon Lee

机构 * Graduate School of Data Science(数据科学研究生院) Seoul National University(首尔国立大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.LG

AI总结 研究针对大语言模型满足约束问题,提出LaSEr-Edit方法。利用轻量级特定任务的基于能量的模型进行错误定位,提出LaSEr-LLM Edit和LaSEr-EBM Edit两种文本修订方法,实验表明该方法能有效控制文本,多约束下也表现良好。

Comments 38 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18358 2026-07-22 cs.CL cs.LG 新提交 62%

A Classifier That Teaches Itself: Self-Improving, Frozen-gate Training (SIFT) for Dynamic Document Classification

一种自学分类器:用于动态文档分类的自我改进冻结门训练(SIFT)

Bogdan Raduta, Horia Velicu, Alexandru Preda, Serban Chiricescu

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.LG

AI总结 研究针对企业文档分类难题,提出SIFT动态分类器服务,通过低成本管道、特定机制及判断反馈实现自我改进,解决标注和安全问题,介绍其架构、机制及部署示例,探讨边际标注成本趋零的经济性。

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10248 2026-07-22 cs.CL cs.LG 版本更新 62%

One mechanism for many mental spaces: a shared router over a value slot in language models

一种机制用于多种心理空间:语言模型中基于值槽的共享路由器

Oliver Steele, Jiangtao Wen, Yuxing Han

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究Transformer语言模型实现何种心理空间构建机制,发现其采用共享路由器和值槽格式,一种空间类型子空间训练能控制其他类型,确立跨类型通用性,还表明该机制驱动推理和组合。

Comments 26 pages, 5 figures, 9 tables. v2: cite the released Mental Spaces Corpus (dataset DOI); switch to ACL bibliography style; minor copy-editing. No change to results

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12442 2026-07-22 cs.CY cs.AI 版本更新 62%

Reframing AI Loss of Control: What Control Is, How to Have It, How to Lose It

重新定义AI失控:它是什么,如何拥有,如何失去

Ze Shen Chin, Maurice Chiodo, Dennis Müller, Coleman Snell

机构 * Oxford Martin AI Governance Initiative AI Standards Lab(牛津马丁人工智能治理倡议人工智能标准实验室) Centre for the Study of Existential Risk, University of Cambridge(存在风险研究中心,剑桥大学) Institute of Mathematics Education, University of Cologne(数学教育研究所,科隆大学) Cornell University(康奈尔大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文通过将控制锚定于“设定和获取目标”,建立控制的工作定义,探讨控制如何被失去、AI如何导致失控,并提出维持控制的建议。

Comments 64 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06176 2026-07-22 cs.LG cs.AI physics.space-ph 版本更新 62%

A Self-Supervised Framework for Space Object Behaviour Characterisation

一种用于空间物体行为特征刻画的自监督框架

Ian Groves, Andrew Campbell, James Fernandes, Diego Ramírez Rodríguez, Paul Murray, Massimiliano Vasile, Victoria Nockles

机构 * Defence AI Research Centre, Defence & National Security, The Alan Turing Institute(国防人工智能研究中心,国防与国家安全,艾伦·图灵研究所) Department of Electronic and Electrical Engineering, University of Strathclyde(电子与电气工程系,斯特拉斯克莱德大学) GMV Aerospace Centre of Excellence, University of Strathclyde(航空航天卓越中心,斯特拉斯克莱德大学)

专题命中 其他安全 :safety(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种自监督框架用于空间物体行为分析,通过预训练和微调实现异常检测、运动预测和合成数据生成,提升空间安全与可持续性。

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18027 2026-07-21 cs.LG cs.CL 新提交 62%

L1 Augmented Attention as an Improved Vector Similarity Metric

L1增强注意力作为一种改进的向量相似性度量

Kurt Godden

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究针对缩放点积注意力在Transformer模型中作为相似性度量的局限,提出L1增强注意力方法,通过减去特定头的L1距离改进相似性计算,经实验在WikiText 2上取得更好效果,揭示了各层几何作用及头级专业化,有效提升语言模型相似性计算。

Comments 16 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06623 2026-07-21 cs.LG cs.AI cs.SY eess.SY 版本更新 62%

LLM-Guided Task-Semantic Field Factorization for Industrial Process Forecasting

用于工业过程预测的大语言模型引导的任务语义场分解

Youcheng Zong, Runda Jia, Mingxuan Ren, Dakuo He

机构 * College of Information Science and Engineering, Northeastern University(东北大学信息科学与工程学院)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 针对工业过程预测中标记数据稀缺等问题,提出大语言模型引导的任务语义场分解框架TSF,通过构建任务语义场,结合传统时间序列主干进行训练和推理,在多任务上降低平均绝对误差,增加参数少且推理开销小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18482 2026-07-21 cs.CL cs.LG stat.ML 版本更新 62%

The Truncation Blind Spot: How Decoding Strategies Systematically Exclude Human-Like Token Choices

截断盲区:解码策略如何系统性地排除人类样式的令牌选择

Esteban Garces Arias, Nurzhan Sapargali, Christian Heumann, Matthias Aßenmacher

机构 * Department of Statistics, Ludwig Maximilian University, Munich, Germany(统计系,路德维希-马克西米利安大学,慕尼黑,德国) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究探讨了文本生成中解码策略与人类语言生成的差异,发现基于概率的解码方法排除了人类可选但统计上稀有的令牌,导致生成文本可检测性增强。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20956 2026-07-21 cs.CV cs.AI cs.LG 版本更新 62%

BUSTR: Descriptor-Aware Vision-Language Learning for Breast Ultrasound Report Generation

BUSTR:用于乳腺超声报告生成的描述符感知视觉语言学习

Rawa Mohammed, Mina Attin, Laxmi Gewali, Bryar Shareef

机构 * University of Nevada, Las Vegas(内华达大学拉斯维加斯分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 针对公共BUS数据集缺乏配对报告限制模型发展的问题,提出BUSTR框架,利用结构化病变信息,通过构建描述符派生报告、训练多头编码器及双重目标指导训练,提升了乳腺超声报告生成的相似性和描述符恢复能力。

Comments 17 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07457 2026-07-21 cs.CL cs.AI 版本更新 62%

GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models

GRIP:通过微调大语言模型进行参数内图推理

Jiarui Feng, Donghong Cai, Yixin Chen, Muhan Zhang

机构 * Washington University in Saint Louis(华盛顿大学圣路易斯分校) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究如何让大语言模型适应结构数据,提出GRIP方法,通过微调任务将图关系知识内化到模型参数,存储于轻量级LoRA模块,实验表明该方法在处理大图时优于基线,处理小图时以低推理成本达可比性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05331 2026-07-21 cs.CY cs.AI cs.HC 62%

Not someone, but something: Rethinking trust in the age of medical AI

不是人,而是东西:在医疗AI时代重新思考信任

Jan Beger

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.CY

AI总结 本文探讨医疗AI时代信任的重新定义,强调通过透明设计和责任部署建立信任,而非依赖同理心或直觉。

Journal ref European Journal of Radiology Artificial Intelligence 3 (2025) 100038

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14185 2026-07-17 cs.LG cs.AI 新提交 62%

Closed-Loop Knowledge Dynamics: An Operational Framework for Saturation and Escape

闭环知识动力学:饱和与逃逸的操作框架

Xuening Wu, Shan Yu, Shenqin Yin

机构 * Pfizer(辉瑞公司) Institute of Humanities and Social Science Data, Fudan University(复旦大学人文社会科学数据研究所)

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 研究闭环知识系统饱和及逃逸问题,引入三级操作框架,利用李雅普诺夫漂移条件等刻画系统动态,通过案例展示反馈影响,建立了稳定性工具、干预效果与跨域诊断间的操作联系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14110 2026-07-17 cs.CL cs.AI 新提交 62%

MAPS: Modeling Co-Existing Subjective Perspectives and Shared Meaning in Multi-Agent Cognitive Dialogue

MAPS:在多智能体认知对话中建模共存的主观视角和共享意义

Molood Arman, Clément Bonnafous

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究针对当前AI对话系统问题,提出MAPS框架,通过领域加权配置文件、动态GRU记忆和令牌级注意力,让智能体保持个性化推理并趋向共享意义,在多数据集评估中支持语义对齐且不损主观性,为可解释对话系统发展提供路径。

详情

展开后加载摘要…

URL PDF HTML 收藏