Research Assistant: AstraZeneca's Agentic System for R&D
研究助手:阿斯利康的研发智能体系统
机构 * AstraZeneca(阿斯利康)
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 阿斯利康研发了基于LLM的智能体系统Research Assistant,整合多类生物医学数据,支持两种问答模式,可溯源证据,为研发工作提供支持。
Comments 16 pages, 3 figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
研究助手:阿斯利康的研发智能体系统
机构 * AstraZeneca(阿斯利康)
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 阿斯利康研发了基于LLM的智能体系统Research Assistant,整合多类生物医学数据,支持两种问答模式,可溯源证据,为研发工作提供支持。
Comments 16 pages, 3 figures
AI编码智能体研究中缺失了人类
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 该文指出AI编码智能体研究当前缺失人类维度,主张转向以人为中心的编码智能体,明确了人机交互的四个核心层面并提出相关研究方向。
SDAM:面向复杂文本转SQL的结构差异感知记忆演化
机构 * Harbin Institute of Technology(哈尔滨工业大学)
专题命中 其他安全 :alignment(abstract);分类 cs.CL
AI总结 针对现有文本转SQL记忆设计的缺陷,提出SDAM方法,集成至SDAM-SQL框架,在BIRD-dev和Spider-test数据集上实现指标提升,验证了方法有效性。
Comments 19 pages, 5 figures, 12tables
学习多模态伪标签以实现鲁棒的开放词汇实例和全景分割
机构 * Seoul National University of Science and Technology(首尔科技大学) ; Chung-Ang University(中央大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 该研究针对开放词汇实例分割与开放集全景分割的痛点,提出多模态框架,结合预训练视觉语言模型生成伪标签并优化训练目标,在COCO数据集上取得优于现有SOTA的性能。
Comments 14 pages
Journal ref Neurocomputing, 2026
基于大型语言模型的专家引导g计算法估计时序因果效应:在医院质量改进中的应用
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 本研究提出专家引导g计算法(egg-computation),结合专家判断与LLM技术,用于估计医院干预措施对平均住院时长的因果效应,在模拟和真实医院数据中表现优于传统方法。
GeoForge:用于对地观测推理的非参数自进化智能体
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 GeoForge是一种无需训练的自进化框架,通过结构化非参数执行状态及多记忆机制提升EO智能体的规划与推理能力,可改善任务准确率、工具轨迹质量并减少推理错误。
城市哨兵:基于AI的统一智能监控框架,用于使用深度学习的实时多威胁检测
机构 * GIK Institute(GIK学院)
专题命中 其他安全 :safety(abstract);分类 cs.CY
AI总结 该研究提出City Sentinel统一监控框架,集成六种检测功能,采用多模型架构,在低延迟下实现高准确率,可灵活扩展新功能,满足实时多威胁监控需求。
Comments 6 pages, FIT 2026
是什么阻碍了智能体技能的可复用性?来自13.8万个SKILL.md文件的证据
机构 * The Graduate Center, City University of New York(纽约城市大学研究生中心) ; The Ohio State University(俄亥俄州立大学) ; Hunter College, City University of New York(纽约城市大学亨特学院)
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 本研究通过分析13.8万个SKILL.md文件,发现91.8%的Agent Skills存在可复用性相关缺陷,主要为打包问题,验证了路由元数据对检索可靠性的影响,并提出了结合规范提示等的质量保证生成工作流。
Comments 11 pages, 4 figures
基于机器学习的铁路车轮缺陷被动超声检测诊断框架
专题命中 其他安全 :safety(abstract);分类 cs.LG
AI总结 本研究提出基于机器学习的铁路车轮缺陷被动超声检测框架,结合统计特征选择与随机森林分类器,实现9类车轮缺陷的非接触式识别,为现场检测系统奠定基础。
Comments Presented at the ASNT Research Symposium 2026, Salt Lake City, Utah, July 20-24, 2026
面向黑盒大语言模型所有权验证的针对性反事实指纹技术
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 针对黑盒LLM所有权验证的挑战,提出TCF框架,将开放式生成对比转化为受限答案的反事实迁移,在四个LLM系列上平均AUC达0.9861,优于TRAP等现有方法。
Comments 37 pages, 18 figures, 23 tables
多模态大模型模态迁移:自主地理信息系统智能体的先决条件
机构 * Graz University of Technology(格拉茨工业大学) ; University of Vienna(维也纳大学) ; University of Liverpool(利物浦大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 本文针对自主GIS智能体的先决条件,提出LMM模态迁移任务,发现现有LMM在图像与文本模态间传递空间信息的能力不足,需加强多模态对齐以实现地理空间理解。
大型语言模型中类人指代消解
机构 * Georgia Institute of Technology(佐治亚理工学院)
专题命中 其他安全 :alignment(abstract);分类 cs.CL
AI总结 本研究探究话语结构等认知科学确定的指代消解影响因素对GPT-2-XL等五个开源权重LLM的作用,发现部分LLM对部分因素具类人敏感性,明确了LLM近似人类指代消解的条件。
Comments 7 pages, 6 figures, 1 table. Presented at CogSci 2026 and the 2026 Annual Meeting of the Society for Text & Discourse. Code: https://github.com/wristy/anaphor
用金丝雀工具诊断大语言模型智能体的工具选择推理
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 本研究引入金丝雀工具诊断LLM智能体的工具选择推理,通过多维度分类法评估8个模型,发现模型能力提升会降低易感性,分类法具能力分层性,且发布了相关框架与数据。
Comments 10 pages, 9 figures, 5 tables
面向大语言模型测试时缩放的可解释自适应采样
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 该研究针对LLM测试时推理的固定计算预算不灵活、不可解释的问题,提出带轻量级模糊控制器的自适应采样方法,在问答和数学任务上提升性能并减少平均采样数,为高效测试时推理提供实用方向。
Omega-S:一种用于大语言模型微调的功能弹性指数
专题命中 其他安全 :alignment(abstract);分类 cs.LG
AI总结 Omega-S是一种仅依赖权重矩阵的即插即用惩罚项,在Llama-3-8B的LoRA微调中,它在保留模型原有能力上优于无正则化、调优后的权重衰减和EWC,且成本增加不到4%。
Comments 15 pages of main text plus appendices; 12 tables. Code, per-seed data and all negative results at https://github.com/BiomeMakers/OmegaS-LLM
用于冷启动评论推荐中汤普森采样的大语言模型衍生先验
专题命中 其他安全 :alignment(abstract);分类 cs.LG
AI总结 该研究提出用大语言模型(LLM)从评论文本提取语义信号生成贝叶斯先验,用于冷启动评论推荐的汤普森采样,经在线A/B/C测试验证其在稀疏反馈场景中效果显著。
Comments 10 pages, 4 figures
通过跨模态自举学习音乐风格以实现钢琴编曲
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 本文提出跨模态框架,受BLIP-2启发用Q-Former从预训练音频LM提取风格表示,经两阶段训练实现可控风格钢琴编曲,在多项任务中提升了风格对齐与音乐质量。
Comments Accepted by ISMIR 2026
HarMoE:基于数据集解耦专家的多源胸部X射线预训练
机构 * University of Bern(伯尔尼大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 本研究提出HarMoE框架,通过解耦数据集专家从异构胸部X射线数据集学习,提升了放射学视觉-语言模型的零样本分类、分布外迁移等性能,相关代码与87.3万份数据集将公开。
EntailLLM:通过逻辑编程结合领域知识验证大语言模型生成的漏洞发现路径
专题命中 其他安全 :safety(abstract);分类 cs.AI
AI总结 EntailLLM通过逻辑编程结合领域知识验证LLM生成的漏洞发现路径,在三类CWE、四个LLM等多组实验中,将合并蕴含率从78%提升至98%,可端到端部署且无需逐设备调优。
使用智能体管控系统构建用于元分析综合的可执行分析知识表示
机构 * School of Mathematical and Computational Sciences(数学与计算科学学院) ; Massey University(梅西大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 该研究提出EAKR,在智能体管控系统MetaSynDec中实施后,可高效构建元分析所需的可执行分析知识表示,其性能优于直接大型语言模型生成,验证了相关方法的可行性与优势。
CRAFT:面向视觉语言模型的基于视频令牌递归自适应融合的压缩方法
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 针对视觉语言模型视频令牌压缩效率与适应性的权衡问题,提出CRAFT方法,通过解耦令牌选择与融合实现高效压缩,在8倍压缩时保留97%主干准确率且性能优于现有方法。
Comments 11 pages, 5 figures
SG-Layout:基于结构化场景图引导的大语言模型布局生成方法
机构 * Chongqing University(重庆大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 SG-Layout通过两阶段训练将结构化空间知识融入LLMs,在三类任务中提升了空间推理与几何一致性,尤其适配关系密集的复杂场景。
Comments 16 pages, 5 figures. Accepted at WAICA 2026
面向航天器集群碰撞感知轨迹规划的神经算子学习
机构 * Purdue University(普渡大学) ; Manifold Research Group(流形研究组)
专题命中 其他安全 :safety(abstract);分类 cs.LG
AI总结 该研究提出排列等变神经算子,结合自监督物理目标与对抗威胁训练,实现航天器集群轨迹规划,可零样本泛化到大规模集群,精度接近最优控制求解器,性能优于无碎片感知基线。
Comments 27 pages, 6 figures, 6 tables. Submitted to Nature Machine Intelligence. Video abstract included as ancillary file
RadPRISM:用于概念解耦图像表示与视觉定位的模式分层放射学报告监督方法
机构 * Technical University of Munich (TUM)(慕尼黑工业大学(TUM)) ; TUM University Hospital(慕尼黑工业大学医院) ; Technical University of Munich, School of Medicine and Health(慕尼黑工业大学医学与健康学院) ; Klinikum rechts der Isar(右伊萨尔医院) ; Charité – Universitätsmedizin Berlin(柏林夏里特医学院) ; Freie Universität Berlin(柏林自由大学) ; Humboldt Universität zu Berlin(柏林洪堡大学) ; Imperial College London(伦敦帝国理工学院) ; Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML)) ; University Hospital Essen (AöR)(埃森大学医院(AöR)) ; Institute for Artificial Intelligence in Medicine (IKIM)(医学人工智能研究所(IKIM)) ; Institute of Interventional and Diagnostic Radiology and Neuroradiology(介入与诊断放射学及神经放射学研究所) ; National Center for Tumor Diseases West(西部肿瘤疾病国家中心)
专题命中 其他安全 :alignment(abstract);分类 cs.LG
AI总结 RadPRISM将放射学模式作为分层轴,通过专用视觉子空间对齐临床概念,提升零样本分类与视觉定位性能,实现可透明检查的概念解耦医学图像表示。
弥合检索增强生成中的问答差距:假设提示嵌入
专题命中 其他安全 :alignment(abstract);分类 cs.CL
AI总结 该研究提出假设提示嵌入(HyPE)框架,将假设内容生成移至索引阶段,提升RAG的检索对齐度与效率,在六个数据集上实现检索精度和召回率的显著提升且兼容多种RAG技术
Comments 10 pages, 8 figures, 5 tables. Published in IEEE Access
Journal ref IEEE Access, vol. 13, pp. 129952-129961, 2025
RTLCurator:用于RTL生成的标签高效数据整理
专题命中 其他安全 :alignment(abstract);分类 cs.LG
AI总结 RTLCurator通过对比规范与模拟失败的实现学习兼容性先验,用少量验证配对校准后,平衡对齐度、覆盖度与结构丰富度保留80%语料,在CodeV和RTLCoder上提升RTL生成模型性能,仅需验证10%语料池。
ViSAGE:为长视频理解构建自修正记忆
机构 * Zhejiang University(浙江大学) ; Xidian University(西安电子科技大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 ViSAGE是一种多模态智能体记忆框架,通过跨模态绑定、双向记忆精调及多智能体交叉验证解决长视频理解中的实体混淆等问题,较最强基线准确率提升5.9%。
Comments Accept by ACMMM 2026
EgoGenesis:基于在线锚定投影记忆与Action-3D RoPE的自我中心世界-动作建模
机构 * Shanghai Jiao Tong University(上海交通大学) ; Alibaba Group(阿里巴巴集团) ; Tianji KernalMind Co., Ltd.(天机芯智有限公司) ; The Hong Kong University of Science and Technology(香港科技大学) ; Southeast University(东南大学) ; Renmin University of China(中国人民大学) ; The University of Tokyo(东京大学)
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 本文提出EgoGenesis模拟器,通过在线锚定投影记忆与Action-3D RoPE合成自我中心操作视频,扩充训练数据,显著提升了真实机器人单臂、双臂任务的分布外操作成功率。
Comments project page: https://egogenesis.github.io/
面向本地生活服务推荐的、基于大语言模型驱动的生成式解缠的可解释表示
专题命中 其他安全 :alignment(abstract);分类 cs.AI
AI总结 针对现有语义ID生成框架的语义纠缠与黑箱问题,提出LGRID模型,通过生成式解缠范式提升本地生活服务推荐的性能与可解释性,在公开数据集上取得显著效果。
训练动力学:语言模型中涌现、可塑性丧失与回路控制的成核速率定律
专题命中 其他安全 :alignment(abstract);分类 cs.LG
AI总结 该研究提出语言模型能力形成的成核速率定律,揭示无部分 credit 的联合对齐是速率限制步骤,定位可塑性丧失的损伤并找到重新初始化 query-key 切片的解决方案,适用于14亿参数 transformer 的合取回路。
Comments 40 pages, 12 figures