Investigating The Security of Modern AI and Cloud Infrastructure
调查现代AI和云基础设施的安全性
专题命中 其他推理 :reasoning(abstract)
AI总结 本文通过物理内存共置到远程服务接口的交互层次分类法,系统解构AI和现代云基础设施的安全假设,并展示利用各抽象层假设的实际攻击。
Comments PhD thesis
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
调查现代AI和云基础设施的安全性
专题命中 其他推理 :reasoning(abstract)
AI总结 本文通过物理内存共置到远程服务接口的交互层次分类法,系统解构AI和现代云基础设施的安全假设,并展示利用各抽象层假设的实际攻击。
Comments PhD thesis
关注细节的机器人批评家
机构 * Columbia University(哥伦比亚大学) ; Toyota Research Institute(丰田研究所)
专题命中 其他推理 :reasoning(abstract)
AI总结 针对大视觉语言模型在机器人操作中难以区分微小视觉差异的问题,提出通过成功与失败轨迹构建成对进展监督来微调批评家,提升细粒度推理和失败检测能力,并在真实和仿真任务中分别提高策略成功率11%和5.9%。
AI对话式访谈:扩展半结构化与深度访谈的规模
专题命中 其他推理 :reasoning(abstract)
AI总结 本研究提出AI对话式访谈方法,通过语音、文本或自由选择模式大规模收集开放型意见数据,证明其能捕捉标准化调查遗漏的深层思考,且受访者评价不低于传统调查。
用于LEGEND-1000 LoFi回旋管连续材料监测的视觉AI智能体
专题命中 其他推理 :reasoning(abstract)
AI总结 提出基于LangChain和Claude Haiku 4.5的视觉AI智能体流水线,通过SAM2分割和混合OCR验证从静水压测试视频中自动提取OFHC铜圆柱的直径和应变,计算屈服强度并与模拟对比。
Comments 27 pages, 8 figures, 5 tables, submitted to PRX Intelligence
OneRank: 面向多任务推荐的统一Transformer原生排序架构
专题命中 其他推理 :reasoning(abstract)
AI总结 提出OneRank,一种Transformer原生多任务排序框架,通过消除编码器-预测器分离并引入任务私有通道,实现任务专用学习并减少干扰,显著提升多任务推荐性能。
Comments KDD 2026 Accepted
见我所见,知我所想:异构智能体间的密集潜通信
专题命中 其他推理 :reasoning(abstract)
AI总结 针对异构智能体间文本通信高损耗问题,提出基于KV缓存变换的密集对齐方法,通过两阶段训练实现跨模型潜空间对齐,在上下文感知和未知场景下均优于基线,计算成本降低2-3倍。
为什么AI垃圾内容重要,但不是那样重要
专题命中 其他推理 :reasoning(abstract)
AI总结 本文回应《为什么垃圾内容重要》一文,通过内在和外部批判,指出其推理忽视了AI垃圾内容的社会技术背景,并基于伦理和社会科学视角,强调应关注其社会功能和审美价值,呼吁进行语境化和文化基础的讨论。
少看多思:面向高效多模态大语言模型的块级注意力跳过
机构 * Xiamen University(厦门大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 针对多模态大语言模型视觉注意力饱和问题,提出训练无关的Visual-Skip方法,通过选择性跳过冗余的视觉自注意力模块实现块级稀疏性,并利用轻量级校准动态选择最优稀疏路径,在保持性能的同时显著降低计算成本。
幻觉级联:多智能体大语言模型系统中的错误传播分析
专题命中 其他推理 :reasoning(abstract)
AI总结 本文通过追踪多智能体LLM级联中的声明级事实不一致性,分析幻觉动态,发现更深级联降低幻觉分数但牺牲事实准确性,并揭示模型与领域差异。
CANote: 通过支架式和基于来源的人机协作增强事实核查笔记撰写
专题命中 其他推理 :reasoning(abstract)
AI总结 提出CANote系统,通过子主张提取、证据链接和结构化草稿辅助用户撰写高质量辟谣笔记,显著提升非专家用户的笔记质量至专家水平。
中间DPAgent:针对AI诱导欺骗模式的代理防御与修复
专题命中 其他推理 :reasoning(abstract)
AI总结 针对网络界面中的隐私欺骗模式,提出DPAgent框架,通过四个专门代理结合潜在空间净化与防御性提示,主动检测并修复欺骗性界面,检测率达90.98%,修复率77%。
托管信封阈值:机构基础设施中外部工件的权限缩放准入
专题命中 其他推理 :reasoning(abstract)
AI总结 提出托管信封阈值模型,根据工件身份、入口路径和撤销能力的封闭程度与执行权限的关系,决定机构对外部工件的准入策略,并应用于多种工件类型。
Comments 32 pages. Preregistered framework and protocol paper; empirical pilot is a separate planned study. OSF preregistration and replication package: https://doi.org/10.17605/OSF.IO/E57FJ