Pramana: A Composable, Domain-Specific Backend for Empirical Networking Research
Pramana:面向实证网络研究的可组合领域专用后端
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文提出面向实证网络研究的可组合领域专用后端Pramana,其通过单一意图规范实现跨载体运行,概念验证可满足34%的数据生成意图,为加速网络研究提供了支撑。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
Pramana:面向实证网络研究的可组合领域专用后端
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文提出面向实证网络研究的可组合领域专用后端Pramana,其通过单一意图规范实现跨载体运行,概念验证可满足34%的数据生成意图,为加速网络研究提供了支撑。
HALLELUAI:一个用于大规模超逼真图像到视频生成的幻觉感知人工智能系统
机构 * Expedia Group(亿客行集团)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 针对AI生成视频时质量控制难的问题,HALLELUAI系统集成视频调节与智能再生模块,能评估风险并迭代修复。经人工参与评估,该系统可输出超逼真视频,推动了可信AI视频内容发展,实现大规模图像到视频生成。
Comments 10 pages, 4 figures, 3 tables
用于时间决策的轨迹感知检索代理
机构 * Amazon(亚马逊)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。
即时计算:展望无人机计算的未来
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 报告设想无人机大规模运输货物等的未来,指出需弥合能力差距,确定了实现无人机技术变革潜力的十二个技术挑战及应对方法,为无人机技术发展规划了多方面的前进路径。
规范驱动开发作为人工智能原生企业软件工程的基础
专题命中 其他Agent :agentic(abstract);分类 cs.SE
AI总结 研究大语言模型和智能人工智能推动下软件工程范式转变,介绍规范驱动开发,提出规范治理参考模型,经评估能减少安全缺陷、缩短上市时间,证明企业软件需规范治理,vibe编码适用于构思和快速原型制作。
迈向自主工业系统的意图抽象层
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI
AI总结 针对自主工业系统中各子系统运行目标冲突难以及时发现的问题,提出意图抽象层(IAL),通过大型语言模型等将自然语言目标解析为结构化意图,检测并解释冲突,实现执行前意图级检查,保障协作自主系统行为。
相同的故事,不同的旅程:从社交媒体比较到人工智能介导的同伴职业探索中的意义建构
机构 * Sun Yat-sen University(中山大学)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI
AI总结 研究针对年轻求职者在社交媒体职业探索时被动浏览的问题,开发JobMate交互式系统,将真实帖子转化为对话式AI代理,通过对比研究发现其能引导社会比较转向建设性自我重构并促进意义建构,还探讨了相关AI系统设计启示。
Comments 10 pages, 7 figures, 2 tables
智能体何时撒谎:重复博弈中的预谋、持续性与可利用性研究
机构 * Carnegie Mellon University(卡内基梅隆大学) ; Vector Institute(向量研究所) ; University of Toronto(多伦多大学) ; EuroSafeAI
专题命中 其他Agent :autonomous agent(abstract);分类 cs.CL
AI总结 本文针对大语言模型智能体行动前公示意图的诚信问题,设计三阶段n人重复博弈协议,评测前沿模型,发现其偏离公示行为多属预谋,不同模型对公示的语义理解不兼容。
Comments Best Paper Award at ICML NExT-Game Workshop
拒绝背后:通过行为监控确定护栏激活
机构 * Mindgard ; Lancaster University(兰卡斯特大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。
Comments 19 pages, 13 figures, 4 tables
超越有监督澄清:基于LLM的输入重写用于对话篇章解析
专题命中 其他Agent :agentic(abstract);分类 cs.CL
AI总结 研究在无监督条件下利用LLM零样本或基于解析器反馈重写输入以提升对话篇章解析性能,发现重写常引入回归,提出选择性干预问题并识别可重写性预测为关键缺失能力。
Comments Accepted to SIGDIAL 2026. 17 pages, 2 figures
公共管理中AI系统的技术类型学
机构 * University of Oxford(牛津大学) ; Hertie School(赫蒂学院) ; Utrecht University(乌得勒支大学) ; Harvard University(哈佛大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 针对公共管理研究将AI视为单一类别的问题,提出五类AI系统类型学(手编、玻璃箱、黑箱、通用、代理系统),通过分析91篇高引论文发现技术精度不足,并给出改进建议。
Comments Under Review
LLMs中的一致性困境:生成器-评估器一致性与对错误的脆弱性
机构 * Massachusetts Institute of Technology(麻省理工学院)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 提出生成器-评估器自一致性度量,发现模型自一致性越高,在临床环境中对已验证错误的脆弱性越大,揭示LLMs中的一致性困境。
集体困境中的AI说服性框架
机构 * Data Science Section, IT University of Copenhagen(丹麦哥本哈根IT大学数据科学系) ; Computer Science Department, University of Milan(意大利米兰大学计算机科学系) ; Copenhagen Center for Social Data Science, University of Copenhagen(丹麦哥本哈根大学哥本哈根社会科学数据科学中心)
专题命中 其他Agent :AI agent(abstract);分类 cs.CL
AI总结 本研究通过集体风险博弈实验,测试AI助手使用个性化说服框架对合作行为的影响,发现亲社会效应短暂而反社会效应持久,揭示了AI影响集体行动的双重用途风险。
Comments The first two authors contributed equally to this research. The article contains 20 pages, 10 figures, and 2 tables
张量代数性质骨架:增强AI编译器的基于性质的测试
专题命中 其他Agent :agentic(abstract);分类 cs.SE
AI总结 提出Propilot框架,利用LLM将张量代数知识表示为可复用的性质骨架,自动生成可执行的基于性质的测试,以检测AI编译器中的语义漂移。
Comments v2 adds citations and fixes some typos
机器在何种条件下能够真正具有创造力?
机构 * Concordia University(康考迪亚大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 本文基于Designics理论,提出机器真正创造力需满足十个要求,并通过实例论证其计算可行性,同时指出当前生成式AI系统尚不具备真正创造力。
污染的合作:测量LLM辅助学生写作中的性别偏见迁移
机构 * Brac University(布拉卡大学)
专题命中 其他Agent :agentic(abstract);分类 cs.CL
AI总结 通过实验发现,使用性别偏见的LLM写作助手会显著增加学生职业规划作文中的性别刻板印象,且偏见迁移不对称:女性目标作文的能动性被抑制,男性目标作文受影响较小。
Comments 18 pages, 7 pages
前缀矩阵分解的近最优下界
专题命中 其他Agent :agentic(abstract)
AI总结 该研究针对下三角全1矩阵Q,利用Gemini智能体系统证明了前缀矩阵分解的近最优下界,其结果可应用于转置流估计与差分隐私计数的相关界。
衔接AI风险框架:将ISO/IEC 42001、美国国家标准与技术研究院AI风险管理框架(NIST AI RMF 1.0)及欧盟AI法案整合为统一治理分类体系
专题命中 其他Agent :agentic(abstract)
AI总结 本文整合ISO/IEC 42001、NIST AI RMF和欧盟AI法案,构建统一AI治理分类体系,提出实施模型与示例,助力组织同时满足三者要求且无需重复付出。
Comments 17 pages, 5 tables
SoK:前沿人工智能如何重塑关键基础设施中的系统级安全风险动态
专题命中 其他Agent :agentic(abstract)
AI总结 本研究提出五维风险动态框架,分析前沿人工智能重塑关键基础设施系统级安全风险的机制,指出学术研究与运营约束的错配,推动系统级安全保证研究。
Comments 19 pages
用于不断演变的社会规范的人工智能价值对齐
专题命中 其他Agent :agentic(abstract)
AI总结 研究人工智能价值对齐对社会规范演变的影响,引入基于社会物理学的数学建模框架,通过解析与模拟分析长期后果,强调价值锁定等风险,倡导用此模型作认知桥梁助力社会技术预见及大规模智能体评估。
jina-reranker-v3.5:一种具有混合注意力和自蒸馏的高效列表式重排器
专题命中 其他Agent :agentic(abstract)
AI总结 研究提出jina-reranker-v3.5列表式重排器,通过混合注意力改进、多领域训练及三阶段自蒸馏方法,在满足效率等需求同时提升性能,如在BEIR上表现出色,在半结构化检索中有显著提升,还降低了推理延迟,并开源模型权重。
Comments 13 pages, 2 figures, 9 tables
SCITUS:将美国国家标准与技术研究院人工智能风险管理框架(NIST AI RMF)适配到加拿大监管环境的多辖区框架
专题命中 其他Agent :agentic(abstract)
AI总结 针对加拿大人工智能监管碎片化问题,提出SCITUS框架,它能将NIST AI RMF 1.0同时适配到加联邦和省级法规,整合多种要素,通过多场景展示适用性,为多辖区合规提供了更优模式及可复制模型。
Comments 74 pages, 1 figure. SCITUS Framework v2.0 (July 2026). Framework documentation: https://scitus.ca/scitus-framework
GDM人工智能控制路线图
专题命中 其他Agent :AI agent(abstract)
AI总结 研究如何保障人工智能代理融入系统时的安全,提出GDM人工智能控制路线图,通过保守威胁建模、基于能力的缓解措施及一系列实际防御构建多层防御体系,平衡安全与开发者速度,为内部安全提供蓝图。
Vibe 可视化:可视化新手如何尝试(并失败)使用对话式 AI 生成和解读可视化
专题命中 其他Agent :agentic(abstract)
AI总结 通过用户研究发现,可视化新手在使用 ChatGPT 等对话式 AI 生成和解读可视化时面临执行错误、误解和信任问题,并提出了改进 AI 辅助可视化系统的设计建议。