Poisoned Playbooks: Demystifying Knowledge Poisoning Effects on AI Security Agents
有毒剧本:揭秘知识投毒对AI安全代理的影响
专题命中 规划决策 :agent(abstract);AI agent(abstract)
AI总结 研究揭示通过RAG注入单条有毒安全知识可系统性改变AI安全代理行为,提出验证边界(VB)分类法,并评估验证提示与多源检索的防御效果。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
有毒剧本:揭秘知识投毒对AI安全代理的影响
专题命中 规划决策 :agent(abstract);AI agent(abstract)
AI总结 研究揭示通过RAG注入单条有毒安全知识可系统性改变AI安全代理行为,提出验证边界(VB)分类法,并评估验证提示与多源检索的防御效果。
RoBoSR:面向具身机器人推理的结构化场景表示
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 提出RoBoSR,一种基于语义对象中心场景图的中间结构表示,将操作建模为逐步状态转换,实现因果推理和长期任务规划,并在零样本泛化中优于提示方法和经典TAMP基线。
EmbodiedUS-FS:用于超声机器人的快速慢速智能
机构 * independent researcher(独立研究员) ; Shanghai World Foreign Language Academy(上海世界外国语中学) ; University of Wyoming(怀俄明大学) ; SUNY Binghamton(纽约州立大学宾汉姆顿分校)
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 提出一种分层快慢思考的具身超声系统,通过慢脑进行意图解析和任务规划,快脑融合多模态反馈优化局部动作,并集成安全防护机制,在动态临床环境中提高任务成功率并减少安全违规。
STARE: 基于惊讶度的令牌级优势重加权以实现策略熵稳定性
机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) ; Tencent Hunyuan(腾讯 Hunyuan)
专题命中 规划决策 :tool use(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对GRPO等RL算法中策略熵崩溃问题,提出STARE方法,通过惊讶度分位数识别熵关键令牌并重加权其优势,结合目标熵闭环门控稳定熵,在1.5B-32B模型和多种任务上实现稳定训练,AIME24/25准确率提升4%-8%。
Comments LLM, Reinforcement Learning
打破求解器瓶颈:在可学习前沿训练任务生成器
机构 * Vmax ; Goodfire AI
专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出PROPEL框架,通过训练轻量级激活探针作为求解率代理,在无需重复求解器评估的情况下优化任务生成器,使生成任务集中在可学习前沿,提升数学、代码和软件工程任务的有效性。
Comments 30 pages, 9 figures, 12 tables
两个自私智能体在图上的间歇性战略合作
机构 * Bar-Ilan University(巴伊兰大学)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究两个自私智能体在时间与空间约束下的战略合作问题,通过IC2PP模型刻画纯纳什均衡结构,证明均衡存在性并提出多项式时间枚举算法。
机器人何时应重新规划?时变MDP中的遗憾引导更新调度
机构 * University of Illinois Urbana–Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 针对时变环境下机器人因预算限制无法持续重规划的问题,提出基于动态遗憾的在线更新调度规则,在仿真和实物实验中优于固定预算基线。
LabVLA:在科学实验室中落地视觉-语言-动作模型
机构 * Zhejiang University(浙江大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Harbin Institute of Technology(哈尔滨工业大学)
专题命中 规划决策 :workflow(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对科学实验室中机器人执行协议面临的数据和实体瓶颈,提出模拟数据引擎RoboGenesis和两阶段训练策略LabVLA,在LabUtopia基准上取得最高平均成功率。
Comments Work in progress. Project website at https://zjunlp.github.io/LabVLA/
零源大语言模型幻觉检测:类人类标准探测
机构 * South China University of Technology(华南理工大学) ; The University of Melbourne(墨尔本大学) ; Pazhou Laboratory(帕乔实验室) ; Australian Institute for Machine Learning, Adelaide University(澳大利亚机器学习研究所,阿德莱德大学)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出HCPD范式,通过类人类标准探测机制模拟人类评估者的多面推理,结合奖励对齐和多样本聚合,实现零源条件下的有效可解释幻觉检测。
Comments Accepted at ICML 2026
Kwai Keye-VL-2.0 技术报告
机构 * Kuaishou Group(快手集团)
专题命中 规划决策 :agent(abstract);agentic(abstract)
AI总结 提出开源MoE多模态基础模型Keye-VL-2.0,首次将DeepSeek稀疏注意力适配到GQA架构,支持无损256K上下文处理,并通过跨模态多教师策略蒸馏和上下文/视频强化学习解决多任务对齐中的灾难性遗忘,在长视频理解和智能体任务上达到同类最优。
Comments 31 pages, 11 figures
PreAct-Bench:大语言模型中的预测性监控基准
机构 * King’s College London(伦敦国王学院) ; National University of Singapore(新加坡国立大学) ; Southern University of Science and Technology(南方科技大学) ; Thomson Reuters Foundational Research(汤姆森路透基础研究) ; Imperial College London(伦敦帝国学院) ; The Alan Turing Institute(艾伦·图灵研究所)
专题命中 规划决策 :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出预测性监控任务,在动作执行前判断是否会导致不道德行为,并构建PreActBench基准,评估多种模型发现该任务具有挑战性。
RO-LiDAR GeoQuickView:探索罗马尼亚公共LiDAR衍生高程数据的Web平台
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 提出一个非商业Web-GIS平台RO-LiDAR GeoQuickView,整合公共LiDAR衍生数字地形模型等高程数据,提供标准化山体阴影可视化、参与式景观记录和空间索引,以解决数据碎片化和专业处理限制问题。
为什么将残差流限制在层而不是令牌?用于连续潜在推理的持久记忆
机构 * University of Cambridge(剑桥大学)
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对CoCoNuT在潜在空间推理中因中间隐藏状态被覆盖导致概念瓶颈的问题,提出AGCLR模型,通过门控概念流持久记忆机制,在GSM8K、HotpotQA和ProsQA上取得一致提升。
TRACE: 通过自适应跨步骤证据聚合的LLM智能体轨迹推理
机构 * University of Massachusetts at Amherst(马萨诸塞大学阿默斯特分校) ; Adobe Research(Adobe研究) ; Dolby Labs(杜比实验室) ; University of Oregon(俄勒冈大学) ; Cisco(思科)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 提出TRACE框架,通过TIJ循环识别高信号区域、累积跨步骤证据并合成轨迹级判决,在SHADE-Arena的十个任务域上F1达0.713,召回率0.844,尤其擅长长距离证据链接。
大型语言模型(LLMs)并非优秀的战略家,然而记忆增强的智能体可提升推理能力
机构 * University of Chicago(芝加哥大学) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL;planning(journal_ref)
AI总结 该研究针对LLM在长时环境中战略推理的缺陷,提出EpicStar框架,结合跨回合记忆与动态门控机制,在星际争霸II测试中实现更高胜率且令牌消耗大幅减少。
Journal ref Published at Reasoning and Planning for LLMs at ICLR 2025
临床试验策略学习:面向决策智能体的离线策略训练
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG;agentic(comments)
AI总结 本研究将肿瘤学临床开发建模为离线决策问题,构建时间数据集,对比4种离线目标与4种LLM智能体,发现奖励加权行为克隆表现最优,证明结构化离线学习可用于规划临床实验。
Comments Accepted for a spotlight at the ICML 2026 Workshop on Generative and Agentic AI for Biology (GenBio) and as a poster at the ICML 2026 Workshop on Decision-Making from Offline Datasets to Online Adaptation: Black-Box Optimization to Reinforcement Learning (DEMO). 15 pages, 3 figures, 11 tables
长视野智能体的跨基准泛化
专题命中 规划决策 :agent(abstract,comments);分类 cs.AI、cs.SE
AI总结 本研究针对长视野智能体,通过两阶段SFT-再-RL流程后训练Qwen3.5-122B-A10B模型,在5项外部基准实现性能提升,证明长视野多工具后训练的工作方式可跨领域迁移。
Comments Accepted at the COLM 2026 Workshop on Agent Behavior. 11 pages, 4 tables
结合人类反馈的策略迭代:将后训练强化学习应用于上下文学习
机构 * Vanderbilt University(范德堡大学) ; Vanderbilt University Medical Center(范德堡大学医学中心)
专题命中 规划决策 :tool-use(abstract);分类 cs.AI、cs.CL
AI总结 该研究提出结合人类反馈的策略迭代(PIHF)方法,采用预训练语言模型为基底,经实验使其在罕见疾病诊断相关任务中显著提升了多个执行器的Recall@1指标,验证了其可行性。
Comments PIHF method paper
步骤级在线策略蒸馏:在线策略蒸馏与监督微调的插值方法
机构 * State Key Laboratory for Novel Software Technology, Nanjing University(南京大学现代软件技术国家重点实验室) ; XingYun Lab, HUJING Digital Media & Entertainment Group(星云实验室,沪景数字媒体娱乐集团) ; University of Chinese Academy of Sciences(中国科学院大学) ; School of Data Science, Fudan University(复旦大学数据科学学院)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL
AI总结 该研究针对令牌级在线策略蒸馏的局限,提出步骤级在线策略蒸馏SOPD,结合监督微调与在线策略蒸馏的优势,在推理和智能体任务上显著优于传统方法,为蒸馏研究提供新视角。
从序列到结构:面向大语言模型智能体的关系型不确定性传播
机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) ; University of Chinese Academy of Sciences(中国科学院大学)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL
AI总结 本研究针对现有LLM智能体不确定性量化方法忽略长程依赖的问题,提出RUPA框架,通过建模轨迹图的关系依赖传播不确定性,在多个基准上实现更优性能。
基于环的空间Transformer:学习建筑分布与行人流量之间的非线性空间相互作用
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 该研究提出基于环的SpatialTransformer模型,利用东京100个火车站的环缓冲区数据学习建筑分布与行人流量的非线性空间相互作用,其预测准确率优于GWR,挑战了紧凑城市假设,为城市规划提供了新视角。
FreeBalance:基于残差 workload 预测的预路由在线 MoE 负载均衡
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 FreeBalance 是一种 MoE 模型在线负载均衡框架,通过残差 workload 预测实现专家迁移与预路由计算重叠,降低负载失衡与推理延迟,提升分布式推理效率。
Comments 8 pages, 4 figures
目标是瓶颈:潜在世界模型编码了其规划器无法使用的内容
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 该研究发现潜在世界模型的规划瓶颈在于规划器目标而非预测器,通过替换目标无需额外训练即可大幅提升长视野规划性能,揭示模型编码了规划器未利用的可达性信息。
Comments Follow-up to arXiv:2608.10145. All experiments run on a laptop CPU; no model was trained or fine-tuned. Code, checkpoints and every measurement: github.com/joyjeet-singh/tinylab
更好的槽,更好的世界:以对象为中心的世界模型中的表示质量与鲁棒性
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 该研究通过受控实验分析以对象为中心的世界模型,发现槽质量与规划成功率正相关,槽绑定良好时可减少辅助输入,且在分布偏移下其鲁棒性优于LeWM,预训练特征是鲁棒性关键因素。
Comments Published at Model-Based RL in the Era of Generative World Models Workshop at RLC 2026
基于遥感与机器学习的孟加拉国达卡区土地利用及植被变化分析
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 本研究结合遥感与机器学习,分析孟加拉国达卡区2019-2024年土地利用与植被变化,发现建成区大幅扩张、植被与水体缩减,随机森林分类精度最高,为城市可持续发展提供数据支撑。
Comments 16 Pages, 8 Figures, 9 Tables
GCPO:针对大语言模型的rollout强化学习中子空间几何的诊断与约束
机构 * Shanghai AI Lab(上海人工智能实验室)
专题命中 规划决策 :tool-use(abstract);分类 cs.AI、cs.LG
AI总结 GCPO通过几何约束策略优化方法,诊断rollout强化学习的子空间几何问题,在大语言模型后训练中提升了多任务性能并解决了训练不稳定等问题
Comments 15 pages, 10 figures
顺其自然:序贯决策中的等待学习
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG
AI总结 该研究针对序贯决策中智能体频繁感知决策的问题,提出采用带字典序目标的强化学习训练等待策略,在7类任务上实现了可观的等待时长,且不牺牲任务性能。
Comments 25 pages
生命周期最优分词:词汇表大小作为与部署 regime 相关的基础设施参数
专题命中 规划决策 :planning(abstract);分类 cs.CL、cs.LG
AI总结 该研究发现 LLM 分词器的最优词汇表大小随部署 regime 变化,提出生命周期部署成本模型,经实验证实其与训练最优值差异最高达 16 倍,且最优范围内质量损失极小,为 LLM 部署提供词汇表容量规划指导。
Comments 6 pages, 3 figures, 6 tables
在压缩中迷失:评估上下文压缩下的侧约束损失
机构 * The Pennsylvania State University(宾夕法尼亚州立大学)
专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL
AI总结 本文针对长上下文场景下压缩器丢失会话约束(SCs)的问题,提出COMPINT评估套件量化损失,并开发即插即用的SCs感知提取器,使SCs保留率超90%。
用于生成式创意写作的叙事关键帧技术
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL
AI总结 该研究提出叙事关键帧技术,作为AI辅助创意写作的交互方法,通过三种关键帧类型实现对生成文本的精细控制,经用户研究验证其可控性、透明性与趣味性更优。
Comments UIST 2026