A False Average: Chain-of-Thought Monitors Collapse Where They Are the Only Defense
虚假的平均值:思维链监控在其作为唯一防御的地方失效
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 该研究指出思维链监控在作为唯一防御时会失效,攻击者通过重写智能体推理可大幅降低监控捕获率,攻击可跨模型迁移,仅轨迹防御难恢复,需外部信息辅助。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
虚假的平均值:思维链监控在其作为唯一防御的地方失效
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 该研究指出思维链监控在作为唯一防御时会失效,攻击者通过重写智能体推理可大幅降低监控捕获率,攻击可跨模型迁移,仅轨迹防御难恢复,需外部信息辅助。
低资源东南亚语言中的原生多语言思维链推理
专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 针对低资源东南亚语言大模型推理的跨语言崩溃与微调瓶颈,提出OSCD算法,结合翻译智能体循环与联合嵌入语义对齐,在AIME25等基准上实现数学推理的显著提升。
Comments 22 pages, 16 figures, 12 tables
深度强化学习:从第一性原理到推理模型
专题命中 规划决策 :agent(abstract);multi-agent(abstract)
AI总结 本书介绍深度强化学习从经典方法到各类算法及多领域应用的演进,融合基础与研究视角,面向具备相关基础的学生、研究者和工程师。
迭代调度修改的引导式探索:铁路牵引单元调度的设计研究
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 该研究针对铁路牵引单元调度中交汇序列空间指数增长的问题,提出结合可视化、仿真与三级引导的交互式探索方法,可大幅减少调度修改的识别与评估时间精力。
Comments Accepted for IEEE VIS 2026, will be published in IEEE TVCG
评估残差:长时序评估在匹配短任务性能之外的补充作用
机构 * Tencent(腾讯)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 该论文提出时序残差概念,指出长时序基准需将全任务成功与短阶段基线预测比较,以解释长任务失败的原因。
CinemaTraj:用LLM智能体为3D场景合成原子相机轨迹
机构 * Technical University of Munich(慕尼黑工业大学) ; Huawei Dresden Research Center(华为德累斯顿研究中心)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 CinemaTraj是将LLM智能体与3D场景图结合的框架,可从自然语言生成带旁白的3D场景相机轨迹,在真实环境中优于现有方法。
Comments 17 pages, including 8-page main paper, references, and supplementary material; project page: https://cinematraj.github.io/
超越缩放:学习用于超高分辨率遥感的多工具视觉推理
机构 * National University of Defense Technology(国防科技大学) ; Wuhan University(武汉大学) ; Tsinghua University(清华大学)
专题命中 规划决策 :tool-use(abstract);planning(abstract)
AI总结 针对超高分辨率遥感图像给多模态大语言模型带来的挑战,提出GeoMTVR数据集,结合监督微调与以工具注意力为重点的强化学习算法开发GeoLens,实验证明其在多工具视觉推理方面优于直接推理和单工具放大基线。
CHILL-Harness:用于长期智能体高效推理的反事实控制学习
专题命中 规划决策 :agent(abstract);workflow(abstract)
AI总结 研究长期智能体控制中因依赖固定策略导致效率低的问题,提出CHILL-Harness方法,通过因果干预效应学习和优势实现因果编排,结合成功保留目标与约束,在多任务实验中减少消耗与时间,保持或提高任务成功率。
UrbanTrace:基于大语言模型的空间数据发现与语义感知集成
专题命中 规划决策 :AI agent(abstract);workflow(abstract)
AI总结 研究针对城市决策中异构空间数据整合问题,提出UrbanTrace视觉分析系统,利用离线分析器结合大语言模型,通过三个交互式视图实现有效空间聚合,经评估在数据发现上表现优异,将空间聚合敏感性转化为视觉资产。
Comments 11 pages, 7 figures. Accepted to IEEE VIS 2026 (Full Papers Track). Author's version accepted for publication in IEEE Transactions on Visualization and Computer Graphics
无出口人群中的宏观壁面压力和微观接触载荷:社会群体凝聚力和边界缓冲
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究无出口人群中机械危险,通过弹性重定向模型和社会力模型及其耦合动力学,用社会群体凝聚力等量化风险,揭示耦合动力学产生的壁面压力/接触载荷权衡及相边界,为高密度场所人群风险缓解和安全规划提供指导。
Comments 16 pages, 8 figures
通过可行动作映射桥接强化学习与最优控制
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 针对操作受约束动态系统,提出FAOC框架,整合RL与OC。通过计算高效映射算法,将RL动作转换为OCP可行参数集,兼顾安全性与灵活性。应用于机器人乒乓球运动规划,模拟实验显示其在样本效率和闭环性能上优于现有基准。
Comments 26 pages, 6 figures
沙普利值与图特多项式相遇
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究存在预先对齐代理组的合作博弈,通过连通性增强局部值的沙普利值建模局部连接对网络连通性的贡献,并将其与色多项式、图特多项式及Potts模型配分函数相联系,以解决相关网络问题。
Comments 14 pages, 0 figures
ReferTrack:用于具身视觉跟踪的先指认后跟踪
机构 * SUSTech(南方科技大学) ; Tencent Robotics X(腾讯机器人X实验室) ; Peking University(北京大学) ; Futian Laboratory(福田实验室)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究针对具身视觉跟踪问题,提出ReferTrack先指认后跟踪范式,用单个摄像头,先选目标再解码跟踪航点,通过滑动窗口队列保留运动线索,经数据集协同训练增强识别,在EVT - Bench上达先进单视图性能并验证了迁移能力。
一个全国规模的电动汽车充电调度框架:基础设施容量约束下的最优迂回路由
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究在现有充电基础设施下电动汽车长途旅行调度负担与成本,提出基于优化的可扩展框架,分三阶段计算最优充电调度,应用于大量车辆轨迹,能快速生成可行调度并评估电动汽车成本竞争力。
Retriever:组合闭环异步机器人程序
机构 * Stanford University(斯坦福大学) ; MIT(麻省理工学院) ; Northeastern University(东北大学)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究构建长期运行机器人智能体的闭环管道问题,提出Retriever,它涵盖异步决策模型等整个堆栈,将智能体表示为有状态因果流函数图,编译到支持多后端的运行时,可系统调试和确定性重放,通过案例研究等进行评估。
Comments Project website: http://retriever.systems; Package open-source website: http://openretriever.org
一种用于社区感知犯罪热点检测的模糊逻辑框架:城市计算平台的原型应用架构与探索性验证
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 该研究针对城市犯罪预防挑战,构建基于模糊逻辑的框架用于社区感知犯罪热点检测和实时通知,结合多种数据与规则估计风险,经探索性验证,虽未证明能减少犯罪或预测准确,但为相关研究提供了以人为本的框架。
Comments 12 pages, 6 tables, 1 figure. Framework paper with Python prototype and exploratory validation with 25 participants
将视频搜索为树:用于有基础的长视频问答的自校正智能体
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; Sony(索尼)
专题命中 规划决策 :agent(abstract);agentic(abstract)
AI总结 研究有基础的长视频问答问题,提出VideoTreeSearch框架,通过构建自适应时间树及可学习的离散操作让智能体导航,经监督微调与强化学习训练,在多个基准测试中表现出色,证明自校正分层搜索是关键机制。
用于云原生卫星平台的基于代码即政策护栏的地面任务计划编译
专题命中 规划决策 :AI agent(abstract);workflow(abstract)
AI总结 研究针对卫星云原生运行时缺少地面开源工具链的问题,提出卫星任务编译器这一四阶段管道,能依据规则检查并编译任务计划为相关工件,经多种方式验证,还向AI代理暴露管道,有相关工具及发布协议。
Comments 13 pages. Extended version of the paper accepted at IEEE SMC-IT/SCC 2026 (Space Mission Challenges for Information Technology / Space Computing Conference); adds a unified GPU+CPU DRA quota and a scheduler-level accelerator fallback re-validated on Kueue v0.18.3
AdaTurn:用于主动视觉感知智能体的预算感知测试时缩放
机构 * University of Rochester(罗切斯特大学) ; Univeristy of Michigan(密歇根大学)
专题命中 规划决策 :agent(abstract);tool use(abstract)
AI总结 研究主动视觉感知智能体在不同预算下的任务执行问题,提出AdaTurn框架,通过强制答案DAPO等组件,根据预算调整智能体行为,提高低预算准确率,且能有效转移到多基准测试中。
ReflectVLN:通过反思推理训练视觉语言导航智能体
机构 * Amap, Alibaba Group(高德软件有限公司,阿里巴巴集团) ; Beihang University(北京航空航天大学)
专题命中 规划决策 :agent(abstract);agentic(abstract)
AI总结 研究针对现有视觉语言导航方法缺乏闭环机制问题,提出ReflectVLN框架,通过双向交互智能体决策,引入行动思维链训练方案,实验证明该框架在有限数据下提升成功率和路径效率,且具良好训练成本与可解释性。
CoMind:从多视角理解人类协作活动
机构 * ETH Zurich(苏黎世联邦理工学院) ; MPI for Informatics(马克斯·普朗克信息研究所) ; Microsoft Switzerland(微软瑞士公司) ; TU Munich(慕尼黑工业大学)
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究旨在填补人类协作认知过程研究空白,引入CoMind数据集,整合多模态数据并标注,建立相关基准,有助于开发和评估能建模复杂社会互动及推理人类行为的AI系统。
Comments Accepted to ECCV 2026
不退化文本智能的统一音频智能
机构 * Nemotron-Labs(Nemotron实验室)
专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本文提出统一音频-文本大语言模型Audex,通过单Transformer解码器架构与多阶段训练,在实现多音频任务SOTA性能的同时,几乎不损失骨干文本LLM的原有文本智能能力。
Comments We release the Audex models at https://huggingface.co/collections/nvidia/nemotron-labs-audex
男性不育症精液分析深度学习技术:计算机视觉、多模态融合与临床转化
机构 * Department of Gynaecology and Obstetrics, The Affiliated Jiangyin Hospital of Nantong University(南通大学附属江阴医院妇产科) ; Department of Oncology, the Affiliated Jiangyin Hospital of Nantong University(南通大学附属江阴医院肿瘤科) ; Thrust of AI, Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)人工智能推力实验室) ; FertiTech AI(生殖科技人工智能公司) ; Department of Oncology, Suzhou Xiangcheng People’s Hospital(苏州市相城区人民医院肿瘤科) ; Department of Biological Sciences and Bioinformatics, School of Science, Xi’an Jiaotong-Liverpool University(西交利物浦大学理学院生物科学与生物信息学系) ; School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院)
专题命中 规划决策 :planning(abstract);workflow(abstract)
AI总结 针对传统精液分析的主观性强等缺陷,综述聚焦计算机视觉与深度学习驱动的精子分析技术,梳理方法、数据集与落地障碍,提出分阶段临床转化路线。
Comments 46 pages, 14 figures
将离策略令牌转换为策略内令牌:一种改进大语言模型对齐的插件方法
机构 * Renmin University of China(中国人民大学)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 研究针对大语言模型强化学习后训练中离策略数据问题,提出选择性重要性采样(SIS),受拒绝采样启发,以离策略模型为提议分布进行令牌级拒绝测试,理论证明可减少梯度估计差距,实验验证其有效性。
一种精确的广义k细胞分解
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究为配备k调制解调器的智能体在多边形环境中进行可见性规划提出精确k细胞分解,通过消除冗余线,确保可见性事件发生在分解线上,改进复杂度,明确关键事件位置并适用于带孔多边形,有实际应用。
Comments To appear in the Proceedings of the 38th Canadian Conference on Computational Geometry (CCCG 2026)
在有预定位设施的区域间定位桥梁的机制设计
专题命中 规划决策 :agent(abstract);planning(abstract)
AI总结 研究在两个有预定位设施的区域间建桥的机制设计问题,考虑不同机制下社会成本和最大成本,给出最优解特性及多种近似机制和下界。
Comments 12 pages, 1 figure; includes supplementary material
超越场景先验:通过基准测试和查询引导的小目标聚焦进行细粒度交通场景推理
机构 * The University of Hong Kong(香港大学) ; Sun Yat-Sen University(中山大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中 规划决策 :agent(abstract);multi-agent(abstract)
AI总结 针对安全关键交通场景中复杂问题,提出细粒度交通推理基准FGTR - Bench和文本引导小目标推理MLLM(TSR - MLLM),解决视觉语言对齐中关键小目标被忽视问题,提升模型性能。
CRRL:一种用于自主系统恢复的基于因果关系的强化学习框架
机构 * Simula Research Laboratory(Simula研究实验室) ; University of Oslo(奥斯陆大学)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG、cs.SE
AI总结 研究自主系统恢复中传统强化学习问题,引入基于因果关系的CRRL框架,利用驾驶日志因果关系塑造训练信号,使策略与基于规则的恢复有效协作,提升相关指标。
Comments 30 pages
SessionBound: 将企业任务审批转化为预算化的数据库会话
专题命中 规划决策 :agent(abstract);AI agent(abstract)
AI总结 提出SessionBound框架,将审批的企业任务转化为短期、预算化、可审计的数据库会话,通过控制平面和SessionBoundDB实现安全边界,无需LLM判断查询安全性。
Comments 7 pages, research prototype. Code: https://github.com/SessionBound/sessionbound
基于近似查询处理和代理模型的AI工作流查询中心优化
专题命中 规划决策 :workflow(abstract);agentic(abstract)
AI总结 提出将AI工作流视为声明式查询,利用近似查询处理(AQP)和代理模型(PM)过滤减少昂贵模型调用,在TPC-DS和LLM流水线上实现85-90%和60-70%的调用减少。