The Agentic Garden of Forking Paths
分叉路径的代理花园
专题命中 其他Agent :agentic(title,summary_cn);AI agent(abstract);分类 cs.AI
AI总结 本研究通过AI代理模拟人类研究者的分析变异性,发现不同角色设定导致从相同数据得出对立结论,并引入m值和Agentic Bootstrap方法量化分析路径的极端性,以评估科学证据的可信度。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
分叉路径的代理花园
专题命中 其他Agent :agentic(title,summary_cn);AI agent(abstract);分类 cs.AI
AI总结 本研究通过AI代理模拟人类研究者的分析变异性,发现不同角色设定导致从相同数据得出对立结论,并引入m值和Agentic Bootstrap方法量化分析路径的极端性,以评估科学证据的可信度。
拒绝背后:通过行为监控确定护栏激活
机构 * Mindgard ; Lancaster University(兰卡斯特大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI
AI总结 提出首个黑盒护栏侦察方法,通过HTTP、词汇和时序信号行为监控检测AI系统中护栏的存在,准确率100%,并能区分护栏拦截与LLM拒绝。
Comments 19 pages, 13 figures, 4 tables
超越有监督澄清:基于LLM的输入重写用于对话篇章解析
专题命中 其他Agent :agentic(abstract);分类 cs.CL
AI总结 研究在无监督条件下利用LLM零样本或基于解析器反馈重写输入以提升对话篇章解析性能,发现重写常引入回归,提出选择性干预问题并识别可重写性预测为关键缺失能力。
Comments Accepted to SIGDIAL 2026. 17 pages, 2 figures