AI-AI Bias: large language models favor communications generated by large language models
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments 8 pages, 4 figures
Journal ref Proc. Natl. Acad. Sci. U.S.A. 122 (31) e2415697122 (2025)
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments 8 pages, 4 figures
Journal ref Proc. Natl. Acad. Sci. U.S.A. 122 (31) e2415697122 (2025)
机构 * University of Colorado Boulder(科罗拉多大学博尔德分校) ; University of Oklahoma(俄克拉荷马大学) ; University of Chittagong(奇塔格昂大学) ; Saga Education(Saga教育)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Accepted to EDM'2025
机构 * The Chinese University of Hong Kong Shenzhen(香港中文大学(深圳)) ; California Institute of Technology(加州理工学院)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
Comments ACL 2025 Findings
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
Comments 9 pages, 6 figures, 3 tables
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
Comments Website: https://www.emergent-values.ai
专题命中 其他Agent :autonomous agent(abstract);分类 cs.CL、cs.LG、cs.SE
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.SE
Comments Work in progress
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments To appear in IEEE ICASSP 2024
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL、cs.LG
Journal ref Nature Machine Intelligence 4, 1068-1076 (2022)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL、cs.LG
Comments IJCAI 2019 Workshop on Semantic Deep Learning
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL;autonomous agent(comments)
Comments Author's copy of the manuscript accepted in the Responsible Artificial Intelligence Agents workshop of the International Conference on Autonomous Agents and Multiagent Systems (AAMAS'19)
通过格论的无偏规范集值预言机
机构 * Pik-Potsdam(皮克-波茨坦)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 针对预言机自指问题,提出基于Knaster-Tarski不动点定理的规范集值预言机,输出无偏且自洽的credal集,并证明其存在性与非空性。
自主分析智能体的创新残差审计:定位、检测限、误差控制与可识别性
机构 * Johns Hopkins University(约翰斯·霍普金斯大学)
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.LG
AI总结 本文针对自主分析智能体的创新残差审计,分析了错误定位、分数选择、误差控制及审计极限,指出表示维度是关键约束。
过程性知识不是低秩的:为什么LoRA无法内化多步骤过程
机构 * University of Melbourne(墨尔本大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。
Comments 14 pages
通过构建实现零幻觉:用于可信企业人工智能的幻觉感知分层监督
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL
AI总结 研究企业AI因幻觉难以被信任的问题时,提出HALO架构,通过六层防御将幻觉视为可控制故障模式,详细介绍各层并关注基于证据的置信度,以实现可信企业AI,在索赔提取工作负载上进行了架构说明。
Comments 12 pages, 2 figures
模型表达、抑制和抗拒的内容:使用角色向量审计开放权重语言模型
机构 * Emory University(埃默里大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL
AI总结 研究通过大规模系统应用角色向量审计开放权重语言模型,编制特征清单并标记其性质,发现模型默认行为特点,引导在默认外特征效果好,且角色向量可探测行为组织。
用于运营决策支持的贝叶斯网络的人工AI构建——一种虚拟调查方法
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG
AI总结 研究如何构建贝叶斯网络用于运营决策支持,提出利用大语言模型的新方法,通过人工智能代理估计概率并去噪,开发六步框架,以客户咨询医生意图建模为例,揭示因素影响,得出有效策略。
TRACE: 双人语音中基于时间关系的对话韵律同步检测
机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) ; Department of Electrical and Computer Engineering, Johns Hopkins University(约翰霍普金斯大学电气与计算机工程系) ; Amazon Research(亚马逊研究院) ; Amazon(亚马逊)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL
AI总结 提出TRACE框架,通过窗口级声学嵌入建模双人交互的时间序列,结合对话上下文和关系信息,在DyadEE数据集上实现97.01%的情感韵律同步检测准确率。
模型取证:调查令人担忧的行为是否反映对齐失败
机构 * MATS
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 提出一个两步基线协议,通过读取思维链生成假设并编辑环境测试假设,以区分模型行为是出于恶意意图还是良性原因,并在六个环境中验证了该方法。
从元想法到高级数学发现——符号嵌入量子算法的人机协同发现
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 本研究通过符号嵌入量子算法的案例,展示了人机协同发现如何将模糊研究直觉转化为具体问题、可行路线和定理族,其中AI辅助探索(包括AIM系统)在路线扩展、方案比较和框架收敛中发挥关键作用,而人类保留最终科学判断。
Comments 35 pasges, 3 figures
认知数字孪生:模拟心智的AI系统的伦理风险与治理
机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
专题命中 其他Agent :autonomous agent(abstract);分类 cs.AI、cs.CL
AI总结 本文定义认知数字孪生(CDT)为动态计算表示个体认知的系统,提出5A治理框架,识别CDT特有风险,并分析治理差距,强调需在认知表示层面进行治理。
Comments Work under review
PRISM:从语言模型激活中恢复指令集
机构 * Center for Cybersecurity Systems & Networks, Amrita Vishwa Vidyapeetham(阿姆里塔·维什瓦·维迪亚佩瑟姆网络安全系统与网络中心) ; Microsoft(微软) ; Ben-Gurion University of the Negev(内盖夫本-古里安大学)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG
AI总结 提出PRISM方法,通过激活条件解码从冻结目标模型隐藏状态中恢复活跃指令集,利用法官引导的GRPO优化,在多种场景下优于基线方法。
Comments Under Review
用于视觉-语言模型的有状态视觉编码器
机构 * University of California, Berkeley(加州大学伯克利分校) ; UC Berkeley(加州大学伯克利分校)
专题命中 其他Agent :agentic(abstract);分类 cs.CL、cs.LG
AI总结 提出有状态视觉编码器,通过将每个视觉表示条件于先前的视觉特征,增强视觉-语言模型在多图像、多轮交互中的视觉变化感知能力,在跨图像空间聚合、多目标视觉差异和轨迹行为克隆等任务上取得一致改进。
Comments Project page: https://statefulvisualencoders.github.io/
DiscourseFlip: 面向黑盒检索增强生成的非直述式语篇级观点操纵攻击
机构 * Wuhan University(武汉大学) ; East China Normal University(华东师范大学) ; Nanyang Technological University(南洋理工大学) ; Worcester Polytechnic Institute(沃思堡理工学院)
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL
AI总结 提出一种基于图引导的代理攻击方法DiscourseFlip,通过语义查询网络中的协同影响在有限预算下最大化语篇级观点偏差,实验证明其有效性和隐蔽性,并揭示现有防御的不足。
混合验证解码:在推测解码中学习分配验证
机构 * Thoughtworks ; Nvidia
专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.CL
AI总结 提出混合验证解码方法,通过预测缓存草稿的接受长度并在缓存验证与模型草稿之间动态选择,在代理工作流中平均加速2.73倍。
Conf-Gen: 生成模型的共形不确定性量化
机构 * layer6ai-labs(layer6ai实验室)
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.LG
AI总结 提出Conf-Gen框架,通过共形风险控制适配生成任务,统一并扩展了共形预测在大型语言模型等生成模型中的应用,并在图像生成、对话AI和AI代理等新领域提供了形式化保证。
Comments ICML 2026
AI,掌舵吧:是什么驱动人机协作问答中的委托与信任?
机构 * University of Maryland(马里兰大学) ; University of California(加州大学) ; MBZUAI
专题命中 其他Agent :AI agent(abstract);分类 cs.AI、cs.CL
AI总结 通过问答游戏实验,研究人类在何时以及为何选择委托AI或采纳其建议,发现人类存在对AI正确建议的低依赖(3.9%)和错误建议的过度依赖(1.7%),并受确认偏见影响,建议通过校准置信度、基于证据的解释和信任细化机制来改进人机协作。
Comments Findings of the Association for Computational Linguistics, 2026