Not Birds of a Feather: Personality-Based Partner Selection in LLM Agents
并非一丘之貉:基于大语言模型代理的个性伙伴选择
专题命中 其他LLM :LLM(title,abstract)
AI总结 研究大语言模型代理中基于个性的伙伴选择,在能力不变时,通过实验发现选择遵循任务刻板印象映射,非同类相吸且与人类团队绩效证据校准错误,揭示了个性选择的特点及对代理市场偏差审计的影响。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
并非一丘之貉:基于大语言模型代理的个性伙伴选择
专题命中 其他LLM :LLM(title,abstract)
AI总结 研究大语言模型代理中基于个性的伙伴选择,在能力不变时,通过实验发现选择遵循任务刻板印象映射,非同类相吸且与人类团队绩效证据校准错误,揭示了个性选择的特点及对代理市场偏差审计的影响。
当机器说谎方式不同时:检测人工智能与人类制造的假新闻
专题命中 其他LLM :large language model(abstract);language model(abstract)
AI总结 研究通过两个二元分类任务,用词汇、可读性等特征及多种机器学习模型,区分真实新闻与人类及人工智能生成的假新闻,发现检测人工智能生成的假新闻准确率高,而人类撰写的较难区分,揭示了错误信息检测的不对称性。
Comments Accepted at ICMLA
Vibe编码:一项测试驱动开发的实验
专题命中 其他LLM :large language model(abstract);language model(abstract)
AI总结 研究探索人类与CLLMs通过vibe编码对等协作,设计四个交互模型并实现相应TDD工作流程。通过实验发现交互模型选择取决于开发目标,智能工作流程利于快速开发但有复杂性,协作工作流程产生更高质量测试套件。
从抓握到说话:基于生成式人工智能的自闭症个体环境基础VR沟通训练
专题命中 其他LLM :LLM(abstract);prompting(abstract)
AI总结 研究探索基于生成式人工智能的VR沟通训练对自闭症个体的作用,通过9名受训者和7名教练参与的三种模式实验发现,C+O+G模式更受青睐,可用性和工作量相当,有助于沟通实践融入任务执行,还讨论了相关设计考量。
Comments 14 pages, ASSETS2026
Journal ref The 28th International ACM SIGACCESS Conference on Computers and Accessibility (ASSETS 2026)
阴谋论兔子洞通过相互作用的传播出现
专题命中 其他LLM :large language model(abstract);language model(abstract)
AI总结 研究探讨人们陷入阴谋论兔子洞的原因,通过分析推文用序列风险模型等揭示阴谋论间相互作用及定居者效应,比较多种模型,发现传染病生态模型能重现相关动态,还表明防止阴谋论首次公开认可有重要作用。
Comments 49 pages, 13 figures, 5 tables, including supplementary appendix
SM4RT:学习用于4D重建的结构化运动几何
机构 * Intelligent Vision Group, Tsinghua University(清华大学智能视觉组)
专题命中 其他LLM :foundation model(abstract);分类 cs.AI
AI总结 针对将单目3D重建能力扩展到4D动态理解的挑战,提出SM4RT,通过引入运动结构表示场景动态,利用并行运动几何编码器和解码器,从单目RGB视频中联合推断相关信息,实现强大运动重建性能并保留场景运动几何结构。
Comments Code is available at: https://github.com/wzzheng/SM4RT
通过一阶损失函数对GELU和阈值传输激活的结构解释
机构 * Business School, University of Edinburgh(爱丁堡大学商学院)
专题命中 其他LLM :language model(abstract);分类 cs.LG
AI总结 基于高斯互补一阶损失函数对GELU给出互补解释,将损失核算与前向信号传输分离,推广到阈值传输族,实验表明校准或学习的均匀阈值门有竞争力且能改进。
Comments 18 pages, 8 figures, 8 tables
基于VLM描述比较的异常帧检测,用于提取特定专家操作和具有视频内自相似性的上下文决策场景
专题命中 其他LLM :language model(abstract)
AI总结 本文针对关键基础设施维护中专家知识传承问题,提出基于VLM描述比较检测异常帧的方法,可提取特定专家操作及上下文决策场景,在模拟实验中该方法的提取率高于传统方法,有效发现含专家知识的候选场景。
Comments 17 pages, 11 figures, 2 tables