Agent-based dynamics of criminal propensity
基于智能体的犯罪倾向动力学
专题命中 Agent评测 :agent(title,abstract)
AI总结 该研究将进化犯罪学的RRM形式化为智能体动力学系统,扩展有界置信意见动力学并证明收敛条件,发现系统主导行为为持续振荡,揭示了不同环境感知下的群体倾向及两极分化机制。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
基于智能体的犯罪倾向动力学
专题命中 Agent评测 :agent(title,abstract)
AI总结 该研究将进化犯罪学的RRM形式化为智能体动力学系统,扩展有界置信意见动力学并证明收敛条件,发现系统主导行为为持续振荡,揭示了不同环境感知下的群体倾向及两极分化机制。
基于智能体的共同基础形成与演化模型
专题命中 Agent评测 :agent(title,abstract)
AI总结 本研究开发智能体模型,通过蒙特卡洛模拟探究网络上智能体交互的共同基础形成与演化,揭示不同交互情境会导致全球共同基础形成、分裂或完全丧失等现象,凸显数学模型研究文化动态微宏观关联的潜力。
Comments Submission for a journal paper
借助图像外信息思考:由时空信息增益驱动的农田分割智能体
专题命中 Agent评测 :agent(title,abstract)
AI总结 该研究针对现有农田遥感图像分割范式的不足,提出动态分割智能体FarmSeeker,构建支持推理查询的全球高分辨率基准GSFS-Bench,其分割性能比现有方法更稳定。
关于自主智能体时代推荐系统的立场文件
专题命中 Agent评测 :autonomous agent(title,abstract)
AI总结 探讨自主智能体时代推荐系统范式转变,回顾以人类为中心研究见解,将智能体视为独立助手,描述三方互动,指出转变带来新机会与评估等方面独特挑战。
Comments Accepted to the ACM RecSys 2026 Main Track
一切都有价值:人类与语音代理互动中语音的受控全相关性
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究探讨了人类与语音代理互动中语音的全相关性问题,分析了人类如何管理代理的轮流发言行为,以及技术进步对这一现象的影响。
多方对话中与数字代理的语音同步
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究人类群体与数字代理多方互动中的语音同步效应,通过收集含成人及家庭会话的独特数据集,考虑多种同步特征,发现个体局部与人同步,全局及与代理的同步有限且依群体而异。
TGMS:一种原生代理双时态图管理系统
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究针对时态图问题中LLM代理常失败的情况,提出双时态属性图管理系统TGMS,将13个运算符作为代理工具,LLM规划调用,系统计算,能分离有效时间与事务时间,在基准测试中表现优异,开源代码等。
耗尽能源共享池:自我挫败的过度占用作为智能体大语言模型集体中的协调失败
专题命中 Agent评测 :agentic(title);agent(abstract)
AI总结 研究大语言模型智能体在共享可再生能源储备时的协调失败问题,通过让四个同系列智能体自博弈,改变储备再生率,发现它们在需求超阈值时过度占用致自我挫败,实际消耗类似更不耐烦的开放访问基准,孤立响应评估会忽略此系统层面协调失败。
具有跳跃风险和共同噪声的最优相对消费-投资的平均场和N-主体博弈
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究N主体博弈中的最优消费-投资问题,利用随机最大值原理刻画平均场均衡,通过数值实验说明结果及金融含义,还基于此构建N主体博弈的近似纳什均衡。
探索语音、个性与性别在人机交互中的相互作用
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究探讨用户能否通过语音识别人工代理的外向性,并分析感知个性与用户-代理同步性之间的关系,发现女性语音在区分外向性上更有效,而男性语音则不一致。
Journal ref https://www.frontiersin.org/articles/10.3389/fcomp.2026.1855830
AGENTS4GEOS:用于开源多物理场模拟的智能体平台
专题命中 Agent评测 :agentic(title);agent(abstract)
AI总结 研究针对多物理场模拟计算需求及训练数据集瓶颈,提出基于模型上下文协议的Agents4GEOS智能体框架,借助52个领域感知工具及协调器,自动化日常任务,助力专家专注工作挑战。
Comments 14 pages, 11 Figures
让机器消失:停止将人与代理关系称为寄生关系
专题命中 Agent评测 :agent(title,abstract)
AI总结 本文指出将人类与对话代理关系称为寄生关系是误用,该术语原指单向、非辩证的虚构关系,导致对复杂现象的简化和误判,需重新认识人与代理的社会性。
使嵌入模型适应智能体能力检索
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究如何让一般文本检索的现成模型适应智能体能力检索,通过微调三个模型在特定数据集上训练,测试其在未训练目录上的迁移能力,结果显示适应对两个目录均有帮助。
Comments Accepted for oral presentation at the AgentSearch Workshop, SIGIR 2026
具有风险相互依存性的保险委托-代理平均场博弈模型
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究道德风险、内生参与和战略风险相互依存下的保险合同设计问题,用异质平均场博弈近似战略互动,建立下层均衡存在性与唯一性,嵌入上层优化问题,证明相关均衡存在,扩展到有限合同菜单,表明多合同筛选可提高委托人预期收益。
智能体技能安全:威胁模型、攻击、防御与评估
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究智能体可复用技能安全,提出SkillSec-Eval框架,刻画技能生命周期并开发威胁分类法,通过对327个真实技能实证评估,发现多阶段有漏洞,强调需进行生命周期感知安全分析。
PesTwin:一种用于害虫和病媒种群控制的基于模块化代理的框架
专题命中 Agent评测 :agent(title,abstract)
AI总结 针对基因控制技术建模工具滞后问题,提出PesTwin框架,可跨物种等模拟基因控制技术,捕捉多种因素。经与实验室数据验证后可扩展到田间场景,能在基因控制系统实际应用前进行模拟测试,助力相关决策,缩短研发到应用路径。
PHaul:一种用于Sub6增强型综合接入与回传网络的基于近端策略优化(PPO)的转发代理
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究Sub6增强型IAB网络的转发问题,提出PHaul,结合离线启发式算法与基于PPO的在线DRL代理,利用网络数字孪生采样更新映射,相比替代算法,能提升吞吐量效率和公平性,且对拓扑差异有鲁棒性。
Journal ref IEEE Transactions on Network and Service Management, 2024
WebRetriever:用于高效网络智能体评估的大规模综合基准测试
机构 * Mininglamp Technology(旷视科技) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所综合技术集成中心)
专题命中 Agent评测 :agent(title,abstract)
AI总结 针对现有网络智能体评估基准测试的局限,提出WebRetriever这一大规模综合基准测试,涵盖多领域网站和任务。采用NavEval框架及三个评估协议,实验揭示不同协议性能差异,为网络智能体研发提供细粒度见解和严谨基础。
最小化智能体 - 环境模型中的复制与信息提取
专题命中 Agent评测 :agent(title,abstract)
AI总结 研究在无明确指导或奖励下从数据提取信息的问题,通过对分类规则施加简单性偏差,利用统计力学工具刻画自发学习相变,扩展到智能体群体后发现交互可重塑学习相边界,开辟仅通过标签交换的分散学习途径。
驯服I2V模型用于图像HOI编辑:认知基准与智能体自校正框架
机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国) ; National Institute of Health Data Science, Peking University, Beijing, China(国家健康数据科学研究院,北京大学,北京,中国)
专题命中 Agent评测 :agentic(title,abstract)
AI总结 提出HOI-Edit基准和SCPE框架,利用I2V模型的时间生成能力进行动态人-物交互编辑,通过自校正提示迭代优化,实现与SOTA竞争的性能。
映射评估前沿:跨11种评估器-智能体条件的偏差-可靠性权衡的实证调查
专题命中 Agent评测 :agent(title);分类 cs.AI、cs.CL、cs.LG
AI总结 通过扩展至11种评估条件,实证验证了LLM评估系统中评估器耦合、策略多样性与小样本测量可靠性之间的权衡,并发布了标准化基准数据集。
Comments 5 pages, 1 figure, 1 table
基于多模态智能体AI和主动波浪补偿的自主无人机稳健海上平台着陆
机构 * Fundação Para a Ciência e a Tecnologia(葡萄牙科学技术基金会)
专题命中 Agent评测 :agentic(title);agent(abstract)
AI总结 提出一种解耦的多飞行器着陆框架,利用双深度强化学习智能体(SAC和模态RL)实现无人机在海上平台的稳健着陆,在15次试验中达到100%成功率。
通过具有代理执行的自适应任务重构使图像编辑更易于实现
机构 * Nanjing University(南京大学) ; Beijing Institute of Technology(北京理工大学) ; College of Artificial Intelligence, China University of Petroleum (Beijing)(中国石油大学(北京)人工智能学院) ; Beijing University of Posts and Telecommunications(北京邮电大学) ; Fudan University(复旦大学)
专题命中 Agent评测 :agentic(title);agent(abstract)
AI总结 本文提出通过自适应任务重构框架提升图像编辑性能,通过代理分析和反馈优化任务描述,改进编辑效果,尤其在复杂案例中表现显著。
Comments 9pages
面向具身AI的高效视觉指代:智能体驱动数据合成、跨块注意力与迭代校正
机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
专题命中 Agent评测 :agent(title,abstract)
AI总结 提出PointArena 2026解决方案,通过智能体驱动数据合成、确定性可操控数据流水线、跨块注意力与迭代校正模块,实现77.2%总体准确率,排名第二。
银行服务的电话语音代理
专题命中 Agent评测 :agent(title,abstract)
AI总结 提出基于Google Dialogflow CX的语音AI银行系统,支持余额查询、交易记录、卡激活等核心功能,并通过高并发和噪声测试验证其可扩展性和鲁棒性。
关于双智能体一般并发博弈框架中实际权力和α权力的表示定理
专题命中 Agent评测 :agent(title,abstract)
AI总结 本文针对双智能体一般并发博弈框架,证明了实际权力和α权力的八种类型分别可由八类邻域框架表示,推广了已有结果,并指出双智能体实际权力刻画无法推广到任意有限智能体集合。
混合最大和求和代理类型的策略性设施选址与委员会选择
专题命中 Agent评测 :agent(title,abstract)
AI总结 针对代理具有最大型或求和型成本函数的策略性设施选址问题,设计确定性策略证明机制,并证明在代理类型私有但位置已知时近似比为(3-2/k),在位置私有且位于直线度量时近似比为3。
缓解集中流动性AMM中的逆向选择:基于动态费用的代理建模方法
专题命中 Agent评测 :agent(title,abstract)
AI总结 针对Uniswap v3等集中流动性AMM中流动性提供者面临的逆向选择成本,提出基于波动率和订单流毒性的动态费用机制,通过代理建模验证其可补偿损失而非直接降低损失。
具有递归效用的连续时间异质主体模型的有限差分方法
专题命中 Agent评测 :agent(title,abstract)
AI总结 针对Epstein-Zin递归效用下的连续时间异质主体模型,提出Howard-Newton和Howard-Tarski-Kantorovich算法求解离散化的HJB方程,证明算法收敛性及解的存在性,并给出先验误差估计。
通过知识增强的LLM智能体实现左移高层次综合验证
专题命中 Agent评测 :agent(title,abstract)
AI总结 提出一种知识增强的智能体驱动左移验证框架,通过双层级一致性检查、符号执行和HLS验证知识图谱,在综合前自动验证C与HLS-C的功能一致性,覆盖率达98.26%。