From Understanding to Action: Feedback-Grounded Policy Discovery for Generative Recommendation
从理解到行动:面向生成式推荐的反馈驱动策略发现
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对生成式推荐的“理解-行动差距”,提出反馈驱动智能体框架,经蒸馏迁移至轻量模型实现无LLM在线推理,在基准测试与在线A/B测试中均取得推荐效果提升。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
从理解到行动:面向生成式推荐的反馈驱动策略发现
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对生成式推荐的“理解-行动差距”,提出反馈驱动智能体框架,经蒸馏迁移至轻量模型实现无LLM在线推理,在基准测试与在线A/B测试中均取得推荐效果提升。
CHARGE:利用CWE层次结构生成硬件安全SystemVerilog断言
专题命中 其他推理 :reasoning(abstract)
AI总结 CHARGE是利用CWE层次结构和LLM生成硬件安全SVA的自动化框架,在Hack@DAC系列SoC设计中检测到多个已知与新错误,生成的SVA具备较高有效性。
Comments This paper is an extended version of the paper accepted to the IEEE/ACM International Conference on Computer-Aided Design (ICCAD 2026)
推理前校准:针对视觉语言模型中语义漂移的鲁棒视觉令牌缩减
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对VLMs的语义漂移问题,提出无训练的CaRe框架,通过两个互补模块校准视觉表示,在剪枝94.4%视觉令牌时保留96.4%原性能,使推理速度提升最高2.30倍。
通过个性化自然语言恢复语义-ID生成式推荐中的协同信号
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对基于LLM的生成式推荐模型中SID丢失协同信号导致准确率受限的问题,提出个性化自然语言引导的框架,通过添加分层协同线索恢复信号,提升推荐准确率。
Comments 8 pages, 4 figures
多人离散出价博弈:确定性、均衡性与复杂性
专题命中 其他推理 :reasoning(abstract)
AI总结 本文研究多人离散出价博弈,证明其在温和假设下具有确定性,均值收益博弈存在值,定性博弈存在纯纳什均衡,且可达性博弈中判断联盟获胜的问题为PSPACE-hard。
Veritas++:面向感知增强的AIGI检测的值感知在线策略蒸馏
机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences (UCAS)(中国科学院大学先进交叉科学学院) ; Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所) ; School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS)(中国科学院大学人工智能学院) ; Ant Group(蚂蚁集团) ; Sangfor Technologies Inc.(深信服科技股份有限公司)
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对现有AIGI检测模型的感知瓶颈,提出Veritas++框架,通过PoRL与VaOPD机制增强感知能力,提升了检测泛化性与效率。
SCALPEL:基于大语言模型驱动的编码器学习的医学视觉-语言语义跨模态对齐框架
机构 * School of Computer Science, Hangzhou Dianzi University(杭州电子科技大学计算机学院)
专题命中 其他推理 :reasoning(abstract)
AI总结 针对现有医学视觉-语言预训练的三大瓶颈,本文提出SCALPEL框架,通过临床报告对比微调、非对称对齐策略及解剖-否定感知目标,在三大医学基准上实现了多项任务的最优性能。
Comments 14 pages, 3 figures, accepted by PRCV2026
熟能生巧:从零人类演示中引导与整合机器人能力
专题命中 其他推理 :reasoning(abstract)
AI总结 本研究提出HERO自改进层级具身智能体,通过整合启发式推理等技术,实现机器人从零人类演示自主演进操作能力,减少数据收集人工干预并提升多样化任务操作稳健性。
从角色提示到无限思考:利用角色条件进行大语言模型推理成本攻击
专题命中 其他推理 :reasoning(abstract)
AI总结 研究LLMs推理成本问题,提出RolePlay框架利用角色条件诱导低效行为放大推理成本,实验证明该框架优于现有方法,为LLM推理效率攻击提供新视角。
Comments 17pages
中间的模型:迈向人工智能原生实时通信
专题命中 其他推理 :reasoning(abstract)
AI总结 研究迈向人工智能原生实时通信,提出将模型视为有状态计算中间盒的新观点,探索网络感知推理调度等三个跨阶段协调机会,构建Conflux验证,结果显示在网络退化时响应延迟等有改善,呼吁建立相关实时通信堆栈。
ALIBI:通过对抗性代码注释对基于大语言模型的漏洞检测器进行自适应智能体攻击
专题命中 其他推理 :reasoning(abstract)
AI总结 研究如何通过对抗性代码注释对基于大语言模型的漏洞检测器进行自适应智能体攻击,提出ALIBI框架,将现实世界漏洞修复提交转换为编码任务评估多个检测器,发现其高度易受攻击,揭示攻击面并推动安全意识设计。
凝视到文本生成:超越人类注意力的分类解码
机构 * Stony Brook University(纽约州立大学石溪分校) ; Australian Institute for Machine Learning(澳大利亚机器学习研究所) ; Adelaide University(阿德莱德大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究提出将凝视解码为自然语言描述人类目标的新问题,构建Gazette框架,基于多模态大语言模型,利用新颖策略合成出声思考转录本并指令调优,使其在多任务凝视解码中达最优性能,能推断多样场景下人类目标意图。
Comments To appear in European Conference on Computer Vision (ECCV) 2026
StateAct:在像素之前的程序状态,用于长期计算机使用代理
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对计算机使用代理,提出基于程序状态的StateAct多代理框架,主要代理用代码处理状态,GUI子代理辅助,支持验证,在OSWorld 2.0上提升了Claude Opus 4.8的成功率,且成本降低,实现从感知到推理的瓶颈转移。
PCA:用于快速视频大语言模型的持久性感知压缩与聚合
机构 * Institute for Artificial Intelligence, Great Bay University(大湾区大学人工智能研究院) ; Sun Yat-sen University(中山大学) ; Youtu Lab, Tencent(腾讯优图实验室) ; Shenzhen University(深圳大学) ; Dongguan Key Laboratory for Intelligence and Information Technology(东莞市智能信息技术重点实验室)
专题命中 其他推理 :reasoning(abstract)
AI总结 研究视频大语言模型长时帧冗余问题,提出PCA方法,含动态下采样和持久性感知运动增强模块,能在编码前保留视觉信息,提升效率与准确性,优于现有方法,速度有显著提升。
Comments Accepted by ACM MM 2026
大语言模型在医疗分诊中的社会经济推断:相同症状,不同邮政编码
专题命中 其他推理 :reasoning(abstract)
AI总结 研究大语言模型对相同症状但不同社会经济地位患者的医疗分诊建议,通过三个模型固定症状改变SES信号,发现对明确信号各模型均提高低SES患者急诊转诊率,对隐含信号的敏感性因模型而异,揭示信号明确性梯度并发布相关内容。
Comments 8 pages, 4 tables. Code, prompts, and raw results: https://github.com/wongqihan/triagebench
通过MLLM引导的概念生成和语义传播进行无监督多模态意图发现
专题命中 其他推理 :reasoning(abstract)
AI总结 该研究针对无监督多模态意图发现缺乏语义监督及可解释性差的问题,提出MCSP方法,通过MLLM引导的对比推理获取语义概念,再经语义传播生成伪标签,实验证明其性能优于现有方法且能产生可解释的簇。
Comments Accepted at ACM Multimedia 2026 (MM '26)
FedAgentKE:异构智能体的联邦语义知识演化
专题命中 其他推理 :reasoning(abstract)
AI总结 研究异构智能体孤立运行问题,提出 FedAgentKE 框架,通过语义知识蒸馏、聚合和Adapt实现联邦语义知识演化,实验验证其在跨框架和跨任务设置下能改进智能体协作,为未来协作智能体生态系统发展提供潜力。
Comments 9 pages (including appendix)
SHIFT:自我重建利用隐式细粒度思维进行检索
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对基于LLM的检索器存在的问题,提出SHIFT框架。通过残差投影等转换LLM为高效检索器,利用细粒度重建缓解不匹配,经实验验证其性能优于其他检索器,为信息检索提供新方法。
SimulS2ST-Omni:通过显式轨迹监督实现数据高效的流式语音到语音翻译
机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
专题命中 其他推理 :reasoning(abstract)
AI总结 研究长格式流式语音到语音翻译,提出仅用约2000小时配对数据的训练方法,核心是联合文本-代码轨迹监督,双流分解减轻干扰,在质量-延迟权衡上表现出色,与先进闭源系统相当。
Comments 29 pages, 19 figures, 16 tables
架起行为与实现的桥梁:用于行为驱动开发的自动化Java胶水代码生成
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对行为驱动开发中胶水代码开发维护难题,提出分层多智能体框架AutoGlue,遵循行为优先工作流程。经实验评估,相比少样本提示,其在代码生成指标上有显著提升,能有效连接行为规范与项目代码,支持软件开发。
缓解零样本视频时刻检索中的模态和语言风格差距
机构 * Sungkyunkwan University(成均馆大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 研究零样本视频时刻检索中模态和语言风格差距问题,提出基于自相似性的时刻提议和评分方法及查询感知的多模态大语言模型推理阶段,有效缓解差距,在相关基准测试中达最优性能。
Comments ECCV 2026 (* These authors contributed equally.)
DuSPiT:双分支子补丁像素扩散变换器
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) ; Reve(瑞夫)
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对像素空间扩散中单一表示兼顾全局与细节的问题,提出双分支子补丁像素扩散变换器DuSPiT。通过分离全局与局部处理,利用两分支交互,实现更丰富细节和更好质量效率权衡,优于此前的像素空间扩散变换器。
令牌通信(TokCom):一个统一的原生人工智能通信框架
专题命中 其他推理 :reasoning(abstract)
AI总结 研究随着人工智能发展无线通信原理的范式转变,提出令牌通信框架TokCom,将令牌提升为6G信息交换一等实体,经架构转变研究、案例验证,概述迈向适用于6G的原生人工智能、令牌驱动通信范式的未来研究方向。
Comments 7 pages, 4 figures
用于对危险驾驶产生情感反应的视觉语言助手
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对现有自动驾驶视觉语言模型忽视情感维度与用户体验的问题,提出KYA系统。它由视觉模块(用YOLOv8变体检测危险行为并提取指标生成日志)和语言模块(依情感基调设置生成回应)组成,经实验评估表现良好,为车载人工智能带来新范式。
Comments Transportation Research Record. Advance online publication (2026)
用于定性和混合方法社交网络分析的大语言模型
专题命中 其他推理 :reasoning(abstract)
AI总结 探讨将大语言模型整合进定性和混合方法社交网络分析领域,强调增强定性分析深度与严谨性,介绍其可辅助数据收集等工作,指出使用局限与伦理挑战,并为相关研究者提供研究设计与实用建议。
Aïra:重新思考面向跨学科科学的人工智能研究助手
专题命中 其他推理 :reasoning(abstract)
AI总结 针对跨学科科学中人工智能研究助手缺乏协作推理支持的问题,提出构建Aïra,它能识别学科观点、翻译术语等,介绍了其设计原则、系统架构,展示输出并给出支持协作学术的人工智能系统未来研究方向。
大型视觉语言模型中的认知专家混合体
机构 * Singapore University of Technology and Design (SUTD)(新加坡科技设计大学)
专题命中 其他推理 :reasoning(abstract)
AI总结 研究大型视觉语言模型中多编码器专家整合难题,提出证据驱动的多模态推理框架,利用布鲁姆分类法及两阶段认知语言化,改进感知和推理能力,实现细粒度分析。
SiFAR:用于低延迟大语言模型推理的无同步全规约算法
专题命中 其他推理 :reasoning(abstract)
AI总结 研究针对大语言模型推理中令牌生成延迟瓶颈,提出无同步全规约算法SiFAR。通过消除一次性算法写后写依赖、利用交换机片上规约等方法,减少全规约延迟,提升端到端吞吐量,在特定条件下取得显著性能提升。
摆脱普罗克汝斯忒斯之床:用于音频语言模型的分组正交连接器
机构 * Graduate Institute of Communication Engineering, National Taiwan University(国立台湾大学通信工程研究所) ; ASUS AICS
专题命中 其他推理 :reasoning(abstract)
AI总结 研究音频语言模型压缩中存在的问题,提出ORCA方法,通过分组使查询输出指向不同方向,在SAKURA多跳推理中表现出色,提升分数,减少查询冗余并提高跨说话者方差。
大语言模型对软件工程术语的理解不可靠
专题命中 其他推理 :reasoning(abstract)
AI总结 研究大语言模型对软件工程术语的理解程度,通过用正确及伪造定义提示,测量分类准确率与推理令牌合理性,发现多数模型虽能检测伪造定义,但存在拒绝正确定义的偏差,明确推理未持续改善结果,揭示了LLMs在术语理解上的问题。