CRPO: Character-centric Group Relative Policy Optimization for Role-aware Reasoning in Role-playing Agents
CRPO:以角色为中心的群体相对策略优化用于角色扮演代理中的角色感知推理
Yihong Tang, Kehai Chen, Liang Yue, Benyou Wang, Min Zhang
机构
*
Institute of Computing and Intelligence(计算与智能研究院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Shenzhen Loop Area Institute (SLAI)(深圳Loop区研究院)
;
The Chinese University of Hong Kong(香港中文大学)
Chain of Evidence: Pixel-Level Visual Attribution for Iterative Retrieval-Augmented Generation
证据链:面向迭代检索增强生成的像素级视觉归因
Peiyang Liu, Ziqiang Cui, Xi Wang, Di Liang, Wei Ye
机构
*
National Engineering Research Center for Software Engineering, Peking University(软件工程国家级工程研究中心,北京大学)
;
City University of Hong Kong(香港城市大学)
;
Peking University(北京大学)
;
Tencent Technology(腾讯科技)
专题命中
逻辑推理
:reasoning(abstract);分类 cs.CL、cs.AI
AI总结
提出Chain of Evidence (CoE)框架,利用视觉语言模型直接对检索到的文档截图进行推理,输出精确边界框以可视化完整推理链,解决迭代检索增强生成中的粗粒度归因和视觉语义丢失问题。
机构
*
School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院)
;
National Institute of Health Data Science, Peking University(北京大学健康数据科学国家研究院)
;
State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)
;
Tianjin Institute of Cardiology, the Second Hospital of Tianjin Medical University(天津医科大学第二医院心内科)
;
National University of Singapore(新加坡国立大学)
;
Jarvis Lab, Tencent(腾讯 Jarvis实验室)
;
HeartVoice Medical Technology(HeartVoice医疗科技)
Federated Semantic Knowledge Graphs for Laboratory Workflows: A Structured Expert Elicitation Methodology Demonstrated Through Bioanalytical Workflow Twins
面向实验室工作流的联邦语义知识图谱:通过生物分析工作流孪生展示的结构化专家启发方法
Luis F. Schachner, Vinith Thamizhazhagan, Sara Tanenbaum, John C. Tran, Pamela P. F. Chan, Mandy Kwong, Andy Chang, Maureen Beresini, Margaret Porter Scott