机构
*
Shenzhen International Center for Industrial and Applied Mathematics(深圳工业与应用数学国际中心)
;
Shenzhen Research Institute of Big Data(深圳大数据研究 institute)
;
The Chinese University of Hong Kong Shenzhen(香港中文大学(深圳))
;
Birmingham City University(伯明翰城市大学)
;
Jilin University(吉林大学)
;
KAUST(科威特大学)
;
Hefei University of Technology(合肥工业大学)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.AI、cs.LG
机构
*
Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)
;
RUC(中国人民大学)
;
USTC(University of Science and Technology of China)
;
NTU(National University of Technology)
;
NUS(National University of Singapore)
;
USC(University of Southern California)
;
SCU(Sichuan University)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中
后训练与偏好优化
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Toronto(多伦多大学)
;
NVIDIA(英伟达)
;
Princeton University(普林斯顿大学)
;
Salesforce Research(Salesforce研究)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.LG
FinSage: A Multi-aspect RAG System for Financial Filings Question Answering
Xinyu Wang, Jijun Chi, Zhenghan Tai, Tung Sum Thomas Kwok, Muzhi Li, Zhuhong Li, Hailin He, Yuchen Hua, Peng Lu, Suyuchen Wang, Yihong Wu, Jerry Huang, Jingrui Tian, Fengran Mo, Yufei Cui, Ling Zhou
机构
*
1SimpleWay.AI 2McGill University 3University of Toronto 4University of California, Los Angeles 5The Chinese University of Hong Kong 6Duke University 7Universit\'e de Montr\'eal 8Mila - Quebec AI Institute 9Noah's Ark Lab 10CG Matrix Technology Limited
;
1SimpleWay.AI 2McGill University 3University of Toronto 4University of California, Los Angeles
;
5The Chinese University of Hong Kong 6Duke University 7Universit\'e de Montr\'eal 8Mila - Quebec AI Institute
;
9Noah's Ark Lab 10CG Matrix Technology Limited
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.AI、cs.LG
CommentsAccepted at the 34th ACM International Conference on Information and Knowledge Management (CIKM2025)
Cultivating Helpful, Personalized, and Creative AI Tutors: A Framework for Pedagogical Alignment using Reinforcement Learning
Siyu Song, Wentao Liu, Ye Lu, Ruohua Zhang, Tao Liu, Jinze Lv, Xinyun Wang, Aimin Zhou, Fei Tan, Bo Jiang, Hao Hao
机构
*
Shanghai Innavation Institute(上海创新研究院)
;
Shanghai Institute of AI for Education(上海人工智能教育研究院)
;
School of Computer Science and Technology(计算机科学与技术学院)
;
Department of Educational Information Technology(教育信息技术系)
专题命中
后训练与偏好优化
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
The Levers of Political Persuasion with Conversational AI
Kobi Hackenburg, Ben M. Tappin, Luke Hewitt, Ed Saunders, Sid Black, Hause Lin, Catherine Fist, Helen Margetts, David G. Rand, Christopher Summerfield
机构
*
UK AI Security Institute(英国人工智能安全研究所)
;
University of Oxford(牛津大学)
;
The London School of Economics and Political Science(伦敦政治经济学院)
;
Stanford University(斯坦福大学)
;
Massachusetts Institute of Technology(麻省理工学院)
Yinuo Ren, Tesi Xiao, Michael Shavlovsky, Lexing Ying, Holakou Rahmanian
机构
*
Institute for Computational and Mathematical Engineering (ICME), Stanford University(计算与数学工程研究所(ICME),斯坦福大学)
;
Amazon(亚马逊)
;
Department of Mathematics, Stanford University(数学系,斯坦福大学)
Position Paper: Rethinking Privacy in RL for Sequential Decision-making in the Age of LLMs
Flint Xiaofeng Fan, Cheston Tan, Roger Wattenhofer, Yew-Soon Ong
机构
*
Centre for Frontier AI Research (CFAR)(前沿人工智能研究所在)
;
Institute of High Performance Computing (IHPC)(高性能计算研究所)
;
Agency for Science, Technology and Research(科技研究局)
;
D-ITET
;
ETH Zurich(苏黎世联邦理工学院)
;
CCDS, Nanyang Technological University(南洋理工大学CCDS)
专题命中
后训练与偏好优化
:large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.AI、cs.LG