CHARM: A Multimodal Graph Foundation Model with Hierarchical Context Modeling for Zero-Shot Transfer
CHARM:一种用于零样本迁移的具有分层上下文建模的多模态图基础模型
Ankang Yang, Jitao Zhao, Di Jin, Yuxiao Huang, Dongxiao He
机构
*
School of Computer Science and Technology, College of Intelligence and Computing, Tianjin University(天津大学智能与计算学部计算机科学与技术学院)
;
Data Science Program, Columbian College of Arts and Sciences, The George Washington University(乔治华盛顿大学文理学院哥伦比亚艺术与科学学院数据科学项目)
专题命中
指令微调
:foundation model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)
Beyond Trajectory Imitation: Strategy-Guided Policy Optimization for LLM Reasoning
超越轨迹模仿:策略引导的策略优化用于大语言模型推理
Tianyuan Shi, Canbin Huang, Bei Li, Xin Chen, Xiaojun Quan, Jingang Wang, Qifan Wang
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院)
;
Meituan, Inc., China(美团)
;
Shenzhen Loop Area Institute, China(深圳环区研究所)
;
Meta AI, USA(Meta AI)
Reinforcement Learning Improves LLM Accuracy and Reasoning in Disease Classification from Radiology Reports
强化学习提升LLM在放射学报告疾病分类中的准确性和推理能力
Yishu Wei, Yi Lin, Adam Flanders, George Shih, Yifan Peng
机构
*
Department of Population Health Sciences, Weill Cornell Medicine, New York, NY(人口健康科学系,韦尔·柯林斯医学中心,纽约,NY)
;
Department of Radiology, Weill Cornell Medicine, New York, NY(放射科,韦尔·柯林斯医学中心,纽约,NY)
;
Department of Radiology, Thomas Jefferson University, Philadelphia, PA(放射科,托马斯·杰斐逊大学,费城,PA)
The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training
对齐的艺术:细调方法如何有效地对齐和重新对齐训练后的LLM
Rui Zhang, Hongwei Li, Yun Shen, Xinyue Shen, Wenbo Jiang, Guowen Xu, Yang Liu, Michael Backes, Yang Zhang
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Flexera
;
CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心)
;
Nanyang Technological University(南洋理工大学)
专题命中
指令微调
:post-training(title);LLM(abstract);large language model(abstract);language model(abstract)
机构
*
Beijing Wenge Technology Co., Ltd.(北京文歌科技有限公司)
;
Hebei Provincial Hospital of Traditional Chinese Medicine(河北省中医院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Tianjin University(天津大学)
专题命中
指令微调
:LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)