LongCrafter: Towards Diverse Long-Context Understanding via Evidence-Graph-Guided Instruction Synthesis
LongCrafter:通过证据图引导的指令合成实现多样化的长上下文理解
Chenhao Yuan, Yinhao Xu, Shuwen Xu, Xizhi Yang, Jiaxiang Liu, Chenxi Zhou, Shaoping Huang, Haolin Ren, Pengfei Cao, Jun Zhao, Kang Liu
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所认知与决策智能复杂系统重点实验室)
专题命中
指令微调
:SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
RASFT: Rollout-Adaptive Supervised Fine-Tuning for Reasoning
RASFT: 用于推理的滚动自适应监督微调
Yongliang Miao, Fengyuan Liu, Wei Shi, Yanguang Liu, Fei Sun, Na Zou, Mengnan Du
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
New Jersey Institute of Technology(新泽西理工学院)
;
Institute of Computing Technology, CAS(中国科学院计算技术研究所)
专题命中
指令微调
:SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation
APEX-Searcher: 通过子目标细化信用分配以增强智能体检索增强生成
Kun Chen, Qingchao Kong, Zhao Feifei, Wenji Mao
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部)
;
Wenge Technology Co., Ltd(Wenger科技有限公司)
专题命中
指令微调
:SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Investigating Cross-Modal Skill Injection: Scenarios, Methods, and Hyperparameters
探究跨模态技能注入:场景、方法与超参数
Zhiyu Xu, Lean Wang, Yuanxin Liu, Lei Li, Hao Zhou, Fandong Meng, Jie Zhou, Xu Sun
机构
*
State Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学)
;
WeChat AI, Tencent Inc., China(腾讯公司,中国)
;
The University of Hong Kong(香港大学)
专题命中
指令微调
:LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)
PriorZero: Bridging Language Priors and World Models for Decision Making
PriorZero:连接语言先验与世界模型以实现决策制定
Junyu Xiong, Yuan Pu, Jia Tang, Yazhe Niu
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Nanjing University of Aeronautics and Astronautics(南京航空航天大学)
;
The Chinese University of Hong Kong MMLab(香港中文大学MMLab)
专题命中
指令微调
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
安全对齐作为持续学习:通过正交梯度投影缓解对齐税
Guanglong Sun, Siyuan Zhang, Liyuan Wang, Jun Zhu, Hang Su, Yi Zhong
机构
*
School of Life Sciences, IDG/McGovern Institute for Brain Research(生命科学学院,IDG/麦戈文脑科学研究所)
;
Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center(计算机科学与技术系,人工智能研究所,清华大学-博世联合机器学习中心,THBI实验室,BNRist中心)
;
Tsinghua University, Beijing, China(清华大学,北京,中国)
专题命中
指令微调
:SFT(abstract,abstract_cn);large language model(abstract);language model(abstract);post-training(abstract)
Emergent Slow Thinking in LLMs as Inverse Tree Freezing
大语言模型中涌现的慢思考作为逆树冻结
Sihan Hu, Xiansheng Cai, Yuan Huang, Zhiyuan Yao, Linfeng Zhang, Pan Zhang, Youjin Deng, Kun Chen
机构
*
Hefei National Laboratory, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室)
;
Hefei National Laboratory for Physical Sciences at the Microscale and Department of Modern Physics, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室和现代物理系)
;
Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所)
;
School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院基础物理与数学科学学院)
;
DP Technology(DP技术)
;
Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics, Lanzhou University(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科省重点实验室、兰州大学)
;
AI for Science Institute, Beijing(北京人工智能科学研究院)
专题命中
指令微调
:LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)
机构
*
Tencent AI for Life Sciences Lab(腾讯AI生命科学实验室)
;
Sun Yat-sen University(中山大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Westlake University(西湖大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)
Siren: A Learning-Based Multi-Turn Attack Framework for Simulating Real-World Human Jailbreak Behaviors
Yi Zhao, Youzhi Zhang
机构
*
Department of Computing The Hong Kong Polytechnic University Hong Kong SAR, China
;
Centre for Artificial Intelligence
;
Robotics Hong Kong Institute of Science \& Innovation Chinese Academy of Sciences Hong Kong SAR, China
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)