IterQR: An Iterative Framework for LLM-based Query Rewrite in e-Commercial Search System
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);pretraining(abstract);post-training(abstract);preference optimization(abstract)
Comments Project in development. Github: https://github.com/jefferyZhan/Griffon/tree/master/Vision-R1
专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);RLHF(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :RLHF(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract);large language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
Comments Accepted by ICLR 2025
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract);large language model(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)
Comments Pre-print
专题命中 后训练与偏好优化 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments Accepted by AAAI 2025
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
Comments EMNLP 2024 Main, Final Version
专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);SFT(abstract);RLHF(abstract)
Comments EMNLP 2024 Main
专题命中 后训练与偏好优化 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract);large language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments Accepted to EMNLP 2024 (Findings)
专题命中 后训练与偏好优化 :LLM(title);large language model(abstract);language model(abstract);RLHF(abstract)
Comments 16 pages, 2 figures, 14 tables
Journal ref ICML 2024
专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);RLHF(abstract);prompting(abstract)
Comments Accepted at ICLR 2024. 28 pages, 5 figures, 4 tables
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)
专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)
专题命中 后训练与偏好优化 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);SFT(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract);RLHF(abstract);preference optimization(abstract)
专题命中 后训练与偏好优化 :RLHF(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)
Comments Accepted by CVPR 2024
专题命中 后训练与偏好优化 :RLHF(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)
专题命中 后训练与偏好优化 :language model(title,abstract);LLM(abstract,comments);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Website: https://sites.google.com/view/llm-vas
MCTS-KBQA:基于信息增益奖励的知识库问答蒙特卡洛树搜索
专题命中 后训练与偏好优化 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
AI总结 该研究针对基于LLM的KBQA中MCTS应用的奖励设计与计算成本问题,提出Fast MCTS方法,以信息增益奖励替代中间状态终端展开,在四个KBQA基准上提升了准确率-成本权衡。
Comments Accepted to CIKM 2026