arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 431 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 431 篇

2603.14579 2026-07-01 cs.CV cs.LG 版本更新 70%

Medical Image Spatial Grounding with Semantic Sampling

基于语义采样的医学图像空间定位

Andrew Seohwan Yu, Mohsen Hariri, Kunio Nakamura, Mingrui Yang, Xiaojuan Li, Vipin Chaudhary

机构 * Case Western Reserve University(凯斯西储大学) Cleveland Clinic(克利夫兰诊所)

专题命中 领域大模型 :language model(abstract);prompting(abstract);分类 cs.LG

AI总结 研究视觉语言模型在医学图像三维空间定位中的挑战,提出MIS-Ground基准和MIS-SemSam优化方法,通过语义采样提升定位精度13.06%。

Comments 10 pages, 2 figures. Accepted at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09698 2026-06-25 cs.IR cs.AI 版本更新 70%

Evaluating Scene-based In-Situ Item Labeling for Immersive Conversational Recommendation

评估基于场景的原位物品标签用于沉浸式对话推荐

Jiazhou Liang, Yifan Simon Liu, David Guo, Minqi Sun, Yilun Jiang, Scott Sanner

机构 * University of Toronto(多伦多大学) University of Waterloo(滑铁卢大学) Vector Institute of Artificial Intelligence(向量人工智能研究所)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 针对沉浸式对话推荐系统,提出基于显式意图满足和主动信息需求的原位标签分类与评估指标,基准测试显示现有方法在利用场景信息、避免冗余和预测主动需求方面存在局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01299 2026-06-25 astro-ph.IM cs.AI 版本更新 70%

Domain-Specific Agents for Cherenkov Telescope Array Control Software and Gamma-Ray Data Analysis

用于切伦科夫望远镜阵列控制软件和伽马射线数据分析的领域专用智能体

Dmitriy Kostunin, Elisa Jones, Vladimir Sotnikov, Valery Sotnikov, Sergo Golovachev, Alexandre Strube

机构 * Deutsches Elektronen-Synchrotron DESY(德意志电子同步辐射研究中心) JetBrains Limited(JetBrains有限公司) JetBrains GmbH(JetBrains德国公司) Jülich Supercomputing Centre(吕贝克超级计算中心)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出领域自适应的大语言模型智能体,结合上下文知识、自动验证和迭代修正,支持切伦科夫望远镜阵列操作与数据分析,减少人工、提高一致性并加速工作流。

Comments EuCAIFCon 2025 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19836 2026-06-23 cs.CL physics.ed-ph 版本更新 70%

A Framework for Deductive Semantic Content Analysis at Scale in Science Education Using Text Embeddings

使用文本嵌入进行科学教育中大规模演绎语义内容分析的框架

Jonas Timmann Mjaaland, Markus Fleten Kreutzer, Halvor Tyseng, Rebeckah K. Fussell, Gina Passante, N. G. Holmes, Anders Malthe-Sørenssen, Tor Ole B. Odden

机构 * Center for Interdisciplinary Education, University of Oslo(interdisciplinary Education 中心,奥斯陆大学) Laboratory of Atomic and Solid State Physics, Cornell University(原子与固体物理实验室,康奈尔大学) Department of Physics, California State University Fullerton(物理系,弗里蒙特加州州立大学) Center for Computing in Science Education, University of Oslo(科学教育计算中心,奥斯陆大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出基于文本嵌入的分类框架DeSCA,仅需少量示例即可实现大规模开放题编码,与人类编码者高度一致,并支持编码一致性审计。

Comments 47 pages plus supplementary information, 5 figures. Version 2 has been lightly edited and formatted to fit better with the field of science education research, including updating the title and adding a brief literature review of NLP methods applied to textual datasets in science education. Results are unchanged since original version

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19893 2026-06-19 cs.LG 版本更新 70%

EQPO: Equitable Group Relative Policy Optimization for Clinical Reasoning

EQPO: 面向临床推理的公平群体相对策略优化

Shiqi Dai, Wei Dai, Jiaee Cheong, Paul Pu Liang

机构 * MIT(麻省理工学院) Harvard University(哈佛大学)

专题命中 领域大模型 :foundation model(abstract);post-training(abstract);分类 cs.LG

AI总结 提出EQPO分层强化学习方法,通过自适应重加权样本促进异质临床人群的均衡学习,在7个诊断基准上降低F1标准差43.9%,缩小预测公平差距27.2%。

Comments Accepted as Oral on NeurIPS 2025 GenAI4Health Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14288 2026-06-18 astro-ph.CO cs.AI cs.CE gr-qc hep-th 版本更新 70%

DeepInflation: an AI agent for research and model discovery of inflation

DeepInflation:用于暴胀研究与模型发现的AI智能体

Ze-Yu Peng, Hao-Shi Yuan, Qi Lai, Jun-Qian Jiang, Gen Ye, Jun Zhang, Yun-Song Piao

机构 * School of Physical Sciences, University of Chinese Academy of Sciences, Beijing 100049, China International Centre for Theoretical Physics Asia-Pacific, University of Chinese Academy of Sciences, 100190 Beijing, China Taiji Laboratory for Gravitational Wave Universe, University of Chinese Academy of Sciences, 100049 Beijing, China School of Fundamental Physics Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS, Hangzhou 310024, China Institute of Theoretical Physics, Chinese Academy of Sciences, P.O. Box 2735, Beijing 100190, China D\' e partement de Physique Th\' e orique, Universit\' e de Gen\` e ve, 24 quai Ernest-Ansermet, CH-1211 Gen\` e ve 4, Switzerland

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出基于多智能体架构的AI智能体DeepInflation,集成大语言模型、符号回归引擎和检索增强生成知识库,自动发现与最新观测一致的单场慢滚暴胀势,并解释理论背景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07375 2026-06-18 cs.CL cs.SD eess.AS 版本更新 70%

TurnGuide: Enhancing Meaningful Full Duplex Spoken Interactions via Dynamic Turn-Level Text-Speech Interleaving

TurnGuide: 通过动态轮次级文本-语音交错增强有意义的全双工口语交互

Wenqian Cui, Lei Zhu, Xiaohui Li, Zhihan Guo, Haoli Bai, Lu Hou, Irwin King

机构 * The Chinese University of Hong Kong(香港中文大学) Huawei Technologies(华为技术)

专题命中 领域大模型 :language model(abstract);foundation model(abstract);分类 cs.CL

AI总结 提出TurnGuide方法,通过动态分割助手语音为对话轮次并交错生成轮次级文本和语音,解决全双工语音语言模型在连续双通道音频中集成离散文本令牌导致的时间对齐问题,显著提升语义连贯性和轮次交互性能。

Comments Interspeech 2026 Long Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00567 2026-06-18 cs.IR cs.AI 版本更新 70%

Improving Scientific Document Retrieval with Academic Concept Index

利用学术概念索引改进科学文献检索

Jeyun Lee, Junhyoung Lee, Wonbin Kweon, Bowen Jin, Yu Zhang, Susik Yoon, Dongha Lee, Hwanjo Yu, Jiawei Han, Seongku Kang

机构 * Korea University Seoul South Korea University of Illinois Urbana-Champaign Champaign United States Texas A\&M University College Station United States Yonsei University Seoul South Korea Pohang University of Science Korea University University of Illinois Urbana-Champaign Texas A\&M University Yonsei University

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对通用检索器在科学领域因词汇和需求不匹配而表现不佳的问题,提出基于学术概念索引的方法,通过概念覆盖查询生成和概念聚焦上下文扩展,提升查询质量和检索性能。

Comments Accepted for publication in ACM TIST, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26195 2026-06-17 cs.CR cs.AI 版本更新 70%

CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly

CyberEvolver:面向网络安全代理的即时结构化自我进化

Yihe Fan, Changyi Li, Lichen Xu, Xudong Pan, Jiarun Dai, Hong Geng, Min Yang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Pudong Research Institute of Cryptology(上海浦东密码研究院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 提出CyberEvolver框架,通过四层可进化架构、痕迹诊断机制和种群波束搜索,实现网络安全代理基于失败经验的支架自我进化,平均成功率提升13.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06173 2026-06-16 cs.IR cs.AI 版本更新 70%

Beyond Case Law: Evaluating Structure-Aware Retrieval and Safety in Statute-Centric Legal QA

超越判例法:评估法规中心型法律问答中的结构感知检索与安全性

Kyubyung Chae, Jewon Yeom, Jeongjae Park, Seunghyun Bae, Ijun Jang, Hyunbin Jin, Jinkwan Jang, Taesup Kim

机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对法规中心型法律问答中层级检索困难与模型幻觉问题,提出结构-安全感知基准SearchFireSafety,通过图引导检索提升性能,但揭示领域适应模型在证据缺失时更易幻觉。

Comments Accepted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21613 2026-06-16 cs.IR cs.AI 版本更新 70%

AgenticRec: A Recommendation-Oriented Agentic Framework with Progressive Tool-Integrated Reasoning Optimization

AgenticRec:面向推荐的智能体框架与渐进式工具集成推理优化

Tianyi Li, Zixuan Wang, Guidong Lei, Xiaodong Li, Hui Li

机构 * Xiamen University(厦门大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出AgenticRec框架,将推荐建模为工具集成推理过程,并设计两阶段训练范式,通过隐式反馈激活和渐进偏好细化提升推荐准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16073 2026-06-15 cs.CL 版本更新 70%

ClaimFlow: Tracing the Evolution of Scientific Claims in NLP

ClaimFlow: 追踪自然语言处理中科学主张的演变

Aniket Pramanick, Yufang Hou, Saif M. Mohammad, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab)(通用知识处理实验室) Department of Computer Science and Hessian Center for AI (hessian.AI)(计算机科学系和海斯曼人工智能中心) Technische Universität Darmstadt(德累斯顿技术大学) IT:U Interdisciplinary Transformation University Austria(奥地利跨学科转型大学) National Research Council Canada(加拿大国家研究委员会)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出ClaimFlow框架,通过标注1617篇论文中的5689个主张和4871个跨论文关系,定义主张关系分类任务,并分析NLP领域主张的演变模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07590 2026-06-12 cs.IR cs.AI 版本更新 70%

DCD: Domain-Oriented Design for Controlled Retrieval-Augmented Generation

DCD:面向领域的受控检索增强生成设计

Valerii Kovalskii, Nikita Belov, Nikita Miteyko, Igor Reshetnikov, Maksim Maksimov

机构 * red_mad_robot

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出DCD(领域-集合-文档)层次化设计,通过结构化知识表示和多阶段路由控制检索与生成范围,无需修改语言模型,提升RAG在异构语料和多步查询中的鲁棒性和准确性。

Comments 14 pages, 4 figures, 2 links, link to HF https://huggingface.co/datasets/redmadrobot-rnd/dcd, link to GIT https://github.com/redmadrobot-rnd/dcd

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08134 2026-06-10 cs.AI cs.CY 版本更新 70%

Position: The ML Community Must Build an AI-Augmented Peer-Review Ecosystem

立场:机器学习社区必须构建AI增强的同行评审生态系统

Qiyao Wei, Samuel Holt, Jing Yang, Markus Wulfmeier, Mihaela van der Schaar

机构 * University of Amsterdam(阿姆斯特丹大学) University of Cambridge(剑桥大学) ETH Zurich(苏黎世联邦理工学院) University of California, Berkeley(加州大学伯克利分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对ML领域稿件激增导致同行评审危机,本文主张将AI辅助评审作为优先研究课题,提出利用大语言模型作为协作工具,增强事实核查、评审指导、作者改进和决策支持,并强调需要更细粒度的评审数据。

Comments 18 pages, 3 figures. Accepted (Oral) at the ICML 2026 Position Paper Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16092 2026-06-09 cs.CL 版本更新 70%

Chatlaw: A Multi-Agent Legal Assistant based on a Role-Aligned Mixture-of-Experts Architecture

Chatlaw: 基于角色对齐的混合专家架构的多智能体法律助手

Jiaxi Cui, Munan Ning, Zongjian Li, Bohua Chen, Yang Yan, Hao Li, Bin Ling, Yonghong Tian, Li Yuan

机构 * Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Peng Cheng Laboratory(鹏城实验室) Law School, Peking University(北京大学法学院) Pandalla.ai

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出Chatlaw多智能体法律助手,采用角色对齐的混合专家架构模拟律所协作流程,在LawBench基准上准确率比GPT-4提升7.73%,并通过真实案例验证。

Comments Accepted manuscript. Updated to match the journal version and added DOI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07380 2026-06-08 cs.CL 版本更新 70%

Mining Useful General Data for Low-Resource Domain Adaptation

挖掘低资源领域适应的有用通用数据

Pingjie Wang, Hongcheng Liu, Yusheng Liao, Ziqing Fan, Yaxin Du, Shuo Tang, Yanfeng Wang, Yu Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 针对低资源领域数据稀缺问题,提出NTK-Selector方法,利用神经正切核从通用数据中筛选有用样本,显著提升领域适应效果。

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05232 2026-06-08 cs.AI 版本更新 70%

ChemQuests: A Curated Chemistry Question-Answer Database Extracted from ChemRxiv papers

ChemQuests: 从ChemRxiv论文中提取的精选化学问答数据库

Mahmoud Amiri, Thomas Bocklitz

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出ChemQuests数据集,包含从155篇ChemRxiv论文中提取的952个高质量问答对,覆盖17个化学子领域,用于化学NLP研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31032 2026-08-17 cs.SE cs.CY 版本更新 67%

Structuring license permissiveness from pairwise comparisons

软件许可证的部分排序

Hamidah Oderinwale, David Atkinson, Rachel Hong, Art Abal, Ben Laufer

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文利用大语言模型对软件许可证进行成对比较,构建基于宽松度的部分排序,并结合现有分类法分析许可证选择,揭示更严格许可证的可解释属性及其对开源生态的法律影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11973 2026-08-14 cs.IR 版本更新 67%

Sci-Surf: Navigating Scientific Literature Discovery through Human Feedback and Intelligent Summarization

Sci-Surf:通过人类反馈与智能摘要实现科学文献发现

Fang Guo, Qi Zhu, Rongcan Pei, Shuqi He, Hui Chen, Yue Zhang

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 针对现有学术发现平台支持不足的问题,提出以意图为中心的Sci-Surf系统,结合反馈驱动推荐与多模态论文消化,经评估推荐质量和消化质量有可测量提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11955 2026-08-14 cs.CY cs.HC 版本更新 67%

Philosophical vertigo with artificial intelligence

人工智能引发的哲学眩晕

Thomas A. Pollak, Hamilton Morrin, Murray Shanahan

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出人工智能引发的哲学眩晕概念,分析其产生、传播路径,关联临床妄想案例,指出AI将参与重构人类认知环境,并提出哲学可修正性作为应对对策。

Comments 29 pages, no figures. Source formatting revised to improve arXiv HTML accessibility; article text unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07516 2026-08-14 cs.HC 版本更新 67%

Catch the Patient, Not the AI: Collective Sensemaking in an Online Health Community

关注患者,而非AI:在线健康社区中的集体意义建构

Feng He

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究以中国最大淋巴瘤在线社区House086为对象,分析337条ChatGPT后记录,发现社区不系统审核AI,而是将AI答案放回多判断来源,仍聚焦患者而非AI。

Comments 20 pages, 3 figures, 8 tables including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02311 2026-08-11 econ.EM q-fin.RM q-fin.ST 版本更新 67%

AI Governance for Institutional Readiness in Finance

金融领域机构准备状态的AI治理

Irene Aldridge, Steve Krawciw

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 针对金融领域智能体AI治理滞后于部署的问题,本文提出四层可计算AI治理框架,通过实证研究验证其有效性并给出90天实施序列,明确跨主体风险控制的可转移措施。

Comments 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03240 2026-08-11 cs.SI cs.DL 版本更新 67%

Generalization and the Rise of System-level Creativity in Science

泛化与科学中系统级创造力的兴起

Hongbo Fang, James Evans

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究通过分析科学出版物的引用网络,发现科学贡献可分为基础、扩展和泛化三种功能类型,揭示了科学生产模式从学科内部转向学科间接口的趋势,揭示了数字知识基础设施驱动的科学结构重组。

Comments 125 pages, 60 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02323 2026-08-06 cs.SE 版本更新 67%

ECLAIR: A Causally-Grounded AI Framework for Scientific Discovery in Empirical Software Engineering

ECLAIR:一种用于实证软件工程科学发现的因果基础AI框架

Alejandro Velasco, Daniel Rodriguez-Cardenas, Dipin Khati, David N. Palacio, Denys Poshyvanyk

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该研究提出因果基础AI框架ECLAIR,将LLMs整合到软件工程科学过程各阶段,通过案例研究揭示提示设计对LLMs代码生成准确率的影响,为AI辅助软件工程实证研究提供方法论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13099 2026-08-06 cs.CV 版本更新 67%

Industrial Synthetic Segment Pre-training

工业合成片段预训练

Shinichi Mae, Hirokatsu Kataoka, Ryousuke Yamada, Yoshihiro Fukuhara, Risa Shinoda, Christian Rupprecht

机构 * TICO-AIST Cooperative Research Lab for Advanced Logistics, Japan(TICO-AIST先进物流联合研究实验室,日本) National Institute of Advanced Industrial Science and Technology (AIST), Japan(日本国家先进工业科学与技术研究院) Visual Geometry Group, University of Oxford, UK(牛津大学视觉几何组)

专题命中 领域大模型 :foundation model(abstract,abstract_cn)

AI总结 该研究提出基于FDSL的InsCore合成数据集,在不使用真实图像的情况下预训练的分割模型,在5个领域的表现与ImageNet-21k预训练模型相当,解决了工业分割模型对真实图像的依赖问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05621 2026-08-04 cs.IR 版本更新 67%

ANCHOR: Agentic Noise Creation Framework for Human Simulation and Denoising Recommendation

ANCHOR: 用于人类模拟和去噪推荐的智能体噪声创建框架

Xiangming Li, Hua Chu, Jiaming Liang, Jianan Li, Yangtao Zhou

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 提出ANCHOR框架,通过智能体模拟用户行为生成真实噪声标签,将推荐去噪转化为监督学习问题,实现高效噪声识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17310 2026-08-04 cs.CR 版本更新 67%

Cryptanalysis of LDPC-Based Pseudorandom Error-Correcting Codes

基于LDPC的伪随机纠错码的密码分析

Tianrui Wang, Anyu Wang, Tianshuo Cong, Delong Ran, Jinyuan Liu, Xiaoyun Wang

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 首次对LDPC-PRC进行密码分析,提出三种攻击破坏其不可检测性和安全性,在DeepSeek和Stable Diffusion等模型上验证有效,并给出防御建议。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08090 2026-08-04 cs.SE cs.HC 版本更新 67%

Crossing Margins: Intersectional Users' Ethical Concerns about Software

跨越边际:交叉性用户对软件的伦理关切

Lauren Olson, Tom P. Humbert, Ricarda Anna-Lena Fischer, Bob Westerveld, Florian Kunneman, Emitzá Guzmán

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究针对交叉性用户软件伦理关切研究空白,收集700多个交叉性Subreddits的36777条帖子,利用大语言模型等技术分析交叉性声音,构建反馈驱动框架评估软件对交叉性用户需求的满足度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08466 2026-07-31 cs.IR 版本更新 67%

ToolRec: Calibrated Preference Alignment for Query Recommendation in On-Device Assistants

ToolRec: 面向设备端助手的校准偏好对齐查询推荐

Zihan Luo, Lingkui Chen, Ruike Zhang, Hong Huang, Boyang Zhang, Ziniu Chen, Lizhong Wang, Chao Chen

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出ToolRec框架,通过构建系统工具库和双层校准机制优化点击数据,利用加权KTO对齐模型,在设备端助手查询推荐中提升点击率和相关性。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11840 2026-07-31 cs.HC 版本更新 67%

AI-Assisted Data Extraction for Systematic Reviews in Education

教育领域系统综述的AI辅助数据提取

Noah L. Schroeder, Chris Davis Jaldi, Shan Zhang, Kweku Yamoah

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本研究针对教育领域系统综述中LLMs应用不足的问题,通过两项实证研究发现LLMs数据提取准确性不足,提出人在回路工作流程并开发相关开源工具,为AI辅助数据提取提供可行方案。

详情

展开后加载摘要…

URL PDF HTML 收藏