arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-29 至 2026-07-29 共收录 286 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 46 篇

2607.24829 2026-07-29 cs.IR cs.LG 新提交 90%

Improving Rare Medication Recommendation with Counterfactual Data Augmentation and Large Language Models

通过反事实数据增强和大语言模型改进罕见药物推荐

Shinhwan Kang, Soo Yong Lee, Jaewon Kim, Kijung Shin, Buru Chang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

AI总结 针对现有方法在推荐罕见药物时性能低的问题,提出GenRxR框架,利用大语言模型生成反事实数据缓解数据稀缺,集成大语言模型建模联合推荐药物关系,经指令调整增强临床推理,实验显示其性能优于多个基线。

Comments Accepted for publication at the 20th ACM Conference on Recommender Systems (RecSys 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09181 2026-07-29 cs.DB 版本更新 89%

Evaluating the Practical Effectiveness of LLM-Driven Index Tuning on Microsoft SQL Server

评估基于大语言模型的索引优化的实用性效果:微软数据库优化顾问

Xiaoying Wang, Wentao Wu, Vivek Narasayya, Surajit Chaudhuri

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本文通过工业基准和真实企业工作负载评估LLM驱动的索引优化效果,对比微软数据库优化顾问(DTA),发现LLM在部分情况下能提供更优执行时间配置,但生产环境中应用仍面临性能波动、集成影响和验证成本等挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06703 2026-07-29 cs.CY 89%

Mapping and Comparing Climate Equity Policy Practices Using RAG LLM-Based Semantic Analysis and Recommendation Systems

利用基于 RAG LLM 的语义分析和推荐系统映射和比较气候公平政策实践

Seung Jun Choi

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文利用基于RAG LLM的语义分析和推荐系统,研究气候公平政策实践的比较与映射,揭示规划领域在AI时代的核心职责与政策趋势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14429 2026-07-29 cs.DL cs.AI cs.CY cs.ET 版本更新 88%

Measuring the State of Open Science in Transportation Using Large Language Models

利用大型语言模型衡量交通运输领域开放科学的状态

Junyi Ji, Ruth Lu, Linda Belkessa, Liming Wang, Silvia Varotto, Yongqi Dong, Nicolas Saunier, Mostafa Ameli, Gregory S. Macfarlane, Bahman Madadi, Cathy Wu

机构 * Massachusetts Institute of Technology(麻省理工学院) Vanderbilt University(范德比大学) Portland State University(波特兰州立大学) Delft University of Technology(代尔夫特理工大学) Brigham Young University(Brigham Young 大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文利用大型语言模型自动评估交通研究中数据和代码的开放科学实践,发现仅有少数论文共享代码或数据,揭示了开放科学与传统学术指标之间的不一致,需通过结构性干预促进实践改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25630 2026-07-29 cs.CL cs.AI cs.HC 新提交 88%

A Human-in-the-Loop Corpus for LLM-Based Simplification of Scientific Summaries

用于基于大语言模型的科学摘要简化的人工参与语料库

Kyuri Im, Michael Färber

机构 * ScaDS.AI, Technische Universität Dresden(ScaDS.AI,德累斯顿工业大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究基于大语言模型的科学文本简化,提出人工参与工作流程,先以GPT-4o-mini生成基线简化,再经不同阶段读者与专家反馈编辑,发布语料库及评估结果,支持跨学科科学交流简化系统相关工作。

Comments Accepted at FGWM@KI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02061 2026-07-29 cs.IR 版本更新 88%

Reason4Rec: Deliberative User Preference Alignment of Large Language Models for Recommendation

Reason4Rec:用于推荐的大语言模型的审慎用户偏好对齐

Yi Fang, Wenjie Wang, Yang Zhang, Fengbin Zhu, Qifan Wang, Fuli Feng, Xiangnan He

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 研究旨在开发更可靠的推荐LLMs,引入“审慎推荐”任务并提出“推理驱动的推荐器”框架,利用语言化用户反馈增强推理能力,经实验验证该框架能提升预测准确性和推理质量。

Comments Accepted to IEEE TKDE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24793 2026-07-29 cs.IR cs.CL 新提交 87%

Retrieval, not hallucinations, will be the limiting factor for LLM-based clinical AI tools

检索而非幻觉将成为基于大语言模型的临床人工智能工具的限制因素

Kirk Roberts, Steven Bedrick, Kurt Miller, William R. Hersh, Hongfang Liu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 探讨临床人工智能中基于大语言模型的错误,将讨论重点从精度错误转向召回错误,特别是患者级数据检索方面,概述错误类型、缓解策略及研究方向,提供检索评估概述。

Comments Perspective piece

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24817 2026-07-29 cs.IR cs.AI cs.CL 新提交 87%

Retrieval-Augmented Generation in LLMs for Mental Health: Quantifying the Incremental Contribution of Retrieval Within a Layered Safety Architecture

大语言模型在心理健康领域的检索增强生成:量化分层安全架构中检索的增量贡献

Anand Gupta, Akshat Surolia, Shubham Mishra, Shakil Imtiaz, Chaitali Sinha

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究数字心理健康干预中,通过在名为Wysa的DMHI里对比启用和禁用检索增强生成(RAG)模式,评估六个大语言模型,计算相关指标并测试差异,发现RAG虽致误报增加,但符合安全原则,是提升LLM驱动的DMHIs相关性能的有前景方法。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24859 2026-07-29 cs.CR 新提交 87%

The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation

大语言模型护栏的幻象:人工智能辅助医疗记录操纵的案例研究

Davis Yadav, Amulya Yadav

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究大语言模型在医疗记录操纵场景下内置护栏的可靠性,通过开发操纵流程、实证评估、利用多种指标评估及用户研究,揭示其弱点,为大语言模型在医疗领域的护栏设计、安全政策及伦理等方面提供参考。

Comments 10 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25471 2026-07-29 cs.AI cs.MM 新提交 86%

TRWH: A Text-Driven Random Walk Heterogeneous GNN for Semantic-Aware Sparse Recommendation

TRWH:用于语义感知稀疏推荐的文本驱动随机游走异构图神经网络

He Ma, Chen Liu

机构 * The University of Sydney(悉尼大学) Nankai University(南开大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对稀疏推荐中整合GNN与LLM优势的挑战,提出TRWH框架,通过随机游走增强融合文本概要与异构图结构,含嵌入创建、异构图神经网络、随机游走路径构建三组件,实验表明其在时尚和美妆数据集上性能远超现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25446 2026-07-29 cs.AI cs.LG 新提交 86%

Toward an Organizational Science of Multi-Agent LLM Systems: Decoupling Who, How, and Which Algorithm

迈向多智能体大语言模型系统的组织科学:解耦谁、如何以及使用哪种算法

Huan Chen, Xiang Song, Jian Jin, Pan Ren, Liang-Jie Zhang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究多智能体大语言模型系统中组织、协调与协作协议问题,IMACS 将三者分离,通过对照比较和自适应组织路由学习协议,揭示责任分配位置影响结果,强调组织设计需依模型重新验证或学习。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24869 2026-07-29 cs.IR cs.CL cs.LG 新提交 86%

Ranked by Position: Order Sensitivity as an Exploitable Attack Surface in LLM Listwise Recommenders

按位置排序:顺序敏感性作为大语言模型列表式推荐器中可利用的攻击面

Ge Zhang, Jingru Cheng, Huiyuan Chen

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究大语言模型列表式推荐器中因位置偏差产生的顺序敏感性攻击面,引入“promo@k”量化漏洞,通过实验得出不同方法对其的影响,证明输入候选顺序是安全相关攻击向量。

Comments 13 pages, 6 figures, 11 tables. Code and data available at https://github.com/geoz-lab/position_bias_attack

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25420 2026-07-29 cs.IR cs.AI 新提交 84%

MARS: Multi-Agent Re-ranking for Repeat-Order Food Delivery Recommendation

MARS:用于重复订单食品配送推荐的多智能体重排

Jiahao Tian, Zhenkai Wang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究针对重复订单食品配送推荐,提出MARS模块化多智能体重排框架,分两阶段推荐,结合多种信号与推理。通过实验评估,贡献包括给出集成框架、证明预训练主干结合轻量级检索有竞争力、建立可重现评估设置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24743 2026-07-29 cs.CV cs.AI cs.CL 版本更新 84%

ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding

ClinFusion:用于整体医学理解的以视觉为中心的多模态大语言模型系统

Hangjie Yuan, Yichen Qian, Zhiwei Tang, Xianzhe Xu, Lirong Wu, Sicheng Yang, Jinwang Wang, Pengju Wang, Zhitao Zeng, Yizeng Han, Yan Xing, Shengxuan Luo, Tao Feng, Qing Xie, Weigen Yao, Yi Yang, Zuozhu Liu, Jiasheng Tang, Shaocheng Wang, Jitao Wang, Jiahong Dong, Weihua Chen, Feng Xu, Fan Wang

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Laboratory(湖畔实验室) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Department of Radiology, The Affiliated Yangming Hospital of Ningbo University(宁波大学附属阳明医院放射科) Zhejiang University-University of Illinois Urbana-Champaign Institute, Zhejiang University(浙江大学伊利诺伊大学厄巴纳香槟校区联合学院,浙江大学) Hepato-Pancreato-Biliary Center, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua Medicine, Tsinghua University(清华长庚医院肝胆胰中心,清华大学临床医学院,清华医学,清华大学) School of Software, Tsinghua University(清华大学软件学院) Beijing National Research Center for Information Science and Technology, Tsinghua University(清华大学北京信息科学与技术国家研究中心)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究针对多模态大语言模型在医学领域部署的挑战,提出ClinFusion,采用组合级联视觉编码器架构和视觉基础评估框架,在多模态医学基准测试中表现优异,超越开源和专有模型,经专家盲评验证效果良好。

Comments Code: https://github.com/alibaba-damo-academy/ClinFusion Models: https://huggingface.co/collections/Alibaba-DAMO-Academy/clinfusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00176 2026-07-29 cs.IR cs.AI 81%

Effectiveness of LLMs in Temporal User Profiling for Recommendation

在推荐系统中利用大语言模型进行时间用户画像的有效性

Milad Sabouri, Masoud Mansoury, Kun Lin, Bamshad Mobasher

机构 * DePaul University, USA(德保罗大学) Delft University of Technology, Netherlands(代尔夫特理工大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了大语言模型在时间用户画像中的有效性,发现其在用户活跃度高的领域表现更好,但计算成本较高,且在不同领域中效果存在差异。

Comments Accepted to the IEEE International Conference on Data Mining (ICDM 2025), Workshop on User Modeling and Recommendation (UMRec). To appear in the IEEE ICDMW 2025 proceedings

Journal ref 2025 IEEE International Conference on Data Mining Workshops (ICDMW), pp. 2330-2335, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25415 2026-07-29 cs.AI 新提交 79%

A Control System, a Dataset, and a Recipe for Making Frozen LLM Agents Learn a Domain

一种用于使冻结的语言模型智能体学习领域的控制系统、数据集和方法

Debjyoti Paul

机构 * Meta AI

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 研究如何让冻结的语言模型智能体学习领域,核心方法是将框架视为特定动作空间,用经典强化学习在线学习策略并以多目标奖励评分,贡献包括用DSPy实例化系统并评估,还发布相关代码、任务套件、训练日志及部署方法。

Comments 8 pages, 1 figure, 3 tables. Code and dataset: https://github.com/dpaul0501/context-optimization-rl

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25366 2026-07-29 cs.IR cs.LG 新提交 79%

Sharpness-aware Model Merging with Salience Recovery for LLM-based Cross-Domain Sequential Recommendation

基于大语言模型的跨域序列推荐的锐度感知模型融合与显著性恢复

Huwei Ji, Jiajie Su, Yuyuan Li, Xiaohua Feng, Chaochao Chen

专题命中 领域大模型 :LLM(title,abstract);分类 cs.LG

AI总结 研究基于大语言模型的跨域序列推荐中的问题,提出SharpRec框架,包含锐度感知几何对齐和偏好显著性激活模块,有效解决跨域知识冲突和性能饱和问题,实验证明其性能优于现有基准。

Comments Published in Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD '26). 12 pages, 6 figures, 4 tables. Code available at https://github.com/muyiahhh/SharpRec

Journal ref Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.2 (KDD '26), August 9-13, 2026, Jeju Island, Republic of Korea, ACM, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00435 2026-07-29 cs.CV cs.AI 版本更新 79%

Detect Before You Leap: Mirage Detection in Vision-Language Models

在跳跃前检测:视觉语言模型中的幻象检测

Sayeed Shafayet Chowdhury, Md. Shaown Miah, S. M. Taiabul Haque, Syed Ishtiaque Ahmed

机构 * Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校) Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 针对视觉语言模型在缺乏视觉证据时产生自信但无根据回答的幻象问题,提出文本条件层内对齐方法,通过分析视觉编码器各层补丁令牌与问题嵌入的对齐轨迹,结合像素统计、零样本域路由和结构化自评估,实现高精度预响应幻象检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27720 2026-07-29 cs.AI 版本更新 79%

Why Does Grounding Hurt Medical VQA? Benchmarking, Diagnosis, and Fine-Tuning of Vision-Language Models

对前沿视觉-语言模型进行审计以实现可信的医学视觉问答:定位失败、格式崩溃和领域适应

Xupeng Chen, Binbin Shi, Chenqian Le, Qifu Yin, Lang Lin, Haowei Ni, Ran Gong, Panfeng Li

机构 * New York University, New York, USA(纽约大学) Tsinghua University, Beijing, China(清华大学) Columbia University, New York, USA(哥伦比亚大学) University of Michigan, Ann Arbor, USA(密歇根大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 本文审计了五种前沿视觉-语言模型在医学视觉问答中的表现,发现定位失败和格式崩溃是信任瓶颈,通过领域适应可提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00214 2026-07-29 cs.CV cs.AI 79%

A Geometric Multimodal Foundation Model Integrating Bp-MRI and Clinical Reports in Prostate Cancer Classification

一种整合Bp-MRI和临床报告的几何多模态基础模型用于前列腺癌分类

Juan A. Olmos, Antoine Manzanera, Fabio Martínez

机构 * Biomedical Imaging, Vision and Learning Laboratory (BIVL$^2$ab), UIS, Colombia(生物医学成像、视觉与学习实验室(BIVL²ab), UIS,哥伦比亚) U2IS, ENSTA, Institut Polytechnique de Paris, France(U2IS, ENSTA,巴黎理工学院,法国)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 本文提出MFM-Geom模型,通过整合Bp-MRI和临床报告,利用几何方法提升前列腺癌分类的准确性和鲁棒性。

Comments Accepted at IEEE International Symposium on Biomedical Imaging (ISBI) 2026

Journal ref 2026 IEEE 23rd International Symposium on Biomedical Imaging (ISBI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09636 2026-07-29 cs.CL cs.CY cs.DL 79%

Towards understanding evolution of science through language model series

Junjie Dong, Zhuoqi Lyu, Qing Ke

机构 * City University of Hong Kong(香港城市大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL

Journal ref ACM Transactions on Intelligent Systems and Technology 17, 114 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23197 2026-07-29 cs.LG cs.AI 交叉投稿 79%

Domain-Prior-Regularized Graph Modeling for Anomaly Detection in Cyber-Physical Systems

用于网络物理系统异常检测的域先验正则化图建模

Youngseok Hwang, Joonsung Kwon, Geonwoo Lee, Hyunwoo Park

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 针对网络物理系统多变量传感器时间序列异常检测,提出DPR-GM框架,利用大语言模型提取传感器对物理耦合,经皮尔逊相关性调制和传感器级可靠性加权,在SKAB基准测试中优于多种基线。

Comments 12 pages, ICML 2026 AI for Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25651 2026-07-29 cs.PL cs.SE 新提交 78%

Demystifying Deep Learning Compiler Frontend Bugs: An LLM-Aided Empirical Study

揭开深度学习编译器前端错误的神秘面纱:一项基于大语言模型辅助的实证研究

Xinyi Yuan, Wei Chen, Jinyi Liu, Pengyu Chen, Jun Wei, Guoquan Wu, Jiaxin Zhu, Tao Huang

专题命中 领域大模型 :LLM(title,abstract)

AI总结 对PyTorch 2默认深度学习编译器前端TorchDynamo的fBug展开首次系统实证研究,借助领域知识增强的大语言模型辅助方法,分析fBug并构建分类法,生成测试用例,发现多个新fBug,为深度学习编译器开发和测试提供见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25603 2026-07-29 cs.SE 新提交 78%

Input Relation Prompting for Metamorphic Testing on Query-Based Systems

基于输入关系提示的查询系统变质测试

Eng-Shen Tu, Shin-Jie Lee

专题命中 领域大模型 :prompting(title,abstract)

AI总结 针对查询系统测试难题,提出通过提示输入输出关系的变质关系识别方法,不依赖预定义测试用例或基本事实,可结合其他测试方法,经案例研究验证其适用性与潜力,推动变质测试发展,提高测试效率。

Comments 18 pages

Journal ref Journal of Information Science and Engineering, Vol. 41, No. 1, pp. 43-60 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27176 2026-07-29 cs.CV 版本更新 78%

MEDIC-AD: Towards Medical Vision-Language Model's Clinical Intelligence

MEDIC-AD:迈向医疗视觉-语言模型的临床智能

Woohyeon Park, Jaeik Kim, Sunghwan Steve Cho, Pa Hong, Wookyoung Jeong, Yoojin Nam, Namjoon Kim, Ginny Y. Wong, Ka Chun Cheung, Jaeyoung Do

机构 * AIDAS Laboratory, Seoul National University(首尔大学AIDAS实验室) Samsung Changwon Hospital(三星昌原医院) Samsung Medical Center(三星医疗中心) NVIDIA, Santa Clara, USA(英伟达(美国圣克拉拉))

专题命中 领域大模型 :language model(title,abstract)

AI总结 MEDIC-AD通过分阶段框架提升医疗视觉-语言模型在病变检测、症状跟踪和视觉可解释性方面的性能,实现临床应用中的最优表现。

Journal ref CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24459 2026-07-29 cs.AI 版本更新 77%

From Execution to Capability: Scientific Experience Consolidation via Procedural Knowledge Synthesis

从执行到能力:通过过程知识合成进行科学经验巩固

Liwei Dong, Jiahao Zhao, Nan Xu

机构 * XScience Lab(X科学实验室) Wenge AI(文阁人工智能)

专题命中 领域大模型 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

AI总结 研究科学计算经验巩固问题,引入SciConsolidate方法,通过对比成败归纳跨任务过程,经开发验证门选择,用失败告知等扩展数据,克服抽象执行差距,在SciCode上实验,为科学计算建立经验到能力途径及自我改进起点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11882 2026-07-29 cs.CY cs.AI cs.HC cs.SE 77%

An Experience Report on a Pedagogically Controlled, Curriculum-Constrained AI Tutor for SE Education

关于在教学控制和课程约束下的AI导师在软件工程教育中的经验报告

Lucia Happe, Dominik Fuchß, Luca Hüttner, Kai Marquardt, Anne Koziolek

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

AI总结 本文介绍了一种基于AI的导师系统,旨在通过结构化提示和语义标记知识库,为中学生提供个性化、课程约束的编程学习支持,并通过试点评估验证其在降低认知负荷和补充课堂教学中的潜力。

Comments 11 pages, 4 figures, accepted for publication at ICSE 2026 SEET Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25489 2026-07-29 cs.CV 新提交 75%

Agentic AI in medicine: architectures, applications, evaluation, and challenges for clinical translation

医学中的智能体人工智能:临床转化的架构、应用、评估及挑战

Zheng Tong, Yang Liu, Wanshu Fan, Jing Qin, Zhongbin Han, Haifan Gong, Congyu Liao, Xiaofeng Liu, Cong Wang

机构 * School of Software Engineering, Dalian University(大连大学软件工程学院) Affiliated Zhongshan Hospital of Dalian University(大连大学附属中山医院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of California, San Francisco(加州大学旧金山分校) Yale University(耶鲁大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 研究探讨医学中智能体人工智能的架构、应用等,通过范围审查筛选相关研究,指出其范围未定论且评估与临床需求不符,证据基础有限,临床转化需更清晰定义、可重复评估等。

Comments Review article, 6 figures, 2 tables. 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24768 2026-07-29 cs.AI cs.CL cs.CY cs.ET 新提交 73%

PATHFinder Agent for Tailored Prenatal Care

用于定制产前护理的PATHFinder智能体

Vaibhav Balloli, Carissa Samuel, Samia Abdelnabi, Alex Peahl, Elizabeth Bondi-Kelly

机构 * University of Michigan(密歇根大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究针对产前护理,提出PATHFinder智能体这一端到端对话系统,通过结构化对话收集信息并制定个性化计划,展示社区资源。经评估前沿大语言模型,GPT-5.2平均分最高,还发现检测建议差距,将开展人体研究和随机对照试验验证。

Comments Accepted as demo at ACM Interactive Health 2026. https://realize-lab.github.io/PATHFinder/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19341 2026-07-29 cs.LG cs.AI 版本更新 73%

Structured Scaling of AI Discovery Across Diverse Scientific Domains

基于评估的科学发现扩展

Haotian Ye, Haowei Lin, Jingyi Tang, Yizhen Luo, Rahul Thapa, Caiyin Yang, Chang Su, Rui Yang, Ruihua Liu, Rundao Li, Zeyu Li, Pengwei Sun, Chong Gao, Dachao Ding, Guangrong He, Miaolei Zhang, Lina Sun, Wenyang Wang, Yuchen Zhong, Zhuohao Shen, Puheng Li, Pan Lu, Bianxiao Cui, Di He, Jianzhu Ma, Junfeng Li, Hexi Baoyin, Yejin Choi, Stefano Ermon, Xiaowen Chu, Tongyang Li, Yuzhi Xu, James Zou

机构 * Wizard Intelligence Learning Lab, Stanford University(智能巫师学习实验室,斯坦福大学) Peking University(北京大学) Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 领域大模型 :LLM(abstract_cn);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SimpleTES框架,通过并行探索、反馈驱动精炼和局部选择,提升评估驱动的发现循环效率,解决科学发现扩展问题,展示在21个科学问题上超越基线模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏