arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 840 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 840 篇

2606.18530 2026-06-18 cs.CR cs.CL cs.LG 新提交 81%

Evaluating Prompting-Based Defenses Against Domain-Camouflaged Injection Attacks

评估基于提示的防御策略对抗领域伪装注入攻击

Aaditya Pai

机构 * Data Science Institute(数据科学研究所)

专题命中 领域大模型 :prompting(title,abstract);分类 cs.CL、cs.LG

AI总结 针对领域伪装注入攻击,评估五种基于提示的防御方法(如释义、重点标记等)在三个模型家族和三个部署领域中的有效性,发现释义法最有效,可将伪装攻击成功率降低55-84%。

Comments 9 pages, 4 figures, 4 tables; under review at the AdvML-Frontiers x CoTMA workshop, COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12006 2026-06-11 cs.LG cs.AI 新提交 81%

Tabular Foundation Models for Clinical Survival Analysis via Survival-Aware Adaptation

通过生存感知适配的临床生存分析表格基础模型

Minh-Khoi Pham, Luca Cotugno, Alina Sirbu, Tai Tan Mai, Martin Crane, Marija Bezbradica

机构 * ADAPT Centre, Dublin City University(ADAPT中心,都柏林城市大学) School of Computing, Dublin City University(都柏林城市大学计算机学院) Department of Computer Science and Engineering, University of Bologna(博洛尼亚大学计算机科学与工程系)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出轻量级适配方法,将表格基础模型(TabPFN、TabDPT、TabICL)与多任务逻辑回归头结合,用于临床生存分析,在多个基准和ICU队列上达到竞争性或更优性能。

Comments Accepted for publication at International Conference on AI in Healthcare 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08847 2026-06-09 cs.CV cs.AI cs.LG 新提交 81%

BLM-SGAN: Bidirectional Language Modeling for Semantic-Spatial Text-to-Image Generation

BLM-SGAN: 用于语义-空间文本到图像生成的双向语言建模

Ahmed Abdelmoneim Mazrou, Haidy Maher El-Amir, Ali Hamdi

机构 * Faculty of Computer Science, MSA University, Egypt(MSA大学计算机科学学院,埃及)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出BLM-SGAN模型,利用BERT的双向注意力机制捕获长程依赖,解决GAN在文本到图像生成中的梯度消失和序列处理限制,在鸟类图像生成上达到SOTA。

Comments Published in ICACIn 2024. Appears in Advances on Intelligent Computing and Data Science II, Lecture Notes on Data Engineering and Communications Technologies, vol. 254, Springer, 2025

Journal ref Advances on Intelligent Computing and Data Science II (ICACIn 2024), Lecture Notes on Data Engineering and Communications Technologies, vol. 254, Springer, Cham, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14273 2026-08-17 cs.HC 新提交 80%

Designing Mobile and Wearable Sensor-Fused Conversational Agents for Health and Wellbeing

面向健康与福祉的移动及可穿戴传感器融合对话智能体设计

Hansoo Lee, Pablo Fonseca, Md Haseen Akhtar

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 本教程面向健康领域,旨在教授参与者使用WSDWAS工具,将可穿戴传感器数据与LLM驱动的对话智能体结合,实现从被动监测到可操作福祉对话的转变。

Comments 6 pages, 3 figures. Accepted as a Tutorial at the 28th International Conference on Mobile Human-Computer Interaction (MobileHCI '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13587 2026-08-17 cs.HC 新提交 80%

Student-ChatGPT Interaction Visible: Designing a Teacher Dashboard for EFL Writing Education

学生与ChatGPT交互可视化:为英语作为外语写作教育设计教师仪表盘

Minsun Kim, Seon Gyeom Kim, Suyoun Lee, Yoosang Yoon, Junho Myung, Haneul Yoo, Jieun Han, Hyunseung Lim, Yoonsu Kim, So-Yeon Ahn, Juho Kim, Alice Oh, Hwajung Hong, Tak Yeon Lee

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 该研究设计了用于EFL写作教育的Prompt Analytics Dashboard,可追踪学生与LLM的交互,经教师测试后能降低监控负担并优化干预时机。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12228 2026-08-13 cs.SE 新提交 80%

Towards Automated Domain Model Extraction from Source Code using Heuristics and Open-Source LLMs

基于启发式方法与开源大语言模型(LLMs)从源代码中自动提取领域模型的研究

Alessandra Mancas, Mounir Ammam, Hyacinth Ali, Kevin Delcourt, Houari Sahraoui

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出结合启发式方法与开源LLMs的自动领域模型提取方法,克服上下文限制,在10个项目数据集上获高F1分数,适用于隐私敏感的工业逆向工程场景。

Comments To appear in the Proceedings of the 29th International Conference on Model Driven Engineering Languages and Systems (MODELS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07503 2026-08-11 cs.HC 新提交 80%

Exploring AI-Supported Disciplinary Mediation in Student Project Teams' Text-Based Communication

探索AI支持的学生项目团队基于文本的交流中的学科调解

Ching-Jung Cheng, Yu-Chan Chung, Bing-Chen Chiu, Yu-Hsun Lin, Jia-Wei Liao

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 本研究提出基于Discord的LLM工具Spritz,通过监测群聊边界信号、匿名综合观点等方式调解学生跨学科项目团队交流,发现其兼具认知与关系价值,但需解决AI角色扩展带来的中立性张力问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07373 2026-08-10 physics.ed-ph 新提交 80%

A bottom-up taxonomy of student discourse with a Socratic AI physics tutor

基于苏格拉底式AI物理导师的学生话语自下而上分类学

Syed Furqan Abbas Hashmi, N. Sanjay Rebello

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究针对苏格拉底式AI物理导师,构建学生话语自下而上分类学,明确其分布特征,为物理教育研究提供学生与该类AI导师互动的话语参考

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05134 2026-08-06 cs.HC 新提交 80%

DeepConnect: A Visual Analytics System for Bridging Interdisciplinary Research Collaborations

DeepConnect:用于搭建跨学科研究合作的可视分析系统

Yingchaojie Feng, Zekai Shao, Yiqun Sun, Yixuan Tang, Anthony K. H. Tung

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 DeepConnect是一种LLM增强的可视分析系统,可解决跨学科合作启动难的问题,通过转化合作目标、检索论文、可视化比较研究者等功能,经评估可用于互补团队组建等场景。

Comments 11 pages, 7 figures, and 1 table. Accepted at IEEE VIS 2026; to appear in IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03285 2026-08-05 cs.AR 新提交 80%

Fovea: Physical-Implication-Aware Wafer-Scale DSE with Decision-Domain-Guided Cross-Fidelity Refinement

Fovea:具备物理含义感知的晶圆级设计空间探索,结合决策域引导的跨保真度优化

Jinxi Li, Huizheng Wang, Jinyi Deng, Yang Hu, Shouyi Yin

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 Fovea是一种晶圆级设计空间探索方法,通过物理含义感知的空间构建与决策域引导的跨保真度优化,在LLM训练工作负载的晶圆架构选择中实现了最优解恢复与显著加速。

Comments 13 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28841 2026-08-03 cs.MA cs.SE 新提交 80%

CyberNeuro: A Privacy-Preserving Agentic Workbench for Cohort-Scale Neuroimage and Clinical Data Analysis

CyberNeuro:用于队列规模神经影像与临床数据分析的隐私保护智能体工作台

Ran Ren, Junhong Tong, Yunxi Kong, Yiyao Chen, Yucheng Li, Kunhao Zhou, Shaoqi Wang, Yuxiang Tao, Shuheng Cao, Zhihao Fan, Marissa DiPiero, Tingting Dan, Guorong Wu

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 CyberNeuro是配备WandaMind本地LLM的隐私保护智能体工作台,通过四个专用智能体实现神经影像与临床数据分析自动化,在NeuroBench上提升了域准确率,还降低了令牌使用量。

Comments 25 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28292 2026-07-31 cs.CL cs.AI cs.CE cs.LG 新提交 80%

CACHE-UK: A Stability-Aware Memory Editor for Sequentially Updated Quantized LLMs in Finance

CACHE-UK:面向金融领域顺序更新量化大语言模型的稳定性感知内存编辑器

Anubhav Lakra, Yue Feng

机构 * Indian Institute of Technology Madras(马德拉斯印度理工学院) University of Birmingham(伯明翰大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对动态金融环境中量化大语言模型的顺序内存编辑退化问题,提出CACHE-UK框架,将知识退化降低11%-17%,测试泛化率达28%,提升6个百分点。

Comments 10 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27682 2026-07-31 cs.IR 新提交 80%

Restoring Collaborative Signals in Semantic-ID Generative Recommendation via Personalized Natural Language

通过个性化自然语言恢复语义-ID生成式推荐中的协同信号

Changjiang Han, Qingyang Li, Yaqiang Zang, Jikun Kang, Pinghua Gong, Xue Liu, Bowei He

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 该研究针对基于LLM的生成式推荐模型中SID丢失协同信号导致准确率受限的问题,提出个性化自然语言引导的框架,通过添加分层协同线索恢复信号,提升推荐准确率。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27822 2026-07-31 nucl-th hep-ph 新提交 80%

CLVisc Agent for autonomous relativistic hydrodynamics studies

用于自主相对论流体动力学研究的CLVisc智能体

Qi Wang, Long-Gang Pang, Shi Pu, Xin-Nian Wang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究开发了一种基于大语言模型的智能体,通过元技能自主完成相对论重离子碰撞的流体动力学模拟与分析,可应用于CLVisc代码,支持核物理研究的自动化工作流程。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21920 2026-07-27 stat.AP 新提交 80%

Systematic Literature Reviews With Two Multi-Agentic Systems And Human-In-The-Loop

基于两个多智能体系统和人在回路的系统文献综述

Zexin Ren, Zixuan Zhao, Qiyun Li, Yawen Wu, Lanjing Wang, Renjie Luo, Yi Xu, Qing Guo, Jin Shi, En Xie, Feifang Hu, Qian Shi

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 针对临床试验系统文献综述传统方法的不足,提出含人在回路的两个多智能体系统,筛选MAS用多LLM智能体等提高准确性,提取MAS结合多种手段确保准确与可扩展,重现网络荟萃分析得出新临床结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13398 2026-07-16 cs.IR 新提交 80%

TMallGS: Scaling Unified Feature and Sequence Modeling for Generative E-commerce Search

天猫GS:为生成式电商搜索扩展统一特征和序列建模

Zhentao Song, Yufeng Gao, Xing Fang, Jing Wang, Guangxin Song, Bokang Wang, Yipin Dai, He Guo

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究工业搜索和排名系统中CTR预测从DLRM转向Transformer架构的问题,提出天猫GS可扩展排名架构,含分层分布校准令牌化等五个关键组件,经实验和测试,该架构提高训练吞吐量,提升UCTCVR和GMV。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13257 2026-07-16 cs.SE 新提交 80%

Can LLMs Learn and Apply Multi-Level Modelling Semantics? A First Empirical Study

大语言模型能否学习并应用多层次建模语义?首次实证研究

Yuhong Fu, Weixing Zhang, Bowen Jiang, Haowei Cheng, Karamjti Kaur, Markus Stumptner

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究大语言模型能否学习应用多层次建模语义,通过让三种商业大语言模型在六种提示策略下为挑战生成模型并与参考对比,发现句法正确性可及,语义正确性部分实现,明确能力边界,为工业5.0建模工作流设计提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00798 2026-07-02 cs.CV 新提交 80%

ClinRAG-GRAPH: Clinical-prior Retrieval-Augmented Graph Model with Domain Adversarial Learning for Breast pCR Prediction

ClinRAG-GRAPH: 基于临床先验的检索增强图模型与领域对抗学习用于乳腺癌pCR预测

Yaofei Duan, Yuhao Huang, Tianyu Zhang, Yuan Gao, Luyi Han, Xin Wang, Xinyu Xie, Xinglong Liang, Chunyao Lu, Muzhen He, Patrick Pang, Yue Sun, Ning Mao, Tao Tan, Ritse Mann

机构 * Department of Medical Imaging, Radboud University Medical Center, Nijmegen, The Netherlands(拉德堡德大学医学中心医学影像科,奈梅亨,荷兰) The Netherlands Cancer Institute, Amsterdam, The Netherlands(荷兰癌症研究所,阿姆斯特丹,荷兰) Faculty of Applied Sciences, Macao Polytechnic University, Macau, China(澳门理工大学应用科学学院,澳门,中国) Boston Children’s Hospital, Harvard Medical School, Boston, USA(波士顿儿童医院,哈佛医学院,波士顿,美国) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, Chinese Academy of Sciences, Hong Kong, China(中国科学院香港创新研究院人工智能与机器人创新中心,香港,中国) Imaging Division, University Medical Center Utrecht, Utrecht, The Netherlands(乌得勒支大学医学中心影像部,乌得勒支,荷兰) Department of Radiology, Fuzhou University Affiliated Provincial Hospital, Fuzhou, China(福州大学附属省立医院放射科,福州,中国) Department of Radiology, Yantai Yuhuangding Hospital, Shandong, China(烟台毓璜顶医院放射科,山东,中国)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出ClinRAG-GRAPH框架,通过构建患者内临床先验图、双分支领域对抗学习和大语言模型驱动的子图检索增强模块,实现术前pCR预测,在内部和外部测试集上取得良好性能。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30921 2026-07-01 cs.DC 新提交 80%

Towards Transparent Checkpointing with AI-driven Code Generation

迈向基于AI驱动代码生成的透明检查点

Hai Duc Nguyen, Tekin Bicer, Kyle Chard, Ian Foster, Bogdan Nicolae

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究使用大型语言模型自动为MPI科学应用生成检查点/重启代码,平均50分钟完成,开销可忽略,恢复效率与人工实现相当。

Journal ref FlexScience'26: The 2026 Workshop on AI and Scientific Computing at Scale using Flexible Computing Infrastructures (in conjunction with HPDC'26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26573 2026-06-26 cs.CY cs.HC 新提交 80%

Pingquanqi (Equalizer): A Cross-Domain Sociotechnical Framework for Human-Agent Interaction Governance

Pingquanqi(均衡器):人机交互治理的跨领域社会技术框架

Yu Wang

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出Pingquanqi框架,通过用户状态区分、贝叶斯止损、可控摩擦和透明度度量等组件,优化LLM代理交互成本,保护用户时间资源,兼顾企业经济效益。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25398 2026-06-25 cs.RO 新提交 80%

MAPL: Multi-Objective Preference Learning for Robot Locomotion

MAPL:机器人运动的多目标偏好学习

Xiyue Chen, Muhan Lin, Shuyang Shi, Joseph Campbell

机构 * Purdue University(普渡大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出MAPL框架,利用大语言模型从自然语言目标中学习多目标偏好,替代手工奖励函数,在四足机器人运动任务中达到或超越专家设计奖励的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22803 2026-06-24 cs.IR 新提交 80%

Towards Fast Domain Adaptation and Fine-Grained User Simulation for Evaluating Conversational Recommender Systems

面向快速领域自适应和细粒度用户模拟的对话推荐系统评估

Yuanzi Li, Quanyu Dai, Xueyang Feng, Zihang Tian, Junhao Wang, Xu Chen, Zhenhua Dong, Huifeng Guo

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出AdaptSim框架,通过自动提示生成和开放动作机制实现快速领域自适应,采用“思考-响应”策略控制语言风格,并基于广度优先搜索的逐轮对比评估对话推荐系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21389 2026-06-23 cs.CR 新提交 80%

From Production SIEM to Reusable Cybersecurity Artifacts

从生产SIEM到可复用的网络安全工件

Sidnei Barbieri, Leonardo Vaz de Meneses, Ágney Lopes Roth Ferraz, Wagner Comin Sonaglio, Lourenço Alves Pereira Júnior

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一种从生产金融安全运营中心提取、匿名化、结构化并验证SIEM数据的方法,生成可复用的研究工件,并通过训练和测量实验验证其隐私-效用边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09637 2026-06-09 cs.SE 新提交 80%

Agentic Persona Generation with Critique-Refinement: An Industrial Evaluation

基于批评-改进的智能体角色生成:工业评估

Mohammad Hossein Amini, David Dewar, Shiva Nejati, Mehrdad Sabetzadeh

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 提出PerGent方法,通过迭代批评-改进循环利用LLM智能体生成角色,在工业部署中专家认可率达96.9%,优于单次生成方法。

Comments Accepted in the Industry Track of the Requirements Engineering (RE) 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06749 2026-06-08 q-bio.QM 新提交 80%

Deterministic access to global viral sequence data enables robust agentic scientific discovery

确定性访问全球病毒序列数据实现稳健的自主科学发现

Ferdous Nasri, Sarah Gurev, Patrick Varilly, Krithik Ramesh, Nuala A. O'Leary, Jonah Cool, Bernhard Y. Renard, Pardis C. Sabeti, Laura Luebbert

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对基于大语言模型的科学代理在病毒数据检索中的高错误率问题,提出确定性查询框架gget virus,通过形式化NCBI Virus过滤流程、元数据约束和结构化记录检索,将检索准确率提升至90%以上,并减少98%数据传输。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12928 2026-08-14 cs.AI 新提交 79%

Polish Medical Visual Question Answering: Vision-Language Models Underutilize Visual Evidence

波兰医学视觉问答:视觉语言模型未充分利用视觉证据

Jakub Pokrywka, Łukasz Grzybowski, Antoni Lasik, Marek Kubis, Jeremi Ignacy Kaczmarek, Wojciech Kusa

机构 * ARAAI Poland(波兰ARAAI) NASK National Research Institute(NASK国家研究院) Poznań University of Medical Sciences(波兹南医科大学) T. Marciniak Lower Silesian Specialist Hospital(T.马尔奇尼亚克下西里西亚专科医院) Adam Mickiewicz University(亚当·密茨凯维奇大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 该研究构建了波兰医学VQA基准,评估多类视觉语言模型,发现模型未充分利用视觉证据,仅从文本或答案选项即可达到高于随机水平的准确率,仅GPT-5.6在部分子集上超人类表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09325 2026-08-11 cs.AI cs.CV 新提交 79%

GeoPhysAdapter: Scale-Matched Geophysical Adaptation for Cross-Domain Landslide Mapping with Vision Foundation Models

GeoPhysAdapter:用于基于视觉基础模型的跨域滑坡制图的尺度匹配地球物理适配方法

Zhihang Liu, Mei-Po Kwan, Jinlin Wu, Hao Li

机构 * Institute of Space and Earth Information Science, The Chinese University of Hong Kong(香港中文大学太空与地球信息科学研究所) Department of Geography and Resource Management, The Chinese University of Hong Kong(香港中文大学地理与资源管理学系) Urban Governance and Design Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)城市治理与设计学域) Department of Geography, National University of Singapore(新加坡国立大学地理学系)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 针对跨域滑坡制图中视觉基础模型的误报问题,提出GeoPhysAdapter方法,在像素和候选滑坡体决策单元结合地球物理约束适配,在PILD数据集上大幅降低了假阳性误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07550 2026-08-11 cs.CV cs.LG 新提交 79%

Auditing Medical Vision-Language Models on Chest Radiographs: Estimating Reference Agreement Across Institutions

胸部X光医学视觉语言模型审计:估算跨机构参考一致性

Pengyang Yu, Yiou Wang, Zhongping Dong, Sahraoui Dhelim, Chun-Mei Feng, M. Tahar Kechadi

机构 * University College Dublin(都柏林大学学院) School of Computer Science, University College Dublin(都柏林大学学院计算机科学学院) The Third Affiliated Hospital of Southern Medical University(南方医科大学第三附属医院) Dublin City University(都柏林城市大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.LG

AI总结 该研究通过评估三个生成式视觉语言模型在胸部X光数据上的表现,估算跨机构参考一致性,发现无法推荐默认估算器,且参考一致性需按站点和接口重新评估。

Comments 10 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01725 2026-08-04 cs.NI cs.LG 新提交 79%

CENTILE: A Telemetry Foundation Model Evaluated by the Decisions It Drives

CENTILE:一种由其驱动的决策评估的遥测基础模型

Zifan Zhang, Zhichao Hou, Tingxiang Ji, Yuchen Liu

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 提出的\textbf{\textsc{Centile}}是首个经重放评估可改善HPC调度与网络配置决策的预训练遥测基础模型,可降低HPC回填平均有界减速约77%、违规率减半。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01361 2026-08-04 cs.AI 新提交 79%

High-Stakes Decisions with Language Models: Insights from Emergency Triage

基于语言模型的高风险决策:来自急诊分诊的见解

Khurram Yamin, Christopher Kelly, Bryan Wilder, Eric Horvitz

机构 * Microsoft(微软) Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.AI

AI总结 本研究以急诊分诊为案例,将语言模型的高风险决策置于概率决策框架内,发现语言模型可根据效用调整建议,强调高风险场景下需将其作为概率决策系统评估。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏