arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 840 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 840 篇

2608.06137 2026-08-07 cs.LG 新提交 83%

SkillTFM: Gated Skill Evolution for Training-Free Adaptation of Tabular Foundation Models

SkillTFM:用于表格基础模型无训练适应的门控技能演化

Yi He, Zhengkang Guan, Anpeng Wu, Peng Cui, Fei Wu, Kun Kuang

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 SkillTFM是一种无训练系统,通过可验证可扩展的技能库将表格基础模型的适应转向技能门控演化,在电价预测等任务中提升了AUC,且在不同骨干网络上均有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04271 2026-08-06 cs.SE cs.CL 新提交 83%

LLM-based Vulnerability Discovery in Business Process Documentation

基于大语言模型的业务流程文档漏洞发现

Ben Falchuk, Himanshu Garg, Euthimios Panagos, Sioan Zohar

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究将LLMs应用于MIRABELLE系统,通过实验测试多种LLMs在业务流程文档漏洞检测各阶段的性能,以实现从业务流程表示中识别业务逻辑漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28980 2026-08-03 cs.LG 新提交 83%

Beyond Feature and Structure Alignment: Learning Transferable Propagation Knowledge for Graph Foundation Models

超越特征与结构对齐:学习图基础模型的可迁移传播知识

Yi Wang, Jitao Zhao, Di Jin, Dongxiao He

机构 * Tianjin University(天津大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 针对现有图基础模型忽略可迁移传播知识单元与传播模式异质性的局限,本文提出ProGFM,通过传播关系原型库学习跨域可迁移传播知识,在多跨域场景下实现更优泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28466 2026-07-31 cs.AI 新提交 83%

A report-grounded vision-language foundation model for colonoscopy from 280000 routine reports

基于28万份常规报告的肠镜报告驱动的视觉-语言基础模型

Jia Yu, Yan Zhu, Yili He, Zilong Wang, Xinyang Jiang, Peiyao Fu, Ruijie Yang, Tianyi Chen, Siyuan Li, Zhihua Wang, Fei Wu, Quanlin Li, Xian Yang, Pinghong Zhou, Shuo Wang

机构 * Digital Medical Research Center, School of Basic Medical Sciences, Fudan University(复旦大学基础医学院数字医学研究中心) Shanghai Collaborative Innovation Center of Endoscopy(上海内镜诊疗协同创新中心) Zhejiang University(浙江大学) Shanghai Institute for Advanced Study of Zhejiang University(浙江大学上海高等研究院) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学联盟曼彻斯特商学院) Data Science Institute, Imperial College London(伦敦帝国理工学院数据科学研究所) Microsoft Research Asia(微软亚洲研究院)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.AI

AI总结 该研究开发了肠镜视觉-语言基础模型EndoCLIP,利用28万份常规肠镜记录恢复的图像-文本对训练,在多项任务中优于通用模型,良恶性分类性能接近专家,可实现临床目标的语言指定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27966 2026-07-31 cs.LG 新提交 83%

What Makes Graph Unified? Principles and Generative Sliding-Window Transformer for Graph Foundation Models

什么使图统一?面向图基础模型的生成式滑动窗口Transformer

Dongxiao He, Siqi Liu, Jitao Zhao, Yawen Li, Yi Wang, Di Jin

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 本研究提炼出跨领域图特征统一的四项要求,提出基于拓扑感知滑动窗口特征编码与生成式重构的图基础模型SliGFM,以实现异质节点特征的有效统一与跨领域知识迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22655 2026-07-28 cs.AI 新提交 83%

EventOD: Event-Aware OD Flow Generation via LLM-Guided Semantic Modulation

EventOD:通过大语言模型引导的语义调制实现事件感知的OD流生成

Jie Zhao, Jie Feng, Can Rong, Zhihan Hou, Peng Lu, Yong Li

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Zhongguancun Academy(中关村科学城研究院) Singapore-MIT Alliance for Research and Technology(新加坡-麻省理工学院科研与技术联盟) Xiuzhong College, Tsinghua University(清华大学致理书院) Department of Automation, Central South University(中南大学自动化学院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究在破坏性事件下估计OD流的问题,提出EventOD框架,利用大语言模型和轻量级适应模块,通过输入级调制实现事件感知适应,实验表明该方法能提高重建精度和分布保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18302 2026-07-22 cs.LG 新提交 83%

A Better Start for Language Models: Domain-Conditional Position Offsets

语言模型的更好开端:领域条件位置偏移

Ye Qiao

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 研究针对自回归语言模型序列开头冷启动惩罚问题,提出领域条件位置偏移方法,通过添加单个学习向量减少困惑度,在多模型上效果显著,且具有轻量级、可热切换特点,能改善检索重排等,是短域内评分和校准的有效工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17270 2026-07-21 cs.CL cs.CY 新提交 83%

Safety That Does Not Transfer: Cross-Lingual Clinical Correctness Drift in Deployable Medical Language Models

不可转移的安全性:可部署医学语言模型中的跨语言临床正确性漂移

Anthonio Oladimeji Gabriel, Dimeji Olawuyi, Toba Ajayi, Temilola Aderemi

机构 * AI SafetyX(人工智能安全X)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究资源匮乏健康环境中可部署医学语言模型的跨语言临床正确性漂移,构建英语-豪萨语问题对评估六个模型,发现本地可部署模型临床正确性下降,前沿模型较稳定,缺陷源于可部署层而非语言或临床材料。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16704 2026-07-21 cs.CL 新提交 83%

Though Language Models Err While They Strive: Conformal Prediction for Self-Correcting Scientific Generation

尽管语言模型在努力时会出错:用于自我纠正科学生成的共形预测

Mingqiao Mo, Yunlong Tan, Hao Zhang

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究针对大语言模型生成技术内容常违反科学原理的问题,提出图结构共形预测框架SFC,将科学推理分解为单元,考虑逻辑依赖,通过实时验证和动态分支纠错,在多基准测试中表现出色,提升准确率、有效性并减少定律违反。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09562 2026-07-13 cs.CV cs.AI 新提交 83%

TCLA: Training-Free Class-wise Logit Adaptation for Medical Vision-Language Models

TCLA:用于医学视觉语言模型的无训练类级对数几率适应

Tianyou Jiang, Ziyu Zhou

机构 * University of Bern(伯尔尼大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.AI

AI总结 针对医学视觉语言模型在分布外数据上有效性下降问题,提出无训练的少样本适应方法TCLA。该方法基于支持样本校正推理对数几率,提升模型性能,实验表明其能持续提高模型OOD性能且多数情况下优于现有训练方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08602 2026-07-10 cs.AI 新提交 83%

Towards Precision Therapy in Hepatocellular Carcinoma: A Clinical-Reasoning LLM for Risk Stratification and Treatment Guidance

迈向肝细胞癌的精准治疗:用于风险分层和治疗指导的临床推理大语言模型

Peng Cui, Jitao Wang, Siyan Xue, Yao Huang, Haoming Xia, Dong Li, Dengxiang Liu, Weilin Wang, Liping Liu, Leida Zhang, Yunfu Cui, Tao Peng, Daolin Ji, Haitao Zhao, Wei Zhang, Xiaojuan Wang, Weijie Ma, Zongren Ding, Jinlong Li, Yuan Ding, Jiajing Zhao, Zhiyu Chen, Chengkun Yang, Ziyue Huang, Jiaqi Liu, Fusheng Liu, Yang Zhou, Xiaojuan Wang, Zhongquan Sun, Shiyun Bao, Xiaojun Wang, Ming Yang, Guangxin Li, Bin Shu, Yong Liao, Hongxuan Li, Yao Tang, Shizhong Yang, Yongyi Zeng, Yufeng Yuan, Yinpeng Dong, Jihui Hao, Jun Zhu, Jiahong Dong

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对肝细胞癌治疗问题,提出HCC-STAR临床推理大语言模型。通过处理电子病历叙述输出风险分层、治疗方案等。经多中心队列验证,性能领先,能助医生决策,是可靠的肝细胞癌风险分层和精准治疗决策支持系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07504 2026-07-09 cs.AI 新提交 83%

Do LLM-Generated Skills Make Better AI Data Scientists? A Component Ablation Across Data-Science Workflows

大语言模型生成的技能能否造就更好的人工智能数据科学家?跨数据科学工作流程的组件消融

Wei-Jung Huang

机构 * Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 研究大语言模型生成的技能在数据科学工作流程中的作用,通过在四个阶段测试及组件消融实验发现,完整生成技能及消融后的技能变体与任务单独提示相比,均未显著提升性能,提醒勿将其作为默认单次提示策略。

Comments KDD 2026 Workshop on AI Data Scientist

Journal ref KDD 2026 Workshop on AI Data Scientist

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05880 2026-07-08 cs.CV cs.AI 新提交 83%

Harrison.Rad 1.5 Technical Report: A radiology foundation model that can draft reports from images, priors and clinical context

哈里森.Rad 1.5技术报告:一种可根据图像、先验知识和临床背景起草报告的放射学基础模型

Suneeta Mall, Vladimir Nekrasov, Ashnil Kumar, Sajith Karunasena, Aiden Nibali, Alix Bird, Mateo Diaz Shine, Jarrel Seah

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对放射科报告积压问题,提出HR1.5多模态大语言模型,通过三阶段训练,用特定评分框架评估,该模型是唯一达模拟FRCR及格标准的系统,在多方面准确率最高,还研究了可解释性等以支持临床应用评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02879 2026-07-07 cs.AI 新提交 83%

MedCalc-Pro: Solving Complex Medical Calculations with LLM Agents

MedCalc-Pro:使用大语言模型智能体解决复杂医学计算问题

Siran Zhao, Ruihui Hou, Ziyue Huai, Chennuo Zhang, Tong Ruan

机构 * East China University of Science and Technology(华东理工大学)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对医学计算评估大语言模型的基准过于简化的问题,提出新基准MedCalc-Pro及更通用智能体框架,含多场景任务设置和真实病例,新框架性能最佳,为评估应用LLMs提供新基准和方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23243 2026-06-23 cs.LG cs.SD 新提交 83%

Unlocking In-Context Learning in Audio-Language Models from Decentralized Medical Audio

从分散的医疗音频中解锁音频-语言模型的上下文学习

Ran Piao, Tsai-Ning Wang, Martijn den Dekker, Linda Moonen, Hareld Kemps, Yuan Lu, Aaqib Saeed

机构 * Eindhoven University of Technology(埃因霍温理工大学) Erasmus MC(伊拉斯姆斯医学中心) Rijnstate Hospital(莱茵州医院)

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 提出联邦自上下文学习(FSC)框架,通过无监督聚类构建伪标签片段,结合渐进式三阶段流水线,在联邦医院客户端实现少样本临床音频诊断,准确率达71.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20713 2026-06-23 cs.AI 新提交 83%

FairTutor: Equity-Aware Pedagogical LLM Routing for Budget-Constrained AI Tutoring

FairTutor: 预算受限AI辅导中的公平感知教学LLM路由

Qingyang Xu

机构 * Independent researcher, Shanghai, China(独立研究者,上海,中国)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 提出FairTutor框架,通过教学驱动的多智能体编排实现成本效益AI辅导,在降低71.6%服务成本的同时达到97.1%的优质教学质量,并引入AIED优势差距指标衡量公平性。

Comments AI for Education Day at SIGKDD 2026, 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15786 2026-06-16 cs.CV cs.AI physics.geo-ph 新提交 83%

Domain-Guided Prompting of the Segment Anything Model for Seismic Interpretation: The Role of Attributes, Visualization, and Hybrid Prompts

领域引导的Segment Anything模型提示用于地震解释:属性、可视化和混合提示的作用

Aniq Ahmad, Heather Bedle, Ahmad Mustafa

机构 * School of Geosciences, University of Oklahoma(俄克拉荷马大学地球科学学院) King Fahd University of Petroleum and Minerals(法赫德国王石油矿产大学)

专题命中 领域大模型 :prompting(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 提出零样本适应框架,通过地质目标感知的地震属性与颜色映射选择,结合混合提示策略,提升SAM在地震解释中的分割精度,避免微调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08618 2026-08-11 cs.RO cs.AI cs.CL 新提交 82%

RAG-Based Auto-Configuration for Industrial Fieldbus Devices

基于检索增强生成(RAG)的工业现场总线设备自动配置

Aadil Gani Ganie, Saad Ezzini, Naveed Farooz Marazi

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 针对工业现场总线设备手动配置的低效易错问题,提出SysName流水线,结合RAG、本地LLM与两级弃权门控,在多协议设备配置任务中实现高效高准确率的端到端自动化,经基准测试与案例验证效果优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08459 2026-08-11 cs.CL cs.AI cs.DB 新提交 82%

Beyond Tables: Doc2DB-Bench for Relationally Faithful Document-to-Database Construction

超越表格:用于关系忠实的文档到数据库构建的Doc2DB-Bench

Zhuowen Liang, Zhengxuan Zhang, Jiayang Wang, Jiazhuo Chen, Nan Tang

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 该研究针对现有文档到表格基准无法适配关系数据库构建需求的问题,推出Doc2DB-Bench基准,含多领域长文档实例,为基于LLM的可靠数据系统提供测试平台。

Comments 24 pages, 13 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07250 2026-08-10 q-bio.QM cs.AI cs.CL 新提交 82%

Artificial Intelligence Can Match Domain Experts in Evidence Extraction and Critical Appraisal of Microbial Oncogenesis Research Publications

人工智能可在微生物致癌研究出版物的证据提取与严格评估上与领域专家相匹配

Kaela Kokkas, Hairong Wang, Richard Klein, Nazir A. Ismail, Natalie Irwin, Mohammad Z. Moonsamy, Kubendran Naidoo, Jeremy Nel, Ekene E. Nweke, Raveen Parboosing, Emmanuel K. Sekyi, Rebecca T. van Dorsten, Bruce A. Bassett, Robert F. Breiman

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 本研究以MMTV-LV与乳腺癌为案例,构建数据集测试4款LLM在24篇微生物致癌研究论文的证据提取与评估任务上的表现,发现GPT-5等两款LLM性能与专家相当,可用于自动化系统证据综合,但仍存在方法学评估等弱点。

Comments Published in Frontiers in Cellular and Infection Microbiology, 45 pages, 14 figures

Journal ref Kokkas K, Wang H, Klein R, et al. (2026) Artificial intelligence can match domain experts in evidence extraction and critical appraisal of microbial oncogenesis research publications. Front. Cell. Infect. Microbiol. 16:1876326

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07418 2026-08-10 cs.AI cs.CL 新提交 82%

ResidencyRL: Reinforcement Learning in Simulated Clinical Environments

ResidencyRL:在模拟临床环境中开展的强化学习

Valentin Liévin, Samuel Schmidgall, Tim Strother, Alex Bijamov, Akshay Goel, Anil Palepu, Chunjong Park, Vahid Balazadeh, Min Woo Sun, Marius Guerard, Justin Chen, Dave Steiner, Vikram Dhillon, Ibrahim Azar, Akhil Mehta, Nicholas Spetsieris, Shilpan Shah, Maen Abdelrahim, Amit Dahiya, Yun Liu, Katherine Chou, Yossi Matias, Avinatan Hassidim, Dale R. Webster, Quoc V. Le, Raia Hadsell, Joelle Barral, Carey Radebaugh, Aleksandra Faust, Shekoofeh Azizi, Mike Schaekermann, Po-Hsuan Cameron Chen, Tao Tu, David Racz, Lin Yang

机构 * Google DeepMind(谷歌DeepMind) Google Research(谷歌研究院) Houston Methodist Hospital(休斯顿卫理公会医院) Trinity Health Group(三一健康集团) Stanford Oncology Partners(斯坦福肿瘤学伙伴) St. Luke Hospital(圣卢克医院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出 ResidencyRL,通过多轮强化学习训练临床 AI 智能体,在模拟临床环境中提升诊断准确性、降低漏报率,且能力可迁移至多个医学基准测试,为临床 AI 发展提供了新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03606 2026-08-05 cs.AI cs.LG 新提交 82%

Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents

临床试验策略学习:面向决策智能体的离线策略训练

William Bolton, Philip Torr

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 本研究将肿瘤学临床开发建模为离线决策问题,构建时间数据集,对比4种离线目标与4种LLM智能体,发现奖励加权行为克隆表现最优,证明结构化离线学习可用于规划临床实验。

Comments Accepted for a spotlight at the ICML 2026 Workshop on Generative and Agentic AI for Biology (GenBio) and as a poster at the ICML 2026 Workshop on Decision-Making from Offline Datasets to Online Adaptation: Black-Box Optimization to Reinforcement Learning (DEMO). 15 pages, 3 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23647 2026-07-28 cs.LG cs.AI 新提交 82%

CALMRec: Causally Aligned Language Memory for Long-Horizon Recommendation

CALMRec:用于长期推荐的因果对齐语言记忆

Gengyu Zhan

机构 * Shenzhen University(深圳大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对当前大语言模型推荐器的问题,提出CALMRec框架,利用冻结多模态语言模型转换信息,维护多种记忆,通过倾向加权更新等减少偏差,在多环境评估中表现良好,提升了折扣长期价值,释义基准上语义原子NDCG显著提高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10127 2026-07-14 cs.LG cs.AI 新提交 82%

GAE: Graph-Augmented Evolution for Scientific Discovery via Reinforcement Optimization

GAE:通过强化优化实现科学发现的图增强进化

Xuanzhou Chen, Taoli Cheng

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 针对大语言模型引导的进化程序搜索的瓶颈,提出GAE框架,通过图神经网络、强化学习优化的元控制器和在线微调循环解决问题,在复杂非线性振荡器系统符号回归任务中有效发现物理方程,性能达最优。

Comments ICML 2026, AI for Science Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07379 2026-07-09 cs.AI cs.LG 新提交 82%

Physics-Audited Agentic Discovery in Scientific Machine Learning

科学机器学习中的物理审核智能发现

Diab W. Abueidda, Bilal Ahmed, Panos Pantidis, Mostafa E. Mobasher

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校) National Center for Supercomputing Applications, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校国家超级计算应用中心)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对智能科学机器学习中替代模型选择问题,提出物理审核智能SciML工作流程,先确定评分评估器,推导物理要求并检查候选者输出,搜索违规情况。通过数值示例验证,该方法能选到满足物理条件的替代模型,区别于仅靠综合分数的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02944 2026-07-07 cs.LG cs.AI 新提交 82%

A Precedent-Guided Co-Scientist for Side-Effect-Aware Drug Redesign

一种用于副作用感知药物重新设计的先例引导协同科学家

Yujin Kim, Charmgil Hong

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 提出PRECEDE用于副作用感知药物重新设计,将重新设计视为基于证据的推理,由LLM编排,定位为人监督的科学工作流,可审核、证伪且受先前药理学限制。

Comments Accepted at the ICML 2026 Workshop on AI for Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01557 2026-07-07 cs.CL cs.AI 新提交 82%

DiPS: Dialogue Policy Selection for High-Stakes Persuasion Agents

DiPS:高风险说服代理的对话策略选择

Tianyi Zhang, Mousumi Das, Abrar Anwar, Jesse Thomason, David Traum

机构 * University of Southern California(南加州大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对高风险场景中说服策略需个性化的问题,提出DiPS框架,基于Q-learning动态选择说服策略,在火灾疏散模拟和真实人机交互中提升成功率。

Comments Proceedings of the 27th Annual Meeting of the Special Interest Group on Discourse and Dialogue (SIGDIAL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01431 2026-07-03 cs.CL cs.AI 新提交 82%

IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs

IsoSci: 用于评估LLM中推理与知识检索的同构跨域科学问题基准

Samir Abdaljalil, Erchin Serpedin, Hasan Kurban

机构 * Texas A&M University(德克萨斯农工大学) Hamad Bin Khalifa University(哈马德·本·哈利法大学)

专题命中 领域大模型 :LLM(title_cn,abstract);分类 cs.CL、cs.AI

AI总结 提出IsoSci基准,通过逻辑结构相同但领域知识不同的科学问题对,分离推理能力与领域知识检索,发现91.3%的推理增益依赖于知识而非结构,挑战了思维链推理提升科学问题解决的假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27973 2026-06-29 cs.CL cs.AI 新提交 82%

From Black-Box to Clinical Insight: A Multi-Stage Explainable Framework for Speech-Based Cognitive Impairment Detection

从黑盒到临床洞察:用于语音认知障碍检测的多阶段可解释框架

Yasaman Haghbin, Sina Rashidi, Ali Zolnour, Fatemeh Taherinezhad, Ali Fartoot, Hossein Azadmaleki, James M Noble, Maryam Dadkhah, Maryam Zolnoori

机构 * Independent Researcher(独立研究者) Columbia University(哥伦比亚大学) Chalmers University of Technology(查尔姆斯理工大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 提出多阶段可解释框架,结合SHAP、语言学特征和LLM推理,将黑盒Transformer预测转化为临床叙事,在NIA PREPARE基准上F1=72.11%,医生评估显示与患者认知特征高度一致,SUS评分82/100。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26728 2026-06-26 cs.AI cs.LG cs.MA 新提交 82%

Scientific discovery as meta-optimization: a combinatorial optimization case study

科学发现作为元优化:一个组合优化案例研究

Yuan-Hang Zhang, Chesson Sipling, Massimiliano Di Ventra

机构 * University of California San Diego(加州大学圣迭戈分校)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出将科学研究形式化为元优化,通过共识目标聚合方法,在3-SAT算法发现中实现从O(N^2.51)到O(N^1.33)的规模改进,最大实例加速约67倍。

Comments 35 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏