arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12496 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12496 篇

2608.12184 2026-08-13 cs.IR 新提交 90%

Making Collaborative Signals Count: Graph-Aware Large Language Models for Sequential Recommendation

让协同信号发挥作用:面向序列推荐的图感知大语言模型

Fenglin Yan, Bohao Wang, Jian Zhang, Yu Cui, Tongya Zheng, Ye Feng, Can Wang, Jiawei Chen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

AI总结 针对现有序列推荐方法难以捕捉全局协同模式的问题,提出图感知大语言模型框架GALLM,通过构建协同图建模三类关系并整合至注意力机制,在四个基准上取得最优性能,HR@5较最强基线平均提升9.76%。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04854 2026-08-06 eess.SY cs.SY 新提交 90%

Transforming Remanufacturing Automation with Large Language Models: A Forward-Looking Analysis with Case Studies

用大语言模型推动再制造自动化:前瞻性分析与案例研究

Chang Liu, Sara Behdad, Prabhakar Pagilla, Xiao Liang, Minghui Zheng

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文通过前瞻性分析与案例研究,提出ReManGPT概念框架,探讨大语言模型在再制造自动化中的应用,以应对报废产品变异性等挑战,同时分析其部署障碍与未来方向。

Journal ref Robotics and Computer-Integrated Manufacturing 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06709 2026-08-06 cs.SE 90%

Using Large Language Models to Support Automation of Failure Management in CI/CD Pipelines: A Case Study in SAP HANA

利用大型语言模型支持CI/CD流水线故障管理的自动化:SAP HANA案例研究

Duong Bui, Stefan Grintz, Alexander Berndt, Thomas Bach

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本研究利用大型语言模型结合历史故障数据,实现了CI/CD流水线故障管理的自动化,准确率达92.1%。

Comments Accepted for publication in the proceedings of SANER 2026

Journal ref 2026 IEEE International Conference on Software Analysis, Evolution and Reengineering (SANER), Limassol, Cyprus, 2026, pp. 524-535

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20763 2026-07-10 cs.SE 版本更新 90%

Unveiling Large Language Model Supply Chain: Structure, Domain, and Vulnerabilities

揭示大语言模型供应链:结构、领域与漏洞

Yanzhe Hu, Shenao Wang, Tianyuan Nie, Yanjie Zhao, Haoyu Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 研究大语言模型供应链的结构、领域和漏洞,通过分析PyPI和NPM的开源包数据集构建依赖图,发现其拓扑结构特点及安全风险传播规律,为增强生态系统弹性提供定量见解和策略依据。

Comments Accepted by Internetware 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02964 2026-07-03 cs.CL cs.AI cs.CR cs.LG 版本更新 90%

Less Data, More Security: Advancing Cybersecurity LLMs Specialization via Resource-Efficient Domain-Adaptive Continuous Pre-training with Minimal Tokens

更少数据,更多安全:通过最小令牌的资源高效领域自适应持续预训练推进网络安全LLM专业化

Salahuddin Salahuddin, Ahmed Hussain, Jussi Löppönen, Toni Jutila

机构 * SSH Communications Security(SSH通讯安全公司) KTH Royal Institute of Technology(皇家理工学院) Aalto University(阿尔托大学)

专题命中 领域大模型 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 提出资源高效的领域自适应持续预训练方法,利用分布式FSDP流水线在126M词网络安全语料上微调LLM,以最少118.8M令牌实现超越大规模预训练模型的最新性能。

Comments 19 Pages; Updated content and authors list

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22735 2026-06-23 stat.AP stat.OT 新提交 90%

Analyzing Students' Statistics Writing Before and After the Emergence of Large Language Models

分析大型语言模型出现前后学生的统计写作

Sara Colando, Erin Franke, Gordon Weinberg, Alex Reinhart

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn)

AI总结 本研究通过2021至2025年间1600多份本科生数据分析报告,发现学生写作风格和动词使用与LLM趋同,尤其在引言和结论部分,同时风格更接近统计专家,并讨论了教学评估的启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07036 2026-06-18 physics.ed-ph 版本更新 90%

Using Large Language Models to Analyze Engagement in Computational Thinking via Computational Physics Essays

使用大型语言模型通过计算物理论文分析计算思维中的参与度

Sean Savage, Amir Bralin, Paul Hur, N. Sanjay Rebello

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本研究利用多模态大型语言模型自动评估100篇学生计算物理论文中的计算思维参与度,在明确子任务上达到84%的准确率,但主观整体质量评估准确率仅71%。

Comments 13 pages, 3 figures, 3 tables. Submitted to Physical Review Physics Education Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14266 2026-06-15 physics.comp-ph 新提交 90%

Large Language Model Based Agent for Automated Discovery in Computational Physics

基于大语言模型的自动化计算物理发现智能体

Hang Lin, Chongwen Liu, Gang Yan

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 提出PhyNex智能体,结合大语言模型引导搜索与领域工具,通过渐进局部搜索和知识积累,在三个物理问题上实现与人类专家相当或更优的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13001 2026-06-12 cs.IR cs.MM 新提交 90%

CFALR: Collaborative Filtering-Augmented Large Language Model for Personalized Fashion Outfit Recommendation

CFALR:协同过滤增强的大语言模型用于个性化时尚套装推荐

Yujuan Ding, Junrong Liao, Yunshan Ma, Yi Bin, Wenqi Fan, Tat-Seng Chua, Qing Li

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 提出CFALR框架,结合协同过滤与大语言模型,通过自然语言描述用户-套装交互并利用CF增强嵌入,解决个性化套装推荐中的数据稀疏和组合空间问题,在Polyvore和IQON数据集上优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13713 2026-06-03 cs.IR cs.SD eess.AS 90%

TALKPLAY: Multimodal Music Recommendation with Large Language Models

TALKPLAY: 基于大语言模型的多模态音乐推荐

Seungheon Doh, Keunwoo Choi, Juhan Nam

机构 * KAIST(韩国科学技术院) talkpl.ai

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 提出TALKPLAY系统,通过将推荐转化为token生成问题,利用大语言模型处理多模态音乐特征,实现端到端对话式推荐,显著优于单模态方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31458 2026-06-01 cs.SE cs.SY eess.SY 90%

Ladder Logic Translation using Large Language Models in Industrial Automation

工业自动化中使用大语言模型的梯形图逻辑翻译

Oluwatosin Ogundare, Promise Ekpo, Nathanial Wiggins

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title);language model(title)

AI总结 针对PLC厂商切换中梯形图翻译的语义不一致问题,提出基于LLM的数学建模与工程化流水线,实现Rockwell到Siemens S7的高语义一致性自动翻译。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09393 2026-05-26 cs.SE 90%

Prediction Model of Motivators and Demotivators of Integrating Large Language Models in Software Engineering Education: An Empirical Study

软件工程教育中集成大型语言模型的激励与抑制因素预测模型:一项实证研究

Maryam Khan, Muhammad Azeem Akbar, Jussi Kasurinen, Estefanía Martín-Barroso

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本研究通过调查126位利益相关者,利用朴素贝叶斯和逻辑回归模型预测大型语言模型熟悉度,并结合遗传算法优化,识别出在成本约束下应优先考虑治理机制(尤其是诚信和伦理保障)的集成策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13911 2026-05-15 cond-mat.mtrl-sci 90%

Rongzai agent: A Large Language Model-Based Autonomous Assistant for Rietveld Refinement of Neutron Diffraction Data

荣宰代理:一种基于大语言模型的自主助手,用于中子衍射数据的Rietveld精修

Qingmeng Li, Hao Wang, Dongbo Xiong, Jiajun Zhong, Wenhai Ji, Hao Hu, Yiyu Zhang, Bolun Zhang, Hong Wang, Yongfeng Zhu, Rong Du, Zhengde Zhang, Fazhi Qi, Junrong Zhang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文提出基于大语言模型的荣宰代理,实现中子衍射数据Rietveld精修的自动化,通过知识驱动决策,提升精修效率与准确性,已在中国散裂中子源部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13497 2026-05-14 cs.IR 90%

Task-Aware Automated User Profile Generation for Recommendation Simulation Using Large Language Models

面向任务的自动化用户画像生成用于推荐模拟的大型语言模型

Xinye Wanyan, Chenglong Ma, Danula Hettiachchi, Ziqi Xu, Jeffrey Chan

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文提出APG4RecSim框架,通过自动化生成真实且稳定的用户画像,提升推荐模拟的性能和泛化能力,实验显示其在排序和评分任务中表现优异。

Comments Accepted by SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12896 2026-05-14 physics.med-ph 90%

Large Language Models for AI-Assisted Radiotherapy Scheduling: A Feasibility Study Under Realistic Operational Constraints

大语言模型用于AI辅助放疗排程:在现实运营约束下的可行性研究

Eric Zhang, Wen Li, Youfang Lai, Annette Souranis, Georgia Paparoidamis, Michael Roumeliotis, Xun Jia

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文研究了大语言模型在放疗患者排程中的可行性,通过模拟环境验证了其在满足临床和运营约束下的有效性,展示了模型在处理复杂排程需求中的优势。

Comments 34 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01011 2026-05-12 cs.CL cs.AI cs.LG 90%

CLEAR: Revealing How Noise and Ambiguity Degrade Reliability in LLMs for Medicine

CLEAR: 揭示噪声和歧义如何降低LLM在医学中的可靠性

Kevin H. Guo, Chao Yan, Avinash Baidya, Katherine Brown, Xiang Gao, Juming Xiong, Zhijun Yin, Bradley A. Malin

机构 * Department of Biomedical Informatics, Vanderbilt University Medical Center(生物医学信息学系,范德比尔特大学医学中心) Vanderbilt University(范德比尔特大学) Intuit AI Research(Intuit AI研究) Department of Electrical and Computer Engineering, Vanderbilt University(电气与计算机工程系,范德比尔特大学) Department of Computer Science, Vanderbilt University(计算机科学系,范德比尔特大学) Department of Biostatistics, Vanderbilt University Medical Center(生物统计学系,范德比尔特大学医学中心)

专题命中 领域大模型 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 CLEAR框架评估了决策空间呈现、歧义性和不确定性对医学基准LLM推理的影响,揭示了现有评估方法的三大局限:增加合理答案数量会降低模型识别正确答案和避免错误答案的能力,歧义性增加导致模型更不谨慎,且模型规模越大,谦逊缺陷越严重。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27433 2026-05-01 cs.HC 90%

Beyond One-Size-Fits-All Exercises: Personalizing Computer Science Worksheets with Large Language Models

超越一刀切练习:利用大语言模型个性化计算机科学练习册

Franco Ortiz, Runlong Ye, Michael Liut

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文研究利用大语言模型根据学生学习者画像生成个性化编程课程练习,发现个性化材料显著提高低知识学生完成率和正确率,且不降低任务难度。

Comments Accepted at ITiCSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26079 2026-04-30 cs.CR 90%

Large Language Models as Explainable Cyberattack Detectors for Energy Industrial Control Systems

大语言模型作为可解释的网络攻击检测器用于能源工业控制系统

Weiyi Kong, Ahmad Mohammad Saber, Amr Youssef, Deepa Kundur

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文研究了大语言模型在工业控制系统中检测Modbus流量攻击的可行性,通过二分类任务实现对异常行为的检测,并生成可审计的事件记录。

Comments Accepted to ACM EnergySP 2026, co-located with ACM e-Energy 2026. Author accepted manuscript. 8 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07963 2026-04-10 cs.CL cs.AI cs.LG 90%

Rethinking Data Mixing from the Perspective of Large Language Models

从大语言模型视角重新思考数据混合

Yuanjian Xu, Tianze Sun, Changwei Xu, XinLong Zhao, Jianing Hao, Ran Chen, Yang Liu, Ruijie Xu, Stephen Chen, Guang Zhang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) OpenCSG Harbin Institute of Technology(哈尔滨工业大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文从理论角度探讨数据混合策略对大语言模型训练的影响,提出DoGraph框架,通过图约束优化提升模型泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26329 2026-03-30 cs.SE 90%

Large Language Models for Software Testing Education: an Experience Report

大型语言模型在软件测试教育中的应用:经验报告

Peng Yang, Yunfeng Zhu, Chao Chang, Shengcheng Yu, Zhenyu Chen, Yong Tang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文通过混合方法研究,探讨学生在使用LLM进行测试任务时的交互问题及教学策略,提出轻量级提示框架以提升测试脚本生成能力。

Comments Paper Accepted by the ACM International Conference on the Foundations of Software Engineering (FSE 2026) Software Engineering Education Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17718 2026-03-19 cs.CV 90%

DiffVP: Differential Visual Semantic Prompting for LLM-Based CT Report Generation

DiffVP:基于LLM的CT报告生成的微分视觉语义提示

Yuhe Tian, Kun Zhang, Haoran Ma, Rui Yan, Yingtai Li, Rongsheng Wang, Shaohua Kevin Zhou

机构 * Department of Electronic Engineering Information Science, School of Information Science Technology, University of Science Technology of China (USTC), Hefei, Anhui 230026, China School of Biomedical Engineering, Division of Life Sciences Medicine, University of Science Technology of China (USTC), Hefei, Anhui 230026, China Center for Medical Imaging, Robotics, Analytic Computing \& Learning (MIRACLE), Suzhou Institute for Advanced Research, University of Science Technology of China (USTC), Suzhou, Jiangsu 215123, China Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology, University of Science Technology of China (USTC), Suzhou, Jiangsu 215123, China State Key Laboratory of Precision Intelligent Chemistry, University of Science

专题命中 领域大模型 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

AI总结 DiffVP通过微分视觉提示方法,利用扫描与参考之间的高阶语义差异指导LLM生成CT报告,提升报告准确性,实验表明其在BLEU和临床效果上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21374 2026-02-26 cs.CL cs.AI cs.LG 90%

Small Language Models for Privacy-Preserving Clinical Information Extraction in Low-Resource Languages

小型语言模型在低资源语言中隐私保护的临床信息提取

Mohammadreza Ghaffarzadeh-Esfahani, Nahid Yousefian, Ebrahim Heidari-Farsani, Ali Akbar Omidvarian, Sepehr Ghahraei, Atena Farangi, AmirBahador Boroumand

机构 * Student Research Committee Isfahan University of Medical Sciences(伊斯法罕医学科学大学学生研究委员会) Department of Emergency Medicine Isfahan University of Medical Sciences(伊斯法罕医学科学大学急诊医学科)

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用小型语言模型结合翻译模型,实现低资源语言中隐私保护的临床信息提取,验证了模型规模和输入语言策略联合优化的重要性。

Comments 16 pages, 3 figures, 2 supplementary files

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08124 2026-02-10 cs.CL cs.AI cs.LG 90%

Gender and Race Bias in Consumer Product Recommendations by Large Language Models

大型语言模型在消费者产品推荐中的性别和种族偏见

Ke Xu, Shera Potka, Alex Thomo

机构 * University of Victoria, British Columbia, Canada(维多利亚大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文研究了大型语言模型在消费者产品推荐中存在性别和种族偏见的问题,通过提示工程和三种分析方法揭示了推荐中的不平等现象,并强调了构建更公平推荐系统的重要性。

Comments Accepted at the 39th International Conference on Advanced Information Networking and Applications (AINA 2025)

Journal ref Lecture Notes in Networks and Systems, vol 1210, pp. 222-233, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01216 2026-01-08 cs.CL cs.AI cs.LG 90%

Detecting PTSD in Clinical Interviews: A Comparative Analysis of NLP Methods and Large Language Models

在临床访谈中检测PTSD:自然语言处理方法和大语言模型的比较分析

Feng Chen, Dror Ben-Zeev, Gillian Sparks, Arya Kadakia, Trevor Cohen

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究比较了NLP方法和大语言模型在临床访谈中检测PTSD的效果,发现领域特定模型和嵌入方法表现最佳,强调了领域适应技术在PTSD筛查中的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08079 2025-12-10 cs.IR 90%

Leveraging Machine Learning and Large Language Models for Automated Image Clustering and Description in Legal Discovery

利用机器学习和大语言模型实现法律发现中的自动化图像聚类与描述

Qiang Mao, Fusheng Wei, Robert Neary, Charles Wang, Han Qin, Jianping Zhang, Nathaniel Huber-Fliflet

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出利用机器学习和大语言模型实现法律发现中自动化图像聚类与描述,通过比较不同采样策略、提示技术和生成方法,提升大规模图像数据处理的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22311 2025-12-01 cs.AI cond-mat.mes-hall cond-mat.soft cs.CL cs.LG 90%

Swarms of Large Language Model Agents for Protein Sequence Design with Experimental Validation

大规模语言模型代理群组用于蛋白质序列设计的实验验证

Fiona Y. Wang, Di Sheng Lee, David L. Kaplan, Markus J. Buehler

机构 * Laboratory for Atomistic and Molecular Mechanics (LAMM), Department of Biological Engineering, Massachusetts Institute of Technology(原子分子力学实验室(LAMM),生物工程系,麻省理工学院) Department of Biomedical Engineering, Tufts University(生物医学工程系,塔夫茨大学) Laboratory for Atomistic and Molecular Mechanics (LAMM), Department of Civil and Environmental Engineering, Department of Mechanical Engineering, Center for Computational Science and Engineering, Schwarzman College of Computing, Massachusetts Institute of Technology(原子分子力学实验室(LAMM),土木与环境工程系,机械工程系,计算科学与工程中心,计算机科学学院,麻省理工学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种基于大规模语言模型代理群组的蛋白质序列设计方法,通过去中心化协调实现高效目标导向设计,无需微调或特定训练,且在实验中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01814 2025-11-21 cs.IR cs.AI cs.CL cs.LG 90%

LLMInit: A Free Lunch from Large Language Models for Selective Initialization of Recommendation

LLMInit: 从大型语言模型中获得免费午餐:用于推荐系统选择性初始化

Weizhi Zhang, Liangwei Yang, Wooseong Yang, Henry Peng Zou, Yuqing Liu, Ke Xu, Sourav Medya, Philip S. Yu

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) Salesforce AI Research(Salesforce AI研究)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LLMInit通过选择性初始化策略将预训练LLM嵌入整合到协同过滤模型中,提升推荐性能并降低计算成本。

Comments Accepted in EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13876 2025-11-19 cs.CV 90%

QwenCLIP: Boosting Medical Vision-Language Pretraining via LLM Embeddings and Prompt tuning

Xiaoyang Wei, Camille Kurtz, Florence Cloppet

机构 * Laboratoire d'Informatique Paris Descartes (LIPADE), Université Paris Cité (France)(巴黎笛卡尔大学信息学实验室(LIPADE),巴黎城市大学(法国))

专题命中 领域大模型 :LLM(title,abstract);pretraining(title,abstract);large language model(abstract);language model(abstract)

Comments This work has been submitted to the IEEE ISBI for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07076 2025-10-28 cs.CL cs.AI cs.LG 90%

MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses

Zonglin Yang, Wanhao Liu, Ben Gao, Tong Xie, Yuqiang Li, Wanli Ouyang, Soujanya Poria, Erik Cambria, Dongzhan Zhou

机构 * Nanyang Technological University(南洋理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Wuhan University(武汉大学) University of New South Wales(新南威尔士大学) GreenDynamics Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22472 2025-09-29 cs.CL cs.AI cs.LG 90%

Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning

Antreas Ioannou, Andreas Shiamishis, Nora Hollenstein, Nezihe Merve Gürel

机构 * Delft University of Technology(代尔夫特理工大学) University of Zurich(苏黎世大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 39 pages, 36 figures. Code and evaluation pipeline available at https://github.com/RobustML-Lab/Legal-Multilingual-Evaluation-of-LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏