arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-13 至 2026-03-13 共收录 237 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 57 篇

2603.11991 2026-03-13 cs.CL cs.AI cs.LG stat.ML 75%

BTZSC: A Benchmark for Zero-Shot Text Classification Across Cross-Encoders, Embedding Models, Rerankers and LLMs

BTZSC:跨跨编码器、嵌入模型、重排序器和大语言模型的零样本文本分类基准

Ilias Aarab

机构 * European Central Bank(欧洲中央银行)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 BTZSC是一个涵盖22个公开数据集的零样本文本分类基准,系统比较了跨编码器、嵌入模型、重排序器和LLMs四种模型家族,发现重排序器和LLMs在性能上表现突出,嵌入模型在准确性和延迟之间取得良好平衡。

Comments Accepted at ICLR 2026. 31 pages, 5 figures, 9 tables. Code: https://github.com/IliasAarab/btzsc ; Dataset: https://huggingface.co/datasets/btzsc/btzsc ; Leaderboard: https://huggingface.co/spaces/btzsc/btzsc-leaderboard . Proceedings of the Fourteenth International Conference on Learning Representations (ICLR 2026), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11393 2026-03-13 cs.HC 75%

To Believe or Not To Believe: Comparing Supporting Information Tools to Aid Human Judgments of AI Veracity

相信还是不相信:比较支持信息工具以帮助人类判断AI可信度

Jessica Irons, Patrick Cooper, Necva Bolucu, Roelien Timmer, Huichen Yang, Changhyun Lee, Brian Jin, Andreas Duenser, Stephen Wan

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文比较了不同支持信息工具对人类判断AI可信度的影响,发现段落检索在准确性和速度上表现良好,而LLM解释易导致过度依赖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10001 2026-03-13 cs.CL cs.AI cs.LG 75%

Leveraging Wikidata for Geographically Informed Sociocultural Bias Dataset Creation: Application to Latin America

利用Wikidata实现地理导向的社会文化偏见数据集创建:应用于拉丁美洲

Yannis Karmim, Renato Pino, Hernan Contreras, Hernan Lira, Sebastian Cifuentes, Simon Escoffier, Luis Martí, Djamé Seddah, Valentin Barrière

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文利用Wikidata和维基百科内容创建拉丁美洲社会文化偏见数据集,通过多项选择题评估LLMs在不同文化背景下的表现差异,发现模型在原生语言中表现更佳,且伊比利亚西班牙文化认知度高于拉丁美洲文化。

Journal ref Workshop on Multilingual and Multicultural Evaluation (MME) of the 19th Conference of the European Chapter of the Association for Computational Linguistics (EACL), Pinzhen Chen; Vil{é}m Zouhar; Hanxu Hu; Simran Khanuja; Wenhao Zhu; Barry Haddow; Alexandra Birch; Alham Fikri Aji; Rico Sennrich; Sara Hooker, Mar 2026, Rabbat, Morocco

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22433 2026-03-13 cs.CV 75%

SkeletonAgent: An Agentic Interaction Framework for Skeleton-based Action Recognition

SkeletonAgent: 一种基于骨架的动作识别代理交互框架

Hongda Liu, Yunfan Liu, Changlu Wang, Yunlong Wang, Zhenan Sun

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences(神经信息处理研究室,自动化研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 评测与基准 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 SkeletonAgent通过Questioner和Selector两个代理连接识别模型与LLM,提升基于骨架的动作识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15112 2026-03-13 cs.AI 74%

ResearchGym: Evaluating Language Model Agents on Real-World AI Research

ResearchGym: 在真实世界人工智能研究中评估语言模型代理

Aniketh Garikaparthi, Manasi Patwardhan, Arman Cohan

专题命中 评测与基准 :language model(title);分类 cs.AI

AI总结 ResearchGym通过重新利用学术论文中的任务环境,评估语言模型代理在真实世界AI研究中的能力,发现其在复杂任务中存在可靠性不足的问题,但偶尔能实现前沿性能。

Comments ICLR 2026 Agents in the Wild Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11924 2026-03-13 cs.LG cs.CL 73%

Chem4DLLM: 4D Multimodal LLMs for Chemical Dynamics Understanding

Chem4DLLM: 4D 多模态大语言模型用于化学动态理解

Xinyu Li, Zhen Zhang, Qi Chen, Anton van den Hengel, Lina Yao, Javen Qinfeng Shi

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 Chem4DLLM通过整合等变图编码器和预训练大语言模型,旨在提升对4D分子动态轨迹的解释能力,推动化学动态理解和多模态科学推理的研究。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11627 2026-03-13 cs.CV 71%

Developing Foundation Models for Universal Segmentation from 3D Whole-Body Positron Emission Tomography

开发用于从3D全身正电子发射断层扫描进行通用分割的基础模型

Yichi Zhang, Le Xue, Wenbo Zhang, Lanlan Li, Feiyang Xiao, Yuchen Liu, Xiaohui Zhang, Hongwei Zhang, Shuqi Wang, Gang Feng, Liling Peng, Xin Gao, Yuanfan Xu, Yuan Qi, Kuangyu Shi, Hong Zhang, Yuan Cheng, Mei Tian, Zixin Hu

机构 * Artificial Intelligence Innovation and Incubation Institute, Fudan University, Shanghai, China(复旦大学人工智能创新与孵化院,上海,中国) Shanghai Academy of Artificial Intelligence for Science, Shanghai, China(上海人工智能科学研究院,上海,中国) Department of Nuclear Medicine and PET Center, Huashan Hospital, Fudan University, Shanghai, China(复旦大学华山医院核医学科与PET中心) Human Phenome Institute, Fudan University, Shanghai, China(复旦大学人类表型研究院) Department of Nuclear Medicine, Zhejiang Cancer Hospital, Hangzhou Institute of Medicine, Chinese Academy of Sciences, Hangzhou, China(浙江省肿瘤医院核医学科,杭州医学院,中国科学院,杭州,中国) Shanghai Universal Medical Imaging Diagnostic Center, Shanghai, China(上海通用医学影像诊断中心,上海,中国) Hangzhou Universal Medical Imaging Diagnostic Center, Hangzhou, China(杭州通用医学影像诊断中心,杭州,中国) Department of Information and Intelligence Development, Zhongshan Hospital, Fudan University, Shanghai, China(复旦大学中山医院信息与智能发展科) Department of Nuclear Medicine, Inselspital, University of Bern, Switzerland(伯尔尼大学Inselspital核医学科,瑞士)

专题命中 评测与基准 :foundation model(title)

AI总结 本文提出SegAnyPET模型,通过构建大规模PET数据集,实现通用分割任务的高效处理,适用于多种医学影像分割需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12152 2026-03-13 cs.CL 70%

LifeSim: Long-Horizon User Life Simulator for Personalized Assistant Evaluation

LifeSim: 为个性化助手评估设计的长周期用户生活模拟器

Feiyu Duan, Xuanjing Huang, Zhongyu Wei

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 LifeSim通过BDI模型模拟用户认知,生成连贯生活轨迹,提出LifeSim-Eval基准评估多场景长周期个性化协助,揭示LLMs在隐性意图和长期偏好建模上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11957 2026-03-13 cs.CL 70%

CHiL(L)Grader: Calibrated Human-in-the-Loop Short-Answer Grading

CHiL(L)Grader: 带校准置信度的循环人工参与简答评分

Pranav Raikote, Korbinian Randl, Ioanna Miliou, Athanasios Lakes, Panagiotis Papapetrou

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 CHiL(L)Grader通过校准置信度估计和人类参与流程,实现高置信度自动评分与不确定情况的人工处理,提升AI辅助评分的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11915 2026-03-13 cs.CL 70%

CoMMET: To What Extent Can LLMs Perform Theory of Mind Tasks?

CoMMET:大型语言模型在理论思维任务中能发挥多大作用?

Ruirui Chen, Weifeng Jiang, Chengwei Qin, Cheston Tan

机构 * Agency for Science, Technology and Research (A*STAR)(科技研究局) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州),中国)

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出CoMMET多模态基准数据集,用于评估大型语言模型在多轮对话中的理论思维能力,通过扩展心理状态评估和引入多轮测试,分析模型优劣势并指明未来改进方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11650 2026-03-13 cs.CL 70%

QChunker: Learning Question-Aware Text Chunking for Domain RAG via Multi-Agent Debate

QChunker: 通过多智能体辩论学习问题感知的文本分块以实现领域RAG

Jihao Zhao, Daixuan Li, Pengfei Li, Shuaishuai Zu, Biao Qin, Hongyan Liu

机构 * School of Information, Renmin University of China(中国人民大学信息学院) School of Smart Governance, Renmin University of China(中国人民大学智能治理学院) School of Information, BRAIN, Renmin University of China(中国人民大学信息学院、BRAIN学院) School of Economics and Management, Tsinghua University(清华大学经济管理学院)

专题命中 评测与基准 :language model(abstract);small language model(abstract);分类 cs.CL

AI总结 QChunker通过多智能体辩论框架,提升RAG中文本分块的语义完整性和信息粒度,采用ChunkScore评估指标,实现更高效高质量的文本分块生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11481 2026-03-13 cs.CV cs.AI 70%

INFACT: A Diagnostic Benchmark for Induced Faithfulness and Factuality Hallucinations in Video-LLMs

INFACT:用于视频大语言模型中诱导忠实性和事实性幻觉诊断的基准测试

Junqi Yang, Yuecong Min, Jie Zhang, Shiguang Shan, Xilin Chen

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 INFACT是一个用于评估视频大语言模型中诱导忠实性和事实性幻觉的诊断基准测试,通过四种模式评估模型可靠性,发现基础模式准确性并不等同于诱导模式下的可靠性,证据篡改和时间干预显著降低模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11088 2026-03-13 cs.CR cs.AI 70%

The Attack and Defense Landscape of Agentic AI: A Comprehensive Survey

代理AI的攻击与防御景观:全面调查

Juhee Kim, Xiaoyuan Liu, Zhun Wang, Shi Qiu, Bo Li, Wenbo Guo, Dawn Song

专题命中 评测与基准 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文首次系统调查了代理AI的安全性,分析了设计空间、攻击景观和防御机制,并指出现有安全不足及开放挑战,为构建安全系统和推进研究提供基础。

Comments Accepted to USENIX Security 2026. This manuscript is an extended version of the conference paper, including additional discussion and updated content

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11938 2026-03-13 cs.AI cs.CV cs.LG 62%

Prototype-Based Knowledge Guidance for Fine-Grained Structured Radiology Reporting

基于原型的知识引导的细粒度结构化放射科报告

Chantal Pellegrini, Adrian Delchev, Ege Özsoy, Nassir Navab, Matthias Keicher

机构 * Computer Aided Medical Procedures, Technische Universität München, Germany(计算机辅助医疗程序,慕尼黑技术大学,德国) Munich Center for Machine Learning, Germany(慕尼黑机器学习中心,德国)

专题命中 评测与基准 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 ProtoSR通过整合自由文本信息提升细粒度结构化放射科报告的自动化水平,利用多模态知识库和原型条件残差增强模型预测,有效改进了对罕见发现和属性的识别能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11281 2026-03-13 cs.CL 57%

ThReadMed-QA: A Multi-Turn Medical Dialogue Benchmark from Real Patient Questions

ThReadMed-QA:一个来自真实患者问题的多轮医疗对话基准测试

Monica Munnangi, Saiph Savage

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

AI总结 ThReadMed-QA是一个基于真实患者问题的多轮医疗对话基准测试,评估了五种先进LLM在多轮对话中的表现,发现单轮能力与多轮可靠性存在矛盾,模型在多轮对话中表现显著下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01204 2026-03-13 cs.LG 57%

Subliminal Signals in Preference Labels

偏好标签中的潜意识信号

Isotta Magistrali, Frédéric Berdoz, Sam Dauncey, Roger Wattenhofer

机构 * ETH Zurich(苏黎世联邦理工学院)

专题命中 评测与基准 :LLM(abstract);分类 cs.LG

AI总结 研究揭示偏好标签可能传递潜意识行为特征,挑战传统二进制监督假设,强调需机制检测并缓解潜意识偏好传输以确保超对齐的稳健监督。

Comments Accepted at AITW@ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18395 2026-03-13 cs.CL 57%

NormGenesis: Multicultural Dialogue Generation via Exemplar-Guided Social Norm Modeling and Violation Recovery

NormGenesis: 通过实例引导的社会规范建模与违反恢复实现多文化对话生成

Minki Hong, Jangho Choi, Jihie Kim

专题命中 评测与基准 :LLM(abstract);分类 cs.CL

AI总结 NormGenesis通过实例引导的社会规范建模与违反恢复,实现多文化对话生成,提升对话自然度和文化适应性。

Comments 39 pages, 17 figures, EMNLP 2025 Main Conference, Senior Area Chair (SAC) Highlights Award

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12138 2026-03-13 cs.CV 50%

HATS: Hardness-Aware Trajectory Synthesis for GUI Agents

HATS: 为GUI代理的硬度感知轨迹合成

Rui Shao, Ruize Gao, Bin Xie, Yixing Li, Kaiwen Zhou, Shuai Wang, Weili Guan, Gongwei Chen

专题命中 评测与基准 :language model(abstract)

AI总结 HATS通过硬度感知轨迹合成框架,解决GUI代理训练中语义模糊性问题,提升任务执行鲁棒性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11800 2026-03-13 cs.SE 50%

Enhancing Requirements Traceability Link Recovery: A Novel Approach with T-SimCSE

增强需求可追溯链接恢复:基于T-SimCSE的新型方法

Ye Wang, Wenqing Wang, Kun Hu, Qiao Huang, Liping Zhao

专题命中 评测与基准 :language model(abstract)

AI总结 本文提出基于SimCSE的T-SimCSE方法,通过计算需求与目标制品的相似性并重新排序,提升需求可追溯链接的恢复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11421 2026-03-13 cs.CV 50%

ShotVerse: Advancing Cinematic Camera Control for Text-Driven Multi-Shot Video Creation

ShotVerse: 提升文本驱动多镜头视频创作的电影级摄像机控制

Songlin Yang, Zhe Wang, Xuyi Yang, Songchun Zhang, Xianghao Kong, Taiyi Wu, Xiaotong Zhao, Ran Zhang, Alan Zhao, Anyi Rao

机构 * Tencent Video AI Center, PCG, Tencent(腾讯视频AI中心)

专题命中 评测与基准 :language model(abstract)

AI总结 ShotVerse通过'计划然后控制'框架,结合视觉语言模型和摄像机适配器,实现多镜头视频创作中精准的摄像机控制与高保真电影效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11306 2026-03-13 cs.CV 50%

Hierarchical Granularity Alignment and State Space Modeling for Robust Multimodal AU Detection in the Wild

层次粒度对齐与状态空间建模用于野外多模态面部动作单元检测

Jun Yu, Yunxiang Zhang, Naixiang Zheng, Lingsi Zhu, Guoyuan Wang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 评测与基准 :foundation model(abstract)

AI总结 本文提出了一种基于层次粒度对齐和状态空间模型的多模态框架,通过强大的基础模型提取高保真视觉和音频表示,并引入视觉-马尔可夫模型和不对称交叉注意机制,实现对野外环境中面部动作单元的高效检测。

Comments 8 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11213 2026-03-13 cs.HC cs.CY 50%

LLMs in social services: How does chatbot accuracy affect human accuracy?

在社会服务中使用LLM:聊天机器人准确性如何影响人类准确性?

Jennah Gosciak, Eric Giannella, Zhaowen Guo, Michael Chen, Allison Koenecke

专题命中 评测与基准 :LLM(abstract)

AI总结 本文研究了基于LLM的聊天机器人如何影响案头工作人员的准确性,发现高质量聊天机器人可显著提升工作人员表现,但准确性提升趋于平缓。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11120 2026-03-13 cs.HC 50%

The Laziness of the Crowd: Effort Aversion Among Raters Risks Undermining the Efficacy of X's Community Notes Program

人群的懒惰:评分者努力规避可能削弱X的社区笔记计划的有效性

Morgan Wack, Patrick Warren, Mustafa Alam

专题命中 评测与基准 :LLM(abstract)

AI总结 研究发现评分者因懒惰而避免评估需要更多努力的合理虚假信息,可能削弱X社区笔记计划的有效性。

Comments 52 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 效率与部署 51 篇

2603.11881 2026-03-13 cs.CL cs.AI 90%

Bielik-Minitron-7B: Compressing Large Language Models via Structured Pruning and Knowledge Distillation for the Polish Language

Bielik-Minitron-7B:通过结构化剪枝和知识蒸馏压缩大型语言模型以适应波兰语

Remigiusz Kinas, Paweł Kiszczak, Sergio P. Perez, Krzysztof Ociepa, Łukasz Flis, Krzysztof Wróbel, Adrian Gwoździej

专题命中 效率与部署 :language model(title,abstract);large language model(title);SFT(abstract);preference optimization(abstract)

AI总结 Bielik-Minitron-7B通过结构化剪枝和知识蒸馏将Bielik-11B-v3.0模型压缩至7.35B参数,优化波兰语性能,实现90%的性能恢复和50%的推理加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16439 2026-03-13 cs.CL 89%

FrugalPrompt: Reducing Contextual Overhead in Large Language Models via Token Attribution

FrugalPrompt:通过令牌归因减少大型语言模型中的上下文开销

Syed Rifat Raiyan, Md Farhan Ishmam, Abdullah Al Imran, Mohammad Ali Moni

机构 * Islamic University of Technology(伊斯兰科技大学) University of Utah(犹他大学) University of Liverpool(利物浦大学) University of Queensland(昆士兰大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 FrugalPrompt通过令牌归因方法减少大型语言模型的上下文开销,保留最语义重要的令牌以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11877 2026-03-13 eess.AS 89%

Silent Speech Interfaces in the Era of Large Language Models: A Comprehensive Taxonomy and Systematic Review

在大语言模型时代的大声接口:全面的分类法和系统性综述

Kele Xu, Yifan Wang, Ming Feng, Qisheng Xu, Wuyang Chen, Yutao Dou, Cheng Yang, Huaimin Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

AI总结 本文综述了在大语言模型时代无声语音接口的发展,探讨了从传统传感器到意图执行的分类法,分析了生物信号处理的转变,并提出了未来发展方向和伦理边界。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11828 2026-03-13 physics.optics 89%

Large language models for optical network O&M: Agent-embedded workflow for automation

大语言模型用于光网络运维:嵌入代理的工作流自动化

Shengnan Li, Yidi Wang, Fubin Wang, Yujia Yang, Yao Zhang, Yuchen Song, Xiaotian Jiang, Yue Pang, Min Zhang, Danshi Wang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于代理的多代理协作架构,利用大语言模型提升光网络运维的自动化水平,通过整合LLM能力与现有工具,实现任务执行的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16083 2026-03-13 cs.CL cs.AI cs.LG 89%

Efficient Compositional Multi-tasking for On-device Large Language Models

高效设备端大语言模型的组合多任务处理

Ondrej Bohdal, Mete Ozay, Jijoong Moon, Kyeng-Hun Lee, Hyeonmok Ko, Umberto Michieli

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种高效的设备端多任务处理方法,通过任务融合提升大语言模型在复杂多任务场景中的性能。

Comments Accepted at EMNLP 2025 (main track, long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23830 2026-03-13 cs.DC cs.AI 88%

OrchMLLM: Orchestrate Multimodal Data with Batch Post-Balancing to Accelerate Multimodal Large Language Model Training

OrchMLLM: 通过批量后平衡 orchestrate 多模态数据以加速多模态大语言模型训练

Yijie Zheng, Bangjun Xiao, Lei Shi, Xiaoyang Li, Faming Wu, Tianyu Li, Xuefeng Xiao, Yang Zhang, Yuxuan Wang, Shouda Liu

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 OrchMLLM通过批量后平衡调度器和全局协调器解决多模态数据训练中的模态不一致问题,提升训练效率和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12229 2026-03-13 cs.MA 87%

Language Model Teams as Distributed Systems

语言模型团队作为分布式系统

Elizabeth Mieczkowski, Katherine M. Collins, Ilia Sucholutsky, Natalia Vélez, Thomas L. Griffiths

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

AI总结 本文提出将分布式系统作为原则性基础,用于创建和评估语言模型团队,揭示LLM团队与分布式计算中的共同挑战和优势。

详情

展开后加载摘要…

URL PDF HTML 收藏