arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-20 至 2026-08-20 共收录 185 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 13 篇

2608.18144 2026-08-20 cs.CL cs.AI 新提交 91%

The Deontic Gap: Large Language Models and the Modal Language of Obligation

义务缺口:大语言模型与义务的模态语言

Daniel Hart, Sarah Allred, Joseph Abbas, Morenike Alugo

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本研究发现大语言模型的义务情态使用模式与当代人类存在缺口,其情态使用反映训练的正式书面资源,少用标记即时人际义务的情态结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18816 2026-08-20 cs.CL cs.AI 新提交 88%

Do Large Language Models Hallucinate Electric Fata Morganas?

大语言模型会产生“电气海市蜃楼”式的幻觉吗?

Kristina Šekrst

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文探讨大语言模型幻觉的哲学意义,通过两项实证研究分析其成因,结合相关理论指出模型的情感自我陈述属于幻觉范畴,未来机器意识或因与高级幻觉无法区分而无法被认知。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18655 2026-08-20 cs.CL 新提交 81%

TranslatePsy-AfriSLM: High-Quality Data Scaling For Low-Resource Machine Translation

TranslatePsy-AfriSLM:面向低资源机器翻译的高质量数据扩展

Milan Gritta, Patrik Lambert, Jihye Back, Amril Nazir

机构 * Tether AI Research(泰瑟人工智能研究院)

专题命中 预训练与数据 :LLM(abstract_cn);language model(abstract);small language model(abstract);SLM(abstract_cn)

AI总结 针对非洲语言机器翻译的数字鸿沟问题,推出面向19种撒哈拉以南非洲语言的开源资源TranslatePsy-AfriSLM,经质量过滤后构建的小参数模型性能远超更大规模的同类系统。

Comments EMNLP 2026 (under ARR, meta review of 4, awaiting accept decision)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18138 2026-08-20 cs.CL cs.AI 新提交 81%

Language Models for Portuguese: A Systematic Mapping Study

面向葡萄牙语的语言模型:一项系统映射研究

Jhessica Silva, Carlos Caetano, Helena Maia, Breno Bernard Nicolau de França, Sandra Avila, Helio Pedrini

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究通过系统映射梳理出46个葡萄牙语语言模型,分析其特征、演变及关系,明确研究缺口并展望未来方向,为该领域发展提供全面概览。

Comments 37 pages; 7 figures; 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18094 2026-08-20 cs.CL cs.AI 新提交 81%

NE-BERT: A Multilingual Language Model for Nine Northeast Indian Languages

NE-BERT:适用于9种印度东北部语言的多语言语言模型

Badal Nyalang

机构 * MWire Labs(MWire实验室)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对印度东北部9种低资源语言的代表性不足问题,提出NE-BERT多语言语言模型,通过加权采样等技术提升性能,解决词汇碎片化,发布资源推动当地NLP研究与数字包容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18681 2026-08-20 cs.CL 新提交 77%

Learning What to Fail On: Failure-Mode Contextual Bandits for Adversarial Data Curation

学习失败的诱因:用于对抗性数据策展的失败模式上下文多臂老虎机

Roie Kazoom, Ofir Cohen, Rami Puzis, Asaf Shabtai, Ofer Hadar

机构 * Ben Gurion University of The Negev(本古里安大学内盖夫分校)

专题命中 预训练与数据 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.CL

AI总结 该研究提出失败模式上下文多臂老虎机框架,通过检索增强等技术优化对抗性数据策展,在多项自然语言理解基准上提升模型准确率,还可迁移至事实核查任务,实现无需额外人工标注的鲁棒性提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18821 2026-08-20 cs.CL cs.AI 新提交 73%

Identifying Implicit Premises for Logical Reconstruction of Argument Graphs

识别论证图逻辑重构的隐含前提

Xuyao Feng, Anthony Hunter

机构 * University College London(伦敦大学学院)

专题命中 预训练与数据 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文针对论证图逻辑重构中省略式论证的隐含前提问题,提出神经符号管道方法,结合大型语言模型生成隐含前提并评估,用于证明陈述间的逻辑关系。

Comments Accepted at the 11th International Conference on Computational Models of Argument (COMMA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18689 2026-08-20 cs.CL cs.AI 新提交 71%

Aslema at NADI 2026: Augmentation through Fewshot for SLU

Aslema 参与 NADI 2026:基于少样本的 SLU 增强方法

Tajwaar Shafiq, Hunzalah Hassan Bhatti, Shammur Absar Chowdhury, Firoj Alam

机构 * Qatar Computing Research Institute(卡塔尔计算研究所)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL、cs.AI;large language model(comments);language model(comments)

AI总结 Aslema 系统参与 NADI 2026 共享任务 5,通过微调模型及合成数据增强(含文化适配语句生成与语音克隆)提升性能,在官方测试集槽填充排第1、意图识别排第4,将公开脚本与合成数据集。

Comments LLMs, Native, Arabic LLMs, Augmentation, Multilingual, Multimodal, Language Diversity, Contextual Understanding, Minority Languages, Culturally Informed, Foundation Models, Large Language Models, Audio Models, Omni Models, Slot Filling

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18613 2026-08-20 cs.AI cs.CR 新提交 70%

CTIFoundry: An Agent-Native Corpus Scaffold for Cyber Threat Intelligence

CTIFoundry:用于网络威胁情报的智能体原生语料库支架

Yutong Cheng, Changze Li, Qian Cui, Wei Ding, Lingzhi Wang, Yan Chen, Peng Gao

机构 * Virginia Tech(弗吉尼亚理工大学) Amazon(亚马逊公司) Northwestern University(西北大学)

专题命中 预训练与数据 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 CTIFoundry是用于网络威胁情报的智能体原生语料库支架,在CTIConnect基准测试中可使智能体F1提升0.19至0.28,小型模型在其上表现优于旗舰模型,且无需增加搜索工作量。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18486 2026-08-20 cs.CL cs.LG 新提交 62%

WhiteMatter: All-to-All Cross-Layer Connections via KV Mixing

WhiteMatter:通过KV混合实现全对全跨层连接

Wenbo Zhang, Xiang Ren

机构 * University of Southern California(南加州大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.LG

AI总结 WhiteMatter通过将每个注意力层连接到所有过去token的所有层表示,以可变连接权重实现全对全跨层KV混合,在预训练中性能优于多50%层数的普通Transformer,缓存压缩50%仍保留大部分增益。

Comments 15 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19133 2026-08-20 cs.CL 新提交 57%

Comment-level Topic Drift Analysis in the Reddit Corpus

Reddit语料库中评论级别的主题漂移分析

Steven Morse, Daniel Runfola, Trenton W. Ford

机构 * William & Mary(威廉玛丽学院)

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

AI总结 该研究将嵌入式动态主题建模技术应用于Reddit语料库,分析127亿条2006-2022年的评论,提出嵌入空间内语义漂移分析方法,发现争议性主题漂移显著而文体类主题相对稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18667 2026-08-20 cs.CV 新提交 50%

Teeth2Point: A Two-Stage Dental CBCT ROI-to-Point Segmentation Framework

Teeth2Point:一种两阶段牙科CBCT ROI到点的分割框架

Qi Ma, Shipra Jain, Niko Benjamin Huber, Ender Konukoglu

机构 * ETH Zurich(苏黎世联邦理工学院) Align Technology(Align Technology公司)

专题命中 预训练与数据 :pretraining(abstract)

AI总结 针对牙科CBCT中牙齿缺失或错位的标注难题,提出Teeth2Point框架,通过卷积定位ROI、自适应采样转点令牌,结合SSL预训练与监督微调,在四个数据集上较基线显著提升异常病例分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18515 2026-08-20 cs.CV 新提交 50%

Cross-Modal MRI Ovary Segmentation in Endometriosis Using Unpaired TVUS Prototype Priors

基于未配对经阴道超声(TVUS)原型先验的子宫内膜异位症跨模态MRI卵巢分割

Xingjian Kang, Lina Felsner, Dominik Perrin, Daiqi Liu, Jasmin Arjomandi, Franziska Mathis-Ullrich, Alexandra Stoll, Katharina Breininger

机构 * Center for AI and Data Science (CAIDAS), Julius-Maximilians-Universität Würzburg(维尔茨堡大学人工智能与数据科学中心) Institute for Computational Imaging and AI in Medicine (CompAI), Technical University of Munich(慕尼黑工业大学计算成像与医学人工智能研究所) Pattern Recognition Lab, Friedrich-Alexander Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡大学模式识别实验室) Department Artificial Intelligence in Biomedical Engineering (AIBE), Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡大学生物医学工程人工智能系)

专题命中 预训练与数据 :pretraining(abstract)

AI总结 针对子宫内膜异位症MRI卵巢分割难题,本研究提出结合TVUS原型库的双分支框架,适配MedSAM3对齐跨模态特征,在相关数据集上较SOTA方法提升超5个百分点,验证了原型库与热身预训练的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 16 篇

2608.18686 2026-08-20 cs.CR 新提交 92%

Improving LLM-Based SSH Honeypots Through Prompting and Fine-Tuning

通过提示工程和微调改进基于大语言模型(LLM)的SSH蜜罐

Muris Sladić, Veronica Valeros, Eman Alibalić, Sebastian Garcia

专题命中 指令微调 :LLM(title,title_cn);prompting(title,abstract)

AI总结 本文通过提示设计和微调改进本地LLM SSH蜜罐,发现提示设计影响显著,扩展数据集微调可提升性能,但提示与微调效果无法简单结合,二者可能因重叠约束产生冲突。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18132 2026-08-20 cs.CL cs.SD eess.AS 新提交 91%

Alignment Is All You Need: Instruction-Free Training for General Audio-Language Models

对齐即全部所需:通用音频-语言模型的无指令训练

Xuanru Zhou, Yiwen Shao, Jiahong Li, Dong Yu

机构 * Zhejiang University(浙江大学) Tencent Hunyuan(腾讯混元)

专题命中 指令微调 :language model(title,abstract);LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract)

AI总结 该研究提出仅对齐的无指令大音频-语言模型LALM,仅训练轻量投影器,在多模态数据集上用更少数据达到或优于基线,证明仅靠对齐即可构建有竞争力的多模态大语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18654 2026-08-20 cs.CV 新提交 89%

Clinically Structured Surrogate Rewards for Post-SFT Medical Image Captioning

SFT后医学图像字幕生成的临床结构化替代奖励

Hyun Jun Kim, Heeseung Shin, Changwon Lim

专题命中 指令微调 :SFT(title,title_cn)

AI总结 该研究针对SFT后医学图像字幕生成,提出临床结构化替代奖励框架,结合生物医学语义等,在ImageCLEFmedical Caption测试集及三个主干上,提升了整体、相关性与事实性指标。

Comments 8 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18767 2026-08-20 cs.CL cs.LG 新提交 87%

Gradient Mirage: Trainable yet Label-Unidentifiable Gradients in Large Language Model Split Learning

梯度幻影:大语言模型拆分学习中可训练且标签不可识别的梯度

Shiyu Miao, Yunlong Mao, Zirui Huang, Liang Yao, Tianshuo Zheng, Yanhui Gu, Fan Liu, Sheng Zhong

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.LG

AI总结 针对大语言模型拆分学习中梯度匹配攻击的标签泄露问题,提出Gradient Mirage防御方法,通过三个维度的不一致性打破梯度-目标一致性,在保留优化效用的同时提升隐私保护,实现更优的隐私-效用权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18085 2026-08-20 cs.CL 新提交 85%

Persona-Guided LLM Agents for Task-Oriented Dialogue

面向任务型对话的角色引导大语言模型智能体

Maryam Shoaeinaeini, Brent Harrison, A.B. Siddique

机构 * University of Kentucky(肯塔基大学)

专题命中 指令微调 :LLM(title,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究构建无需训练的框架,通过三种情境评估多模型在SGD数据集上的表现,发现适应用户人格存在权衡,Try情境的线索式适应可更可靠实现感知人格的任务型对话。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18100 2026-08-20 cs.CL cs.AI cs.CY 新提交 85%

Computational Orientalism: Measuring Structural Discourse Bias in Large Language Models Using the Middle East Cultural Sensitivity Score (MECSS)

计算东方主义:使用中东文化敏感性评分(MECSS)测量大语言模型中的结构性话语偏见

Maha Shahid

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL、cs.AI

AI总结 该研究提出MECSS框架测量大语言模型的东方主义结构性话语偏见,发现GPT-4和Falcon3-7B-Instruct均存在系统性东方主义模式,且Falcon3-7B-Instruct得分更高,Said-washing现象普遍存在。

Comments 16 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18539 2026-08-20 cs.LG cs.AI cs.CL 新提交 83%

Evaluating and Explaining Prompt Sensitivity of LLMs Using Interactions

利用交互作用评估与解释大语言模型的提示敏感性

Ruiyang Qin, Qingzhuo Wang, Tian Wang, Zhihua Wei, Wen Shen

机构 * School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出基于交互作用的IPS指标,分析50个开源LLMs的提示敏感性,发现监督微调等四个因素可通过降低低阶交互作用的敏感性减少提示波动。

Comments Accepted at the 43rd International Conference on Machine Learning (ICML 2026). 46 pages, 48 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18171 2026-08-20 cs.AI cs.LG 新提交 81%

Looped Language Models Improve Compositional Tool Calling

循环语言模型可提升组合式工具调用能力

Andrei Cristian Popescu, Haitz Sáez de Ocáriz Borde, Pietro Liò

机构 * University of Cambridge(剑桥大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究在组合式工具调用场景下,通过在多个数据集上对比循环与非循环语言模型,发现循环计算可提升组合式工具使用性能,自适应推理能实现更优计算-性能权衡,为智能体系统提供了有前景的架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18855 2026-08-20 cs.IR 新提交 80%

Think-to-Personalize: Unifying Reasoning and Retrieval for User-Centric Personalized Dense Retrieval

思考以个性化:统一推理与检索的以用户为中心的个性化密集检索

Angqing Jiang, Gaoming Zhang, Jianchun Song, Kena Qi, Dayao Chen, Wei Lin, Defu Lian

专题命中 指令微调 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出TTP框架,将用户意图推理与密集检索统一,经两阶段训练后在电商场景实验及在线测试中均取得优于基线的效果,提升了订单量。

Comments Accepted at CIKM 2026. 11 pages, 8 figures, and 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18597 2026-08-20 cs.LG 新提交 79%

Off-Manifold Collapse in Guided Protein Language Models

引导式蛋白质语言模型中的流形外坍塌

Shuibai Zhang, Xinchi Liu, Fred Zhangzhi Peng, Zhihan Yang, Shutong Wu, Yingzi Ma, Jiawei Zhang

机构 * Duke University(杜克大学) Cornell University(康奈尔大学) University of Wisconsin--Madison(威斯康星大学麦迪逊分校)

专题命中 指令微调 :language model(title,abstract);分类 cs.LG

AI总结 该研究发现引导式蛋白质语言模型存在流形外坍塌问题,提出无需训练的马氏过滤方法,可低成本提升生成序列的属性得分与结构合理性,且可跨引导方法迁移。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18438 2026-08-20 cs.CL cs.AI cs.LG 新提交 78%

Pedagogical AI in Mental Health: A Tri-Stream Fine-Tuned LLM Framework for Automated Clinical Supervision and Risk Triage

心理健康领域的教学式AI:用于自动化临床监督与风险分诊的三通路微调大语言模型框架

Shreeya Sharma, Ravish Gupta, Saket Kumar, Abhishek Aggarwal

机构 * Microsoft(微软) BigCommerce University at Buffalo, The State University of New York(纽约州立大学布法罗分校) Amazon(亚马逊)

专题命中 指令微调 :LLM(title);分类 cs.CL、cs.AI、cs.LG

AI总结 针对精神医疗的监督缺口,提出三通路微调Mistral-7B-instruct框架,实现自动化临床监督与风险分诊,提升效率并解决冷启动问题。

Comments 14 pages, 1 figure, 2 tables. Accepted for publication in AICTC 2026, Lecture Notes in Networks and Systems, vol. 2165, Springer

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19000 2026-08-20 cs.CV 新提交 75%

Mise-en-Scène: Implicit Layout Emergence in Diffusion Transformers for Human-AI Design Co-Creation

场景布置(Mise-en-Scène):用于人机协同设计共创的扩散Transformer中隐式布局的涌现

Zipeng Xu, Ryan Murdock, Umberto Michieli

机构 * Canva Research(Canva研究院)

专题命中 指令微调 :LLM(abstract,abstract_cn);language model(abstract)

AI总结 本文提出Mise-en-Scène框架,通过微调扩散Transformer实现隐式布局涌现,结合匹配放置步骤保证素材保真度,在PrismLayersPlus基准上生成的设计感知质量显著优于现有方法。

Comments Best Paper Award at ECCV Human-AI Co-Creation Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18142 2026-08-20 cs.AI cs.CL 新提交 73%

Efficient Adaptation of LLMs for Hate Speech Detection in Low-Resource Languages: A Comparative Study on Roman Urdu

低资源语言仇恨言论检测的大语言模型高效适配:以罗马乌尔都语为例的比较研究

Toneema Zubair, Muhammad Junaid Asif, Faisal Kamiran, Hafiz Hassan Saeed, Rana Fayyaz Ahmad

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文针对罗马乌尔都语仇恨言论检测的低资源语言场景,对比评估Mistral等大语言模型,发现采用LoRA参数高效微调可显著提升性能,且计算效率优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18731 2026-08-20 cs.CV cs.AI 新提交 70%

A Few Cases Are All You Need: An Empirical Study of Annotation-Efficient LoRA Fine-Tuning of MedSAM3

少数案例足矣:对MedSAM3的标注高效LoRA微调的实证研究

Sachin Dudda Nagaraju, Bendik Skarre Abrahamsen, Ashkan Moradi, Mattijs Elschot

机构 * Norwegian University of Science and Technology(挪威科技大学) St. Olavs Hospital, Trondheim University Hospital(圣奥拉夫斯医院(特隆赫姆大学医院))

专题命中 指令微调 :foundation model(abstract);pretraining(abstract);分类 cs.AI

AI总结 该研究针对MedSAM3,用LoRA微调实现仅10个标注案例即可让医学图像分割达到临床可用性能,在腹部器官和心脏分割任务上优于部分专业工具,且训练速度更快。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18696 2026-08-20 cs.CV cs.AI 新提交 70%

Impact of Iterative Fine-Tuning on Transcription Accuracy in Complex Historical Sanskrit Manuscripts

迭代微调对复杂历史梵文手稿转录准确率的影响

Kartik Chincholikar, Kaushik Gopalan, Mihir Hasabnis

机构 * Centre for Inter-disciplinary Artificial Intelligence (CAI)(跨学科人工智能中心(CAI)) FLAME University(火焰大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对复杂历史梵文手稿的OCR挑战,提出可在布局与外观层级迭代微调的传统OCR流水线,构建含精细标注的数据集,验证了迭代微调的性能提升并完成多模态大模型基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18090 2026-08-20 cs.CL cs.AI 新提交 62%

Nine Emotion Centroids: A Label-Free Valence Axis That Transfers Across Four Modalities

九个情绪质心:跨四种模态迁移的无标签效价轴

Yousef Radwan

机构 * KAUST(阿卜杜拉国王科技大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出一种仅用9个情绪类别名称和少量叙事段落即可找到跨视觉、音频等四种模态迁移的无标签效价轴的方法,该轴在多模态情感任务中表现优异且具有机制活性。

Comments 15 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 9 篇

2608.19072 2026-08-20 cs.AI cs.CL cs.LG 新提交 91%

What is Missing from AI Post-Training AI: An Empirical Analysis

AI后训练AI缺失了什么?一项实证分析

Joy Jia Yin Lim, Xin Huang, Hao Peng, Yaxi Lu, Xin Cong, Zhong Zhang, Maosong Sun, Yankai Lin

机构 * Tsinghua University(清华大学) University of Electronic Science and Technology of China(电子科技大学) Renmin University of China(中国人民大学)

专题命中 后训练与偏好优化 :LLM(summary_cn,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过实证分析发现,LLM智能体后训练时存在策略锁定问题,其缺失的是执行过程中自发重新评估训练策略的机制,而非经验、指导或推理计算。

详情

展开后加载摘要…

URL PDF HTML 收藏