Exploring the Reasoning Depth of Small Language Models in Software Architecture: A Multidimensional Evaluation Framework Towards Software Engineering 2.0
探索小型语言模型在软件架构中的推理深度:一项面向软件工程2.0的多维评估框架
专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);large language model(abstract);prompting(abstract)
AI总结 本研究通过多维评估框架评估小型语言模型在软件架构中的推理深度,发现参数阈值影响推理能力,揭示了中等大小模型在短上下文下的校准机制及语义多样性与幻觉的相关性。
Comments Accepted at ICSA 2026