Agentic coding without the cloud: evaluating open-weight large language models on longitudinal data preparation tasks
无需云端的智能编码:在纵向数据准备任务中评估开放权重的大语言模型
AI总结 研究在纵向数据准备任务中评估开放权重的大语言模型,介绍开源框架,含真实数据集、任务定义和评估程序,通过基准测试发现当前先进模型表现良好,为治理受限研究中的AI辅助数据准备提供可行路径。
Comments Presented at SLLS 2026; accepted at CLS 2026 and RSS 2026