arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 1722 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1722 篇

2203.13464 2024-04-08 cs.LG cs.AI cs.IT math.IT 62%

From MIM-Based GAN to Anomaly Detection:Event Probability Influence on Generative Adversarial Networks

Rui She, Pingyi Fan

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08429 2024-03-14 cs.SE cs.AI 62%

Software Vulnerability and Functionality Assessment using LLMs

Rasmus Ingemann Tuffveson Jensen, Vali Tawosi, Salwa Alamir

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

Comments 4 pages, accepted to NLBSE'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08299 2024-03-14 cs.SE cs.AI 62%

AutoDev: Automated AI-Driven Development

Michele Tufano, Anisha Agarwal, Jinu Jang, Roshanak Zilouchian Moghaddam, Neel Sundaresan

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06382 2024-03-12 cs.CV cs.AI cs.LG 62%

Pre-Trained Model Recommendation for Downstream Fine-tuning

Jiameng Bai, Sai Wu, Jie Song, Junbo Zhao, Gang Chen

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01940 2024-03-12 cs.CL cs.AI 62%

CodeApex: A Bilingual Programming Evaluation Benchmark for Large Language Models

Lingyue Fu, Huacan Chai, Shuang Luo, Kounianhua Du, Weiming Zhang, Longteng Fan, Jiayi Lei, Renting Rui, Jianghao Lin, Yuchen Fang, Yifan Liu, Jingkuan Wang, Siyuan Qi, Kangning Zhang, Weinan Zhang, Yong Yu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 33pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05873 2024-03-12 cs.SE cs.IR cs.LG 62%

LEGION: Harnessing Pre-trained Language Models for GitHub Topic Recommendations with Distribution-Balance Loss

Yen-Trang Dang, Thanh-Le Cong, Phuc-Thanh Nguyen, Anh M. T. Bui, Phuong T. Nguyen, Bach Le, Quyet-Thang Huynh

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.LG

Comments Accepted to EASE'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01784 2024-03-05 cs.AI cs.PL 62%

CatCode: A Comprehensive Evaluation Framework for LLMs On the Mixture of Code and Text

Zhenru Lin, Yiqun Yao, Yang Yuan

专题命中 代码评测 :code generation(abstract);分类 cs.AI、cs.PL

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09910 2024-03-05 cs.LG cs.AI cs.CV 62%

LabelBench: A Comprehensive Framework for Benchmarking Adaptive Label-Efficient Learning

Jifan Zhang, Yifang Chen, Gregory Canal, Stephen Mussmann, Arnav M. Das, Gantavya Bhatt, Yinglun Zhu, Jeffrey Bilmes, Simon Shaolei Du, Kevin Jamieson, Robert D Nowak

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12351 2024-02-27 cs.CL cs.LG 62%

Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey

Yunpeng Huang, Jingwei Xu, Junyu Lai, Zixu Jiang, Taolue Chen, Zenan Li, Yuan Yao, Xiaoxing Ma, Lijuan Yang, Hao Chen, Shupeng Li, Penghao Zhao

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.LG

Comments 40 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14261 2024-02-23 cs.SE cs.AI 62%

Copilot Evaluation Harness: Evaluating LLM-Guided Software Programming

Anisha Agarwal, Aaron Chan, Shubham Chandel, Jinu Jang, Shaun Miller, Roshanak Zilouchian Moghaddam, Yevhen Mohylevskyy, Neel Sundaresan, Michele Tufano

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11565 2024-02-20 cs.LG cs.AI 62%

Continual Learning on Graphs: Challenges, Solutions, and Opportunities

Xikun Zhang, Dongjin Song, Dacheng Tao

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09136 2024-02-15 cs.CL cs.AI 62%

DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning

Yejie Wang, Keqing He, Guanting Dong, Pei Wang, Weihao Zeng, Muxi Diao, Yutao Mou, Mengdi Zhang, Jingang Wang, Xunliang Cai, Weiran Xu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15810 2024-01-30 cs.SE cs.AI 62%

Green Runner: A tool for efficient deep learning component selection

Jai Kannan

专题命中 代码评测 :repository(abstract);分类 cs.SE、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05940 2024-01-12 cs.SE cs.AI 62%

Mutation-based Consistency Testing for Evaluating the Code Understanding Capability of LLMs

Ziyu Li, Donghwan Shin

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

Comments This is an author-preprint. The published version will be included in the proceedings of CAIN 2024 (co-located with ICSE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15685 2023-12-21 cs.CL cs.AI 62%

RewriteLM: An Instruction-Tuned Large Language Model for Text Rewriting

Lei Shu, Liangchen Luo, Jayakumar Hoskere, Yun Zhu, Yinxiao Liu, Simon Tong, Jindong Chen, Lei Meng

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Journal ref AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.04023 2023-11-29 cs.CL cs.AI 62%

A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity

Yejin Bang, Samuel Cahyawijaya, Nayeon Lee, Wenliang Dai, Dan Su, Bryan Wilie, Holy Lovenia, Ziwei Ji, Tiezheng Yu, Willy Chung, Quyet V. Do, Yan Xu, Pascale Fung

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 45 pages, AACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14139 2023-11-27 cs.LG cs.AI 62%

Machine Learning For An Explainable Cost Prediction of Medical Insurance

Ugochukwu Orji, Elochukwu Ukwandu

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments 42 pages, 16 figures and 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10548 2023-11-27 cs.SD cs.AI cs.LG eess.AS 62%

MARBLE: Music Audio Representation Benchmark for Universal Evaluation

Ruibin Yuan, Yinghao Ma, Yizhi Li, Ge Zhang, Xingran Chen, Hanzhi Yin, Le Zhuo, Yiqi Liu, Jiawen Huang, Zeyue Tian, Binyue Deng, Ningzhi Wang, Chenghua Lin, Emmanouil Benetos, Anton Ragni, Norbert Gyenge, Roger Dannenberg, Wenhu Chen, Gus Xia, Wei Xue, Si Liu, Shi Wang, Ruibo Liu, Yike Guo, Jie Fu

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments camera-ready version for NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09707 2023-11-17 cs.CL cs.PL 62%

GenCodeSearchNet: A Benchmark Test Suite for Evaluating Generalization in Programming Language Understanding

Andor Diera, Abdelhalim Dahou, Lukas Galke, Fabian Karl, Florian Sihler, Ansgar Scherp

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.PL

Comments accepted at GenBench workshop, EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11986 2023-11-02 cs.AI cs.CL cs.CY 62%

Sociotechnical Safety Evaluation of Generative AI Systems

Laura Weidinger, Maribeth Rauh, Nahema Marchal, Arianna Manzini, Lisa Anne Hendricks, Juan Mateos-Garcia, Stevie Bergman, Jackie Kay, Conor Griffin, Ben Bariach, Iason Gabriel, Verena Rieser, William Isaac

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments main paper p.1-29, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.00521 2023-09-26 cs.LG cs.AI cs.MA 62%

Off-the-Grid MARL: Datasets with Baselines for Offline Multi-Agent Reinforcement Learning

Claude Formanek, Asad Jeewa, Jonathan Shock, Arnu Pretorius

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments Extended Abstract at Autonomous Agents and Multi-Agent Systems Conference 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04369 2023-09-11 cs.CL cs.AI 62%

Beyond Static Datasets: A Deep Interaction Approach to LLM Evaluation

Jiatong Li, Rui Li, Qi Liu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12415 2023-08-25 cs.SE cs.AI 62%

Benchmarking Causal Study to Interpret Large Language Models for Source Code

Daniel Rodriguez-Cardenas, David N. Palacio, Dipin Khati, Henry Burke, Denys Poshyvanyk

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.AI

Comments 6 pages, 4 tables, 3 figures, accepted to ICSME 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15850 2023-08-01 stat.ML cs.AI cs.LG 62%

Comprehensive Algorithm Portfolio Evaluation using Item Response Theory

Sevvandi Kandanaarachchi, Kate Smith-Miles

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14150 2023-07-18 cs.CL cs.AI 62%

WYWEB: A NLP Evaluation Benchmark For Classical Chinese

Bo Zhou, Qianglong Chen, Tianyu Wang, Xiaomi Zhong, Yin Zhang

专题命中 代码评测 :repository(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2023

Journal ref https://aclanthology.org/2023.findings-acl.204

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.04556 2023-06-08 cs.LG cs.HC cs.SE 62%

StudentEval: A Benchmark of Student-Written Prompts for Large Language Models of Code

Hannah McLean Babe, Sydney Nguyen, Yangtian Zi, Arjun Guha, Molly Q Feldman, Carolyn Jane Anderson

专题命中 代码评测 :code generation(abstract);分类 cs.SE、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.10166 2023-06-05 stat.ML cs.AI cs.LG 62%

QCBA: Improving Rule Classifiers Learned from Quantitative Data by Recovering Information Lost by Discretisation

Tomas Kliegr, Ebroul Izquierdo

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

Comments online-first. Appl Intell (2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18575 2023-05-31 cs.PL cs.AI 62%

Search-Based Regular Expression Inference on a GPU

Mojtaba Valizadeh, Martin Berger

专题命中 代码评测 :program synthesis(abstract);分类 cs.AI、cs.PL

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13547 2023-03-27 cs.CL cs.AI 62%

A comprehensive evaluation of ChatGPT's zero-shot Text-to-SQL capability

Aiwei Liu, Xuming Hu, Lijie Wen, Philip S. Yu

专题命中 代码评测 :code generation(abstract);分类 cs.CL、cs.AI

Comments 6 pages, 1 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.12749 2023-02-07 stat.ML cs.AI cs.LG 62%

Deep Latent State Space Models for Time-Series Generation

Linqi Zhou, Michael Poli, Winnie Xu, Stefano Massaroli, Stefano Ermon

专题命中 代码评测 :repository(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏