arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 1729 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1729 篇

2407.09424 2024-07-15 eess.SP cs.AI 57%

TelecomGPT: A Framework to Build Telecom-Specfic Large Language Models

Hang Zou, Qiyang Zhao, Yu Tian, Lina Bariah, Faouzi Bader, Thierry Lestable, Merouane Debbah

专题命中 代码评测 :code generation(abstract);分类 cs.AI

Comments arXiv admin note: text overlap with arXiv:1303.2654 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04796 2024-07-15 cs.CL 57%

Toucan: Many-to-Many Translation for 150 African Language Pairs

AbdelRahim Elmadany, Ife Adebara, Muhammad Abdul-Mageed

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14027 2024-07-11 cs.CR cs.AI 57%

(Security) Assertions by Large Language Models

Rahul Kande, Hammond Pearce, Benjamin Tan, Brendan Dolan-Gavitt, Shailja Thakur, Ramesh Karri, Jeyavijayan Rajendran

专题命中 代码评测 :code generation(abstract);分类 cs.AI

Comments This article has been accepted for publication in IEEE Transactions on Information Forensics and Security. This is the author's version. See https://ieeexplore.ieee.org/document/10458667 for the published version of the paper. Citation information: DOI 10.1109/TIFS.2024.3372809. See https://www.ieee.org/publications/rights/index.html for information on publication rights

Journal ref IEEE Transactions on Information Forensics and Security. 2024 Mar 4

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17008 2024-07-03 cs.LG stat.ML 57%

Meta-learning and Data Augmentation for Stress Testing Forecasting Models

Ricardo Inácio, Vitor Cerqueira, Marília Barandas, Carlos Soares

专题命中 代码评测 :repository(abstract);分类 cs.LG

Comments 16 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03672 2024-07-02 cs.CR cs.LG 57%

Cutting through buggy adversarial example defenses: fixing 1 line of code breaks Sabre

Nicholas Carlini

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13737 2024-06-25 cs.CL 57%

EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation

Atnafu Lambebo Tonja, Israel Abebe Azime, Tadesse Destaw Belay, Mesay Gemeda Yigezu, Moges Ahmed Mehamed, Abinew Ali Ayele, Ebrahim Chekol Jibril, Michael Melese Woldeyohannis, Olga Kolesnikova, Philipp Slusallek, Dietrich Klakow, Shengwu Xiong, Seid Muhie Yimam

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments Accepted at LREC-Coling 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15019 2024-06-24 cs.CL 57%

MedOdyssey: A Medical Domain Benchmark for Long Context Evaluation Up to 200K Tokens

Yongqi Fan, Hongli Sun, Kui Xue, Xiaofan Zhang, Shaoting Zhang, Tong Ruan

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14712 2024-06-24 quant-ph cs.AI 57%

Qiskit HumanEval: An Evaluation Benchmark For Quantum Code Generative Models

Sanjay Vishwakarma, Francis Harkins, Siddharth Golecha, Vishal Sharathchandra Bajpe, Nicolas Dupuis, Luca Buratti, David Kremer, Ismael Faro, Ruchir Puri, Juan Cruz-Benito

专题命中 代码评测 :code generation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11731 2024-06-18 cs.SE 57%

PerfCurator: Curating a large-scale dataset of performance bug-related commits from public repositories

Md Abul Kalam Azad, Manoj Alexender, Matthew Alexender, Syed Salauddin Mohammad Tariq, Foyzul Hassan, Probir Roy

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15692 2024-06-18 cs.AI 57%

Instruction Fusion: Advancing Prompt Evolution through Hybridization

Weidong Guo, Jiuding Yang, Kaitong Yang, Xiangyang Li, Zhuwei Rao, Yu Xu, Di Niu

专题命中 代码评测 :code generation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09967 2024-06-17 cs.CL 57%

Bag of Lies: Robustness in Continuous Pre-training BERT

Ine Gevers, Walter Daelemans

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.08486 2024-06-14 cs.AI 57%

Neural Class Expression Synthesis

N'Dah Jean Kouagou, Stefan Heindorf, Caglar Demir, Axel-Cyrille Ngonga Ngomo

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments 18 pages, 2 figures, ESWC 2023--Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06902 2024-06-12 cs.SE 57%

CodeScore-R: An Automated Robustness Metric for Assessing the FunctionalCorrectness of Code Synthesis

Guang Yang, Yu Zhou, Xiang Chen, Xiangyu Zhang

专题命中 代码评测 :code generation(abstract);分类 cs.SE

Comments in Chinese language, Journal of Computer Research and Development

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05109 2024-06-05 cs.LG 57%

Yet Another ICU Benchmark: A Flexible Multi-Center Framework for Clinical ML

Robin van de Water, Hendrik Schmidt, Paul Elbers, Patrick Thoral, Bert Arnrich, Patrick Rockenschaub

专题命中 代码评测 :repository(abstract);分类 cs.LG

Comments Main benchmark: https://github.com/rvandewater/YAIB, Cohort generation: https://github.com/rvandewater/YAIB-cohorts, Models: https://github.com/rvandewater/YAIB-models. To be published in ICLR 2024 proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08636 2024-06-05 cs.DC cs.AI 57%

MLCommons Cloud Masking Benchmark with Early Stopping

Varshitha Chennamsetti, Gregor von Laszewski, Ruochen Gu, Laiba Mehnaz, Juri Papay, Samuel Jackson, Jeyan Thiyagalingam, Sergey V. Samsonau, Geoffrey C. Fox

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments NYU did not approve the publication of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05634 2024-05-24 cs.CL 57%

Towards Verifiable Generation: A Benchmark for Knowledge-aware Language Model Attribution

Xinze Li, Yixin Cao, Liangming Pan, Yubo Ma, Aixin Sun

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments acl findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10251 2024-05-17 cs.CL 57%

A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks

Xuanfan Ni, Piji Li

专题命中 代码评测 :code generation(abstract);分类 cs.CL

Comments CCL2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04600 2024-05-16 cs.SE 57%

Contextual API Completion for Unseen Repositories Using LLMs

Noor Nashid, Taha Shabani, Parsa Alian, Ali Mesbah

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07456 2024-05-14 cs.LG 57%

Boosting House Price Estimations with Multi-Head Gated Attention

Zakaria Abdellah Sellam, Cosimo Distante, Abdelmalik Taleb-Ahmed, Pier Luigi Mazzeo

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06057 2024-05-13 cs.CV cs.LG 57%

UnSegGNet: Unsupervised Image Segmentation using Graph Neural Networks

Kovvuri Sai Gopal Reddy, Bodduluri Saran, A. Mudit Adityaja, Saurabh J. Shigwan, Nitin Kumar

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02364 2024-05-07 cs.LG cs.DC 57%

A Survey on Contribution Evaluation in Vertical Federated Learning

Yue Cui, Chung-ju Huang, Yuzhu Zhang, Leye Wang, Lixin Fan, Xiaofang Zhou, Qiang Yang

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14361 2024-04-30 cs.CL 57%

Better Synthetic Data by Retrieving and Transforming Existing Datasets

Saumya Gandhi, Ritu Gala, Vijay Viswanathan, Tongshuang Wu, Graham Neubig

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments PDF fixed in v3

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03262 2024-04-18 cs.CL 57%

Predicting Emergent Abilities with Infinite Resolution Evaluation

Shengding Hu, Xin Liu, Xu Han, Xinrong Zhang, Chaoqun He, Weilin Zhao, Yankai Lin, Ning Ding, Zebin Ou, Guoyang Zeng, Zhiyuan Liu, Maosong Sun

专题命中 代码评测 :code generation(abstract);分类 cs.CL

Comments After revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09220 2024-04-16 cs.CL 57%

Compass: Large Multilingual Language Model for South-east Asia

Sophia Maria

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19399 2024-04-11 cs.CL 57%

KazParC: Kazakh Parallel Corpus for Machine Translation

Rustem Yeshpanov, Alina Polonskaya, Huseyin Atakan Varol

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments To appear in Proceedings of the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19335 2024-04-11 cs.CL 57%

KazSAnDRA: Kazakh Sentiment Analysis Dataset of Reviews and Attitudes

Rustem Yeshpanov, Huseyin Atakan Varol

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments To appear in Proceedings of the 2024 Joint International Conference on Computational Linguistics, Language Resources and Evaluation (LREC-COLING 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.06041 2024-04-10 cs.SE 57%

On Evaluating the Efficiency of Source Code Generated by LLMs

Changan Niu, Ting Zhang, Chuanyi Li, Bin Luo, Vincent Ng

专题命中 代码评测 :code generation(abstract);分类 cs.SE

Comments 1st special event of AI Foundation Models and Software Engineering (FORGE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19287 2024-03-29 cs.SE 57%

CoderUJB: An Executable and Unified Java Benchmark for Practical Programming Scenarios

Zhengran Zeng, Yidong Wang, Rui Xie, Wei Ye, Shikun Zhang

专题命中 代码评测 :code generation(abstract);分类 cs.SE

Comments 11 pages, 4 figures, issta2024 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14721 2024-03-28 cs.DL cs.SE 57%

Automated Extraction and Maturity Analysis of Open Source Clinical Informatics Repositories from Scientific Literature

Jeremy R. Harper

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.11271 2024-03-27 cs.SE 57%

Tackling Long Code Search with Splitting, Encoding, and Aggregating

Fan Hu, Yanlin Wang, Lun Du, Hongyu Zhang, Shi Han, Dongmei Zhang, Xirong Li

专题命中 代码评测 :code model(abstract);分类 cs.SE

Comments Accepted by LREC-COLING 2024

详情

展开后加载摘要…

URL PDF HTML 收藏