arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 1729 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 代码评测 1729 篇

2503.20265 2025-03-27 cs.SE 57%

Fixseeker: An Empirical Driven Graph-based Approach for Detecting Silent Vulnerability Fixes in Open Source Software

Yiran Cheng, Ting Zhang, Lwin Khin Shar, Zhe Lang, David Lo, Shichao Lv, Dongliang Fang, Zhiqiang Shi, Limin Sun

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08909 2025-03-24 cs.SE 57%

Software Testing for Extended Reality Applications: A Systematic Mapping Study

Ruizhen Gu, José Miguel Rojas, Donghwan Shin

专题命中 代码评测 :repository(abstract);分类 cs.SE

Comments 51 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09094 2025-03-13 cs.CL 57%

Domain Adaptation for Japanese Sentence Embeddings with Contrastive Learning based on Synthetic Sentence Generation

Zihao Chen, Hisashi Handa, Miho Ohsaki, Kimiaki Shirahama

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments 39 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15993 2025-03-12 cs.CV cs.LG physics.ao-ph 57%

ClimDetect: A Benchmark Dataset for Climate Change Detection and Attribution

Sungduk Yu, Brian L. White, Anahita Bhiwandiwalla, Musashi Hinck, Matthew Lyle Olson, Yaniv Gurwicz, Raanan Y. Rohekar, Tung Nguyen, Vasudev Lal

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04359 2025-03-07 cs.SE 57%

LONGCODEU: Benchmarking Long-Context Language Models on Long Code Understanding

Jia Li, Xuyuan Guo, Lei Li, Kechi Zhang, Ge Li, Jia Li, Zhengwei Tao, Fang Liu, Chongyang Tao, Yuqi Zhu, Zhi Jin

专题命中 代码评测 :code model(abstract);分类 cs.SE

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04261 2025-03-07 cs.AI 57%

VirtualXAI: A User-Centric Framework for Explainability Assessment Leveraging GPT-Generated Personas

Georgios Makridis, Vasileios Koukos, Georgios Fatouros, Dimosthenis Kyriazis

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01391 2025-02-27 cs.LG 57%

Counterfactual Learning on Graphs: A Survey

Zhimeng Guo, Teng Xiao, Zongyu Wu, Charu Aggarwal, Hui Liu, Suhang Wang

专题命中 代码评测 :repository(abstract);分类 cs.LG

Journal ref Machine Intelligence Research (vol. 22, no. 1, pp. 17-59), https://link.springer.com/article/10.1007/s11633-024-1519-z, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16614 2025-02-25 cs.CL 57%

CodeCriticBench: A Holistic Code Critique Benchmark for Large Language Models

Alexander Zhang, Marcus Dong, Jiaheng Liu, Wei Zhang, Yejie Wang, Jian Yang, Ge Zhang, Tianyu Liu, Zhongyuan Peng, Yingshui Tan, Yuanxing Zhang, Zhexu Wang, Weixun Wang, Yancheng He, Ken Deng, Wangchunshu Zhou, Wenhao Huang, Zhaoxiang Zhang

专题命中 代码评测 :code generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15147 2025-02-25 cs.AI cs.HC 57%

A Causality-aware Paradigm for Evaluating Creativity of Multimodal Large Language Models

Zhongzhan Huang, Shanshan Zhong, Pan Zhou, Shanghua Gao, Marinka Zitnik, Liang Lin

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments Accepted by TPAMI. arXiv admin note: text overlap with arXiv:2312.02439

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14678 2025-02-21 cs.CL 57%

How to Get Your LLM to Generate Challenging Problems for Evaluation

Arkil Patel, Siva Reddy, Dzmitry Bahdanau

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07175 2025-02-21 eess.SP cs.CV cs.LG 57%

Robust Feature Engineering Techniques for Designing Efficient Motor Imagery-Based BCI-Systems

Syed Saim Gardezi, Soyiba Jawed, Mahnoor Khan, Muneeba Bukhari, Rizwan Ahmed Khan

专题命中 代码评测 :repository(abstract);分类 cs.LG

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12846 2025-02-21 cs.AI 57%

How well can a large language model explain business processes as perceived by users?

Dirk Fahland, Fabiana Fournier, Lior Limonad, Inna Skarbovsky, Ava J. E. Swevels

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments 42 pages, 13 figures

Journal ref Data & Knowledge Engineering, Volume 157, May 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13117 2025-02-19 stat.AP cs.AI 57%

Performance Evaluation of Large Language Models in Statistical Programming

Xinyi Song, Kexin Xie, Lina Lee, Ruizhe Chen, Jared M. Clark, Hao He, Haoran He, Jie Min, Xinlei Zhang, Simin Zheng, Zhiyang Zhang, Xinwei Deng, Yili Hong

专题命中 代码评测 :code generation(abstract);分类 cs.AI

Comments 27 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07049 2025-02-19 cs.CR cs.AI 57%

LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights

Ze Sheng, Zhicheng Chen, Shuning Gu, Heqing Huang, Guofei Gu, Jeff Huang

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments 33 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12381 2025-02-19 cs.CV cs.AI 57%

HumanEval-V: Benchmarking High-Level Visual Reasoning with Complex Diagrams in Coding Tasks

Fengji Zhang, Linquan Wu, Huiyu Bai, Guancheng Lin, Xiao Li, Xiao Yu, Yue Wang, Bei Chen, Jacky Keung

专题命中 代码评测 :code generation(abstract);分类 cs.AI

Comments homepage https://humaneval-v.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09328 2025-02-14 cs.SE 57%

Copilot Arena: A Platform for Code LLM Evaluation in the Wild

Wayne Chi, Valerie Chen, Anastasios Nikolas Angelopoulos, Wei-Lin Chiang, Aditya Mittal, Naman Jain, Tianjun Zhang, Ion Stoica, Chris Donahue, Ameet Talwalkar

专题命中 代码评测 :code generation(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03471 2025-01-28 cs.AR cs.CL 57%

MetRex: A Benchmark for Verilog Code Metric Reasoning Using LLMs

Manar Abdelatty, Jingxiao Ma, Sherief Reda

专题命中 代码评测 :code generation(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14506 2025-01-27 cs.CL 57%

WanJuanSiLu: A High-Quality Open-Source Webtext Dataset for Low-Resource Languages

Jia Yu, Fei Yuan, Rui Min, Jing Yu, Pei Chu, Jiayang Li, Wei Li, Ruijie Zhang, Zhenxiang Li, Zhifei Ren, Dong Zheng, Wenjian Zhang, Yan Teng, Lingyu Meng, ZhenJiang Jin, Jiantao Qiu, ShaSha Wang, Zhongying Tu, Dahua Lin, Yu Wang, Yu Qiao, Yanfeng Wang, Conghui He

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11140 2025-01-22 cs.CV cs.AI 57%

CLOFAI: A Dataset of Real And Fake Image Classification Tasks for Continual Learning

William Doherty, Anton Lee, Heitor Murilo Gomes

专题命中 代码评测 :repository(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07554 2025-01-14 cs.CV cs.CL 57%

SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing

Varun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li, Youshan Zhang

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments WACV workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04306 2025-01-09 cs.CL cs.DL 57%

LLM4SR: A Survey on Large Language Models for Scientific Research

Ziming Luo, Zonglin Yang, Zexin Xu, Wei Yang, Xinya Du

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04604 2025-01-09 cs.AI 57%

ARC Prize 2024: Technical Report

Francois Chollet, Mike Knoop, Gregory Kamradt, Bryan Landers

专题命中 代码评测 :program synthesis(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20787 2025-01-07 cs.CR cs.AI 57%

SecBench: A Comprehensive Multi-Dimensional Benchmarking Dataset for LLMs in Cybersecurity

Pengfei Jing, Mengyun Tang, Xiaorong Shi, Xing Zheng, Sen Nie, Shi Wu, Yong Yang, Xiapu Luo

专题命中 代码评测 :code generation(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21156 2024-12-31 cs.LG 57%

Unified dimensionality reduction techniques in chronic liver disease detection

Anand Karna, Naina Khan, Rahul Rauniyar, Prashant Giridhar Shambharkar

专题命中 代码评测 :repository(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15054 2024-12-20 cs.CV cs.AI cs.SD eess.AS 57%

GIRAFE: Glottal Imaging Dataset for Advanced Segmentation, Analysis, and Facilitative Playbacks Evaluation

G. Andrade-Miranda, K. Chatzipapas, J. D. Arias-Londoño, J. I. Godino-Llorente

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11990 2024-12-17 cs.CL 57%

ExecRepoBench: Multi-level Executable Code Completion Evaluation

Jian Yang, Jiajun Zhang, Jiaxi Yang, Ke Jin, Lei Zhang, Qiyao Peng, Ken Deng, Yibo Miao, Tianyu Liu, Zeyu Cui, Binyuan Hui, Junyang Lin

专题命中 代码评测 :repository(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11912 2024-12-17 cs.CL 57%

CharacterBench: Benchmarking Character Customization of Large Language Models

Jinfeng Zhou, Yongkang Huang, Bosi Wen, Guanqun Bi, Yuxuan Chen, Pei Ke, Zhuang Chen, Xiyao Xiao, Libiao Peng, Kuntian Tang, Rongsheng Zhang, Le Zhang, Tangjie Lv, Zhipeng Hu, Hongning Wang, Minlie Huang

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11328 2024-12-17 cs.SE 57%

Zero-Shot Prompting Approaches for LLM-based Graphical User Interface Generation

Kristian Kolthoff, Felix Kretzer, Lennart Fiebig, Christian Bartelt, Alexander Maedche, Simone Paolo Ponzetto

专题命中 代码评测 :repository(abstract);分类 cs.SE

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09259 2024-12-10 cs.CV cs.CL 57%

Jailbreak Attacks and Defenses against Multimodal Generative Models: A Survey

Xuannan Liu, Xing Cui, Peipei Li, Zekun Li, Huaibo Huang, Shuhan Xia, Miaoxuan Zhang, Yueying Zou, Ran He

专题命中 代码评测 :repository(abstract);分类 cs.CL

Comments ongoing work

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05137 2024-12-09 cs.AI 57%

Can Large Language Models Serve as Effective Classifiers for Hierarchical Multi-Label Classification of Scientific Documents at Industrial Scale?

Seyed Amin Tabatabaei, Sarah Fancher, Michael Parsons, Arian Askari

专题命中 代码评测 :repository(abstract);分类 cs.AI

Comments This paper has been accepted at COLING 2025 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏