{"url":"/method/codegen","slug":"codegen","name":"CodeGen","full_name":"CodeGen","full_name_withheld":false,"description_markdown":"**CodeGen** is an autoregressive transformers with next-token prediction language modeling as the learning objective trained on a natural language corpus and programming language data curated from GitHub.","description_state":"present","introduced_year":null,"introduced_by":{"title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","paper":"/paper/a-conversational-paradigm-for-program","first_author":"Erik Nijkamp","n_authors":8,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/a-conversational-paradigm-for-program"},"source":{"url":"https://arxiv.org/abs/2203.13474v5","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Natural Language Processing","area_id":"natural-language-processing","collection":"Language Models","url":"/methods/category/language-models","pwc_aliases":[]}],"n_papers_tagged":25,"archive_num_papers":25,"papers_newest_first":[{"paper":"/paper/how-to-select-pre-trained-code-models-for","title":"How to Select Pre-Trained Code Models for Reuse? A Learning Perspective","date":"2025-01-07","arxiv_id":"2501.03783","n_code_links":1,"syntology":null},{"paper":"/paper/does-your-neural-code-completion-model-use-my","title":"Does Your Neural Code Completion Model Use My Code? A Membership Inference Approach","date":"2024-04-22","arxiv_id":"2404.14296","n_code_links":1,"syntology":null},{"paper":null,"title":"CodeFort: Robust Training for Code Generation Models","date":"2024-04-11","arxiv_id":"2405.01567","n_code_links":0,"syntology":null},{"paper":"/paper/bugs-in-large-language-models-generated-code","title":"Bugs in Large Language Models Generated Code: An Empirical Study","date":"2024-03-13","arxiv_id":"2403.08937","n_code_links":1,"syntology":null},{"paper":null,"title":"LLaMoCo: Instruction Tuning of Large Language Models for Optimization Code Generation","date":"2024-03-02","arxiv_id":"2403.01131","n_code_links":0,"syntology":null},{"paper":"/paper/humaneval-on-latest-gpt-models-2024","title":"HumanEval on Latest GPT Models -- 2024","date":"2024-02-20","arxiv_id":"2402.14852","n_code_links":1,"syntology":{"ran":1,"of":3,"unverified":2,"pointer_only":0}},{"paper":"/paper/crosscodeeval-a-diverse-and-multilingual","title":"CrossCodeEval: A Diverse and Multilingual Benchmark for Cross-File Code Completion","date":"2023-10-17","arxiv_id":"2310.11248","n_code_links":1,"syntology":{"ran":4,"of":6,"unverified":2,"pointer_only":0}},{"paper":"/paper/neural-rankers-for-code-generation-via-inter","title":"Functional Overlap Reranking for Neural Code Generation","date":"2023-10-16","arxiv_id":"2311.03366","n_code_links":2,"syntology":null},{"paper":null,"title":"Large Language Model-Aware In-Context Learning for Code Generation","date":"2023-10-15","arxiv_id":"2310.09748","n_code_links":0,"syntology":null},{"paper":"/paper/biocoder-a-benchmark-for-bioinformatics-code","title":"BioCoder: A Benchmark for Bioinformatics Code Generation with Large Language Models","date":"2023-08-31","arxiv_id":"2308.16458","n_code_links":1,"syntology":{"ran":1,"of":1,"unverified":0,"pointer_only":1}},{"paper":"/paper/comex-a-tool-for-generating-customized-source","title":"COMEX: A Tool for Generating Customized Source Code Representations","date":"2023-07-10","arxiv_id":"2307.04693","n_code_links":1,"syntology":null},{"paper":null,"title":"Exploring the Robustness of Large Language Models for Solving Programming Problems","date":"2023-06-26","arxiv_id":"2306.14583","n_code_links":0,"syntology":null},{"paper":"/paper/fine-tuning-large-language-models-for","title":"Fine-Tuning Large Language Models for Answering Programming Questions with Code Snippets","date":"2023-06-26","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/how-effective-are-neural-networks-for-fixing","title":"How Effective Are Neural Networks for Fixing Security Vulnerabilities","date":"2023-05-29","arxiv_id":"2305.18607","n_code_links":1,"syntology":{"ran":4,"of":4,"unverified":0,"pointer_only":4}},{"paper":"/paper/prompting-with-pseudo-code-instructions","title":"Prompting with Pseudo-Code Instructions","date":"2023-05-19","arxiv_id":"2305.11790","n_code_links":2,"syntology":{"ran":0,"of":13,"unverified":13,"pointer_only":0}},{"paper":"/paper/exploring-the-effectiveness-of-large-language","title":"Using Large Language Models to Generate JUnit Tests: An Empirical Study","date":"2023-04-30","arxiv_id":"2305.00418","n_code_links":1,"syntology":null},{"paper":"/paper/learning-performance-improving-code-edits","title":"Learning Performance-Improving Code Edits","date":"2023-02-15","arxiv_id":"2302.07867","n_code_links":2,"syntology":{"ran":7,"of":19,"unverified":12,"pointer_only":19}},{"paper":"/paper/controlling-large-language-models-to-generate","title":"Large Language Models for Code: Security Hardening and Adversarial Testing","date":"2023-02-10","arxiv_id":"2302.05319","n_code_links":1,"syntology":null},{"paper":"/paper/execution-based-evaluation-for-open-domain","title":"Execution-Based Evaluation for Open-Domain Code Generation","date":"2022-12-20","arxiv_id":"2212.10481","n_code_links":1,"syntology":null},{"paper":"/paper/recode-robustness-evaluation-of-code","title":"ReCode: Robustness Evaluation of Code Generation Models","date":"2022-12-20","arxiv_id":"2212.10264","n_code_links":3,"syntology":{"ran":5,"of":5,"unverified":0,"pointer_only":0}},{"paper":"/paper/benchmarking-large-language-models-for","title":"Benchmarking Large Language Models for Automated Verilog RTL Code Generation","date":"2022-12-13","arxiv_id":"2212.11140","n_code_links":1,"syntology":{"ran":0,"of":2,"unverified":2,"pointer_only":0}},{"paper":null,"title":"On the Compositional Generalization Gap of In-Context Learning","date":"2022-11-15","arxiv_id":"2211.08473","n_code_links":0,"syntology":null},{"paper":"/paper/extracting-meaningful-attention-on-source","title":"Follow-up Attention: An Empirical Study of Developer and Neural Model Code Exploration","date":"2022-10-11","arxiv_id":"2210.05506","n_code_links":1,"syntology":null},{"paper":"/paper/a-scalable-and-extensible-approach-to","title":"MultiPL-E: A Scalable and Extensible Approach to Benchmarking Neural Code Generation","date":"2022-08-17","arxiv_id":"2208.08227","n_code_links":1,"syntology":{"ran":1,"of":1,"unverified":0,"pointer_only":1}},{"paper":"/paper/a-conversational-paradigm-for-program","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","date":"2022-03-25","arxiv_id":"2203.13474","n_code_links":8,"syntology":{"ran":10,"of":10,"unverified":0,"pointer_only":0}}],"papers_shown":25,"tasks":[{"task":"/task/code-generation","name":"Code Generation","papers":19},{"task":"/task/humaneval","name":"HumanEval","papers":6},{"task":"/task/language-modelling","name":"Language Modelling","papers":5},{"task":"/task/program-synthesis","name":"Program Synthesis","papers":4},{"task":null,"name":"mbpp","papers":4},{"task":"/task/code-completion","name":"Code Completion","papers":3},{"task":"/task/contrastive-learning","name":"Contrastive Learning","papers":3},{"task":"/task/language-modeling","name":"Language Modeling","papers":3},{"task":"/task/benchmarking","name":"Benchmarking","papers":2},{"task":"/task/data-augmentation","name":"Data Augmentation","papers":2},{"task":"/task/in-context-learning","name":"In-Context Learning","papers":2},{"task":"/task/large-language-model","name":"Large Language Model","papers":2},{"task":"/task/memorization","name":"Memorization","papers":2},{"task":"/task/attribute","name":"Attribute","papers":1},{"task":"/task/code-repair","name":"Code Repair","papers":1},{"task":"/task/code-summarization-1","name":"Code Summarization","papers":1},{"task":"/task/model-selection","name":"Model Selection","papers":1},{"task":"/task/program-repair","name":"Program Repair","papers":1},{"task":"/task/prompt-engineering","name":"Prompt Engineering","papers":1},{"task":"/task/question-answering","name":"Question Answering","papers":1}],"tasks_shown":20,"n_tasks":25,"usage_by_year":[{"year":"2022","papers":7},{"year":"2023","papers":12},{"year":"2024","papers":5},{"year":"2025","papers":1}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/codegen"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}