{"url":"/method/gated-convolution-network","slug":"gated-convolution-network","name":"Gated Convolution Network","full_name":"Gated Convolution Network","full_name_withheld":false,"description_markdown":"A **Gated Convolutional Network** is a type of language model that combines convolutional networks with a gating mechanism. Zero padding is used to ensure future context can not be seen. Gated convolutional layers can be stacked on top of other hierarchically. Model predictions are then obtained with an [adaptive softmax](https://paperswithcode.com/method/adaptive-softmax) layer.","description_state":"present","introduced_year":null,"introduced_by":{"title":"Language Modeling with Gated Convolutional Networks","paper":"/paper/language-modeling-with-gated-convolutional","first_author":"Yann N. Dauphin","n_authors":4,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/language-modeling-with-gated-convolutional"},"source":{"url":"http://arxiv.org/abs/1612.08083v3","title":"Language Modeling with Gated Convolutional Networks","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Natural Language Processing","area_id":"natural-language-processing","collection":"Language Models","url":"/methods/category/language-models","pwc_aliases":[]}],"n_papers_tagged":3,"archive_num_papers":3,"papers_newest_first":[{"paper":"/paper/denomamba-a-fused-state-space-model-for-low","title":"DenoMamba: A fused state-space model for low-dose CT denoising","date":"2024-09-19","arxiv_id":"2409.13094","n_code_links":1,"syntology":null},{"paper":"/paper/mixture-of-variational-experts-for-continual","title":"Mixture-of-Variational-Experts for Continual Learning","date":"2021-10-25","arxiv_id":"2110.12667","n_code_links":1,"syntology":null},{"paper":"/paper/language-modeling-with-gated-convolutional","title":"Language Modeling with Gated Convolutional Networks","date":"2016-12-23","arxiv_id":"1612.08083","n_code_links":11,"syntology":null}],"papers_shown":3,"tasks":[{"task":"/task/continual-learning","name":"Continual Learning","papers":1},{"task":"/task/denoising","name":"Denoising","papers":1},{"task":"/task/diagnostic","name":"Diagnostic","papers":1},{"task":"/task/domain-il-continual-learning","name":"Domain-IL Continual Learning","papers":1},{"task":"/task/language-modeling","name":"Language Modeling","papers":1},{"task":"/task/language-modelling","name":"Language Modelling","papers":1},{"task":null,"name":"Permuted-MNIST","papers":1},{"task":"/task/reinforcement-learning","name":"Reinforcement Learning","papers":1},{"task":"/task/reinforcement-learning-1","name":"Reinforcement Learning (RL)","papers":1},{"task":"/task/ssim","name":"SSIM","papers":1},{"task":"/task/sensitivity","name":"Sensitivity","papers":1},{"task":"/task/sentence","name":"Sentence","papers":1},{"task":null,"name":"Split-CIFAR-10","papers":1},{"task":null,"name":"Split-MNIST","papers":1},{"task":"/task/reinforcement-learning-2","name":"reinforcement-learning","papers":1}],"tasks_shown":15,"n_tasks":15,"usage_by_year":[{"year":"2016","papers":1},{"year":"2021","papers":1},{"year":"2024","papers":1}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/gated-convolution-network"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}