{"url":"/method/ctrl","slug":"ctrl","name":"CTRL","full_name":"CTRL","full_name_withheld":false,"description_markdown":"**CTRL** is conditional [transformer](https://paperswithcode.com/method/transformer) language model, trained\r\nto condition on control codes that govern style, content, and task-specific behavior. Control codes were derived from structure that naturally co-occurs with raw\r\ntext, preserving the advantages of unsupervised learning while providing more\r\nexplicit control over text generation. These codes also allow CTRL to predict\r\nwhich parts of the training data are most likely given a sequence","description_state":"present","introduced_year":null,"introduced_by":{"title":null,"paper":null,"first_author":null,"n_authors":0,"url_abs":null,"archive_paper_url":null},"source":{"url":"https://arxiv.org/abs/1909.05858v2","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Natural Language Processing","area_id":"natural-language-processing","collection":"Transformers","url":"/methods/category/transformers","pwc_aliases":[]}],"n_papers_tagged":28,"archive_num_papers":null,"papers_newest_first":[{"paper":"/paper/sample-and-computationally-efficient-1","title":"Sample and Computationally Efficient Continuous-Time Reinforcement Learning with General Function Approximation","date":"2025-05-20","arxiv_id":"2505.14821","n_code_links":1,"syntology":null},{"paper":null,"title":"Tractable Representations for Convergent Approximation of Distributional HJB Equations","date":"2025-03-07","arxiv_id":"2503.05563","n_code_links":0,"syntology":null},{"paper":null,"title":"Integrating LLMs with ITS: Recent Advances, Potentials, Challenges, and Future Directions","date":"2025-01-08","arxiv_id":"2501.04437","n_code_links":0,"syntology":null},{"paper":null,"title":"A Combined Encoder and Transformer Approach for Coherent and High-Quality Text Generation","date":"2024-11-19","arxiv_id":"2411.12157","n_code_links":0,"syntology":null},{"paper":"/paper/causal-temporal-representation-learning-with","title":"Causal Temporal Representation Learning with Nonstationary Sparse Transition","date":"2024-09-05","arxiv_id":"2409.03142","n_code_links":1,"syntology":{"ran":7,"of":9,"unverified":2,"pointer_only":9}},{"paper":"/paper/machine-learning-models-for-daily-rainfall","title":"Machine learning models for daily rainfall forecasting in Northern Tropical Africa using tropical wave predictors","date":"2024-08-29","arxiv_id":"2408.16349","n_code_links":1,"syntology":null},{"paper":null,"title":"CTRL: Continuous-Time Representation Learning on Temporal Heterogeneous Information Network","date":"2024-05-11","arxiv_id":"2405.08013","n_code_links":0,"syntology":null},{"paper":"/paper/an-embarrassingly-simple-defense-against","title":"Towards Adversarial Robustness And Backdoor Mitigation in SSL","date":"2024-03-23","arxiv_id":"2403.15918","n_code_links":1,"syntology":null},{"paper":"/paper/two-trades-is-not-baffled-condense-graph-via","title":"Two Trades is not Baffled: Condensing Graph via Crafting Rational Gradient Matching","date":"2024-02-07","arxiv_id":"2402.04924","n_code_links":1,"syntology":{"ran":3,"of":3,"unverified":0,"pointer_only":0}},{"paper":null,"title":"CTRL: Connect Collaborative and Language Model for CTR Prediction","date":"2023-06-05","arxiv_id":"2306.02841","n_code_links":0,"syntology":null},{"paper":"/paper/swectrl-mini-a-data-transparent-transformer","title":"SweCTRL-Mini: a data-transparent Transformer-based large language model for controllable text generation in Swedish","date":"2023-04-27","arxiv_id":"2304.13994","n_code_links":1,"syntology":null},{"paper":"/paper/once-detected-never-lost-surpassing-human","title":"Once Detected, Never Lost: Surpassing Human Performance in Offline LiDAR based 3D Object Detection","date":"2023-04-24","arxiv_id":"2304.12315","n_code_links":2,"syntology":{"ran":3,"of":5,"unverified":2,"pointer_only":0}},{"paper":"/paper/elastic-weight-removal-for-faithful-and","title":"Elastic Weight Removal for Faithful and Abstractive Dialogue Generation","date":"2023-03-30","arxiv_id":"2303.17574","n_code_links":1,"syntology":null},{"paper":null,"title":"Mixing Backward- with Forward-Chaining for Metacognitive Skill Acquisition and Transfer","date":"2023-03-18","arxiv_id":"2303.12223","n_code_links":0,"syntology":null},{"paper":null,"title":"Alternative formulations for gilthead seabream diets: towards a more sustainable production","date":"2022-11-03","arxiv_id":"2211.02430","n_code_links":0,"syntology":null},{"paper":"/paper/controllable-factuality-in-document-grounded","title":"Controllable Factuality in Document-Grounded Dialog Systems Using a Noisy Channel Model","date":"2022-10-31","arxiv_id":"2210.17418","n_code_links":1,"syntology":null},{"paper":"/paper/unsupervised-learning-of-structured","title":"Unsupervised Learning of Structured Representations via Closed-Loop Transcription","date":"2022-10-30","arxiv_id":"2210.16782","n_code_links":1,"syntology":null},{"paper":"/paper/demystifying-self-supervised-trojan-attacks","title":"An Embarrassingly Simple Backdoor Attack on Self-supervised Learning","date":"2022-10-13","arxiv_id":"2210.07346","n_code_links":4,"syntology":{"ran":2,"of":2,"unverified":0,"pointer_only":2}},{"paper":"/paper/continual-learning-fast-and-slow","title":"Continual Learning, Fast and Slow","date":"2022-09-06","arxiv_id":"2209.02370","n_code_links":1,"syntology":null},{"paper":"/paper/ctrl-clustering-training-losses-for-label","title":"CTRL: Clustering Training Losses for Label Error Detection","date":"2022-08-17","arxiv_id":"2208.08464","n_code_links":1,"syntology":null},{"paper":"/paper/pursuit-of-a-discriminative-representation","title":"Pursuit of a Discriminative Representation for Multiple Subspaces via Sequential Games","date":"2022-06-18","arxiv_id":"2206.09120","n_code_links":1,"syntology":{"ran":0,"of":1,"unverified":1,"pointer_only":0}},{"paper":null,"title":"Efficient and Training-Free Control of Language Generation","date":"2022-05-12","arxiv_id":"2205.06036","n_code_links":0,"syntology":null},{"paper":null,"title":"A Comparative Study of Transformers on Word Sense Disambiguation","date":"2021-11-30","arxiv_id":"2111.15417","n_code_links":0,"syntology":null},{"paper":"/paper/turingbench-a-benchmark-environment-for","title":"TURINGBENCH: A Benchmark Environment for Turing Test in the Age of Neural Text Generation","date":"2021-09-27","arxiv_id":"2109.13296","n_code_links":3,"syntology":{"ran":0,"of":7,"unverified":7,"pointer_only":0}},{"paper":"/paper/cross-trajectory-representation-learning-for","title":"Cross-Trajectory Representation Learning for Zero-Shot Generalization in RL","date":"2021-06-04","arxiv_id":"2106.02193","n_code_links":1,"syntology":{"ran":7,"of":11,"unverified":4,"pointer_only":11}},{"paper":"/paper/learning-to-relate-depth-and-semantics-for","title":"Learning to Relate Depth and Semantics for Unsupervised Domain Adaptation","date":"2021-05-17","arxiv_id":"2105.07830","n_code_links":1,"syntology":{"ran":3,"of":4,"unverified":1,"pointer_only":4}},{"paper":"/paper/ctlr-wic-tsv-target-sense-verification-using","title":"CTLR@WiC-TSV: Target Sense Verification using Marked Inputs andPre-trained Models","date":"2021-04-30","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/ctrl-a-conditional-transformer-language-model-1","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","date":"2019-09-11","arxiv_id":"1909.05858","n_code_links":8,"syntology":{"ran":13,"of":14,"unverified":1,"pointer_only":0}}],"papers_shown":28,"tasks":[{"task":"/task/representation-learning","name":"Representation Learning","papers":6},{"task":"/task/language-modelling","name":"Language Modelling","papers":5},{"task":"/task/text-generation","name":"Text Generation","papers":5},{"task":"/task/language-modeling","name":"Language Modeling","papers":4},{"task":"/task/self-supervised-learning","name":"Self-Supervised Learning","papers":3},{"task":"/task/adversarial-robustness","name":"Adversarial Robustness","papers":2},{"task":"/task/backdoor-attack","name":"Backdoor Attack","papers":2},{"task":"/task/reinforcement-learning-1","name":"Reinforcement Learning (RL)","papers":2},{"task":"/task/3d-object-detection","name":"3D Object Detection","papers":1},{"task":"/task/attribute","name":"Attribute","papers":1},{"task":"/task/authorship-attribution","name":"Authorship Attribution","papers":1},{"task":"/task/autonomous-driving","name":"Autonomous Driving","papers":1},{"task":"/task/binary-text-classification","name":"Binary text classification","papers":1},{"task":"/task/click-through-rate-prediction","name":"Click-Through Rate Prediction","papers":1},{"task":"/task/clustering","name":"Clustering","papers":1},{"task":"/task/computational-efficiency","name":"Computational Efficiency","papers":1},{"task":"/task/continual-learning","name":"Continual Learning","papers":1},{"task":"/task/continuous-control","name":"Continuous Control","papers":1},{"task":"/task/depth-estimation","name":"Depth Estimation","papers":1},{"task":"/task/dialogue-generation","name":"Dialogue Generation","papers":1}],"tasks_shown":20,"n_tasks":58,"usage_by_year":[{"year":"2019","papers":1},{"year":"2021","papers":5},{"year":"2022","papers":8},{"year":"2023","papers":5},{"year":"2024","papers":6},{"year":"2025","papers":3}],"row_source":"embedded","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/ctrl"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}