{"url":"/method/xavier-initialization","slug":"xavier-initialization","name":"Xavier Initialization","full_name":"Xavier Initialization","full_name_withheld":false,"description_markdown":"**Xavier Initialization**, or **Glorot Initialization**, is an initialization scheme for neural networks. Biases are initialized be 0 and the weights $W\\_{ij}$ at each layer are initialized as:\r\n\r\n$$ W\\_{ij} \\sim U\\left[-\\frac{\\sqrt{6}}{\\sqrt{fan_{in} + fan_{out}}}, \\frac{\\sqrt{6}}{\\sqrt{fan_{in} + fan_{out}}}\\right] $$\r\n\r\nWhere $U$ is a uniform distribution and $fan_{in}$ is the size of the previous layer (number of columns in $W$) and $fan_{out}$ is the size of the current layer.","description_state":"present","introduced_year":null,"introduced_by":{"title":null,"paper":null,"first_author":null,"n_authors":0,"url_abs":null,"archive_paper_url":null},"source":{"url":null,"title":null,"url_on_a_paper_host":false},"code_snippet_url":"https://github.com/pytorch/pytorch/blob/0adb5843766092fba584791af76383125fd0d01c/torch/nn/init.py#L289","code_snippet_url_on_a_code_host":true,"categories":[{"area":"General","area_id":"general","collection":"Initialization","url":"/methods/category/initialization","pwc_aliases":[]}],"n_papers_tagged":121,"archive_num_papers":121,"papers_newest_first":[{"paper":null,"title":"Detecting immune cells with label-free two-photon autofluorescence and deep learning","date":"2025-06-17","arxiv_id":"2506.14449","n_code_links":0,"syntology":null},{"paper":null,"title":"Deploying and Evaluating Multiple Deep Learning Models on Edge Devices for Diabetic Retinopathy Detection","date":"2025-06-14","arxiv_id":"2506.14834","n_code_links":0,"syntology":null},{"paper":"/paper/seconnds-secure-outsourced-neural-network","title":"SecONNds: Secure Outsourced Neural Network Inference on ImageNet","date":"2025-06-13","arxiv_id":"2506.11586","n_code_links":2,"syntology":null},{"paper":null,"title":"Comparative Analysis of Lightweight Deep Learning Models for Memory-Constrained Devices","date":"2025-05-06","arxiv_id":"2505.03303","n_code_links":0,"syntology":null},{"paper":null,"title":"Deepfake Detection with Optimized Hybrid Model: EAR Biometric Descriptor via Improved RCNN","date":"2025-03-16","arxiv_id":"2503.12381","n_code_links":0,"syntology":null},{"paper":null,"title":"Comparison of Neural Models for X-ray Image Classification in COVID-19 Detection","date":"2025-01-08","arxiv_id":"2501.04196","n_code_links":0,"syntology":null},{"paper":null,"title":"Evaluating Convolutional Neural Networks for COVID-19 classification in chest X-ray images","date":"2024-12-26","arxiv_id":"2412.19362","n_code_links":0,"syntology":null},{"paper":null,"title":"Improving the network traffic classification using the Packet Vision approach","date":"2024-12-26","arxiv_id":"2412.19360","n_code_links":0,"syntology":null},{"paper":null,"title":"Robust Weight Initialization for Tanh Neural Networks with Fixed Point Analysis","date":"2024-10-03","arxiv_id":"2410.02242","n_code_links":0,"syntology":null},{"paper":"/paper/rnc-efficient-rram-aware-nas-and-compilation","title":"RNC: Efficient RRAM-aware NAS and Compilation for DNNs on Resource-Constrained Edge Devices","date":"2024-09-27","arxiv_id":"2409.18841","n_code_links":1,"syntology":null},{"paper":null,"title":"Dataset-Free Weight-Initialization on Restricted Boltzmann Machine","date":"2024-09-12","arxiv_id":"2409.07708","n_code_links":0,"syntology":null},{"paper":"/paper/comparative-analysis-of-transfer-learning","title":"Evaluating Deep Learning Models for Breast Cancer Classification: A Comparative Study","date":"2024-08-29","arxiv_id":"2408.16859","n_code_links":2,"syntology":null},{"paper":null,"title":"Deep Learning for Lung Disease Classification Using Transfer Learning and a Customized CNN Architecture with Attention","date":"2024-08-23","arxiv_id":"2408.13180","n_code_links":0,"syntology":null},{"paper":null,"title":"On Initializing Transformers with Pre-trained Embeddings","date":"2024-07-17","arxiv_id":"2407.12514","n_code_links":0,"syntology":null},{"paper":null,"title":"Deep Network Pruning: A Comparative Study on CNNs in Face Recognition","date":"2024-05-28","arxiv_id":"2405.18302","n_code_links":0,"syntology":null},{"paper":null,"title":"BanglaNum -- A Public Dataset for Bengali Digit Recognition from Speech","date":"2024-03-20","arxiv_id":"2403.13465","n_code_links":0,"syntology":null},{"paper":"/paper/quantization-effects-on-neural-networks","title":"Quantization Effects on Neural Networks Perception: How would quantization change the perceptual field of vision models?","date":"2024-03-15","arxiv_id":"2403.09939","n_code_links":1,"syntology":null},{"paper":null,"title":"The Potential of Wearable Sensors for Assessing Patient Acuity in Intensive Care Unit (ICU)","date":"2023-11-03","arxiv_id":"2311.02251","n_code_links":0,"syntology":null},{"paper":null,"title":"Multi-Transfer Learning Techniques for Detecting Auditory Brainstem Response","date":"2023-08-29","arxiv_id":"2308.16203","n_code_links":0,"syntology":null},{"paper":null,"title":"SqueezerFaceNet: Reducing a Small Face Recognition CNN Even More Via Filter Pruning","date":"2023-07-20","arxiv_id":"2307.10697","n_code_links":0,"syntology":null},{"paper":null,"title":"Modulation Classification Through Deep Learning Using Resolution Transformed Spectrograms","date":"2023-06-06","arxiv_id":"2306.04655","n_code_links":0,"syntology":null},{"paper":null,"title":"PSDNet: Determination of Particle Size Distributions Using Synthetic Soil Images and Convolutional Neural Networks","date":"2023-03-07","arxiv_id":"2303.04269","n_code_links":0,"syntology":null},{"paper":null,"title":"Use Cases for Time-Frequency Image Representations and Deep Learning Techniques for Improved Signal Classification","date":"2023-02-22","arxiv_id":"2302.11093","n_code_links":0,"syntology":null},{"paper":null,"title":"Optimization of FPGA-based CNN Accelerators Using Metaheuristics","date":"2022-09-22","arxiv_id":"2209.11272","n_code_links":0,"syntology":null},{"paper":null,"title":"Optimizing Anchor-based Detectors for Autonomous Driving Scenes","date":"2022-08-11","arxiv_id":"2208.06062","n_code_links":0,"syntology":null},{"paper":null,"title":"Liquid State Machine-Empowered Reflection Tracking in RIS-Aided THz Communications","date":"2022-08-08","arxiv_id":"2208.04400","n_code_links":0,"syntology":null},{"paper":null,"title":"Land Classification in Satellite Images by Injecting Traditional Features to CNN Models","date":"2022-07-21","arxiv_id":"2207.10368","n_code_links":0,"syntology":null},{"paper":"/paper/summarizing-videos-using-concentrated","title":"Summarizing Videos using Concentrated Attention and Considering the Uniqueness and Diversity of the Video Frames","date":"2022-06-29","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/gator-customizable-channel-pruning-of-neural","title":"Gator: Customizable Channel Pruning of Neural Networks with Gating","date":"2022-05-30","arxiv_id":"2205.15404","n_code_links":1,"syntology":null},{"paper":"/paper/object-detection-with-spiking-neural-networks","title":"Object Detection with Spiking Neural Networks on Automotive Event Data","date":"2022-05-09","arxiv_id":"2205.04339","n_code_links":1,"syntology":{"ran":1,"of":1,"unverified":0,"pointer_only":0}}],"papers_shown":30,"tasks":[{"task":"/task/transfer-learning","name":"Transfer Learning","papers":19},{"task":"/task/image-classification","name":"Image Classification","papers":16},{"task":"/task/classification","name":"General Classification","papers":15},{"task":"/task/object-detection","name":"Object Detection","papers":14},{"task":"/task/object-detection-1","name":"object-detection","papers":13},{"task":"/task/classification-1","name":"Classification","papers":11},{"task":null,"name":"GPU","papers":10},{"task":"/task/image-classification","name":"image-classification","papers":10},{"task":"/task/data-augmentation","name":"Data Augmentation","papers":6},{"task":"/task/deep-learning","name":"Deep Learning","papers":6},{"task":"/task/object","name":"Object","papers":6},{"task":"/task/semantic-segmentation","name":"Semantic Segmentation","papers":6},{"task":"/task/quantization","name":"Quantization","papers":5},{"task":"/task/specificity","name":"Specificity","papers":5},{"task":null,"name":"CPU","papers":4},{"task":"/task/face-recognition","name":"Face Recognition","papers":4},{"task":"/task/autonomous-driving","name":"Autonomous Driving","papers":3},{"task":"/task/diagnostic","name":"Diagnostic","papers":3},{"task":"/task/diversity","name":"Diversity","papers":3},{"task":"/task/face-verification","name":"Face Verification","papers":3}],"tasks_shown":20,"n_tasks":122,"usage_by_year":[{"year":"2014","papers":1},{"year":"2016","papers":5},{"year":"2017","papers":8},{"year":"2018","papers":18},{"year":"2019","papers":15},{"year":"2020","papers":22},{"year":"2021","papers":20},{"year":"2022","papers":9},{"year":"2023","papers":6},{"year":"2024","papers":11},{"year":"2025","papers":6}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/xavier-initialization"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}