{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/decoder/papers/64","list_of":"/task/decoder","task":"Decoder","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":64,"pages_in_order":104,"rows_per_page":100,"rows":[6301,6400],"of":10368,"counts":{"archive_papers_tagged":10368,"with_a_code_link":4358,"where_syntology_ran_a_sample":1061,"not_listed_spam_title":0,"listed":10368,"listed_where_code_ran":1061,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":909,"every_run_a_failure_of_syntologys_instrument":152,"listed_with_a_run_with_no_instrument_failure":909,"listed_every_run_a_failure_of_syntologys_instrument":152,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/decoder","prev":"/task/decoder/papers/63","next":"/task/decoder/papers/65","papers":[{"url":null,"slug":"tceip-text-condition-embedded-regression","title":"TCEIP: Text Condition Embedded Regression Network for Dental Implant Position Prediction","date":"2023-06-26","arxiv_id":"2306.14406","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-q-transformer-visual-explanation-in","title":"Action Q-Transformer: Visual Explanation in Deep Reinforcement Learning with Encoder-Decoder Model using Action Query","date":"2023-06-24","arxiv_id":"2306.13879","repositories_listed":0,"syntology":null},{"url":null,"slug":"clothfit-cloth-human-attribute-guided-virtual","title":"ClothFit: Cloth-Human-Attribute Guided Virtual Try-On Network Using 3D Simulated Dataset","date":"2023-06-24","arxiv_id":"2306.13908","repositories_listed":0,"syntology":null},{"url":null,"slug":"miracle-multi-task-learning-based","title":"MIRACLE: Multi-task Learning based Interpretable Regulation of Autoimmune Diseases through Common Latent Epigenetics","date":"2023-06-24","arxiv_id":"2306.13866","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-weighted-autoencoder-based-approach-to","title":"A Weighted Autoencoder-Based Approach to Downlink NOMA Constellation Design","date":"2023-06-23","arxiv_id":"2306.13423","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-aware-transmission-for-robust-point","title":"Semantic-aware Transmission for Robust Point Cloud Classification","date":"2023-06-23","arxiv_id":"2306.13296","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-double-helix-inside-the-nlp-transformer","title":"The Double Helix inside the NLP Transformer","date":"2023-06-23","arxiv_id":"2306.13817","repositories_listed":0,"syntology":null},{"url":null,"slug":"flowface-explicit-semantic-flow-supervised","title":"FlowFace++: Explicit Semantic Flow-supervised End-to-End Face Swapping","date":"2023-06-22","arxiv_id":"2306.12686","repositories_listed":0,"syntology":null},{"url":null,"slug":"rxfood-plug-in-rgb-x-fusion-for-object-of","title":"RXFOOD: Plug-in RGB-X Fusion for Object of Interest Detection","date":"2023-06-22","arxiv_id":"2306.12621","repositories_listed":0,"syntology":null},{"url":null,"slug":"iterated-piecewise-affine-ipa-approximation","title":"Iterated Piecewise Affine (IPA) Approximation for Language Modeling","date":"2023-06-21","arxiv_id":"2306.12317","repositories_listed":0,"syntology":null},{"url":null,"slug":"provably-efficient-representation-learning","title":"Provably Efficient Representation Learning with Tractable Planning in Low-Rank POMDP","date":"2023-06-21","arxiv_id":"2306.12356","repositories_listed":0,"syntology":null},{"url":null,"slug":"kiut-knowledge-injected-u-transformer-for-1","title":"KiUT: Knowledge-injected U-Transformer for Radiology Report Generation","date":"2023-06-20","arxiv_id":"2306.11345","repositories_listed":0,"syntology":null},{"url":null,"slug":"moleclues-optimizing-molecular-conformers-by","title":"MoleCLUEs: Molecular Conformers Maximally In-Distribution for Predictive Models","date":"2023-06-20","arxiv_id":"2306.11681","repositories_listed":0,"syntology":null},{"url":null,"slug":"recent-advances-in-direct-speech-to-text","title":"Recent Advances in Direct Speech-to-text Translation","date":"2023-06-20","arxiv_id":"2306.11646","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-spatio-temporal-network-for-video-semantic","title":"A spatio-temporal network for video semantic segmentation in surgical videos","date":"2023-06-19","arxiv_id":"2306.11052","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-gated-fusion-with-prefix-tuning-for","title":"Dual-Gated Fusion with Prefix-Tuning for Multi-Modal Relation Extraction","date":"2023-06-19","arxiv_id":"2306.11020","repositories_listed":0,"syntology":null},{"url":null,"slug":"lvvc-a-learned-versatile-video-coding","title":"VNVC: A Versatile Neural Video Coding Framework for Efficient Human-Machine Vision","date":"2023-06-19","arxiv_id":"2306.10681","repositories_listed":0,"syntology":null},{"url":null,"slug":"machine-learning-for-real-time-anomaly","title":"Machine Learning for Real-Time Anomaly Detection in Optical Networks","date":"2023-06-19","arxiv_id":"2306.10741","repositories_listed":0,"syntology":null},{"url":null,"slug":"neuro-symbolic-bi-directional-translation","title":"Neuro-Symbolic Bi-Directional Translation -- Deep Learning Explainability for Climate Tipping Point Research","date":"2023-06-19","arxiv_id":"2306.11161","repositories_listed":0,"syntology":null},{"url":null,"slug":"segt-a-novel-separated-edge-guidance","title":"SegT: A Novel Separated Edge-guidance Transformer Network for Polyp Segmentation","date":"2023-06-19","arxiv_id":"2306.10773","repositories_listed":0,"syntology":null},{"url":null,"slug":"unimc-a-unified-framework-for-long-term","title":"UniMC: A Unified Framework for Long-Term Memory Conversation via Relevance Representation Learning","date":"2023-06-18","arxiv_id":"2306.10543","repositories_listed":0,"syntology":null},{"url":null,"slug":"dreamcatcher-revealing-the-language-of-the","title":"DreamCatcher: Revealing the Language of the Brain with fMRI using GPT Embedding","date":"2023-06-16","arxiv_id":"2306.10082","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-learning-based-meta-modeling-for-multi","title":"Deep learning based Meta-modeling for Multi-objective Technology Optimization of Electrical Machines","date":"2023-06-15","arxiv_id":"2306.09087","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-knowledge-distillation-for-surgical","title":"Self-Knowledge Distillation for Surgical Phase Recognition","date":"2023-06-15","arxiv_id":"2306.08961","repositories_listed":0,"syntology":null},{"url":null,"slug":"em-network-oracle-guided-self-distillation","title":"EM-Network: Oracle Guided Self-distillation for Sequence Learning","date":"2023-06-14","arxiv_id":"2306.10058","repositories_listed":0,"syntology":null},{"url":null,"slug":"m-2unet-metaformer-multi-scale-upsampling","title":"M^2UNet: MetaFormer Multi-scale Upsampling Network for Polyp Segmentation","date":"2023-06-14","arxiv_id":"2306.08600","repositories_listed":0,"syntology":null},{"url":null,"slug":"recipes-for-sequential-pre-training-of","title":"Recipes for Sequential Pre-training of Multilingual Encoder and Seq2Seq Models","date":"2023-06-14","arxiv_id":"2306.08756","repositories_listed":0,"syntology":null},{"url":null,"slug":"decoding-brain-motor-imagery-with-various","title":"Decoding Brain Motor Imagery with various Machine Learning techniques","date":"2023-06-13","arxiv_id":"2306.07519","repositories_listed":0,"syntology":null},{"url":null,"slug":"i-see-dead-people-gray-box-adversarial-attack","title":"I See Dead People: Gray-Box Adversarial Attack on Image-To-Text Models","date":"2023-06-13","arxiv_id":"2306.07591","repositories_listed":0,"syntology":null},{"url":null,"slug":"cd-ctfm-a-lightweight-cnn-transformer-network","title":"CD-CTFM: A Lightweight CNN-Transformer Network for Remote Sensing Cloud Detection Fusing Multiscale Features","date":"2023-06-12","arxiv_id":"2306.07186","repositories_listed":0,"syntology":null},{"url":null,"slug":"coupled-attention-networks-for-multivariate","title":"Coupled Attention Networks for Multivariate Time Series Anomaly Detection","date":"2023-06-12","arxiv_id":"2306.07114","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comprehensive-review-of-state-of-the-art","title":"A Comprehensive Review of State-of-The-Art Methods for Java Code Generation from Natural Language Text","date":"2023-06-10","arxiv_id":"2306.06371","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-efficient-speech-separation-network-based","title":"An Efficient Speech Separation Network Based on Recurrent Fusion Dilated Convolution and Channel Attention","date":"2023-06-09","arxiv_id":"2306.05887","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-encoder-decoder-and-dual-path","title":"Efficient Encoder-Decoder and Dual-Path Conformer for Comprehensive Feature Learning in Speech Enhancement","date":"2023-06-09","arxiv_id":"2306.05861","repositories_listed":0,"syntology":null},{"url":null,"slug":"single-stage-visual-relationship-learning","title":"Single-Stage Visual Relationship Learning using Conditional Queries","date":"2023-06-09","arxiv_id":"2306.05689","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-attentive-survival-analysis-in-limit","title":"Deep Attentive Survival Analysis in Limit Order Books: Estimating Fill Probabilities with Convolutional-Transformers","date":"2023-06-08","arxiv_id":"2306.05479","repositories_listed":0,"syntology":null},{"url":null,"slug":"flowformer-a-transformer-architecture-and-its","title":"FlowFormer: A Transformer Architecture and Its Masked Cost Volume Autoencoding for Optical Flow","date":"2023-06-08","arxiv_id":"2306.05442","repositories_listed":0,"syntology":null},{"url":null,"slug":"joint-channel-estimation-and-feedback-with","title":"Joint Channel Estimation and Feedback with Masked Token Transformers in Massive MIMO Systems","date":"2023-06-08","arxiv_id":"2306.06125","repositories_listed":0,"syntology":null},{"url":null,"slug":"posterior-collapse-in-linear-conditional-and","title":"Beyond Vanilla Variational Autoencoders: Detecting Posterior Collapse in Conditional and Hierarchical Variational Autoencoders","date":"2023-06-08","arxiv_id":"2306.05023","repositories_listed":0,"syntology":null},{"url":null,"slug":"absformer-transformer-based-model-for","title":"Absformer: Transformer-based Model for Unsupervised Multi-Document Abstractive Summarization","date":"2023-06-07","arxiv_id":"2306.04787","repositories_listed":0,"syntology":null},{"url":null,"slug":"data-augmentation-for-improving-tail-traffic","title":"Data Augmentation for Improving Tail-traffic Robustness in Skill-routing for Dialogue Systems","date":"2023-06-07","arxiv_id":"2306.04823","repositories_listed":0,"syntology":null},{"url":null,"slug":"set-to-sequence-ranking-based-concept-aware","title":"Set-to-Sequence Ranking-based Concept-aware Learning Path Recommendation","date":"2023-06-07","arxiv_id":"2306.04234","repositories_listed":0,"syntology":null},{"url":null,"slug":"transfer-learning-from-pre-trained-language","title":"Transfer Learning from Pre-trained Language Models Improves End-to-End Speech Summarization","date":"2023-06-07","arxiv_id":"2306.04233","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-novel-implementation-methodology-for-error","title":"A Novel Implementation Methodology for Error Correction Codes on a Neuromorphic Architecture","date":"2023-06-06","arxiv_id":"2306.04010","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-unified-framework-to-super-resolve-face","title":"A Unified Framework to Super-Resolve Face Images of Varied Low Resolutions","date":"2023-06-06","arxiv_id":"2306.03380","repositories_listed":0,"syntology":null},{"url":null,"slug":"textformer-a-query-based-end-to-end-text","title":"TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision","date":"2023-06-06","arxiv_id":"2306.03377","repositories_listed":0,"syntology":null},{"url":null,"slug":"color-aware-deep-temporal-backdrop-duplex","title":"Color-aware Deep Temporal Backdrop Duplex Matting System","date":"2023-06-05","arxiv_id":"2306.02954","repositories_listed":0,"syntology":null},{"url":null,"slug":"doubly-stochastic-graph-based-non","title":"Doubly Stochastic Graph-based Non-autoregressive Reaction Prediction","date":"2023-06-05","arxiv_id":"2306.06119","repositories_listed":0,"syntology":null},{"url":null,"slug":"non-parametric-probabilistic-time-series","title":"Non-parametric Probabilistic Time Series Forecasting via Innovations Representation","date":"2023-06-05","arxiv_id":"2306.03782","repositories_listed":0,"syntology":null},{"url":null,"slug":"extract-and-attend-improving-entity","title":"Extract and Attend: Improving Entity Translation in Neural Machine Translation","date":"2023-06-04","arxiv_id":"2306.02242","repositories_listed":0,"syntology":null},{"url":null,"slug":"modular-transformers-compressing-transformers","title":"Modular Transformers: Compressing Transformers into Modularized Layers for Flexible Efficient Inference","date":"2023-06-04","arxiv_id":"2306.02379","repositories_listed":0,"syntology":null},{"url":null,"slug":"usd-unknown-sensitive-detector-empowered-by","title":"USD: Unknown Sensitive Detector Empowered by Decoupled Objectness and Segment Anything Model","date":"2023-06-04","arxiv_id":"2306.02275","repositories_listed":0,"syntology":null},{"url":null,"slug":"hd-demucs-general-speech-restoration-with","title":"HD-DEMUCS: General Speech Restoration with Heterogeneous Decoders","date":"2023-06-02","arxiv_id":"2306.01411","repositories_listed":0,"syntology":null},{"url":null,"slug":"masked-autoencoder-for-unsupervised-video","title":"Masked Autoencoder for Unsupervised Video Summarization","date":"2023-06-02","arxiv_id":"2306.01395","repositories_listed":0,"syntology":null},{"url":null,"slug":"ocbev-object-centric-bev-transformer-for","title":"OCBEV: Object-Centric BEV Transformer for Multi-View 3D Object Detection","date":"2023-06-02","arxiv_id":"2306.01738","repositories_listed":0,"syntology":null},{"url":null,"slug":"sapi-surroundings-aware-vehicle-trajectory","title":"SAPI: Surroundings-Aware Vehicle Trajectory Prediction at Intersections","date":"2023-06-02","arxiv_id":"2306.01812","repositories_listed":0,"syntology":null},{"url":null,"slug":"study-socially-aware-temporally-casual","title":"STUDY: Socially Aware Temporally Causal Decoder Recommender Systems","date":"2023-06-02","arxiv_id":"2306.07946","repositories_listed":0,"syntology":null},{"url":null,"slug":"data-interpolants-that-s-what-discriminators","title":"Data Interpolants -- That's What Discriminators in Higher-order Gradient-regularized GANs Are","date":"2023-06-01","arxiv_id":"2306.00785","repositories_listed":0,"syntology":null},{"url":null,"slug":"encoder-decoder-multimodal-speaker-change","title":"Encoder-decoder multimodal speaker change detection","date":"2023-06-01","arxiv_id":"2306.00680","repositories_listed":0,"syntology":null},{"url":null,"slug":"hierarchical-attention-encoder-decoder","title":"Hierarchical Attention Encoder Decoder","date":"2023-06-01","arxiv_id":"2306.01070","repositories_listed":0,"syntology":null},{"url":null,"slug":"improved-cross-lingual-transfer-learning-for","title":"Improved Cross-Lingual Transfer Learning For Automatic Speech Translation","date":"2023-06-01","arxiv_id":"2306.00789","repositories_listed":0,"syntology":null},{"url":null,"slug":"masked-autoencoders-with-multi-window","title":"Masked Autoencoders with Multi-Window Local-Global Attention Are Better Audio Learners","date":"2023-06-01","arxiv_id":"2306.00561","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-ideal-large-eddy-simulation-modeling","title":"Neural Ideal Large Eddy Simulation: Modeling Turbulence with Neural Stochastic Differential Equations","date":"2023-06-01","arxiv_id":"2306.01174","repositories_listed":0,"syntology":null},{"url":null,"slug":"pv2tea-patching-visual-modality-to-textual","title":"PV2TEA: Patching Visual Modality to Textual-Established Information Extraction","date":"2023-06-01","arxiv_id":"2306.01016","repositories_listed":0,"syntology":null},{"url":null,"slug":"snapfusion-text-to-image-diffusion-model-on","title":"SnapFusion: Text-to-Image Diffusion Model on Mobile Devices within Two Seconds","date":"2023-06-01","arxiv_id":"2306.00980","repositories_listed":0,"syntology":null},{"url":null,"slug":"examining-the-emergence-of-deductive","title":"Examining the Emergence of Deductive Reasoning in Generative Language Models","date":"2023-05-31","arxiv_id":"2306.01009","repositories_listed":0,"syntology":null},{"url":null,"slug":"how-does-pretraining-improve-discourse-aware","title":"How Does Pretraining Improve Discourse-Aware Translation?","date":"2023-05-31","arxiv_id":"2305.19847","repositories_listed":0,"syntology":null},{"url":null,"slug":"strategies-for-improving-low-resource-speech","title":"Strategies for improving low resource speech to text translation relying on pre-trained ASR models","date":"2023-05-31","arxiv_id":"2306.00208","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-transformer-decoder-based-features","title":"Dual Transformer Decoder based Features Fusion Network for Automated Audio Captioning","date":"2023-05-30","arxiv_id":"2305.18753","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-clustering-transformer-network-for","title":"Dynamic Clustering Transformer Network for Point Cloud Segmentation","date":"2023-05-30","arxiv_id":"2306.08073","repositories_listed":0,"syntology":null},{"url":null,"slug":"long-term-wind-power-forecasting-with","title":"Long-term Wind Power Forecasting with Hierarchical Spatial-Temporal Transformer","date":"2023-05-30","arxiv_id":"2305.18724","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-choice-of-perception-loss-function-for","title":"On the Choice of Perception Loss Function for Learned Video Compression","date":"2023-05-30","arxiv_id":"2305.19301","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-massive-mimo-channel-estimation","title":"Unsupervised Massive MIMO Channel Estimation with Dual-Path Knowledge-Aware Auto-Encoders","date":"2023-05-30","arxiv_id":"2305.18744","repositories_listed":0,"syntology":null},{"url":null,"slug":"vvc-extension-scheme-for-object-detection","title":"VVC Extension Scheme for Object Detection Using Contrast Reduction","date":"2023-05-30","arxiv_id":"2305.18782","repositories_listed":0,"syntology":null},{"url":null,"slug":"bright-bi-level-feature-representation-of","title":"BRICS: Bi-level feature Representation of Image CollectionS","date":"2023-05-29","arxiv_id":"2305.18601","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-modal-face-stylization-with-a","title":"Multi-Modal Face Stylization with a Generative Prior","date":"2023-05-29","arxiv_id":"2305.18009","repositories_listed":0,"syntology":null},{"url":null,"slug":"networked-time-series-imputation-via-position","title":"Networked Time Series Imputation via Position-aware Graph Enhanced Variational Autoencoders","date":"2023-05-29","arxiv_id":"2305.18612","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-machine-translation-with-dynamic-graph","title":"Neural Machine Translation with Dynamic Graph Convolutional Decoder","date":"2023-05-28","arxiv_id":"2305.17698","repositories_listed":0,"syntology":null},{"url":null,"slug":"rasr2-the-rwth-asr-toolkit-for-generic","title":"RASR2: The RWTH ASR Toolkit for Generic Sequence-to-sequence Speech Recognition","date":"2023-05-28","arxiv_id":"2305.17782","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-segmentation-with-bidirectional","title":"Semantic Segmentation with Bidirectional Language Models Improves Long-form ASR","date":"2023-05-28","arxiv_id":"2305.18419","repositories_listed":0,"syntology":null},{"url":null,"slug":"benchmarking-diverse-modal-entity-linking","title":"Benchmarking Diverse-Modal Entity Linking with Generative Models","date":"2023-05-27","arxiv_id":"2305.17337","repositories_listed":0,"syntology":null},{"url":null,"slug":"wavepf-a-novel-fusion-approach-based-on","title":"DePF: A Novel Fusion Approach based on Decomposition Pooling for Infrared and Visible Images","date":"2023-05-27","arxiv_id":"2305.17376","repositories_listed":0,"syntology":null},{"url":null,"slug":"high-fidelity-image-compression-with-score","title":"High-Fidelity Image Compression with Score-based Generative Models","date":"2023-05-26","arxiv_id":"2305.18231","repositories_listed":0,"syntology":null},{"url":null,"slug":"inter-connection-effective-connection-between","title":"Inter-connection: Effective Connection between Pre-trained Encoder and Decoder for Speech Translation","date":"2023-05-26","arxiv_id":"2305.16897","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-computational-power-of-decoder-only","title":"How Powerful are Decoder-Only Transformer Neural Models?","date":"2023-05-26","arxiv_id":"2305.17026","repositories_listed":0,"syntology":null},{"url":null,"slug":"pedestrian-trajectory-forecasting-using-deep","title":"Pedestrian Trajectory Forecasting Using Deep Ensembles Under Sensing Uncertainty","date":"2023-05-26","arxiv_id":"2305.16620","repositories_listed":0,"syntology":null},{"url":null,"slug":"abstractive-summary-generation-for-the-urdu","title":"Abstractive Summary Generation for the Urdu Language","date":"2023-05-25","arxiv_id":"2305.16195","repositories_listed":0,"syntology":null},{"url":null,"slug":"haav-hierarchical-aggregation-of-augmented-1","title":"HAAV: Hierarchical Aggregation of Augmented Views for Image Captioning","date":"2023-05-25","arxiv_id":"2305.16295","repositories_listed":0,"syntology":null},{"url":null,"slug":"image-is-first-order-norm-linear","title":"Image as First-Order Norm+Linear Autoregression: Unveiling Mathematical Invariance","date":"2023-05-25","arxiv_id":"2305.16319","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-scheduled-sampling-for-neural","title":"Improving Scheduled Sampling for Neural Transducer-based ASR","date":"2023-05-25","arxiv_id":"2305.15958","repositories_listed":0,"syntology":null},{"url":null,"slug":"interactive-segment-anything-nerf-with","title":"Interactive Segment Anything NeRF with Feature Imitation","date":"2023-05-25","arxiv_id":"2305.16233","repositories_listed":0,"syntology":null},{"url":null,"slug":"scan-and-snap-understanding-training-dynamics","title":"Scan and Snap: Understanding Training Dynamics and Token Composition in 1-layer Transformer","date":"2023-05-25","arxiv_id":"2305.16380","repositories_listed":0,"syntology":null},{"url":null,"slug":"viola-unified-codec-language-models-for","title":"VioLA: Unified Codec Language Models for Speech Recognition, Synthesis, and Translation","date":"2023-05-25","arxiv_id":"2305.16107","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-lingual-data-augmentation-for-document","title":"Cross-lingual Data Augmentation for Document-grounded Dialog Systems in Low Resource Languages","date":"2023-05-24","arxiv_id":"2305.14949","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-modal-mutual-attention-and-iterative","title":"Multi-Modal Mutual Attention and Iterative Interaction for Referring Image Segmentation","date":"2023-05-24","arxiv_id":"2305.15302","repositories_listed":0,"syntology":null},{"url":null,"slug":"reinforcement-learning-finetuned-vision-code","title":"Learning UI-to-Code Reverse Generator Using Visual Critic Without Rendering","date":"2023-05-24","arxiv_id":"2305.14637","repositories_listed":0,"syntology":null},{"url":null,"slug":"ba-sot-boundary-aware-serialized-output","title":"BA-SOT: Boundary-Aware Serialized Output Training for Multi-Talker ASR","date":"2023-05-23","arxiv_id":"2305.13716","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffhand-end-to-end-hand-mesh-reconstruction","title":"DiffHand: End-to-End Hand Mesh Reconstruction via Diffusion Models","date":"2023-05-23","arxiv_id":"2305.13705","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-representational-disparities","title":"Exploring Representational Disparities Between Multilingual and Bilingual Translation Models","date":"2023-05-23","arxiv_id":"2305.14230","repositories_listed":0,"syntology":null},{"url":null,"slug":"flowchroma-a-deep-recurrent-neural-network","title":"FlowChroma -- A Deep Recurrent Neural Network for Video Colorization","date":"2023-05-23","arxiv_id":"2305.13704","repositories_listed":0,"syntology":null}],"record_sha256":"1a9a0c466430e8ae560b002e26e4e01a602334f7eb6416079d0917564f301e9c","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}