{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/action-recognition-in-videos/papers/22","list_of":"/task/action-recognition-in-videos","task":"Action Recognition","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":22,"pages_in_order":28,"rows_per_page":100,"rows":[2101,2200],"of":2759,"counts":{"archive_papers_tagged":2759,"with_a_code_link":1058,"where_syntology_ran_a_sample":275,"not_listed_spam_title":0,"listed":2759,"listed_where_code_ran":275,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":232,"every_run_a_failure_of_syntologys_instrument":43,"listed_with_a_run_with_no_instrument_failure":232,"listed_every_run_a_failure_of_syntologys_instrument":43,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/action-recognition-in-videos","prev":"/task/action-recognition-in-videos/papers/21","next":"/task/action-recognition-in-videos/papers/23","papers":[{"url":null,"slug":"action-recognition-via-pose-based-graph","title":"Action Recognition via Pose-Based Graph Convolutional Networks with Intermediate Dense Supervision","date":"2019-11-28","arxiv_id":"1911.12509","repositories_listed":0,"syntology":null},{"url":null,"slug":"adapnet-adaptability-decomposing-encoder","title":"AdapNet: Adaptability Decomposing Encoder-Decoder Network for Weakly Supervised Action Recognition and Localization","date":"2019-11-27","arxiv_id":"1911.11961","repositories_listed":0,"syntology":null},{"url":"/paper/an-attention-enhanced-recurrent-graph","slug":"an-attention-enhanced-recurrent-graph","title":"An Attention-Enhanced Recurrent Graph Convolutional Network for Skeleton-Based Action Recognition","date":"2019-11-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"literature-review-of-action-recognition-in","title":"Literature Review of Action Recognition in the Wild","date":"2019-11-27","arxiv_id":"1911.12249","repositories_listed":0,"syntology":null},{"url":null,"slug":"skeleton-based-zero-shot-action-recognition","title":"Skeleton based Zero Shot Action Recognition in Joint Pose-Language Semantic Space","date":"2019-11-26","arxiv_id":"1911.11344","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-image-to-video-adaptation-and-fusion","title":"Deep Image-to-Video Adaptation and Fusion Networks for Action Recognition","date":"2019-11-25","arxiv_id":"1911.10751","repositories_listed":0,"syntology":null},{"url":null,"slug":"teinet-towards-an-efficient-architecture-for","title":"TEINet: Towards an Efficient Architecture for Video Recognition","date":"2019-11-21","arxiv_id":"1911.09435","repositories_listed":0,"syntology":null},{"url":null,"slug":"take-an-emotion-walk-perceiving-emotions-from","title":"Take an Emotion Walk: Perceiving Emotions from Gaits Using Hierarchical Attention Pooling and Affective Mapping","date":"2019-11-20","arxiv_id":"1911.08708","repositories_listed":0,"syntology":null},{"url":null,"slug":"mimic-the-raw-domain-accelerating-action","title":"Mimic The Raw Domain: Accelerating Action Recognition in the Compressed Domain","date":"2019-11-19","arxiv_id":"1911.08206","repositories_listed":0,"syntology":null},{"url":null,"slug":"smart-skeletal-motion-action-recognition","title":"SMART: Skeletal Motion Action Recognition aTtack","date":"2019-11-16","arxiv_id":"1911.07107","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-aligned-convolutional-neural-network-for","title":"Deep-Aligned Convolutional Neural Network for Skeleton-based Action Recognition and Segmentation","date":"2019-11-12","arxiv_id":"1911.04969","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-recognition-using-supervised-spiking","title":"Action Recognition Using Supervised Spiking Neural Networks","date":"2019-11-09","arxiv_id":"1911.03630","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-spectral-nonlocal-block-for-neural-networks","title":"A Spectral Nonlocal Block for Neural Networks","date":"2019-11-04","arxiv_id":"1911.01059","repositories_listed":0,"syntology":null},{"url":null,"slug":"comprehensive-video-understanding-video","title":"Comprehensive Video Understanding: Video summarization with content-based video recommender design","date":"2019-10-30","arxiv_id":"1910.13888","repositories_listed":0,"syntology":null},{"url":"/paper/skip-clip-self-supervised-spatiotemporal","slug":"skip-clip-self-supervised-spatiotemporal","title":"Skip-Clip: Self-Supervised Spatiotemporal Representation Learning by Future Clip Order Ranking","date":"2019-10-28","arxiv_id":"1910.12770","repositories_listed":0,"syntology":null},{"url":"/paper/spatial-residual-layer-and-dense-connection","slug":"spatial-residual-layer-and-dense-connection","title":"Spatial Residual Layer and Dense Connection Block Enhanced Spatial Temporal Graph Convolutional Network for Skeleton-Based Action Recognition","date":"2019-10-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"controllable-attention-for-structured-layered-1","title":"Controllable Attention for Structured Layered Video Decomposition","date":"2019-10-24","arxiv_id":"1910.11306","repositories_listed":0,"syntology":null},{"url":null,"slug":"human-action-recognition-in-drone-videos","title":"Human Action Recognition in Drone Videos using a Few Aerial Training Examples","date":"2019-10-22","arxiv_id":"1910.10027","repositories_listed":0,"syntology":null},{"url":null,"slug":"predictive-coding-networks-meet-action","title":"Predictive Coding Networks Meet Action Recognition","date":"2019-10-22","arxiv_id":"1910.10056","repositories_listed":0,"syntology":null},{"url":null,"slug":"looking-ahead-anticipating-pedestrians","title":"Looking Ahead: Anticipating Pedestrians Crossing with Future Frames Prediction","date":"2019-10-20","arxiv_id":"1910.09077","repositories_listed":0,"syntology":null},{"url":null,"slug":"human-action-recognition-with-multi-laplacian","title":"Human Action Recognition with Multi-Laplacian Graph Convolutional Networks","date":"2019-10-15","arxiv_id":"1910.06934","repositories_listed":0,"syntology":null},{"url":null,"slug":"real-time-monitoring-of-driver-drowsiness-on","title":"Real-time monitoring of driver drowsiness on mobile platforms using 3D neural networks","date":"2019-10-15","arxiv_id":"1910.06540","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-stage-hrnet-multiple-stage-high","title":"Multi-Stage HRNet: Multiple Stage High-Resolution Network for Human Pose Estimation","date":"2019-10-14","arxiv_id":"1910.05901","repositories_listed":0,"syntology":null},{"url":null,"slug":"generating-human-action-videos-by-coupling-3d","title":"Generating Human Action Videos by Coupling 3D Game Engines and Probabilistic Graphical Models","date":"2019-10-12","arxiv_id":"1910.06699","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-modal-knowledge-distillation-for-action","title":"Cross-modal knowledge distillation for action recognition","date":"2019-10-10","arxiv_id":"1910.04641","repositories_listed":0,"syntology":null},{"url":null,"slug":"compressed-video-action-recognition-with","title":"Compressed Video Action Recognition with Refined Motion Vector","date":"2019-10-06","arxiv_id":"1910.02533","repositories_listed":0,"syntology":null},{"url":"/paper/symbiotic-graph-neural-networks-for-3d","slug":"symbiotic-graph-neural-networks-for-3d","title":"Symbiotic Graph Neural Networks for 3D Skeleton-based Human Action Recognition and Motion Prediction","date":"2019-10-05","arxiv_id":"1910.02212","repositories_listed":0,"syntology":null},{"url":null,"slug":"advit-adversarial-frames-identifier-based-on","title":"AdvIT: Adversarial Frames Identifier Based on Temporal Consistency in Videos","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/bayesian-graph-convolution-lstm-for-skeleton","slug":"bayesian-graph-convolution-lstm-for-skeleton","title":"Bayesian Graph Convolution LSTM for Skeleton Based Action Recognition","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/driveact-a-multi-modal-dataset-for-fine","slug":"driveact-a-multi-modal-dataset-for-fine","title":"Drive&Act: A Multi-Modal Dataset for Fine-Grained Driver Behavior Recognition in Autonomous Vehicles","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-multi-view-human-action","title":"Generative Multi-View Human Action Recognition","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/mmact-a-large-scale-dataset-for-cross-modal","slug":"mmact-a-large-scale-dataset-for-cross-modal","title":"MMAct: A Large-Scale Dataset for Cross Modal Human Action Understanding","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"order-preserving-wasserstein-discriminant","title":"Order-Preserving Wasserstein Discriminant Analysis","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"view-lstm-novel-view-video-synthesis-through","title":"View-LSTM: Novel-View Video Synthesis Through View Decomposition","date":"2019-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"spatio-temporal-fast-3d-convolutions-for","title":"Spatio-Temporal FAST 3D Convolutions for Human Action Recognition","date":"2019-09-30","arxiv_id":"1909.13474","repositories_listed":0,"syntology":null},{"url":null,"slug":"discriminability-distillation-in-group-1","title":"Discriminability Distillation in Group Representation Learning","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"190910214","title":"Learning Coupled Spatial-temporal Attention for Skeleton-based Action Recognition","date":"2019-09-23","arxiv_id":"1909.10214","repositories_listed":0,"syntology":null},{"url":"/paper/making-the-invisible-visible-action","slug":"making-the-invisible-visible-action","title":"Making the Invisible Visible: Action Recognition Through Walls and Occlusions","date":"2019-09-20","arxiv_id":"1909.09300","repositories_listed":0,"syntology":null},{"url":null,"slug":"target-specific-action-classification-for","title":"Target-Specific Action Classification for Automated Assessment of Human Motor Behavior from Video","date":"2019-09-20","arxiv_id":"1909.09566","repositories_listed":0,"syntology":null},{"url":null,"slug":"global-temporal-representation-based-cnns-for","title":"Global Temporal Representation based CNNs for Infrared Action Recognition","date":"2019-09-18","arxiv_id":"1909.08287","repositories_listed":0,"syntology":null},{"url":null,"slug":"transferable-feature-representation-for","title":"Transferable Feature Representation for Visible-to-Infrared Cross-Dataset Human Action Recognition","date":"2019-09-18","arxiv_id":"1909.08297","repositories_listed":0,"syntology":null},{"url":null,"slug":"protogan-towards-few-shot-learning-for-action","title":"ProtoGAN: Towards Few Shot Learning for Action Recognition","date":"2019-09-17","arxiv_id":"1909.07945","repositories_listed":0,"syntology":null},{"url":null,"slug":"multitask-learning-to-improve-egocentric","title":"Multitask Learning to Improve Egocentric Action Recognition","date":"2019-09-15","arxiv_id":"1909.06761","repositories_listed":0,"syntology":null},{"url":null,"slug":"x-tom-explaining-with-theory-of-mind-for","title":"X-ToM: Explaining with Theory-of-Mind for Gaining Justified Human Trust","date":"2019-09-15","arxiv_id":"1909.06907","repositories_listed":0,"syntology":null},{"url":null,"slug":"adversarial-attack-on-skeleton-based-human","title":"Adversarial Attack on Skeleton-based Human Action Recognition","date":"2019-09-14","arxiv_id":"1909.06500","repositories_listed":0,"syntology":null},{"url":null,"slug":"metric-based-few-shot-learning-for-video","title":"Metric-Based Few-Shot Learning for Video Action Recognition","date":"2019-09-14","arxiv_id":"1909.09602","repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-action-recognition-in-videos-a","title":"Zero-Shot Action Recognition in Videos: A Survey","date":"2019-09-13","arxiv_id":"1909.06423","repositories_listed":0,"syntology":null},{"url":"/paper/mlgcn-multi-laplacian-graph-convolutional","slug":"mlgcn-multi-laplacian-graph-convolutional","title":"MLGCN: Multi-Laplacian Graph Convolutional Networks for Human Action Recognition","date":"2019-09-11","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-modal-three-stream-network-for-action","title":"Multi-Modal Three-Stream Network for Action Recognition","date":"2019-09-08","arxiv_id":"1909.03466","repositories_listed":0,"syntology":null},{"url":null,"slug":"discriminative-video-representation-learning","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","date":"2019-09-05","arxiv_id":"1909.02856","repositories_listed":0,"syntology":null},{"url":"/paper/eleatt-rnn-adding-attentiveness-to-neurons-in","slug":"eleatt-rnn-adding-attentiveness-to-neurons-in","title":"EleAtt-RNN: Adding Attentiveness to Neurons in Recurrent Neural Networks","date":"2019-09-03","arxiv_id":"1909.01939","repositories_listed":0,"syntology":null},{"url":null,"slug":"riemannian-batch-normalization-for-spd-neural","title":"Riemannian batch normalization for SPD neural networks","date":"2019-09-03","arxiv_id":"1909.02414","repositories_listed":0,"syntology":null},{"url":null,"slug":"dwnet-deep-wide-network-for-3d-action","title":"DWnet: Deep-Wide Network for 3D Action Recognition","date":"2019-08-29","arxiv_id":"1908.11036","repositories_listed":0,"syntology":null},{"url":"/paper/cooperative-cross-stream-network-for","slug":"cooperative-cross-stream-network-for","title":"Cooperative Cross-Stream Network for Discriminative Action Representation","date":"2019-08-27","arxiv_id":"1908.10136","repositories_listed":0,"syntology":null},{"url":null,"slug":"mobile-video-action-recognition","title":"Mobile Video Action Recognition","date":"2019-08-27","arxiv_id":"1908.10155","repositories_listed":0,"syntology":null},{"url":"/paper/temporal-reasoning-graph-for-activity","slug":"temporal-reasoning-graph-for-activity","title":"Temporal Reasoning Graph for Activity Recognition","date":"2019-08-27","arxiv_id":"1908.09995","repositories_listed":0,"syntology":null},{"url":"/paper/graph-based-skeleton-modeling-for-human","slug":"graph-based-skeleton-modeling-for-human","title":"Graph Based Skeleton Modeling for Human Activity Analysis","date":"2019-08-26","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"non-local-recurrent-neural-memory-for","title":"Non-local Recurrent Neural Memory for Supervised Sequence Modeling","date":"2019-08-26","arxiv_id":"1908.09535","repositories_listed":0,"syntology":null},{"url":"/paper/190807625","slug":"190807625","title":"Action recognition with spatial-temporal discriminative filter banks","date":"2019-08-20","arxiv_id":"1908.07625","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-enhancement-transform-two-stream-3d","title":"Cross-Enhancement Transform Two-Stream 3D ConvNets for Action Recognition","date":"2019-08-19","arxiv_id":"1908.08916","repositories_listed":0,"syntology":null},{"url":null,"slug":"gradient-weighted-superpixels-for","title":"Gradient Weighted Superpixels for Interpretability in CNNs","date":"2019-08-16","arxiv_id":"1908.08997","repositories_listed":0,"syntology":null},{"url":null,"slug":"bypass-enhancement-rgb-stream-model-for","title":"Bypass Enhancement RGB Stream Model for Pedestrian Action Recognition of Autonomous Vehicles","date":"2019-08-15","arxiv_id":"1908.05674","repositories_listed":0,"syntology":null},{"url":null,"slug":"sparse-coding-of-shape-trajectories-for","title":"Sparse Coding of Shape Trajectories for Facial Expression and Action Recognition","date":"2019-08-08","arxiv_id":"1908.03231","repositories_listed":0,"syntology":null},{"url":"/paper/stm-spatiotemporal-and-motion-encoding-for","slug":"stm-spatiotemporal-and-motion-encoding-for","title":"STM: SpatioTemporal and Motion Encoding for Action Recognition","date":"2019-08-07","arxiv_id":"1908.02486","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-recognition-in-untrimmed-videos-with","title":"Action Recognition in Untrimmed Videos with Composite Self-Attention Two-Stream Framework","date":"2019-08-04","arxiv_id":"1908.04353","repositories_listed":0,"syntology":null},{"url":null,"slug":"fitting-comparison-and-alignment-of","title":"Fitting, Comparison, and Alignment of Trajectories on Positive Semi-Definite Matrices with Application to Action Recognition","date":"2019-08-01","arxiv_id":"1908.00646","repositories_listed":0,"syntology":null},{"url":"/paper/two-stream-video-classification-with-cross","slug":"two-stream-video-classification-with-cross","title":"Two-Stream Video Classification with Cross-Modality Attention","date":"2019-08-01","arxiv_id":"1908.00497","repositories_listed":0,"syntology":null},{"url":"/paper/multi-agent-reinforcement-learning-based","slug":"multi-agent-reinforcement-learning-based","title":"Multi-Agent Reinforcement Learning Based Frame Sampling for Effective Untrimmed Video Recognition","date":"2019-07-31","arxiv_id":"1907.13369","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-multi-kernel-convolutional-lstm-networks","title":"Deep Multi-Kernel Convolutional LSTM Networks and an Attention-Based Mechanism for Videos","date":"2019-07-30","arxiv_id":"1908.08990","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-novel-approach-for-robust-multi-human","title":"A Novel Approach for Robust Multi Human Action Recognition and Summarization based on 3D Convolutional Neural Networks","date":"2019-07-25","arxiv_id":"1907.11272","repositories_listed":0,"syntology":null},{"url":null,"slug":"weakly-supervised-recognition-of-surgical","title":"Weakly Supervised Recognition of Surgical Gestures","date":"2019-07-25","arxiv_id":"1907.10993","repositories_listed":0,"syntology":null},{"url":null,"slug":"motion-aware-feature-for-improved-video","title":"Motion-Aware Feature for Improved Video Anomaly Detection","date":"2019-07-24","arxiv_id":"1907.10211","repositories_listed":0,"syntology":null},{"url":null,"slug":"domain-specific-priors-and-meta-learning-for","title":"Domain-Specific Priors and Meta Learning for Few-Shot First-Person Action Recognition","date":"2019-07-22","arxiv_id":"1907.09382","repositories_listed":0,"syntology":null},{"url":"/paper/tarn-temporal-attentive-relation-network-for","slug":"tarn-temporal-attentive-relation-network-for","title":"TARN: Temporal Attentive Relation Network for Few-Shot and Zero-Shot Action Recognition","date":"2019-07-21","arxiv_id":"1907.09021","repositories_listed":0,"syntology":null},{"url":null,"slug":"real-time-driver-state-monitoring-using-a-cnn","title":"Real-Time Driver State Monitoring Using a CNN Based Spatio-Temporal Approach","date":"2019-07-18","arxiv_id":"1907.08009","repositories_listed":0,"syntology":null},{"url":"/paper/spatiotemporal-graph-routing-for-skeleton","slug":"spatiotemporal-graph-routing-for-skeleton","title":"Spatiotemporal graph routing for skeleton-based action recognition","date":"2019-07-17","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-unified-deep-framework-for-joint-3d-pose","title":"A Unified Deep Framework for Joint 3D Pose Estimation and Action Recognition from a Single RGB Camera","date":"2019-07-16","arxiv_id":"1907.06968","repositories_listed":0,"syntology":null},{"url":null,"slug":"slow-feature-analysis-for-human-action","title":"Slow Feature Analysis for Human Action Recognition","date":"2019-07-15","arxiv_id":"1907.06670","repositories_listed":0,"syntology":null},{"url":null,"slug":"two-stream-spatiotemporal-feature-for-video","title":"Two-stream Spatiotemporal Feature for Video QA Task","date":"2019-07-11","arxiv_id":"1907.05006","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-action-recognition-via-neural","title":"Video Action Recognition Via Neural Architecture Searching","date":"2019-07-10","arxiv_id":"1907.04632","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-deep-learning-approach-for-real-time-3d","title":"A Deep Learning Approach for Real-Time 3D Human Action Recognition from Skeletal Data","date":"2019-07-08","arxiv_id":"1907.03520","repositories_listed":0,"syntology":null},{"url":"/paper/learning-shape-motion-representations-from","slug":"learning-shape-motion-representations-from","title":"Learning Shape-Motion Representations from Geometric Algebra Spatio-Temporal Model for Skeleton-Based Action Recognition","date":"2019-07-08","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"deformable-tube-network-for-action-detection","title":"Deformable Tube Network for Action Detection in Videos","date":"2019-07-03","arxiv_id":"1907.01847","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-analysis-of-deep-neural-networks-with","title":"An Analysis of Deep Neural Networks with Attention for Action Recognition from a Neurophysiological Perspective","date":"2019-07-02","arxiv_id":"1907.01273","repositories_listed":0,"syntology":null},{"url":"/paper/few-shot-video-classification-via-temporal","slug":"few-shot-video-classification-via-temporal","title":"Few-Shot Video Classification via Temporal Alignment","date":"2019-06-27","arxiv_id":"1906.11415","repositories_listed":0,"syntology":null},{"url":null,"slug":"baidu-uts-submission-to-the-epic-kitchens","title":"Baidu-UTS Submission to the EPIC-Kitchens Action Recognition Challenge 2019","date":"2019-06-22","arxiv_id":"1906.09383","repositories_listed":0,"syntology":null},{"url":null,"slug":"fbk-hupba-submission-to-the-epic-kitchens","title":"FBK-HUPBA Submission to the EPIC-Kitchens 2019 Action Recognition Challenge","date":"2019-06-21","arxiv_id":"1906.08960","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-action-recognition-network-for-specific","title":"An Action Recognition network for specific target based on rMC and RPN","date":"2019-06-19","arxiv_id":"1906.07944","repositories_listed":0,"syntology":null},{"url":"/paper/r-stan-residual-spatial-temporal-attention","slug":"r-stan-residual-spatial-temporal-attention","title":"R-STAN: Residual Spatial-Temporal Attention Network for Action Recognition","date":"2019-06-19","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-temporal-sequence-learning-for-action","title":"A Temporal Sequence Learning for Action Recognition and Prediction","date":"2019-06-17","arxiv_id":"1906.06813","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatio-temporal-fusion-networks-for-action","title":"Spatio-Temporal Fusion Networks for Action Recognition","date":"2019-06-17","arxiv_id":"1906.06822","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-real-time-action-recognition-on","title":"Towards Real-Time Action Recognition on Mobile Devices Using Deep Models","date":"2019-06-17","arxiv_id":"1906.07052","repositories_listed":0,"syntology":null},{"url":"/paper/three-stream-convolutional-neural-network","slug":"three-stream-convolutional-neural-network","title":"Three-Stream Convolutional Neural Network With Multi-Task and Ensemble Learning for 3D Action Recognition","date":"2019-06-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-temporal-action-proposal-generation","title":"Accelerating temporal action proposal generation via high performance computing","date":"2019-06-15","arxiv_id":"1906.06496","repositories_listed":0,"syntology":null},{"url":null,"slug":"trimmed-action-recognition-dense-captioning","title":"Trimmed Action Recognition, Dense-Captioning Events in Videos, and Spatio-temporal Action Localization with Focus on ActivityNet Challenge 2019","date":"2019-06-14","arxiv_id":"1906.07016","repositories_listed":0,"syntology":null},{"url":"/paper/hallucinating-bag-of-words-and-fisher-vector","slug":"hallucinating-bag-of-words-and-fisher-vector","title":"Hallucinating IDT Descriptors and I3D Optical Flow Features for Action Recognition with CNNs","date":"2019-06-13","arxiv_id":"1906.05910","repositories_listed":0,"syntology":null},{"url":"/paper/learning-spatio-temporal-representation-with-3","slug":"learning-spatio-temporal-representation-with-3","title":"Learning Spatio-Temporal Representation with Local and Global Diffusion","date":"2019-06-13","arxiv_id":"1906.05571","repositories_listed":0,"syntology":null},{"url":null,"slug":"weakly-supervised-compositional","title":"Weakly-supervised Compositional FeatureAggregation for Few-shot Recognition","date":"2019-06-11","arxiv_id":"1906.04833","repositories_listed":0,"syntology":null},{"url":"/paper/faster-recurrent-networks-for-video","slug":"faster-recurrent-networks-for-video","title":"FASTER Recurrent Networks for Efficient Video Classification","date":"2019-06-10","arxiv_id":"1906.04226","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-role-of-ego-vision-in-view-invariant","title":"The role of ego vision in view-invariant action recognition","date":"2019-06-10","arxiv_id":"1906.03918","repositories_listed":0,"syntology":null}],"record_sha256":"76efad634885f700a3cebad707b12ca1eb293cc7aae5cec6aebb79475c5f850b","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}