{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/action-recognition-in-videos/papers/18","list_of":"/task/action-recognition-in-videos","task":"Action Recognition","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":18,"pages_in_order":28,"rows_per_page":100,"rows":[1701,1800],"of":2759,"counts":{"archive_papers_tagged":2759,"with_a_code_link":1058,"where_syntology_ran_a_sample":275,"not_listed_spam_title":0,"listed":2759,"listed_where_code_ran":275,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":232,"every_run_a_failure_of_syntologys_instrument":43,"listed_with_a_run_with_no_instrument_failure":232,"listed_every_run_a_failure_of_syntologys_instrument":43,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/action-recognition-in-videos","prev":"/task/action-recognition-in-videos/papers/17","next":"/task/action-recognition-in-videos/papers/19","papers":[{"url":null,"slug":"motion-modulated-temporal-fragment-alignment","title":"Motion-Modulated Temporal Fragment Alignment Network for Few-Shot Action Recognition","date":"2022-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-grained-spatio-temporal-features","title":"Multi-Grained Spatio-Temporal Features Perceived Network for Event-Based Lip-Reading","date":"2022-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"object-relation-reasoning-graph-for-action","title":"Object-Relation Reasoning Graph for Action Recognition","date":"2022-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"recurring-the-transformer-for-video-action","title":"Recurring the Transformer for Video Action Recognition","date":"2022-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"uncertainty-guided-probabilistic-transformer","title":"Uncertainty-Guided Probabilistic Transformer for Complex Action Recognition","date":"2022-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"3d-skeleton-based-few-shot-action-recognition","title":"3D Skeleton-based Few-shot Action Recognition with JEANIE is not so Naïve","date":"2021-12-23","arxiv_id":"2112.12668","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-grained-multi-modal-self-supervised","title":"Fine-grained Multi-Modal Self-Supervised Learning","date":"2021-12-22","arxiv_id":"2112.12182","repositories_listed":0,"syntology":null},{"url":null,"slug":"expansion-squeeze-excitation-fusion-network","title":"Expansion-Squeeze-Excitation Fusion Network for Elderly Activity Recognition","date":"2021-12-21","arxiv_id":"2112.10992","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-hypergraph-convolutional-networks-for","title":"Dynamic Hypergraph Convolutional Networks for Skeleton-Based Action Recognition","date":"2021-12-20","arxiv_id":"2112.10570","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-model-pseudo-labeling-for-semi","title":"Cross-Model Pseudo-Labeling for Semi-Supervised Action Recognition","date":"2021-12-17","arxiv_id":"2112.09690","repositories_listed":0,"syntology":null},{"url":null,"slug":"distillation-of-human-object-interaction","title":"Distillation of Human-Object Interaction Contexts for Action Recognition","date":"2021-12-17","arxiv_id":"2112.09448","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-attention-based-anchor-proposal-for","title":"Self-attention based anchor proposal for skeleton-based action recognition","date":"2021-12-17","arxiv_id":"2112.09413","repositories_listed":0,"syntology":null},{"url":"/paper/co-training-transformer-with-videos-and","slug":"co-training-transformer-with-videos-and","title":"Co-training Transformer with Videos and Images Improves Action Recognition","date":"2021-12-14","arxiv_id":"2112.07175","repositories_listed":0,"syntology":null},{"url":null,"slug":"temporal-transformer-networks-with-self","title":"Temporal Transformer Networks with Self-Supervision for Action Recognition","date":"2021-12-14","arxiv_id":"2112.07338","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-expert-human-action-recognition-with","title":"Multi-Expert Human Action Recognition with Hierarchical Super-Class Learning","date":"2021-12-13","arxiv_id":"2112.07015","repositories_listed":0,"syntology":null},{"url":null,"slug":"real-time-action-recognition-from-video","title":"Real Time Action Recognition from Video Footage","date":"2021-12-13","arxiv_id":"2112.06456","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-supervised-spatiotemporal-representation","title":"Self-supervised Spatiotemporal Representation Learning by Exploiting Video Continuity","date":"2021-12-11","arxiv_id":"2112.05883","repositories_listed":0,"syntology":null},{"url":null,"slug":"stc-mix-space-time-channel-mixing-for-self","title":"Cross-modal Manifold Cutmix for Self-supervised Video Representation Learning","date":"2021-12-07","arxiv_id":"2112.03906","repositories_listed":0,"syntology":null},{"url":null,"slug":"time-equivariant-contrastive-video-1","title":"Time-Equivariant Contrastive Video Representation Learning","date":"2021-12-07","arxiv_id":"2112.03624","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-connectivity-with-graph","title":"Learning Connectivity with Graph Convolutional Networks for Skeleton-based Action Recognition","date":"2021-12-06","arxiv_id":"2112.03328","repositories_listed":0,"syntology":null},{"url":null,"slug":"stsm-spatio-temporal-shift-module-for","title":"STSM: Spatio-Temporal Shift Module for Efficient Action Recognition","date":"2021-12-05","arxiv_id":"2112.02523","repositories_listed":0,"syntology":null},{"url":null,"slug":"make-a-long-image-short-adaptive-token-length","title":"Make A Long Image Short: Adaptive Token Length for Vision Transformers","date":"2021-12-03","arxiv_id":"2112.01686","repositories_listed":0,"syntology":null},{"url":null,"slug":"stacked-temporal-attention-improving-first","title":"Stacked Temporal Attention: Improving First-person Action Recognition by Emphasizing Discriminative Clips","date":"2021-12-02","arxiv_id":"2112.01038","repositories_listed":0,"syntology":null},{"url":"/paper/graph-convolutional-module-for-temporal","slug":"graph-convolutional-module-for-temporal","title":"Graph Convolutional Module for Temporal Action Localization in Videos","date":"2021-12-01","arxiv_id":"2112.00302","repositories_listed":0,"syntology":null},{"url":null,"slug":"reformulating-zero-shot-action-recognition","title":"Reformulating Zero-shot Action Recognition for Multi-label Actions","date":"2021-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"spatiotemporal-joint-filter-decomposition-in","title":"Spatiotemporal Joint Filter Decomposition in 3D Convolutional Neural Networks","date":"2021-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"your-head-is-there-to-move-you-around-goal","title":"Your head is there to move you around: Goal-driven models of the primate dorsal pathway","date":"2021-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-your-body-a-cognitive-assessment-system","title":"Cross Your Body: A Cognitive Assessment System for Children","date":"2021-11-24","arxiv_id":"2111.12824","repositories_listed":0,"syntology":null},{"url":null,"slug":"contrast-reconstruction-representation","title":"Contrast-reconstruction Representation Learning for Self-supervised Skeleton-based Action Recognition","date":"2021-11-22","arxiv_id":"2111.11051","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-recognition-with-domain-invariant","title":"Action Recognition with Domain Invariant Features of Skeleton Image","date":"2021-11-19","arxiv_id":"2111.11250","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-transformers-for-lightweight","title":"Evaluating Transformers for Lightweight Action Recognition","date":"2021-11-18","arxiv_id":"2111.09641","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-scale-semantics-guided-neural-networks","title":"Multi-Scale Semantics-Guided Neural Networks for Efficient Skeleton-Based Human Action Recognition","date":"2021-11-07","arxiv_id":"2111.03993","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-recognition-using-transfer-learning","title":"Action Recognition using Transfer Learning and Majority Voting for CSGO","date":"2021-11-06","arxiv_id":"2111.03882","repositories_listed":0,"syntology":null},{"url":null,"slug":"technical-report-disentangled-action-parsing","title":"Technical Report: Disentangled Action Parsing Networks for Accurate Part-level Action Parsing","date":"2021-11-05","arxiv_id":"2111.03225","repositories_listed":0,"syntology":null},{"url":null,"slug":"event-and-activity-recognition-in-video","title":"Event and Activity Recognition in Video Surveillance for Cyber-Physical Systems","date":"2021-11-03","arxiv_id":"2111.02064","repositories_listed":0,"syntology":null},{"url":null,"slug":"gradient-frequency-modulation-for-visually","title":"Gradient Frequency Modulation for Visually Explaining Video Understanding Models","date":"2021-11-01","arxiv_id":"2111.01215","repositories_listed":0,"syntology":null},{"url":null,"slug":"livestock-monitoring-with-transformer","title":"Livestock Monitoring with Transformer","date":"2021-11-01","arxiv_id":"2111.00801","repositories_listed":0,"syntology":null},{"url":null,"slug":"lsta-net-long-short-term-spatio-temporal","title":"LSTA-Net: Long short-term Spatio-Temporal Aggregation Network for Skeleton-based Action Recognition","date":"2021-11-01","arxiv_id":"2111.00823","repositories_listed":0,"syntology":null},{"url":null,"slug":"distantly-supervised-semantic-text-detection","title":"Distantly Supervised Semantic Text Detection and Recognition for Broadcast Sports Videos Understanding","date":"2021-10-31","arxiv_id":"2111.00629","repositories_listed":0,"syntology":null},{"url":null,"slug":"skeleton-based-mutually-assisted-interacted","title":"Skeleton-Based Mutually Assisted Interacted Object Localization and Human Action Recognition","date":"2021-10-28","arxiv_id":"2110.14994","repositories_listed":0,"syntology":null},{"url":null,"slug":"iip-transformer-intra-inter-part-transformer","title":"IIP-Transformer: Intra-Inter-Part Transformer for Skeleton-Based Action Recognition","date":"2021-10-26","arxiv_id":"2110.13385","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatio-temporal-graph-complementary","title":"Spatio-Temporal Graph Complementary Scattering Networks","date":"2021-10-23","arxiv_id":"2110.12150","repositories_listed":0,"syntology":null},{"url":null,"slug":"gtm-gray-temporal-model-for-video-recognition","title":"GTM: Gray Temporal Model for Video Recognition","date":"2021-10-20","arxiv_id":"2110.10348","repositories_listed":0,"syntology":null},{"url":null,"slug":"domain-generalization-through-audio-visual","title":"Domain Generalization through Audio-Visual Relative Norm Alignment in First Person Action Recognition","date":"2021-10-19","arxiv_id":"2110.10101","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatial-temporal-transformer-for-3d-point","title":"Spatial-Temporal Transformer for 3D Point Cloud Sequences","date":"2021-10-19","arxiv_id":"2110.09783","repositories_listed":0,"syntology":null},{"url":null,"slug":"sca-net-sparse-channel-attention-module-for","title":"SCA Net: Sparse Channel Attention Module for Action Recognition","date":"2021-10-15","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"knights-first-place-submission-for-vipriors21","title":"\"Knights\": First Place Submission for VIPriors21 Action Recognition Challenge at ICCV 2021","date":"2021-10-14","arxiv_id":"2110.07758","repositories_listed":0,"syntology":null},{"url":null,"slug":"nuisance-label-supervision-robustness","title":"Nuisance-Label Supervision: Robustness Improvement by Free Labels","date":"2021-10-14","arxiv_id":"2110.07118","repositories_listed":0,"syntology":null},{"url":null,"slug":"joint-learning-on-the-hierarchy","title":"Joint Learning On The Hierarchy Representation for Fine-Grained Human Action Recognition","date":"2021-10-12","arxiv_id":"2110.05853","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-is-graph-structured-graph-module-for","title":"Video Is Graph: Structured Graph Module for Video Action Recognition","date":"2021-10-12","arxiv_id":"2110.05904","repositories_listed":0,"syntology":null},{"url":"/paper/high-order-tensor-pooling-with-attention-for","slug":"high-order-tensor-pooling-with-attention-for","title":"High-order Tensor Pooling with Attention for Action Recognition","date":"2021-10-11","arxiv_id":"2110.05216","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-baseline-framework-for-part-level-action","title":"A Baseline Framework for Part-level Action Parsing and Action Recognition","date":"2021-10-07","arxiv_id":"2110.03368","repositories_listed":0,"syntology":null},{"url":null,"slug":"saic-cambridge-hupba-fbk-submission-to-the","title":"SAIC_Cambridge-HuPBA-FBK Submission to the EPIC-Kitchens-100 Action Recognition Challenge 2021","date":"2021-10-06","arxiv_id":"2110.02902","repositories_listed":0,"syntology":null},{"url":null,"slug":"vision-based-excavator-activity-analysis-and","title":"Construction Site Safety Monitoring and Excavator Activity Analysis System","date":"2021-10-06","arxiv_id":"2110.03083","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-modelling-across-time-of-human","title":"Efficient Modelling Across Time of Human Actions and Interactions","date":"2021-10-05","arxiv_id":"2110.02120","repositories_listed":0,"syntology":null},{"url":null,"slug":"procedure-planning-in-instructional-videosvia","title":"Procedure Planning in Instructional Videos via Contextual Modeling and Model-based Policy Learning","date":"2021-10-05","arxiv_id":"2110.01770","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatio-temporal-video-representation-learning","title":"Spatio-Temporal Video Representation Learning for AI Based Video Playback Style Prediction","date":"2021-10-03","arxiv_id":"2110.01015","repositories_listed":0,"syntology":null},{"url":"/paper/comparative-validation-of-machine-learning","slug":"comparative-validation-of-machine-learning","title":"Comparative Validation of Machine Learning Algorithms for Surgical Workflow and Skill Analysis with the HeiChole Benchmark","date":"2021-09-30","arxiv_id":"2109.14956","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-learning-based-action-detection-in","title":"Deep Learning-based Action Detection in Untrimmed Videos: A Survey","date":"2021-09-30","arxiv_id":"2110.00111","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-few-shot-action-recognition-via","title":"Unsupervised Few-Shot Action Recognition via Action-Appearance Aligned Meta-Adaptation","date":"2021-09-30","arxiv_id":"2109.15317","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-stage-transformer-for-video-learning","title":"Cross-Stage Transformer for Video Learning","date":"2021-09-29","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fundamental-limits-of-transfer-learning-in","title":"Fundamental Limits of Transfer Learning in Binary Classifications","date":"2021-09-29","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"self-supervised-learning-of-motion-informed","title":"Self-Supervised Learning of Motion-Informed Latents","date":"2021-09-29","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"transductive-universal-transport-for-zero","title":"Transductive Universal Transport for Zero-Shot Action Recognition","date":"2021-09-29","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"vi-mix-for-self-supervised-video","title":"Vi-MIX FOR SELF-SUPERVISED VIDEO REPRESENTATION","date":"2021-09-29","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"information-elevation-network-for-fast-online","title":"Information Elevation Network for Fast Online Action Detection","date":"2021-09-28","arxiv_id":"2109.13572","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-supervised-video-representation-learning-9","title":"Self-Supervised Video Representation Learning by Video Incoherence Detection","date":"2021-09-26","arxiv_id":"2109.12493","repositories_listed":0,"syntology":null},{"url":null,"slug":"long-short-view-feature-decomposition-via","title":"Long Short View Feature Decomposition via Contrastive Video Representation Learning","date":"2021-09-23","arxiv_id":"2109.11593","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-view-invariant-human-posture","title":"Unsupervised View-Invariant Human Posture Representation","date":"2021-09-17","arxiv_id":"2109.08730","repositories_listed":0,"syntology":null},{"url":null,"slug":"adversarial-bone-length-attack-on-action","title":"Adversarial Bone Length Attack on Action Recognition","date":"2021-09-13","arxiv_id":"2109.05830","repositories_listed":0,"syntology":null},{"url":null,"slug":"egocentric-view-hand-action-recognition-by","title":"Egocentric View Hand Action Recognition by Leveraging Hand Surface and Hand Grasp Type","date":"2021-09-08","arxiv_id":"2109.03783","repositories_listed":0,"syntology":null},{"url":null,"slug":"gcst-graph-convolutional-skeleton-transformer","title":"Hierarchical Graph Convolutional Skeleton Transformer for Action Recognition","date":"2021-09-07","arxiv_id":"2109.02860","repositories_listed":0,"syntology":null},{"url":"/paper/efficient-action-recognition-using-confidence","slug":"efficient-action-recognition-using-confidence","title":"Efficient Action Recognition Using Confidence Distillation","date":"2021-09-05","arxiv_id":"2109.02137","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-cross-modal-contrastive-features-for","title":"Learning Cross-modal Contrastive Features for Video Domain Adaptation","date":"2021-08-26","arxiv_id":"2108.11974","repositories_listed":0,"syntology":null},{"url":null,"slug":"shifted-chunk-transformer-for-spatio-temporal","title":"Shifted Chunk Transformer for Spatio-Temporal Representational Learning","date":"2021-08-26","arxiv_id":"2108.11575","repositories_listed":0,"syntology":null},{"url":"/paper/biaswap-removing-dataset-bias-with-bias","slug":"biaswap-removing-dataset-bias-with-bias","title":"BiaSwap: Removing dataset bias with bias-tailored swapping augmentation","date":"2021-08-23","arxiv_id":"2108.10008","repositories_listed":0,"syntology":null},{"url":null,"slug":"few-shot-activity-recognition-using","title":"Few Shot Activity Recognition Using Variational Inference","date":"2021-08-20","arxiv_id":"2108.08990","repositories_listed":0,"syntology":null},{"url":null,"slug":"mm-vit-multi-modal-video-transformer-for","title":"MM-ViT: Multi-Modal Video Transformer for Compressed Video Action Recognition","date":"2021-08-20","arxiv_id":"2108.09322","repositories_listed":0,"syntology":null},{"url":"/paper/self-supervised-video-representation-learning-8","slug":"self-supervised-video-representation-learning-8","title":"Self-Supervised Video Representation Learning with Meta-Contrastive Network","date":"2021-08-19","arxiv_id":"2108.08426","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-multi-modal-video-reasoning-and-analyzing","title":"The Multi-Modal Video Reasoning and Analyzing Competition","date":"2021-08-18","arxiv_id":"2108.08344","repositories_listed":0,"syntology":null},{"url":null,"slug":"channel-temporal-attention-for-first-person","title":"Channel-Temporal Attention for First-Person Video Domain Adaptation","date":"2021-08-17","arxiv_id":"2108.07846","repositories_listed":0,"syntology":null},{"url":"/paper/learning-skeletal-graph-neural-networks-for","slug":"learning-skeletal-graph-neural-networks-for","title":"Learning Skeletal Graph Neural Networks for Hard 3D Pose Estimation","date":"2021-08-16","arxiv_id":"2108.07181","repositories_listed":0,"syntology":null},{"url":null,"slug":"temporal-action-segmentation-with-high-level","title":"Temporal Action Segmentation with High-level Complex Activity Labels","date":"2021-08-15","arxiv_id":"2108.06706","repositories_listed":0,"syntology":null},{"url":"/paper/learning-visual-affordance-grounding-from","slug":"learning-visual-affordance-grounding-from","title":"Learning Visual Affordance Grounding from Demonstration Videos","date":"2021-08-12","arxiv_id":"2108.05675","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatio-temporal-human-action-recognition","title":"Spatio-Temporal Human Action Recognition Modelwith Flexible-interval Sampling and Normalization","date":"2021-08-12","arxiv_id":"2108.05633","repositories_listed":0,"syntology":null},{"url":null,"slug":"feature-supervised-action-modality-transfer","title":"Feature-Supervised Action Modality Transfer","date":"2021-08-06","arxiv_id":"2108.03329","repositories_listed":0,"syntology":null},{"url":null,"slug":"skeleton-cloud-colorization-for-unsupervised","title":"Skeleton Cloud Colorization for Unsupervised 3D Action Representation Learning","date":"2021-08-04","arxiv_id":"2108.01959","repositories_listed":0,"syntology":null},{"url":null,"slug":"classifying-action-correctness-in-physical","title":"Classifying action correctness in physical rehabilitation exercises","date":"2021-08-03","arxiv_id":"2108.01375","repositories_listed":0,"syntology":null},{"url":null,"slug":"lighter-stacked-hourglass-human-pose","title":"Lighter Stacked Hourglass Human Pose Estimation","date":"2021-07-28","arxiv_id":"2107.13643","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptive-recursive-circle-framework-for-fine","title":"Adaptive Recursive Circle Framework for Fine-grained Action Recognition","date":"2021-07-25","arxiv_id":"2107.11813","repositories_listed":0,"syntology":null},{"url":null,"slug":"federated-action-recognition-on-heterogeneous","title":"Federated Action Recognition on Heterogeneous Embedded Devices","date":"2021-07-18","arxiv_id":"2107.12147","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-for-temporal-sparsity-in-deep-neural","title":"Training for temporal sparsity in deep neural networks, application in video processing","date":"2021-07-15","arxiv_id":"2107.07305","repositories_listed":0,"syntology":null},{"url":null,"slug":"delta-sampling-r-bert-for-limited-data-and","title":"Delta Sampling R-BERT for limited data and low-light action recognition","date":"2021-07-12","arxiv_id":"2107.05202","repositories_listed":0,"syntology":null},{"url":null,"slug":"aligning-correlation-information-for-domain","title":"Aligning Correlation Information for Domain Adaptation in Action Recognition","date":"2021-07-11","arxiv_id":"2107.04932","repositories_listed":0,"syntology":null},{"url":null,"slug":"interpretable-deep-feature-propagation-for","title":"Interpretable Deep Feature Propagation for Early Action Recognition","date":"2021-07-11","arxiv_id":"2107.05122","repositories_listed":0,"syntology":null},{"url":null,"slug":"review-of-video-predictive-understanding","title":"Review of Video Predictive Understanding: Early Action Recognition and Future Action Prediction","date":"2021-07-11","arxiv_id":"2107.05140","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-3d-sampling-for-self-supervised","title":"Video 3D Sampling for Self-supervised Representation Learning","date":"2021-07-08","arxiv_id":"2107.03578","repositories_listed":0,"syntology":null},{"url":null,"slug":"polito-iit-submission-to-the-epic-kitchens","title":"PoliTO-IIT Submission to the EPIC-KITCHENS-100 Unsupervised Domain Adaptation Challenge for Action Recognition","date":"2021-07-01","arxiv_id":"2107.00337","repositories_listed":0,"syntology":null},{"url":null,"slug":"videolightformer-lightweight-action","title":"VideoLightFormer: Lightweight Action Recognition using Transformers","date":"2021-07-01","arxiv_id":"2107.00451","repositories_listed":0,"syntology":null},{"url":null,"slug":"long-short-temporal-modeling-for-efficient","title":"Long-Short Temporal Modeling for Efficient Action Recognition","date":"2021-06-30","arxiv_id":"2106.15787","repositories_listed":0,"syntology":null}],"record_sha256":"f6786d1fe6b1cc02b2c8ac5652684bc59cb1eff53ad88baedf91617b837fb04a","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}