{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/action-classification/papers/5","list_of":"/task/action-classification","task":"Action Classification","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":5,"pages_in_order":5,"rows_per_page":100,"rows":[401,457],"of":457,"counts":{"archive_papers_tagged":457,"with_a_code_link":251,"where_syntology_ran_a_sample":83,"not_listed_spam_title":0,"listed":457,"listed_where_code_ran":83,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":75,"every_run_a_failure_of_syntologys_instrument":8,"listed_with_a_run_with_no_instrument_failure":75,"listed_every_run_a_failure_of_syntologys_instrument":8,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/action-classification","prev":"/task/action-classification/papers/4","next":null,"papers":[{"url":null,"slug":"spatio-temporal-channel-correlation-networks","title":"Spatio-Temporal Channel Correlation Networks for Action Classification","date":"2018-06-19","arxiv_id":"1806.07754","repositories_listed":0,"syntology":null},{"url":"/paper/videos-as-space-time-region-graphs","slug":"videos-as-space-time-region-graphs","title":"Videos as Space-Time Region Graphs","date":"2018-06-05","arxiv_id":"1806.01810","repositories_listed":0,"syntology":null},{"url":null,"slug":"videocapsulenet-a-simplified-network-for","title":"VideoCapsuleNet: A Simplified Network for Action Detection","date":"2018-05-21","arxiv_id":"1805.08162","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-verb-corpus","title":"Action Verb Corpus","date":"2018-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/rethinking-the-faster-r-cnn-architecture-for","slug":"rethinking-the-faster-r-cnn-architecture-for","title":"Rethinking the Faster R-CNN Architecture for Temporal Action Localization","date":"2018-04-20","arxiv_id":"1804.07667","repositories_listed":0,"syntology":null},{"url":null,"slug":"disjoint-multi-task-learning-between","title":"Disjoint Multi-task Learning between Heterogeneous Human-centric Tasks","date":"2018-02-14","arxiv_id":"1802.04962","repositories_listed":0,"syntology":null},{"url":"/paper/end-to-end-fine-grained-action-segmentation","slug":"end-to-end-fine-grained-action-segmentation","title":"End-to-End Fine-Grained Action Segmentation and Recognition Using Conditional Random Field Models and Discriminative Sparse Coding","date":"2018-01-29","arxiv_id":"1801.09571","repositories_listed":0,"syntology":null},{"url":null,"slug":"actionable-email-intent-modeling-with","title":"Actionable Email Intent Modeling with Reparametrized RNNs","date":"2017-12-26","arxiv_id":"1712.09185","repositories_listed":0,"syntology":null},{"url":null,"slug":"highly-efficient-human-action-recognition","title":"Highly Efficient Human Action Recognition with Quantum Genetic Algorithm Optimized Support Vector Machine","date":"2017-11-27","arxiv_id":"1711.09511","repositories_listed":0,"syntology":null},{"url":null,"slug":"attend-and-interact-higher-order-object","title":"Attend and Interact: Higher-Order Object Interactions for Video Understanding","date":"2017-11-16","arxiv_id":"1711.06330","repositories_listed":0,"syntology":null},{"url":null,"slug":"flip-invariant-motion-representation","title":"Flip-Invariant Motion Representation","date":"2017-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"action-classification-and-highlighting-in","title":"Action Classification and Highlighting in Videos","date":"2017-08-31","arxiv_id":"1708.09522","repositories_listed":0,"syntology":null},{"url":"/paper/revisiting-the-effectiveness-of-off-the-shelf","slug":"revisiting-the-effectiveness-of-off-the-shelf","title":"Revisiting the Effectiveness of Off-the-shelf Temporal Modeling Approaches for Large-scale Video Classification","date":"2017-08-12","arxiv_id":"1708.03805","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-video-understanding-by","title":"Unsupervised Video Understanding by Reconciliation of Posture Similarities","date":"2017-08-03","arxiv_id":"1708.01191","repositories_listed":0,"syntology":null},{"url":null,"slug":"action-recognition-by-learning-pose","title":"Action recognition by learning pose representations","date":"2017-08-02","arxiv_id":"1708.00672","repositories_listed":0,"syntology":null},{"url":"/paper/temporal-convolution-based-action-proposal","slug":"temporal-convolution-based-action-proposal","title":"Temporal Convolution Based Action Proposal: Submission to ActivityNet 2017","date":"2017-07-21","arxiv_id":"1707.06750","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-the-path-signature-for-skeleton","title":"Developing the Path Signature Methodology and its Application to Landmark-based Human Action Recognition","date":"2017-07-13","arxiv_id":"1707.03993","repositories_listed":0,"syntology":null},{"url":null,"slug":"weakly-supervised-actor-action-segmentation","title":"Weakly Supervised Actor-Action Segmentation via Robust Multi-Task Ranking","date":"2017-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"generic-tubelet-proposals-for-action","title":"Generic Tubelet Proposals for Action Localization","date":"2017-05-30","arxiv_id":"1705.10861","repositories_listed":0,"syntology":null},{"url":null,"slug":"single-image-action-recognition-by-predicting","title":"Single Image Action Recognition by Predicting Space-Time Saliency","date":"2017-05-12","arxiv_id":"1705.04641","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-feature-embedding-strategy-for-high-level","title":"A Feature Embedding Strategy for High-level CNN representations from Multiple ConvNets","date":"2017-05-11","arxiv_id":"1705.04301","repositories_listed":0,"syntology":null},{"url":"/paper/actionvlad-learning-spatio-temporal","slug":"actionvlad-learning-spatio-temporal","title":"ActionVLAD: Learning spatio-temporal aggregation for action classification","date":"2017-04-10","arxiv_id":"1704.02895","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-representation-learning-for-human-motion","title":"Deep representation learning for human motion prediction and classification","date":"2017-02-24","arxiv_id":"1702.07486","repositories_listed":0,"syntology":null},{"url":null,"slug":"vision-and-language-integration-moving-beyond","title":"Vision and Language Integration: Moving beyond Objects","date":"2017-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"hybrid-learning-of-optical-flow-and-next","title":"Hybrid Learning of Optical Flow and Next Frame Prediction to Boost Optical Flow in the Wild","date":"2016-12-12","arxiv_id":"1612.03777","repositories_listed":0,"syntology":null},{"url":"/paper/self-supervised-video-representation-learning-1","slug":"self-supervised-video-representation-learning-1","title":"Self-Supervised Video Representation Learning With Odd-One-Out Networks","date":"2016-11-21","arxiv_id":"1611.06646","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-traditional-to-modern-domain-adaptation","title":"From Traditional to Modern : Domain Adaptation for Action Classification in Short Social Video Clips","date":"2016-10-18","arxiv_id":"1610.05613","repositories_listed":0,"syntology":null},{"url":"/paper/generating-videos-with-scene-dynamics","slug":"generating-videos-with-scene-dynamics","title":"Generating Videos with Scene Dynamics","date":"2016-09-08","arxiv_id":"1609.02612","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-action-concept-trees-and-semantic","title":"Learning Action Concept Trees and Semantic Alignment Networks from Image-Description Data","date":"2016-09-08","arxiv_id":"1609.02284","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-two-stream-motion-and-appearance-3d","title":"Efficient Two-Stream Motion and Appearance 3D CNNs for Video Classification","date":"2016-08-31","arxiv_id":"1608.08851","repositories_listed":0,"syntology":null},{"url":null,"slug":"spatio-temporal-co-occurrence","title":"Spatio-temporal Co-Occurrence Characterizations for Human Action Classification","date":"2016-08-02","arxiv_id":"1610.05174","repositories_listed":0,"syntology":null},{"url":null,"slug":"natural-language-descriptions-of-human","title":"Natural Language Descriptions of Human Activities Scenes: Corpus Generation and Analysis","date":"2016-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"action-classification-via-concepts-and","title":"Action Classification via Concepts and Attributes","date":"2016-05-25","arxiv_id":"1605.07824","repositories_listed":0,"syntology":null},{"url":null,"slug":"revisiting-human-action-recognition","title":"Revisiting Human Action Recognition: Personalization vs. Generalization","date":"2016-05-02","arxiv_id":"1605.00392","repositories_listed":0,"syntology":null},{"url":"/paper/improved-dense-trajectory-with-cross-streams","slug":"improved-dense-trajectory-with-cross-streams","title":"Improved Dense Trajectory with Cross Streams","date":"2016-04-29","arxiv_id":"1604.08826","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-human-action-recognition-by-non","title":"Improving Human Action Recognition by Non-action Classification","date":"2016-04-21","arxiv_id":"1604.06397","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-thumos-challenge-on-action-recognition","title":"The THUMOS Challenge on Action Recognition for Videos \"in the Wild\"","date":"2016-04-21","arxiv_id":"1604.06182","repositories_listed":0,"syntology":null},{"url":null,"slug":"acd-action-concept-discovery-from-image","title":"ACD: Action Concept Discovery from Image-Sentence Corpora","date":"2016-04-16","arxiv_id":"1604.04784","repositories_listed":0,"syntology":null},{"url":null,"slug":"recurrent-mixture-density-network-for","title":"Recurrent Mixture Density Network for Spatiotemporal Visual Attention","date":"2016-03-27","arxiv_id":"1603.08199","repositories_listed":0,"syntology":null},{"url":"/paper/deep-multimodal-feature-analysis-for-action","slug":"deep-multimodal-feature-analysis-for-action","title":"Deep Multimodal Feature Analysis for Action Recognition in RGB+D Videos","date":"2016-03-23","arxiv_id":"1603.07120","repositories_listed":0,"syntology":null},{"url":"/paper/segmental-spatiotemporal-cnns-for-fine","slug":"segmental-spatiotemporal-cnns-for-fine","title":"Segmental Spatiotemporal CNNs for Fine-grained Action Segmentation","date":"2016-02-09","arxiv_id":"1602.02995","repositories_listed":0,"syntology":null},{"url":null,"slug":"human-action-segmentation-with-hierarchical","title":"Human Action Segmentation With Hierarchical Supervoxel Consistency","date":"2015-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"what-do-15000-object-categories-tell-us-about","title":"What do 15,000 Object Categories Tell Us About Classifying and Localizing Actions?","date":"2015-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"long-short-term-motion-feature-for-action","title":"Long-short Term Motion Feature for Action Classification and Retrieval","date":"2015-02-13","arxiv_id":"1502.04132","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-optimization-for-average-precision","title":"Efficient Optimization for Average Precision SVM","date":"2014-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"action-classification-with-locality","title":"Action Classification with Locality-constrained Linear Coding","date":"2014-08-17","arxiv_id":"1408.3810","repositories_listed":0,"syntology":null},{"url":null,"slug":"robust-statistical-approach-for-extraction-of","title":"Robust Statistical Approach for Extraction of Moving Human Silhouettes from Videos","date":"2014-08-17","arxiv_id":"1408.3814","repositories_listed":0,"syntology":null},{"url":null,"slug":"r-cnns-for-pose-estimation-and-action","title":"R-CNNs for Pose Estimation and Action Detection","date":"2014-06-19","arxiv_id":"1406.5212","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-cause-and-effect-analysis-of-motion","title":"A Cause and Effect Analysis of Motion Trajectories for Modeling Actions","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-feature-extraction-encoding-and","title":"Efficient Feature Extraction, Encoding and Classification for Action Recognition","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"optimizing-average-precision-using-weakly","title":"Optimizing Average Precision using Weakly Supervised Data","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"recognition-of-complex-events-exploiting","title":"Recognition of Complex Events: Exploiting Temporal Dynamics between Underlying Concepts","date":"2014-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"feature-sampling-and-partitioning-for-visual","title":"Feature sampling and partitioning for visual vocabulary generation on large action classification datasets","date":"2014-05-29","arxiv_id":"1405.7545","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-coordinate-solvers-for-large-scale","title":"Dual coordinate solvers for large-scale structural SVMs","date":"2013-12-06","arxiv_id":"1312.1743","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-study-on-unsupervised-dictionary-learning","title":"A Study on Unsupervised Dictionary Learning and Feature Encoding for Action Classification","date":"2013-09-02","arxiv_id":"1309.0309","repositories_listed":0,"syntology":null},{"url":null,"slug":"representing-videos-using-mid-level","title":"Representing Videos Using Mid-level Discriminative Patches","date":"2013-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"bilinear-classifiers-for-visual-recognition","title":"Bilinear classifiers for visual recognition","date":"2009-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null}],"record_sha256":"6dd044125ce1a27e76dae541e74c7edd5d949701ba04c1a56387ea56c9873406","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}