{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/clip-magnitude","entry":"clip_magnitude","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-25T09:33:49+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":16,"n_papers_ran":16,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":1,"n_samples_ran":1,"n_samples_fingerprinted":1,"n_places":16,"n_places_pointer_only":3,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":0,"ran_fixture":0,"ran":1,"unverified":0},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2608.02332","paper":"/paper/arxiv-2608-02332","title":"Diffusion Policy with Behavioral Advantage Correction for Offline Reinforcement Learning","date":null,"month_inferred_from_arxiv_id":"2026-08","title_source":"syntology","repo":"aviralkumar2907/CQL","path":"d4rl/rlkit/pythonplusplus.py","file_url":"https://github.com/aviralkumar2907/CQL/blob/HEAD/d4rl/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2507.08387","paper":null,"title":"arXiv:2507.08387","date":null,"month_inferred_from_arxiv_id":"2025-07","title_source":null,"repo":"shlee94/Off2OnRL","path":"rlkit/rlkit/pythonplusplus.py","file_url":"https://github.com/shlee94/Off2OnRL/blob/HEAD/rlkit/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2312.03587","paper":"/paper/language-informed-visual-concept-learning","title":"Language-Informed Visual Concept Learning","date":"2023-12-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"sharonal10/langint","path":"tu/tu/configs.py","file_url":"https://github.com/sharonal10/langint/blob/HEAD/tu/tu/configs.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2311.05067","paper":"/paper/accelerating-exploration-with-unlabeled-prior-1","title":"Accelerating Exploration with Unlabeled Prior Data","date":"2023-11-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"avisingh599/cog","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/avisingh599/cog/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2307.05891","paper":"/paper/pid-inspired-inductive-biases-for-deep-1","title":"PID-Inspired Inductive Biases for Deep Reinforcement Learning in Partially Observable Control Tasks","date":"2023-07-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"IanChar/GPIDE","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/IanChar/GPIDE/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2305.19746","paper":"/paper/adaptive-and-explainable-deployment-of","title":"Adaptive and Explainable Deployment of Navigation Skills via Hierarchical Deep Reinforcement Learning","date":null,"month_inferred_from_arxiv_id":"2023-05","title_source":"archive","repo":"leekwoon/hrl-nav","path":"src/rlkit/pythonplusplus.py","file_url":"https://github.com/leekwoon/hrl-nav/blob/HEAD/src/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2212.13936","paper":"/paper/on-pathologies-in-kl-regularized-1","title":"On Pathologies in KL-Regularized Reinforcement Learning from Expert Demonstrations","date":"2022-12-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"conglu1997/nppac","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/conglu1997/nppac/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2110.03655","paper":"/paper/augmenting-reinforcement-learning-with","title":"Augmenting Reinforcement Learning with Behavior Primitives for Diverse Manipulation Tasks","date":"2021-10-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"UT-Austin-RPL/maple","path":"maple/pythonplusplus.py","file_url":"https://github.com/UT-Austin-RPL/maple/blob/HEAD/maple/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2104.09122","paper":"/paper/probabilistic-mixture-of-experts-for-1","title":"Probabilistic Mixture-of-Experts for Efficient Deep Reinforcement Learning","date":"2021-04-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"JieRen98/rlkit-pmoe","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/JieRen98/rlkit-pmoe/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2010.08252","paper":"/paper/hyperparameter-auto-tuning-in-self-supervised","title":"Hyperparameter Auto-tuning in Self-Supervised Robotic Learning","date":"2020-10-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"birlrobotics/rlkit_autotune","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/birlrobotics/rlkit_autotune/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2006.13916","paper":"/paper/off-dynamics-reinforcement-learning-training","title":"Off-Dynamics Reinforcement Learning: Training for Transfer with Domain Classifiers","date":"2020-06-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"shreyasc-13/off_domain_rlkit","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/shreyasc-13/off_domain_rlkit/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"2006.04779","paper":"/paper/conservative-q-learning-for-offline","title":"Conservative Q-Learning for Offline Reinforcement Learning","date":"2020-06-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ikostrikov/cql-results","path":"d4rl/rlkit/pythonplusplus.py","file_url":"https://github.com/ikostrikov/cql-results/blob/HEAD/d4rl/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"1912.11032","paper":"/paper/towards-practical-multi-object-manipulation","title":"Towards Practical Multi-Object Manipulation using Relational Reinforcement Learning","date":"2019-12-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"richardrl/rlkit-relational","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/richardrl/rlkit-relational/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"1911.08453","paper":"/paper/planning-with-goal-conditioned-policies-1","title":"Planning with Goal-Conditioned Policies","date":"2019-11-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"snasiriany/leap","path":"railrl/pythonplusplus.py","file_url":"https://github.com/snasiriany/leap/blob/HEAD/railrl/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"1910.12827","paper":"/paper/entity-abstraction-in-visual-model-based","title":"Entity Abstraction in Visual Model-Based Reinforcement Learning","date":"2019-10-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jcoreyes/OP3","path":"op3/pythonplusplus.py","file_url":"https://github.com/jcoreyes/OP3/blob/HEAD/op3/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}},{"arxiv_id":"1910.11670","paper":"/paper/contextual-imagined-goals-for-self-supervised","title":"Contextual Imagined Goals for Self-Supervised Robotic Learning","date":"2019-10-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"anair13/rlkit","path":"rlkit/pythonplusplus.py","file_url":"https://github.com/anair13/rlkit/blob/HEAD/rlkit/pythonplusplus.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"93d28ca67303e04b","mcp_get_code":{"code_sha256":"93d28ca67303e04b"}}]}