{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/attention/papers/44","list_of":"/method/attention","method":"Attention","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":44,"pages_in_order":316,"rows_per_page":100,"rows":[4301,4400],"of":31583,"counts":{"archive_papers_tagged":31583,"with_a_code_link":13473,"where_syntology_ran_a_sample":3998,"not_listed_spam_title":0,"listed":31583,"listed_where_code_ran":3998,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":3366,"every_run_a_failure_of_syntologys_instrument":632,"listed_with_a_run_with_no_instrument_failure":3366,"listed_every_run_a_failure_of_syntologys_instrument":632,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/attention","prev":"/method/attention/papers/43","next":"/method/attention/papers/45","papers":[{"paper":null,"slug":"flat-u-net-an-efficient-ultralightweight","title":"Flat U-Net: An Efficient Ultralightweight Model for Solar Filament Segmentation in Full-disk H$α$ Images","date":"2025-02-11","arxiv_id":"2502.07259","n_code_links":0,"syntology":null},{"paper":null,"slug":"foqa-a-faroese-question-answering-dataset","title":"FoQA: A Faroese Question-Answering Dataset","date":"2025-02-11","arxiv_id":"2502.07642","n_code_links":0,"syntology":null},{"paper":null,"slug":"foreign-object-detection-in-high-voltage","title":"Foreign-Object Detection in High-Voltage Transmission Line Based on Improved YOLOv8m","date":"2025-02-11","arxiv_id":"2502.07175","n_code_links":0,"syntology":null},{"paper":"/paper/grammar-control-in-dialogue-response","slug":"grammar-control-in-dialogue-response","title":"Grammar Control in Dialogue Response Generation for Language Learning Chatbots","date":"2025-02-11","arxiv_id":"2502.07544","n_code_links":1,"syntology":null},{"paper":"/paper/graph-rag-tool-fusion","slug":"graph-rag-tool-fusion","title":"Graph RAG-Tool Fusion","date":"2025-02-11","arxiv_id":"2502.07223","n_code_links":1,"syntology":null},{"paper":null,"slug":"hgtul-a-hypergraph-based-model-for-trajectory","title":"HGTUL: A Hypergraph-based Model For Trajectory User Linking","date":"2025-02-11","arxiv_id":"2502.07549","n_code_links":0,"syntology":null},{"paper":null,"slug":"large-cognition-model-towards-pretrained-eeg","title":"Large Cognition Model: Towards Pretrained EEG Foundation Model","date":"2025-02-11","arxiv_id":"2502.17464","n_code_links":0,"syntology":null},{"paper":"/paper/lasp-2-rethinking-sequence-parallelism-for","slug":"lasp-2-rethinking-sequence-parallelism-for","title":"LASP-2: Rethinking Sequence Parallelism for Linear Attention and Its Hybrid","date":"2025-02-11","arxiv_id":"2502.07563","n_code_links":1,"syntology":null},{"paper":null,"slug":"learning-effective-dynamics-across-spatio","title":"Learning Effective Dynamics across Spatio-Temporal Scales of Complex Flows","date":"2025-02-11","arxiv_id":"2502.07990","n_code_links":0,"syntology":null},{"paper":"/paper/linear-transformers-as-var-models-aligning","slug":"linear-transformers-as-var-models-aligning","title":"Linear Transformers as VAR Models: Aligning Autoregressive Attention Mechanisms with Autoregressive Forecasting","date":"2025-02-11","arxiv_id":"2502.07244","n_code_links":1,"syntology":{"ran":7,"of":9,"n_ran_checked":7,"n_instrument":0,"unverified":2,"pointer_only":0,"phrase":"7 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 0 where Syntology's instrument failed) · 2 unverified","official":{"repos":["ljc-fvnr/structural-aligned-mixture-of-var"],"state":"official (archive's flag): 7 ran","n_ran":7,"n_constructed":0,"n_ran_no_instrument_failure":7,"n_unverified":2,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"longred-mitigating-short-text-degradation-of","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","date":"2025-02-11","arxiv_id":"2502.07365","n_code_links":0,"syntology":null},{"paper":"/paper/maat-mamba-adaptive-anomaly-transformer-with","slug":"maat-mamba-adaptive-anomaly-transformer-with","title":"MAAT: Mamba Adaptive Anomaly Transformer with association discrepancy for time series","date":"2025-02-11","arxiv_id":"2502.07858","n_code_links":1,"syntology":null},{"paper":null,"slug":"making-language-models-robust-against","title":"Making Language Models Robust Against Negation","date":"2025-02-11","arxiv_id":"2502.07717","n_code_links":0,"syntology":null},{"paper":"/paper/mask-enhanced-autoregressive-prediction-pay","slug":"mask-enhanced-autoregressive-prediction-pay","title":"Mask-Enhanced Autoregressive Prediction: Pay Less Attention to Learn More","date":"2025-02-11","arxiv_id":"2502.07490","n_code_links":1,"syntology":null},{"paper":"/paper/mgpath-vision-language-model-with-multi","slug":"mgpath-vision-language-model-with-multi","title":"MGPATH: Vision-Language Model with Multi-Granular Prompt Learning for Few-Shot WSI Classification","date":"2025-02-11","arxiv_id":"2502.07409","n_code_links":1,"syntology":null},{"paper":null,"slug":"migt-memory-instance-gated-transformer","title":"MIGT: Memory Instance Gated Transformer Framework for Financial Portfolio Management","date":"2025-02-11","arxiv_id":"2502.07280","n_code_links":0,"syntology":null},{"paper":null,"slug":"nanovlms-how-small-can-we-go-and-still-make","title":"NanoVLMs: How small can we go and still make coherent Vision Language Models?","date":"2025-02-11","arxiv_id":"2502.07838","n_code_links":0,"syntology":null},{"paper":null,"slug":"next-block-prediction-video-generation-via","title":"Next Block Prediction: Video Generation via Semi-Auto-Regressive Modeling","date":"2025-02-11","arxiv_id":"2502.07737","n_code_links":0,"syntology":null},{"paper":null,"slug":"on-training-conditional-conformal-prediction","title":"On Training-Conditional Conformal Prediction and Binomial Proportion Confidence Intervals","date":"2025-02-11","arxiv_id":"2502.07497","n_code_links":0,"syntology":null},{"paper":"/paper/opengrok-enhancing-sns-data-processing-with","slug":"opengrok-enhancing-sns-data-processing-with","title":"OpenGrok: Enhancing SNS Data Processing with Distilled Knowledge and Mask-like Mechanisms","date":"2025-02-11","arxiv_id":"2502.07312","n_code_links":1,"syntology":null},{"paper":null,"slug":"optimizing-knowledge-distillation-in","title":"Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers","date":"2025-02-11","arxiv_id":"2502.07436","n_code_links":0,"syntology":null},{"paper":null,"slug":"pippo-high-resolution-multi-view-humans-from","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","date":"2025-02-11","arxiv_id":"2502.07785","n_code_links":0,"syntology":null},{"paper":null,"slug":"rethinking-timing-residuals-advancing-pet","title":"Rethinking Timing Residuals: Advancing PET Detectors with Explicit TOF Corrections","date":"2025-02-11","arxiv_id":"2502.07630","n_code_links":0,"syntology":null},{"paper":null,"slug":"robust-indoor-localization-in-dynamic","title":"Robust Indoor Localization in Dynamic Environments: A Multi-source Unsupervised Domain Adaptation Framework","date":"2025-02-11","arxiv_id":"2502.07246","n_code_links":0,"syntology":null},{"paper":"/paper/small-language-model-makes-an-effective-long","slug":"small-language-model-makes-an-effective-long","title":"Small Language Model Makes an Effective Long Text Extractor","date":"2025-02-11","arxiv_id":"2502.07286","n_code_links":1,"syntology":null},{"paper":null,"slug":"sparseformer-detecting-objects-in-hrw-shots","title":"SparseFormer: Detecting Objects in HRW Shots via Sparse Vision Transformer","date":"2025-02-11","arxiv_id":"2502.07216","n_code_links":0,"syntology":null},{"paper":null,"slug":"spatial-degradation-aware-and-temporal","title":"Spatial Degradation-Aware and Temporal Consistent Diffusion Model for Compressed Video Super-Resolution","date":"2025-02-11","arxiv_id":"2502.07381","n_code_links":0,"syntology":null},{"paper":"/paper/textatlas5m-a-large-scale-dataset-for-dense","slug":"textatlas5m-a-large-scale-dataset-for-dense","title":"TextAtlas5M: A Large-scale Dataset for Dense Text Image Generation","date":"2025-02-11","arxiv_id":"2502.07870","n_code_links":1,"syntology":null},{"paper":null,"slug":"towards-more-accurate-full-atom-antibody-co","title":"Towards More Accurate Full-Atom Antibody Co-Design","date":"2025-02-11","arxiv_id":"2502.19391","n_code_links":0,"syntology":null},{"paper":null,"slug":"tractable-transformers-for-flexible","title":"Tractable Transformers for Flexible Conditional Generation","date":"2025-02-11","arxiv_id":"2502.07616","n_code_links":0,"syntology":null},{"paper":"/paper/transmla-multi-head-latent-attention-is-all","slug":"transmla-multi-head-latent-attention-is-all","title":"TransMLA: Multi-Head Latent Attention Is All You Need","date":"2025-02-11","arxiv_id":"2502.07864","n_code_links":1,"syntology":null},{"paper":null,"slug":"unveiling-simplicities-of-attention-adaptive","title":"Unveiling Simplicities of Attention: Adaptive Long-Context Head Identification","date":"2025-02-11","arxiv_id":"2502.09647","n_code_links":0,"syntology":null},{"paper":null,"slug":"vidcraft3-camera-object-and-lighting-control","title":"VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation","date":"2025-02-11","arxiv_id":"2502.07531","n_code_links":0,"syntology":null},{"paper":"/paper/a-simple-yet-effective-ddg-predictor-is-an","slug":"a-simple-yet-effective-ddg-predictor-is-an","title":"A Simple yet Effective DDG Predictor is An Unsupervised Antibody Optimizer and Explainer","date":"2025-02-10","arxiv_id":"2502.06913","n_code_links":1,"syntology":null},{"paper":null,"slug":"an-appearance-defect-detection-method-for","title":"An Appearance Defect Detection Method for Cigarettes Based on C-CenterNet","date":"2025-02-10","arxiv_id":"2502.06119","n_code_links":0,"syntology":null},{"paper":"/paper/c-3po-compact-plug-and-play-proxy","slug":"c-3po-compact-plug-and-play-proxy","title":"C-3PO: Compact Plug-and-Play Proxy Optimization to Achieve Human-like Retrieval-Augmented Generation","date":"2025-02-10","arxiv_id":"2502.06205","n_code_links":0,"syntology":{"ran":8,"of":8,"n_ran_checked":7,"n_instrument":1,"unverified":0,"pointer_only":0,"phrase":"8 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","official":null}},{"paper":null,"slug":"col-olhtr-a-novel-framework-for-multimodal","title":"Col-OLHTR: A Novel Framework for Multimodal Online Handwritten Text Recognition","date":"2025-02-10","arxiv_id":"2502.06100","n_code_links":0,"syntology":null},{"paper":null,"slug":"completeness-of-datasets-documentation-on-ml","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","date":"2025-02-10","arxiv_id":"2503.13463","n_code_links":0,"syntology":null},{"paper":"/paper/conditional-diffusion-model-with-spatial","slug":"conditional-diffusion-model-with-spatial","title":"Conditional diffusion model with spatial attention and latent embedding for medical image segmentation","date":"2025-02-10","arxiv_id":"2502.06997","n_code_links":1,"syntology":null},{"paper":"/paper/conmec-a-dataset-for-metonymy-resolution-with","slug":"conmec-a-dataset-for-metonymy-resolution-with","title":"ConMeC: A Dataset for Metonymy Resolution with Common Nouns","date":"2025-02-10","arxiv_id":"2502.06087","n_code_links":1,"syntology":null},{"paper":null,"slug":"customvideox-3d-reference-attention-driven","title":"CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers","date":"2025-02-10","arxiv_id":"2502.06527","n_code_links":0,"syntology":null},{"paper":null,"slug":"debatebench-a-challenging-long-context","title":"DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models","date":"2025-02-10","arxiv_id":"2502.06279","n_code_links":0,"syntology":null},{"paper":null,"slug":"deep-learning-in-automated-power-line","title":"Deep Learning in Automated Power Line Inspection: A Review","date":"2025-02-10","arxiv_id":"2502.07826","n_code_links":0,"syntology":null},{"paper":null,"slug":"do-attention-heads-compete-or-cooperate","title":"Do Attention Heads Compete or Cooperate during Counting?","date":"2025-02-10","arxiv_id":"2502.06923","n_code_links":0,"syntology":null},{"paper":"/paper/early-operative-difficulty-assessment-in","slug":"early-operative-difficulty-assessment-in","title":"Early Operative Difficulty Assessment in Laparoscopic Cholecystectomy via Snapshot-Centric Video Analysis","date":"2025-02-10","arxiv_id":"2502.07008","n_code_links":1,"syntology":null},{"paper":"/paper/efficient-vdit-efficient-video-diffusion","slug":"efficient-vdit-efficient-video-diffusion","title":"Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile","date":"2025-02-10","arxiv_id":"2502.06155","n_code_links":1,"syntology":null},{"paper":null,"slug":"event-vision-sensor-a-review","title":"Event Vision Sensor: A Review","date":"2025-02-10","arxiv_id":"2502.06116","n_code_links":0,"syntology":null},{"paper":null,"slug":"facial-analysis-systems-and-down-syndrome","title":"Facial Analysis Systems and Down Syndrome","date":"2025-02-10","arxiv_id":"2502.06341","n_code_links":0,"syntology":null},{"paper":null,"slug":"find-central-dogma-again","title":"Find Central Dogma Again: Leveraging Multilingual Transfer in Large Language Models","date":"2025-02-10","arxiv_id":"2502.06253","n_code_links":0,"syntology":null},{"paper":null,"slug":"finding-words-associated-with-dif-predicting","title":"Finding Words Associated with DIF: Predicting Differential Item Functioning using LLMs and Explainable AI","date":"2025-02-10","arxiv_id":"2502.07017","n_code_links":0,"syntology":null},{"paper":"/paper/foundation-model-of-electronic-medical","slug":"foundation-model-of-electronic-medical","title":"Foundation Model of Electronic Medical Records for Adaptive Risk Estimation","date":"2025-02-10","arxiv_id":"2502.06124","n_code_links":1,"syntology":null},{"paper":null,"slug":"fully-exploiting-vision-foundation-model-s","title":"Fully Exploiting Vision Foundation Model's Profound Prior Knowledge for Generalizable RGB-Depth Driving Scene Parsing","date":"2025-02-10","arxiv_id":"2502.06219","n_code_links":0,"syntology":null},{"paper":null,"slug":"fundusam-a-specialized-deep-learning-model","title":"FunduSAM: A Specialized Deep Learning Model for Enhanced Optic Disc and Cup Segmentation in Fundus Images","date":"2025-02-10","arxiv_id":"2502.06220","n_code_links":0,"syntology":null},{"paper":"/paper/history-guided-video-diffusion","slug":"history-guided-video-diffusion","title":"History-Guided Video Diffusion","date":"2025-02-10","arxiv_id":"2502.06764","n_code_links":1,"syntology":null},{"paper":null,"slug":"inventory-consensus-control-in-supply-chain","title":"Inventory Consensus Control in Supply Chain Networks using Dissipativity-Based Control and Topology Co-Design","date":"2025-02-10","arxiv_id":"2502.06580","n_code_links":0,"syntology":null},{"paper":null,"slug":"is-long-range-sequential-modeling-necessary","title":"Is Long Range Sequential Modeling Necessary For Colorectal Tumor Segmentation?","date":"2025-02-10","arxiv_id":"2502.07120","n_code_links":0,"syntology":null},{"paper":null,"slug":"large-language-models-in-software-security-a","title":"LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights","date":"2025-02-10","arxiv_id":"2502.07049","n_code_links":0,"syntology":null},{"paper":null,"slug":"leveraging-gpt-4o-efficiency-for-detecting","title":"Leveraging GPT-4o Efficiency for Detecting Rework Anomaly in Business Processes","date":"2025-02-10","arxiv_id":"2502.06918","n_code_links":0,"syntology":null},{"paper":null,"slug":"marginal-mechanisms-for-balanced-exchange","title":"Marginal Mechanisms For Balanced Exchange","date":"2025-02-10","arxiv_id":"2502.06499","n_code_links":0,"syntology":null},{"paper":null,"slug":"multimodal-task-representation-memory-bank-vs","title":"Multimodal Task Representation Memory Bank vs. Catastrophic Forgetting in Anomaly Detection","date":"2025-02-10","arxiv_id":"2502.06194","n_code_links":0,"syntology":null},{"paper":"/paper/neighborhood-order-learning-graph-attention","slug":"neighborhood-order-learning-graph-attention","title":"Neighborhood-Order Learning Graph Attention Network for Fake News Detection","date":"2025-02-10","arxiv_id":"2502.06927","n_code_links":1,"syntology":null},{"paper":null,"slug":"no-trick-no-treat-pursuits-and-challenges","title":"No Trick, No Treat: Pursuits and Challenges Towards Simulation-free Training of Neural Samplers","date":"2025-02-10","arxiv_id":"2502.06685","n_code_links":0,"syntology":null},{"paper":null,"slug":"optimizing-knowledge-integration-in-retrieval","title":"Optimizing Knowledge Integration in Retrieval-Augmented Generation with Self-Selection","date":"2025-02-10","arxiv_id":"2502.06148","n_code_links":0,"syntology":null},{"paper":"/paper/powerformer-a-transformer-with-weighted","slug":"powerformer-a-transformer-with-weighted","title":"Powerformer: A Transformer with Weighted Causal Attention for Time-series Forecasting","date":"2025-02-10","arxiv_id":"2502.06151","n_code_links":1,"syntology":null},{"paper":null,"slug":"progressive-collaborative-and-semantic","title":"Progressive Collaborative and Semantic Knowledge Fusion for Generative Recommendation","date":"2025-02-10","arxiv_id":"2502.06269","n_code_links":0,"syntology":null},{"paper":"/paper/prompt-sid-learning-structural-representation","slug":"prompt-sid-learning-structural-representation","title":"Prompt-SID: Learning Structural Representation Prompt via Latent Diffusion for Single-Image Denoising","date":"2025-02-10","arxiv_id":"2502.06432","n_code_links":1,"syntology":null},{"paper":"/paper/rallrec-improving-retrieval-augmented-large","slug":"rallrec-improving-retrieval-augmented-large","title":"RALLRec: Improving Retrieval Augmented Large Language Model Recommendation with Representation Learning","date":"2025-02-10","arxiv_id":"2502.06101","n_code_links":1,"syntology":null},{"paper":"/paper/relgnn-composite-message-passing-for","slug":"relgnn-composite-message-passing-for","title":"RelGNN: Composite Message Passing for Relational Deep Learning","date":"2025-02-10","arxiv_id":"2502.06784","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result","official":{"repos":["snap-stanford/relgnn"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":1,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"structural-reformation-of-large-language","title":"Structural Reformation of Large Language Model Neuron Encapsulation for Divergent Information Aggregation","date":"2025-02-10","arxiv_id":"2502.07124","n_code_links":0,"syntology":null},{"paper":"/paper/systematic-outliers-in-large-language-models","slug":"systematic-outliers-in-large-language-models","title":"Systematic Outliers in Large Language Models","date":"2025-02-10","arxiv_id":"2502.06415","n_code_links":1,"syntology":{"ran":0,"of":2,"n_ran_checked":0,"n_instrument":0,"unverified":2,"pointer_only":0,"phrase":"0 ran · 2 unverified","official":{"repos":["an-yongqi/systematic-outliers"],"state":"official: harvested, nothing ran","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":2,"ran_from_kinds":[]}}},{"paper":null,"slug":"the-exponential-distribution-of-the-orders-of","title":"The exponential distribution of the orders of demonstrative, numeral, adjective and noun","date":"2025-02-10","arxiv_id":"2502.06342","n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-bandit-based-prompt-tuning-for-in-the","title":"Towards bandit-based prompt-tuning for in-the-wild foundation agents","date":"2025-02-10","arxiv_id":"2502.06358","n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-copyright-protection-for-knowledge","title":"Towards Copyright Protection for Knowledge Bases of Retrieval-augmented Language Models via Reasoning","date":"2025-02-10","arxiv_id":"2502.10440","n_code_links":0,"syntology":null},{"paper":null,"slug":"unconstrained-body-recognition-at-altitude","title":"Unconstrained Body Recognition at Altitude and Range: Comparing Four Approaches","date":"2025-02-10","arxiv_id":"2502.07130","n_code_links":0,"syntology":null},{"paper":"/paper/unleashing-the-potential-of-pre-trained","slug":"unleashing-the-potential-of-pre-trained","title":"Unleashing the Potential of Pre-Trained Diffusion Models for Generalizable Person Re-Identification","date":"2025-02-10","arxiv_id":"2502.06619","n_code_links":1,"syntology":null},{"paper":null,"slug":"utilizing-novelty-based-evolution-strategies","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","date":"2025-02-10","arxiv_id":"2502.06301","n_code_links":0,"syntology":null},{"paper":null,"slug":"visir-vision-transformer-single-image","title":"ViSIR: Vision Transformer Single Image Reconstruction Method for Earth System Models","date":"2025-02-10","arxiv_id":"2502.06741","n_code_links":0,"syntology":null},{"paper":"/paper/wandering-around-a-bioinspired-approach-to","slug":"wandering-around-a-bioinspired-approach-to","title":"Wandering around: A bioinspired approach to visual attention through object motion sensitivity","date":"2025-02-10","arxiv_id":"2502.06747","n_code_links":1,"syntology":null},{"paper":null,"slug":"benchmarking-prompt-engineering-techniques","title":"Benchmarking Prompt Engineering Techniques for Secure Code Generation with GPT Models","date":"2025-02-09","arxiv_id":"2502.06039","n_code_links":0,"syntology":null},{"paper":null,"slug":"emergence-of-episodic-memory-in-transformers","title":"Emergence of Episodic Memory in Transformers: Characterizing Changes in Temporal Structure of Attention Scores During Training","date":"2025-02-09","arxiv_id":"2502.06902","n_code_links":0,"syntology":null},{"paper":null,"slug":"enhancing-financial-time-series-forecasting","title":"Enhancing Financial Time-Series Forecasting with Retrieval-Augmented Large Language Models","date":"2025-02-09","arxiv_id":"2502.05878","n_code_links":0,"syntology":null},{"paper":null,"slug":"hyliformer-hyperbolic-linear-attention-for","title":"HyLiFormer: Hyperbolic Linear Attention for Skeleton-based Human Action Recognition","date":"2025-02-09","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/injecting-universal-jailbreak-backdoors-into","slug":"injecting-universal-jailbreak-backdoors-into","title":"Injecting Universal Jailbreak Backdoors into LLMs in Minutes","date":"2025-02-09","arxiv_id":"2502.10438","n_code_links":1,"syntology":{"ran":3,"of":4,"n_ran_checked":0,"n_instrument":3,"unverified":1,"pointer_only":4,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 3 where Syntology's instrument failed) · 1 unverified","official":{"repos":["johnnychanv/JailbreakEdit"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":1,"ran_from_kinds":["official","unlocated"]}}},{"paper":"/paper/investigating-compositional-reasoning-in-time","slug":"investigating-compositional-reasoning-in-time","title":"Investigating Compositional Reasoning in Time Series Foundation Models","date":"2025-02-09","arxiv_id":"2502.06037","n_code_links":1,"syntology":null},{"paper":null,"slug":"large-language-models-for-in-file","title":"Large Language Models for In-File Vulnerability Localization Can Be \"Lost in the End\"","date":"2025-02-09","arxiv_id":"2502.06898","n_code_links":0,"syntology":null},{"paper":"/paper/let-the-ai-conspiracy-begin-language-model","slug":"let-the-ai-conspiracy-begin-language-model","title":"HSI: Head-Specific Intervention Can Induce Misaligned AI Coordination in Large Language Models","date":"2025-02-09","arxiv_id":"2502.05945","n_code_links":1,"syntology":null},{"paper":"/paper/linear-attention-modeling-for-learned-image","slug":"linear-attention-modeling-for-learned-image","title":"Linear Attention Modeling for Learned Image Compression","date":"2025-02-09","arxiv_id":"2502.05741","n_code_links":0,"syntology":{"ran":2,"of":3,"n_ran_checked":0,"n_instrument":2,"unverified":1,"pointer_only":2,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 2 where Syntology's instrument failed) · 1 unverified","official":null}},{"paper":"/paper/lm2-large-memory-models","slug":"lm2-large-memory-models","title":"LM2: Large Memory Models","date":"2025-02-09","arxiv_id":"2502.06049","n_code_links":2,"syntology":null},{"paper":null,"slug":"moemba-a-mamba-based-mixture-of-experts-for","title":"MoEMba: A Mamba-based Mixture of Experts for High-Density EMG-based Hand Gesture Recognition","date":"2025-02-09","arxiv_id":"2502.17457","n_code_links":0,"syntology":null},{"paper":null,"slug":"on-the-use-of-performer-and-agent-attention","title":"On the use of Performer and Agent Attention for Spoken Language Identification","date":"2025-02-09","arxiv_id":"2502.05841","n_code_links":0,"syntology":null},{"paper":null,"slug":"performance-analysis-of-traditional-vqa","title":"Performance Analysis of Traditional VQA Models Under Limited Computational Resources","date":"2025-02-09","arxiv_id":"2502.05738","n_code_links":0,"syntology":null},{"paper":null,"slug":"provably-overwhelming-transformer-models-with","title":"Provably Overwhelming Transformer Models with Designed Inputs","date":"2025-02-09","arxiv_id":"2502.06038","n_code_links":0,"syntology":null},{"paper":null,"slug":"satellite-observations-guided-diffusion-model","title":"Satellite Observations Guided Diffusion Model for Accurate Meteorological States at Arbitrary Resolution","date":"2025-02-09","arxiv_id":"2502.07814","n_code_links":0,"syntology":null},{"paper":"/paper/saving-77-of-the-parameters-in-large-language","slug":"saving-77-of-the-parameters-in-large-language","title":"Saving 77% of the Parameters in Large Language Models Technical Report","date":"2025-02-09","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"scaffoldgpt-a-scaffold-based-large-language","title":"ScaffoldGPT: A Scaffold-based GPT Model for Drug Optimization","date":"2025-02-09","arxiv_id":"2502.06891","n_code_links":0,"syntology":null},{"paper":null,"slug":"snat-yolo-efficient-cross-layer-aggregation","title":"SNAT-YOLO: Efficient Cross-Layer Aggregation Network for Edge-Oriented Gangue Detection","date":"2025-02-09","arxiv_id":"2502.05988","n_code_links":0,"syntology":null},{"paper":null,"slug":"spherefusion-efficient-panorama-depth","title":"SphereFusion: Efficient Panorama Depth Estimation via Gated Fusion","date":"2025-02-09","arxiv_id":"2502.05859","n_code_links":0,"syntology":null},{"paper":"/paper/temporal-working-memory-query-guided-segment","slug":"temporal-working-memory-query-guided-segment","title":"Temporal Working Memory: Query-Guided Segment Refinement for Enhanced Multimodal Understanding","date":"2025-02-09","arxiv_id":"2502.06020","n_code_links":1,"syntology":null},{"paper":null,"slug":"vfx-creator-animated-visual-effect-generation","title":"VFX Creator: Animated Visual Effect Generation with Controllable Diffusion Transformer","date":"2025-02-09","arxiv_id":"2502.05979","n_code_links":0,"syntology":null},{"paper":null,"slug":"2502-05400","title":"Dynamic Noise Preference Optimization for LLM Self-Improvement via Synthetic Data","date":"2025-02-08","arxiv_id":"2502.05400","n_code_links":0,"syntology":null}],"record_sha256":"5a11b98e0cdd6970d51b7a7cd85ad18c09a7f653f8dfd85b77ebe41d0008e600","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}