{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/softmax/papers/48","list_of":"/method/softmax","method":"Softmax","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":48,"pages_in_order":375,"rows_per_page":100,"rows":[4701,4800],"of":37443,"counts":{"archive_papers_tagged":37443,"with_a_code_link":15869,"where_syntology_ran_a_sample":4578,"not_listed_spam_title":0,"listed":37443,"listed_where_code_ran":4578,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":3835,"every_run_a_failure_of_syntologys_instrument":743,"listed_with_a_run_with_no_instrument_failure":3835,"listed_every_run_a_failure_of_syntologys_instrument":743,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/softmax","prev":"/method/softmax/papers/47","next":"/method/softmax/papers/49","papers":[{"paper":null,"slug":"next-block-prediction-video-generation-via","title":"Next Block Prediction: Video Generation via Semi-Auto-Regressive Modeling","date":"2025-02-11","arxiv_id":"2502.07737","n_code_links":0,"syntology":null},{"paper":null,"slug":"on-training-conditional-conformal-prediction","title":"On Training-Conditional Conformal Prediction and Binomial Proportion Confidence Intervals","date":"2025-02-11","arxiv_id":"2502.07497","n_code_links":0,"syntology":null},{"paper":"/paper/opengrok-enhancing-sns-data-processing-with","slug":"opengrok-enhancing-sns-data-processing-with","title":"OpenGrok: Enhancing SNS Data Processing with Distilled Knowledge and Mask-like Mechanisms","date":"2025-02-11","arxiv_id":"2502.07312","n_code_links":1,"syntology":null},{"paper":null,"slug":"optimizing-knowledge-distillation-in","title":"Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers","date":"2025-02-11","arxiv_id":"2502.07436","n_code_links":0,"syntology":null},{"paper":null,"slug":"pippo-high-resolution-multi-view-humans-from","title":"Pippo: High-Resolution Multi-View Humans from a Single Image","date":"2025-02-11","arxiv_id":"2502.07785","n_code_links":0,"syntology":null},{"paper":null,"slug":"rethinking-timing-residuals-advancing-pet","title":"Rethinking Timing Residuals: Advancing PET Detectors with Explicit TOF Corrections","date":"2025-02-11","arxiv_id":"2502.07630","n_code_links":0,"syntology":null},{"paper":null,"slug":"robust-indoor-localization-in-dynamic","title":"Robust Indoor Localization in Dynamic Environments: A Multi-source Unsupervised Domain Adaptation Framework","date":"2025-02-11","arxiv_id":"2502.07246","n_code_links":0,"syntology":null},{"paper":"/paper/small-language-model-makes-an-effective-long","slug":"small-language-model-makes-an-effective-long","title":"Small Language Model Makes an Effective Long Text Extractor","date":"2025-02-11","arxiv_id":"2502.07286","n_code_links":1,"syntology":null},{"paper":null,"slug":"sparseformer-detecting-objects-in-hrw-shots","title":"SparseFormer: Detecting Objects in HRW Shots via Sparse Vision Transformer","date":"2025-02-11","arxiv_id":"2502.07216","n_code_links":0,"syntology":null},{"paper":null,"slug":"spatial-degradation-aware-and-temporal","title":"Spatial Degradation-Aware and Temporal Consistent Diffusion Model for Compressed Video Super-Resolution","date":"2025-02-11","arxiv_id":"2502.07381","n_code_links":0,"syntology":null},{"paper":"/paper/textatlas5m-a-large-scale-dataset-for-dense","slug":"textatlas5m-a-large-scale-dataset-for-dense","title":"TextAtlas5M: A Large-scale Dataset for Dense Text Image Generation","date":"2025-02-11","arxiv_id":"2502.07870","n_code_links":1,"syntology":null},{"paper":null,"slug":"towards-more-accurate-full-atom-antibody-co","title":"Towards More Accurate Full-Atom Antibody Co-Design","date":"2025-02-11","arxiv_id":"2502.19391","n_code_links":0,"syntology":null},{"paper":null,"slug":"tractable-transformers-for-flexible","title":"Tractable Transformers for Flexible Conditional Generation","date":"2025-02-11","arxiv_id":"2502.07616","n_code_links":0,"syntology":null},{"paper":"/paper/transmla-multi-head-latent-attention-is-all","slug":"transmla-multi-head-latent-attention-is-all","title":"TransMLA: Multi-Head Latent Attention Is All You Need","date":"2025-02-11","arxiv_id":"2502.07864","n_code_links":1,"syntology":null},{"paper":null,"slug":"unveiling-simplicities-of-attention-adaptive","title":"Unveiling Simplicities of Attention: Adaptive Long-Context Head Identification","date":"2025-02-11","arxiv_id":"2502.09647","n_code_links":0,"syntology":null},{"paper":null,"slug":"vidcraft3-camera-object-and-lighting-control","title":"VidCRAFT3: Camera, Object, and Lighting Control for Image-to-Video Generation","date":"2025-02-11","arxiv_id":"2502.07531","n_code_links":0,"syntology":null},{"paper":"/paper/a-simple-yet-effective-ddg-predictor-is-an","slug":"a-simple-yet-effective-ddg-predictor-is-an","title":"A Simple yet Effective DDG Predictor is An Unsupervised Antibody Optimizer and Explainer","date":"2025-02-10","arxiv_id":"2502.06913","n_code_links":1,"syntology":null},{"paper":null,"slug":"active-inference-through-incentive-design-in","title":"Active Inference through Incentive Design in Markov Decision Processes","date":"2025-02-10","arxiv_id":"2502.07065","n_code_links":0,"syntology":null},{"paper":null,"slug":"an-appearance-defect-detection-method-for","title":"An Appearance Defect Detection Method for Cigarettes Based on C-CenterNet","date":"2025-02-10","arxiv_id":"2502.06119","n_code_links":0,"syntology":null},{"paper":"/paper/c-3po-compact-plug-and-play-proxy","slug":"c-3po-compact-plug-and-play-proxy","title":"C-3PO: Compact Plug-and-Play Proxy Optimization to Achieve Human-like Retrieval-Augmented Generation","date":"2025-02-10","arxiv_id":"2502.06205","n_code_links":0,"syntology":{"ran":8,"of":8,"n_ran_checked":7,"n_instrument":1,"unverified":0,"pointer_only":0,"phrase":"8 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","official":null}},{"paper":null,"slug":"col-olhtr-a-novel-framework-for-multimodal","title":"Col-OLHTR: A Novel Framework for Multimodal Online Handwritten Text Recognition","date":"2025-02-10","arxiv_id":"2502.06100","n_code_links":0,"syntology":null},{"paper":null,"slug":"completeness-of-datasets-documentation-on-ml","title":"Completeness of Datasets Documentation on ML/AI repositories: an Empirical Investigation","date":"2025-02-10","arxiv_id":"2503.13463","n_code_links":0,"syntology":null},{"paper":"/paper/conditional-diffusion-model-with-spatial","slug":"conditional-diffusion-model-with-spatial","title":"Conditional diffusion model with spatial attention and latent embedding for medical image segmentation","date":"2025-02-10","arxiv_id":"2502.06997","n_code_links":1,"syntology":null},{"paper":"/paper/conmec-a-dataset-for-metonymy-resolution-with","slug":"conmec-a-dataset-for-metonymy-resolution-with","title":"ConMeC: A Dataset for Metonymy Resolution with Common Nouns","date":"2025-02-10","arxiv_id":"2502.06087","n_code_links":1,"syntology":null},{"paper":null,"slug":"customvideox-3d-reference-attention-driven","title":"CustomVideoX: 3D Reference Attention Driven Dynamic Adaptation for Zero-Shot Customized Video Diffusion Transformers","date":"2025-02-10","arxiv_id":"2502.06527","n_code_links":0,"syntology":null},{"paper":null,"slug":"debatebench-a-challenging-long-context","title":"DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models","date":"2025-02-10","arxiv_id":"2502.06279","n_code_links":0,"syntology":null},{"paper":null,"slug":"deep-learning-in-automated-power-line","title":"Deep Learning in Automated Power Line Inspection: A Review","date":"2025-02-10","arxiv_id":"2502.07826","n_code_links":0,"syntology":null},{"paper":null,"slug":"do-attention-heads-compete-or-cooperate","title":"Do Attention Heads Compete or Cooperate during Counting?","date":"2025-02-10","arxiv_id":"2502.06923","n_code_links":0,"syntology":null},{"paper":"/paper/early-operative-difficulty-assessment-in","slug":"early-operative-difficulty-assessment-in","title":"Early Operative Difficulty Assessment in Laparoscopic Cholecystectomy via Snapshot-Centric Video Analysis","date":"2025-02-10","arxiv_id":"2502.07008","n_code_links":1,"syntology":null},{"paper":"/paper/efficient-vdit-efficient-video-diffusion","slug":"efficient-vdit-efficient-video-diffusion","title":"Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile","date":"2025-02-10","arxiv_id":"2502.06155","n_code_links":1,"syntology":null},{"paper":null,"slug":"event-vision-sensor-a-review","title":"Event Vision Sensor: A Review","date":"2025-02-10","arxiv_id":"2502.06116","n_code_links":0,"syntology":null},{"paper":null,"slug":"facial-analysis-systems-and-down-syndrome","title":"Facial Analysis Systems and Down Syndrome","date":"2025-02-10","arxiv_id":"2502.06341","n_code_links":0,"syntology":null},{"paper":null,"slug":"find-central-dogma-again","title":"Find Central Dogma Again: Leveraging Multilingual Transfer in Large Language Models","date":"2025-02-10","arxiv_id":"2502.06253","n_code_links":0,"syntology":null},{"paper":null,"slug":"finding-words-associated-with-dif-predicting","title":"Finding Words Associated with DIF: Predicting Differential Item Functioning using LLMs and Explainable AI","date":"2025-02-10","arxiv_id":"2502.07017","n_code_links":0,"syntology":null},{"paper":"/paper/foundation-model-of-electronic-medical","slug":"foundation-model-of-electronic-medical","title":"Foundation Model of Electronic Medical Records for Adaptive Risk Estimation","date":"2025-02-10","arxiv_id":"2502.06124","n_code_links":1,"syntology":null},{"paper":null,"slug":"fully-exploiting-vision-foundation-model-s","title":"Fully Exploiting Vision Foundation Model's Profound Prior Knowledge for Generalizable RGB-Depth Driving Scene Parsing","date":"2025-02-10","arxiv_id":"2502.06219","n_code_links":0,"syntology":null},{"paper":null,"slug":"fundusam-a-specialized-deep-learning-model","title":"FunduSAM: A Specialized Deep Learning Model for Enhanced Optic Disc and Cup Segmentation in Fundus Images","date":"2025-02-10","arxiv_id":"2502.06220","n_code_links":0,"syntology":null},{"paper":"/paper/history-guided-video-diffusion","slug":"history-guided-video-diffusion","title":"History-Guided Video Diffusion","date":"2025-02-10","arxiv_id":"2502.06764","n_code_links":1,"syntology":null},{"paper":null,"slug":"inventory-consensus-control-in-supply-chain","title":"Inventory Consensus Control in Supply Chain Networks using Dissipativity-Based Control and Topology Co-Design","date":"2025-02-10","arxiv_id":"2502.06580","n_code_links":0,"syntology":null},{"paper":null,"slug":"is-long-range-sequential-modeling-necessary","title":"Is Long Range Sequential Modeling Necessary For Colorectal Tumor Segmentation?","date":"2025-02-10","arxiv_id":"2502.07120","n_code_links":0,"syntology":null},{"paper":null,"slug":"large-language-models-in-software-security-a","title":"LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights","date":"2025-02-10","arxiv_id":"2502.07049","n_code_links":0,"syntology":null},{"paper":null,"slug":"leveraging-gpt-4o-efficiency-for-detecting","title":"Leveraging GPT-4o Efficiency for Detecting Rework Anomaly in Business Processes","date":"2025-02-10","arxiv_id":"2502.06918","n_code_links":0,"syntology":null},{"paper":null,"slug":"marginal-mechanisms-for-balanced-exchange","title":"Marginal Mechanisms For Balanced Exchange","date":"2025-02-10","arxiv_id":"2502.06499","n_code_links":0,"syntology":null},{"paper":null,"slug":"multimodal-task-representation-memory-bank-vs","title":"Multimodal Task Representation Memory Bank vs. Catastrophic Forgetting in Anomaly Detection","date":"2025-02-10","arxiv_id":"2502.06194","n_code_links":0,"syntology":null},{"paper":"/paper/neighborhood-order-learning-graph-attention","slug":"neighborhood-order-learning-graph-attention","title":"Neighborhood-Order Learning Graph Attention Network for Fake News Detection","date":"2025-02-10","arxiv_id":"2502.06927","n_code_links":1,"syntology":null},{"paper":null,"slug":"no-trick-no-treat-pursuits-and-challenges","title":"No Trick, No Treat: Pursuits and Challenges Towards Simulation-free Training of Neural Samplers","date":"2025-02-10","arxiv_id":"2502.06685","n_code_links":0,"syntology":null},{"paper":null,"slug":"optimizing-knowledge-integration-in-retrieval","title":"Optimizing Knowledge Integration in Retrieval-Augmented Generation with Self-Selection","date":"2025-02-10","arxiv_id":"2502.06148","n_code_links":0,"syntology":null},{"paper":"/paper/powerformer-a-transformer-with-weighted","slug":"powerformer-a-transformer-with-weighted","title":"Powerformer: A Transformer with Weighted Causal Attention for Time-series Forecasting","date":"2025-02-10","arxiv_id":"2502.06151","n_code_links":1,"syntology":null},{"paper":null,"slug":"progressive-collaborative-and-semantic","title":"Progressive Collaborative and Semantic Knowledge Fusion for Generative Recommendation","date":"2025-02-10","arxiv_id":"2502.06269","n_code_links":0,"syntology":null},{"paper":"/paper/prompt-sid-learning-structural-representation","slug":"prompt-sid-learning-structural-representation","title":"Prompt-SID: Learning Structural Representation Prompt via Latent Diffusion for Single-Image Denoising","date":"2025-02-10","arxiv_id":"2502.06432","n_code_links":1,"syntology":null},{"paper":"/paper/rallrec-improving-retrieval-augmented-large","slug":"rallrec-improving-retrieval-augmented-large","title":"RALLRec: Improving Retrieval Augmented Large Language Model Recommendation with Representation Learning","date":"2025-02-10","arxiv_id":"2502.06101","n_code_links":1,"syntology":null},{"paper":"/paper/relgnn-composite-message-passing-for","slug":"relgnn-composite-message-passing-for","title":"RelGNN: Composite Message Passing for Relational Deep Learning","date":"2025-02-10","arxiv_id":"2502.06784","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result","official":{"repos":["snap-stanford/relgnn"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":1,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"structural-reformation-of-large-language","title":"Structural Reformation of Large Language Model Neuron Encapsulation for Divergent Information Aggregation","date":"2025-02-10","arxiv_id":"2502.07124","n_code_links":0,"syntology":null},{"paper":"/paper/systematic-outliers-in-large-language-models","slug":"systematic-outliers-in-large-language-models","title":"Systematic Outliers in Large Language Models","date":"2025-02-10","arxiv_id":"2502.06415","n_code_links":1,"syntology":{"ran":0,"of":2,"n_ran_checked":0,"n_instrument":0,"unverified":2,"pointer_only":0,"phrase":"0 ran · 2 unverified","official":{"repos":["an-yongqi/systematic-outliers"],"state":"official: harvested, nothing ran","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":2,"ran_from_kinds":[]}}},{"paper":null,"slug":"the-exponential-distribution-of-the-orders-of","title":"The exponential distribution of the orders of demonstrative, numeral, adjective and noun","date":"2025-02-10","arxiv_id":"2502.06342","n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-bandit-based-prompt-tuning-for-in-the","title":"Towards bandit-based prompt-tuning for in-the-wild foundation agents","date":"2025-02-10","arxiv_id":"2502.06358","n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-copyright-protection-for-knowledge","title":"Towards Copyright Protection for Knowledge Bases of Retrieval-augmented Language Models via Reasoning","date":"2025-02-10","arxiv_id":"2502.10440","n_code_links":0,"syntology":null},{"paper":null,"slug":"unconstrained-body-recognition-at-altitude","title":"Unconstrained Body Recognition at Altitude and Range: Comparing Four Approaches","date":"2025-02-10","arxiv_id":"2502.07130","n_code_links":0,"syntology":null},{"paper":"/paper/unleashing-the-potential-of-pre-trained","slug":"unleashing-the-potential-of-pre-trained","title":"Unleashing the Potential of Pre-Trained Diffusion Models for Generalizable Person Re-Identification","date":"2025-02-10","arxiv_id":"2502.06619","n_code_links":1,"syntology":null},{"paper":null,"slug":"utilizing-novelty-based-evolution-strategies","title":"Utilizing Novelty-based Evolution Strategies to Train Transformers in Reinforcement Learning","date":"2025-02-10","arxiv_id":"2502.06301","n_code_links":0,"syntology":null},{"paper":null,"slug":"visir-vision-transformer-single-image","title":"ViSIR: Vision Transformer Single Image Reconstruction Method for Earth System Models","date":"2025-02-10","arxiv_id":"2502.06741","n_code_links":0,"syntology":null},{"paper":"/paper/wandering-around-a-bioinspired-approach-to","slug":"wandering-around-a-bioinspired-approach-to","title":"Wandering around: A bioinspired approach to visual attention through object motion sensitivity","date":"2025-02-10","arxiv_id":"2502.06747","n_code_links":1,"syntology":null},{"paper":null,"slug":"benchmarking-prompt-engineering-techniques","title":"Benchmarking Prompt Engineering Techniques for Secure Code Generation with GPT Models","date":"2025-02-09","arxiv_id":"2502.06039","n_code_links":0,"syntology":null},{"paper":null,"slug":"emergence-of-episodic-memory-in-transformers","title":"Emergence of Episodic Memory in Transformers: Characterizing Changes in Temporal Structure of Attention Scores During Training","date":"2025-02-09","arxiv_id":"2502.06902","n_code_links":0,"syntology":null},{"paper":null,"slug":"enhancing-financial-time-series-forecasting","title":"Enhancing Financial Time-Series Forecasting with Retrieval-Augmented Large Language Models","date":"2025-02-09","arxiv_id":"2502.05878","n_code_links":0,"syntology":null},{"paper":null,"slug":"hyliformer-hyperbolic-linear-attention-for","title":"HyLiFormer: Hyperbolic Linear Attention for Skeleton-based Human Action Recognition","date":"2025-02-09","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/injecting-universal-jailbreak-backdoors-into","slug":"injecting-universal-jailbreak-backdoors-into","title":"Injecting Universal Jailbreak Backdoors into LLMs in Minutes","date":"2025-02-09","arxiv_id":"2502.10438","n_code_links":1,"syntology":{"ran":3,"of":4,"n_ran_checked":0,"n_instrument":3,"unverified":1,"pointer_only":4,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 3 where Syntology's instrument failed) · 1 unverified","official":{"repos":["johnnychanv/JailbreakEdit"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":1,"ran_from_kinds":["official","unlocated"]}}},{"paper":"/paper/investigating-compositional-reasoning-in-time","slug":"investigating-compositional-reasoning-in-time","title":"Investigating Compositional Reasoning in Time Series Foundation Models","date":"2025-02-09","arxiv_id":"2502.06037","n_code_links":1,"syntology":null},{"paper":null,"slug":"large-language-models-for-in-file","title":"Large Language Models for In-File Vulnerability Localization Can Be \"Lost in the End\"","date":"2025-02-09","arxiv_id":"2502.06898","n_code_links":0,"syntology":null},{"paper":"/paper/let-the-ai-conspiracy-begin-language-model","slug":"let-the-ai-conspiracy-begin-language-model","title":"HSI: Head-Specific Intervention Can Induce Misaligned AI Coordination in Large Language Models","date":"2025-02-09","arxiv_id":"2502.05945","n_code_links":1,"syntology":null},{"paper":"/paper/linear-attention-modeling-for-learned-image","slug":"linear-attention-modeling-for-learned-image","title":"Linear Attention Modeling for Learned Image Compression","date":"2025-02-09","arxiv_id":"2502.05741","n_code_links":0,"syntology":{"ran":2,"of":3,"n_ran_checked":0,"n_instrument":2,"unverified":1,"pointer_only":2,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 2 where Syntology's instrument failed) · 1 unverified","official":null}},{"paper":"/paper/lm2-large-memory-models","slug":"lm2-large-memory-models","title":"LM2: Large Memory Models","date":"2025-02-09","arxiv_id":"2502.06049","n_code_links":2,"syntology":null},{"paper":null,"slug":"moemba-a-mamba-based-mixture-of-experts-for","title":"MoEMba: A Mamba-based Mixture of Experts for High-Density EMG-based Hand Gesture Recognition","date":"2025-02-09","arxiv_id":"2502.17457","n_code_links":0,"syntology":null},{"paper":null,"slug":"on-the-use-of-performer-and-agent-attention","title":"On the use of Performer and Agent Attention for Spoken Language Identification","date":"2025-02-09","arxiv_id":"2502.05841","n_code_links":0,"syntology":null},{"paper":null,"slug":"performance-analysis-of-traditional-vqa","title":"Performance Analysis of Traditional VQA Models Under Limited Computational Resources","date":"2025-02-09","arxiv_id":"2502.05738","n_code_links":0,"syntology":null},{"paper":null,"slug":"provably-overwhelming-transformer-models-with","title":"Provably Overwhelming Transformer Models with Designed Inputs","date":"2025-02-09","arxiv_id":"2502.06038","n_code_links":0,"syntology":null},{"paper":null,"slug":"satellite-observations-guided-diffusion-model","title":"Satellite Observations Guided Diffusion Model for Accurate Meteorological States at Arbitrary Resolution","date":"2025-02-09","arxiv_id":"2502.07814","n_code_links":0,"syntology":null},{"paper":"/paper/saving-77-of-the-parameters-in-large-language","slug":"saving-77-of-the-parameters-in-large-language","title":"Saving 77% of the Parameters in Large Language Models Technical Report","date":"2025-02-09","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"scaffoldgpt-a-scaffold-based-large-language","title":"ScaffoldGPT: A Scaffold-based GPT Model for Drug Optimization","date":"2025-02-09","arxiv_id":"2502.06891","n_code_links":0,"syntology":null},{"paper":null,"slug":"snat-yolo-efficient-cross-layer-aggregation","title":"SNAT-YOLO: Efficient Cross-Layer Aggregation Network for Edge-Oriented Gangue Detection","date":"2025-02-09","arxiv_id":"2502.05988","n_code_links":0,"syntology":null},{"paper":null,"slug":"spherefusion-efficient-panorama-depth","title":"SphereFusion: Efficient Panorama Depth Estimation via Gated Fusion","date":"2025-02-09","arxiv_id":"2502.05859","n_code_links":0,"syntology":null},{"paper":"/paper/temporal-working-memory-query-guided-segment","slug":"temporal-working-memory-query-guided-segment","title":"Temporal Working Memory: Query-Guided Segment Refinement for Enhanced Multimodal Understanding","date":"2025-02-09","arxiv_id":"2502.06020","n_code_links":1,"syntology":null},{"paper":null,"slug":"the-curse-of-depth-in-large-language-models","title":"The Curse of Depth in Large Language Models","date":"2025-02-09","arxiv_id":"2502.05795","n_code_links":0,"syntology":null},{"paper":null,"slug":"vfx-creator-animated-visual-effect-generation","title":"VFX Creator: Animated Visual Effect Generation with Controllable Diffusion Transformer","date":"2025-02-09","arxiv_id":"2502.05979","n_code_links":0,"syntology":null},{"paper":null,"slug":"2502-05400","title":"Dynamic Noise Preference Optimization for LLM Self-Improvement via Synthetic Data","date":"2025-02-08","arxiv_id":"2502.05400","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-novel-convolutional-free-method-for-3d","title":"A Novel Convolutional-Free Method for 3D Medical Imaging Segmentation","date":"2025-02-08","arxiv_id":"2502.05396","n_code_links":0,"syntology":null},{"paper":"/paper/ape-faster-and-longer-context-augmented","slug":"ape-faster-and-longer-context-augmented","title":"APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding","date":"2025-02-08","arxiv_id":"2502.05431","n_code_links":1,"syntology":{"ran":5,"of":5,"n_ran_checked":1,"n_instrument":4,"unverified":0,"pointer_only":5,"phrase":"5 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 1 violated, 0 with no contract checked; 4 where Syntology's instrument failed) · 0 unverified","official":{"repos":["infini-ai-lab/ape"],"state":"official (archive's flag): 5 ran","n_ran":5,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/bridging-traffic-state-and-trajectory-for","slug":"bridging-traffic-state-and-trajectory-for","title":"Bridging Traffic State and Trajectory for Dynamic Road Network and Trajectory Representation Learning","date":"2025-02-08","arxiv_id":"2502.06870","n_code_links":1,"syntology":null},{"paper":null,"slug":"demystifying-catastrophic-forgetting-in-two","title":"Demystifying Catastrophic Forgetting in Two-Stage Incremental Object Detector","date":"2025-02-08","arxiv_id":"2502.05540","n_code_links":0,"syntology":null},{"paper":null,"slug":"diffusion-model-for-interest-refinement-in","title":"Diffusion Model for Interest Refinement in Multi-Interest Recommendation","date":"2025-02-08","arxiv_id":"2502.05561","n_code_links":0,"syntology":null},{"paper":"/paper/event-stream-based-visual-object-tracking","slug":"event-stream-based-visual-object-tracking","title":"Event Stream-based Visual Object Tracking: HDETrack V2 and A High-Definition Benchmark","date":"2025-02-08","arxiv_id":"2502.05574","n_code_links":1,"syntology":null},{"paper":null,"slug":"flow-based-conformal-prediction-for-multi","title":"Flow-based Conformal Prediction for Multi-dimensional Time Series","date":"2025-02-08","arxiv_id":"2502.05709","n_code_links":0,"syntology":null},{"paper":null,"slug":"flowing-through-layers-a-continuous-dynamical","title":"Flowing Through Layers: A Continuous Dynamical Systems Perspective on Transformers","date":"2025-02-08","arxiv_id":"2502.05656","n_code_links":0,"syntology":null},{"paper":null,"slug":"forbidden-science-dual-use-ai-challenge","title":"Forbidden Science: Dual-Use AI Challenge Benchmark and Scientific Refusal Tests","date":"2025-02-08","arxiv_id":"2502.06867","n_code_links":0,"syntology":null},{"paper":null,"slug":"graph-neural-network-enabled-pinching","title":"Graph Neural Network Enabled Pinching Antennas","date":"2025-02-08","arxiv_id":"2502.05447","n_code_links":0,"syntology":null},{"paper":null,"slug":"gwrf-a-generalizable-wireless-radiance-field","title":"GWRF: A Generalizable Wireless Radiance Field for Wireless Signal Propagation Modeling","date":"2025-02-08","arxiv_id":"2502.05708","n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-lexical-manifold-projection-in","title":"Hierarchical Lexical Manifold Projection in Large Language Models: A Novel Mechanism for Multi-Scale Semantic Representation","date":"2025-02-08","arxiv_id":"2502.05395","n_code_links":0,"syntology":null},{"paper":"/paper/knowledge-graph-guided-retrieval-augmented","slug":"knowledge-graph-guided-retrieval-augmented","title":"Knowledge Graph-Guided Retrieval Augmented Generation","date":"2025-02-08","arxiv_id":"2502.06864","n_code_links":1,"syntology":null},{"paper":"/paper/lossless-acceleration-of-large-language","slug":"lossless-acceleration-of-large-language","title":"Lossless Acceleration of Large Language Models with Hierarchical Drafting based on Temporal Locality in Speculative Decoding","date":"2025-02-08","arxiv_id":"2502.05609","n_code_links":1,"syntology":null},{"paper":null,"slug":"mofm-a-large-scale-human-motion-foundation","title":"MoFM: A Large-Scale Human Motion Foundation Model","date":"2025-02-08","arxiv_id":"2502.05432","n_code_links":0,"syntology":null}],"record_sha256":"a17baeb7a4470b744706048307daf6b60482ea90bd0198487ed27a0ba0421583","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}