{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/softmax/papers/47","list_of":"/method/softmax","method":"Softmax","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":47,"pages_in_order":375,"rows_per_page":100,"rows":[4601,4700],"of":37443,"counts":{"archive_papers_tagged":37443,"with_a_code_link":15869,"where_syntology_ran_a_sample":4578,"not_listed_spam_title":0,"listed":37443,"listed_where_code_ran":4578,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":3835,"every_run_a_failure_of_syntologys_instrument":743,"listed_with_a_run_with_no_instrument_failure":3835,"listed_every_run_a_failure_of_syntologys_instrument":743,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/softmax","prev":"/method/softmax/papers/46","next":"/method/softmax/papers/48","papers":[{"paper":null,"slug":"clear-cluster-based-prompt-learning-on","title":"CLEAR: Cluster-based Prompt Learning on Heterogeneous Graphs","date":"2025-02-13","arxiv_id":"2502.08918","n_code_links":0,"syntology":null},{"paper":null,"slug":"diverse-transformer-decoding-for-offline","title":"Diverse Transformer Decoding for Offline Reinforcement Learning Using Financial Algorithmic Approaches","date":"2025-02-13","arxiv_id":"2502.10473","n_code_links":0,"syntology":null},{"paper":null,"slug":"dynsegnet-dynamic-architecture-adjustment-for","title":"DynSegNet:Dynamic Architecture Adjustment for Adversarial Learning in Segmenting Hemorrhagic Lesions from Fundus Images","date":"2025-02-13","arxiv_id":"2502.09256","n_code_links":0,"syntology":null},{"paper":null,"slug":"e-md3c-taming-masked-diffusion-transformers","title":"E-MD3C: Taming Masked Diffusion Transformers for Efficient Zero-Shot Object Customization","date":"2025-02-13","arxiv_id":"2502.09164","n_code_links":0,"syntology":null},{"paper":null,"slug":"enhancing-rag-with-active-learning-on","title":"Enhancing RAG with Active Learning on Conversation Records: Reject Incapables and Answer Capables","date":"2025-02-13","arxiv_id":"2502.09073","n_code_links":0,"syntology":null},{"paper":null,"slug":"farm-frequency-aware-model-for-cross-domain","title":"FARM: Frequency-Aware Model for Cross-Domain Live-Streaming Recommendation","date":"2025-02-13","arxiv_id":"2502.09375","n_code_links":0,"syntology":null},{"paper":null,"slug":"feature-based-graph-attention-networks","title":"Feature-based Graph Attention Networks Improve Online Continual Learning","date":"2025-02-13","arxiv_id":"2502.09143","n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-vision-transformer-with","title":"Hierarchical Vision Transformer with Prototypes for Interpretable Medical Image Classification","date":"2025-02-13","arxiv_id":"2502.08997","n_code_links":0,"syntology":null},{"paper":null,"slug":"human-llm-coevolution-evidence-from-academic","title":"Human-LLM Coevolution: Evidence from Academic Writing","date":"2025-02-13","arxiv_id":"2502.09606","n_code_links":0,"syntology":null},{"paper":null,"slug":"improving-tcm-question-answering-through-tree","title":"Improving TCM Question Answering through Tree-Organized Self-Reflective Retrieval with LLMs","date":"2025-02-13","arxiv_id":"2502.09156","n_code_links":0,"syntology":null},{"paper":null,"slug":"infinitehip-extending-language-model-context","title":"InfiniteHiP: Extending Language Model Context Up to 3 Million Tokens on a Single GPU","date":"2025-02-13","arxiv_id":"2502.08910","n_code_links":0,"syntology":null},{"paper":null,"slug":"joint-attention-mechanism-learning-to","title":"Joint Attention Mechanism Learning to Facilitate Opto-physiological Monitoring during Physical Activity","date":"2025-02-13","arxiv_id":"2502.09291","n_code_links":0,"syntology":null},{"paper":null,"slug":"kimas-a-configurable-knowledge-integrated","title":"KIMAs: A Configurable Knowledge Integrated Multi-Agent System","date":"2025-02-13","arxiv_id":"2502.09596","n_code_links":0,"syntology":null},{"paper":null,"slug":"linear-time-user-level-dp-sco-via-robust","title":"Linear-Time User-Level DP-SCO via Robust Statistics","date":"2025-02-13","arxiv_id":"2502.08889","n_code_links":0,"syntology":null},{"paper":null,"slug":"llm-enhanced-multiple-instance-learning-for","title":"LLM-Enhanced Multiple Instance Learning for Joint Rumor and Stance Detection with Social Context Information","date":"2025-02-13","arxiv_id":"2502.08888","n_code_links":0,"syntology":null},{"paper":null,"slug":"long-term-talkingface-generation-via-motion","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","date":"2025-02-13","arxiv_id":"2502.09533","n_code_links":0,"syntology":null},{"paper":null,"slug":"machine-learning-for-modelling-unstructured","title":"Machine learning for modelling unstructured grid data in computational physics: a review","date":"2025-02-13","arxiv_id":"2502.09346","n_code_links":0,"syntology":null},{"paper":"/paper/mc2sleepnet-multi-modal-cross-masking-with","slug":"mc2sleepnet-multi-modal-cross-masking-with","title":"MC2SleepNet: Multi-modal Cross-masking with Contrastive Learning for Sleep Stage Classification","date":"2025-02-13","arxiv_id":"2502.17470","n_code_links":1,"syntology":null},{"paper":null,"slug":"mechanistic-unveiling-of-transformer-circuits","title":"Mechanistic Unveiling of Transformer Circuits: Self-Influence as a Key to Model Reasoning","date":"2025-02-13","arxiv_id":"2502.09022","n_code_links":0,"syntology":null},{"paper":null,"slug":"predicting-cognitive-decline-a-multimodal-ai","title":"Predicting Cognitive Decline: A Multimodal AI Approach to Dementia Screening from Speech","date":"2025-02-13","arxiv_id":"2502.08862","n_code_links":0,"syntology":null},{"paper":null,"slug":"refinecoder-iterative-improving-of-large","title":"RefineCoder: Iterative Improving of Large Language Models via Adaptive Critique Refinement for Code Generation","date":"2025-02-13","arxiv_id":"2502.09183","n_code_links":0,"syntology":null},{"paper":"/paper/residual-transformer-fusion-network-for-salt-1","slug":"residual-transformer-fusion-network-for-salt-1","title":"Residual Transformer Fusion Network for Salt and Pepper Image Denoising","date":"2025-02-13","arxiv_id":"2502.09000","n_code_links":0,"syntology":null},{"paper":"/paper/rethinking-evaluation-metrics-for-grammatical","slug":"rethinking-evaluation-metrics-for-grammatical","title":"Rethinking Evaluation Metrics for Grammatical Error Correction: Why Use a Different Evaluation Process than Human?","date":"2025-02-13","arxiv_id":"2502.09416","n_code_links":1,"syntology":{"ran":2,"of":3,"n_ran_checked":2,"n_instrument":0,"unverified":1,"pointer_only":0,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["gotutiyan/gec-metrics"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":0,"n_ran_no_instrument_failure":2,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"rlsa-pfl-robust-lightweight-secure","title":"RLSA-PFL: Robust Lightweight Secure Aggregation with Model Inconsistency Detection in Privacy-Preserving Federated Learning","date":"2025-02-13","arxiv_id":"2502.08989","n_code_links":0,"syntology":null},{"paper":null,"slug":"structured-convergence-in-large-language","title":"Structured Convergence in Large Language Model Representations via Hierarchical Latent Space Folding","date":"2025-02-13","arxiv_id":"2502.08947","n_code_links":0,"syntology":null},{"paper":null,"slug":"the-influence-of-visual-and-linguistic-cues","title":"Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues","date":"2025-02-13","arxiv_id":"2502.09120","n_code_links":0,"syntology":null},{"paper":null,"slug":"the-joint-entity-relation-extraction-model","title":"The Joint Entity-Relation Extraction Model Based on Span and Interactive Fusion Representation for Chinese Medical Texts with Complex Semantics","date":"2025-02-13","arxiv_id":"2502.09247","n_code_links":0,"syntology":null},{"paper":"/paper/the-stochastic-parrot-on-llm-s-shoulder-a","slug":"the-stochastic-parrot-on-llm-s-shoulder-a","title":"The Stochastic Parrot on LLM's Shoulder: A Summative Assessment of Physical Concept Understanding","date":"2025-02-13","arxiv_id":"2502.08946","n_code_links":1,"syntology":null},{"paper":null,"slug":"transformer-enhanced-variational-autoencoder","title":"Transformer-Enhanced Variational Autoencoder for Crystal Structure Prediction","date":"2025-02-13","arxiv_id":"2502.09423","n_code_links":0,"syntology":null},{"paper":null,"slug":"unleashing-the-power-of-large-language-model","title":"Unleashing the Power of Large Language Model for Denoising Recommendation","date":"2025-02-13","arxiv_id":"2502.09058","n_code_links":0,"syntology":null},{"paper":"/paper/unlocking-the-potential-of-classic-gnns-for","slug":"unlocking-the-potential-of-classic-gnns-for","title":"Unlocking the Potential of Classic GNNs for Graph-level Tasks: Simple Architectures Meet Excellence","date":"2025-02-13","arxiv_id":"2502.09263","n_code_links":1,"syntology":{"ran":7,"of":12,"n_ran_checked":7,"n_instrument":0,"unverified":5,"pointer_only":3,"phrase":"7 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 0 where Syntology's instrument failed) · 5 unverified","official":{"repos":["LUOyk1999/GNNPlus"],"state":"official (archive's flag): 7 ran","n_ran":7,"n_constructed":0,"n_ran_no_instrument_failure":7,"n_unverified":5,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"utilizing-pre-trained-and-large-language","title":"Utilizing Pre-trained and Large Language Models for 10-K Items Segmentation","date":"2025-02-13","arxiv_id":"2502.08875","n_code_links":0,"syntology":null},{"paper":null,"slug":"vertical-federated-continual-learning-via","title":"Vertical Federated Continual Learning via Evolving Prototype Knowledge","date":"2025-02-13","arxiv_id":"2502.09152","n_code_links":0,"syntology":null},{"paper":"/paper/what-exactly-has-tabpfn-learned-to-do","slug":"what-exactly-has-tabpfn-learned-to-do","title":"What exactly has TabPFN learned to do?","date":"2025-02-13","arxiv_id":"2502.08978","n_code_links":1,"syntology":null},{"paper":null,"slug":"a-comparative-study-of-different-tso-dso","title":"A comparative study of different TSO-DSO coordination in the reserve market","date":"2025-02-12","arxiv_id":"2502.08782","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-survey-on-image-quality-assessment-insights","title":"A Survey on Image Quality Assessment: Insights, Analysis, and Future Outlook","date":"2025-02-12","arxiv_id":"2502.08540","n_code_links":0,"syntology":null},{"paper":"/paper/a-systematic-review-on-the-evaluation-of","slug":"a-systematic-review-on-the-evaluation-of","title":"A Systematic Review on the Evaluation of Large Language Models in Theory of Mind Tasks","date":"2025-02-12","arxiv_id":"2502.08796","n_code_links":1,"syntology":null},{"paper":"/paper/ask-in-any-modality-a-comprehensive-survey-on","slug":"ask-in-any-modality-a-comprehensive-survey-on","title":"Ask in Any Modality: A Comprehensive Survey on Multimodal Retrieval-Augmented Generation","date":"2025-02-12","arxiv_id":"2502.08826","n_code_links":1,"syntology":null},{"paper":null,"slug":"choruscvr-chorus-supervision-for-entire-space","title":"ChorusCVR: Chorus Supervision for Entire Space Post-Click Conversion Rate Modeling","date":"2025-02-12","arxiv_id":"2502.08277","n_code_links":0,"syntology":null},{"paper":null,"slug":"coast-intelligent-time-adaptive-neural","title":"TANTE: Time-Adaptive Operator Learning via Neural Taylor Expansion","date":"2025-02-12","arxiv_id":"2502.08574","n_code_links":0,"syntology":null},{"paper":null,"slug":"contextual-compression-encoding-for-large","title":"Contextual Compression Encoding for Large Language Models: A Novel Framework for Multi-Layered Parameter Space Pruning","date":"2025-02-12","arxiv_id":"2502.08323","n_code_links":0,"syntology":null},{"paper":null,"slug":"coutfitgan-learning-to-synthesize-compatible","title":"COutfitGAN: Learning to Synthesize Compatible Outfits Supervised by Silhouette Masks and Fashion Styles","date":"2025-02-12","arxiv_id":"2502.08674","n_code_links":0,"syntology":null},{"paper":"/paper/enhanced-load-forecasting-with-gat-lstm","slug":"enhanced-load-forecasting-with-gat-lstm","title":"Enhanced Load Forecasting with GAT-LSTM: Leveraging Grid and Temporal Features","date":"2025-02-12","arxiv_id":"2502.08376","n_code_links":1,"syntology":null},{"paper":null,"slug":"enhancing-auto-regressive-chain-of-thought","title":"Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning","date":"2025-02-12","arxiv_id":"2502.08482","n_code_links":0,"syntology":null},{"paper":"/paper/fino1-on-the-transferability-of-reasoning","slug":"fino1-on-the-transferability-of-reasoning","title":"Fino1: On the Transferability of Reasoning Enhanced LLMs to Finance","date":"2025-02-12","arxiv_id":"2502.08127","n_code_links":1,"syntology":{"ran":4,"of":4,"n_ran_checked":0,"n_instrument":4,"unverified":0,"pointer_only":4,"phrase":"4 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 4 where Syntology's instrument failed) · 0 unverified","official":{"repos":["the-finai/fino1"],"state":"official (archive's flag): 4 ran","n_ran":4,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"generalized-class-discovery-in-instance","title":"Generalized Class Discovery in Instance Segmentation","date":"2025-02-12","arxiv_id":"2502.08149","n_code_links":0,"syntology":null},{"paper":"/paper/hdt-hierarchical-discrete-transformer-for","slug":"hdt-hierarchical-discrete-transformer-for","title":"HDT: Hierarchical Discrete Transformer for Multivariate Time Series Forecasting","date":"2025-02-12","arxiv_id":"2502.08302","n_code_links":1,"syntology":null},{"paper":"/paper/hi-end-mae-hierarchical-encoder-driven-masked","slug":"hi-end-mae-hierarchical-encoder-driven-masked","title":"Hi-End-MAE: Hierarchical encoder-driven masked autoencoders are stronger vision learners for medical image segmentation","date":"2025-02-12","arxiv_id":"2502.08347","n_code_links":1,"syntology":null},{"paper":"/paper/intar-inter-task-auto-reconfigurable","slug":"intar-inter-task-auto-reconfigurable","title":"InTAR: Inter-Task Auto-Reconfigurable Accelerator Design for High Data Volume Variation in DNNs","date":"2025-02-12","arxiv_id":"2502.08807","n_code_links":1,"syntology":null},{"paper":null,"slug":"joint-transmit-and-pinching-beamforming-for","title":"Joint Transmit and Pinching Beamforming for Pinching Antenna Systems (PASS): Optimization-Based or Learning-Based?","date":"2025-02-12","arxiv_id":"2502.08637","n_code_links":0,"syntology":null},{"paper":"/paper/light-a-video-training-free-video-relighting","slug":"light-a-video-training-free-video-relighting","title":"Light-A-Video: Training-free Video Relighting via Progressive Light Fusion","date":"2025-02-12","arxiv_id":"2502.08590","n_code_links":1,"syntology":{"ran":5,"of":6,"n_ran_checked":3,"n_instrument":2,"unverified":1,"pointer_only":1,"phrase":"5 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 2 where Syntology's instrument failed) · 1 unverified","official":{"repos":["bcmi/Light-A-Video"],"state":"official (archive's flag): 5 ran","n_ran":5,"n_constructed":0,"n_ran_no_instrument_failure":3,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"mapping-the-landscape-of-generative-ai-in","title":"Mapping the Landscape of Generative AI in Network Monitoring and Management","date":"2025-02-12","arxiv_id":"2502.08576","n_code_links":0,"syntology":null},{"paper":"/paper/mme5-improving-multimodal-multilingual","slug":"mme5-improving-multimodal-multilingual","title":"mmE5: Improving Multimodal Multilingual Embeddings via High-quality Synthetic Data","date":"2025-02-12","arxiv_id":"2502.08468","n_code_links":1,"syntology":null},{"paper":null,"slug":"on-mechanistic-circuits-for-extractive","title":"On Mechanistic Circuits for Extractive Question-Answering","date":"2025-02-12","arxiv_id":"2502.08059","n_code_links":0,"syntology":null},{"paper":null,"slug":"paretorag-leveraging-sentence-context","title":"ParetoRAG: Leveraging Sentence-Context Attention for Robust and Efficient Retrieval-Augmented Generation","date":"2025-02-12","arxiv_id":"2502.08178","n_code_links":0,"syntology":null},{"paper":null,"slug":"representation-learning-to-advance-multi","title":"Representation Learning to Advance Multi-institutional Studies with Electronic Health Record Data","date":"2025-02-12","arxiv_id":"2502.08547","n_code_links":0,"syntology":null},{"paper":null,"slug":"rethinking-tokenized-graph-transformers-for","title":"Rethinking Tokenized Graph Transformers for Node Classification","date":"2025-02-12","arxiv_id":"2502.08101","n_code_links":0,"syntology":null},{"paper":"/paper/sasvi-segment-any-surgical-video","slug":"sasvi-segment-any-surgical-video","title":"SASVi - Segment Any Surgical Video","date":"2025-02-12","arxiv_id":"2502.09653","n_code_links":1,"syntology":null},{"paper":null,"slug":"scalable-thermodynamic-second-order","title":"Scalable Thermodynamic Second-order Optimization","date":"2025-02-12","arxiv_id":"2502.08603","n_code_links":0,"syntology":null},{"paper":null,"slug":"self-evaluation-for-job-shop-scheduling","title":"Self-Evaluation for Job-Shop Scheduling","date":"2025-02-12","arxiv_id":"2502.08684","n_code_links":0,"syntology":null},{"paper":"/paper/selfelicit-your-language-model-secretly-knows","slug":"selfelicit-your-language-model-secretly-knows","title":"SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence","date":"2025-02-12","arxiv_id":"2502.08767","n_code_links":1,"syntology":null},{"paper":"/paper/systematic-knowledge-injection-into-large","slug":"systematic-knowledge-injection-into-large","title":"Systematic Knowledge Injection into Large Language Models via Diverse Augmentation for Domain-Specific RAG","date":"2025-02-12","arxiv_id":"2502.08356","n_code_links":1,"syntology":{"ran":9,"of":9,"n_ran_checked":9,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"9 ran (of which 0 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["kushagrabhushan/Systematic-Knowledge-Injection"],"state":"official (archive's flag): 9 ran","n_ran":9,"n_constructed":0,"n_ran_no_instrument_failure":9,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/tlob-a-novel-transformer-model-with-dual","slug":"tlob-a-novel-transformer-model-with-dual","title":"TLOB: A Novel Transformer Model with Dual Attention for Price Trend Prediction with Limit Order Book Data","date":"2025-02-12","arxiv_id":"2502.15757","n_code_links":1,"syntology":{"ran":0,"of":2,"n_ran_checked":0,"n_instrument":0,"unverified":2,"pointer_only":0,"phrase":"0 ran · 2 unverified","official":{"repos":["leonardoberti00/tlob"],"state":"official: harvested, nothing ran","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":2,"ran_from_kinds":[]}}},{"paper":"/paper/top-theta-attention-sparsifying-transformers","slug":"top-theta-attention-sparsifying-transformers","title":"Top-Theta Attention: Sparsifying Transformers by Compensated Thresholding","date":"2025-02-12","arxiv_id":"2502.08363","n_code_links":1,"syntology":null},{"paper":null,"slug":"ynote-a-novel-music-notation-for-fine-tuning","title":"YNote: A Novel Music Notation for Fine-Tuning LLMs in Music Generation","date":"2025-02-12","arxiv_id":"2502.10467","n_code_links":0,"syntology":null},{"paper":null,"slug":"5d-neural-surrogates-for-nonlinear","title":"5D Neural Surrogates for Nonlinear Gyrokinetic Simulations of Plasma Turbulence","date":"2025-02-11","arxiv_id":"2502.07469","n_code_links":0,"syntology":null},{"paper":"/paper/a-large-scale-benchmark-for-vietnamese","slug":"a-large-scale-benchmark-for-vietnamese","title":"A Large-Scale Benchmark for Vietnamese Sentence Paraphrases","date":"2025-02-11","arxiv_id":"2502.07188","n_code_links":1,"syntology":null},{"paper":null,"slug":"a-survey-on-mamba-architecture-for-vision","title":"A Survey on Mamba Architecture for Vision Applications","date":"2025-02-11","arxiv_id":"2502.07161","n_code_links":0,"syntology":null},{"paper":null,"slug":"an-advanced-nlp-framework-for-automated","title":"An Advanced NLP Framework for Automated Medical Diagnosis with DeBERTa and Dynamic Contextual Positional Gating","date":"2025-02-11","arxiv_id":"2502.07755","n_code_links":0,"syntology":null},{"paper":null,"slug":"attention-learning-is-needed-to-efficiently","title":"Attention Learning is Needed to Efficiently Learn Parity Function","date":"2025-02-11","arxiv_id":"2502.07553","n_code_links":0,"syntology":null},{"paper":"/paper/auditing-prompt-caching-in-language-model","slug":"auditing-prompt-caching-in-language-model","title":"Auditing Prompt Caching in Language Model APIs","date":"2025-02-11","arxiv_id":"2502.07776","n_code_links":1,"syntology":{"ran":2,"of":2,"n_ran_checked":2,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"2 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["chenchenygu/auditing-prompt-caching"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":0,"n_ran_no_instrument_failure":2,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/automated-capability-discovery-via-model-self","slug":"automated-capability-discovery-via-model-self","title":"Automated Capability Discovery via Model Self-Exploration","date":"2025-02-11","arxiv_id":"2502.07577","n_code_links":2,"syntology":null},{"paper":null,"slug":"balancekv-kv-cache-compression-through","title":"Streaming Attention Approximation via Discrepancy Theory","date":"2025-02-11","arxiv_id":"2502.07861","n_code_links":0,"syntology":null},{"paper":null,"slug":"breaking-down-bias-on-the-limits-of","title":"Breaking Down Bias: On The Limits of Generalizable Pruning Strategies","date":"2025-02-11","arxiv_id":"2502.07771","n_code_links":0,"syntology":null},{"paper":null,"slug":"causalged-blending-causality-and-diffusion","title":"CausalGeD: Blending Causality and Diffusion for Spatial Gene Expression Generation","date":"2025-02-11","arxiv_id":"2502.07751","n_code_links":0,"syntology":null},{"paper":null,"slug":"codephys-robust-video-based-remote","title":"CodePhys: Robust Video-based Remote Physiological Measurement through Latent Codebook Querying","date":"2025-02-11","arxiv_id":"2502.07526","n_code_links":0,"syntology":null},{"paper":"/paper/dataset-ownership-verification-in-contrastive","slug":"dataset-ownership-verification-in-contrastive","title":"Dataset Ownership Verification in Contrastive Pre-trained Models","date":"2025-02-11","arxiv_id":"2502.07276","n_code_links":1,"syntology":null},{"paper":null,"slug":"deep-semantic-graph-learning-via-llm-based","title":"Deep Semantic Graph Learning via LLM based Node Enhancement","date":"2025-02-11","arxiv_id":"2502.07982","n_code_links":0,"syntology":null},{"paper":null,"slug":"dense-object-detection-based-on-de","title":"Dense Object Detection Based on De-homogenized Queries","date":"2025-02-11","arxiv_id":"2502.07194","n_code_links":0,"syntology":null},{"paper":null,"slug":"dsv-exploiting-dynamic-sparsity-to-accelerate","title":"DSV: Exploiting Dynamic Sparsity to Accelerate Large-Scale Video DiT Training","date":"2025-02-11","arxiv_id":"2502.07590","n_code_links":0,"syntology":null},{"paper":"/paper/enhance-a-video-better-generated-video-for","slug":"enhance-a-video-better-generated-video-for","title":"Enhance-A-Video: Better Generated Video for Free","date":"2025-02-11","arxiv_id":"2502.07508","n_code_links":1,"syntology":null},{"paper":null,"slug":"enviro-iot-calibrating-low-cost-environmental","title":"Enviro-IoT: Calibrating Low-Cost Environmental Sensors in Urban Settings","date":"2025-02-11","arxiv_id":"2502.07596","n_code_links":0,"syntology":null},{"paper":null,"slug":"fast-cos-a-fast-one-stage-object-detector","title":"Fast-COS: A Fast One-Stage Object Detector Based on Reparameterized Attention Vision Transformer for Autonomous Driving","date":"2025-02-11","arxiv_id":"2502.07417","n_code_links":0,"syntology":null},{"paper":null,"slug":"flat-u-net-an-efficient-ultralightweight","title":"Flat U-Net: An Efficient Ultralightweight Model for Solar Filament Segmentation in Full-disk H$α$ Images","date":"2025-02-11","arxiv_id":"2502.07259","n_code_links":0,"syntology":null},{"paper":null,"slug":"foqa-a-faroese-question-answering-dataset","title":"FoQA: A Faroese Question-Answering Dataset","date":"2025-02-11","arxiv_id":"2502.07642","n_code_links":0,"syntology":null},{"paper":null,"slug":"foreign-object-detection-in-high-voltage","title":"Foreign-Object Detection in High-Voltage Transmission Line Based on Improved YOLOv8m","date":"2025-02-11","arxiv_id":"2502.07175","n_code_links":0,"syntology":null},{"paper":"/paper/grammar-control-in-dialogue-response","slug":"grammar-control-in-dialogue-response","title":"Grammar Control in Dialogue Response Generation for Language Learning Chatbots","date":"2025-02-11","arxiv_id":"2502.07544","n_code_links":1,"syntology":null},{"paper":"/paper/graph-rag-tool-fusion","slug":"graph-rag-tool-fusion","title":"Graph RAG-Tool Fusion","date":"2025-02-11","arxiv_id":"2502.07223","n_code_links":1,"syntology":null},{"paper":null,"slug":"hgtul-a-hypergraph-based-model-for-trajectory","title":"HGTUL: A Hypergraph-based Model For Trajectory User Linking","date":"2025-02-11","arxiv_id":"2502.07549","n_code_links":0,"syntology":null},{"paper":null,"slug":"large-cognition-model-towards-pretrained-eeg","title":"Large Cognition Model: Towards Pretrained EEG Foundation Model","date":"2025-02-11","arxiv_id":"2502.17464","n_code_links":0,"syntology":null},{"paper":"/paper/lasp-2-rethinking-sequence-parallelism-for","slug":"lasp-2-rethinking-sequence-parallelism-for","title":"LASP-2: Rethinking Sequence Parallelism for Linear Attention and Its Hybrid","date":"2025-02-11","arxiv_id":"2502.07563","n_code_links":1,"syntology":null},{"paper":null,"slug":"learning-effective-dynamics-across-spatio","title":"Learning Effective Dynamics across Spatio-Temporal Scales of Complex Flows","date":"2025-02-11","arxiv_id":"2502.07990","n_code_links":0,"syntology":null},{"paper":"/paper/linear-transformers-as-var-models-aligning","slug":"linear-transformers-as-var-models-aligning","title":"Linear Transformers as VAR Models: Aligning Autoregressive Attention Mechanisms with Autoregressive Forecasting","date":"2025-02-11","arxiv_id":"2502.07244","n_code_links":1,"syntology":{"ran":7,"of":9,"n_ran_checked":7,"n_instrument":0,"unverified":2,"pointer_only":0,"phrase":"7 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 0 where Syntology's instrument failed) · 2 unverified","official":{"repos":["ljc-fvnr/structural-aligned-mixture-of-var"],"state":"official (archive's flag): 7 ran","n_ran":7,"n_constructed":0,"n_ran_no_instrument_failure":7,"n_unverified":2,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"longred-mitigating-short-text-degradation-of","title":"LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation","date":"2025-02-11","arxiv_id":"2502.07365","n_code_links":0,"syntology":null},{"paper":"/paper/maat-mamba-adaptive-anomaly-transformer-with","slug":"maat-mamba-adaptive-anomaly-transformer-with","title":"MAAT: Mamba Adaptive Anomaly Transformer with association discrepancy for time series","date":"2025-02-11","arxiv_id":"2502.07858","n_code_links":1,"syntology":null},{"paper":null,"slug":"making-language-models-robust-against","title":"Making Language Models Robust Against Negation","date":"2025-02-11","arxiv_id":"2502.07717","n_code_links":0,"syntology":null},{"paper":"/paper/mask-enhanced-autoregressive-prediction-pay","slug":"mask-enhanced-autoregressive-prediction-pay","title":"Mask-Enhanced Autoregressive Prediction: Pay Less Attention to Learn More","date":"2025-02-11","arxiv_id":"2502.07490","n_code_links":1,"syntology":null},{"paper":"/paper/mgpath-vision-language-model-with-multi","slug":"mgpath-vision-language-model-with-multi","title":"MGPATH: Vision-Language Model with Multi-Granular Prompt Learning for Few-Shot WSI Classification","date":"2025-02-11","arxiv_id":"2502.07409","n_code_links":1,"syntology":null},{"paper":null,"slug":"migt-memory-instance-gated-transformer","title":"MIGT: Memory Instance Gated Transformer Framework for Financial Portfolio Management","date":"2025-02-11","arxiv_id":"2502.07280","n_code_links":0,"syntology":null},{"paper":null,"slug":"nanovlms-how-small-can-we-go-and-still-make","title":"NanoVLMs: How small can we go and still make coherent Vision Language Models?","date":"2025-02-11","arxiv_id":"2502.07838","n_code_links":0,"syntology":null}],"record_sha256":"3924ef6d69d0a1cf40dde99af575e13a5195c34093dde6ad8b6685ec25cfe782","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}