{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/vision-transformer/papers/2","list_of":"/method/vision-transformer","method":"Vision Transformer","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":2,"pages_in_order":22,"rows_per_page":100,"rows":[101,200],"of":2144,"counts":{"archive_papers_tagged":2144,"with_a_code_link":1051,"where_syntology_ran_a_sample":328,"not_listed_spam_title":0,"listed":2144,"listed_where_code_ran":328,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":286,"every_run_a_failure_of_syntologys_instrument":42,"listed_with_a_run_with_no_instrument_failure":286,"listed_every_run_a_failure_of_syntologys_instrument":42,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/vision-transformer","prev":"/method/vision-transformer","next":"/method/vision-transformer/papers/3","papers":[{"paper":null,"slug":"advanced-chest-x-ray-analysis-via-transformer","title":"Advanced Chest X-Ray Analysis via Transformer-Based Image Descriptors and Cross-Model Attention Mechanism","date":"2025-04-23","arxiv_id":"2504.16774","n_code_links":0,"syntology":null},{"paper":"/paper/quantum-doubly-stochastic-transformers","slug":"quantum-doubly-stochastic-transformers","title":"Quantum Doubly Stochastic Transformers","date":"2025-04-22","arxiv_id":"2504.16275","n_code_links":0,"syntology":{"ran":3,"of":4,"n_ran_checked":3,"n_instrument":0,"unverified":1,"pointer_only":1,"phrase":"3 ran (of which 2 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":null}},{"paper":null,"slug":"automated-measurement-of-eczema-severity-with","title":"Automated Measurement of Eczema Severity with Self-Supervised Learning","date":"2025-04-21","arxiv_id":"2504.15193","n_code_links":0,"syntology":null},{"paper":null,"slug":"distribution-aware-dataset-distillation-for","title":"Distribution-aware Dataset Distillation for Efficient Image Restoration","date":"2025-04-21","arxiv_id":"2504.14826","n_code_links":0,"syntology":null},{"paper":"/paper/ecvit-efficient-convolutional-vision","slug":"ecvit-efficient-convolutional-vision","title":"ECViT: Efficient Convolutional Vision Transformer with Local-Attention and Multi-scale Stages","date":"2025-04-21","arxiv_id":"2504.14825","n_code_links":1,"syntology":null},{"paper":null,"slug":"impact-of-latent-space-dimension-on-iot","title":"Impact of Latent Space Dimension on IoT Botnet Detection Performance: VAE-Encoder Versus ViT-Encoder","date":"2025-04-21","arxiv_id":"2504.14879","n_code_links":0,"syntology":null},{"paper":null,"slug":"msad-net-multiscale-and-spatial-attention","title":"MSAD-Net: Multiscale and Spatial Attention-based Dense Network for Lung Cancer Classification","date":"2025-04-20","arxiv_id":"2504.14626","n_code_links":0,"syntology":null},{"paper":null,"slug":"6g-wavesfm-a-foundation-model-for-sensing","title":"6G WavesFM: A Foundation Model for Sensing, Communication, and Localization","date":"2025-04-18","arxiv_id":"2504.14100","n_code_links":0,"syntology":null},{"paper":"/paper/a-deep-learning-based-supervised-transfer","slug":"a-deep-learning-based-supervised-transfer","title":"A Deep Learning-Based Supervised Transfer Learning Framework for DOA Estimation with Array Imperfections","date":"2025-04-18","arxiv_id":"2504.13394","n_code_links":1,"syntology":null},{"paper":null,"slug":"collective-learning-mechanism-based-optimal","title":"Collective Learning Mechanism based Optimal Transport Generative Adversarial Network for Non-parallel Voice Conversion","date":"2025-04-18","arxiv_id":"2504.13791","n_code_links":0,"syntology":null},{"paper":null,"slug":"cytofm-the-first-cytology-foundation-model","title":"CytoFM: The first cytology foundation model","date":"2025-04-18","arxiv_id":"2504.13402","n_code_links":0,"syntology":null},{"paper":null,"slug":"dense-advit-a-novel-vision-transformer-for","title":"DenSe-AdViT: A novel Vision Transformer for Dense SAR Object Detection","date":"2025-04-18","arxiv_id":"2504.13638","n_code_links":0,"syntology":null},{"paper":"/paper/lora-based-continual-learning-with","slug":"lora-based-continual-learning-with","title":"LoRA-Based Continual Learning with Constraints on Critical Parameter Changes","date":"2025-04-18","arxiv_id":"2504.13407","n_code_links":1,"syntology":null},{"paper":"/paper/putting-the-segment-anything-model-to-the","slug":"putting-the-segment-anything-model-to-the","title":"Putting the Segment Anything Model to the Test with 3D Knee MRI - A Comparison with State-of-the-Art Performance","date":"2025-04-17","arxiv_id":"2504.13340","n_code_links":1,"syntology":null},{"paper":"/paper/human-aligned-compression-for-robust-models","slug":"human-aligned-compression-for-robust-models","title":"Human Aligned Compression for Robust Models","date":"2025-04-16","arxiv_id":"2504.12255","n_code_links":1,"syntology":null},{"paper":"/paper/zooming-in-on-fakes-a-novel-dataset-for","slug":"zooming-in-on-fakes-a-novel-dataset-for","title":"Zooming In on Fakes: A Novel Dataset for Localized AI-Generated Image Detection with Forgery Amplification Approach","date":"2025-04-16","arxiv_id":"2504.11922","n_code_links":1,"syntology":null},{"paper":null,"slug":"a-decade-of-wheat-mapping-for-lebanon","title":"A Decade of Wheat Mapping for Lebanon","date":"2025-04-15","arxiv_id":"2504.11366","n_code_links":0,"syntology":null},{"paper":"/paper/afire-anatomy-driven-self-supervised-learning","slug":"afire-anatomy-driven-self-supervised-learning","title":"AFiRe: Anatomy-Driven Self-Supervised Learning for Fine-Grained Representation in Radiographic Images","date":"2025-04-15","arxiv_id":"2504.10972","n_code_links":1,"syntology":null},{"paper":null,"slug":"embedding-radiomics-into-vision-transformers","title":"Embedding Radiomics into Vision Transformers for Multimodal Medical Image Classification","date":"2025-04-15","arxiv_id":"2504.10916","n_code_links":0,"syntology":null},{"paper":null,"slug":"differentially-private-2d-human-pose","title":"Differentially Private 2D Human Pose Estimation","date":"2025-04-14","arxiv_id":"2504.10190","n_code_links":0,"syntology":null},{"paper":null,"slug":"integrating-vision-and-location-with","title":"Integrating Vision and Location with Transformers: A Multimodal Deep Learning Framework for Medical Wound Analysis","date":"2025-04-14","arxiv_id":"2504.10452","n_code_links":0,"syntology":null},{"paper":null,"slug":"self-controlled-dynamic-expansion-model-for","title":"Self-Controlled Dynamic Expansion Model for Continual Learning","date":"2025-04-14","arxiv_id":"2504.10561","n_code_links":0,"syntology":null},{"paper":"/paper/the-scalability-of-simplicity-empirical","slug":"the-scalability-of-simplicity-empirical","title":"The Scalability of Simplicity: Empirical Analysis of Vision-Language Learning with a Single Transformer","date":"2025-04-14","arxiv_id":"2504.10462","n_code_links":1,"syntology":{"ran":2,"of":9,"n_ran_checked":2,"n_instrument":0,"unverified":7,"pointer_only":0,"phrase":"2 ran (of which 2 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 7 unverified; every one of the 2 samples that ran constructed an object rather than computing a result","official":{"repos":["bytedance/sail"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":2,"n_ran_no_instrument_failure":2,"n_unverified":7,"ran_from_kinds":["official"]}}},{"paper":"/paper/learning-occlusion-robust-vision-transformers-1","slug":"learning-occlusion-robust-vision-transformers-1","title":"Learning Occlusion-Robust Vision Transformers for Real-Time UAV Tracking","date":"2025-04-12","arxiv_id":"2504.09228","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result","official":{"repos":["wuyou3474/ortrack"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":1,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/multi-scale-activation-refinement-and-1","slug":"multi-scale-activation-refinement-and-1","title":"Multi-scale Activation, Refinement, and Aggregation: Exploring Diverse Cues for Fine-Grained Bird Recognition","date":"2025-04-12","arxiv_id":"2504.09215","n_code_links":0,"syntology":null},{"paper":null,"slug":"adaptive-additive-parameter-updates-of-vision","title":"Adaptive Additive Parameter Updates of Vision Transformers for Few-Shot Continual Learning","date":"2025-04-11","arxiv_id":"2504.08982","n_code_links":0,"syntology":null},{"paper":null,"slug":"hypergraph-vision-transformers-images-are","title":"Hypergraph Vision Transformers: Images are More than Nodes, More than Edges","date":"2025-04-11","arxiv_id":"2504.08710","n_code_links":0,"syntology":null},{"paper":null,"slug":"sarformer-an-acquisition-parameter-aware","title":"SARFormer -- An Acquisition Parameter Aware Vision Transformer for Synthetic Aperture Radar Data","date":"2025-04-11","arxiv_id":"2504.08441","n_code_links":0,"syntology":null},{"paper":null,"slug":"steering-clip-s-vision-transformer-with","title":"Steering CLIP's vision transformer with sparse autoencoders","date":"2025-04-11","arxiv_id":"2504.08729","n_code_links":0,"syntology":null},{"paper":null,"slug":"breaking-the-barriers-video-vision","title":"Breaking the Barriers: Video Vision Transformers for Word-Level Sign Language Recognition","date":"2025-04-10","arxiv_id":"2504.07792","n_code_links":0,"syntology":null},{"paper":"/paper/deep-learning-meets-teleconnections-improving","slug":"deep-learning-meets-teleconnections-improving","title":"Deep Learning Meets Teleconnections: Improving S2S Predictions for European Winter Weather","date":"2025-04-10","arxiv_id":"2504.07625","n_code_links":1,"syntology":null},{"paper":"/paper/heart-failure-prediction-using-modal","slug":"heart-failure-prediction-using-modal","title":"Heart Failure Prediction using Modal Decomposition and Masked Autoencoders for Scarce Echocardiography Databases","date":"2025-04-10","arxiv_id":"2504.07606","n_code_links":1,"syntology":null},{"paper":null,"slug":"novel-pooling-based-vgg-lite-for-pneumonia","title":"Novel Pooling-based VGG-Lite for Pneumonia and Covid-19 Detection from Imbalanced Chest X-Ray Datasets","date":"2025-04-10","arxiv_id":"2504.07468","n_code_links":0,"syntology":null},{"paper":"/paper/gaze-guided-learning-avoiding-shortcut-bias","slug":"gaze-guided-learning-avoiding-shortcut-bias","title":"Gaze-Guided Learning: Avoiding Shortcut Bias in Visual Classification","date":"2025-04-08","arxiv_id":"2504.05583","n_code_links":1,"syntology":null},{"paper":"/paper/hrmedseg-unlocking-high-resolution-medical","slug":"hrmedseg-unlocking-high-resolution-medical","title":"HRMedSeg: Unlocking High-resolution Medical Image segmentation via Memory-efficient Attention Modeling","date":"2025-04-08","arxiv_id":"2504.06205","n_code_links":1,"syntology":null},{"paper":"/paper/prompthmr-promptable-human-mesh-recovery","slug":"prompthmr-promptable-human-mesh-recovery","title":"PromptHMR: Promptable Human Mesh Recovery","date":"2025-04-08","arxiv_id":"2504.06397","n_code_links":1,"syntology":null},{"paper":null,"slug":"emf-event-meta-formers-for-event-based-real","title":"EMF: Event Meta Formers for Event-based Real-time Traffic Object Detection","date":"2025-04-05","arxiv_id":"2504.04124","n_code_links":0,"syntology":null},{"paper":null,"slug":"resilience-of-vision-transformers-for-domain","title":"Resilience of Vision Transformers for Domain Generalisation in the Presence of Out-of-Distribution Noisy Images","date":"2025-04-05","arxiv_id":"2504.04225","n_code_links":0,"syntology":null},{"paper":null,"slug":"adavit-adaptive-vision-transformer-for","title":"AdaViT: Adaptive Vision Transformer for Flexible Pretrain and Finetune with Variable 3D Medical Image Modalities","date":"2025-04-04","arxiv_id":"2504.03589","n_code_links":0,"syntology":null},{"paper":null,"slug":"ac-lora-auto-component-lora-for-personalized","title":"AC-LoRA: Auto Component LoRA for Personalized Artistic Style Image Generation","date":"2025-04-03","arxiv_id":"2504.02231","n_code_links":0,"syntology":null},{"paper":"/paper/beyond-conventional-transformers-the-medical","slug":"beyond-conventional-transformers-the-medical","title":"Beyond Conventional Transformers: The Medical X-ray Attention (MXA) Block for Improved Multi-Label Diagnosis Using Knowledge Distillation","date":"2025-04-03","arxiv_id":"2504.02277","n_code_links":1,"syntology":null},{"paper":"/paper/f-vita-foundation-model-guided-visible-to","slug":"f-vita-foundation-model-guided-visible-to","title":"F-ViTA: Foundation Model Guided Visible to Thermal Translation","date":"2025-04-03","arxiv_id":"2504.02801","n_code_links":1,"syntology":null},{"paper":"/paper/gptqv2-efficient-finetuning-free-quantization","slug":"gptqv2-efficient-finetuning-free-quantization","title":"GPTAQ: Efficient Finetuning-Free Quantization for Asymmetric Calibration","date":"2025-04-03","arxiv_id":"2504.02692","n_code_links":2,"syntology":{"ran":0,"of":2,"n_ran_checked":0,"n_instrument":0,"unverified":2,"pointer_only":2,"phrase":"0 ran · 2 unverified","official":{"repos":["intelligent-computing-lab-yale/gptaq","intelligent-computing-lab-yale/gptqv2"],"state":"official: harvested, nothing ran","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":2,"ran_from_kinds":[]}}},{"paper":null,"slug":"hgformer-topology-aware-vision-transformer","title":"HGFormer: Topology-Aware Vision Transformer with HyperGraph Learning","date":"2025-04-03","arxiv_id":"2504.02440","n_code_links":0,"syntology":null},{"paper":null,"slug":"hqvit-hybrid-quantum-vision-transformer-for","title":"HQViT: Hybrid Quantum Vision Transformer for Image Classification","date":"2025-04-03","arxiv_id":"2504.02730","n_code_links":0,"syntology":null},{"paper":null,"slug":"semiconductor-wafer-map-defect-classification","title":"Semiconductor Wafer Map Defect Classification with Tiny Vision Transformers","date":"2025-04-03","arxiv_id":"2504.02494","n_code_links":0,"syntology":null},{"paper":null,"slug":"prompt-guided-attention-head-selection-for","title":"Prompt-Guided Attention Head Selection for Focus-Oriented Image Retrieval","date":"2025-04-02","arxiv_id":"2504.01348","n_code_links":0,"syntology":null},{"paper":null,"slug":"univitar-unified-vision-transformer-with","title":"UniViTAR: Unified Vision Transformer with Native Resolution","date":"2025-04-02","arxiv_id":"2504.01792","n_code_links":0,"syntology":null},{"paper":"/paper/cellvta-enhancing-vision-foundation-models","slug":"cellvta-enhancing-vision-foundation-models","title":"CellVTA: Enhancing Vision Foundation Models for Accurate Cell Segmentation and Classification","date":"2025-04-01","arxiv_id":"2504.00784","n_code_links":1,"syntology":null},{"paper":"/paper/mergevq-a-unified-framework-for-visual","slug":"mergevq-a-unified-framework-for-visual","title":"MergeVQ: A Unified Framework for Visual Generation and Representation with Disentangled Token Merging and Quantization","date":"2025-04-01","arxiv_id":"2504.00999","n_code_links":1,"syntology":null},{"paper":null,"slug":"qsvit-a-methodology-for-quantizing-spiking","title":"QSViT: A Methodology for Quantizing Spiking Vision Transformers","date":"2025-04-01","arxiv_id":"2504.00948","n_code_links":0,"syntology":null},{"paper":null,"slug":"conformal-uncertainty-quantification-to","title":"Conformal uncertainty quantification to evaluate predictive fairness of foundation AI model for skin lesion classes across patient demographics","date":"2025-03-31","arxiv_id":"2503.23819","n_code_links":0,"syntology":null},{"paper":"/paper/foundation-models-for-seismic-data-processing","slug":"foundation-models-for-seismic-data-processing","title":"Foundation Models For Seismic Data Processing: An Extensive Review","date":"2025-03-31","arxiv_id":"2503.24166","n_code_links":1,"syntology":null},{"paper":"/paper/a-lightweight-image-super-resolution","slug":"a-lightweight-image-super-resolution","title":"A Lightweight Image Super-Resolution Transformer Trained on Low-Resolution Images Only","date":"2025-03-30","arxiv_id":"2503.23265","n_code_links":1,"syntology":null},{"paper":null,"slug":"efficient-adaptation-for-remote-sensing","title":"Efficient Adaptation For Remote Sensing Visual Grounding","date":"2025-03-29","arxiv_id":"2503.23083","n_code_links":0,"syntology":null},{"paper":"/paper/large-self-supervised-models-bridge-the-gap","slug":"large-self-supervised-models-bridge-the-gap","title":"Large Self-Supervised Models Bridge the Gap in Domain Adaptive Object Detection","date":"2025-03-29","arxiv_id":"2503.23220","n_code_links":1,"syntology":null},{"paper":"/paper/z-saslm-zero-shot-style-aligned-sli-blending-1","slug":"z-saslm-zero-shot-style-aligned-sli-blending-1","title":"Z-SASLM: Zero-Shot Style-Aligned SLI Blending Latent Manipulation","date":"2025-03-29","arxiv_id":"2503.23234","n_code_links":1,"syntology":null},{"paper":null,"slug":"recom-realistic-co-speech-motion-generation","title":"ReCoM: Realistic Co-Speech Motion Generation with Recurrent Embedded Transformer","date":"2025-03-27","arxiv_id":"2503.21847","n_code_links":0,"syntology":null},{"paper":"/paper/face-spoofing-detection-using-deep-learning","slug":"face-spoofing-detection-using-deep-learning","title":"Face Spoofing Detection using Deep Learning","date":"2025-03-25","arxiv_id":"2503.19223","n_code_links":1,"syntology":null},{"paper":null,"slug":"roboflamingo-plus-fusion-of-depth-and-rgb","title":"RoboFlamingo-Plus: Fusion of Depth and RGB Perception with Vision-Language Models for Enhanced Robotic Manipulation","date":"2025-03-25","arxiv_id":"2503.19510","n_code_links":0,"syntology":null},{"paper":"/paper/surg-3m-a-dataset-and-foundation-model-for","slug":"surg-3m-a-dataset-and-foundation-model-for","title":"Surg-3M: A Dataset and Foundation Model for Perception in Surgical Settings","date":"2025-03-25","arxiv_id":"2503.19740","n_code_links":1,"syntology":null},{"paper":null,"slug":"chirp-localization-via-fine-tuned-transformer","title":"Chirp Localization via Fine-Tuned Transformer Model: A Proof-of-Concept Study","date":"2025-03-24","arxiv_id":"2503.22713","n_code_links":0,"syntology":null},{"paper":null,"slug":"image-to-text-for-medical-reports-using","title":"Image-to-Text for Medical Reports Using Adaptive Co-Attention and Triple-LSTM Module","date":"2025-03-24","arxiv_id":"2503.18297","n_code_links":0,"syntology":null},{"paper":"/paper/spmtrack-spatio-temporal-parameter-efficient","slug":"spmtrack-spatio-temporal-parameter-efficient","title":"SPMTrack: Spatio-Temporal Parameter-Efficient Fine-Tuning with Mixture of Experts for Scalable Visual Tracking","date":"2025-03-24","arxiv_id":"2503.18338","n_code_links":1,"syntology":{"ran":1,"of":1,"n_ran_checked":1,"n_instrument":0,"unverified":0,"pointer_only":0,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","official":{"repos":["wenruicai/spmtrack"],"state":"official (archive's flag): 1 ran","n_ran":1,"n_constructed":0,"n_ran_no_instrument_failure":1,"n_unverified":0,"ran_from_kinds":["official"]}}},{"paper":"/paper/pathohr-breast-cancer-survival-prediction-on","slug":"pathohr-breast-cancer-survival-prediction-on","title":"PathoHR: Breast Cancer Survival Prediction on High-Resolution Pathological Images","date":"2025-03-23","arxiv_id":"2503.17970","n_code_links":1,"syntology":null},{"paper":null,"slug":"automated-diagnosis-of-lung-diseases-using","title":"Automated diagnosis of lung diseases using vision transformer: a comparative study on chest x-ray classification","date":"2025-03-22","arxiv_id":"2503.18973","n_code_links":0,"syntology":null},{"paper":"/paper/emplace-self-supervised-urban-scene-change","slug":"emplace-self-supervised-urban-scene-change","title":"EMPLACE: Self-Supervised Urban Scene Change Detection","date":"2025-03-22","arxiv_id":"2503.17716","n_code_links":1,"syntology":{"ran":4,"of":7,"n_ran_checked":4,"n_instrument":0,"unverified":3,"pointer_only":7,"phrase":"4 ran (of which 4 constructed an object rather than computing a result; 4 with no instrument failure: 0 honoured, 0 violated, 4 with no contract checked; 0 where Syntology's instrument failed) · 3 unverified; every one of the 4 samples that ran constructed an object rather than computing a result","official":{"repos":["timalph/emplace"],"state":"official (archive's flag): 4 ran","n_ran":4,"n_constructed":4,"n_ran_no_instrument_failure":4,"n_unverified":3,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"serial-low-rank-adaptation-of-vision","title":"Serial Low-rank Adaptation of Vision Transformer","date":"2025-03-22","arxiv_id":"2503.17750","n_code_links":0,"syntology":null},{"paper":"/paper/feature-based-dual-visual-feature-extraction","slug":"feature-based-dual-visual-feature-extraction","title":"Feature-Based Dual Visual Feature Extraction Model for Compound Multimodal Emotion Recognition","date":"2025-03-21","arxiv_id":"2503.17453","n_code_links":1,"syntology":null},{"paper":null,"slug":"vision-transformer-based-semantic-1","title":"Vision Transformer Based Semantic Communications for Next Generation Wireless Networks","date":"2025-03-21","arxiv_id":"2503.17275","n_code_links":0,"syntology":null},{"paper":null,"slug":"hyperspectral-imaging-for-identifying-foreign","title":"Hyperspectral Imaging for Identifying Foreign Objects on Pork Belly","date":"2025-03-20","arxiv_id":"2503.16086","n_code_links":0,"syntology":null},{"paper":"/paper/a-score-attention-based-scene-coordinate","slug":"a-score-attention-based-scene-coordinate","title":"A-SCoRe: Attention-based Scene Coordinate Regression for wide-ranging scenarios","date":"2025-03-18","arxiv_id":"2503.13982","n_code_links":1,"syntology":null},{"paper":"/paper/dynamic-accumulated-attention-map-for","slug":"dynamic-accumulated-attention-map-for","title":"Dynamic Accumulated Attention Map for Interpreting Evolution of Decision-Making in Vision Transformer","date":"2025-03-18","arxiv_id":"2503.14640","n_code_links":1,"syntology":null},{"paper":null,"slug":"text-guided-image-invariant-feature-learning","title":"Text-Guided Image Invariant Feature Learning for Robust Image Watermarking","date":"2025-03-18","arxiv_id":"2503.13805","n_code_links":0,"syntology":null},{"paper":null,"slug":"advancing-chronic-tuberculosis-diagnostics","title":"Advancing Chronic Tuberculosis Diagnostics Using Vision-Language Models: A Multi modal Framework for Precision Analysis","date":"2025-03-17","arxiv_id":"2503.14536","n_code_links":0,"syntology":null},{"paper":"/paper/an-interpretable-approach-to-automating-the","slug":"an-interpretable-approach-to-automating-the","title":"An interpretable approach to automating the assessment of biofouling in video footage","date":"2025-03-17","arxiv_id":"2503.12875","n_code_links":1,"syntology":null},{"paper":null,"slug":"towards-scalable-foundation-model-for-multi","title":"Towards Scalable Foundation Model for Multi-modal and Hyperspectral Geospatial Data","date":"2025-03-17","arxiv_id":"2503.12843","n_code_links":0,"syntology":null},{"paper":"/paper/fourier-based-3d-multistage-transformer-for","slug":"fourier-based-3d-multistage-transformer-for","title":"Fourier-Based 3D Multistage Transformer for Aberration Correction in Multicellular Specimens","date":"2025-03-16","arxiv_id":"2503.12593","n_code_links":2,"syntology":null},{"paper":null,"slug":"semantic-matters-multimodal-features-for","title":"Semantic Matters: Multimodal Features for Affective Analysis","date":"2025-03-16","arxiv_id":"2504.11460","n_code_links":0,"syntology":null},{"paper":null,"slug":"asynchronous-sharpness-aware-minimization-for","title":"Asynchronous Sharpness-Aware Minimization For Fast and Accurate Deep Learning","date":"2025-03-14","arxiv_id":"2503.11147","n_code_links":0,"syntology":null},{"paper":"/paper/bevdiffloc-end-to-end-lidar-global","slug":"bevdiffloc-end-to-end-lidar-global","title":"BEVDiffLoc: End-to-End LiDAR Global Localization in BEV View based on Diffusion Model","date":"2025-03-14","arxiv_id":"2503.11372","n_code_links":1,"syntology":null},{"paper":null,"slug":"dynrsl-vlm-enhancing-autonomous-driving","title":"DynRsl-VLM: Enhancing Autonomous Driving Perception with Dynamic Resolution Vision-Language Models","date":"2025-03-14","arxiv_id":"2503.11265","n_code_links":0,"syntology":null},{"paper":null,"slug":"countpath-automating-fragment-counting-in","title":"CountPath: Automating Fragment Counting in Digital Pathology","date":"2025-03-13","arxiv_id":"2503.10520","n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-domain-biometric-recognition-using-body","title":"Multi-Domain Biometric Recognition using Body Embeddings","date":"2025-03-13","arxiv_id":"2503.10931","n_code_links":0,"syntology":null},{"paper":"/paper/robustness-tokens-towards-adversarial","slug":"robustness-tokens-towards-adversarial","title":"Robustness Tokens: Towards Adversarial Robustness of Transformers","date":"2025-03-13","arxiv_id":"2503.10191","n_code_links":1,"syntology":null},{"paper":null,"slug":"cleverdistiller-simple-and-spatially","title":"CleverDistiller: Simple and Spatially Consistent Cross-modal Distillation","date":"2025-03-12","arxiv_id":"2503.09878","n_code_links":0,"syntology":null},{"paper":null,"slug":"mapping-fmri-signal-and-image-stimuli-in-an","title":"Mapping fMRI Signal and Image Stimuli in an Artificial Neural Network Latent Space: Bringing Artificial and Natural Minds Together","date":"2025-03-12","arxiv_id":"2503.19923","n_code_links":0,"syntology":null},{"paper":null,"slug":"object-aware-dino-oh-a-dino-enhancing-self","title":"Object-Aware DINO (Oh-A-Dino): Enhancing Self-Supervised Representations for Multi-Object Instance Retrieval","date":"2025-03-12","arxiv_id":"2503.09867","n_code_links":0,"syntology":null},{"paper":null,"slug":"kan-mixers-a-new-deep-learning-architecture","title":"KAN-Mixers: a new deep learning architecture for image classification","date":"2025-03-11","arxiv_id":"2503.08939","n_code_links":0,"syntology":null},{"paper":null,"slug":"transecg-leveraging-transformers-for","title":"TransECG: Leveraging Transformers for Explainable ECG Re-identification Risk Analysis","date":"2025-03-11","arxiv_id":"2503.13495","n_code_links":0,"syntology":null},{"paper":null,"slug":"vision-transformer-for-intracranial","title":"Vision Transformer for Intracranial Hemorrhage Classification in CT Scans Using an Entropy-Aware Fuzzy Integral Strategy for Adaptive Scan-Level Decision Fusion","date":"2025-03-11","arxiv_id":"2503.08609","n_code_links":0,"syntology":null},{"paper":"/paper/a-data-centric-revisit-of-pre-trained-vision","slug":"a-data-centric-revisit-of-pre-trained-vision","title":"A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning","date":"2025-03-10","arxiv_id":"2503.06960","n_code_links":1,"syntology":{"ran":3,"of":4,"n_ran_checked":2,"n_instrument":1,"unverified":1,"pointer_only":0,"phrase":"3 ran (of which 2 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 1 where Syntology's instrument failed) · 1 unverified","official":{"repos":["cvmi-lab/slotmim"],"state":"official (archive's flag): 3 ran","n_ran":3,"n_constructed":2,"n_ran_no_instrument_failure":2,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"visual-and-text-prompt-segmentation-a-novel","title":"Visual and Text Prompt Segmentation: A Novel Multi-Model Framework for Remote Sensing","date":"2025-03-10","arxiv_id":"2503.07911","n_code_links":0,"syntology":null},{"paper":"/paper/gromo-plant-growth-modeling-with-multiview","slug":"gromo-plant-growth-modeling-with-multiview","title":"GroMo: Plant Growth Modeling with Multiview Images","date":"2025-03-09","arxiv_id":"2503.06608","n_code_links":1,"syntology":null},{"paper":null,"slug":"seeing-delta-parameters-as-jpeg-images-data","title":"Seeing Delta Parameters as JPEG Images: Data-Free Delta Compression with Discrete Cosine Transform","date":"2025-03-09","arxiv_id":"2503.06676","n_code_links":0,"syntology":null},{"paper":null,"slug":"lightweight-software-kernels-and-hardware","title":"Lightweight Software Kernels and Hardware Extensions for Efficient Sparse Deep Neural Networks on Microcontrollers","date":"2025-03-08","arxiv_id":"2503.06183","n_code_links":0,"syntology":null},{"paper":"/paper/gbt-sam-a-parameter-efficient-depth-aware","slug":"gbt-sam-a-parameter-efficient-depth-aware","title":"GBT-SAM: Adapting a Foundational Deep Learning Model for Generalizable Brain Tumor Segmentation via Efficient Integration of Multi-Parametric MRI Data","date":"2025-03-06","arxiv_id":"2503.04325","n_code_links":1,"syntology":null},{"paper":"/paper/toward-lightweight-and-fast-decoders-for","slug":"toward-lightweight-and-fast-decoders-for","title":"Toward Lightweight and Fast Decoders for Diffusion Models in Image and Video Generation","date":"2025-03-06","arxiv_id":"2503.04871","n_code_links":1,"syntology":null},{"paper":null,"slug":"ahcptq-accurate-and-hardware-compatible-post","title":"AHCPTQ: Accurate and Hardware-Compatible Post-Training Quantization for Segment Anything Model","date":"2025-03-05","arxiv_id":"2503.03088","n_code_links":0,"syntology":null},{"paper":null,"slug":"dtu-net-a-multi-scale-dilated-transformer","title":"DTU-Net: A Multi-Scale Dilated Transformer Network for Nonlinear Hyperspectral Unmixing","date":"2025-03-05","arxiv_id":"2503.03465","n_code_links":0,"syntology":null}],"record_sha256":"764dcd5d2e82ef831678d3c48db7d102c81484c9a659727be8a50d0db61a2c34","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}