{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/softmax/papers/62","list_of":"/method/softmax","method":"Softmax","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":62,"pages_in_order":375,"rows_per_page":100,"rows":[6101,6200],"of":37443,"counts":{"archive_papers_tagged":37443,"with_a_code_link":15869,"where_syntology_ran_a_sample":4578,"not_listed_spam_title":0,"listed":37443,"listed_where_code_ran":4578,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":3835,"every_run_a_failure_of_syntologys_instrument":743,"listed_with_a_run_with_no_instrument_failure":3835,"listed_every_run_a_failure_of_syntologys_instrument":743,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/softmax","prev":"/method/softmax/papers/61","next":"/method/softmax/papers/63","papers":[{"paper":null,"slug":"gs-dit-advancing-video-generation-with","title":"GS-DiT: Advancing Video Generation with Dynamic 3D Gaussian Fields through Efficient Dense 3D Point Tracking","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hazy-low-quality-satellite-video-restoration","title":"Hazy Low-Quality Satellite Video Restoration Via Learning Optimal Joint Degradation Patterns and Continuous-Scale Super-Resolution Reconstruction","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"heterogeneous-skeleton-based-action","title":"Heterogeneous Skeleton-Based Action Representation Learning","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hierarchical-compact-clustering-attention-1","title":"Hierarchical Compact Clustering Attention (COCA) for Unsupervised Object-Centric Learning","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/hunet-homotopy-unfolding-network-for-image","slug":"hunet-homotopy-unfolding-network-for-image","title":"HUNet: Homotopy Unfolding Network for Image Compressive Sensing","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"hush-holistic-panoramic-3d-scene","title":"HUSH: Holistic Panoramic 3D Scene Understanding using Spherical Harmonics","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"i2vguard-safeguarding-images-against-misuse","title":"I2VGuard: Safeguarding Images against Misuse in Diffusion-based Image-to-Video Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"icediff-high-resolution-and-high-quality","title":"IceDiff: High Resolution and High-Quality Arctic Sea Ice Forecasting with Generative Diffusion Prior","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"keep-the-balance-a-parameter-efficient","title":"Keep the Balance: A Parameter-Efficient Symmetrical Framework for RGB+X Semantic Segmentation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"knowledge-guided-prompt-learning-for-deepfake","title":"Knowledge-Guided Prompt Learning for Deepfake Facial Image Detection","date":"2025-01-01","arxiv_id":"2501.00700","n_code_links":0,"syntology":null},{"paper":"/paper/labels-generated-by-large-language-model","slug":"labels-generated-by-large-language-model","title":"Labels Generated by Large Language Model Helps Measuring People's Empathy in Vitro","date":"2025-01-01","arxiv_id":"2501.00691","n_code_links":1,"syntology":null},{"paper":null,"slug":"language-guided-salient-object-ranking","title":"Language-Guided Salient Object Ranking","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"learning-endogenous-attention-for-incremental","title":"Learning Endogenous Attention for Incremental Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"less-attention-is-more-prompt-transformer-for","title":"Less Attention is More: Prompt Transformer for Generalized Category Discovery","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/less-is-more-token-context-aware-learning-for","slug":"less-is-more-token-context-aware-learning-for","title":"Less is More: Token Context-aware Learning for Object Tracking","date":"2025-01-01","arxiv_id":"2501.00758","n_code_links":1,"syntology":null},{"paper":"/paper/lp-diff-towards-improved-restoration-of-real","slug":"lp-diff-towards-improved-restoration-of-real","title":"LP-Diff: Towards Improved Restoration of Real-World Degraded License Plate","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"mask-2dit-dual-mask-based-diffusion","title":"Mask^2DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mc-2-multi-concept-guidance-for-customized-1","title":"MC^2: Multi-concept Guidance for Customized Multi-concept Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/mitigating-object-hallucinations-in-large-2","slug":"mitigating-object-hallucinations-in-large-2","title":"Mitigating Object Hallucinations in Large Vision-Language Models with Assembly of Global and Local Attention","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"motionpro-exploring-the-role-of-pressure-in","title":"MotionPRO: Exploring the Role of Pressure in Human MoCap and Beyond","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"motions-as-queries-one-stage-multi-person","title":"Motions as Queries: One-Stage Multi-Person Holistic Human Motion Capture","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-group-proportional-representations-for","title":"Multi-Group Proportional Representations for Text-to-Image Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-party-collaborative-attention-control","title":"Multi-party Collaborative Attention Control for Image Customization","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/multimodal-large-models-are-effective-action","slug":"multimodal-large-models-are-effective-action","title":"Multimodal Large Models Are Effective Action Anticipators","date":"2025-01-01","arxiv_id":"2501.00795","n_code_links":1,"syntology":null},{"paper":null,"slug":"multiscaled-multi-head-attention-based-video","title":"Multiscaled Multi-Head Attention-based Video Transformer Network for Hand Gesture Recognition","date":"2025-01-01","arxiv_id":"2501.00935","n_code_links":0,"syntology":null},{"paper":"/paper/navigating-nuance-in-quest-for-political","slug":"navigating-nuance-in-quest-for-political","title":"Navigating Nuance: In Quest for Political Truth","date":"2025-01-01","arxiv_id":"2501.00782","n_code_links":1,"syntology":null},{"paper":"/paper/nnwnet-rethinking-the-use-of-transformers-in","slug":"nnwnet-rethinking-the-use-of-transformers-in","title":"nnWNet: Rethinking the Use of Transformers in Biomedical Image Segmentation and Calling for a Unified Evaluation Benchmark","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"on-importance-of-layer-pruning-for-smaller","title":"On Importance of Layer Pruning for Smaller BERT Models and Low Resource Languages","date":"2025-01-01","arxiv_id":"2501.00733","n_code_links":0,"syntology":null},{"paper":null,"slug":"onda-pose-occlusion-aware-neural-domain","title":"ONDA-Pose: Occlusion-Aware Neural Domain Adaptation for Self-Supervised 6D Object Pose Estimation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"patch-matters-training-free-fine-grained","title":"Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"performance-barrier-event-triggered-pde","title":"Performance-Barrier Event-Triggered PDE Control of Traffic Flow","date":"2025-01-01","arxiv_id":"2501.00722","n_code_links":0,"syntology":null},{"paper":null,"slug":"pillarhist-a-quantization-aware-pillar-1","title":"PillarHist: A Quantization-aware Pillar Feature Encoder based on Height-aware Histogram","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"point-clouds-meets-physics-dynamic-acoustic","title":"Point Clouds Meets Physics: Dynamic Acoustic Field Fitting Network for Point Cloud Understanding","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"pointsr-self-regularized-point-supervision","title":"PointSR: Self-Regularized Point Supervision for Drone-View Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"popen-preference-based-optimization-and","title":"POPEN: Preference-Based Optimization and Ensemble for LVLM-Based Reasoning Segmentation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/population-aware-diffusion-for-time-series","slug":"population-aware-diffusion-for-time-series","title":"Population Aware Diffusion for Time Series Generation","date":"2025-01-01","arxiv_id":"2501.00910","n_code_links":1,"syntology":{"ran":7,"of":8,"n_ran_checked":7,"n_instrument":0,"unverified":1,"pointer_only":8,"phrase":"7 ran (of which 0 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 0 violated, 7 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified","official":{"repos":["wmd3i/PaD-TS"],"state":"official (archive's flag): 7 ran","n_ran":7,"n_constructed":0,"n_ran_no_instrument_failure":7,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":"/paper/prompt-cam-making-vision-transformers","slug":"prompt-cam-making-vision-transformers","title":"Prompt-CAM: Making Vision Transformers Interpretable for Fine-Grained Analysis","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"prompthash-affinity-prompted-collaborative-1","title":"PromptHash:Affinity-Prompted Collaborative Cross-Modal Learning for Adaptive Hashing Retrieval","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"prototype-based-image-prompting-for-weakly","title":"Prototype-Based Image Prompting for Weakly Supervised Histopathological Image Segmentation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/ps-diffusion-photorealistic-subject-driven","slug":"ps-diffusion-photorealistic-subject-driven","title":"PS-Diffusion: Photorealistic Subject-Driven Image Editing with Disentangled Control and Attention","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"r2c-mapping-room-to-chessboard-to-unlock-llm","title":"R2C: Mapping Room to Chessboard to Unlock LLM As Low-Level Action Planner","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"radiov2-5-improved-baselines-for","title":"RADIOv2.5: Improved Baselines for Agglomerative Vision Foundation Models","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"reasoning-mamba-hypergraph-guided-region","title":"Reasoning Mamba: Hypergraph-Guided Region Relation Calculating for Weakly Supervised Affordance Grounding","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/relation3d-enhancing-relation-modeling-for","slug":"relation3d-enhancing-relation-modeling-for","title":"Relation3D : Enhancing Relation Modeling for Point Cloud Instance Segmentation","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/rethinking-addressing-in-language-models-via","slug":"rethinking-addressing-in-language-models-via","title":"Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding","date":"2025-01-01","arxiv_id":"2501.00712","n_code_links":1,"syntology":{"ran":2,"of":3,"n_ran_checked":1,"n_instrument":1,"unverified":1,"pointer_only":0,"phrase":"2 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 1 where Syntology's instrument failed) · 1 unverified","official":{"repos":["vita-group/tape"],"state":"official (archive's flag): 2 ran","n_ran":2,"n_constructed":1,"n_ran_no_instrument_failure":1,"n_unverified":1,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"rethinking-noisy-video-text-retrieval-via","title":"Rethinking Noisy Video-Text Retrieval via Relation-aware Alignment","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"rethinking-spiking-self-attention-mechanism","title":"Rethinking Spiking Self-Attention Mechanism: Implementing a-XNOR Similarity Calculation in Spiking Transformers","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/rethinking-token-reduction-with-parameter","slug":"rethinking-token-reduction-with-parameter","title":"Rethinking Token Reduction with Parameter-Efficient Fine-Tuning in ViT for Pixel-Level Tasks","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"revisiting-audio-visual-segmentation-with","title":"Revisiting Audio-Visual Segmentation with Vision-Centric Transformer","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/revisiting-generative-replay-for-class","slug":"revisiting-generative-replay-for-class","title":"Revisiting Generative Replay for Class Incremental Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"robsense-a-robust-multi-modal-foundation","title":"RobSense: A Robust Multi-modal Foundation Model for Remote Sensing with Static, Temporal, and Incomplete Data Adaptability","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"robust-multimodal-survival-prediction-with-1","title":"Robust Multimodal Survival Prediction with Conditional Latent Differentiation Variational AutoEncoder","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"s-3-face-sss-compliant-facial-reflectance","title":"S^3-Face: SSS-Compliant Facial Reflectance Estimation via Diffusion Priors","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sapiensid-foundation-for-human-recognition","title":"SapiensID: Foundation for Human Recognition","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"scenediffuser-city-scale-traffic-simulation","title":"SceneDiffuser++: City-Scale Traffic Simulation via a Generative World Model","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"scsa-a-plug-and-play-semantic-continuous","title":"SCSA: A Plug-and-Play Semantic Continuous-Sparse Attention for Arbitrary Semantic Style Transfer","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sdgocc-semantic-and-depth-guided-bird-s-eye","title":"SDGOCC: Semantic and Depth-Guided Bird's-Eye View Transformation for 3D Multimodal Occupancy Prediction","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sealion-semantic-part-aware-latent-point","title":"SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"seeing-is-not-believing-adversarial-natural","title":"Seeing is Not Believing: Adversarial Natural Object Optimization for Hard-Label 3D Scene Attacks","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"seek-common-ground-while-reserving","title":"Seek Common Ground While Reserving Differences: Semi-Supervised Image-Text Sentiment Recognition","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"seen-da-semantic-entropy-guided-domain-aware","title":"SEEN-DA: SEmantic ENtropy guided Domain-aware Attention for Domain Adaptive Object Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"self-supervised-controlnet-with-spatio","title":"Self-supervised ControlNet with Spatio-Temporal Mamba for Real-world Video Super-resolution","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"self-supervised-cross-view-correspondence","title":"Self-Supervised Cross-View Correspondence with Predictive Cycle Consistency","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"separation-of-powers-on-segregating-knowledge","title":"Separation of Powers: On Segregating Knowledge from Observation in LLM-enabled Knowledge-based Visual Question Answering","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"spatial-temporal-attention-based-target","title":"Spatial Temporal Attention based Target Vehicle Trajectory Prediction for Internet of Vehicles","date":"2025-01-01","arxiv_id":"2501.00890","n_code_links":0,"syntology":null},{"paper":null,"slug":"spiking-transformer-introducing-accurate-1","title":"Spiking Transformer: Introducing Accurate Addition-Only Spiking Self-Attention for Transformer","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"splatter-360-generalizable-360-gaussian","title":"Splatter-360: Generalizable 360 Gaussian Splatting for Wide-baseline Panoramic Images","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"star-with-bilinear-mapping","title":"Star with Bilinear Mapping","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/subspace-constraint-and-contribution","slug":"subspace-constraint-and-contribution","title":"Subspace Constraint and Contribution Estimation for Heterogeneous Federated Learning","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/task-aware-clustering-for-prompting-vision","slug":"task-aware-clustering-for-prompting-vision","title":"Task-Aware Clustering for Prompting Vision-Language Models","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"task-aware-cross-modal-feature-refinement","title":"Task-aware Cross-modal Feature Refinement Transformer with Large Language Models for Visual Grounding","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"texgarment-consistent-garment-uv-texture","title":"TexGarment: Consistent Garment UV Texture Generation via Efficient 3D Structure-Guided Diffusion Transformer","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/topnet-transformer-efficient-occupancy","slug":"topnet-transformer-efficient-occupancy","title":"TopNet: Transformer-Efficient Occupancy Prediction Network for Octree-Structured Point Cloud Geometry Compression","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"toward-real-world-bev-perception-depth","title":"Toward Real-world BEV Perception: Depth Uncertainty Estimation via Gaussian Splatting","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"towards-efficient-foundation-model-for-zero","title":"Towards Efficient Foundation Model for Zero-shot Amodal Segmentation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"ucod-dpl-unsupervised-camouflaged-object","title":"UCOD-DPL: Unsupervised Camouflaged Object Detection via Dynamic Pseudo-label Learning","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"unity-in-diversity-video-editing-via-gradient","title":"Unity in Diversity: Video Editing via Gradient-Latent Purification","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"unseen-visual-anomaly-generation","title":"Unseen Visual Anomaly Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"v2v3d-view-to-view-denoised-3d-reconstruction-1","title":"V2V3D: View-to-View Denoised 3D Reconstruction for Light Field Microscopy","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/vasparse-towards-efficient-visual-1","slug":"vasparse-towards-efficient-visual-1","title":"VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"video-language-model-pretraining-with-spatio","title":"Video Language Model Pretraining with Spatio-temporal Masking","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"vikienet-towards-efficient-3d-object","title":"ViKIENet: Towards Efficient 3D Object Detection with Virtual Key Instance Enhanced Network","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"vodiff-controlling-object-visibility-order-in","title":"VODiff: Controlling Object Visibility Order in Text-to-Image Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/volformer-explore-more-comprehensive-cube","slug":"volformer-explore-more-comprehensive-cube","title":"VolFormer: Explore More Comprehensive Cube Interaction for Hyperspectral Image Restoration and Beyond","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"vsnet-focusing-on-the-linguistic","title":"VSNet: Focusing on the Linguistic Characteristics of Sign Language","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/wavelet-and-prototype-augmented-query-based","slug":"wavelet-and-prototype-augmented-query-based","title":"Wavelet and Prototype Augmented Query-based Transformer for Pixel-level Surface Defect Detection","date":"2025-01-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"weakly-supervised-semantic-segmentation-via-5","title":"Weakly Supervised Semantic Segmentation via Progressive Confidence Region Expansion","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"yo-chameleon-personalized-vision-and-language","title":"Yo'Chameleon: Personalized Vision and Language Generation","date":"2025-01-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"a-novel-convolution-and-attention-mechanism","title":"A Novel Convolution and Attention Mechanism-based Model for 6D Object Pose Estimation","date":"2024-12-31","arxiv_id":"2501.01993","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-novel-shape-guided-transformer-network-for","title":"A Novel Shape Guided Transformer Network for Instance Segmentation in Remote Sensing Images","date":"2024-12-31","arxiv_id":"2501.00360","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-study-on-context-length-and-efficient","title":"A Study on Context Length and Efficient Transformers for Biomedical Image Analysis","date":"2024-12-31","arxiv_id":"2501.00619","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-wideband-amplifying-and-filtering","title":"A wideband amplifying and filtering reconfigurable intelligent surface for wireless relay","date":"2024-12-31","arxiv_id":"2501.09759","n_code_links":0,"syntology":null},{"paper":null,"slug":"advanced-lung-nodule-segmentation-and","title":"Advanced Lung Nodule Segmentation and Classification for Early Detection of Lung Cancer using SAM and Transfer Learning","date":"2024-12-31","arxiv_id":"2501.00586","n_code_links":0,"syntology":null},{"paper":"/paper/crrg-clip-automatic-generation-of-chest","slug":"crrg-clip-automatic-generation-of-chest","title":"CRRG-CLIP: Automatic Generation of Chest Radiology Reports and Classification of Chest Radiographs","date":"2024-12-31","arxiv_id":"2501.01989","n_code_links":1,"syntology":null},{"paper":null,"slug":"dementia-detection-using-multi-modal-methods","title":"Dementia Detection using Multi-modal Methods on Audio Data","date":"2024-12-31","arxiv_id":"2501.00465","n_code_links":0,"syntology":null},{"paper":null,"slug":"echoes-in-ai-quantifying-lack-of-plot","title":"Echoes in AI: Quantifying Lack of Plot Diversity in LLM Outputs","date":"2024-12-31","arxiv_id":"2501.00273","n_code_links":0,"syntology":null},{"paper":null,"slug":"exploring-variability-in-fine-tuned-models","title":"Exploring Variability in Fine-Tuned Models for Text Classification with DistilBERT","date":"2024-12-31","arxiv_id":"2501.00241","n_code_links":0,"syntology":null},{"paper":null,"slug":"fast-and-interpretable-mixed-integer-linear","title":"Fast and Interpretable Mixed-Integer Linear Program Solving by Learning Model Reduction","date":"2024-12-31","arxiv_id":"2501.00307","n_code_links":0,"syntology":null},{"paper":null,"slug":"finding-missed-code-size-optimizations-in","title":"Finding Missed Code Size Optimizations in Compilers using LLMs","date":"2024-12-31","arxiv_id":"2501.00655","n_code_links":0,"syntology":null},{"paper":null,"slug":"gpt-4-on-clinic-depression-assessment-an-llm","title":"GPT-4 on Clinic Depression Assessment: An LLM-Based Pilot Study","date":"2024-12-31","arxiv_id":"2501.00199","n_code_links":0,"syntology":null}],"record_sha256":"9413bc367bbdacbcfcff2fbb6878b4be0370d79859975368f1bdda05a31cb10f","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}