| Bridging Vision Foundation Model Priors with CLIP for Spatial-aware Few-shot Anomaly Detection in Medical Images added by Syntology |
2026-09 (from id) |
JuzhengMiao/Spatial-FAD/open_clip_SpatialFAD/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| Expert Knowledge-Guided Decision Calibration for Accurate Fine-Grained Tree Species Classification added by Syntology |
2026-01 (from id) |
WHU-USI3DV/TreeCLS/models/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| MedITok: A Unified Tokenizer for Medical Image Synthesis and Interpretation |
25 May 2025 |
masaaki-75/meditok/local_openclip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| GeoLangBind: Unifying Earth Observation with Agglomerative Vision-Language Foundation Models |
8 Mar 2025 |
xiong-zhitong/geolb-siglip/open_clip/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| Hidden in the Noise: Two-Stage Robust Watermarking for Images |
5 Dec 2024 |
Kasraarabi/Hidden-in-the-Noise/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| CorrCLIP: Reconstructing Correlations in CLIP with Off-the-Shelf Foundation Models for Open-Vocabulary Semantic Segmentation |
15 Nov 2024 |
zdk258/CorrCLIP/CorrCLIPv1/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| On Erroneous Agreements of CLIP Image Embeddings |
7 Nov 2024 |
lst627/CLIP-Embeds/open_clip/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| ROBIN: Robust and Invisible Watermarks for Diffusion Models with Adversarial Optimization |
6 Nov 2024 |
Hannah1102/ROBIN/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| What If the Input is Expanded in OOD Detection? |
24 Oct 2024 |
tmlr-group/CoVer/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| TULIP: Token-length Upgraded CLIP |
13 Oct 2024 |
ivonajdenkoska/tulip/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| SePPO: Semi-Policy Preference Optimization for Diffusion Alignment |
7 Oct 2024 |
dwanzhang-ai/seppo/utils/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| SegEarth-OV: Towards Training-Free Open-Vocabulary Segmentation for Remote Sensing Images |
2 Oct 2024 |
likyoo/SegEarth-OV/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| Embedding Geometries of Contrastive Language-Image Pre-Training |
19 Sep 2024 |
eify/open_clip/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| ECG-Chat: A Large ECG-Language Model for Cardiac Disease Diagnosis |
16 Aug 2024 |
YubaoZhao/ECG-Chat/open_clip/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| ProxyCLIP: Proxy Attention Improves CLIP for Open-Vocabulary Segmentation |
9 Aug 2024 |
mc-lan/proxyclip/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| VSSD: Vision Mamba with Non-Causal State Space Duality |
26 Jul 2024 |
YuHengsss/Trident/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| VideoEval: Comprehensive Benchmark Suite for Low-Cost Evaluation of Video Foundation Model |
9 Jul 2024 |
leexinhao/VideoEval/VidTAB_Zeroshot/eva_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| Vision Model Pre-training on Interleaved Image-Text Data via Latent Compression Learning |
11 Jun 2024 |
opengvlab/lcl/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs |
11 Jun 2024 |
damo-nlp-sg/inf-clip/inf_clip/models/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| Efficient Vision-Language Pre-training by Cluster Masking |
14 May 2024 |
zi-hao-wei/efficient-vision-language-pre-training-by-cluster-masking/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| PuLID: Pure and Lightning ID Customization via Contrastive Alignment |
24 Apr 2024 |
tothebeginning/pulid/eva_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| RingID: Rethinking Tree-Ring Watermarking for Enhanced Multi-Key Identification |
22 Apr 2024 |
showlab/ringid/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| FiLo: Zero-Shot Anomaly Detection by Fine-Grained Description and High-Quality Localization |
21 Apr 2024 |
casia-iva-lab/filo/models/vv_open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| PromptAD: Learning Prompts with only Normal Samples for Few-Shot Anomaly Detection |
8 Apr 2024 |
funz-0/promptad/PromptAD/CLIPAD/hf_model.py 2a377da4a76a2d44 |
unverified |
Unlicense (permissive) |
| Gaussian Shading: Provable Performance-Lossless Image Watermarking for Diffusion Models |
7 Apr 2024 |
bsmhmmlf/Gaussian-Shading/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| ViTamin: Designing Scalable Vision Models in the Vision-Language Era |
2 Apr 2024 |
beckschen/vitamin/ViTamin/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| DreamLIP: Language-Image Pre-training with Long Captions |
25 Mar 2024 |
zyf0619sjtu/DreamLIP/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
CC-BY-4.0 · pointer only |
| UrbanVLP: Multi-Granularity Vision-Language Pretraining for Urban Socioeconomic Indicator Prediction |
25 Mar 2024 |
citymind-lab/urbanvlp/open_clip_mine/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| Long-CLIP: Unlocking the Long-Text Capability of CLIP |
22 Mar 2024 |
beichenzbc/long-clip/open_clip_long/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| Toward Generalist Anomaly Detection via In-context Residual Learning with Few-shot Sample Prompts |
11 Mar 2024 |
mala-lab/WinCLIP/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
GPL-3.0 (copyleft) · pointer only |
| Open-Vocabulary SAM: Segment and Recognize Twenty-thousand Classes Interactively |
5 Jan 2024 |
harboryuan/ovsam/ext/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| SkyScript: A Large and Semantically Diverse Vision-Language Dataset for Remote Sensing |
20 Dec 2023 |
wangzhecheng/skyscript/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models |
4 Dec 2023 |
xunguangwang/instructta/EVA-CLIP/rei/eva_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| Diffusion Model Alignment Using Direct Preference Optimization |
21 Nov 2023 |
SalesforceAIResearch/DiffusionDPO/utils/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 recorded; this copy not marked cleared · pointer only |
| AnomalyCLIP: Object-agnostic Prompt Learning for Zero-shot Anomaly Detection |
29 Oct 2023 |
zqhang/WinCLIP-pytorch/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| CLIPSelf: Vision Transformer Distills Itself for Open-Vocabulary Dense Prediction |
2 Oct 2023 |
wusize/clipself/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| Understanding and Mitigating the Label Noise in Pre-training on Downstream Tasks |
29 Sep 2023 |
Hhhhhhao/Noisy-Model-Learning/open_clip/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| Bootstrap Fine-Grained Vision-Language Alignment for Unified Zero-Shot Anomaly Localization |
30 Aug 2023 |
hq-deng/AnoVL/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| CLIP-KD: An Empirical Study of CLIP Model Distillation |
24 Jul 2023 |
winycg/clip-kd/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
no licence file found · pointer only |
| APRIL-GAN: A Zero-/Few-Shot Anomaly Classification and Segmentation Method for CVPR 2023 VAND Workshop Challenge Tracks 1&2: 1st Place on Zero-shot AD and 4th Place on Few-shot AD |
27 May 2023 |
bychelsea/vand-april-gan/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| An Inverse Scaling Law for CLIP Training |
11 May 2023 |
UCSC-VLAA/CLIPA/clipa_torch/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
Apache-2.0 (permissive) |
| WinCLIP: Zero-/Few-Shot Anomaly Classification and Segmentation |
26 Mar 2023 |
caoyunkang/WinClip/WinCLIP/CLIPAD/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| Hard Prompts Made Easy: Gradient-Based Discrete Optimization for Prompt Tuning and Discovery |
7 Feb 2023 |
YuxinWenRick/hard-prompts-made-easy/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| Learning Customized Visual Models with Retrieval-Augmented Knowledge |
17 Jan 2023 |
microsoft/react/react_customization/src/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| arXiv:Ma_ReMP-AD_Retrieval-enhanced_Multi-modal_Prompt_Fusion_for_Few-Shot_Industrial_Visual_Anomaly_ICCV_2025_paper |
|
cshcma/ReMP-AD/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |
| arXiv:Hertz_Style_Aligned_Image_Generation_via_Shared_Attention_CVPR_2024_paper |
|
aim-uofa/StyleDrop-PyTorch/open_clip/hf_model.py 2a377da4a76a2d44 |
unverified |
MIT (permissive) |