| LLM-Enhanced Dual-Branch Learning for Large-Scale Multi-Label Text Classification added by Syntology |
2026-09 (from id) |
huiyegit/DualMLC/model.py 42b780b0164fc3f2 |
unverified |
Apache-2.0 (permissive) |
| Physics-Guided Synthetic High-Frequency Ultrasound Generation for Skin Layer Segmentation added by Syntology |
2026-09 (from id) |
Finn-02/synthetic-hfus-skin-layer-segmentation/code/segablation/models.py 082747798cfb4ac6 |
unverified |
no licence file found · pointer only |
| Learning Symbolic Constraint Representations from Examples: A Neuro-Symbolic Approach added by Syntology |
2026-09 (from id) |
NassimBelmecheri/TRAC/trac/model.py ddffce9a54db46fa |
unverified |
no licence file found · pointer only |
| TAME: Temporal-Aware Mixture-of-Experts for Text-Video Retrieval added by Syntology |
2026-09 (from id) |
sejong-rcv/TAME/modules/module_clip_moe_TAME.py 2e509d5fd4f1f3fb |
unverified |
no licence file found · pointer only |
| Cost-efficient Active Learning for Referring Image Segmentation and Grounding added by Syntology |
2026-08 (from id) |
junbum766/ALRIS/model/clip_detris.py fd39a00b70046a6a |
unverified |
no licence file found · pointer only |
| RelShap: Relationally Consistent Shapley Explanations added by Syntology |
2026-08 (from id) |
duneag2/relshap/models.py f82e4128c4274d2c |
unverified |
no licence file found · pointer only |
| The Evaluation Protocol Determines the Result: An Independent Reproduction of LeWorldModel on TwoRoom added by Syntology |
2026-08 (from id) |
joyjeet-singh/tinylab/models.py 359387c181b9f34d |
ran
|
no licence file found · pointer only |
| CARPRT: Class-Aware Zero-Shot Prompt Reweighting for Black-Box Vision-Language Models added by Syntology |
2026-07 (from id) |
tmlr-group/CARPRT/clip/model.py f3830274a7e18d5e |
unverified |
no licence file found · pointer only |
| SAF3R: Dynamic Sparse Attention for Feed-Forward 3D Reconstruction Transformers added by Syntology |
2026-07 (from id) |
jndeng/SAF3R/saf3r/utils/model_utils.py 25c975b9fde6e203 |
unverified |
no licence file found · pointer only |
| Concept-Constrained Prompt Learning for Few-Shot CLIP Adaptation added by Syntology |
2026-06 (from id) |
richael-sang/concept-constrained-prompt-learning/clip/model.py 48ac2bd4dcbfb717 |
unverified |
MIT (permissive) |
| TS-Fault: Benchmarking Time Series Forecasters Against Structural Faults added by Syntology |
2026-06 (from id) |
Ray-zyy/TS-Fault/foundation_models.py 1b41aac98d371f93 |
unverified |
no licence file found · pointer only |
| Federated Foundation Models over Vehicular Networks added by Syntology |
2026-06 (from id) |
KasraBorazjani/vehicular-fedfm/clip/model.py 1c568604200ae60d |
unverified |
MIT (permissive) |
| Federated Foundation Models over Vehicular Networks added by Syntology |
2026-06 (from id) |
KasraBorazjani/vehicular-fedfm/clip/model_old.py a749dbcaeea34ff8 |
unverified |
MIT (permissive) |
| Eigenvectors of Experts are Training-free Non-collapsing Routers added by Syntology |
2026-05 (from id) |
giangdip2410/SSMoE/SSMoE/Vision/CLIP-SSMoE/clipmoe/model_clipmoe.py 640bc7cbe2f90309 |
unverified |
no licence file found · pointer only |
| TRACER: Persistent Regularization for Robust Multimodal Finetuning added by Syntology |
2026-05 (from id) |
HesamAsad/TRACER/clip/model.py b64f67bec6a093b9 |
unverified |
no licence file found · pointer only |
| Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening added by Syntology |
2026-05 (from id) |
Durjoy001/Retinal-NeuralNET/src/train_cnn.py 9a15b6f14e5e71e6 |
unverified |
MIT (permissive) |
| Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening added by Syntology |
2026-05 (from id) |
Durjoy001/Retinal-NeuralNET/src/train_hybrid.py a4dfe1619a248e9e |
unverified |
MIT (permissive) |
| Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening added by Syntology |
2026-05 (from id) |
Durjoy001/Retinal-NeuralNET/src/train_vit.py 8ba2159b6ca06dd7 |
unverified |
MIT (permissive) |
| Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening added by Syntology |
2026-05 (from id) |
Durjoy001/Retinal-NeuralNET/misc/train_cnn_final.py 4e4ae5a8d5f164fd |
unverified |
MIT (permissive) |
| Benchmarking Convolutional, Transformer, Hybrid, and Vision Language Models for Multi Disease Retinal Screening added by Syntology |
2026-05 (from id) |
Durjoy001/Retinal-NeuralNET/misc/train_vit_update.py c393ea4a983d138f |
unverified |
MIT (permissive) |
| Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models added by Syntology |
2026-05 (from id) |
SEU-VIPGroup/A-TPT/clip/model.py ce030f573ae70489 |
unverified |
no licence file found · pointer only |
| SWORDBENCH: Evaluating Orthogonality of Steering Image Representations added by Syntology |
2026-05 (from id) |
openai/CLIP/clip/model.py 39e6b23b55f376ea |
unverified |
MIT (permissive) |
| Neutral-Reference Prompting for Vision-Language Models added by Syntology |
2026-05 (from id) |
Sheldon04/NeRP/clip/model.py c47aa9e5b049a11d |
unverified |
no licence file found · pointer only |
| A Resilient Solution for Sewer Overflow Monitoring Across Cloud and Edge added by Syntology |
2026-05 (from id) |
tianheng-ling/EdgeOverflowForecast/models/build_model.py f5f7fe9cfdcd1eaf |
unverified |
Unlicense (permissive) |
| Key Coverage Matters: Semi-Structured Extraction of OCR Clinical Reports added by Syntology |
2026-05 (from id) |
AI-Starfish-Research/Key-Coverage-Matters/src/pre_struct/ebqa/train_ebqa.py 283837acd110a1b7 |
unverified |
no licence file found · pointer only |
| Fine-Tuning Impairs the Balancedness of Foundation Models in Long-tailed Personalized Federated Learning added by Syntology |
2026-05 (from id) |
shihaohou/FedPuReL/clip/model.py 0d784ed171f1c8af |
unverified |
no licence file found · pointer only |
| Sentiment and Emotion Classification of Indonesian E-Commerce Reviews via Multi-Task BiLSTM and AutoML Benchmarking added by Syntology |
2026-04 (from id) |
ikii-sd/pba2026-crazyrichteam/src/model.py b79931a1936e4453 |
unverified |
no licence file found · pointer only |
| Information-Theoretic Optimization for Task-Adapted Compressed Sensing Magnetic Resonance Imaging added by Syntology |
2026-04 (from id) |
tianweiy/SeqMRI/activemri/baselines/non_rl.py b5a9e50c6853a306 |
unverified |
MIT (permissive) |
| Enhance-then-Balance Modality Collaboration for Robust Multimodal Sentiment Analysis added by Syntology |
2026-04 (from id) |
kangverse/EBMC/EBMC/ebmc.py 608efde149a58adf |
unverified |
licence not identified · pointer only |
| Automated Detection of Multiple Sclerosis Lesions on 7-tesla MRI Using U-net and Transformer-based Segmentation added by Syntology |
2026-04 (from id) |
maynord/7T-MS-lesion-segmentation/load_segformer.py 38f42f1866d0f337 |
unverified |
no licence file found · pointer only |
| BLOSSOM: Block-wise Federated Learning Over Shared and Sparse Observed Modalities added by Syntology |
2026-03 (from id) |
DaSH-Lab-CSIS/blossom/blossom/models.py f97478f4b7adb5d4 |
unverified |
MIT (permissive) |
| Unlocking Few-Shot Capabilities in LVLMs via Prompt Conditioning and Head Selection added by Syntology |
2026-03 (from id) |
gaopengcuhk/Tip-Adapter/clip/model.py f3830274a7e18d5e |
unverified |
no licence file found · pointer only |
| Less Data, Faster Convergence: Goal-Driven Data Optimization for Multimodal Instruction Tuning added by Syntology |
2026-03 (from id) |
rujiewu/GDO/gdo/extract_six_metrics.py 70149d03ea2ec0e9 |
unverified |
MIT (permissive) |
| Exhaustive Circuit Mapping of a Single-Cell Foundation Model Reveals Massive Redundancy, Heavy-Tailed Hub Architecture, and Layer-Dependent Differentiation Control added by Syntology |
2026-03 (from id) |
Biodyn-AI/sae-biological-map/src/revision/p1a_retrace_with_deltas.py 9242b130d7b1594b |
unverified |
MIT (permissive) |
| Relational In-Context Learning via Synthetic Pre-training with Structural Prior added by Syntology |
2026-03 (from id) |
MuLabPKU/RDBPFN/inference/src/model.py a1db0c571a63bb56 |
unverified |
no licence file found · pointer only |
| Meta-Learning Hyperparameters for Parameter Efficient Fine-Tuning added by Syntology |
2026-03 (from id) |
doem97/metalora/clip/model.py bd228a615e42622e |
unverified |
Apache-2.0 (permissive) |
| MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation ⋆ added by Syntology |
24 Feb 2026 |
sajjad-ucsb/MMLoP/clip/model.py 658e2151cc86a71c |
unverified |
no licence file found · pointer only |
| Training-Free Adaptation of Diffusion Models via Doob's h-Transform added by Syntology |
2026-02 (from id) |
liamyzq/Doob_training_free_adaptation/search/doob_search.py 1e2b56744de208d8 |
unverified |
no licence file found · pointer only |
| Video-based Music Generation added by Syntology |
2026-02 (from id) |
serkansulun/emsync/midi/src/midi_model.py 3fe06f3d52eeff49 |
unverified |
licence not identified · pointer only |
| FiLoRA: Focus-and-Ignore LoRA for Controllable Feature Reliance added by Syntology |
2026-02 (from id) |
AndreyGuzhov/AudioCLIP/model/clip/model.py 265cc70439b93cda |
unverified |
MIT (permissive) |
| Modeling Image-Caption Rating from Comparative Judgments added by Syntology |
2026-02 (from id) |
hil-se/comparative_image_caption/src/compare.py 218ea173a82c8673 |
unverified |
no licence file found · pointer only |
| Modeling Image-Caption Rating from Comparative Judgments added by Syntology |
2026-02 (from id) |
hil-se/comparative_image_caption/src/regression.py 5a6f66fcafdca8ac |
unverified |
no licence file found · pointer only |
| C3Box: A CLIP-based Class-Incremental Learning Toolbox added by Syntology |
2026-01 (from id) |
LAMDA-CL/C3Box/backbone/codaprompt_model.py 3b756d1614489d7d |
unverified |
MIT (permissive) |
| C3Box: A CLIP-based Class-Incremental Learning Toolbox added by Syntology |
2026-01 (from id) |
LAMDA-CL/C3Box/backbone/ease_model.py fae6565b756a39c6 |
unverified |
MIT (permissive) |
| C3Box: A CLIP-based Class-Incremental Learning Toolbox added by Syntology |
2026-01 (from id) |
LAMDA-CL/C3Box/backbone/tuna_model.py 9654e4aa6dd62c4d |
unverified |
MIT (permissive) |
| Bi-modal Textual Prompt Learning for Vision-language Models in Remote Sensing added by Syntology |
2026-01 (from id) |
ipankhi/BiMoRS/clip/model.py 6f837ffa4cbd5ff1 |
unverified |
no licence file found · pointer only |
| Bi-modal Textual Prompt Learning for Vision-language Models in Remote Sensing added by Syntology |
2026-01 (from id) |
ipankhi/BiMoRS/clip/.ipynb_checkpoints/model-checkpoint.py 5e864d56213cb347 |
unverified |
no licence file found · pointer only |
| Bi-modal Textual Prompt Learning for Vision-language Models in Remote Sensing added by Syntology |
2026-01 (from id) |
ipankhi/BiMoRS/clip/.ipynb_checkpoints/model_mod_cls-checkpoint.py 455489a9c18a4e47 |
unverified |
no licence file found · pointer only |
| Why Can't I Open My Drawer? Mitigating Object-Driven Shortcuts in Zero-Shot Compositional Action Recognition added by Syntology |
2026-01 (from id) |
KHU-VLL/RCORE/custom_clip/model.py 58149cc1cfb6b50c |
unverified |
licence not identified · pointer only |
| MVGD-Net: A Novel Motion-aware Video Glass Surface Detection Method added by Syntology |
2026-01 (from id) |
YT3DVision/MVGDNet/swinv2/build.py aacc86165a54d602 |
unverified |
no licence file found · pointer only |
| MERGETUNE: Continued fine-tuning of vision-language models added by Syntology |
2026-01 (from id) |
Surrey-UP-Lab/MERGETUNE/mergetune/clip/model.py 2b1b5aeb8f09297c |
unverified |
no licence file found · pointer only |
| Eliminating Inductive Bias in Reward Models with Information-Theoretic Guidance added by Syntology |
2025-12 (from id) |
Qwen-Applications/DIR/rm_eval/eval_biasbench.py 629048a34404782d |
unverified |
Apache-2.0 (permissive) |
| Open Ad-hoc Categorization with Contextualized Feature Learning added by Syntology |
2025-12 (from id) |
Wayne2Wang/OAK/src/models/clip/model.py 39e6b23b55f376ea |
unverified |
MIT (permissive) |
| Calibrating Uncertainty for Zero-Shot Adversarial CLIP added by Syntology |
2025-12 (from id) |
VivienLu/UCAT/replace/model.py a25e1e252d00d120 |
unverified |
no licence file found · pointer only |
| Sunac: Source-Aware Unified Neural Audio Codec added by Syntology |
2025-11 (from id) |
merlresearch/unified-source-separation/nets/model_wrapper.py ab0e0708736551bd |
unverified |
AGPL-3.0 (copyleft) · pointer only |
| TOMCAT : Test-time Comprehensive Knowledge Accumulation for Compositional Zero-Shot Learning added by Syntology |
2025-10 (from id) |
xud-yan/TOMCAT/model/tomcat_bm.py a1348e10527ad6fa |
unverified |
MIT (permissive) |
| Revisiting Logit Distributions for Reliable Out-of-Distribution Detection added by Syntology |
2025-10 (from id) |
GIT-LJc/LogitGap/clip/model.py aa56b568a90f8516 |
unverified |
no licence file found · pointer only |
| Cooperative Pseudo Labeling for Unsupervised Federated Classification added by Syntology |
2025-10 (from id) |
krumpguo/FedCoPL/clip/model.py 39e6b23b55f376ea |
unverified |
no licence file found · pointer only |
| Object-Centric Representation Learning for Enhanced 3D Semantic Scene Graph Prediction added by Syntology |
2025-10 (from id) |
VisualScienceLab-KHU/OCRL-3DSSG-Codes/clip_adapter/clip/model.py 0b01acb5bc3f8968 |
unverified |
no licence file found · pointer only |
| Training Deep Normalization-Free Spiking Neural Networks with Lateral Inhibition added by Syntology |
2025-09 (from id) |
vwOvOwv/DeepEISNN/models/factory.py 97b03a7b44045352 |
unverified |
no licence file found · pointer only |
| humancompatible.train: Implementing Optimization Algorithms for Stochastically-Constrained Stochastic Optimization Problems added by Syntology |
2025-09 (from id) |
humancompatible/train/tiny_image_net.py ffc644405a8bb696 |
unverified |
Apache-2.0 (permissive) |
| Iterative Prompt Refinement for Safer Text-to-Image Generation added by Syntology |
2025-09 (from id) |
ku-dmlab/IPR/clip/model.py 39e6b23b55f376ea |
unverified |
Apache-2.0 (permissive) |
| Customizing the Inductive Biases of Softmax Attention using Structured Matrices added by Syntology |
2025-09 (from id) |
YilunKuang/structured-attention/in_context_regression/models.py d9639c68861b1f12 |
unverified |
Apache-2.0 (permissive) |
| Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens added by Syntology |
2025-08 (from id) |
ChengshuaiZhao0/DataAlchemy/src/models.py 28c6cf908efdbaf6 |
unverified |
MIT (permissive) |
| arXiv:2507.15480 |
2025-07 (from id) |
khufia/RAda/eft/clip/maple_model.py 48ac2bd4dcbfb717 |
unverified |
no licence file found · pointer only |
| arXiv:2507.15480 |
2025-07 (from id) |
khufia/RAda/eft/clip/model.py 39e6b23b55f376ea |
unverified |
no licence file found · pointer only |
| Hierarchical Cross-modal Prompt Learning for Vision-Language Models |
20 Jul 2025 |
zzeoZheng/HiCroPL/clip/model.py 787d36caf7777994 |
unverified |
licence not identified · pointer only |
| Addressing Imbalanced Domain-Incremental Learning through Dual-Balance Collaborative Experts |
9 Jul 2025 |
Lain810/DCE/models/clip/model.py 59ef8345feead1c6 |
unverified |
licence not identified · pointer only |
| LIRA: Inferring Segmentation in Large Multi-modal Models with Local Interleaved Region Assistance |
8 Jul 2025 |
echo840/LIRA/xtuner/apis/model.py dcdc7ef233f3e1e8 |
unverified |
no licence file found · pointer only |
| pFedMMA: Personalized Federated Fine-Tuning with Multi-Modal Adapter for Vision-Language Models |
7 Jul 2025 |
sajjad-ucsb/pfedmma/clip/model.py 16e4a4653cfc7ce3 |
unverified |
no licence file found · pointer only |
| FA: Forced Prompt Learning of Vision-Language Models for Out-of-Distribution Detection |
6 Jul 2025 |
0xFAFA/FA/clip/model_origin.py f3830274a7e18d5e |
unverified |
no licence file found · pointer only |
| FA: Forced Prompt Learning of Vision-Language Models for Out-of-Distribution Detection |
6 Jul 2025 |
0xFAFA/FA/clip/model.py 3116a18e959b946d |
unverified |
no licence file found · pointer only |
| arXiv:2507.00721 |
2025-07 (from id) |
AMAP-ML/UPRE/clip/model.py 58d897b93de64279 |
unverified |
no licence file found · pointer only |
| arXiv:2506.23502 |
2025-06 (from id) |
Mengxiao-Tian/LAMP/clip/model.py fc48e485e5a826d4 |
unverified |
no licence file found · pointer only |
| SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes |
26 Jun 2025 |
yifanycc/sharpzo/clip/model.py 5b58ecca1df5fb53 |
unverified |
MIT (permissive) |
| SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging |
10 Jun 2025 |
nhatthanhtran/SEMA/models/build.py f0da8448e76e4d0e |
unverified |
MIT recorded; this copy not marked cleared · pointer only |
| Unleashing the Potential of Consistency Learning for Detecting and Grounding Multi-Modal Media Manipulation |
6 Jun 2025 |
liyih/CSCL/code/MultiModal-DeepFake-main/models/METER/clip_model.py 84631e1ece975f6b |
unverified |
MIT (permissive) |
| Counterfactual reasoning: an analysis of in-context emergence |
5 Jun 2025 |
moxmiller/counterfactual-reasoning/src/models.py 6dab71e46d7c02d7 |
unverified |
MIT (permissive) |
| Logic Gate Neural Networks are Good for Verification |
26 May 2025 |
HyberionBrew/difflogic_verify/utils/exp_setup.py af0f3880640daca0 |
unverified |
MIT (permissive) |
| Graceful Forgetting in Generative Language Models |
26 May 2025 |
rubickkcibur/LWF/trainLM_tools.py 7a2798b6dec9fdba |
unverified |
MIT (permissive) |
| arXiv:2505.17982 |
2025-05 (from id) |
bryanwong17/HiVE-MIL/clip/model.py 39e6b23b55f376ea |
unverified |
MIT (permissive) |
| VideoEval-Pro: Robust and Realistic Long Video Understanding Evaluation |
20 May 2025 |
opengvlab/internvideo2/xtuner-train_internvideo2_5/xtuner/apis/model.py dcdc7ef233f3e1e8 |
unverified |
MIT (permissive) |
| MSCI: Addressing CLIP's Inherent Limitations for Compositional Zero-Shot Learning |
15 May 2025 |
ltpwy/MSCI/MSCI/code/model/Mutifuse_new.py 76a940626d2d869d |
unverified |
no licence file found · pointer only |
| DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models |
17 Mar 2025 |
JREion/DPC/clip/model.py 1509c72699e83a57 |
unverified |
Apache-2.0 (permissive) |
| SCAP: Transductive Test-Time Adaptation via Supportive Clique-based Attribute Prompting |
17 Mar 2025 |
zhoujiahuan1991/CVPR2025-SCAP/clip/model.py aa56b568a90f8516 |
unverified |
Apache-2.0 (permissive) |
| When and How Does CLIP Enable Domain and Compositional Generalization? |
13 Feb 2025 |
neuroexplicit-saar/discover-then-name/clip/model.py 3662e54c46137680 |
unverified |
MIT (permissive) |
| A Benchmark and Evaluation for Real-World Out-of-Distribution Detection Using Vision-Language Models |
30 Jan 2025 |
hoshi23/ood-x-banchmarks/clip/model.py c47aa9e5b049a11d |
unverified |
MIT (permissive) |
| A Benchmark and Evaluation for Real-World Out-of-Distribution Detection Using Vision-Language Models |
30 Jan 2025 |
hoshi23/ood-x-banchmarks/clip_w_local/model.py dbbf313e1d3a69ba |
unverified |
MIT (permissive) |
| Dual-Modal Prototype Joint Learning for Compositional Zero-Shot Learning |
23 Jan 2025 |
codefish12-09/VP_CMJL/model/VP_CMJL.py 36577f417969caa7 |
unverified |
no licence file found · pointer only |
| Densely Connected Parameter-Efficient Tuning for Referring Image Segmentation |
15 Jan 2025 |
jiaqihuang01/detris/model/clip.py fd39a00b70046a6a |
unverified |
MIT (permissive) |
| NeuralSVG: An Implicit Representation for Text-to-Vector Generation |
7 Jan 2025 |
SagiPolaczek/NeuralSVG/CLIP_/clip/model.py 54a4f1da198cb291 |
unverified |
MIT (permissive) |
| Towards Visual Grounding: A Survey |
28 Dec 2024 |
linhuixiao/clip-vg/models/clip/model.py c9a8ee28fc96c79b |
unverified |
Apache-2.0 (permissive) |
| KALAHash: Knowledge-Anchored Low-Resource Adaptation for Deep Hashing |
27 Dec 2024 |
Tree-Shu-Zhao/KALAHash.pytorch/src/model/builder.py 5b455114fa92c532 |
unverified |
MIT (permissive) |
| Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves |
16 Dec 2024 |
koorye/skiptuning/clip/model.py c47aa9e5b049a11d |
unverified |
no licence file found · pointer only |
| Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves |
16 Dec 2024 |
koorye/skiptuning/clip_coprompt/model.py 918dfac560aed1c9 |
unverified |
no licence file found · pointer only |
| Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves |
16 Dec 2024 |
koorye/skiptuning/clip_maple/model.py c37b753b6072a78a |
unverified |
no licence file found · pointer only |
| Skip Tuning: Pre-trained Vision-Language Models are Effective and Efficient Adapters Themselves |
16 Dec 2024 |
koorye/skiptuning/clip_tcp/model.py 8c79ff33cfef4532 |
unverified |
no licence file found · pointer only |
| Enhance Vision-Language Alignment with Noise |
14 Dec 2024 |
hyzhang98/pini/clip/model.py 1bef19854cedd8ba |
unverified |
MIT (permissive) |
| ATPrompt: Textual Prompt Learning with Embedded Attributes |
12 Dec 2024 |
zhengli97/promptkd/clip/model.py c4b35ea23feab4ce |
unverified |
Apache-2.0 (permissive) |
| LAION-SG: An Enhanced Large-Scale Dataset for Training Complex Image-Text Models with Structural Annotations |
11 Dec 2024 |
yangling0818/sgdiff/sg_image_pretraining/clip/model.py 39e6b23b55f376ea |
unverified |
no licence file found · pointer only |
| Bridging the Divide: Reconsidering Softmax and Linear Attention |
9 Dec 2024 |
leaplabthu/inline/models/build.py aad933b3b81ff1a5 |
unverified |
no licence file found · pointer only |
| TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation |
4 Dec 2024 |
ByteFlow-AI/TokenFlow/tokenflow/tokenizer/clip/model.py beae755c2ed7e35a |
unverified |
Apache-2.0 (permissive) |
| NLPrompt: Noise-Label Prompt Learning for Vision-Language Models |
2 Dec 2024 |
qunovo/NLPrompt/clip/model.py fd9041fbaf4e48a4 |
unverified |
no licence file found · pointer only |
| Dual Risk Minimization: Towards Next-Level Robustness in Fine-tuning Zero-Shot Models |
29 Nov 2024 |
vaynexie/DRM/clip_m/model.py b64f67bec6a093b9 |
unverified |
no licence file found · pointer only |
| MARVEL-40M+: Multi-Level Visual Elaboration for High-Fidelity Text-to-3D Content Creation |
26 Nov 2024 |
SadilKhan/MARVEL-FX3D/pipeline/dis_image_background_removal.py c2d989e38cdb2be9 |
unverified |
MIT (permissive) |
| Self-Calibrated CLIP for Training-Free Open-Vocabulary Segmentation |
24 Nov 2024 |
sulebai/sc-clip/clip/model.py 59fa36e272aa8ab9 |
unverified |
MIT (permissive) |
| GMAI-VL & GMAI-VL-5.5M: A Large Vision-Language Model and A Comprehensive Multimodal Dataset Towards General Medical AI |
21 Nov 2024 |
uni-medical/gmai-vl/xtuner/apis/model.py dcdc7ef233f3e1e8 |
unverified |
Apache-2.0 (permissive) |
| Robust Fine-tuning of Zero-shot Models via Variance Reduction |
11 Nov 2024 |
BeierZhu/VRF/clip/model.py 4e1f6a9710dc6279 |
unverified |
no licence file found · pointer only |
| UMFC: Unsupervised Multi-Domain Feature Calibration for Vision-Language Models |
11 Nov 2024 |
GIT-LJc/UMFC/clip/model.py 3c6a360ce71fe4b6 |
unverified |
no licence file found · pointer only |
| Customized Multiple Clustering via Multi-Modal Subspace Proxy Learning |
6 Nov 2024 |
Alexander-Yao/Multi-Sub/clip/model.py 39e6b23b55f376ea |
unverified |
no licence file found · pointer only |
| Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection |
5 Nov 2024 |
tmlr-group/SCT/clip_w_local/model.py dbbf313e1d3a69ba |
unverified |
no licence file found · pointer only |
| B-cosification: Transforming Deep Neural Networks to be Inherently Interpretable |
1 Nov 2024 |
shrebox/b-cosification/CLIP/clip/model.py aedee70f1d728a60 |
unverified |
Apache-2.0 (permissive) |
| arXiv:2411.00409 |
2024-11 (from id) |
yusukekwn/Black-Box-Forgetting/clip/model.py 39e6b23b55f376ea |
unverified |
no licence file found · pointer only |
| Show Me What and Where has Changed? Question Answering and Grounding for Remote Sensing Change Detection |
31 Oct 2024 |
like413/vista/VisTA/model/clip.py d761a6dca9831c24 |
unverified |
licence not identified · pointer only |
| Text-Guided Attention is All You Need for Zero-Shot Robustness in Vision-Language Models |
29 Oct 2024 |
zhyblue424/TGA-ZSR/replace/model.py a25e1e252d00d120 |
unverified |
no licence file found · pointer only |
| Point-PRC: A Prompt Learning Based Regulation Framework for Generalizable Point Cloud Analysis |
27 Oct 2024 |
auniquesun/Point-PRC/clip/model.py 876171439d432604 |
unverified |
MIT (permissive) |