Pinned Loading
-
-
CLIP-fine-tune-cross-attention-read-noread
CLIP-fine-tune-cross-attention-read-noread PublicA cross-attention bridge for CLIP, to read OR ignore text in images on-demand. For typographic attack robustness or deliberately leveraging CLIP's 'OCR-like' text-reading capabilities.
Python
-
VITAL-CLIP-class-concept-visualization
VITAL-CLIP-class-concept-visualization PublicCLIP class/concept/facet/inner neuron visualization (CNN and ViT); plus: king-man+woman=queen in Vision Transformers
Python 1
-
CLIP-fine-tune-registers-gated
CLIP-fine-tune-registers-gated PublicVision Transformers Needs Registers. And Gated MLPs. And +20M params. Tiny modality gap ensues!
-
Long-CLIP
Long-CLIP PublicForked from beichenzbc/Long-CLIP
Scripts for use with LongCLIP, including fine-tuning Long-CLIP
-
CLIP-ViT-visualization
CLIP-ViT-visualization PublicWhat do CLIP Vision Transformers learn? Feature Visualization can show you!
If the problem persists, check the GitHub status page or contact support.

