Upload pretrained SSL4EM encoders
Browse files- 4dstem/dinov2_domain/config.json +13 -0
- 4dstem/dinov2_domain/encoder.pt +3 -0
- 4dstem/dinov2_original/config.json +13 -0
- 4dstem/dinov2_original/encoder.pt +3 -0
- 4dstem/ijepa_domain/config.json +13 -0
- 4dstem/ijepa_domain/encoder.pt +3 -0
- 4dstem/ijepa_original/config.json +13 -0
- 4dstem/ijepa_original/encoder.pt +3 -0
- 4dstem/mae_domain/config.json +13 -0
- 4dstem/mae_domain/encoder.pt +3 -0
- 4dstem/mae_original/config.json +13 -0
- 4dstem/mae_original/encoder.pt +3 -0
- 4dstem/simclr_domain/config.json +13 -0
- 4dstem/simclr_domain/encoder.pt +3 -0
- 4dstem/simclr_original/config.json +13 -0
- 4dstem/simclr_original/encoder.pt +3 -0
- 4dstem/vicregl_domain/config.json +13 -0
- 4dstem/vicregl_domain/encoder.pt +3 -0
- 4dstem/vicregl_original/config.json +13 -0
- 4dstem/vicregl_original/encoder.pt +3 -0
- README.md +110 -0
- cem500k/dinov2_domain/config.json +13 -0
- cem500k/dinov2_domain/encoder.pt +3 -0
- cem500k/dinov2_original/config.json +13 -0
- cem500k/dinov2_original/encoder.pt +3 -0
- cem500k/ijepa_domain/config.json +13 -0
- cem500k/ijepa_domain/encoder.pt +3 -0
- cem500k/ijepa_original/config.json +13 -0
- cem500k/ijepa_original/encoder.pt +3 -0
- cem500k/mae_domain/config.json +13 -0
- cem500k/mae_domain/encoder.pt +3 -0
- cem500k/mae_original/config.json +13 -0
- cem500k/mae_original/encoder.pt +3 -0
- cem500k/simclr_domain/config.json +13 -0
- cem500k/simclr_domain/encoder.pt +3 -0
- cem500k/simclr_original/config.json +13 -0
- cem500k/simclr_original/encoder.pt +3 -0
- cem500k/vicregl_domain/config.json +13 -0
- cem500k/vicregl_domain/encoder.pt +3 -0
- cem500k/vicregl_original/config.json +13 -0
- cem500k/vicregl_original/encoder.pt +3 -0
4dstem/dinov2_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "dinov2",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/dinov2_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:0d82ba4de4bac9644d3ea99f4e4b4e7ea5a88ce52d06e39ac2adee0206c437d0
|
| 3 |
+
size 341673235
|
4dstem/dinov2_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "dinov2",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/dinov2_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:9f3610166c45cb292009b8695e2f48ee1f39370c28d81f5371f4ab55622c4892
|
| 3 |
+
size 341673235
|
4dstem/ijepa_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "ijepa",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/ijepa_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:af57567a06e8c117008e89efe2900bab8d8f12601ff246a1e6d7c71818c85a5a
|
| 3 |
+
size 341673235
|
4dstem/ijepa_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "ijepa",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/ijepa_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:a3dce8753b4ca20aa7a32f0c23d7520cd1aad44f24b61cf545d91780cf99a7f1
|
| 3 |
+
size 341673235
|
4dstem/mae_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "mae",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/mae_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:c303bf67a9dcec77824cb866db2fe242c7575860bd599d83768c8abd991d6a1b
|
| 3 |
+
size 341673235
|
4dstem/mae_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "mae",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/mae_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:29bbc2e1e773bc8d5a8ff866211f868210b8cc72bb97e09d3d9a60be7c2f99d5
|
| 3 |
+
size 341673235
|
4dstem/simclr_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "simclr",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/simclr_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:8f78a1033646df7b7e6173bdf1ad1a999b620800bc8186e6626995e7aeb2d4a7
|
| 3 |
+
size 341673235
|
4dstem/simclr_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "simclr",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/simclr_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:61937faf15f525fb36da0a0cceca8587c1a240fa7f216245060c70aaee6b295d
|
| 3 |
+
size 341673235
|
4dstem/vicregl_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "vicregl",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/vicregl_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:fce8be01480a550526e3adad270665164520df6e79dd0d291164c21c0e0fb83c
|
| 3 |
+
size 341673235
|
4dstem/vicregl_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 224,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "vicregl",
|
| 10 |
+
"pretrain_dataset": "4dstem",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
4dstem/vicregl_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7552dcbc2ea08baa41988cdbe3e645afc051a28d6add849b7076d6c0537ef938
|
| 3 |
+
size 341673235
|
README.md
ADDED
|
@@ -0,0 +1,110 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
---
|
| 2 |
+
license: mit
|
| 3 |
+
library_name: pytorch
|
| 4 |
+
pipeline_tag: image-feature-extraction
|
| 5 |
+
tags:
|
| 6 |
+
- self-supervised-learning
|
| 7 |
+
- electron-microscopy
|
| 8 |
+
- 4d-stem
|
| 9 |
+
- scientific-imaging
|
| 10 |
+
- dinov2
|
| 11 |
+
- mae
|
| 12 |
+
- simclr
|
| 13 |
+
- vicregl
|
| 14 |
+
- i-jepa
|
| 15 |
+
---
|
| 16 |
+
|
| 17 |
+
# Physics-Aligned Self-Supervised Learning for Scientific Imaging
|
| 18 |
+
|
| 19 |
+
Pretrained ViT-B encoders from the GCPR 2026 paper
|
| 20 |
+
*Physics-Aligned Self-Supervised Learning for Scientific Imaging*.
|
| 21 |
+
|
| 22 |
+
Five SSL methods (DINOv2, I-JEPA, MAE, SimCLR, VICRegL) were each pretrained
|
| 23 |
+
on two electron-microscopy modalities under two augmentation regimes:
|
| 24 |
+
|
| 25 |
+
- **`*_domain`** — physics-aligned augmentations (T_phys): measurement-consistent
|
| 26 |
+
symmetries plus acquisition-driven perturbations (noise, intensity variation,
|
| 27 |
+
reciprocal-space scaling, diffraction tilt, ...).
|
| 28 |
+
- **`*_original`** — standard natural-image augmentations (T_orig): random crop,
|
| 29 |
+
horizontal flip, blur, photometric perturbations.
|
| 30 |
+
|
| 31 |
+
Pretraining data:
|
| 32 |
+
|
| 33 |
+
- **`cem500k/`** — real-space cellular EM ([CEM500K](https://doi.org/10.7554/eLife.65894) subset, 10k images).
|
| 34 |
+
- **`4dstem/`** — simulated LiNiO2 4D-STEM diffraction patterns
|
| 35 |
+
([Scheunert et al.](https://doi.org/10.5281/zenodo.17360572) subset, 10k patterns).
|
| 36 |
+
|
| 37 |
+
All encoders are single-channel (grayscale) ViT-B backbones.
|
| 38 |
+
|
| 39 |
+
## Available models
|
| 40 |
+
|
| 41 |
+
| Path | Method | Pretraining data | Augmentations |
|
| 42 |
+
|---|---|---|---|
|
| 43 |
+
| `cem500k/dinov2_domain` | dinov2 | cem500k | physics-aligned |
|
| 44 |
+
| `cem500k/dinov2_original` | dinov2 | cem500k | natural-image |
|
| 45 |
+
| `cem500k/ijepa_domain` | ijepa | cem500k | physics-aligned |
|
| 46 |
+
| `cem500k/ijepa_original` | ijepa | cem500k | natural-image |
|
| 47 |
+
| `cem500k/mae_domain` | MAE | cem500k | physics-aligned |
|
| 48 |
+
| `cem500k/mae_original` | MAE | cem500k | natural-image |
|
| 49 |
+
| `cem500k/simclr_domain` | simclr | cem500k | physics-aligned |
|
| 50 |
+
| `cem500k/simclr_original` | simclr | cem500k | natural-image |
|
| 51 |
+
| `cem500k/vicregl_domain` | vicregl | cem500k | physics-aligned |
|
| 52 |
+
| `cem500k/vicregl_original` | vicregl | cem500k | natural-image |
|
| 53 |
+
| `4dstem/dinov2_domain` | dinov2 | 4dstem | physics-aligned |
|
| 54 |
+
| `4dstem/dinov2_original` | dinov2 | 4dstem | natural-image |
|
| 55 |
+
| `4dstem/ijepa_domain` | ijepa | 4dstem | physics-aligned |
|
| 56 |
+
| `4dstem/ijepa_original` | ijepa | 4dstem | natural-image |
|
| 57 |
+
| `4dstem/mae_domain` | MAE | 4dstem | physics-aligned |
|
| 58 |
+
| `4dstem/mae_original` | MAE | 4dstem | natural-image |
|
| 59 |
+
| `4dstem/simclr_domain` | simclr | 4dstem | physics-aligned |
|
| 60 |
+
| `4dstem/simclr_original` | simclr | 4dstem | natural-image |
|
| 61 |
+
| `4dstem/vicregl_domain` | vicregl | 4dstem | physics-aligned |
|
| 62 |
+
| `4dstem/vicregl_original` | vicregl | 4dstem | natural-image |
|
| 63 |
+
|
| 64 |
+
## Usage
|
| 65 |
+
|
| 66 |
+
With the accompanying code (https://github.com/DL4EM/physics-aligned-ssl):
|
| 67 |
+
|
| 68 |
+
```python
|
| 69 |
+
from em_ssl.hub import load_encoder
|
| 70 |
+
|
| 71 |
+
encoder = load_encoder("cem500k/dinov2_domain", repo_id="DL4EM/physics-aligned-ssl")
|
| 72 |
+
|
| 73 |
+
import torch
|
| 74 |
+
images = torch.randn(4, 1, 128, 128) # grayscale EM crops in [0, 1]
|
| 75 |
+
features = encoder(images)
|
| 76 |
+
```
|
| 77 |
+
|
| 78 |
+
Without the codebase, each `encoder.pt` is a plain PyTorch checkpoint:
|
| 79 |
+
|
| 80 |
+
```python
|
| 81 |
+
import torch
|
| 82 |
+
from huggingface_hub import hf_hub_download
|
| 83 |
+
|
| 84 |
+
path = hf_hub_download("DL4EM/physics-aligned-ssl", "cem500k/dinov2_domain/encoder.pt")
|
| 85 |
+
ckpt = torch.load(path, map_location="cpu", weights_only=True)
|
| 86 |
+
state_dict = ckpt["encoder_state_dict"] # ViT-B weights
|
| 87 |
+
print(ckpt["backbone"], ckpt["backbone_kwargs"])
|
| 88 |
+
```
|
| 89 |
+
|
| 90 |
+
Inputs are single-channel images normalised to [0, 1] (percentile
|
| 91 |
+
normalisation was used during pretraining). Real-space EM models were trained
|
| 92 |
+
on 128x128 crops; 4D-STEM models on 224x224 crops.
|
| 93 |
+
|
| 94 |
+
## Citation
|
| 95 |
+
|
| 96 |
+
```bibtex
|
| 97 |
+
@inproceedings{kazimi2026physicsaligned,
|
| 98 |
+
title = {Physics-Aligned Self-Supervised Learning for Scientific Imaging},
|
| 99 |
+
author = {Kazimi, Bashir and Sandfeld, Stefan},
|
| 100 |
+
booktitle = {DAGM German Conference on Pattern Recognition (GCPR)},
|
| 101 |
+
year = {2026}
|
| 102 |
+
}
|
| 103 |
+
```
|
| 104 |
+
|
| 105 |
+
## About
|
| 106 |
+
|
| 107 |
+
Developed by the [Deep Learning for Electron Microscopy (DL4EM)](https://www.fz-juelich.de/en/ias/ias-9/research/deep-learning-for-electron-microscopy)
|
| 108 |
+
group at the [Institute for Materials Data Science and Informatics (IAS-9)](https://www.fz-juelich.de/en/ias/ias-9),
|
| 109 |
+
Forschungszentrum Jülich. For questions, please open an issue on the
|
| 110 |
+
[GitHub repository](https://github.com/DL4EM/physics-aligned-ssl).
|
cem500k/dinov2_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "dinov2",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/dinov2_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:bb63bbfcedf1cde172f4803705908495bbbe5d2efc79bcef43063ea60f759ce7
|
| 3 |
+
size 341267731
|
cem500k/dinov2_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "dinov2",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/dinov2_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:9b22e9f60f6cf4c0f879737b6a54bdd800c926e6f966e4d4b334319049c9b110
|
| 3 |
+
size 341267731
|
cem500k/ijepa_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 8,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "ijepa",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/ijepa_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:e381214596bdf96fc0ba8eff4f56194cc55ca75f4283668aa7b8b4d9acbc8d66
|
| 3 |
+
size 341267731
|
cem500k/ijepa_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 8,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "ijepa",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/ijepa_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:d244356597d545afc4a10a90219ac4fc8b8352cba72641483e497a6847ce862b
|
| 3 |
+
size 341267731
|
cem500k/mae_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "mae",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/mae_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:90696236832e3074e4ca7b12fe15e0300c6f7a2fb85bb98fcdcfb6aae4e1b08d
|
| 3 |
+
size 341267731
|
cem500k/mae_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "mae",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/mae_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:26142cf7fae04a8d908c7aeae29c1ecd25de5ec8cb0f625e0d56a53d70e22fe6
|
| 3 |
+
size 341267731
|
cem500k/simclr_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "simclr",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/simclr_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:f23081d72c85667552e2daa390ff97d1720ff5444c3e488e076ac5756f362db9
|
| 3 |
+
size 341267731
|
cem500k/simclr_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "simclr",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/simclr_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:7fce96ffb7a87cf605bc4c1675ba5c40922ff70be54e470238005580982daff3
|
| 3 |
+
size 341267731
|
cem500k/vicregl_domain/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "vicregl",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "physics-aligned",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/vicregl_domain/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:4f5097420a0d97858d786850369b17ffa0dc054bae282ff1f71287e1e707d4cf
|
| 3 |
+
size 341267731
|
cem500k/vicregl_original/config.json
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"backbone": "vit_base_em",
|
| 3 |
+
"in_channels": 1,
|
| 4 |
+
"backbone_kwargs": {
|
| 5 |
+
"img_size": 128,
|
| 6 |
+
"patch_size": 16,
|
| 7 |
+
"drop_rate": 0.0
|
| 8 |
+
},
|
| 9 |
+
"method": "vicregl",
|
| 10 |
+
"pretrain_dataset": "cem500k",
|
| 11 |
+
"augmentations": "natural-image",
|
| 12 |
+
"epoch": 299
|
| 13 |
+
}
|
cem500k/vicregl_original/encoder.pt
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:6601446f639cdaff8a773148229076dbe5956278d150771df48eec3406b3828d
|
| 3 |
+
size 341267731
|