Upload SAE model weights, config, and training state
Browse files- README.md +5 -8
- config.json +4 -4
- model.safetensors +1 -1
- training_state.pt +2 -2
README.md
CHANGED
|
@@ -6,13 +6,10 @@ tags:
|
|
| 6 |
- Robotics
|
| 7 |
datasets:
|
| 8 |
- villekuosmanen/build_block_tower
|
| 9 |
-
- villekuosmanen/dAgger_build_block_tower_1.0.0
|
| 10 |
-
- villekuosmanen/dAgger_build_block_tower_1.1.0
|
| 11 |
-
- villekuosmanen/dAgger_build_block_tower_1.2.0
|
| 12 |
-
- villekuosmanen/dAgger_build_block_tower_1.3.0
|
| 13 |
-
- villekuosmanen/dAgger_build_block_tower_1.4.0
|
| 14 |
- villekuosmanen/fail_build_block_tower_stationary
|
| 15 |
-
- villekuosmanen/
|
|
|
|
|
|
|
| 16 |
library_name: physical-ai-interpretability
|
| 17 |
---
|
| 18 |
|
|
@@ -23,7 +20,7 @@ This model is a Sparse Autoencoder trained for interpretability analysis of robo
|
|
| 23 |
## Model Details
|
| 24 |
|
| 25 |
- **Architecture**: Multi-modal Sparse Autoencoder
|
| 26 |
-
- **Training Dataset**: `villekuosmanen/build_block_tower`, `villekuosmanen/
|
| 27 |
- **Base Policy**: LeRobot ACT policy
|
| 28 |
- **Layer Target**: `model.encoder.layers.3.norm2`
|
| 29 |
- **Tokens**: 77
|
|
@@ -36,7 +33,7 @@ This model is a Sparse Autoencoder trained for interpretability analysis of robo
|
|
| 36 |
- **Learning Rate**: 0.0001
|
| 37 |
- **Batch Size**: 16
|
| 38 |
- **L1 Penalty**: 0.3
|
| 39 |
-
- **Epochs**:
|
| 40 |
- **Optimizer**: adam
|
| 41 |
|
| 42 |
## Usage
|
|
|
|
| 6 |
- Robotics
|
| 7 |
datasets:
|
| 8 |
- villekuosmanen/build_block_tower
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 9 |
- villekuosmanen/fail_build_block_tower_stationary
|
| 10 |
+
- villekuosmanen/build_block_tower_val
|
| 11 |
+
- villekuosmanen/dAgger_build_block_tower_1.4.0
|
| 12 |
+
- villekuosmanen/dAgger_build_block_tower_dino
|
| 13 |
library_name: physical-ai-interpretability
|
| 14 |
---
|
| 15 |
|
|
|
|
| 20 |
## Model Details
|
| 21 |
|
| 22 |
- **Architecture**: Multi-modal Sparse Autoencoder
|
| 23 |
+
- **Training Dataset**: `villekuosmanen/build_block_tower`, `villekuosmanen/fail_build_block_tower_stationary`, `villekuosmanen/build_block_tower_val`, `villekuosmanen/dAgger_build_block_tower_1.4.0`, `villekuosmanen/dAgger_build_block_tower_dino`
|
| 24 |
- **Base Policy**: LeRobot ACT policy
|
| 25 |
- **Layer Target**: `model.encoder.layers.3.norm2`
|
| 26 |
- **Tokens**: 77
|
|
|
|
| 33 |
- **Learning Rate**: 0.0001
|
| 34 |
- **Batch Size**: 16
|
| 35 |
- **L1 Penalty**: 0.3
|
| 36 |
+
- **Epochs**: 10
|
| 37 |
- **Optimizer**: adam
|
| 38 |
|
| 39 |
## Usage
|
config.json
CHANGED
|
@@ -14,7 +14,7 @@
|
|
| 14 |
"block_size": 8,
|
| 15 |
"batch_size": 16,
|
| 16 |
"learning_rate": 0.0001,
|
| 17 |
-
"num_epochs":
|
| 18 |
"validation_split": 0.1,
|
| 19 |
"l1_penalty": 0.3,
|
| 20 |
"optimizer": "adam",
|
|
@@ -28,9 +28,9 @@
|
|
| 28 |
"save_every": 1000,
|
| 29 |
"validate_every": 500,
|
| 30 |
"device": "cuda",
|
| 31 |
-
"repo_id": "[villekuosmanen/build_block_tower, villekuosmanen/
|
| 32 |
-
"repo_hash": "
|
| 33 |
"layer_name": "model.encoder.layers.3.norm2",
|
| 34 |
"activation_cache_path": "/home/ville/.cache/physical_ai_interpretability/sae_activations",
|
| 35 |
-
"experiment_name": "
|
| 36 |
}
|
|
|
|
| 14 |
"block_size": 8,
|
| 15 |
"batch_size": 16,
|
| 16 |
"learning_rate": 0.0001,
|
| 17 |
+
"num_epochs": 10,
|
| 18 |
"validation_split": 0.1,
|
| 19 |
"l1_penalty": 0.3,
|
| 20 |
"optimizer": "adam",
|
|
|
|
| 28 |
"save_every": 1000,
|
| 29 |
"validate_every": 500,
|
| 30 |
"device": "cuda",
|
| 31 |
+
"repo_id": "[villekuosmanen/build_block_tower, villekuosmanen/fail_build_block_tower_stationary, villekuosmanen/build_block_tower_val, villekuosmanen/dAgger_build_block_tower_1.4.0, villekuosmanen/dAgger_build_block_tower_dino]",
|
| 32 |
+
"repo_hash": "b7b921b3",
|
| 33 |
"layer_name": "model.encoder.layers.3.norm2",
|
| 34 |
"activation_cache_path": "/home/ville/.cache/physical_ai_interpretability/sae_activations",
|
| 35 |
+
"experiment_name": "sae_dAgger_build_block_t_b7b921b3"
|
| 36 |
}
|
model.safetensors
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
size 971496408
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:9f72613854f5cab813362329d2318e5b6153efa6cba7ce2c7413cf0911d9cb7b
|
| 3 |
size 971496408
|
training_state.pt
CHANGED
|
@@ -1,3 +1,3 @@
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
-
oid sha256:
|
| 3 |
-
size
|
|
|
|
| 1 |
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:85025084e4f82e20cd2d33b4a1276fe6a1d1bd64a1848a1ebb8744daa6ce749f
|
| 3 |
+
size 1942998285
|