villekuosmanen commited on
Commit
6b88c29
·
verified ·
1 Parent(s): b9dff20

Upload SAE model weights, config, and training state

Browse files
Files changed (4) hide show
  1. README.md +5 -8
  2. config.json +4 -4
  3. model.safetensors +1 -1
  4. training_state.pt +2 -2
README.md CHANGED
@@ -6,13 +6,10 @@ tags:
6
  - Robotics
7
  datasets:
8
  - villekuosmanen/build_block_tower
9
- - villekuosmanen/dAgger_build_block_tower_1.0.0
10
- - villekuosmanen/dAgger_build_block_tower_1.1.0
11
- - villekuosmanen/dAgger_build_block_tower_1.2.0
12
- - villekuosmanen/dAgger_build_block_tower_1.3.0
13
- - villekuosmanen/dAgger_build_block_tower_1.4.0
14
  - villekuosmanen/fail_build_block_tower_stationary
15
- - villekuosmanen/fail_build_block_tower_autonomous_interaction
 
 
16
  library_name: physical-ai-interpretability
17
  ---
18
 
@@ -23,7 +20,7 @@ This model is a Sparse Autoencoder trained for interpretability analysis of robo
23
  ## Model Details
24
 
25
  - **Architecture**: Multi-modal Sparse Autoencoder
26
- - **Training Dataset**: `villekuosmanen/build_block_tower`, `villekuosmanen/dAgger_build_block_tower_1.0.0`, `villekuosmanen/dAgger_build_block_tower_1.1.0`, `villekuosmanen/dAgger_build_block_tower_1.2.0`, `villekuosmanen/dAgger_build_block_tower_1.3.0`, `villekuosmanen/dAgger_build_block_tower_1.4.0`, `villekuosmanen/fail_build_block_tower_stationary`, `villekuosmanen/fail_build_block_tower_autonomous_interaction`
27
  - **Base Policy**: LeRobot ACT policy
28
  - **Layer Target**: `model.encoder.layers.3.norm2`
29
  - **Tokens**: 77
@@ -36,7 +33,7 @@ This model is a Sparse Autoencoder trained for interpretability analysis of robo
36
  - **Learning Rate**: 0.0001
37
  - **Batch Size**: 16
38
  - **L1 Penalty**: 0.3
39
- - **Epochs**: 20
40
  - **Optimizer**: adam
41
 
42
  ## Usage
 
6
  - Robotics
7
  datasets:
8
  - villekuosmanen/build_block_tower
 
 
 
 
 
9
  - villekuosmanen/fail_build_block_tower_stationary
10
+ - villekuosmanen/build_block_tower_val
11
+ - villekuosmanen/dAgger_build_block_tower_1.4.0
12
+ - villekuosmanen/dAgger_build_block_tower_dino
13
  library_name: physical-ai-interpretability
14
  ---
15
 
 
20
  ## Model Details
21
 
22
  - **Architecture**: Multi-modal Sparse Autoencoder
23
+ - **Training Dataset**: `villekuosmanen/build_block_tower`, `villekuosmanen/fail_build_block_tower_stationary`, `villekuosmanen/build_block_tower_val`, `villekuosmanen/dAgger_build_block_tower_1.4.0`, `villekuosmanen/dAgger_build_block_tower_dino`
24
  - **Base Policy**: LeRobot ACT policy
25
  - **Layer Target**: `model.encoder.layers.3.norm2`
26
  - **Tokens**: 77
 
33
  - **Learning Rate**: 0.0001
34
  - **Batch Size**: 16
35
  - **L1 Penalty**: 0.3
36
+ - **Epochs**: 10
37
  - **Optimizer**: adam
38
 
39
  ## Usage
config.json CHANGED
@@ -14,7 +14,7 @@
14
  "block_size": 8,
15
  "batch_size": 16,
16
  "learning_rate": 0.0001,
17
- "num_epochs": 20,
18
  "validation_split": 0.1,
19
  "l1_penalty": 0.3,
20
  "optimizer": "adam",
@@ -28,9 +28,9 @@
28
  "save_every": 1000,
29
  "validate_every": 500,
30
  "device": "cuda",
31
- "repo_id": "[villekuosmanen/build_block_tower, villekuosmanen/dAgger_build_block_tower_1.0.0, villekuosmanen/dAgger_build_block_tower_1.1.0, villekuosmanen/dAgger_build_block_tower_1.2.0, villekuosmanen/dAgger_build_block_tower_1.3.0, villekuosmanen/dAgger_build_block_tower_1.4.0, villekuosmanen/fail_build_block_tower_stationary, villekuosmanen/fail_build_block_tower_autonomous_interaction]",
32
- "repo_hash": "881292d6",
33
  "layer_name": "model.encoder.layers.3.norm2",
34
  "activation_cache_path": "/home/ville/.cache/physical_ai_interpretability/sae_activations",
35
- "experiment_name": "sae_fail_build_block_tow_881292d6"
36
  }
 
14
  "block_size": 8,
15
  "batch_size": 16,
16
  "learning_rate": 0.0001,
17
+ "num_epochs": 10,
18
  "validation_split": 0.1,
19
  "l1_penalty": 0.3,
20
  "optimizer": "adam",
 
28
  "save_every": 1000,
29
  "validate_every": 500,
30
  "device": "cuda",
31
+ "repo_id": "[villekuosmanen/build_block_tower, villekuosmanen/fail_build_block_tower_stationary, villekuosmanen/build_block_tower_val, villekuosmanen/dAgger_build_block_tower_1.4.0, villekuosmanen/dAgger_build_block_tower_dino]",
32
+ "repo_hash": "b7b921b3",
33
  "layer_name": "model.encoder.layers.3.norm2",
34
  "activation_cache_path": "/home/ville/.cache/physical_ai_interpretability/sae_activations",
35
+ "experiment_name": "sae_dAgger_build_block_t_b7b921b3"
36
  }
model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:0211c1fe33e69f654dd269531f5aee5e04b26a56a7552ab4e5a7f14ea2449906
3
  size 971496408
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9f72613854f5cab813362329d2318e5b6153efa6cba7ce2c7413cf0911d9cb7b
3
  size 971496408
training_state.pt CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:d142098a493441e4ab7adbb34caebce779e5659f678299accf1253b46743bd21
3
- size 1942998303
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:85025084e4f82e20cd2d33b4a1276fe6a1d1bd64a1848a1ebb8744daa6ce749f
3
+ size 1942998285