{ "architectures": [ "ConvNextForImageClassification" ], "depths": [ 3, 3, 27, 3 ], "drop_path_rate": 0.0, "dtype": "float32", "hidden_act": "gelu", "hidden_sizes": [ 128, 256, 512, 1024 ], "id2label": { "0": "\u304a", "1": "\u304d", "2": "\u3059", "3": "\u3064", "4": "\u306a", "5": "\u306f", "6": "\u307e", "7": "\u3084", "8": "\u308c", "9": "\u3092" }, "image_size": 224, "initializer_range": 0.02, "label2id": { "\u304a": 0, "\u304d": 1, "\u3059": 2, "\u3064": 3, "\u306a": 4, "\u306f": 5, "\u307e": 6, "\u3084": 7, "\u308c": 8, "\u3092": 9 }, "layer_norm_eps": 1e-12, "layer_scale_init_value": 1e-06, "model_type": "convnext", "num_channels": 3, "num_stages": 4, "out_features": [ "stage4" ], "out_indices": [ 4 ], "patch_size": 4, "stage_names": [ "stem", "stage1", "stage2", "stage3", "stage4" ], "transformers_version": "4.57.3" }