chimbiwide commited on
Commit
7df7d52
·
verified ·
1 Parent(s): de6b941

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +1 -1
README.md CHANGED
@@ -15,7 +15,7 @@ base_model: chimbiwide/gemma-3-1b-it-thinking-32k-grpo-merged
15
 
16
  # GemmaThink-32k-Q8_0-GGUF (GRPO Trained Model)
17
 
18
- This model was trained using SFT (Suprevised FineTuning) to generate structured reasoning traces.
19
 
20
  ## Training Details
21
 
 
15
 
16
  # GemmaThink-32k-Q8_0-GGUF (GRPO Trained Model)
17
 
18
+ This model was trained using GRPO (Group Relative Policy Optimization) to generate structured reasoning traces.
19
 
20
  ## Training Details
21