F1ow421 commited on
Commit
d25fcad
·
verified ·
1 Parent(s): 20c96ca

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +40 -0
README.md ADDED
@@ -0,0 +1,40 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ language: ru
3
+ license: cc-by-4.0
4
+ tags:
5
+ - text-classification
6
+ - pytorch
7
+ - multi-task-learning
8
+ - rubert-tiny2
9
+ ---
10
+
11
+ # Russian Multi-Task Toxicity Classifier
12
+
13
+ Модель классификации токсичности комментариев по трем классам:
14
+ 1. `profanity` — ненормативная лексика.
15
+ 2. `threat` — угрозы безопасности/жизни.
16
+ 3. `illegal` — призывы к нарушению законов.
17
+
18
+ Построена на базе `cointegrated/rubert-tiny2` с тремя независимыми классификационными слоями.
19
+
20
+ ## Метрики F1-score на валидации (сбалансированный гибридный датасет):
21
+ - **PROFANITY**: 0.8466 (порог 0.90)
22
+ - **THREAT**: 0.7888 (порог 0.90)
23
+ - **ILLEGAL**: 0.9489 (порог 0.70)
24
+
25
+ ## Графики и визуализация обучения
26
+
27
+ ### 1. Распределение классов в датасете
28
+ ![Распределение классов](class_distribution.png)
29
+
30
+ ### 2. Матрица корреляции классов
31
+ ![Корреляция классов](correlation_matrix.png)
32
+
33
+ ### 3. Зависимость F1-меры от порога
34
+ ![Пороги классификации](f1_vs_thresholds.png)
35
+
36
+ ### 4. Распределение предсказанных вероятностей по категориям
37
+ ![Распределение вероятностей](class_probabilities.png)
38
+
39
+ ### 5. Анализ ложных тревог и пропусков для класса THREAT
40
+ ![Анализ ошибок](threat_errors.png)