F1ow421's picture
Upload README.md with huggingface_hub
d25fcad verified
|
Raw
History Blame
1.66 kB
metadata
language: ru
license: cc-by-4.0
tags:
  - text-classification
  - pytorch
  - multi-task-learning
  - rubert-tiny2

Russian Multi-Task Toxicity Classifier

Модель классификации токсичности комментариев по трем классам:

  1. profanity — ненормативная лексика.
  2. threat — угрозы безопасности/жизни.
  3. illegal — призывы к нарушению законов.

Построена на базе cointegrated/rubert-tiny2 с тремя независимыми классификационными слоями.

Метрики F1-score на валидации (сбалансированный гибридный датасет):

  • PROFANITY: 0.8466 (порог 0.90)
  • THREAT: 0.7888 (порог 0.90)
  • ILLEGAL: 0.9489 (порог 0.70)

Графики и визуализация обучения

1. Распределение классов в датасете

Распределение классов

2. Матрица корреляции классов

Корреляция классов

3. Зависимость F1-меры от порога

Пороги классификации

4. Распределение предсказанных вероятностей по категориям

Распределение вероятностей

5. Анализ ложных тревог и пропусков для класса THREAT

Анализ ошибок