File size: 4,181 Bytes
83fb02b
 
 
 
d0f66d3
cdf01bc
d0f66d3
 
cdf01bc
d0f66d3
83fb02b
d0f66d3
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
83fb02b
 
d0f66d3
83fb02b
d0f66d3
cdf01bc
d0f66d3
cdf01bc
d0f66d3
cdf01bc
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
 
 
 
 
83fb02b
d0f66d3
83fb02b
d0f66d3
 
 
83fb02b
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
 
 
83fb02b
d0f66d3
83fb02b
d0f66d3
83fb02b
d0f66d3
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
101
102
103
104
105
106
107
108
109
110
111
112
113
114
115
116
117
118
119
120
121
122
123
124
125
126
127
128
129
130
131
132
133
134
135
136
137
138
139
140
141
142
143
144
145
---
library_name: transformers
license: apache-2.0
base_model: Comunidade-Synapse-BR/Synapse-Guard-v1

language:
  - pt

pipeline_tag: text-classification

tags:
  - bert
  - portuguese
  - pt-br
  - text-classification
  - content-moderation
  - spam-detection
  - toxicity-detection
  - adult-content
  - lightweight
---

# 🛡️ Synapse-Guard v1.1

O **Synapse-Guard v1.1** é um modelo leve baseado em **BERT** para classificação de conteúdo em português brasileiro, desenvolvido pela **Comunidade Synapse BR**.

Esta versão representa uma evolução do **Synapse-Guard v1**, sendo refinada com um conjunto de treinamento maior e revisado para melhorar a qualidade da classificação.

O modelo foi desenvolvido para aplicações de moderação automática de conteúdo, oferecendo inferência rápida e baixo consumo de recursos.

> **Importante:** este modelo **não gera conteúdo**. Ele apenas classifica textos em categorias de moderação.

---

# 📖 Visão Geral

O Synapse-Guard v1.1 foi projetado para auxiliar sistemas de moderação automática na identificação de conteúdos potencialmente inadequados.

O foco desta versão foi melhorar a qualidade do treinamento mantendo uma arquitetura leve, adequada para aplicações em produção.

---

# 🏷️ Classes

| Classe | Descrição |
|--------|-----------|
| 🟢 Neutro | Conversas comuns e conteúdo considerado seguro. |
| 📢 Spam | Publicidade abusiva, golpes, phishing e mensagens promocionais. |
| 🔴 Tóxico | Linguagem ofensiva, insultos e conteúdo abusivo. |
| 🔞 Adulto | Conteúdo sexual explícito ou voltado ao público adulto. |

---

# 🎯 Casos de Uso

O modelo é indicado para:

- Moderação automática
- Chatbots
- Assistentes de IA
- Redes sociais
- Fóruns
- Sistemas de comentários
- Detecção de spam
- Filtragem de conteúdo adulto
- Aplicações embarcadas com recursos limitados

---

# 🏋️ Treinamento

Esta versão foi refinada a partir do:

- **Modelo base:** Synapse-Guard v1

Conjunto de treinamento:

- Aproximadamente **365.000 exemplos**
- Aproximadamente **50.000 exemplos de validação**
- Textos em português brasileiro

---

# ⚡ Exemplo de Uso

```python
from transformers import pipeline

classifier = pipeline(
    "text-classification",
    model="Comunidade-Synapse-BR/Synapse-Guard-v1.1"
)

resultado = classifier("Você é um idiota.")

print(resultado)
```

---

# 📊 Avaliação

Durante o treinamento, o modelo apresentou excelente desempenho no conjunto de validação utilizado durante o fine-tuning.

Entretanto, avaliações realizadas com exemplos inéditos mostraram que o desempenho pode variar conforme o domínio, estilo de escrita e distribuição dos dados de entrada.

Como qualquer modelo supervisionado, sua qualidade depende da semelhança entre os dados utilizados em produção e aqueles presentes durante o treinamento.

---

# ⚠️ Limitações

Embora apresente bom desempenho para moderação de conteúdo em português, o modelo pode apresentar dificuldades em situações como:

- Ironias
- Sarcasmo
- Conteúdo ambíguo
- Textos muito curtos
- Mensagens que dependem fortemente do contexto

Para aplicações críticas, recomenda-se utilizar revisão humana como camada adicional de segurança.

---

# 📜 Licença

Este modelo é distribuído sob a licença **Apache License 2.0**.

Consulte o repositório para informações adicionais.

---

# ⚖️ Aviso

Este modelo foi desenvolvido para pesquisa, desenvolvimento e integração em aplicações de moderação de conteúdo.

As previsões do modelo não devem ser consideradas decisões definitivas. Os desenvolvedores são responsáveis por validar seu desempenho antes da utilização em ambientes de produção.

---

# 🤝 Sobre a Comunidade Synapse BR

A **Comunidade Synapse BR** é uma iniciativa brasileira dedicada ao desenvolvimento de modelos de inteligência artificial, datasets e ferramentas de código aberto para a comunidade de língua portuguesa.

Nossa missão é tornar a inteligência artificial mais acessível por meio de soluções leves, eficientes e abertas, contribuindo para fortalecer o ecossistema brasileiro de IA.