Text Classification
Transformers
Safetensors
Portuguese
bert
portuguese
pt-br
content-moderation
spam-detection
toxicity-detection
adult-content
lightweight
text-embeddings-inference
Instructions to use Comunidade-Synapse-BR/Synapse-Guard-v1.1 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Comunidade-Synapse-BR/Synapse-Guard-v1.1 with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-classification", model="Comunidade-Synapse-BR/Synapse-Guard-v1.1")# Load model directly from transformers import AutoTokenizer, AutoModelForSequenceClassification tokenizer = AutoTokenizer.from_pretrained("Comunidade-Synapse-BR/Synapse-Guard-v1.1") model = AutoModelForSequenceClassification.from_pretrained("Comunidade-Synapse-BR/Synapse-Guard-v1.1", device_map="auto") - Notebooks
- Google Colab
- Kaggle
File size: 4,181 Bytes
83fb02b d0f66d3 cdf01bc d0f66d3 cdf01bc d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 cdf01bc d0f66d3 cdf01bc d0f66d3 cdf01bc d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 83fb02b d0f66d3 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 | ---
library_name: transformers
license: apache-2.0
base_model: Comunidade-Synapse-BR/Synapse-Guard-v1
language:
- pt
pipeline_tag: text-classification
tags:
- bert
- portuguese
- pt-br
- text-classification
- content-moderation
- spam-detection
- toxicity-detection
- adult-content
- lightweight
---
# 🛡️ Synapse-Guard v1.1
O **Synapse-Guard v1.1** é um modelo leve baseado em **BERT** para classificação de conteúdo em português brasileiro, desenvolvido pela **Comunidade Synapse BR**.
Esta versão representa uma evolução do **Synapse-Guard v1**, sendo refinada com um conjunto de treinamento maior e revisado para melhorar a qualidade da classificação.
O modelo foi desenvolvido para aplicações de moderação automática de conteúdo, oferecendo inferência rápida e baixo consumo de recursos.
> **Importante:** este modelo **não gera conteúdo**. Ele apenas classifica textos em categorias de moderação.
---
# 📖 Visão Geral
O Synapse-Guard v1.1 foi projetado para auxiliar sistemas de moderação automática na identificação de conteúdos potencialmente inadequados.
O foco desta versão foi melhorar a qualidade do treinamento mantendo uma arquitetura leve, adequada para aplicações em produção.
---
# 🏷️ Classes
| Classe | Descrição |
|--------|-----------|
| 🟢 Neutro | Conversas comuns e conteúdo considerado seguro. |
| 📢 Spam | Publicidade abusiva, golpes, phishing e mensagens promocionais. |
| 🔴 Tóxico | Linguagem ofensiva, insultos e conteúdo abusivo. |
| 🔞 Adulto | Conteúdo sexual explícito ou voltado ao público adulto. |
---
# 🎯 Casos de Uso
O modelo é indicado para:
- Moderação automática
- Chatbots
- Assistentes de IA
- Redes sociais
- Fóruns
- Sistemas de comentários
- Detecção de spam
- Filtragem de conteúdo adulto
- Aplicações embarcadas com recursos limitados
---
# 🏋️ Treinamento
Esta versão foi refinada a partir do:
- **Modelo base:** Synapse-Guard v1
Conjunto de treinamento:
- Aproximadamente **365.000 exemplos**
- Aproximadamente **50.000 exemplos de validação**
- Textos em português brasileiro
---
# ⚡ Exemplo de Uso
```python
from transformers import pipeline
classifier = pipeline(
"text-classification",
model="Comunidade-Synapse-BR/Synapse-Guard-v1.1"
)
resultado = classifier("Você é um idiota.")
print(resultado)
```
---
# 📊 Avaliação
Durante o treinamento, o modelo apresentou excelente desempenho no conjunto de validação utilizado durante o fine-tuning.
Entretanto, avaliações realizadas com exemplos inéditos mostraram que o desempenho pode variar conforme o domínio, estilo de escrita e distribuição dos dados de entrada.
Como qualquer modelo supervisionado, sua qualidade depende da semelhança entre os dados utilizados em produção e aqueles presentes durante o treinamento.
---
# ⚠️ Limitações
Embora apresente bom desempenho para moderação de conteúdo em português, o modelo pode apresentar dificuldades em situações como:
- Ironias
- Sarcasmo
- Conteúdo ambíguo
- Textos muito curtos
- Mensagens que dependem fortemente do contexto
Para aplicações críticas, recomenda-se utilizar revisão humana como camada adicional de segurança.
---
# 📜 Licença
Este modelo é distribuído sob a licença **Apache License 2.0**.
Consulte o repositório para informações adicionais.
---
# ⚖️ Aviso
Este modelo foi desenvolvido para pesquisa, desenvolvimento e integração em aplicações de moderação de conteúdo.
As previsões do modelo não devem ser consideradas decisões definitivas. Os desenvolvedores são responsáveis por validar seu desempenho antes da utilização em ambientes de produção.
---
# 🤝 Sobre a Comunidade Synapse BR
A **Comunidade Synapse BR** é uma iniciativa brasileira dedicada ao desenvolvimento de modelos de inteligência artificial, datasets e ferramentas de código aberto para a comunidade de língua portuguesa.
Nossa missão é tornar a inteligência artificial mais acessível por meio de soluções leves, eficientes e abertas, contribuindo para fortalecer o ecossistema brasileiro de IA. |