Downloads · 30 days
10
21% of all-time downloads
zurawski/bertweetbr_multilabel_classifier_multidomain
bertweetbr_multilabel_classifier_multidomain is a machine learning model from zurawski. Use it for the machine learning task on the model card, and read the license before you ship it in a product.
Este modelo é uma versão fine-tuned do BERTweetBR para detecção multilabel de diferentes tipos de discurso de ódio em comentários do YouTube. O modelo é capaz de identificar múltiplas categorias de ódio simultaneament…
Downloads · 30 days
10
21% of all-time downloads
All-time downloads
47
Public
Parameters
135M
540 MB on disk
Likes
0
Public
Click a slice to open those files.
.safetensors540 MB · 100%
From the Hugging Face model README
Este modelo é uma versão fine-tuned do BERTweetBR para detecção multilabel de diferentes tipos de discurso de ódio em comentários do YouTube. O modelo é capaz de identificar múltiplas categorias de ódio simultaneamente em um mesmo texto.
Corpus Multidomínio YouTube: Dataset coletado especificamente para este trabalho, contendo comentários do YouTube de cinco domínios temáticos distintos:
Os comentários foram anotados manualmente com múltiplas categorias de discurso de ódio quando aplicável.
Avaliação no conjunto de teste (167 exemplos com pelo menos um rótulo):
| Categoria | Precision | Recall | F1-Score | Support |
|---|---|---|---|---|
| Insulto de Baixo Calão | 0.63 | 0.41 | 0.50 | 93 |
| Homofobia | 0.00 | 0.00 | 0.00 | 15 |
| Racismo | 0.00 | 0.00 | 0.00 | 2 |
| Misoginia/Machismo | 0.00 | 0.00 | 0.00 | 10 |
| Xenofobia | 0.00 | 0.00 | 0.00 | 6 |
| Violência/Extremismo | 0.00 | 0.00 | 0.00 | 5 |
| Intolerância Religiosa | 0.00 | 0.00 | 0.00 | 7 |
| Intolerância Política | 0.69 | 0.42 | 0.52 | 26 |
| Anticapacitismo | 0.00 | 0.00 | 0.00 | 3 |
Métricas Gerais: