Downloads · 30 days
23
16% of all-time downloads
cibi11/turkish-content-moderation
turkish-content-moderation is a text classification model from cibi11. Use it when you need a label for a piece of text. The card lists the license as mit.
XLM-RoBERTa-large tabanlı, Türkçe metinleri 7 kategoride sınıflandıran bir içerik moderasyon modelidir.
Downloads · 30 days
23
16% of all-time downloads
All-time downloads
146
Public
Repo size
2.3 GB
Likes
1
Public
Click a slice to open those files.
.safetensors2.2 GB · 99%
From the Hugging Face model README
XLM-RoBERTa-large tabanlı, Türkçe metinleri 7 kategoride sınıflandıran bir içerik moderasyon modelidir.
| Index | Kategori | Açıklama |
|---|---|---|
| 0 | normal | Normal, zararsız içerik |
| 1 | kufur | Küfür içeren ifadeler |
| 2 | tehdit | Tehdit edici ifadeler |
| 3 | taciz | Taciz içeren ifadeler |
| 4 | nefret | Nefret söylemi |
| 5 | saka/igneleme | Şaka veya iğneleme amaçlı ifadeler |
| 6 | cinsel | Cinsel içerikli ifadeler |
| Sınıf | F1 Skoru |
|---|---|
| Küfür | %94.7 |
| Normal | %85.7 |
| Cinsel | %85.7 |
| Nefret | %84.0 |
| Şaka/İğneleme | %83.8 |
| Tehdit | %80.9 |
| Taciz | %62.7 |
| Macro F1 | %82.5 |
| Accuracy | %83.0 |
Bu model, kendi oluşturulan Türkçe içerik moderasyon veri seti ile fine-tune edilmiştir.
import torch
from transformers import AutoModelForSequenceClassification, AutoTokenizer
model_name = "cibi11/turkish-content-moderation"
tokenizer = AutoTokenizer.from_pretrained(model_name)
model = AutoModelForSequenceClassification.from_pretrained(model_name)
model.eval()
text = "Seninle konuşmak istemiyorum"
inputs = tokenizer(text, return_tensors="pt", truncation=True, max_length=128)
with torch.no_grad():
logits = model(**inputs).logits
probs = torch.softmax(logits, dim=-1)[0]
kategoriler = ["normal", "kufur", "tehdit", "taciz", "nefret", "saka/igneleme", "cinsel"]
for label, prob in zip(kategoriler, probs):
print(f"{label}: %{prob.item() * 100:.1f}")
print(f"Sonuç: {kategoriler[probs.argmax()]}")
Bu model hatalı pozitif ve hatalı negatif sonuçlar üretebilir ve tek başına moderasyon kararları için yeterli değildir. Kullanım öncesinde insan denetimi önerilir.
MIT
This model is fine-tuned from xlm-roberta-large, which is released under the MIT License.