Downloads · 30 days
9
23% of all-time downloads
crash-information-extraction/BERT-Crash-nonCrash-Classification
BERT-Crash-nonCrash-Classification is a text classification model from crash-information-extraction. Use it when you need a label for a piece of text. The card lists the license as apache-2.0.
Fine-tuned BERT for detecting crash-related Persian social media texts.
Downloads · 30 days
9
23% of all-time downloads
All-time downloads
40
Public
Parameters
118M
473 MB on disk
Likes
0
Public
Click a slice to open those files.
.safetensors473 MB · 100%
From the Hugging Face model README
Fine-tuned BERT for detecting crash-related Persian social media texts.
📄 Paper: Extracting traffic crash information from social media: an LLM-based approach – Transportation Letters (2026)
Binary classifier to determine whether a given Persian social media text is related to a traffic crash or not.
bert-base-multilingual-cased| Task | Metric | Score |
|---|---|---|
| Crash Detection (Binary) | Accuracy | 91.1% |
from transformers import AutoModelForSequenceClassification, AutoTokenizer
model = AutoModelForSequenceClassification.from_pretrained("crash-information-extraction/BERT-Crash-nonCrash-Classification")
tokenizer = AutoTokenizer.from_pretrained("crash-information-extraction/BERT-Crash-nonCrash-Classification")
text = "تصادف در خیابان آزادی ۲ کشته داشت"
inputs = tokenizer(text, return_tensors="pt")
outputs = model(**inputs)
predicted_class = outputs.logits.argmax().item()