Downloads · 30 days
0
sanvo/vietnamese-nmt
vietnamese-nmt is a translation model from sanvo. Use it when you need text moved from one language to another. It is set up for transformers. The card lists the license as mit.
Fine-tuned facebook/nllb-200-distilled-600M (600M parameters) for trilingual translation between Vietnamese, English, and Japanese.
Downloads · 30 days
0
Access
Public
Updated Feb 23, 2026
Repo size
—
Likes
0
Public
Click a slice to open those files.
.md2.8 KB · 64%
From the Hugging Face model README
Fine-tuned facebook/nllb-200-distilled-600M (600M parameters) for trilingual translation between Vietnamese, English, and Japanese.
| Source | Target | Direction |
|---|---|---|
| Vietnamese | English | vi → en |
| English | Vietnamese | en → vi |
| Vietnamese | Japanese | vi → ja |
| Japanese | Vietnamese | ja → vi |
| English | Japanese | en → ja |
| Japanese | English | ja → en |
Includes a character-based language detection module using Unicode range analysis:
from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
model = AutoModelForSeq2SeqLM.from_pretrained("sanvo/vietnamese-nmt")
tokenizer = AutoTokenizer.from_pretrained("facebook/nllb-200-distilled-600M")
# Vietnamese → English
tokenizer.src_lang = "vie_Latn"
inputs = tokenizer("Xin chào, bạn khỏe không?", return_tensors="pt")
translated = model.generate(**inputs, forced_bos_token_id=tokenizer.lang_code_to_id["eng_Latn"])
print(tokenizer.decode(translated[0], skip_special_tokens=True))
# Vietnamese → Japanese
translated = model.generate(**inputs, forced_bos_token_id=tokenizer.lang_code_to_id["jpn_Jpan"])
print(tokenizer.decode(translated[0], skip_special_tokens=True))