Downloads · 30 days
48
13% of all-time downloads
ruaccent/RUAccent-encoder
RUAccent-encoder is a feature extraction model from ruaccent. Use it when you need embeddings to search or compare text. It is set up for transformers. The card lists the license as mit.
Эта модель представляет собой энкодер для TTS систем, который умеет разрешать омографию. Предназначен для интеграции в TTS системы, но лучше обратите внимание на энкодер который вогнали в стресс (как и автора RUAccent)
Downloads · 30 days
48
13% of all-time downloads
All-time downloads
375
Public
Parameters
28.7M
115 MB on disk
Likes
2
Public
Click a slice to open those files.
.safetensors115 MB · 100%
From the Hugging Face model README
Эта модель представляет собой энкодер для TTS систем, который умеет разрешать омографию. Предназначен для интеграции в TTS системы, но лучше обратите внимание на энкодер который вогнали в стресс (как и автора RUAccent)
import torch
from transformers import AutoModel
import chartk
tokenizer = chartk.CharacterTokenizer.from_pretrained('ruaccent/RUAccent-encoder')
model = AutoModel.from_pretrained('ruaccent/RUAccent-stressed-encoder')
text = "На горе стоит замок"
inputs = tokenizer(text, return_tensors='pt', padding=True, truncation=True, max_length=512)
with torch.no_grad():
outputs = model(**inputs)
last_hidden_state = outputs.last_hidden_state