Helsinki-NLP/tatoeba
Updated • 1.32k • 55
How to use mihdeme/mt-fr-en-tatoeba with Transformers:
# Use a pipeline as a high-level helper
# Warning: Pipeline type "translation" is no longer supported in transformers v5.
# You must load the model directly (see below) or downgrade to v4.x with:
# 'pip install "transformers<5.0.0'
from transformers import pipeline
pipe = pipeline("translation", model="mihdeme/mt-fr-en-tatoeba") # Load model directly
from transformers import AutoTokenizer, AutoModelForSeq2SeqLM
tokenizer = AutoTokenizer.from_pretrained("mihdeme/mt-fr-en-tatoeba")
model = AutoModelForSeq2SeqLM.from_pretrained("mihdeme/mt-fr-en-tatoeba", device_map="auto")mt-fr-en-tatoeba
This is a fine-tuned version of Helsinki-NLP/opus-mt-fr-en, trained on the Tatoeba dataset for French-to-English translation.
Helsinki-NLP/opus-mt-fr-enopus_tatoeba (French-English)from transformers import AutoModelForSeq2SeqLM, AutoTokenizer
model_name = "mihdeme/mt-fr-en-tatoeba"
model = AutoModelForSeq2SeqLM.from_pretrained(model_name)
tokenizer = AutoTokenizer.from_pretrained(model_name)
def translate(sentence):
inputs = tokenizer(sentence, return_tensors="pt", padding=True, truncation=True)
outputs = model.generate(**inputs)
return tokenizer.decode(outputs[0], skip_special_tokens=True)
print(translate("Bonjour, comment ça va ?"))
Apache 2.0
Trained using Hugging Face Transformers. Original dataset from Tatoeba.
Base model
Helsinki-NLP/opus-mt-fr-en