Instructions to use dominguesm/canarim-bert-nheengatu with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use dominguesm/canarim-bert-nheengatu with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("fill-mask", model="dominguesm/canarim-bert-nheengatu")# pip install -U transformers accelerate # Load model directly from transformers import AutoTokenizer, AutoModelForMaskedLM tokenizer = AutoTokenizer.from_pretrained("dominguesm/canarim-bert-nheengatu") model = AutoModelForMaskedLM.from_pretrained("dominguesm/canarim-bert-nheengatu", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Corpus nheengatu
#1
by fabriciocarraro - opened
Olá Maicon! Estou num projeto de tradução automática PT↔Nheengatu, e vi que o canarim-BERT foi pré-treinado num corpus de 60+ fontes. Haveria possibilidade de compartilhá-lo? Daria o crédito necessário.
Conforme conversamos por e-mail, vou disponibilizar o dataset utilizado nos treinos aqui mesmo no HF
dominguesm changed discussion status to closed