Corpus nheengatu

#1
by fabriciocarraro - opened

Olá Maicon! Estou num projeto de tradução automática PT↔Nheengatu, e vi que o canarim-BERT foi pré-treinado num corpus de 60+ fontes. Haveria possibilidade de compartilhá-lo? Daria o crédito necessário.

Conforme conversamos por e-mail, vou disponibilizar o dataset utilizado nos treinos aqui mesmo no HF

dominguesm changed discussion status to closed

Sign up or log in to comment