На моих замерах русскоязычный fasttext работал лучше, чем rubert.
И удивительно даже, что не только на моих, но и на
некоторых диппавловских 🤔
И он точно быстрее)
fasttext'ы на сайте rusvectores в стандартном формате библиотеки gensim, который отлично задокументирован.
Так что я бы с FT начал, а берт, элмо и прочие толстые нейронки уже потом докручивал бы.