Instructions to use Finnish-NLP/convbert-base-finnish with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Finnish-NLP/convbert-base-finnish with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("feature-extraction", model="Finnish-NLP/convbert-base-finnish")# Load model directly from transformers import AutoTokenizer, AutoModel tokenizer = AutoTokenizer.from_pretrained("Finnish-NLP/convbert-base-finnish") model = AutoModel.from_pretrained("Finnish-NLP/convbert-base-finnish", device_map="auto") - Notebooks
- Google Colab
- Kaggle
| python3 build_pretraining_dataset.py --corpus-dir /researchdisk/training_dataset_sentences/train_splitted/ --vocab-file /researchdisk/convbert-base-finnish/vocab.txt --output-dir /researchdisk/training_dataset_sentences/train_tokenized_512 --max-seq-length 512 --num-processes 64 --no-lower-case --no-strip-accents |