Views
No views yet
| Hyperparameter | Value |
|---|---|
| \(n_{parameters}\) | 340M |
| \(n_{layers}\) | 24 |
| \(n_{heads}\) | 16 |
| \(n_{ctx}\) | 1024 |
| \(n_{vocab}\) | 30592 |
| Dataset | Genre | Size(GB) |
|---|---|---|
| Anföranden | Politics | 0.9 |
| DCEP | Politics | 0.6 |
| DGT | Politics | 0.7 |
| Fass | Medical | 0.6 |
| Författningar | Legal | 0.1 |
| Web data | Misc | 45.0 |
| JRC | Legal | 0.4 |
| Litteraturbanken | Books | 0.3O |
| SCAR | Misc | 28.0 |
| SOU | Politics | 5.3 |
| Subtitles | Drama | 1.3 |
| Wikipedia | Facts | 1.8 |
1from transformers import AutoTokenizer, AutoModelForMaskedLM
2tokenizer = AutoTokenizer.from_pretrained("AI-Nordics/bert-large-swedish-cased")
3model = AutoModelForMaskedLM.from_pretrained("AI-Nordics/bert-large-swedish-cased")
4