Views
No views yet
word\tphonemeshola ˈo l a
prueba p ɾ u ˈe β a
español ˌe s p a ɲ ˈo lespeak/lexicon.db files in the gruut-lang-* packages (v2.0.x). These contain IPA transcriptions with stress marks generated via espeak-ng.espeak/ subdirectory contains phonemizations generated by espeak-ng (GPL v3). The legal status of bulk phonemization output from a GPL tool is debated — it may or may not constitute a derivative work depending on jurisdiction.| Language | Code | Entries | File |
|---|---|---|---|
| Arabic | ar | 82,702 | ar_lexicon.tsv |
| Czech | cs | 43,991 | cs_lexicon.tsv |
| German | de | 279,704 | de_lexicon.tsv |
| English | en | 124,447 | en_lexicon.tsv |
| Spanish | es | 596,995 | es_lexicon.tsv |
| Farsi | fa | 47,143 | fa_lexicon.tsv |
| French | fr | 90,717 | fr_lexicon.tsv |
| Italian | it | 29,388 | it_lexicon.tsv |
| Dutch | nl | 40,084 | nl_lexicon.tsv |
| Portuguese | pt | 65,262 | pt_lexicon.tsv |
| Russian | ru | 533,929 | ru_lexicon.tsv |
| Swedish | sv | 27,192 | sv_lexicon.tsv |
| Swahili | sw | 69,676 | sw_lexicon.tsv |
1pip download gruut-lang-{code} --no-deps
2tar xzf gruut_lang_{code}-*.tar.gz
3sqlite3 espeak/lexicon.db -separator $'\t' \
4 "SELECT word, phonemes FROM word_phonemes ORDER BY word" > {code}_lexicon.tsv