← IDLItesseract-ocr on GitHub ↗
Now scanning
Afrikaans
Amharic
Arabic
Arabic
Armenian
Assamese
Azerbaijani
Azerbaijani (Cyrillic script)
Belarusian
Bangla
Bengali
Tibetan
Bosnian
Breton
Bulgarian
Canadian Aboriginal
Catalan
Cebuano
Czech
Cherokee
Chinese (Simplified)
Chinese (Simplified, vertical)
Chinese (Traditional)
Chinese (Traditional, vertical)
Cherokee
Corsican
Welsh
Cyrillic
Danish
Danish (Fraktur script)
German
German (Fraktur script)
German (Fraktur script)
Devanagari
Divehi
Dzongkha
Greek
English
Middle English
Esperanto
Math / equation detection
Estonian
Ethiopic
Basque
Faroese
Persian
Filipino
Finnish
French
Fraktur
German (Fraktur, legacy script)
Middle French
Western Frisian
Georgian
Scottish Gaelic
Irish
Galician
Ancient Greek
Greek
Gujarati
Gujarati
Gurmukhi
Hangul
Hangul (vertical)
Han (Simplified)
Han (Simplified, vertical)
Han (Traditional)
Han (Traditional, vertical)
Haitian Creole
Hebrew
Hebrew
Hindi
Croatian
Hungarian
Armenian
Inuktitut
Indonesian
Icelandic
Italian
Italian (historical orthography)
Japanese
Japanese (vertical)
Javanese
Japanese
Japanese (vertical)
Kannada
Kannada
Georgian
Georgian (historical orthography)
Kazakh
Khmer
Khmer
Kyrgyz
Kurdish
Korean
Korean (vertical)
Lao
Lao
Latin
Latin
Latvian
Lithuanian
Luxembourgish
Malayalam
Malayalam
Marathi
Macedonian
Maltese
Mongolian
Māori
Malay
Burmese
Myanmar
Nepali
Dutch
Norwegian
Occitan
Odia
Oriya
Orientation & script detection
Punjabi
Polish
Portuguese
Pashto
Quechua
Romanian
Russian
Sanskrit
Sinhala
Sinhala
Slovak
Slovak (Fraktur script)
Slovenian
Sindhi
Spanish
Spanish (historical orthography)
Albanian
Serbian
Serbian (Latin script)
Sundanese
Swahili
Swedish
Syriac
Syriac
Tamil
Tamil
Tatar
Telugu
Telugu
Tajik
Filipino
Thai
Thaana
Thai
Tibetan
Tigrinya
Tongan
Turkish
Uyghur
Ukrainian
Urdu
Uzbek
Uzbek (Cyrillic script)
Vietnamese
Vietnamese
Yiddish
Yoruba
Afrikaans
Amharic
Arabic
Arabic
Armenian
Assamese
Azerbaijani
Azerbaijani (Cyrillic script)
Belarusian
Bangla
Bengali
Tibetan
Bosnian
Breton
Bulgarian
Canadian Aboriginal
Catalan
Cebuano
Czech
Cherokee
Chinese (Simplified)
Chinese (Simplified, vertical)
Chinese (Traditional)
Chinese (Traditional, vertical)
Cherokee
Corsican
Welsh
Cyrillic
Danish
Danish (Fraktur script)
German
German (Fraktur script)
German (Fraktur script)
Devanagari
Divehi
Dzongkha
Greek
English
Middle English
Esperanto
Math / equation detection
Estonian
Ethiopic
Basque
Faroese
Persian
Filipino
Finnish
French
Fraktur
German (Fraktur, legacy script)
Middle French
Western Frisian
Georgian
Scottish Gaelic
Irish
Galician
Ancient Greek
Greek
Gujarati
Gujarati
Gurmukhi
Hangul
Hangul (vertical)
Han (Simplified)
Han (Simplified, vertical)
Han (Traditional)
Han (Traditional, vertical)
Haitian Creole
Hebrew
Hebrew
Hindi
Croatian
Hungarian
Armenian
Inuktitut
Indonesian
Icelandic
Italian
Italian (historical orthography)
Japanese
Japanese (vertical)
Javanese
Japanese
Japanese (vertical)
Kannada
Kannada
Georgian
Georgian (historical orthography)
Kazakh
Khmer
Khmer
Kyrgyz
Kurdish
Korean
Korean (vertical)
Lao
Lao
Latin
Latin
Latvian
Lithuanian
Luxembourgish
Malayalam
Malayalam
Marathi
Macedonian
Maltese
Mongolian
Māori
Malay
Burmese
Myanmar
Nepali
Dutch
Norwegian
Occitan
Odia
Oriya
Orientation & script detection
Punjabi
Polish
Portuguese
Pashto
Quechua
Romanian
Russian
Sanskrit
Sinhala
Sinhala
Slovak
Slovak (Fraktur script)
Slovenian
Sindhi
Spanish
Spanish (historical orthography)
Albanian
Serbian
Serbian (Latin script)
Sundanese
Swahili
Swedish
Syriac
Syriac
Tamil
Tamil
Tatar
Telugu
Telugu
Tajik
Filipino
Thai
Thaana
Thai
Tibetan
Tigrinya
Tongan
Turkish
Uyghur
Ukrainian
Urdu
Uzbek
Uzbek (Cyrillic script)
Vietnamese
Vietnamese
Yiddish
Yoruba

Tesseract Atlas

Every OCR model published across Tesseract’s official trained-data repositories, searchable by language, script, and quality tier.

Model codes tracked
167
Language models
128
Script models
37
Full / partial tier coverage
162 / 5

All models

167 of 167 model codes

Afrikaans
afr
7.5 MB2.5 MB12.2 MB3/3
Albanian
sqi
8.2 MB1.8 MB4.4 MB3/3
Amharic
amh
8.0 MB5.2 MB8.0 MB3/3
Ancient Greek
grc
7.1 MB2.1 MB4.9 MB3/3
Arabic
ara
2.4 MB1.4 MB12.0 MB3/3
Arabic
Arabic
9.6 MB8.9 MB16.3 MB3/3
Armenian
Armenian
8.0 MB7.5 MB18.0 MB3/3
Armenian
hye
3.4 MB3.3 MB6.1 MB3/3
Assamese
asm
2.0 MB2.0 MB10.8 MB3/3
Azerbaijani
aze
9.7 MB3.4 MB6.0 MB3/3
Azerbaijani (Cyrillic script)
aze_cyrl
4.5 MB1.9 MB4.5 MB3/3
Bangla
ben
1.7 MB835.8 KB10.5 MB3/3
Basque
eus
9.7 MB4.9 MB7.6 MB3/3
Belarusian
bel
10.7 MB3.5 MB10.4 MB3/3
Bengali
Bengali
6.0 MB5.4 MB15.9 MB3/3
Bosnian
bos
7.6 MB2.4 MB5.0 MB3/3
Breton
bre
6.0 MB6.0 MB14.9 MB3/3
Bulgarian
bul
8.0 MB1.6 MB8.4 MB3/3
Burmese
mya
4.4 MB4.4 MB14.3 MB3/3
Canadian Aboriginal
Canadian_Aboriginal
6.8 MB6.8 MB14.5 MB3/3
Catalan
cat
6.2 MB1.1 MB3.6 MB3/3
Cebuano
ceb
2.3 MB699.4 KB3.3 MB3/3
Cherokee
Cherokee
4.0 MB4.0 MB6.8 MB3/3
Cherokee
chr
1.4 MB366.2 KB2.2 MB3/3
Chinese (Simplified, vertical)
chi_sim_vert
2.4 MB1.8 MB12.5 MB3/3
Chinese (Simplified)
chi_sim
42.3 MB2.4 MB12.5 MB3/3
Chinese (Traditional, vertical)
chi_tra_vert
2.3 MB1.7 MB12.4 MB3/3
Chinese (Traditional)
chi_tra
56.3 MB2.3 MB12.4 MB3/3
Corsican
cos
2.2 MB2.2 MB8.4 MB3/3
Croatian
hrv
13.2 MB3.9 MB10.7 MB3/3
Cyrillic
Cyrillic
28.5 MB27.9 MB35.0 MB3/3
Czech
ces
15.5 MB3.6 MB10.4 MB3/3
Danish
dan
10.1 MB2.5 MB9.3 MB3/3
Danish (Fraktur script)
dan_frak
1.5 MB1/3
Devanagari
Devanagari
18.0 MB17.1 MB27.2 MB3/3
Divehi
div
1.7 MB1.7 MB4.4 MB3/3
Dutch
nld
22.1 MB5.8 MB8.5 MB3/3
Dzongkha
dzo
439.1 KB439.1 KB3.1 MB3/3
English
eng
22.4 MB3.9 MB14.7 MB3/3
Esperanto
epo
10.8 MB4.5 MB7.1 MB3/3
Estonian
est
14.6 MB4.3 MB15.1 MB3/3
Ethiopic
Ethiopic
8.7 MB8.7 MB10.7 MB3/3
Faroese
fao
3.3 MB3.3 MB9.6 MB3/3
Filipino
fil
2.4 MB1.8 MB8.6 MB3/3
Filipino
tgl
7.0 MB1/3
Finnish
fin
20.2 MB7.5 MB13.7 MB3/3
Fraktur
Fraktur
10.4 MB10.4 MB16.8 MB3/3
French
fra
13.6 MB1.1 MB3.8 MB3/3
Galician
glg
7.7 MB2.4 MB12.1 MB3/3
Georgian
Georgian
6.6 MB6.6 MB13.2 MB3/3
Georgian
kat
8.3 MB2.4 MB4.3 MB3/3
Georgian (historical orthography)
kat_old
1.0 MB413.2 KB3.0 MB3/3
German
deu
14.7 MB1.5 MB8.2 MB3/3
German (Fraktur script)
deu_frak
1.9 MB1/3
German (Fraktur script)
deu_latf
21.8 MB6.1 MB12.3 MB3/3
German (Fraktur, legacy script)
frk
20 B1/3
Greek
ell
7.2 MB1.4 MB8.5 MB3/3
Greek
Greek
3.6 MB2.9 MB10.1 MB3/3
Gujarati
guj
1.9 MB1.4 MB8.1 MB3/3
Gujarati
Gujarati
4.8 MB4.8 MB6.7 MB3/3
Gurmukhi
Gurmukhi
4.7 MB4.0 MB11.1 MB3/3
Haitian Creole
hat
3.2 MB1.9 MB11.6 MB3/3
Han (Simplified, vertical)
HanS_vert
5.2 MB5.2 MB11.8 MB3/3
Han (Simplified)
HanS
5.7 MB5.7 MB15.9 MB3/3
Han (Traditional, vertical)
HanT_vert
5.2 MB5.2 MB11.8 MB3/3
Han (Traditional)
HanT
5.2 MB5.2 MB11.8 MB3/3
Hangul
Hangul
5.2 MB4.6 MB11.7 MB3/3
Hangul (vertical)
Hangul_vert
5.7 MB4.5 MB15.8 MB3/3
Hebrew
heb
5.2 MB938.9 KB3.5 MB3/3
Hebrew
Hebrew
5.3 MB4.6 MB11.7 MB3/3
Hindi
hin
1.6 MB1.1 MB11.3 MB3/3
Hungarian
hun
17.2 MB5.1 MB11.8 MB3/3
Icelandic
isl
8.6 MB2.2 MB9.0 MB3/3
Indonesian
ind
7.9 MB1.1 MB7.9 MB3/3
Inuktitut
iku
3.6 MB2.7 MB5.9 MB3/3
Irish
gle
4.4 MB1.1 MB3.8 MB3/3
Italian
ita
15.2 MB2.6 MB8.5 MB3/3
Italian (historical orthography)
ita_old
16.5 MB3.1 MB9.4 MB3/3
Japanese
Japanese
6.1 MB5.6 MB17.0 MB3/3
Japanese
jpn
34.0 MB2.4 MB13.7 MB3/3
Japanese (vertical)
Japanese_vert
6.1 MB6.1 MB17.0 MB3/3
Japanese (vertical)
jpn_vert
2.9 MB2.9 MB13.7 MB3/3
Javanese
jav
7.0 MB2.8 MB8.2 MB3/3
Kannada
kan
3.4 MB3.4 MB9.8 MB3/3
Kannada
Kannada
7.0 MB6.5 MB13.5 MB3/3
Kazakh
kaz
8.8 MB4.5 MB7.2 MB3/3
Khmer
khm
1.4 MB1.4 MB7.7 MB3/3
Khmer
Khmer
4.9 MB4.3 MB11.5 MB3/3
Korean
kor
14.6 MB1.6 MB11.9 MB3/3
Korean (vertical)
kor_vert
1.1 MB1.1 MB3.8 MB3/3
Kurdish
kmr
3.4 MB3.4 MB9.7 MB3/3
Kyrgyz
kir
14.7 MB9.5 MB11.4 MB3/3
Lao
lao
6.7 MB6.1 MB12.9 MB3/3
Lao
Lao
10.3 MB9.6 MB16.7 MB3/3
Latin
lat
8.8 MB3.0 MB9.3 MB3/3
Latin
Latin
86.3 MB85.2 MB96.7 MB3/3
Latvian
lav
10.1 MB2.6 MB5.4 MB3/3
Lithuanian
lit
12.0 MB3.0 MB9.8 MB3/3
Luxembourgish
ltz
2.5 MB2.5 MB12.1 MB3/3
Macedonian
mkd
5.1 MB1.5 MB3.3 MB3/3
Malay
msa
7.9 MB1.7 MB7.8 MB3/3
Malayalam
mal
5.7 MB5.0 MB11.9 MB3/3
Malayalam
Malayalam
8.6 MB8.6 MB10.6 MB3/3
Maltese
mlt
7.1 MB2.2 MB4.8 MB3/3
Māori
mri
842.8 KB842.7 KB3.4 MB3/3
Marathi
mar
3.0 MB2.0 MB12.8 MB3/3
Math / equation detection
equ
2.1 MB2.1 MB2.1 MB3/3
Middle English
enm
5.0 MB3.0 MB12.7 MB3/3
Middle French
frm
17.0 MB1.9 MB3.9 MB3/3
Mongolian
mon
2.0 MB2.0 MB8.2 MB3/3
Myanmar
Myanmar
7.5 MB7.5 MB14.0 MB3/3
Nepali
nep
2.1 MB979.4 KB11.8 MB3/3
Norwegian
nor
11.8 MB3.4 MB13.6 MB3/3
Occitan
oci
6.0 MB6.0 MB12.3 MB3/3
Odia
ori
1.4 MB1.4 MB7.7 MB3/3
Orientation & script detection
osd
10.1 MB10.1 MB10.1 MB3/3
Oriya
Oriya
5.5 MB5.5 MB15.5 MB3/3
Pashto
pus
1.7 MB1.7 MB11.4 MB3/3
Persian
fas
548.1 KB421.4 KB3.2 MB3/3
Polish
pol
18.4 MB4.5 MB11.4 MB3/3
Portuguese
por
14.6 MB1.9 MB7.8 MB3/3
Punjabi
pan
1.6 MB486.1 KB11.3 MB3/3
Quechua
que
4.8 MB4.8 MB10.3 MB3/3
Romanian
ron
10.5 MB2.3 MB9.2 MB3/3
Russian
rus
19.0 MB3.7 MB14.6 MB3/3
Sanskrit
san
11.8 MB11.8 MB14.4 MB3/3
Scottish Gaelic
gla
2.9 MB2.9 MB9.2 MB3/3
Serbian
srp
7.1 MB2.1 MB8.9 MB3/3
Serbian (Latin script)
srp_latn
8.9 MB3.1 MB9.4 MB3/3
Sindhi
snd
1.6 MB1.6 MB11.4 MB3/3
Sinhala
sin
1.6 MB1.6 MB7.9 MB3/3
Sinhala
Sinhala
4.6 MB4.6 MB6.5 MB3/3
Slovak
slk
13.4 MB4.2 MB11.0 MB3/3
Slovak (Fraktur script)
slk_frak
825.6 KB1/3
Slovenian
slv
9.5 MB2.9 MB5.6 MB3/3
Spanish
spa
17.4 MB2.2 MB12.9 MB3/3
Spanish (historical orthography)
spa_old
18.7 MB2.8 MB9.0 MB3/3
Sundanese
sun
1.3 MB1.3 MB3.9 MB3/3
Swahili
swa
5.7 MB2.1 MB4.7 MB3/3
Swedish
swe
13.0 MB4.0 MB13.7 MB3/3
Syriac
syr
2.1 MB2.1 MB11.9 MB3/3
Syriac
Syriac
5.5 MB5.5 MB14.6 MB3/3
Tajik
tgk
3.5 MB2.5 MB4.4 MB3/3
Tamil
tam
3.2 MB3.1 MB5.7 MB3/3
Tamil
Tamil
7.8 MB6.8 MB17.7 MB3/3
Tatar
tat
1.0 MB1.0 MB7.2 MB3/3
Telugu
tel
3.2 MB2.6 MB8.7 MB3/3
Telugu
Telugu
6.8 MB6.2 MB13.3 MB3/3
Thaana
Thaana
5.8 MB5.8 MB12.2 MB3/3
Thai
tha
1.0 MB1.0 MB7.3 MB3/3
Thai
Thai
4.6 MB4.1 MB11.0 MB3/3
Tibetan
bod
1.9 MB1.9 MB8.2 MB3/3
Tibetan
Tibetan
5.4 MB5.4 MB11.9 MB3/3
Tigrinya
tir
2.1 MB369.9 KB2.3 MB3/3
Tongan
ton
925.1 KB925.0 KB3.6 MB3/3
Turkish
tur
17.9 MB4.3 MB7.1 MB3/3
Ukrainian
ukr
11.8 MB3.6 MB10.4 MB3/3
Urdu
urd
1.3 MB1.3 MB7.6 MB3/3
Uyghur
uig
2.7 MB2.7 MB12.5 MB3/3
Uzbek
uzb
10.3 MB6.2 MB12.4 MB3/3
Uzbek (Cyrillic script)
uzb_cyrl
4.7 MB1.5 MB4.1 MB3/3
Vietnamese
vie
7.4 MB518.8 KB11.9 MB3/3
Vietnamese
Vietnamese
1.6 MB1.6 MB11.9 MB3/3
Welsh
cym
5.7 MB2.1 MB8.3 MB3/3
Western Frisian
fry
1.8 MB1.8 MB8.1 MB3/3
Yiddish
yid
4.7 MB532.8 KB3.1 MB3/3
Yoruba
yor
940.8 KB940.8 KB3.6 MB3/3