OCR 2017: tesseract-4.0.0-alpha.20170703/004-9885/0269.hocr OCR 2018: tesseract-4.0.0-20181201/004-9885/0269.hocr