NayanaOCR Corpus
Библиотека от Hugging Face для работы с крупнейшим открытым многоязычным корпусом документов.
Содержит более 1 миллиона изображений документов, охватывающих множество языков и стилей. Идеально подходит для обучения и тестирования моделей оптического распознавания символов (OCR).
Источник: @huggingface, 26-05-2026