Немецкая Transkribus распознаёт рукописи, но стоит дорого. Для российских исследователей это означает, что тысячи церковнославянских текстов XI–XVIII веков остаются необработанными. В МИФИ создают альтернативу — лингвистическую интеллектуальную среду с элементами самообучения. Ведущий научный сотрудник Института русского языка им. В.В. Виноградова РАН Александр Кравецкий заявил: «Зарубежные аналоги, такие как немецкая система Transkribus, существуют, но являются коммерческими и дорогими для массового использования».
Почему зарубежные системы не подходят
Transkribus — не единственная система распознавания рукописей, но одна из немногих, которая работает с историческими текстами. Однако она платная. Для массовой оцифровки тысяч экземпляров это создаёт барьер: исследователи вынуждены выбирать, какие тексты обрабатывать, а какие оставить нечитаемыми.
Российский проект ориентирован на создание доступного инструмента с элементами самообучения. Он будет постоянно пополняться новыми рукописями. Это принципиально иной подход: не покупка лицензии, а собственная разработка.
Что уже сделано
В распоряжении исследователей 247 оцифрованных рукописей — более 110 000 страниц. Идёт работа по составлению каталога почерков и очистке изображений. Накопленный материал скармливается разным моделям искусственного интеллекта, созданным в МИФИ.
В чём сложность
Главная проблема не в ветхости бумаги, а в вариативности почерков. Буквы «и» и «н» похожи, «К» кто-то пишет как палочку с двумя диагоналями, а кто-то — как палочку со скобочкой справа. Машина должна понимать, что текст может обрываться на «зачале» — двух-трёх первых словах песнопения.
Что это даёт
Анализ тысяч экземпляров вместо десятков. Это позволит выявлять исправления текстов, которые предпринимались не только при патриархе Никоне в XVII веке, но и раньше. Даже в «Слове о полку Игореве» можно будет найти цитаты из богослужебных книг.
Коротко: главное
-
Почему не используют Transkribus? — Система коммерческая и дорогая.
-
Что создают в МИФИ? — Доступный инструмент с самообучением.
-
Сколько рукописей оцифровано? — Всего 247, более 110 000 страниц.
-
В чём сложность для машины? — Вариативность почерков.
-
Что даст проект? — Анализ тысяч экземпляров вместо десятков.
Резюме
-
Коммерческие системы распознавания рукописей дороги для массового использования.
-
В МИФИ создают доступную альтернативу с элементами самообучения.
-
Уже оцифровано 247 рукописей, более 110 000 страниц.
-
Главная сложность — вариативность почерков, а не ветхость бумаги.
-
Проект позволит анализировать тысячи экземпляров вместо десятков.
Материал подготовлен изданием «Техносуверен» (technosuveren.ru).
Дата публикации: 24 сентября 2026 года.






















