Яндекс оцифрует 2 млн страниц рукописей Льва Толстого к его юбилею
Компания Яндекс объявила о начале масштабного сотрудничества с фондом «Наследие Льва Толстого», став генеральным цифровым партнером проекта по сохранению литературного наследия классика. К 200-летию со дня рождения писателя, которое будет отмечаться в 2028 году, планируется перевести в цифровой формат и систематизировать колоссальный объем архивных материалов. Проект направлен на создание современной цифровой экосистемы, объединяющей тексты, изображения и аудиовизуальные данные.
Масштабная цифровизация архивов в Ясной Поляне
Основной задачей партнерства является обработка 2 миллионов листов из архива Государственного музея-заповедника «Ясная Поляна» и Государственного музея Л. Н. Толстого в Москве. Процесс оцифровки включает не только сканирование бумажных носителей, но и распознавание сложных рукописных текстов автора с помощью технологий машинного зрения. Согласно данным ТАСС, в рамках инициативы будут реализованы следующие технологические решения:
- Распознавание и систематизация уникальных черновиков и личных дневников.
- Создание нейросетевой модели для синтеза голоса Льва Толстого на основе сохранившихся фонограмм.
- Каталогизация и реставрация архивных фотографий с использованием искусственного интеллекта.
- Разработка виртуального пространства (метавселенной) по мотивам ключевых произведений автора.
Искусственный интеллект на службе литературы
Применение нейросетей позволит исследователям и широкой аудитории получить доступ к ранее трудночитаемым материалам. Технологии Яндекса помогут структурировать цифровую экосистему, в которой произведения будут связаны с историческим контекстом, картами перемещений писателя и комментариями экспертов. Это позволит по-новому взглянуть на творческий путь автора «Войны и мира» и «Анны Карениной» через призму современных технологий Data Science.
Планируется создать полноценный цифровой мир Толстого, где ИИ поможет не только сохранить наследие, но и сделать его интерактивным для новых поколений читателей.
Реализация проекта станет важным этапом подготовки к празднованию юбилея писателя в мировом масштабе. Использование искусственного интеллекта для обработки архивных данных такого объема является беспрецедентным случаем для российской культурной сферы, открывающим новые возможности для филологических исследований и образовательных программ.