Подсказки для поиска

Семантические издания Толстого, Пушкина и Чехова — новый способ существования литературных текстов

Семантические издания Толстого, Пушкина и Чехова — новый способ существования литературных текстов
В коллаже использованы материалы фотобанка Pexels и pushkin-digital

Цифровые технологии сегодня позволяют превратить любое собрание сочинений в настоящую базу данных, чтобы увидеть многочисленные связи внутри текста и между текстами, выявить необычные закономерности.

«Семантическое издание — это представление текста в виде связанных данных. Для этого текст должен быть размечен, то есть его элементам приписана информация об их значении в виде организованных меток в машиночитаемом формате. Притом формат должен быть универсальным: то есть для разметки одних и тех же сущностей в разных текстах должны использоваться одни и те же метки»1.

В основе проекта Слово Толстого — электронная версия девяностотомного собрания сочинений Льва Толстого. Запуск проекта состоялся осенью 2022 года и стал результатом многолетней работы группы Tolstoy Digital под руководством Феклы Толстой, в которой участвовали Государственный музей Л. Н. Толстого, НИУ ВШЭ и компания ABBYY. Пользователю доступен поиск по корпусу текстов, а также многочисленные словарные и справочные материалы. В дальнейшем база будет пополнена книгами из личной библиотеки Толстого, письмами и дневниками самого писателя и членов его семьи и работами исследователей. 

Семантическое издание полного собрания сочинений Чехова Chekhov Digital разрабатывает Южный федеральный университет совместно с Центром гуманитарных исследований НИУ ВШЭ. Ресурс позволяет использовать как обычный поиск по слову или фразе, так и расширенный — по году, тому, изданию, месту написания, по жанру или объему произведения и другим параметрам. Можно искать фрагменты текста по именам персонажей, по названиям животных или природным явлениям. 

Проект Pushkin Digital основан на материалах академического полного собрания сочинений Пушкина, которые подготовлены в Пушкинском Доме — ИРЛИ РАН. Здесь вместо тегирования информации фокус сделан на комментировании и создании гипертекстуальности. Помимо обширного историко-литературного комментария доступно большое количество внешних ссылок, книг и статей, а также аудио- и видеоматериалов. Оцифрованы десятки рукописей, к ним дается специальная расшифровка, благодаря чему можно проследить ход работы писателя. В отдельном каталоге собраны иллюстрации художников к произведениям Пушкина. 

Семантические издания полезны как для профессионалов, так и для всех, кто интересуется русской литературой, поэтому таких проектов будет становиться все больше. Например, обсуждаются перспективы объединения усилий для создания цифрового Достоевского.  Подробнее о разнообразных проектах в этой области можно прочитать на портале «Горький».

Портал «Грамота.ру»

Еще на эту тему

Современные онлайн-ресурсы расширяют возможности исследователей русского языка

Инструменты, разработанные сотрудниками ИЛИ РАН, будут интересны и неспециалистам

Как цифровизация помогает сохранить языки коренных народов России

Голосовые помощники, цифровые учебники и онлайн-переводчики вносят вклад в создание языковой среды

все публикации

От копирайта до копилефта: как менялось авторское право на тексты

Почему «Гамлет» при жизни Шекспира принадлежал театральной труппе и чем важен спор вокруг Микки Мауса

Модные слова добавляют ярких красок в палитру общения

Ими хочется щеголять, но лучше делать это аккуратно, считают гости программы «Наблюдатель»

Возможно ли дешифровать письменность острова Пасхи?

Лингвист Евгения Коровина о тайне дощечек ронго-ронго

«Это роли не играет»: какие устойчивые словосочетания мы используем в речи

В программе «Наблюдатель» лингвисты рассказали о фразеологизмах из разных языков и культур 

Названия стран и народов: реальность меняется, а языковая норма остается?

Бирма стала Мьянмой, но нас больше волнуют Беларусь и Кыргызстан

В Метасловаре Грамоты есть возможность проверять ударения при подготовке к ЕГЭ по русскому языку

Все слова, вошедшие в орфоэпический словник, отмечены специальной плашкой

Учитель Сергей Валюгин: «Грамотный язык сближается с искусством»

О речи школьников, понимании Пушкина и о том, как владение языком становится новой ценностью

Семантические сдвиги: почему слова меняют смысл

Новые значения возникают не только в соответствии с языковыми законами, но и в результате ошибок

Пять мифов о том, как устроены естественные языки

Владимир Плунгян отделяет распространенные заблуждения от данных лингвистической науки

Должен ли извиняться этичный ИИ?

Лингвист Валерий Шульгинов готов прощать ботов только на определенных условиях

«Моя мама — копия ее мама»: что случилось с падежом

Лингвист Ирина Левонтина о причудах не генетики, но грамматики

Как используется слово «фидбэк» в современном русском языке

Вышел второй номер журнала «Русская речь» за 2026 год

Школьный жаргон XIX века: бонсюжешки ушли, а ерунда осталась

Про гимназическое прошлое многих слов мы даже не догадываемся

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2025 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!