Подсказки для поиска

Семантические издания Толстого, Пушкина и Чехова — новый способ существования литературных текстов

Семантические издания Толстого, Пушкина и Чехова — новый способ существования литературных текстов
В коллаже использованы материалы фотобанка Pexels и pushkin-digital

Цифровые технологии сегодня позволяют превратить любое собрание сочинений в настоящую базу данных, чтобы увидеть многочисленные связи внутри текста и между текстами, выявить необычные закономерности.

«Семантическое издание — это представление текста в виде связанных данных. Для этого текст должен быть размечен, то есть его элементам приписана информация об их значении в виде организованных меток в машиночитаемом формате. Притом формат должен быть универсальным: то есть для разметки одних и тех же сущностей в разных текстах должны использоваться одни и те же метки»1.

В основе проекта Слово Толстого — электронная версия девяностотомного собрания сочинений Льва Толстого. Запуск проекта состоялся осенью 2022 года и стал результатом многолетней работы группы Tolstoy Digital под руководством Феклы Толстой, в которой участвовали Государственный музей Л. Н. Толстого, НИУ ВШЭ и компания ABBYY. Пользователю доступен поиск по корпусу текстов, а также многочисленные словарные и справочные материалы. В дальнейшем база будет пополнена книгами из личной библиотеки Толстого, письмами и дневниками самого писателя и членов его семьи и работами исследователей. 

Семантическое издание полного собрания сочинений Чехова Chekhov Digital разрабатывает Южный федеральный университет совместно с Центром гуманитарных исследований НИУ ВШЭ. Ресурс позволяет использовать как обычный поиск по слову или фразе, так и расширенный — по году, тому, изданию, месту написания, по жанру или объему произведения и другим параметрам. Можно искать фрагменты текста по именам персонажей, по названиям животных или природным явлениям. 

Проект Pushkin Digital основан на материалах академического полного собрания сочинений Пушкина, которые подготовлены в Пушкинском Доме — ИРЛИ РАН. Здесь вместо тегирования информации фокус сделан на комментировании и создании гипертекстуальности. Помимо обширного историко-литературного комментария доступно большое количество внешних ссылок, книг и статей, а также аудио- и видеоматериалов. Оцифрованы десятки рукописей, к ним дается специальная расшифровка, благодаря чему можно проследить ход работы писателя. В отдельном каталоге собраны иллюстрации художников к произведениям Пушкина. 

Семантические издания полезны как для профессионалов, так и для всех, кто интересуется русской литературой, поэтому таких проектов будет становиться все больше. Например, обсуждаются перспективы объединения усилий для создания цифрового Достоевского.  Подробнее о разнообразных проектах в этой области можно прочитать на портале «Горький».

Портал «Грамота.ру»

Еще на эту тему

Современные онлайн-ресурсы расширяют возможности исследователей русского языка

Инструменты, разработанные сотрудниками ИЛИ РАН, будут интересны и неспециалистам

Как цифровизация помогает сохранить языки коренных народов России

Голосовые помощники, цифровые учебники и онлайн-переводчики вносят вклад в создание языковой среды

все публикации

Лучшие программы-корректоры на основе ИИ

Роботы уже могут исправить большинство ошибок, но сами добавляют новые

Горячая десятка заимствований: что тут сложного?

Пользователи Грамоты часто ищут информацию об этих заимствованиях, которые еще не освоились в русском языке

Язык тела: как жесты помогают нам общаться

Они дополняют, уточняют и даже заменяют слова

Елочки или лапки? Как правильно использовать кавычки

Они нужны для оформления прямой речи, цитат, названий, а также слов, использованных иронически

Мария Каленчук: «Да, мы ориентируемся на живую речь!»

В издательстве «Грамота» вышел Большой словарь ударений

Кто эффективнее в изучении языка — человек или нейросеть?

«Язык опирается на врожденную систему знаний», — объясняет лингвист Наталия Слюсарь

Не только люди: с кем еще мы разговариваем по душам?

Лингвист Валерий Шульгинов напоминает, что до появления чат-ботов люди охотно общались со стихиями, куклами и техникой

Нейтральный язык эсперанто: благородная попытка объединить человечество

Был ли шанс у этого проекта, на который доктор Заменгоф потратил многие годы?

Что было написано на яблоке раздора? Тест на знание истории крылатых слов

Часто мы используем устойчивые выражения, точный смысл которых от нас ускользает

Как пишутся сложные топонимы: правила и исключения

Ново-Огарево отличается от Новосибирска, как Соль-Илецк от Сольвычегодска

Попадает в самое сердечко... Почему теперь так говорят?

Лингвист Ирина Фуфаева ищет причины экспансии этого диминутива в современной речи

Лингвист Борис Орехов: «Корпус русской классики дает доступ в языковую лабораторию авторов»

В Национальном корпусе русского языка теперь можно изучать и сравнивать языки писателей XIX века

Всё о чувствах и отношениях: почему язык психологии стал так популярен

Лингвисты, социологи и психологи обсуждают вред и пользу психотерапевтической волны в русском языке

Запретные слова: что думают лингвисты о нецензурной лексике как части русского языка

В издательстве МИФ вышла научно-популярная книга двух докторов филологических наук

«Слова года» полгода спустя: кто продолжает забег

Насколько точным был прошлогодний выбор Грамоты и как чувствуют себя «наши» неологизмы сегодня

Как устроены языковые манипуляции

Эти приемы используют публицисты, политики, телефонные мошенники и даже родственники

Что значит это региональное слово?

Не только «поребрик» и «мультифора» выдают малую родину говорящего

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
От 2320 ₽
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2024 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!