Подсказки для поиска
Новогодняя игра: Грамота предсказывает будущее. Хочу погадать!
Хочу погадать!

Нейросети научатся применять сложные правила русского языка

Современные программы, которые генерируют тексты, научились писать довольно складно. Однако они часто спотыкаются именно на сложных правилах русского языка, поскольку в материалах, на которых их обучают, примеров применения таких правил крайне мало.

Исследователи из МГУ и «Яндекса» разработали специальный учебный материал, призванный помочь программам лучше понимать и применять правила орфографии и пунктуации. Речь идет о самых трудных случаях, которые проверяют на ЕГЭ и олимпиадах.

База данных под названием LORuGEC включает тысячу примеров текстов с типичными ошибками и исправленными вариантами. В этой коллекции представлены 48 правил русского языка — от постановки запятых в сложноподчиненных предложениях до слитного или раздельного написания частицы не. Каждый пример не только показывает, как правильно, но и объясняет, какое правило применяется в конкретном случае.

Когда программа видит текст с ошибкой, она сначала ищет в базе похожие случаи, а уже потом исправляет. Например, если пропущена запятая перед союзом «что», программа будет ориентироваться на пример с такой же ошибкой, а не на любой другой случай неправильной пунктуации. Благодаря этому программа исправляет только то, что действительно неверно.

«Яндекс» проверил новый метод на своих больших языковых моделях YandexGPT 5 Lite и YandexGPT 5 Pro, а также на зарубежных аналогах. Точность исправления ошибок в сложных случаях выросла на 5–10%. Самая продвинутая версия программы теперь верно исправляет ошибки в 83% случаев, более простая — в 71%.

База данных и метод обучения выложены в открытый доступ, чтобы любой разработчик или исследователь мог их использовать бесплатно. Особенно полезными они могут оказаться для создания образовательных программ и приложений, которые помогают школьникам и студентам изучать русский язык.

Проект был представлен на международной конференции по компьютерной лингвистике ACL 2025 и получил приз за лучшую разработку на воркшопе, посвященном использованию ИИ в образовании. О достижениях также рассказали на Конгрессе молодых ученых, который проходит в эти дни в Научно-технологическом университете «Сириус».

Портал «Грамота.ру»

Еще на эту тему

Яндекс привлекает школьных учителей литературы для обучения «Алисы»

Их участие сделает ИИ-помощника более полезным для образовательного процесса

Проверка грамотности — один из самых частых запросов школьников к нейросетям

Это следует из опроса, проведенного российской компанией MAXIMUM Education

Нейросети проиграли людям при поиске грамматических ошибок

Это открытие ставит под сомнение языковые компетенции моделей

все публикации

Как дети учатся говорить

Освоение языка на уровне родного происходит до 6–7 лет

Что такое геймерский жаргон и как он вышел за пределы игрового мира

«Заспавнил мобов» и «затащил катку» в переводе на русский литературный

«Живи себе нормальненько!»

Лингвист Ирина Левонтина — о языковой эволюции нормальности

Что подарить человеку читающему? Пять книг о языках и текстах

Языки можно учить, изучать и использовать для дела и удовольствия

Что означали эти слова в позднесоветскую эпоху?

Вспоминаем реалии прошлого, которые ушли из нашей жизни вместе с их названиями

Сергей Татевосов: «Наш язык — организм с прекрасной системой пищеварения»

Как меняется русский язык? Лингвисты по просьбе Грамоты рассказывают о главных трендах

Супер, гипер, мега и другие: найдите десять отличий в значении приставок

Есть ли что-то общее у Супермена с суперпозицией, а у гипертекста — с гипермаркетом

Леонид Крысин: «Это было изучение всех ипостасей русского языка»

Лингвист рассказал порталу Arzamas о своей жизни и о том, зачем заниматься наукой

Фекла Толстая: «Язык становится разнообразнее»

Как меняется русский язык? Наши друзья и партнеры рассказывают о главных трендах

«Вы» с прописной буквы — правило устарело?

За подчеркнутой вежливостью может скрываться пассивная агрессия

Слово как оружие: фэнтези о тайной библиотеке и волшебной печатной машинке

В издательстве «МИФ» вышел перевод книги Карстена Хенна «Золотая печатная машинка»

Проявленность: следующий шаг после «быть собой»

В языке поп-психологии у осознанности появилась пара

«Академос» — орфографический ресурс, а не словарь новых слов

Сотрудники Института русского языка имени В. В. Виноградова рассказали о задачах онлайн-ресурса

Сигма: независимый одиночка

Как песня в исполнении двух юных девушек прославила новый тип мужчины

Лингвист Игорь Мельчук вспоминает о жизни и науке середины XX века

Ведущие подкаста «Глагольная группа» анонсировали серию разговоров со знаменитым ученым

Слоп: низкокачественный ИИ-контент

Когда нейросети засоряют интернет-пространство бессмысленными «помоями»

Федор Успенский: «Меня раздражает, когда привычные вещи, на которых я вырос, начинают меняться»

Как меняется русский язык? Лингвисты по просьбе Грамоты рассказывают о главных трендах

Ред-флаг: предупреждение об опасности

Тревожные звоночки еще можно игнорировать, а от красных флагов лучше сразу бежать

Пупупу: новое междометие

Реакция на негатив, задумчивость и принятие неизбежного

Промпт: запрос к языковой модели

С новыми технологиями в нашем активном лексиконе появляются и новые слова

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2025 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!