Подсказки для поиска

Можно использовать знаки подстановки

Российские исследователи предложили новую модель генерации ключевых слов к научным текстам

Ключевые слова в научных статьях, монографиях и других текстах нужны для того, чтобы потом по этим словам публикация могла быть отнесена к определенной теме и нашлась в поиске. Было бы удобно «вычислять» ключевые слова с помощью нейросетевых алгоритмов, которые автоматически прочитывают текст и определяют, о чем там идет речь.

Сейчас подходы к определению ключевых слов в основном строятся на выделении их из текста. Однако в этом случае классификация может быть неполной. Например, для слов и словосочетаний нейросеть, большая языковая модель и машинное обучение можно подобрать обобщающий термин искусственный интеллект. Однако в тексте его может и не быть. Другими словами, важно, чтобы алгоритм не только находил ключевые слова в тексте, но и добавлял слова, семантически связанные с содержанием текста.

Исследователи из Института проблем передачи информации им. Харкевича РАН и их коллеги с кафедры программного обеспечения Школы компьютерных наук ТюмГУ предложили новый подход к генерации ключевых слов для русскоязычных научных текстов. Они использовали модель mT5, которая хорошо зарекомендовала себя в автоматическом реферировании русскоязычных текстов.

Что нейросети умеют делать с текстами и чем предстоит заняться человекуЭксперты обсудили, как мы будем взаимодействовать с ИИВ результате использования модели список ключевых слов, относящихся к теме анализируемых текстов, расширился. В выбранном корпусе доля ключевых слов, не встречающихся в текстах в явном виде, составила 53,17% для обучающей выборки и 54,8% — для тестовой.  

При этом у примененного подхода есть ограничения. Использование mT5 для генерации ключевых слов потребовало дообучения на текстах из определенной предметной области. При использовании ее для текстов других предметных областей результаты могут быть не такими точными. Ведь чем более специфична обучающая выборка, тем более точными будут результаты генерации.

Портал «Грамота.ру»

Еще на эту тему

Научный стиль: точность не в ущерб понятности

Им пользуются авторы учебников, исследователи, лекторы, научные журналисты

Искусственный интеллект научили создавать конспекты научных статей

Разработчики надеются, что это поможет повысить доступность информации

Чат-боты GPT и другие: что думают лингвисты о больших языковых моделях

Впереди демократизация порождения текстов и большие риски злоупотреблений

все публикации

«Дорогие дети! Я в вас верю, всё будет в порядке!»

Психолог Елена Морозова о том, как пережить ЕГЭ

Что такое бывшие диминутивы и как они возникают

Зяблик, ласточка, букашка потеряли связь со своими «родителями» и стали самостоятельными словами

Николай Карамзин, сентименталист-революционер

Рассказываем о ключевых исторических фигурах, повлиявших на развитие русского письменного языка

Что в эмодзи тебе моем: как смайлы помогают и мешают нам общаться

Улыбка в рабочей переписке может оскорбить, а пицца в описании профиля — напугать

Термины родства и свойства́ в русском языке

В День семьи разбираемся, чьим мужем может быть зять и от кого нужно скрываться невестке

Евгений Головко о связи лингвистики с науками о человеке и обществе

Для антропологической лингвистики язык — прежде всего культурный маркер

Тест на общие корни: найдите дальних родственников!

Чтобы увидеть этимологические связи между русскими словами, приходится вспоминать латынь и греческий

Яков Грот, систематизатор русской орфографии

Рассказываем о ключевых исторических фигурах, повлиявших на развитие русского письменного языка

Какие фамилии в русском языке не склоняются?

На склонение фамилии влияет не только пол ее носителя

Почему так трудно выбрать номинацию для людей с инвалидностью?

Ни прямота, ни политкорректность сами по себе не решают проблемы

ИИ отбирает у человека языковое пространство?

О некоторых публикациях журнала «Русская речь» за 2025 год

Знакомый почерк: что мы теряем вместе с ручным письмом?

Могут пострадать память, когнитивные способности и эмоциональная связь с прошлым

Экономика языка, или Как одни слова обесценивают другие

Лингвист Валерий Шульгинов объясняет, почему крольчонок стал кроликом и что случилось со словом nice

Как устроено ударение в разных языках

Оно может быть силовым, музыкальным или даже вовсе отсутствовать

«Нелицеприятная оценка»: странные формы и употребления на пути из ошибок в норму

Лингвист Ирина Фуфаева с интересом наблюдает за говорящими, уверенными в своей непогрешимости

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
От 2320 ₽
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2024 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!
На сайте используются cookies. Продолжая использовать сайт, вы принимаете условия