Подсказки для поиска

Минимум 13% аннотаций к научным статьям создается с помощью нейросетей

Генеративные нейросетевые модели уже используются в научных текстах, и это не новость. Но насколько активно ученые прибегают к таким инструментам — хотя бы на уровне создания аннотаций к своим статьям?

Группа ученых из Германии и США проанализировала более 15 млн англоязычных аннотаций биомедицинских статей из базы PubMed с 2010 по 2024 год. Их интересовали статистически измеримые перемены в лексике, которые бы указывали на «почерк» нейросетей. Для этого была использована методика выявления «избыточных» слов. Она работает как предсказательная модель, основанная на вероятности. Например, мы привыкли видеть определенное количество автомобилей на дороге каждый день. В какой-то момент мы замечаем, что их стало значительно больше — или появились новые, необычные модели. Это и есть «избыточность».

В данном случае исследуются не автомобили, а слова. Если слово было связано с темой статьи (например, «коронавирус»), его определяли как «содержательное». А если оно относилось скорее к стилю написания (например, «тщательно», «важно», «неотъемлемый»), его называли «стилевым». Поскольку появление «стилевых» избыточных слов совпало с массовым распространением генеративных нейросетевых моделей, авторы считают, что эти слова являются своего рода «отпечатками пальцев» этих моделей.

Чем больше избыточных стилевых слов, тем выше вероятность того, что текст был целиком или частично сгенерирован.

Согласно выводам статьи, использование следующих «избыточных» слов отличало тексты, написанные в период 2023–2024 годов: delves (углубляется), underscores (подчеркивает), showcasing (демонстрируя), potential (возможный, потенциальный), findings (результаты, выводы), crucial (ключевой, важный), significant (существенный), these (эти). Другими словами, они стали широко использоваться в те годы, когда началось активное развитие генеративных нейросетей (ChatGPT вышел в 2022 году).

Признаки сгенерированного текста были обнаружены в 13,5% аннотаций 2024 года.

И это по самым мягким оценкам, подчеривают авторы. На самом деле доля таких текстов, вероятно, выше, поскольку метод не учитывает аннотации, не содержащие выбранных стилевых маркеров. Реальный объем использования нейросетей в биомедицинских публикациях может достигать 30%.

Нейросети могут исправлять грамматику и улучшать «читабельность» текста, но при этом они склонны искажать факты, создавать вымышленные данные, усиливать предвзятость. Такие тексты менее оригинальны, в них меньше новизны, языковые средства менее разнообразны. По мнению авторов, использование нейросетей при подготовке текстов ставит под сомнение добросовестность исследователей, а текущие правила использования генеративных нейросетей в науке требуют пересмотра.

Портал «Грамота.ру»

Еще на эту тему

Чем сгенерированные тексты отличаются от написанных человеком

Большие языковые модели «выдают себя» аномально частым использованием определенных языковых конструкций

Новую технологию распознавания сгенерированных текстов разрабатывают в НИУ ВШЭ

Результаты проекта «Поймай бота» будут доступны пользователям в 2025 году

Как отличить текст, написанный нейросетью? Ряд критериев предложен на «Хабре»

ИИ не способен к оригинальному мышлению и творческому осмыслению информации

все публикации

Почувствуйте себя консультантом справочной службы Грамоты

Мы предлагаем вам ответить на вопросы, которые задавали пользователи в 2025 году

Максим Кронгауз: «Разграничить язык интернета и язык вне интернета стало невозможно»

Как меняется русский язык? Лингвисты по просьбе Грамоты рассказывают о главных трендах

Зачем нам нужен язык на самом деле?

Лингвист Валерий Шульгинов — о коммуникативной и символической функциях языка

Система TALK: как общаться легче и эффективнее

Вышел перевод на русский язык книги Элисон Вуд Брукс «Простой сложный разговор»

Почему князь Святослав пил «синее вино»?

Разгадка этой и других словесных тайн — в новой книге филолога Марии Елифёровой

Оскорбление как искусство, ритуал и путь к просветлению

Рискованные речевые акты могут приносить пользу, если они встроены в традиционную культуру

Нетудашка, сердцежмяк и другие новые слова в книге Бориса Иомдина

Русский язык постоянно пополняется не только заимствованиями 

Как животные обрели свои имена: семь детективных историй о зоонимах

Водяная лошадь из Библии, загадочная страна Лемурия и слон, ставший верблюдом

Думать вредно? Чем наивная дурочка лучше продуманной твари

Лингвист Ирина Левонтина описала новое значение старого прилагательного

Способы выражения вежливости в русском и других языках

«Вежливыми» могут быть местоимения, глаголы и даже приставки и суффиксы

Катавасия, близорукость и блины для медведей: когда слова сбивают нас с толку

Народная этимология предлагает фантастические объяснения вместо научных фактов

В чем вопрос? Юбилейный тест для новичков и ветеранов Грамоты

Мы проанализировали ваши вопросы и запросы, чтобы понять, что вас волнует больше всего

Словарь аббревиатур русского языка как государственного определит нормы для разных типов сокращений

Главные трудности связаны с определением рода, склонением и произношением

Дислексия и дисграфия могут быть связаны не только с речевыми нарушениями, но и с недостатком самоконтроля

Ольга Величенкова о разных ошибках в письме, прогнозировании школьной неуспешности и умении сосредоточиться на главном

Плеоназмы со смыслом, неологизмы для мужчин и всякие штуки: вышел новый номер «Трудов ИРЯ РАН»

Кое-что о современной русской лексике в сборнике статей к 90-летию Леонида Крысина

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
От 2320 ₽
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2025 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!