Подсказки для поиска

Распространение генеративных моделей делает проверку текстов на плагиат недостаточной

В рамках исследования авторы работы (сотрудники двух факультетов МГУ — иностранных языков и регионоведения, вычислительной математики и кибернетики) протестировали способность пяти ведущих больших языковых моделей — ChatGPT-4, Gemini-pro-1.5, Claude 3 Opus, Llama3-70b и Microsoft Phi-3 — выполнять письменные задания из популярных учебников, выпущенных издательствами Oxford University Press и Pearson Education.

Моделям требовалось выполнить следующие учебные задания: написать формальное электронное письмо, формальное электронное письмо с подробными инструкциями, письмо с жалобой, неформальное электронное письмо, сопроводительное письмо, статью с описанием веб-сайта, эссе с аргументацией позиций за и против; составить описание города, описание человека или места и другие.

Тексты оценивались системой PlagiarismChecker.ai по следующим критериям: количество слов, доля продвинутого словарного запаса (относящегося к уровням B2–C1), дополнительные структурные элементы (заголовки, названия разделов) и уникальность текста.

По результатам проверки уникальность выше 75% показали 80% текстов, составленных языковыми моделями. Лучше всего справился ChatGPT4о. В заданиях на электронные письма модель показала уникальность 60–85%, что авторы считают высоким результатом, несмотря на обнаружение типичных фраз. ChatGPT4о сгенерировал подробный текст эссе (523 слова) со стопроцентной уникальностью, хотя словарный запас B2–C1 не был самым большим. Ниже всего по параметру уникальности оказались сопроводительные письма, однако, по словам авторов исследования, это рассматривается как преимущество, поскольку свидетельствует о воспроизведении стандартизированных формул.

В то же время 32 из 36 текстов, сгенерированных Gemini, Claude, Llama, Phi, были определены как тексты, со стопроцентной вероятностью сгенерированные ИИ (авторы не указывают, какой инструмент использовался для этого). Что касается ChatGPT4о, только один из девяти сгенерированных ею текстов (неформальное электронное письмо) был квалифицирован как сгенерированный с вероятностью меньше ста процентов (61%). Авторы считают, что выбранный ими детектор ИИ почти идеально отслеживает происхождение текста.

Исследователи делают вывод, что с учетом возможностей ИИ необходимо изменить подход к составлению письменных заданий, иначе недобросовестные учащиеся вместо плагиата будут сдавать уникальные, но сгенерированные нейросетью работы. Акцент должен быть сделан не на воспроизведении готовых шаблонов, а на умении критически и творчески мыслить. В то же время они отметили, что LLM могут выступать в качестве партнера по обучению или цифрового репетитора для изучающих иностранные языки, компенсировать недостаток адекватной речевой практики для самостоятельного изучения.

Портал «Грамота.ру»

Еще на эту тему

Разработаны инструменты выявления сгенерированных фрагментов в научных текстах

С их помощью можно будет отличать добросовестные публикации от «фейковых»

Новую технологию распознавания сгенерированных текстов разрабатывают в НИУ ВШЭ

Результаты проекта «Поймай бота» будут доступны пользователям в 2025 году

Как отличить текст, написанный нейросетью? Ряд критериев предложен на «Хабре»

ИИ не способен к оригинальному мышлению и творческому осмыслению информации

все публикации

А и Б сидели на трубе: семь детских книг о буквах и знаках

Иногда А, Я и даже точка могут стать главными героями поучительных историй

Опять запятые! Сложный пунктуационный тест

Десять цитат из русской классики, которые нужно написать без ошибок

Михаил Штудинер не спешит изгонять из языка то, что в нем еще живо

Автор «Словаря трудностей русского языка» — об объективном характере нормы и ее субъективной фиксации

Как менялись библиотеки?

История книжных коллекций от собраний табличек до храмов литературы в новой книге МИФа

Новое образование для «нового человека»: как учили грамоте в советской школе сто лет назад

31 августа исполняется сто лет декрету о всеобщем начальном обучении в РСФСР

Язык и пространство: что находится в центре мира?

Реки, горы и стороны света могут быть встроены в языковую систему координат, объясняет Валерий Шульгинов

Курсы лекций Ирины Кобозевой и Андрея Кибрика доступны на платформе Teach-in

Не нужно быть студентом, чтобы погрузиться в лексическую семантику и ареальную лингвистику

Как философы пытались создать идеальные языки

Продуманные, точные — но абсолютно непригодные для общения

Чем речовка лучше речевки? Три переменчивых неологизма XX века 

Раньше слова «речовка», «плащовка» и «мелочовка» писались по-другому

От пашни до веб-сайта: что верстает верстальщик?

В истории названия распространенной современной профессии разбиралась лингвист Ирина Фуфаева

В издательстве «МИФ» вышла книга о книгах

Как создавали, распространяли и запрещали книги

Андрей Кибрик о русскоязычных жителях Аляски и особенностях их диалекта

Сохранить аляскинский русский невозможно, но необходимо его документировать

Чем нас привлекает общение с языковыми моделями

Чат-бот может быть удобным собеседником, но для некоторых людей это удобство чревато проблемами

В научном сообществе исследование обсценных слов находится под запретом

Так считают авторы заметок о русском мате Анатолий Баранов и Дмитрий Добровольский

Лучшие программы-корректоры на основе ИИ

Роботы уже могут исправить большинство ошибок, но сами добавляют новые

Горячая десятка заимствований: что тут сложного?

Пользователи Грамоты часто ищут информацию об этих заимствованиях, которые еще не освоились в русском языке

Язык тела: как жесты помогают нам общаться

Они дополняют, уточняют и даже заменяют слова

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
От 2320 ₽
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2024 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!