Подсказки для поиска

Люди и ChatGPT одинаково «видят» структуру предложений

Международная группа исследователей обнаружила, что большие языковые модели, такие как ChatGPT, обрабатывают предложения почти так же, как человеческий мозг, — разбивая их на иерархически упорядоченные блоки-составляющие, а не просто анализируя цепочку слов.

Классическая лингвистика со времен Ноама Хомского утверждает, что мозг превращает линейную последовательность слов в иерархическую структуру — дерево, где слова объединяются в группы (именные, глагольные, предложные...), те — в более крупные блоки, и так далее. Большие языковые модели не проектировались специально для построения таких деревьев, и до недавнего времени не было уверенности, что они способны использовать ту же языковую логику, что и человек.

В ходе эксперимента люди и нейросети выполняли необычное задание: им показывали пример удаления фрагмента из предложения, а затем просили применить такое же «правило» к новому предложению.

Оказалось, что и люди, и все протестированные модели (ChatGPT, GPT-4, Claude-3, Gemini-1, Llama-3) в подавляющем большинстве случаев удаляли именно полные лингвистические составляющие — например, целиком именную группу вроде большой красный дом, а не случайный набор слов. Частота таких «правильных» удалений была значительно выше случайного уровня (p<0,001).

Для контроля ученые использовали простую нейросеть LSTM, которая обрабатывает текст линейно и не обучалась на огромных массивах данных, — она справилась с задачей не лучше, чем если бы действовала наугад. Это означает, что наблюдаемое сходство в поведении людей и языковых моделей нельзя объяснить статистическими закономерностями, описывающими порядок слов.

Еще одно открытие: выбор стратегии зависел от языка. При работе с английским текстом и люди, и модели фокусировались на типе «родительского» узла в синтаксическом дереве, а с китайским — на типе той составляющей, которую они удаляли. Билингвы, для которых английский был вторым языком, переключались на «английское» правило при работе с английскими предложениями.

Авторы приходят к выводу о том, что нейросети, как и люди, не просто имеют представление о скрытой иерархической структуре предложения, но и применяют его на практике. Несмотря на принципиально разные механизмы работы и обучения, человеческий мозг и современные языковые модели анализируют и строят предложения схожим образом.

Предложенный метод, по мнению авторов, может стать новым диагностическим инструментом, позволяющим понять, действительно ли языковая модель усвоила абстрактные синтаксические представления или только запомнила статистические паттерны.

Портал «Грамота.ру»

Еще на эту тему

ChatGPT не справился с пониманием метафор в речах Трампа

Модель дала неверную интерпретацию слов в трети случаев

Кто эффективнее в изучении языка — человек или нейросеть?

«Язык опирается на врожденную систему знаний», — объясняет лингвист Наталия Слюсарь

Чем сгенерированные тексты отличаются от написанных человеком

Большие языковые модели «выдают себя» аномально частым использованием определенных языковых конструкций

все публикации

Откуда берутся разные варианты произношения?

Вышла книга Марии Каленчук об орфоэпических словарях

Одушевленное и неодушевленное в языке: как в этом разобраться

Почему мы встречаем важного клиента, но на компьютер устанавливаем клиент

Изоляты — языки без «родственников»

Как получилось, что им не нашлось места ни в одной языковой семье?

Берестяные грамоты находят даже в вечной мерзлоте

Алексей Гиппиус рассказал об итогах раскопок 2025 года

Лингвист Наталья Брагина о вежливости и конфликтной коммуникации в XXI веке

В выпуске программы «Говорим по-русски!» рассказали о том, как интонация и частицы могут сделать вежливое высказывание грубым

Местный для местных: секретный падеж русского языка

Почему мы говорим «о шкафе», но храним вещи «в шкафу»?

Еще раз про любовь

Лингвист Ирина Левонтина изучает оттенки современного языка для отношений

От торговцев до сидельцев: история тайного языка коробейников

Кем были офени, зачем они меняли слова и как стали «отцами» воровского арго

Бог: как правильно писать и произносить

Для орфографии имеет значение, о каком божестве мы говорим

Ирина Фуфаева об истории феминитивов и о том, чем они бывают полезны

Негативное восприятие специальных наименований для женских профессий связано с языком бюрократии

Почему нельзя сказать «напишомое»?

Самые неожиданные вопросы справочной службе

Авторский стиль и манера общения: что показывает анализ сгенерированных текстов

Вышел четвертый номер журнала «Коммуникативные исследования» за 2025 год

Уважение, эмпатия и компетентность — три кита цифрового этикета 

Ольга Лукинова рассказала об этичном общении в интернете

Путешествие за языком: что такое полевая лингвистика

Лингвист Сергей Татевосов объясняет, почему малые языки интересуют науку не меньше, чем большие и известные

О чем говорят популярные слова 2025 года

Усталость от ИИ, абсурд и сложные эмоции

Разговор с ИИ-сторонним: что такое промпт как часть коммуникации

Валерий Шульгинов решил разобраться в лингвистической природе диалога с нейросетью

Как дети учатся говорить

Освоение языка на уровне родного происходит до 6–7 лет

1/6
Большой универсальный словарь русского языка (2 тома)
1 — 4 классы
Морковкин В.В., Богачева Г.Ф., Луцкая Н.М.
4.3
Подробнее об издании
Купить на маркетплейсах:
Назовите ваше слово года!
Какие новые слова в 2025 году прочно вошли в вашу речь? На какие вы обратили внимание, какие стали чаще слышать вокруг? Участвуйте в выборе «Слова года» по версии Грамоты.
Отправить
Спасибо!
Мы получили ваш ответ и обязательно учтем его при составлении списка слов-кандидатов
Читать Грамоту дальше
Новые публикации Грамоты в вашей почте
Неверный формат email
Подписаться
Спасибо,
подписка оформлена.
Будем держать вас в курсе!