Генеративный искусственный интеллект может постепенно влиять не только на то, как создаются тексты, но и на саму письменную речь. Исследователь обнаружил характерные для языковых моделей слова и выражения в новостных материалах сразу на 34 языках.
Особенно интересно, что изменения стали заметнее после широкого распространения ChatGPT.
Как искали «почерк» искусственного интеллекта
Исследование провёл Томас Стефан Юзек из Florida State University. Он проанализировал большой массив новостных текстов на 34 языках и попытался определить слова, которые современные языковые модели используют заметно чаще людей.
После этого исследователь сравнил, как менялась частота подобных слов в реальных новостях до и после появления ChatGPT.
Результат оказался любопытным: в 26 из 34 языков характерные для ИИ слова стали встречаться чаще. Средний рост составил примерно 15%.
При этом специально подобранная группа обычных контрольных слов подобного увеличения не показала.
Какие слова особенно любит ИИ
У языковых моделей есть собственные речевые привычки.
Например, в английских текстах исследователи уже раньше замечали необычно частое употребление таких слов, как delve, underscore и intricate.
В новом исследовании похожие закономерности обнаружились и в других языках.
Особенно часто повторялись слова со значением «подчеркнуть», «акцентировать», «обратить внимание». Глаголы такого типа оказались среди характерных для ИИ сразу в 24 из 34 исследованных языков.
Наверняка многим пользователям нейросетей знакомы и конструкции вроде «важно отметить», «стоит подчеркнуть» или «следует учитывать».
Сами по себе эти выражения совершенно нормальны. Необычной становится именно частота их употребления.
Почему язык людей может становиться похожим на язык нейросетей
Самое очевидное объяснение — всё больше текстов создаётся или редактируется с помощью искусственного интеллекта.
Автор может написать материал самостоятельно, а затем попросить нейросеть исправить стиль, сократить текст или сделать его более понятным. В результате в готовую публикацию попадают речевые конструкции, которые предпочитает языковая модель.
Есть и другой возможный эффект.
Человек постоянно читает созданные искусственным интеллектом тексты и постепенно сам начинает использовать знакомые обороты. То есть влияние может происходить даже тогда, когда автор непосредственно не обращается к ChatGPT.
Получается интересная ситуация: сначала нейросети обучались на человеческих текстах, а теперь созданные нейросетями тексты потенциально начинают влиять на язык самих людей.
Станут ли разные языки более похожими
Исследование показало ещё одну любопытную тенденцию: похожие смысловые предпочтения искусственного интеллекта появляются в совершенно разных языках.
Это может постепенно приводить к своеобразному выравниванию письменного стиля. Русский, английский, немецкий, испанский и другие языки, конечно, не станут одинаковыми, но тексты на них могут чаще использовать похожие конструкции и способы подачи информации.
Особенно заметным такой эффект может оказаться в новостях, деловой переписке, научных работах и интернет-публикациях — там, где искусственный интеллект уже активно помогает создавать и редактировать тексты.
Действительно ли ChatGPT уже меняет язык
Пока говорить об этом как о доказанном факте рано.
Исследование показывает совпадение во времени: после распространения генеративного ИИ в новостных материалах чаще стали появляться слова, которые предпочитают языковые модели.
Но это ещё не доказывает, что причиной изменений стал именно ChatGPT.
Кроме того, работа пока опубликована в виде научного препринта и должна получить дальнейшую оценку исследователей.
Тем не менее сама тенденция заслуживает внимания. Языки всегда менялись под влиянием новых технологий — книгопечатания, телевидения, интернета, социальных сетей и автоматических переводчиков.
