Филолог Борис Орехов: «С развитием ИИ письменные работы студентов утратили смысл»

Тема сентября в блоге Музея криптографии — «Большая перемена»: о школе, образовании и правилах культуры, которые приходится осваивать заново в век научных прорывов и цифровой эволюции. Наш разговор с филологом и специалистом по цифровым гуманитарным исследованиям Борисом Ореховым, на днях презентовавшим в Музее криптографии свою книгу «Электронная лира: Как и зачем искусственный интеллект пишет стихи?», мы предсказуемо решили начать с криптографии — науки, которая веками училась находить закономерности в языке и моментально реагировала на нововведения в человеческой риторике.
МК: Борис, вы не раз были в Музее криптографии и после одного из визитов написали в своей статье «Не (с)только криптография», что «любой ученый, работающий с текстами, в той или иной мере, дешифровщик». Возьмем в качестве примера тексты художественные. По-вашему, почему писатели из века в век прячут потайные смыслы в своих произведениях, и зачем мы их дешифруем?
Б. О.: Справедливо было бы сказать, что иногда писатели прячут смыслы, а иногда мы за давностью лет теряем криптографический ключ к тому, что было понятно современникам, и тогда требуются филологи, чтобы расшифровать сообщение. Стихотворение «Цицерон» Ф. И. Тютчева обычно связывалось комментаторами с событиями Июльской революции, и только лет 20 назад удалось установить, что Тютчев написал этот текст еще зимой, так что не он изображал общественные катаклизмы, а, как это часто бывает, сама история повторяла за поэтом.
Писатели прячут смыслы, потому что это традиционный культурный механизм, который они воспринимают от предшественников.
Возможно, это следствие того, что такой же путь проходит любая фраза нашей речи: сначала она появляется у нас в голове, затем кодируется языком, потом ее слышит и расшифровывает наш собеседник. Криптография описывает сам принцип человеческого общения.
Но, кстати, можно вспомнить, что в литературе есть и зеркальная по отношению к криптографии ситуация: часто бывает, что сообщение у всех на виду, но остается непрочитанным (например, стеганография). В литературе есть прием эзопова языка, когда скрытый смысл, наоборот, прочитывается всеми, хотя формально он будто бы зашифрован.
МК: Теперь — о поэтах, цифровых. Нейросети сегодня вполне освоились в стихотворных размерах, знают, что такое ритм и ударные слоги. При этом силлабо-тоника создана человеком и отчасти является отражением его психофизиологических состояний (будь то учащенное сердцебиение/ дыхание от радости и возбуждения или замедленный темп произношения у человека в печали). Если нейросеть безукоризненно пишет стихотворения, но у нее нет ни дыхания, ни пульса, ни голоса, что именно она в таком случае воспроизводит?
Б. О.: Все не так просто: в начале книги М. Л. Гаспарова «Метр и смысл» убедительно показано, что поэтические размеры никак не связаны с психофизиологией, это в чистом виде механизм культурной памяти, так что ничего удивительного, что большие языковые модели прилежно воспроизводят стиховые формы: искусственный интеллект через тексты получил доступ к нашему культурному опыту. Как сказано в переводе В. К. Шилейко древней поэмы о Гильгамеше: «Он прочел совокупно все писанья». Нейросеть — это такой электрический Гильгамеш XXI века, когда она пишет стихотворение, она воспроизводит усредненное значение этого опыта, это среднее арифметическое всех прочитанных ею поэтических произведений.
МК: Пару лет назад в исследовании Scientific Reports читатели не смогли наверняка отличить стихи известных поэтов от текстов ИИ, а машинные тексты в среднем оценивали выше. Причем самый большой разрыв оказался именно по параметру ритма. Как бы вы объяснили такие результаты эксперимента, и есть ли здесь связь с уровнем культурного образования?
Б. О.: Прежде всего, скажу, что в книге призываю отказаться от практики угадывания автора. Мне кажется, это очень скучно и ведет нас в интеллектуальный тупик. Ведь столько всего есть интересного, о чем можно в связи с этой темой поговорить! У меня набралось таких поводов для разговоров на 260 страниц.
Я проводил эксперимент, в котором участвовали квалифицированные читатели (филологи), и они действительно неплохо сориентировались в предложенных им текстах. А причина высокой оценки текстов от ИИ кроется в той же самой их природе: они порождают нечто усредненное, конвенциональное, консервативное, безопасное, то, что всех устраивает (так же устроено современное студийное кино, которое собирает у экранов миллионы зрителей). А живой человек всегда стремится вырваться за пределы шаблонов и не обязательно встречает на этом пути понимание (как много наберется любителей авторского артхауса?).
МК: Кажется, с заблуждением, в которое может ввести ИИ, уже начали бороться. Минувшим летом издательская группа Hachette сняла с публикации роман Мии Баллард Shy Girl после подозрений в широком использовании ИИ. Но у медали, как и всегда, есть две стороны. Сегодня на людей, употребляющих в письменной речи длинное тире и устойчивые выражения, сразу навешивается ярлык пользователя ChatGPT. Часто такие обвинения могут быть ошибочными и обидными. Не превращается ли наше стремление отделить живой контент от нейросетевого в легкую одержимость?
Б. О.: Мы пока находимся в зоне флуктуации, когда много неясного, много эмоций, не определены правила игры. Собственно, я не вижу ничего запретного в широком использовании ИИ при написании романов, ведь то, что текстологи называют авторской волей, все равно привилегия человека — только он отбирает, что из результатов генерации включить в финальный текст, а что отбросить.
Со временем все успокоятся, одержимости пройдут, новые реалии пропишут в юридических документах и издатели поймут, что снимать с публикации текст за использование ИИ и использование пишущей машинки — действия одинакового уровня осмысленности.
МК: А сами вы попадались на удочку ИИ-контента? Приходилось поверить в реальность видео или фото?
Б. О.: Результаты генерации визуального контента пока отличимы, а вот с голосом я уже не очень уверен, ловлю ИИ только на неправильных ударениях в очевидных словах и на пережатом битрейте. Ну и самое главное — я преподаватель, и буквально этой зимой осознал, что в письменных работах для студентов больше нет смысла, я не смогу понять, кто именно сдает тест: человек или ИИ.
Отныне никаких эссе и контрольных — только устные экзамены и коллоквиумы.
МК: Борис, вы рассказывали, что писали свою книгу «Электронная лира: Как и зачем искусственный интеллект пишет стихи?» шесть лет, начав работать над ней в 2019 году. Интересно, как вы ощутили прогресс нейросетей внутри этого периода? Какие тезисы приходилось основательно переписывать с течением времени?
Б. О.: Как ни странно, за это время концептуально в книге практически ничего не поменялось. Отчасти потому что я не пытался описывать технологии, которые и в самом деле быстро эволюционируют. Моя цель состояла в том, чтобы поставить происходящее в понятный гуманитарию историко-культурный и теоретико-философский контекст. А эти системы координат довольно устойчивы. Кроме того, половину книги занимает обзор опытов и подходов в области генерации стихов в XX веке. При всех шутках о непредсказуемости прошлого эта картина за последние годы тоже не претерпела сдвигов.
Переломным был примерно 2020 год, когда стало ясно (задолго до появления ChatGPT), что в книге не обойтись без разговора о трансформерах — технологии, на фундаменте которой стоят сегодняшние большие языковые модели (от них буква «T» в аббревиатуре GPT). Их прогресс стал слишком очевиден, и те контексты, которые они добавляли в общую картину, больше нельзя было игнорировать. Так появились новые главы, но уже написанное вычеркивать не пришлось.
МК: Созвучно с сентябрьской темой нашего блога «Большая перемена» недавно в одном из интервью вы вспомнили историю Набокова, который попробовал заменить себя на лекции магнитофоном. А как вы относитесь к концепции ИИ-двойников культовых личностей в качестве преподавателей — через десятки лет они будут явно интереснее магнитофона. :) Видите ли вы потенциал в таком сценарии?
Б. О.: Я плохой прогнозист, и не решусь сказать, приживется ли такая практика. Но ясно, что питательной средой для нее является привычка. Может быть, Набокову недостало упорства, чтобы ее сформировать? Если бы в течение многих лет он выставлял вместо себя на кафедру магнитофон, студенты могли привыкнуть и смириться.
ИИ-аватары в образовании имеют право на жизнь, по крайней мере, на попытку. Но вот барьер между ИИ-двойником и культовостью личности представляется мне непреодолимым. В личности важна личность, ее концепция предполагает единственность и цельность, ее невозможно скопировать — так мы о ней привыкли думать. Перенос культовости в аватар проблематичен. Впрочем, жизнь может легко меня опровергнуть.
МК: Представьте, вам разрешили вернуться в школьные годы и передать себе же, школьнику Борису Орехову, сегодняшний смартфон с ИИ. Оказали бы себе такую услугу?
Б. О.: Без сомнения, я бы с радостью воспользовался такой возможностью. Я понимаю стоящие за этим вопросом опасения: вдруг, имея такой мощный инструмент, дети разучатся думать? Но ведь это очень древний сюжет, и обращение к нему демонстрирует, что подобные опасения ходом человеческой истории не подтверждаются.
Умберто Эко в своем эссе «От Интернета к Гуттенбергу» показывает, что в связи с письменностью того же самого боялись еще во времена Платона: в диалоге «Федр» говорится, что из-за изобретения письменности люди «будут вспоминать не благодаря внутреннему усилию, а благодаря внешней поддержке». И этому у Эко есть исторически подкрепленное опровержение: «если когда-то память тренировали, чтобы держать в ней факты, то после изобретения письма ее стали тренировать, чтобы держать в ней книги. Книги закаляют память, а не убаюкивают ее». То же с мышлением и ИИ. Автомобили не отняли у человека способности ходить.
Беседовала: Полина Улискина