Почему тексты ИИ часто выглядят одинаково – и как не писать, как бот

Статьи, написанные популярными языковыми моделями на самые разные темы, сделаны будто под копирку. Часто повторяются одни и те же словосочетания, речевые обороты, но это лишь вершина айсберга. Похожи не только отдельные фразы, а сам язык, структура статей.

Почему так? Нейросеть ленится придумывать что-то новое? Нет, дело вовсе не в этом.

Нейросеть не думает — она предсказывает

Когда человек пишет статью, он может вспомнить случай из жизни, придумать неожиданную аналогию или удачную шутку. Языковая модель на это неспособна, да она и не стремится создать что-то оригинальное и цепляющее. Всё, что она делает — выбирает наиболее вероятное продолжение текста.

Нейросети обучают на гигантском объёме текстового материала — книгах, статьях, учебниках, научных публикациях, новостях, справочниках. Переработав всю эту информацию, они впитывают закономерности языка. Если множество текстов начинается словами «Сегодня трудно переоценить значение...», именно такая конструкция становится для модели наиболее вероятной. Неудивительно, что сгенерированные статьи так похожи друг на друга. И… — на тексты многих средних авторов, поставивших создание контента на поток.

Получается любопытный парадокс.

Оригинальность — это отклонение от статистики. А нейросеть обучена следовать статистике.

Обороты и конструкции, типичные для нейросети

Во многих сгенерированных текстах часто встречаются фразы вроде: «Ни для кого не секрет...» «На сегодняшний день...» «Следует отметить...» «По причине того, что...» Даже появилось мнение, что шаблонные и канцелярские обороты — главный признак текста, написанного ИИ.

На самом деле всё с точностью наоборот.

Канцелярит появился задолго до искусственного интеллекта. Им переполнены официальные документы, инструкции, учебники, научные статьи, а редакторы с незапамятных времён неустанно вычеркивают канцелярит из текстов слабых авторов.

Нейросеть лишь переняла эту манеру письма, потому что она встречается очень часто. Вот и появляется вместо «запускать» «осуществлять запуск», вместо «сейчас» — «в данный момент времени», а вместо «измерять» — «производить замер».

Иными словами, нейросеть не придумала канцелярит. Она просто отлично освоила язык, на котором уже много лет пишут тысячи людей.

Но позаимствовали языковые модели не только шаблонные фразы, но и саму логику текста.

Проверить это несложно, попросите нейросеть написать статьи, к примеру:

  • как выбрать велосипед;
  • как приготовить борщ;
  • почему кошки мурлыкают;
  • что такое блокчейн.

И вы увидите, что:

  • Сначала читателю сообщат, что тема очень важна.
  • Потом объяснят основные понятия.
  • Затем перечислят несколько фактов или рекомендаций.
  • В конце обязательно будет вывод.

Сходная структура, похожие связки:

Начало статьи: «В современном мире...» «Сегодня трудно переоценить...»

Переход между абзацами: «Кроме того...» «Следует отметить...» «Важно понимать...»

Финал: «Таким образом...» «Подводя итог...»

Возможно, нейросети кто-то задал готовые шаблоны статей? Нет, просто именно такая композиция чаще всего встречается в информационных текстах и поэтому вероятнее всего её и выберет ИИ. Но это не значит, что такая структура плохая, неправильная, просто она стандартная, шаблонная. Более того, что именно такую схему долгое время рекомендовали и многие пособия по копирайтингу: она понятна, логична и подходит почти для любой темы.

Детекторы ИИ принимают вас за искусственный разум?

С развитием нейросетей, когда однотипных текстов в сети становится все больше, возник спрос на так называемые детекторы ИИ. Многие из них работают некорректно, но когда кто-то жалуется:

«Я сам написал статью, а сервис определил, что текст создан нейросетью!» — совсем необязательно, что программа ошиблась.

Большинство детекторов анализирует не происхождение текста, а его статистические особенности. Насколько предсказуемы слова? Часто ли повторяются типичные конструкции? Однообразна ли композиция? Много ли распространенных речевых шаблонов?

Если человек пишет, как все, по избитому сценарию, использует шаблонные фразы и канцелярит, детектор вполне может принять его текст за машинный.

Получается забавно.

Иногда программа принимает человека за нейросеть вовсе не потому, что он пользовался искусственным интеллектом.

А потому, что и человек, и нейросеть написали одинаково типичный текст.

Как перестать писать,как ИИ

Есть распространенное мнение, что для этого достаточно убрать любимые машинами обороты «следует отметить», «таким образом» и иже с ними. Ну и слегка разнообразить план.

Если бы все было так просто.

На самом деле проблема не в отдельных выражениях, а в предсказуемости, безликости текста.

Поэтому хороший автор ломает шаблон: начинает статью с неожиданного вопроса, приводит собственное наблюдение, заменяет общие рассуждения конкретным примером, меняет привычную структуру повествования.

Именно такие детали делают текст живым.

Ну а канцелярит и хороший автор — вещи несовместимые.

Подытожим

Нейросеть не придумывает шаблоны и не изобретает канцелярит. Она просто очень точно воспроизводит самые вероятные способы писать статьи — те самые, которые десятилетиями использовали тысячи авторов.

Поэтому лучший способ перестать писать, как бот, удивительно прост: перестать писать так, как пишет большинство.

Добавляйте собственные наблюдения, неожиданные сравнения, реальные истории и живую речь, не используйте очевидные связки без необходимости. Именно там, где человек сознательно отходит от статистической нормы, появляется авторский стиль. А это пока остается одной из тех вещей, которые невозможно получить простым вычислением наиболее вероятного следующего слова.

Поделиться
Отправить

Оценить статью

1 звезда2 звезды3 звезды4 звезды5 звезд (Пока оценок нет)
Загрузка...

Наш сайт использует файлы cookies, чтобы улучшить работу и повысить эффективность сайта. Продолжая работу с сайтом, вы соглашаетесь с использованием нами cookies и политикой конфиденциальности.

Принять