Теория мёртвого интернета становится всё ближе к реальности
Она больше не кажется конспирологией
Еще пару лет назад концепция «Мёртвого интернета» (Dead Internet Theory) звучала как идеальный сюжет для параноидального научно-фантастического романа. Теория, зародившаяся на просторах имиджборд около 2021 года, утверждала, что привычный нам веб «умер» где-то в районе 2016 года.
С тех пор реальные пользователи якобы составляют лишь малую долю трафика, а остальное пространство заполнено алгоритмами, ботами и автогенерируемым контентом, создающим иллюзию бурлящей жизни. Тогда это казалось выдумкой любителей заговоров.
Свежее исследование социологического центра Pew Research Center показывает, что некогда негативный прогноз или миф начинает реализовываться.
Статистика, которая настораживает

Исследователи Pew Research проанализировали почти полмиллиона англоязычных веб-страниц, собранных из архива Common Crawl за последние пять лет — включая период до публичного релиза ChatGPT в конце 2022 года. Для детальной проверки отобрали случайную выборку из 10 000 страниц, опубликованных за последний месяц, и пропустили их через специальный детектор Open Pangram.
Оказалось, каждая десятая страница в глобальной сети (около 10%) содержит явные признаки того, что её текст полностью или частично написан ИИ. На первый взгляд, 10% нельзя назвать катастрофической цифрой.
Нюанс в том, что веб-пространство состоит из огромного массива старого контента, созданного за десятилетия до появления нейросетей. Если исключить из выборки страницы, появившиеся до ноября 2022 года, и взглянуть только на свежие публикации, доля синтетического текста возрастает в геометрической прогрессии.
Где «живого» текста почти не осталось?

Степень засилья ИИ-контента напрямую зависит от доменной зоны. Исследование Pew выявило четкую градацию:
- Домены .COM. Абсолютные лидеры по «зомбификации». Именно здесь расположено больше всего сайтов, сгенерированных ботами для продвижения, дешевого SEO-трафика и рекламы. Почти 10% всех материалов — продукт нейросетей.
- Домены .ORG. Показывают более умеренный уровень — около 4,6% страниц несут следы ИИ.
- Домены .EDU и .GOV. Остаются последними оплотами органического контента. Доля нейросетевых текстов на образовательных и государственных порталах пока не превышает 1%.
Главная проблема заключается в том, что коммерческий веб (.com) с каждым днем всё сильнее превращается в «замкнутую экосистему». Там алгоритмы пишут тексты для поисковых роботов, а те, в свою очередь, ранжируют их для других алгоритмов.
Почерк нейросети, или как распознать «бездушный» текст

ИИ-детекторы не идеальны — они могут ошибаться в обе стороны, принимая живой текст за генерацию и наоборот. Но языковые модели выдают себя характерными статистическими аномалиями. Потенциально они обучены на человеческих текстах, но используют определённые языковые паттерны со слишком высокой, «нечеловеческой» частотой.
Исследователи Pew выделили несколько ключевых маркеров, выдающих присутствие бота:
- Любовь к пунктуации. ИИ использует длинное тире (
—) в два раза чаще, чем среднестатистический человек. А серийная запятая (оксфордская запятая перед союзом «и» в списках) встречается в генерациях на 63% чаще. - Излюбленные слова-паразиты. В английском языке нейросети питают страсть к специфическим глаголам и существительным вроде delve («погружаться», «вникать») или interplay («взаимодействие»).
- Синтаксические штампы. ИИ злоупотребляет отрицательными параллелизмами (конструкции вида «не только X, но и Y») и постоянно повторяет ключевые слова из пользовательского промпта.
- Стерильный тон. Тексты ИИ часто страдают избыточной пояснительной структурой, отсутствием личного опыта и подчеркнуто нейтральным, гладким языком, в котором нет места живым эмоциям или языковым несовершенствам.
Главный тупик цифровой эры

Самый тревожный вывод исследования касается даже не того, что читать интернет становится скучно. Проблема глубже и кроется в вопросе доверия к информации.
Разработчики ИИ сами говорят, что их модели склонны к «галлюцинациям» и могут выдавать ложь за правду, поэтому информацию всегда стоит перепроверять. Но как перепроверить факт в сети, если источники, на которые вы опираетесь для проверки, с высокой вероятностью тоже сгенерированы нейросетью?
Статьи по теме
Замечаете ли вы засилье ИИ-контента в интернете?
0 голосов
Автор
Алексей Прощайло
Игры, музыка, литература. И любое место, где есть море. VK: https://vk.com/alexi.here
Все материалы автораЧто думаете?





0 комментариев