Исследователи выяснили, что около 35% новых сайтов создаются ИИ полностью или частично, а тексты в сети становятся более стерильными и неестественно жизнерадостными.
📋 Обзор
Проблема так называемого AI slop — потока низкокачественного контента, созданного нейросетями, — давно ощущается на практике всеми, кто активно пользуется смартфоном, поиском, соцсетями и новостными лентами. После запуска ChatGPT в 2022 году этот процесс заметно ускорился: многие платформы оказались буквально залиты текстами, изображениями и публикациями, созданными ИИ. Теперь у этого явления появилась и количественная оценка.
Основные детали
Согласно новому препринту, опубликованному исследователями из Имперского колледжа Лондона, Стэнфордского университета и Internet Archive, примерно 35% всех новых сайтов в интернете создаются либо полностью с помощью ИИ, либо при его активном участии. Авторы работы также пришли к выводу, что онлайн-тексты становятся «все более стерильными и искусственно жизнерадостными». Иными словами, нейросети не просто увеличивают объем контента в сети, но и меняют его тональность — интернет выглядит более «приглаженным», чем есть на самом деле.
Для выявления ИИ-контента команда протестировала четыре разных подхода к детекции и в итоге остановилась на инструментах Pangram Labs, которые показали наиболее стабильные результаты. При этом исследователи отдельно оговорили важный момент: ни один инструмент распознавания ИИ-текстов нельзя считать абсолютно точным. Для формирования репрезентативной выборки использовались данные Wayback Machine — сервиса Internet Archive, который сохраняет снимки веб-страниц и позволяет анализировать, как менялось содержимое сайтов со временем.
Ключевой вывод исследования касается не только масштаба, но и качества цифровой среды. Если раньше интернет ассоциировался с хаотичной, живой и нередко конфликтной средой, то теперь значительная часть нового контента приобретает шаблонный, безопасный и чрезмерно оптимистичный стиль. Это может казаться безобидным, но на практике приводит к размыванию аутентичности: тексты становятся менее человечными, хуже передают реальный опыт и чаще производят впечатление «правильных», но пустых.
Почему это важно для российского интернета
Для российской аудитории этот тренд хорошо узнаваем. На отечественных площадках уже заметен рост «нейросетевого» контента: от SEO-статей и карточек товаров до обзоров, комментариев и корпоративных новостей, написанных в одинаково гладком и обезличенном стиле. Особенно заметно это в сферах онлайн-торговли, маркетинга, медиапроектов и контент-ферм, где скорость публикации часто важнее глубины и экспертизы. В результате пользователь может видеть десятки материалов, которые выглядят правдоподобно, но почти не несут новой информации.
Для российского рынка это означает сразу несколько рисков. Во-первых, снижается доверие к публикациям: читатель все чаще не уверен, имеет ли дело с экспертным мнением, редакционной работой или машинной компиляцией. Во-вторых, ухудшается качество поиска и рекомендаций: если сеть наполняется однотипными текстами, полезный материал сложнее найти. В-третьих, растет нагрузка на редакции, маркетплейсы и платформы, которым приходится думать не только о модерации откровенного спама, но и о более тонкой проблеме — массовом производстве формально приличного, но содержательно слабого контента.
В российских реалиях это особенно чувствительно для новостных медиа, образовательных платформ и сервисов с пользовательскими отзывами. Если отзывы, обзоры или справочные тексты генерируются автоматически, пользователь начинает хуже понимать, где реальный человеческий опыт, а где «идеально вежливая» имитация. По сути, речь идет не просто о фейках в привычном смысле, а о постепенном изменении самого информационного фона.
Что будет дальше
Исследование не утверждает, что любой ИИ-контент вреден сам по себе. Нейросети уже стали рабочим инструментом для редакторов, разработчиков, маркетологов и малого бизнеса. Однако работа ученых показывает, что массовое и бесконтрольное внедрение таких систем меняет интернет глубже, чем кажется. Речь идет не только о количестве автоматически созданных сайтов, но и о новой норме цифровой коммуникации, в которой все становится чуть более одинаковым, вежливым и искусственно бодрым.
Для пользователей главный вывод прост: к онлайн-контенту придется относиться еще критичнее, чем раньше. Для платформ и редакций — искать баланс между автоматизацией и сохранением человеческого голоса. А для рынка в целом это сигнал, что следующая большая проблема интернета может быть связана не с явной дезинформацией, а с избытком правдоподобного, гладкого и эмоционально «правильного» контента, который постепенно делает сеть менее живой.
Источник: Аналитические данные и отраслевые отчеты
Следите за новостями технологий в нашем Telegram-канале и не пропускайте важные обновления!
Источник: wired.com