Теория "мертвого интернета" всё ближе: что показало новое исследование

Набор текста на ноутбуке. Фото: Unsplash

Тексты, созданные или существенно отредактированные искусственным интеллектом, становятся всё более заметной частью интернета. Анализ почти полумиллиона англоязычных веб-страниц показал, что особенно быстро их доля растет среди материалов, опубликованных после появления ChatGPT.

О том, сколько контента в интернете создается с помощью ИИ, пишет редакция Новини.LIVE со ссылкой на Pew Research Center.

Признаки ИИ обнаружены на 10% веб-страниц

Исследователи использовали веб-архив Common Crawl и собрали почти 500 000 англоязычных страниц за последние пять лет, включая период до запуска ChatGPT в ноябре 2022 года.

Тексты проверили с помощью инструмента Open Pangram, который ищет языковые закономерности, характерные для материалов, созданных или существенно отредактированных искусственным интеллектом.

В случайной выборке из 10 000 веб-страниц за июль 2026 года примерно 10% продемонстрировали значительные признаки авторства ИИ.

Исследователи отмечают, что этот показатель постепенно рос после появления ChatGPT и последующего распространения других чат-ботов, в частности Claude и Gemini.

Общий показатель в 10% включает множество старых страниц, которые были опубликованы ещё до появления современных генеративных чат-ботов. Если учитывать только материалы, созданные после запуска ChatGPT, картина меняется гораздо сильнее.

В выборке за июль 2026 года признаки использования ИИ обнаружили более чем на трети страниц, опубликованных после выхода ChatGPT.

Чаще всего признаки ИИ встречаются на доменах .com

ИИ-контент распределен в интернете неравномерно. После запуска ChatGPT характерные языковые признаки встречались примерно с одинаковой частотой среди основных доменов .com, .org, .edu и .gov.

В выборках за 2026 год примерно каждая десятая страница на доменах .com демонстрировала значительные признаки использования ИИ. Для доменов .org этот показатель составлял 4,6%, а для доменов .edu и .gov — около 1%.

Какие слова и конструкции чаще использует ИИ

Исследователи также сравнили языковые особенности современных веб-страниц с материалами 2023 года.

Длинное тире стало использоваться примерно в два раза чаще, а частота использования оксфордской запятой выросла на 63%. Более чем вдвое чаще стали встречаться слова и выражения, характерные для текстов ИИ, среди которых "delve", "interplay", "testament", "crucial", "pivotal" и "highlight".

Почти втрое чаще стала использоваться конструкция отрицательного параллелизма типа "это не просто X, это Y", хотя в целом она остается относительно редкой.

Отдельные слова пока не доказывают использование ИИ

Авторы исследования подчеркивают, что системы определения ИИ не являются безошибочными. Они могут ошибочно отнести человеческий текст к созданному искусственным интеллектом или, наоборот, не распознать ИИ-контент.

Точно так же использование длинного тире, оксфордской запятой или отдельных характерных слов само по себе не означает, что текст создала нейросеть.

Однако при анализе большого количества документов можно увидеть статистические закономерности в выборе слов, пунктуации и построении предложений, которые чаще встречаются в материалах, созданных с помощью ИИ.

Ранее Новини.LIVE писали, что в Windows 11 появляется всё больше функций на основе искусственного интеллекта, однако нужны они далеко не всем. Часть таких инструментов можно быстро отключить непосредственно в настройках системы.

Также Новини.LIVE сообщали, что чат-ботам не стоит безоговорочно доверять личную, финансовую или медицинскую информацию. Данные, введенные в ИИ-сервисы, потенциально могут храниться или использоваться в дальнейшем.