Август 2026   |   Обзор события   | 7

Каждый третий новый текст в сети написан ИИ, а боты уже читают ботов

Каждый третий новый текст в сети написан нейросетями, а трафик от ботов впервые обогнал человеческий. Алгоритмы читают страницы, созданные другими алгоритмами, превращая качественный контент человека в дефицитный ресурс.

ИСХОДНЫЙ НАРРАТИВ

Согласно исследованию Pew Research, более трети веб-страниц, опубликованных после запуска ChatGPT в ноябре 2022 года, содержат явные признаки создания или существенной правки с помощью искусственного интеллекта. В выборке из 10 000 страниц, собранных в июле 2026 года, доля таких материалов достигла 35%. Для сравнения: если брать случайную совокупность всех страниц без фильтрации по дате публикации, показатель составляет около 10%, так как в ней присутствуют старые тексты, созданные до появления генеративных инструментов.

Методология анализа опиралась на архив Common Crawl и технологию детектирования Open Pangram. Исследователи проанализировали почти полмиллиона англоязычных страниц за последние пять лет. Важно отметить, что автоматические системы могут ошибаться, однако в масштабах выборки полученные данные считаются достоверными и отражают реальный тренд.

Разрыв между корпоративным и официальным сегментами

Структура контента значительно различается в зависимости от типа домена. Сайты с расширением .com демонстрируют десятикратное превышение доли ИИ-авторства по сравнению с образовательными (.edu) и государственными ресурсами (.gov), где этот показатель держится на уровне около 1%. Организационные сайты (.org) также остаются относительно «чистыми» — лишь 4,6% их контента имеет следы генерации нейросетями.

Это свидетельствует о том, что бизнес-сектор активно интегрирует ИИ в контент-маркетинг и операционные процессы, тогда как государственные и академические институты сохраняют более консервативный подход к созданию текстов.

Боты читают ботов: новый этап эволюции веба

Рост машинного контента совпадает с другим важным рубежом: провайдер интернет-инфраструктуры Cloudflare сообщил, что трафик от роботов впервые превысил человеческий. Этот момент наступил раньше, чем прогнозировали эксперты компании.

Концептуальное изображение
Создано специально для ASECTOR
Концептуальное изображение

Ситуация создает замкнутый цикл: алгоритмы читают страницы, созданные другими алгоритмами. Pew Research также зафиксировала статистические маркеры ИИ-текстов, которые становятся все более частыми в сети последних лет. К ним относятся массовое использование тире (em dash), оксфордской запятой и характерных риторических конструкций типа «это не X, а Y».

Тип доменаДоля страниц с признаками ИИ-авторства
.comВысокий уровень (в 10 раз выше чем у .edu/.gov)
.org4,6%
.edu / .gov~1%

Данные указывают на то, что качественный человеческий контент становится дефицитным ресурсом в информационном пространстве. Для бизнеса это означает необходимость пересмотра стратегий SEO и контент-производства, так как алгоритмы поисковых систем и пользователи все чаще сталкиваются с машинными текстами.

АНАЛИТИЧЕСКИЙ РАЗБОР

Веб делится на два слоя: машинный шум и человеческая ценность

Каждый третий новый текст в сети теперь пишут алгоритмы. Но главная проблема не в количестве ботов, а в том, как они меняют экономику контента. ИИ-сервисы забирают данные с сайтов, но почти никогда не возвращают туда пользователей. По данным Cloudflare, соотношение «захвата» контента и возврата трафика достигает 100:1 [!]. Это значит, что бизнес платит за хостинг и модерацию, а аудитория уходит в чат-боты, которые дают готовые ответы без ссылок на первоисточник.

Энтропия контента и риск «эха»

Ситуация напоминает замкнутый круг: нейросети обучаются на данных, которые сами же генерируют. Генеративный ИИ не создает принципиально новых идей, а лишь ремикширует существующие паттерны [!]. Когда боты читают страницы, написанные другими ботами, качество информации деградирует до уровня статистического шума. Поисковые системы теряют ориентиры для оценки релевантности, опираясь на маркеры, которые ИИ копирует у людей (например, специфическое использование тире или оксфордской запятой).

Для бизнеса это сигнал: массовый машинный контент обесценивает стандартные SEO-стратегии. Если все конкуренты заполняют сеть однотипными статьями, ценность уникального человеческого опыта резко возрастает. Выживут те, кто предлагает то, чего нет в обучающей выборке алгоритмов: локальный контекст, проверенные первичные данные и живую интонацию автора.

Веб превращается из витрины для людей в базу данных для машин. В «машинном слое» царит шум, а в «человеческом» формируется премиальная ниша доверия.

Российский контекст: от рутины к регулированию

В России процесс идет по-своему. Компании активно внедряют ИИ для внутренних задач, а не только для публичного маркетинга. Например, Билайн запустил платформу «Экзоинтеллект», где 10 тысяч сотрудников создали 600 кастомных ассистентов для анализа данных и подготовки документов [!]. Это подтверждает тренд: ИИ становится инструментом операционной эффективности, а не только генератором постов в блог.

Однако рынок готовится к изменениям правил игры. Эксперты прогнозируют введение нормативных актов, требующих прозрачности ИИ-систем и обязательной маркировки синтетического контента [!]. Это усложнит жизнь компаниям, которые полагались на скрытую автоматизацию текстов. Теперь бизнесу придется явно указывать, кто автор материала, или нести риски санкций за нарушение требований к достоверности информации.

Как защитить активы и найти аудиторию

Чтобы не потерять трафик и доверие, компаниям стоит пересмотреть подход к контент-стратегии:

  • Отказ от гонки за объемом. Вместо тысяч однотипных страниц эффективнее создавать глубокие материалы с уникальными кейсами и экспертными мнениями.
  • Защита интеллектуальной собственности. Появился стандарт RSL (Really Simple Licensing), который позволяет издателям устанавливать условия использования контента ИИ, включая оплату за скрейпинг [!]. Это дает возможность монетизировать свой контент или запретить его бесплатное использование алгоритмами.
  • Фокус на «человеческом слое». Инвестиции нужно направлять на создание доверия через экспертизу и личную ответственность автора, а не на манипуляции с поисковой выдачей.

Бизнес больше не может полагаться на то, что поисковики приведут трафик автоматически. Теперь главная валюта — это способность отфильтровать машинный шум и предложить пользователю достоверную информацию, которую невозможно сгенерировать нейросетью.

Когда фактов слишком много нужна система

Асектор превращает поток новостей в понятную картину: что произошло, на что это влияет и чем может обернуться. Без шума. С доказательной базой.

Коротко о главном

Почему общая доля ИИ-контента по всей сети составляет лишь около 10%?

Этот показатель ниже, чем у новых текстов (35%), потому что в случайную совокупность всех страниц попадают старые материалы, созданные до появления генеративных инструментов.

Какие технологии использовались для детектирования машинного текста?

Исследователи опирались на архив Common Crawl и технологию Open Pangram, проанализировав почти полмиллиона англоязычных страниц за последние пять лет.

В каком сегменте интернета концентрация ИИ-авторства максимальна?

Сайты с доменом .com демонстрируют десятикратное превышение доли искусственного контента по сравнению с образовательными и государственными ресурсами, что свидетельствует об активной интеграции нейросетей в бизнес-процессы.

Какой уровень ИИ-генерации характерен для государственных и академических сайтов?

На ресурсах .gov и .edu доля машинных текстов держится на уровне около 1%, а на организационных сайтах (.org) она составляет 4,6%, что отражает консервативный подход этих институтов.

Какое событие Cloudflare зафиксировала в отношении интернет-трафика?

Провайдер сообщил, что трафик от роботов впервые превысил человеческий, наступление которого произошло раньше прогнозов экспертов компании.

Какие стилистические маркеры betraying ИИ-тексты становятся массовыми?

В сети все чаще встречаются статистические паттерны, такие как избыточное использование тире (em dash), оксфордской запятой и риторических конструкций типа «это не X, а Y».

Инфографика событий

Открыть инфографику на весь экран


Участники и связи

Отрасли: ИТ и программное обеспечение; Искусственный интеллект (AI); Бизнес; Аналитика и исследования

Оценка значимости: 7 из 10

Материалы по теме

ИИ-роботы забирают контент, но не возвращают трафик — что это значит для сайтов

Цифра соотношения «захвата» контента и возврата трафика (100:1), зафиксированная Cloudflare, служит ключевым аргументом в начале текста. Она наглядно иллюстрирует экономический дисбаланс, при котором бизнес несет издержки на создание контента, но теряет аудиторию в пользу ИИ-ассистентов, не получающих реферального трафика от пользователей.

Подробнее →
Генеративный ИИ не создает новых идей: компании рискуют получить однообразие контента

Утверждение о том, что генеративный ИИ лишь ремикширует существующие паттерны, а не создает новые идеи, подкрепляет тезис об «энтропии контента». Этот факт обосновывает риск деградации информации до статистического шума в замкнутом цикле обучения ботов на данных ботов, усиливая аргумент о необходимости уникального человеческого опыта.

Подробнее →
Билайн Экзоинтеллект: токеномика меняет структуру затрат и требует пересмотра штатного расписания

Данные о платформе «Экзоинтеллект» Билайна (10 тысяч сотрудников, 600 ассистентов) используются для демонстрации специфики российского рынка. Они подтверждают тезис о том, что в РФ ИИ внедряется прежде всего как инструмент внутренней операционной эффективности и автоматизации рутинных задач, а не только для публичного маркетинга.

Подробнее →
Академия АйТи: ИИ и кибербезопасность стали главными драйверами корпоративного обучения

Прогноз экспертов относительно введения нормативных актов по прозрачности ИИ и маркировке синтетического контента обосновывает раздел о регулировании. Этот факт служит предупреждением бизнесу о предстоящих изменениях правил игры, где скрытая автоматизация станет рискованной, а прозрачность авторства — обязательным требованием.

Подробнее →
Новый стандарт RSL: как защитить контент от ИИ-скрейпинга и получать за него деньги

Упоминание стандарта RSL (Really Simple Licensing) и возможности устанавливать условия оплаты за скрейпинг подкрепляет рекомендацию по защите интеллектуальной собственности. Этот инструмент представлен как практическое решение для монетизации контента или запрета его бесплатного использования алгоритмами, позволяя издателям контролировать доступ к своим данным.

Подробнее →