Исследователи применили детектор Open Pangram к выборке материалов, опубликованных к июлю 2026 года. Если в общем массиве данных признаки ИИ-авторства обнаруживаются на 10% страниц, то среди контента, созданного после появления чат-ботов, этот показатель подскочил до 35%. При этом цифры коррелируют с типом доменной зоны: в сегменте .com доля машинного текста в разы выше, чем в академических .edu или государственных .gov ресурсах.
Влияние нейросетей проявилось даже в структуре предложений. Сопоставление текстов 2023 и 2026 годов показало всплеск использования специфических конструкций. Употребление длинного тире удвоилось, а оксфордская запятая стала встречаться на 63% чаще. Авторы отчета подчеркивают: подобные маркеры не являются абсолютным доказательством машинного происхождения, однако в масштабах миллионов документов они становятся статистически значимыми.
Эксперты призывают относиться к полученным цифрам как к оценочным, а не как к финальному счету. Детекторы способны ошибаться, принимая авторский стиль за генерацию, или пропускать тонко отредактированные тексты. Несмотря на погрешности, масштаб трансформации очевиден: за четыре года нейросети превратились в полноценных соавторов, чьи лингвистические привычки стали частью цифровой среды.
Комментарии (0)
Пока нет комментариев. Будьте первым!