Понад третина англомовних вебсторінок, опублікованих після запуску ChatGPT, має ознаки того, що текст був написаний або суттєво відредагований штучним інтелектом. До такого висновку дійшли дослідники Pew Research Center після аналізу великого масиву вебконтенту.

Для дослідження використовували архів Common Crawl і зібрали майже пів мільйона англомовних сторінок за приблизно п’ять років — тобто період включав як час до появи ChatGPT, так і роки після його запуску в листопаді 2022-го.
У випадковій вибірці 10 тисяч сторінок за липень 2026 року близько 10% мали значні ознаки AI-авторства.
Однак якщо залишити лише сторінки, створені після запуску ChatGPT, частка зростає приблизно до 35%.
Дослідники використовували інструменти для визначення характерних мовних ознак, але наголошують, що жоден детектор не може безпомилково встановити авторство конкретного тексту.
Тому результати варто сприймати не як доказ щодо кожної окремої сторінки, а як оцінку загальної тенденції в масштабі вебу.
Найвищі показники виявили на комерційних доменах .com. Там частка текстів з ознаками AI була приблизно в десять разів вищою, ніж на освітніх .edu або урядових .gov ресурсах.
На .edu та .gov показник залишався близько 1%, а на доменах .org — приблизно 4,6%.
Паралельно змінюється й те, хто читає веб. Cloudflare нещодавно повідомляла, що автоматизований бот-трафік уже перевищив людський.
У результаті формується нова модель інтернету, де значну частину сторінок можуть писати системи автоматизації, а переглядати їх — інші автоматизовані системи.
Дослідження також фіксує зростання окремих стилістичних конструкцій, які часто асоціюють із мовними моделями. Проте самі автори застерігають від використання таких маркерів для звинувачення конкретної людини в застосуванні AI.
Основний висновок дослідження полягає в масштабі зміни: генеративний AI вже не є окремим інструментом для невеликої групи авторів, а помітно впливає на те, як створюється сучасний вебконтент.
Джерело: TechCrunch

1356