Pew Research Center дослідив, наскільки поширеним став контент, створений або суттєво відредагований за допомогою штучного інтелекту. Аналіз майже 490 тисяч англомовних вебсторінок показав: у липні 2026 року 10% випадкової вибірки сторінок мали помітні ознаки використання ШІ.

Серед новішого контенту цей показник значно вищий. Якщо враховувати лише сторінки, опубліковані після виходу ChatGPT у листопаді 2022 року, ознаки використання ШІ має понад третина матеріалів у вибірці за липень 2026 року.
Для дослідження Pew Research Center використав вебархів Common Crawl зі сторінками, зібраними від січня 2021 року до липня 2026 року. Тексти перевіряли за допомогою моделі Open Pangram, яка визначає статистичні особливості мови, характерні для текстів, створених або суттєво відредагованих ШІ.
Дослідники також виявили різницю між типами сайтів. У 2026 році приблизно 10% сторінок у доменній зоні .com мали ознаки використання ШІ. Для .org цей показник становив 4,6%, а для .edu та .gov — близько 1%.

Окремо Pew Research Center проаналізував, як змінюється сама мова в інтернеті. Порівняно з 2023 роком у нових вебматеріалах приблизно вдвічі частіше використовують довге тире, а частота оксфордської коми зросла на 63%. Слова та конструкції, які моделі ШІ використовують частіше за людей, також стали помітно поширенішими.
Зокрема, більш ніж удвічі зросло використання англійських слів delve, interplay, testament та низки інших характерних для ШІ формулювань. Конструкції на кшталт «це не просто X, це Y» трапляються майже втричі частіше, хоча загалом залишаються відносно рідкісними.

Водночас автори дослідження застерігають від визначення походження окремого тексту лише за словами або пунктуацією. Люди також використовують такі конструкції, а системи для виявлення ШІ можуть помилково класифікувати як людські, так і згенеровані тексти. Тому результати дослідження показують загальну тенденцію на великій вибірці, а не дають змогу достовірно визначити автора кожної окремої сторінки.

Для медіа, маркетологів і бізнесу дослідження показує, як швидко ШІ стає частиною процесу створення вебконтенту. Водночас зростання його частки робить менш надійними окремі мовні ознаки як спосіб визначити, хто створив текст — людина чи ШІ.
Джерело: Paw Research Center