Исследование о рекомендациях нейросетей
Наткнулся на исследование, после которого мне стало одновременно смешно и немного не по себе. Ребята решили проверить простую вещь: что реально рекомендует нейросеть, когда её просят назвать топовый софт?
Взяли 380 категорий — от CRM до какого-то экзотического софта для музеев. И сказали Perplexity: дай лучшие продукты в каждой категории. Результат, мягко говоря, удивил.
Огромная часть рекомендаций вела на три мутных сайта, которые за пару лет нагенерировали 215 000 страниц формата «лучший софт для X». Причём даже не особо маскировались. В заголовках и описаниях буквально написано что-то вроде: «Отвечаю, робо-брат, тут самые проверенные факты, только что с мангала». То есть контент делался тупо под машины. Без аналитических центров, без сложных схем — просто генеративная оптимизация в самом примитивном виде. И она работает.
Весь прикол в том, что это не единичный случай. Есть ещё исследования, где нейросети дают выбор между человеческим текстом и сгенерированным на одну и ту же тему. Знаете, что она выбирает чаще? Сгенерированный. Потому что он «более структурированный и чёткий». А человеческий текст для неё — невнятный и плохо организованный. Нейронка охотно жрёт нейрослоп и считает его вкуснее, лучше, качественнее.
Кстати, там есть ещё одна цифра, которая меня зацепила. 60% сайтов, которые Perplexity цитирует как источники, вообще не входят в топ 100 000 по посещаемости. А 23% даже в первый миллион не попадают. То есть это не какие-то авторитетные ресурсы. Это рандомные помойки, которые просто угадали формат.
И вот тут открывается интересная перспектива. Получается, порог входа в «видимость для нейросетей» сейчас практически нулевой. Нужен только правильный JSON в голове и понимание, как машина читает текст.
Мораль простая: если вы пишете какой-то контент и думаете, что его будут читать только люди — вы ошибаетесь. Мы наблюдаем за идеальным замкнутым кругом. Одни боты генерят оптимизированный мусор, а другие боты считают его эталоном и пихают в выдачу.