Perplexity ссылается на 215 тысяч страниц, созданных специально под ответы ИИ
Исследователи Trellner обнаружили три сайта, которые сгенерировали 215 128 страниц вида «лучшие программы для X», и Perplexity ссылается на них в ответах. Страницы сделаны не для людей, а для поисковых ответов нейросетей: шаблонные списки с оценками, отзывами и таблицами сравнения, которых никто не писал.
Вторая проверка того же дня, аудит Haus Research, посчитала, насколько ссылки Perplexity подтверждают то, ради чего их поставили. Примерно в трети случаев по указанному адресу нет числа, которое сервис на него списывает.
Обе работы бьют в одно место — список источников под ответом выглядит как доказательство, но проверку выдерживает не всегда.
Что говорят
sphHacker News
Чем LLM-поисковики защищены от обучения на контенте, сгенерированном другими LLM? Дойдем ли мы до того, что ИИ-сайты составят большинство интернета, а модели будут учиться на собственной отрыгнутой жвачке, экспоненциально усиливая свои ошибки? Или корпус до 2022 года станет «сталью с низким фоном», а все после — все менее надежным, если не сертифицировано как написанное человеком?
AurornisHacker News
Пользовался бесплатной годовой подпиской Perplexity. Сначала было полезно для простых запросов — найти вспомнившийся рецепт, страницу справки или инструкцию. Потом они начали оптимизировать скорость ответа в ущерб качеству: результат появляется за секунду, но это мусор, ссылки и сноски часто не соответствуют тексту рядом с ними.
a2ff6eeb0Hacker News
Логично. Манипуляция обучающими данными, чтобы модели рекомендовали именно твой продукт, — уже наверняка большая индустрия.