Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

У ИИ-поисковиков обнаружилось пристрастие к «менее популярным» источникам

В прошлом году Google развернула в поисковой машине функцию обзоров от искусственного интеллекта — не слишком удачный поначалу эксперимент показал, насколько результаты работы этого сервиса отличаются от традиционной выдачи со ссылками, которую поисковые службы показывали десятилетиями. Поисковые системы на базе ИИ вообще склонны ссылаться на менее популярные сайты и ресурсы, которые не попали бы в первую сотню ссылок «органической» выдачи Google, установили учёные.

 Источник изображения: sarah b / unsplash.com

Источник изображения: sarah b / unsplash.com

Немецкие учёные сравнили результаты традиционного поиска Google с его же «Обзорами от ИИ» и ответами чат-бота Gemini-2.5-Flash; в качестве дополнительных источников они использовали поисковую службу OpenAI GPT-4o и дополнительный режим модели GPT-4o, при котором веб-поиск подключается лишь по необходимости, если модель не обнаруживает ответа в собственной базе знаний. Массив тестовых запросов учёные собрали из трёх источников: WildChat — запросы, которые пользователи отправляли в ChatGPT; AllSides — запросы на политические темы; а также запросы, связанные с сотней самых популярных товаров на Amazon.

В целом системы поиска на основе генеративного ИИ чаще цитировали ресурсы, которые, как правило, не появлялись в первой десятке традиционной поисковой выдачи, показала статистика рейтинга Tranco. Цитируемые ИИ источники с меньшей вероятностью, чем ресурсы из выдачи традиционного поиска Google, оказывались в первой тысяче, а то и в первом миллионе рейтинга Tranco. Среди собственных предпочтений Gemini оказалось множество непопулярных сайтов: по всем результатам медианный источник информации чат-бота не попадал в первую тысячу Tranco. Цитируемые поисковыми системами на базе ИИ источники, как правило, не появлялись даже близко к верхушке выдачи Google: 53 % источников из «обзоров от ИИ» в Google не попали в первую десятку, а 40 % — в первую сотню результатов из традиционной выдачи.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

Значительной оказалась разница в качестве источников: системы ИИ чаще обращались к корпоративным ресурсам и энциклопедиям, но почти никогда не ссылались на соцсети. Анализ ответов, который провела большая языковая модель, показал, что ИИ охватил то же количество идентифицируемых понятий, что и первая десятка ресурсов в традиционной выдаче — результаты были столь же подробными, разнообразными и актуальными. С другой стороны, ИИ проявил склонность сжимать информацию, то есть не упоминать второстепенных и неоднозначных аспектов, которые сохраняются в традиционном поиске.

Важным достоинством поисковых систем с ИИ оказалась способность объединять информацию из заложенной при обучении базой знаний с данными цитируемых сайтов. Модель GPT-4o, например, часто вообще не обращалась к внешним источникам, ограничиваясь собственными знаниями — это же оказалось и её слабым местом: иногда она запрашивала подробности у пользователя вместо того, чтобы самостоятельно обратиться к веб-поиску. Учёные не стали делать выводов о качестве работы поисковых системы с ИИ, но призвали выработать новые методы оценки качества их работы с учётом разнообразия, охвата понятий и способности моделей объединять собственные знания с данными внешних источников.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В ранний доступ Steam ворвалась Breathedge 2 — приключенческая комедийная игра о выживании в космосе 29 мин.
OpenClaw обновился до версии 2.0 — запуск ИИ-агентов стал проще, а управлять ими теперь могут сразу несколько человек 2 ч.
Take-Two отчиталась о «бурном развитии» расследования по поиску виновника утечек GTA VI 5 ч.
ЕС поставил ChatGPT в один ряд с крупнейшими онлайн-платформами — ответственность OpenAI возрастёт 5 ч.
ИИ-направление принесло Cloud.ru более половины выручки в I полугодии 2026 года 6 ч.
Instagram объявила войну ИИ-аккаунтам, выдающим себя за реальных людей 6 ч.
Sony подтвердила сентябрьскую презентацию State of Play — покажут Final Fantasy VII Revelation и игры от PlayStation Studios 6 ч.
Windows 11 начала обманывать, что антивирус Defender отключён — на самом деле он работает 7 ч.
В российской серверной ОС SelectOS прописался ИИ-агент Aish 7 ч.
«Нам нужно адаптироваться»: оригинальная The Long Dark получит новые DLC, а Blackfrost: The Long Dark 2 скоро выйдет из тени 10 ч.
Nvidia заплатила $3,5 млрд за союз с MediaTek — вместе они бросают вызов фирменным ИИ-чипам Google и Amazon 2 ч.
Meta внедряет роботов в ЦОД для замены людей, но пока процесс идёт очень медленно 4 ч.
CXMT запустила пробное производство памяти HBM3E 4 ч.
В недрах Марса обнаружилась массивная «тепловая аномалия» — возможно, это результат древнего космического ДТП 5 ч.
Никому ни слова: операторы ЦОД в США всё чаще заключают тайные соглашения в властями, прикрываясь NDA 6 ч.
Российским операторам разрешили строить 5G на частотах LTE — сети скоро появятся в городах-миллионниках 7 ч.
TSMC намерена в 50 раз повысить производительность ИИ-систем — помогут 3D-чипы и кремниевая фотоника 7 ч.
G.Skill представила комплект Flare X5X DDR5-6000 с технологией разгона AMD EXPO ULL для систем на Ryzen 9 ч.
Очередная доставка астронавтов и космонавта на МКС задержится из-за технических проблем у корабля SpaceX Dragon 9 ч.
Поставщики облачных услуг в Бразилии возьмут на вооружение оптические диски Folio Photonics 10 ч.