Поиск@Mail.Ru теперь разделяет названия книг и фильмов

Поиск@Mail.Ru продолжает работать над распознаванием возможных значений запросов пользователей с целью выдачи максимально подходящих результатов. Очередным шагом в этом направлении стал запуск нового алгоритма обработки названий фильмов и книг, для которых такая задача особенно актуальна.

Не секрет, что многие фильмы являются экранизацией книг или просто имеют одинаковые с ними названия, поэтому в такой ситуации корректное распознавание желания пользователя - задача особенно сложная и важная. Хороший пример многозначного запроса - название «Война и мир», которое принадлежит двум литературным произведениям (роману Льва Толстого и пьесе Михаила Булгакова) и пяти экранизациям.


Поисковый робот GoGo.Ru, используемый на Поиске@Mail.Ru, умеет корректно выделять фактологические данные из проиндексированной информации. В частности, он автоматически определяет все возможные объекты, которые обычно упоминаются под названием «Война и мир», и наиболее характерные для них слова - имена авторов, актеров и т.д. Также робот анализирует поведение пользователей, которые ищут информацию по тому или иному многозначному запросу, и определяет, какое именно значение чаще всего интересует людей. В случае с «Войной и миром» обычно имеется в виду роман Льва Толстого. В результате пользователь увидит над результатами поиска по такому запросу краткую справку по данному произведению.


Стоит отметить, что формат подсказки также учитывает наиболее часто встречающиеся желания пользователей. Например, в случае с книгой человек практически всегда хочет получить ее текст, поэтому любая справка по произведению, помимо имени автора и краткого описания, почти всегда (когда это возможно) содержит ссылку «Читать», которая отправляет пользователя на сайт одной из электронных библиотек. Если на сайте библиотеки робот обнаружил файл с текстом, то пользователю предлагается еще и скачать книгу. В случае с фильмами людей интересуют как трейлеры и ролики, так и сюжет, имена режиссера и актерского состава, поэтому все эти данные также агрегируются роботом.


В ряде случаев пользователю предлагается уточнить запрос наиболее подходящими словами, список которых, опять-таки, формируется на основании данных о поведении людей на поисковике. В случае с фильмом это может быть имя актера, исполнившего главную роль. Кликнув на уточняющий запрос, пользователь увидит справку по необходимой ему экранизации (например, по «Войне и миру» Сергея Бондарчука 1965 года) и результаты уточненного поиска.


В настоящее время специалисты Поиска@Mail.Ru ведут работу над расширением справочных возможностей проекта, которые позволят сделать поиск еще удобнее и эффективнее.


Еще несколько примеров:
Книга мастеров
Побег из Шоушенка
Достучаться до небес
Зеленая миля
Криминальное чтиво
Крестный отец
Мастер и Маргарита
Сто лет одиночества

Рубрики: Web

Ключевые слова: Mail.ru, поисковые системы