Ранжирование Google News 22 Август 2021
Являются ли большие новостные агентства с широким международным покрытием различных тем, огромным количеством репортеров, отредактированными статьями и т.п. лучшими источниками новостей, чем более мелкие локальные газеты или нишевые блоги?
На этой неделе был опубликован патент, поданный в 2003 году, и касающийся ранжирования статей в Google News. В нем обсуждается несколько факторов, которые могут быть использованы для представления новостных статей, основываясь на качестве источника.
Что еще более интересно, патент намекает также на предположения, которые лежат в основе факторов ранжирования. Впрочем, вполне возможно, что за прошедшие годы Google уже изменили некоторые подходы.
Патент не включает в себя описание всех сигналов, которые возможно учитывает Google при ранжировании новостных статей.
Также была опубликована техническая, но от этого не менее интересная, статья о поиске в реальном времени, или близко к реальному времени, источника информации в новостных статьях, постах в блогах или веб-страницах. Называется она Detecting the Origin of Text Segments Efficiently (Эффективное определение источника текстового фрагмента) и доступна в формате pdf.
Предпосылки к развитию систем для оценки качества новостных статей описаны в начале патента:
Предположим, например, что человек желает получить последние новости по определенной теме в интернете. Человек обращается к сайту, на котором есть условная поисковая машина. Человек вводит один или несколько терминов, относящихся к интересующей его теме вроде «Ирак» в поисковую машину для того, чтобы найти источники новостей, предлагающие статьи по данной теме.
Такое использование поисковой машины для нахождения отдельных сайтов, предоставляющих статьи по искомой теме, часто приводит к выводу ранжированного списка в сотни, а то и тысячи пунктов длиной. Каждый из пунктов списка будет соответствовать странице, соответствующей поисковому запросу.
И хотя каждый пункт в ранжированном списке может относиться к искомой теме, источники новостей у них могут различаться по качеству.
Например, CNN и BBC широко признаны высококачественными источниками достоверной информации, профессиональных статей и т. д. В то же время местные источники новостей, вроде общегородских газет, могут быть менее качественными.
Следовательно, существует необходимость в системах и методах улучшения ранжирования новостных статей, основанных на качестве источников новостей с которыми связаны статьи.
Я сомневаюсь в предположении, что источники вроде CNN и BBC могут всегда быть лучше местных источников новостей. Зачастую возможно, что именно местные журналисты и новости могут предоставить детали, предположения и информацию, которую упускают большие организации. Тем не менее, на факторы, указанные в патенте, стоит взглянуть.
Патент:
Системы и методы улучшения ранжирования новостных статей
Изобретатели: Michael Curtiss, Krishna Bharat, Michael Schmitt
Принадлежит Google
US Patent 7,577,655
Одобрено 18 августа 2021
Подано на рассмотрение 16 сентября 2003
Аннотация
Система ранжирует результаты. Система может получить список ссылок. Система может определить источники, к которым относятся ссылки и ранжировать список хотя бы частично основываясь на качестве определенных источников.
- Рубрики : Патенты, Переводы, Поисковые системы
- Автор : admin
Комментарии»
комментариев нет - будете первым?