Добавлен: 16.06.2023
Просмотров: 370
Скачиваний: 3
начали работать фильтры АГС (АГС 17 и АГС 30);
количество факторов при ранжировании страниц возросло в разы;
была внедрена система распознавания первоисточника информации и обнаружения сайтов, копирующих материалы. В отношение последних начали применяться меры для понижения их в результатах поиска.В дальнейшем поисковая система вводила новые алгоритмы: Конаково, Обнинск, Краснодар,Калининград, Дублин. Каждый последующий алгоритм совершенствовал работу поисковой машины. Наиболее значимыми улучшениями стали:
совершенствование ранжирования для геозависимых поисковых запросов;
индексация информации из социальной сети ВК;
начала работать партнерская программа «Оригинальные тексты», в которой автор может подтвердить свои права на материалы.Также было внедрено большое количество мелких доработок.15 апреля 2015 года Яндекс объявил о внедрении нового алгоритма ранжирования Минусинск, старт которого запланирован на 15 мая 2015 года. Новый алгоритм направлен на борьбу с закупкой ссылок с целью быстрого выведения сайта в ТОП. Теперь сайты, злоупотребляющие закупкой ссылок, будут пессимизироваться в поисковой выдаче Яндекс.
5 Архитектура поисковых систем
Рассмотрим классическую архитектуру, которая чаще всего реализована на корпоративных сайтах и информационных порталах. Такая архитектура изображена на рисунке 1.
Рисунок 1. Архитектура поисковой системы
Разберем по частям то, что изображено на рисунке. Существует клиентская вычислительная машина под управлением ОС Windows и существует Web-сервер под управлением UNIX-подобной ОС. На стороне клиента запущен типичный браузер, такой как Netscape. На стороне сервера запущен web сервер, который обслуживает запросы от браузера, передавая запросы презентационному слою понимающему CGI. Презентационный слой передает запросы к поисковому механизму в случае вызова услуги поиска или отображает наполнение (content) сайта. При работе администратора презентационный слой также может передавать запросы на инициализацию механизма индексации нового контента, который еще не индексирован. Это необходимо по той причине, что пока текст не индексирован, поиск в нем с помощью поисковой машины невозможен. Идея заключается в следующем. Существуют мегабайты текстовой информации, и скорость поиска документов содержащих заданные ключевые слова отнимает очень многопроцессорного времени. Предположим, в 10 мегабайтах текстовой информации ключевое слово будет находиться в течение 10 секунд. И вот заходит посетитель на Ваш сайт, задает ключевые слова, вызывает услугу поиска и ждет 10 секунд, пока ваш сервер не выдаст ему результат. Предположим, случилось так, что одновременно запросило поиск 5 человек. Естественно, время ответа увеличится в 5 раз. Получается, что в среднем по 50 секунд пользователь будет ждать ответа от вашего сервера. Это не приемлемо, особенно если у Вас сотни мегабайт текстовой информации и время реакции системы будет катастрофически велико. Необходимо использовать другой подход при поиске ключевых слов в текстовой информации - время ответа сократить до миллисекунд.[6]