Контрольная работа: Вычисление в программной среде MathCAD/SMathStudio. Поисковики в Интернете

Внимание! Если размещение файла нарушает Ваши авторские права, то обязательно сообщите нам

Следующим важнейшим достоинством является специально разработанный модуль ранжирования результатов - PageRank. Он основан на алгоритме, согласно которому вначале устанавливается структура ссылок во всей Сети, а затем каждая отдельная страница ранжируется в соответствии с числом и значимостью ссылок на нее с других страниц. При этом авторитетность внешних ссылок более важна, чем их количество. Подобный алгоритм позволяет существенно повысить релевантность ссылок в следствии чего Google отличает высокая степень соответствия найденной информации интересам пользователя. Этот результат достигается, в частности, еще и за счет специальной подсистемы защиты пользователя от сайтов, которые продвигаются с помощью различных недобросовестных методов.

Google отличается высокой степенью комфорта для пользователя. Несмотря на то, что это глобальная поисковая система, пользователи из неанглоязычных стран автоматически переадресовываются на интерфейс на их родном языке. Русскоязычный интерфейс, в частности, находится по адресу www. . ru. Длительность процесса в большинстве случаев не превышает одной секунды, несмотря на огромный объем индексного файла системы.

Интерфейс первой страницы Google - на сегодня в Сети у него нет достойных конкурентов.

Методика поиска с помощью Google предельно проста. В поисковую строку водится запрос на естественном языке - неважно на русском, английском или любом другом. Язык запросов не допускает усечения терминов знаком "*", поэтому все возможные варианты слов (library, libraries, librarians) пользователю следует вводить самостоятельно. Все термины запроса по умолчанию объединяются условием AND (И) - перед ними нет нужды ставить знак "+". Таким образом, в список результатов попадают лишь страницы, содержащие все введенные ключевые слова. Для поиска по точной фразе традиционно используются кавычки: так запрос "Кто убил кошку у мадам Полосухер?" прямо приведет к ссылке на полный текст "Собачьего сердца" Михаила Булгакова.

Поисковый механизм игнорирует стоп-слова (предлоги, союзы, артикли), однако если какое-либо из таких слов существенно перед ним необходимо поставить "+", давая понять системе, что в данном случае термин даже из одной буквы является значимым (например: Александр +I).

Google имеет в своем арсенале множество опций для максимальной конкретизации запроса. Все они доступны через меню Advanced Search "Расширенный поиск". Помимо уже описанных возможностей добавляются фильтры, ограничивающие язык документа, его формат (к примеру, "только документы в PDF"), время опубликования ("последние три месяца"), месту термина в самом документе ("в заголовке страницы") или расположение страницы в определенном домене или даже сайте.

Выдаваемые в результате поиска ссылки на документы, помимо традиционных сведений о заглавии документа, контексте искомых слов и данных о размере содержат функцию Cached "Сохранено", позволяющую полностью восстановить весь документ, если по каким-либо причинам сайт на котором он расположен недоступен. Еще одна функция Similar pages "Похожие страницы" позволяет получить перечень страниц, содержание которых схоже с указанным источником. Это функция, впрочем, пока выполнена без особого успеха.

Помимо поиска текстовых материалов Google обладает лучшими на сегодня возможностями поиска иллюстраций с помощью режима "Поиск изображений" (Images, "Картинки"). В его базе данных учтено более 390 тысяч иллюстраций, разыскание которых ведется аналогично поиску текстовых документов с возможностью ограничения определенным размером, форматом или цветностью графических файлов - все через опцию "Расширенный поиск изображений".

При использовании Google следует, однако, помнить, что при работе с файлами большого объема он индексирует не весь источник, а лишь его первые 101 Кб. (для PDF-файлов лимит ограничен 120 Кб.) поэтому индексация документа пока не всегда гарантирует возможность его нахождения по любому фрагменту текста.

В качестве собственного справочника ресурсов Интернет Google использует усовершенствованный массив Open Directory Project, что порой позволяет сочетать достоинства обоих поисковых инструментов.

Дополнительным платным сервисом Google является поиск труднодоступной информации непосредственно человеком. Стоимость этого вида обслуживания - $2.50 за ответ.

Поисковая система AlltheWeb

Поисковая система, существующая с 1997 года, расположена в Европе (Норвегия) и изначально была ориентирована преимущественно на европейские сайты. В настоящее время отражает более 2.1 миллиарда документов, среди которых весомое место занимают русскоязычные материалы. Обновление базы производится раз в две недели, среднее время индексации - 5 недель. AlltheWeb способен индексировать PDF-файлы, которые обрабатываются без ограничения их размера.

Весь Web - интерфейс главной страницы.

Помимо текстовых разысканий в WWW, AlltheWeb поддерживает поиск в группах новостей по интересам, файлов на FTP-серверах, иллюстраций, видео фрагментов и MP3 файлов.

Система оперирует традиционным языком запросов, включающим знаки "+", "-", кавычки для поиска цитат, круглые скобки для поиска по условию ИЛИ. Более сложные ограничения задаются специфическими операторами системы. Однако для формирования многоуровневых запросов лучше обратится к Advanced Search ("Расширенному поиску"), который позволяет легко применить фильтры, в числе которых ограничения по местоположению термина в документе, определенному домену или сайту, времени опубликования, языку и даже объему исходной страницы.

Среди сервисных функций AlltheWeb возможность автоматически объединять результаты в "тематические" папки. Специальная функция позволяет каждому пользователю создать свой собственный интерфейс системы с указанием приоритетов при сортировке результатов и дополнительными услугами, как например, отправка найденных ссылок по электронной почте. Сам оправдывает название поискового механизма, именуемого Fast Search (Быстрый поиск).

Поисковая система Alta Vista

Система введена в эксплуатацию в 1996 году и в течении трех лет являлась признанным лидером сетевого поиска по объему индексного файла, эффективности ранжирования результатов и сервисным функциям. Именно в ней был впервые опробован ставший ныне традиционным язык запросов: знаки "+" и "-", усечение с помощью знака "*" и кавычки для поиска по точной фразе. В форме углубленного запроса были впервые эффективно использованы булевые операторы и оператор расстояния - NEAR.

На данный момент Alta Vista содержит сведения всего об 1 миллиарде web-страниц и статей из телеконференций. Декларируется полное обновление базы каждые три месяца. На сегодня этих показателей уже явно недостаточно, чтобы сохранить лидирующие позиции в мировом поисковом сервисе.

Перечень результатов в AltaVista

Под строкой с запросом приведены термины, ассоциируемые с искомыми ключевыми словами.

Единственным сервисом Alta Vista, сохраняющим актуальность является поиск мультимедийный файлов, в особенности аудио и видео. Поисковый механизм при этом опирается на имена мультимедийных файлов и подписи к иллюстрациям. До некоторой степени может быть полезна и функция перевода найденных страниц на ведущие европейские, а также китайский, корейский и японский языки.

Помимо перечисленный глобальных поисковых систем в некоторых случаях (более по инерции) продолжают использоваться устаревшие поисковые сервисы, среди которых наиболее заметны Lycos (www. lycos. сom), InfoSeek (www. ) и Excite (www. ). Малый объем их индексных файлов в настоящее время не позволяет полагаться на предоставляемые ими сведения. "Молодые" поисковые системы, запущенные в 2000 и 2001 годах, такие как WiseNut (www. ) и Teoma (www. ), несмотря на внушительный объем проиндексированных документов пока не представляют особого интереса. Ни одна из них, в частности, не способна осуществлять поиск документов на русском языке.

Информационно-поисковая система по законодательству - Garant

Программа Garant содержит в себе все Российское законодательство, а так же бухгалтерские законопроекты и системы налогов и документы для руководителя Менеджера. Все это тоже может пригодиться адвокату. С помощью этой программы юрист сможет быстро отыскать необходимый ему закон или документ, что значительно увеличит его работоспособность.

Эта программа имеет очень хорошо отлаженную поисковую систему, «По реквизитам» и «По ситуации». При использовании поиска «По реквизитам», Garant выдает небольшую табличку, в которой можно указать часть искомого документа, например:

- выбрать тип документа, допустим «кодекс» и программа выдаст все кодексы нашего законодательства;

- выбрать орган, допустим «орган власти города Москвы» и Garant выдаст все документы и законы выпущенные относительного этого органа;

- выбрать раздел документа, допустим «законодательство о приватизации» и программа опять же выдаст все что у нее есть по этому поводу;

- можно просто указать сроки издания закона, например с 1 января 98 года, по 1 февраля 98 года, и все документы выпущенные в этот период предстанут перед вами, а можно просто указать с какого-нибудь определенного числа и по сей день, так же можно указать дату регистрации в министерстве юстиции документа;

- если вам нужно найти какой-нибудь определенный закон или документ, шифр которого вам известен, то можно его набрать и Garant вам тут же его предоставит;

- программа Garant так же позволяет искать документ по контексту, это когда вам известно только несколько слов из закона который вам нужно отыскать или найти все законы содержащие эту фразу;

- так же можно указать статус документа, т. е. можно указать искать во всех документах или в действующих или в уже утративших силу;

- при поиске по контексту можно указать тип поиска, т. е. искать только в названии документа или икать и самом документе.

При поиске «По ситуации», вам просто необходимо набрать ключевое слово, и программа выдаст все документы которые у нее есть отсортированные по этому ключу, а вам просто нужно выбрать необходимый вам документ которые нашел для вас Garant по введенному ключу.

Из этой программы никогда ничего не удаляется, а только вносятся новые законы и они будут написаны черным цветом, а старые которые уже утратили силу просто будут написаны желтым цветом, это его способность тоже может сильно пригодиться адвокату, ведь адвокаты могут пересматривать дела заключенных которые сидят в тюрьме по закону, который уже утратил силу. Здесь вступает обратная сторона закона и чтоб выпустить невинного заключенного юрист должен ознакомиться с нынешним законодательством и с прошлым, а для этого ему необходимо поднять старые законы, а программа Garant ему предоставит и новые законодательства и старые, что тоже значительно ускорит работу юриста.

Также программа Garant содержит и много других возможностей для облегченной работы с ней, но они более специфические и редко используются.

История развития алгоритмов поиска Яндекса

1997 год - 23 сентября начала работать будущая самая популярная в России поисковая система. В поисковике образца 97 года учитывалась морфология русского языка. Система умела ранжировать результат в соответствии с релевантностью запроса. В ноябре система начала обрабатывать естественные поисковые запросы и выдавать соответствующие результаты.

С 1998 по 2002 годы система училась искать разные форматы документов, включая изображения, новости, товарные описания.

С 2002 по 2005 годы начался активный период создания коммерческих интернет-ресурсов, быстро заполоняющих рынок. Конкуренция росла, и за первые места в поисковой выдаче началась борьба. Основным методом продвижения стал обмен ссылками. В этот же период появились первые сервисы, обеспечивающие ссылочный обмен на автоматическом уровне. Продвижение в те годы было элементарным: обменяться линками, зарегистрироваться в тематических каталогах и гарантированно получить место в ТОПе. Бороться с автоматизированными сервисами Яндекс научился только в 2005 году. Тогда и была произведена первая глобальная «чистка» сайтов в поисковой выдаче.

С 2006 по 2007 годы начался период, который называют расцветом ссылочного ранжирования. Автоматизировались процессы закупки ссылок с главных страниц сайтов, а после - и с внутренних. Начала работать самая большая биржа ссылок - Sape.

17 января 2008 года - появляется первый поисковый алгоритм с собственным именем 8 SP1. Руководство Яндекса сообщает, что с этих пор все будущие поисковые алгоритмы будут носить названия населенных пунктов. Игра в «города» продолжилась на долгие годы: Яндекс начал достаточно серьезную борьбу со ссылочным продвижением. Сотни сайтов, пользующихся услугами ссылочных бирж, лишились «насиженных» позиций. В этот же период возникает понятие «непот-фильтра». Чуть позже жесткую борьбу пришлось немного смягчить, так как качество поисковой выдачи снизилось.

16 мая 2008 года - появление алгоритма «Магадан». В ТОП возвращаются сайты, продвигаемые с помощью покупных ссылок. Начинается учет траста. Яндекс начинает индексацию зарубежных ресурсов.

2 июля 2008 года - запуск «Магадан 2.0». В алгоритме впервые учитывается уникальность текстового контента. Поисковые запросы делят по географическому признаку. Появляются первые коммерческие запросы. Еще более важным становится фактор возраста ресурса (посредники начинают метаться в поиске старых доменов, массово скупая их).

12 сентября 2008 года - «Находка». Усовершенствована работа с тезаурусом: наличием стоп-слов в запросах, различными вариантами написания слов и т.п. Усилены фильтры, борющиеся с клоакингом и принудительным редиректом.

Источник: https://otherreferats.allbest.ru/download/1172171/