Глубокая паутина
Глубокая паутина (также известна как невидимая паутина) — множество веб-страниц Всемирной паутины, неиндексируемых поисковыми системами. Термин произошел от соотв. англ. invisible web[1]. Наиболее значительной частью глубокой паутины является глубинный веб (от англ. deep web, hidden web), состоящий из веб-страниц, динамически-генерируемых по запросам к онлайн базам данных[2]. Не следует смешивать понятие глубокая паутина с понятием тёмная паутина (от англ. англ. dark web), под которым имеются в виду сетевые сегменты, вообще не подключённые к сети Интернет.
Суть проблемы
В глубокой паутине находятся веб-страницы, не связанные с другими гиперссылками — например, страницы, динамически создаваемые по запросам к базам данных. В глубокой паутине также находятся сайты, доступ к которым открыт только для зарегистрированных пользователей. Поисковые системы используют специальные роботы (англ. web crawler), которые переходят по гиперссылкам и индексируют содержимое веб-страниц, на которых они оказываются. В то же время, информация из баз данных, доступная пользователям через поисковые веб-формы (но не по гиперссылкам), остается недоступной для робота, неспособного в режиме реального времени правильно заполнить форму значениями (другими словами, сформировать запрос к базе данных). Таким образом, значительная часть Всемирной паутины оказывается скрыта от поисковых роботов. Используя аналогию, информация, будучи недоступной для поисковых систем, находится «на глубине» (от англ. deep).
Масштаб
В 2000 году поисковая компания «BrightPlanet» провела исследование, которое показало, что в глубокой паутине находится в 500 раз больше документов, чем доступно через поисковые системы. Конечно, эти цифры могут быть не совсем точными. Например, существует проблема с различением разных представлений одного и того же материала в базах данных.
Ключи к решению
В 2005 году компания «Yahoo!» сделала серьёзный шаг к решению этой проблемы. Компания выпустила поисковый движок «Yahoo! Subscriptions», который производит поиск по сайтам (пока немногочисленным), доступ к которым открыт только зарегистрированным участникам этих сайтов.
Это, однако, полностью не решило имеющейся проблемы. Эксперты поисковых систем по-прежнему пытаются найти технические возможности для индексации содержимого баз данных и доступа к закрытым веб-сайтам.
Специальные поисковые машины
- Yahoo! Subscriptions
- QProber: Классификация и поиск по «скрытым» базам данных
- MetaQuerier: Обследуя и интегрируя глубокую паутину
- CompletePlanet: Поиск по базам данных и специальным движкам
- WebInsight: Поиск по государственным базам данных России и СНГ
Литература
- ↑ Гари Прайс, Крис Шерман. "Невидимая паутина: Открывая источники информации, которые поисковые машины не видят" (англ. «The Invisible Web: Uncovering Information Sources Search Engines Can’t See», издательство CyberAge Books, 2001, ISBN 0-910965-51-X).
- ↑ Денис Шестаков, Наталья Воронцова (2005). "Структура русскоязычной части глубинного Веба". Интернет-математика 2005, стр.320-341. Ссылка
Ссылки
- Доклад компании BrightPlanet
- Общая информация о глубокой паутине
- Примеры открытия ресурсов глубокой паутины
- Портал невидимой паутины
bg:Дълбока мрежа da:Dybe net de:Deep Web en:Deep Web fa:وب پنهان fr:Web profond it:Web invisibile ja:深層Web sk:Neviditeľný web zh:暗网
Если вам нравится SbUP.com Сайт, вы можете поддержать его - BTC: bc1qppjcl3c2cyjazy6lepmrv3fh6ke9mxs7zpfky0 , TRC20 и ещё....