Профессиональный поиск в Интернете - Алексей Кутовенко
Шрифт:
Интервал:
Закладка:
Рис. 10.3. Система Sig.ma объединяет технологии поиска и мэшапов
На правой панели выводится список всех задействованных в поиске ресурсов. При наведении указателя мыши на отдельные фрагменты сводки на панели ресурсов подсвечиваются ссылки на источники, из которых были взяты данные сведения. Список ссылок можно сортировать по различным признакам. Кроме того, действует система фильтров, с помощью которой можно удалять из списка ссылок ненужные документы. После этой операции и списки ресурсов, и сводка автоматически перестраиваются. Результаты поиска Sig.ma можно не только просмотреть на сайте проекта, но и экспортировать на собственную веб-страницу в виде виджета.
Выводы и рекомендации
Семантический веб действительно имеет право называться «поколением Web 3.0», поскольку предлагаемые изменения носят принципиальный характер. В первую очередь это относится к ориентации ресурсов на поисковые агенты – программы, которые исполняют роль посредников между опубликованными в интернете разрозненными данными и пользователями. Однако период массового внедрения семантических технологий, скорее всего, будет еще достаточно продолжительным по времени. В таких условиях заслуживают внимания ресурсы, предлагающие удобные с точки зрения людей интерфейсы для работы с данными в семантических форматах. Большинство общедоступных поисковиков, способных стать «окнами» в Web 3.0, – это экспериментальные проекты. Многие проекты поддерживают подключение программ-агентов пользователей, и именно такой режим работы с ними является предпочтительным. Если же ориентироваться на самостоятельную работу пользователя, то практически вне конкуренции в настоящее время оказывается связка проектов Sindice/Sig.ma. Благодаря одним из самых удобных на сегодня интерфейсов просмотра семантических данных эти проекты можно рекомендовать широкому кругу пользователей, заинтересованных в работе с данными в форматах Web 3.0. Другие «герои» этой главы хоть и не могут похвастаться сопоставимыми интерфейсами, за счет охвата широкого спектра источников данных способны стать ценными средствами поиска.
Глава 11
Программы-помощники
Интернет-поиск – это одно из средств получения информации, необходимой для выполнения той или иной деятельности. Именно это является его главной целью. Поэтому в данный процесс входит не только обращение к поисковым интернет-машинам. Найдя с помощью таких поисковиков нужные ресурсы, приходится заниматься их анализом, сохранением и управлением созданным архивом. Эти задачи глобальны, и при активной работе с интернетом решать их приходится практически ежедневно. Поэтому вполне логичным стало появление специализированных приложений, облегчающих эту работу. Даная глава посвящена именно таким программам.
Среди всего многообразия программ-помощников в деле поиска и последующей обработки найденной информации можно выделить две основные группы: инструменты, помогающие непосредственно в поиске информации в Сети, и группа приложений, предназначенных для сохранения и обработки найденных данных.
Идея задействовать «настольное» приложение в качестве посредника между пользователем и интернет-поисковиками далеко не нова. Преимущества такого решения по сравнению со стандартным веб-поиском сводятся к двум аспектам. Первый – это возможность одновременного обращения к большому количеству интернет-поисковиков из единой формы запроса локальной программы. Второй – наличие дополнительных инструментов обработки и анализа найденных ссылок, а также сохранения результатов поиска в удобном формате.
При серьезном целенаправленном сборе информации в Сети часто возникает необходимость сохранения полезных ссылок или веб-страниц для дальнейшей работы. Результатом, кроме собственно полезного эффекта, становится стремительно растущий размер архивов на жестком диске. И если емкости современных дисков позволяют несколько свысока смотреть на проблему нехватки пространства, сортировка такого беспорядочного архива и поиск в нем стандартными средствами становятся настоящей головной болью.
Решать данную проблему можно различными способами. Все современные браузеры предлагают встроенные средства для работы с закладками, однако их функциональности хватает только для обслуживания относительно небольших архивов. Задачу поиска среди сохраненных веб-страниц можно возложить на всевозможные «настольные» индексаторы в духе Google Desktop Search и тому подобных. Со своей основной задачей – поиском – они справятся хорошо, однако упорядочить крупный архив с их помощью не получится, равно как, например, составить на основе использованных страниц библиографию к своей письменной работе или выполнить иное полезное, но не относящееся к собственно поиску действие. Наиболее эффективным средством обработки найденных данных являются специализированные менеджеры закладок и сохраненных веб-страниц.
Программы для метапоиска в интернете
Несмотря на кажущееся разнообразие выбора, пик популярности подобных приложений, похоже, позади. Большинство представленных в Сети локальных программ для интернет-поиска было создано в начале двухтысячных годов, многие не обновлялись с 2003–2005 года. Учитывая постоянные изменения поискового «ландшафта», польза от применения таких «старичков» представляется весьма сомнительной. Далее мы уделим внимание только последним решениям, которых не так много.
Современные программы для поиска в интернете значительно различаются по функциональности. Среди них есть как относительно простые приложения, оснащенные разумным минимумом функций, так и достаточно сложные решения, которые, по большому счету, являются локальными аналогами вертикальных тематических интернет-поисковиков. Такие приложения предлагают метапоиск среди большого количества специализированных поисковиков и интернет-ресурсов. Их ценность состоит именно в наличии больших каталогов ресурсов и возможности точного тематического поиска по узким запросам.
FirstStop WebSearch
Программа FirstStop WebSearch размещает свое поле для быстрого поиска прямо на рабочем столе Windows. Бесплатная версия программы предлагает только два тематических раздела поиска: в Сети в целом и в сервисах социальных закладок. Количество встроенных поисковиков невелико. Это компенсируется тем, что FirstStop WebSearch позволяет добавлять в базу собственные поисковики, причем определять переменные и форматировать строку запроса предлагается вручную – на сайте программы есть даже небольшая шпаргалка о том, как это делать. Предусмотрено автоматическое обновление базы поисковиков в соответствии с заданными пользователем параметрами. Кроме того, списки поисковиков можно импортировать и экспортировать вручную.
Оригинальная особенность данного приложения – кластеризация результатов. Панель Discovery Tree демонстрирует все автоматически выделенные программой ключевые слова, что позволяет быстро перемещаться по результаты поиска. К сожалению, быстрое исключение кластеров из результатов поиска не предусмотрено, что не дает эффективно фильтровать результаты. Для этой задачи служит отдельный инструмент, позволяющий отбирать страницы по заголовку, нашедшему ссылки поисковику и другим признакам (рис. 11.1).
Рис. 11.1. Поисковик FirstStop WebSearch
Результаты поиска можно сохранить и выгрузить в файл. Для дополнительной обработки результатов предлагается использовать сторонние программы – предусмотрена интеграция с пакетами Web Finalist и Monarch Search. Из полезных дополнений в данной программе можно отметить разве что встроенный каталогизатор ссылок на веб-сайты.
Copernic Agent
Copernic Agent остается, пожалуй, самым известным приложением для метапоиска в интернете. Существуют три версии приложения: Basic, Personal и Professional. «Базовая» версия бесплатна, однако обладает урезанной функциональностью. Мы рассмотрим наиболее мощную «профессиональную» версию. Это приложение обладает достаточно серьезными возможностями поиска и дополнительной обработки результатов.
Оценка одной из основных характеристик любого решения для мета-поиска – охват интернет-поисковиков – в Copernic неоднозначна, хотя заявлена поддержка нескольких сотен поисковиков и онлайновых справочников, разбитых на тематические и национальные группы. Каждая категория содержит до нескольких десятков поисковых ресурсов. Категории можно устанавливать и удалять, что напоминает работу с электронными словарями. При установке категории в списке поисковиков можно отобрать только нужные машины (рис. 11.2).
Рис. 11.2. Настройка поисковых категорий в программе Copernic Agent
Хотелось бы остановиться на национальных поисковых категориях Copernic. Предлагается десяток подборок для конкретных стран – от. Австралии до Индии. К сожалению, России здесь нет, наиболее близкое географически местоположение – Польша. Кроме того, предлагаются подборки поисковиков для работы с материалами на испанском, итальянском и французском языках. В этих блоках подобраны полезные поисковики, что делает Copernic хорошим инструментом для работы с некоторыми национальными сегментами Сети. Нельзя не отметить тематический поиск в новостях, блогах и таких полезных для специалистов источниках, как базы патентов. Перед таким массивом источников можно было бы только уважительно снять шляпу, если бы не пара неприятных нюансов, относящихся к наиболее универсальной и востребованной категории – простому веб-поиску.