Современные подходы к поиску информации используют две общие техники: (1) сопоставление слов в запросе с индексом базы данных (поиск по ключевому слову) и (2) перемещение по базе данных с помощью гипертекстовых или гипермедийных ссылок.
Поиск по ключевым словам можно сделать как более общим, так и более узким с помощью логических операторов (например, дизъюнкции и конъюнкции). Однако из-за семантической неоднозначности, связанной с индексированием свободного текста, точность поиска по ключевым словам, то есть процент правильно найденных релевантных документов из коллекции, далека от идеальной, и для ее повышения были введены различные модификации. В одной из них поисковая выдача сортируется по степени релевантности, основанной на статистическом совпадении ключевых слов в запросе и в документе; в другой — программа автоматически генерирует новый запрос, используя один или несколько документов, которые пользователь считает релевантными. Поиск по ключевым словам был доминирующим подходом к поиску текста с начала 1960-х годов; гипертекст до сих пор был в основном ограничен персональными или корпоративными информационно-поисковыми приложениями.
Экспоненциальный рост использования компьютерных сетей в 1990-х годах предвещает значительные изменения в системах и методах поиска информации. В широкомасштабных информационных службах, ряд которых начал функционировать в начале 1990-х годов в компьютерной сети Интернет, персональный компьютер или терминал пользователя (так называемый клиент) может осуществлять одновременный поиск в нескольких базах данных, находящихся на разнородных компьютерах (так называемых серверах). Последние расположены в разных географических точках, а их базы данных содержат различные типы данных и часто используют несовместимые форматы. Одновременный распределенный поиск возможен благодаря тому, что клиенты и серверы согласовывают стандартную схему адресации документов и принимают общий протокол связи, учитывающий все типы и форматы данных, используемые серверами. Связь с другими широкополосными сервисами, использующими другие протоколы, осуществляется путем маршрутизации через так называемые шлюзы, способные транслировать протоколы. Архитектура типичной сетевой информационной системы показана на рисунке 5. Показаны несколько представительных клиентов: «тупой» терминал (т. е. не имеющий внутреннего процессора), персональный компьютер (PC), Macintosh (Mac) и машина NeXT. Они имеют доступ к данным на серверах, работающих по общему протоколу, а также к данным, предоставляемым службами, которые требуют преобразования протокола через шлюзы. Сетевые новости — это такая широкомасштабная служба, содержащая сотни групп новостей на самые разные темы, по
Развивающиеся методы поиска информации, примером которых может служить экспериментальный интерфейс к справочнику по космическим шаттлам НАСА, сочетают в себе естественный язык, гиперссылки и поиск по ключевым словам. Другие техники, стремящиеся к более высокому уровню точности и эффективности поиска, изучаются исследователями, занимающимися искусственным интеллектом и нейронными сетями. Следующей важной вехой может стать компьютерная программа, которая будет путешествовать по бесшовной информационной вселенной глобальных электронных сетей и непрерывно фильтровать ее содержимое через профили организационных и личных интересов: информационный робот XXI века.