Поиск информации что это информатика

Поиск информации

Информационный поиск (ИП) (англ. Information retrieval ) — процесс поиска неструктурированной документальной информации и наука об этом поиске.

Содержание

История

Термин «информационный поиск» был впервые введён Кельвином Муром в 1948 в его докторской диссертации, опубликован и употребляется в литературе с 1950.

Сначала системы автоматизированного ИП, или информационно-поисковые системы (ИПС), использовались лишь для управления информационным взрывом в научной литературе. Многие университеты и публичные библиотеки стали использовать ИПС для обеспечения доступа к книгам, журналам и другим документам. Широкое распространение ИПС получили с появлением сети Интернет. У русскоязычных пользователей наибольшей популярностью пользуются поисковые системы Яндекс и Рамблер.

Информационный поиск как процесс

Поиск информации представляет собой процесс выявления в некотором множестве документов (текстов) всех таких, которые посвящены указанной теме (предмету), удовлетворяют заранее определенному условию поиска (запросу) или содержат необходимые (соответствующие информационной потребности) факты, сведения, данные.

Процесс поиска включает последовательность операций, направленных на сбор, обработку и предоставление необходимой информации заинтересованным лицам.

В общем случае поиск информации состоит из четырех этапов:

Виды поиска

Полнотекстовый поиск — поиск по всему содержимому документа. Пример полнотекстового поиска — любой интернет-поисковик, например www.yandex.ru,

Поиск по метаданным — это поиск по неким атрибутам документа, поддерживаемым системой — название документа, дата создания, размер, автор и т. д. Пример поиска по реквизитам — диалог поиска в файловой системе (например, MS Windows).

Поиск по изображению — поиск по содержанию изображения. Поисковая система распознает содержание фотографии (загружена пользователем или добавлен URL изображения). В результатах поиска пользователь получает похожие изображения. Так работают поисковые системы:

Методы поиска

Адресный поиск

Процесс поиска документов по чисто формальным признакам, указанным в запросе.
Для осуществления нужны следующие условия:

Адресами документов могут выступать адреса веб-серверов и веб-страниц и элементы библиографической записи, и адреса хранения документов в хранилище.

Семантический поиск

Процесс поиска документов по их содержанию.
Условия:

Документальный поиск

Процесс поиска в хранилище информационно-поисковой системы первичных документов или в базе данных вторичных документов, соответствующих запросу пользователя.

Два вида документального поиска:

Фактографический поиск

Процесс поиска фактов, соответствующих информационному запросу.
К фактографическим данным относятся сведения, извлеченные из документов, как первичных, так и вторичных и получаемые непосредственно из источников их возникновения.

Различают два вида:

Информационный поиск как наука

Информационный поиск — большая междисциплинарная область науки, стоящая на пересечении когнитивной психологии, информатики, информационного дизайна, лингвистики, семиотики, и библиотечного дела.

ИП рассматривает поиск информации в документах, поиск самих документов, извлечение метаданных из документов, поиск текста, изображений, видео и звука в локальных реляционных базах данных, в гипертекстовых базах данных таких, как Интернет и локальные интранет-системы.

Существует некоторая путаница, связанная с понятиями поиска данных, поиска документов, информационного поиска и текстового поиска. Тем не менее, каждое из этих направлений исследования обладает собственными методиками, практическими наработками и литературой.

В настоящее время ИП — это бурно развивающаяся область науки, популярность которой обусловлено экспоненциальным ростом объемов информации, в частности в сети Интернет. ИП посвящена обширная литература и множество конференций. Одной из наиболее известных является Министерством обороны США совместно с Институтом Стандартов и Технологий (NIST) с целью консолидации исследовательского сообщества и развития методик оценки качества ИП.

Запрос и объект запроса

Говоря о системах ИП, употребляют термины запрос и объект запроса.

Запрос — это формализованный способ выражения информационных потребностей пользователем системы. Для выражения информационной потребности используется язык поисковых запросов, синтаксис варьируется от системы к системе. Кроме специального языка запросов, современные поисковые системы позволяют вводить запрос на естественном языке.

Объект запроса — это информационная сущность, которая хранится в базе автоматизированной системы поиска. Несмотря на то, что наиболее распространенным объектом запроса является текстовый документ, не существует никаких принципиальных ограничений. В частности, возможен поиск изображений, музыки и другой мультимедиа информации. Процесс занесения объектов поиска в ИПС называется индексацией. Далеко не всегда ИПС хранит точную копию объекта, нередко вместо неё хранится суррогат.

Задачи информационного поиска

Центральная задача ИП — помочь пользователю удовлетворить его информационную потребность. Так как описать информационные потребности пользователя технически непросто, они формулируются как некоторый запрос, представляющий из себя набор ключевых слов, характеризующий то, что ищет пользователь.

Классическая задача ИП, с которой началось развитие этой области, — это поиск документов, удовлетворяющих запросу, в рамках некоторой статической коллекции документов. Но список задач ИП постоянно расширяется и теперь включает:

Оценки эффективности

Существует много способов оценить насколько хорошо документы, найденные ИПС, соответствуют запросу. К сожалению, понятие степени соответствия запроса, или другими словами релевантности, является субъективным понятием, а степень соответствия зависит от конкретного человека, оценивающего результаты выполнения запроса.

Точность (precision)

Определяется как отношение числа релевантных документов, найденных ИПС, к общему числу документов:

Поиск информации что это информатика,

где Drel — это множество релевантных документов в базе, а Dretr — множество документов, найденных системой. По результатм исследований компании, оценивающей релевантность показателей основных русских и зарубежных поисковых систем.

0.698 Эти показатели были получены на основе анализа запроса на слово cat и по тому, как много релевантных ссылок выдаёт поисковик на 100 первых ответов.

Полнота (recall)

Отношение числа найденных релевантных документов, к общему числу релевантных документов в базе:

Поиск информации что это информатика,

где Drel — это множество релевантных документов в базе, а Dretr — множество документов, найденных системой.

Выпадение (fall-out)

Выпадение характеризует вероятность нахождения нерелевантного ресурса и определяется, как отношение числа найденных нерелевантных документов к общему числу нерелевантных документов в базе:

Поиск информации что это информатика,

где Dnrel — это множество нерелевантных документов в базе, а Dretr — множество документов, найденных системой.

F-мера (F-measure, мера Ван Ризбергена)

Традиционно F-мера определяется, как гармоническое среднее точности и полноты:

Поиск информации что это информатика

Часто ее также называют F1 мерой, потому что точность и полнота присутствуют в этой формуле с одинаковым весом.

Более общая формула для положительного вещественного α имеет вид:

Поиск информации что это информатика

См. также

Ссылки

Литература

Полезное

Смотреть что такое «Поиск информации» в других словарях:

Поиск информации — в узком смысле процесс выявления в массиве информации записей, удовлетворяющих заранее определенному условию поиска (запросу). По английски: Information retrieval Синонимы: Поиск данных См. также: Автоматизированный информационный поиск… … Финансовый словарь

поиск (информации) — — [http://slovarionline.ru/anglo russkiy slovar neftegazovoy promyishlennosti/] Тематики нефтегазовая промышленность EN retrieval … Справочник технического переводчика

поиск информации — — [http://www.iks media.ru/glossary/index.html?glossid=2400324] Тематики электросвязь, основные понятия EN information retreival … Справочник технического переводчика

поиск информации — informacijos paieška statusas T sritis automatika atitikmenys: angl. information retrieval vok. Informationserschließung, f; Wiederauffinden von Informationen, n; Wiedergewinnung von Nachrichten, f rus. информационный поиск, m; поиск информации,… … Automatikos terminų žodynas

ПОИСК ИНФОРМАЦИИ — совокупность логических и технических операций, конечной целью которых является извлечение из массива документов нужной информации или документа по заданным признакам в соответствии с запросом … Большой экономический словарь

Ретроспективный поиск информации — информационный поиск, проводимый во всем накопленном массиве документов или фактов по любому запросу, соответствующему тематике и виду информационного массива. По английски: Retrospective searching См. также: Информационный поиск Финансовый… … Финансовый словарь

ХРАНЕНИЕ И ПОИСК ИНФОРМАЦИИ — ХРАНЕНИЕ И ПОИСК ИНФОРМАЦИИ, отрасль КОМПЬЮТЕРНОЙ НАУКИ, изучающая функционирование массивов информации. Система поиска баз данных предполагает нахождение больших компьютерных файлов, содержащих необходимые ДАННЫЕ. Эти данные могут быть… … Научно-технический энциклопедический словарь

упорядоченный поиск информации — — [Л.Г.Суменко. Англо русский словарь по информационным технологиям. М.: ГП ЦНИИС, 2003.] Тематики информационные технологии в целом EN ordered retrieval … Справочник технического переводчика

хранение и поиск информации — — [http://www.iks media.ru/glossary/index.html?glossid=2400324] Тематики электросвязь, основные понятия EN information storage and retrievalISR … Справочник технического переводчика

Поиск подстроки — Поиск информации одно из основных использований компьютера. Одна из простейших задач поиска информации поиск точно заданной подстроки в строке. Тем не менее, эта задача чрезвычайно важна она применяется в текстовых редакторах,… … Википедия

Источник

Поиск информации что это информатика

Код ОГЭ по информатике: 2.4.1. Компьютерные энциклопедии и справочники; информация в компьютерных сетях, некомпьютерных источниках информации. Компьютерные и некомпьютерные каталоги, поисковые машины, формулирование запросов

Поиск информации (информационный поиск) — это информационный процесс, цель которого — получение информации из информационного объекта или из хранилища информационных объектов. Поиск информации является разновидностью процесса обработки информации. Для ускорения информационного поиска создают и используют информационно-поисковые системы.

Информационно-поисковая система (ИПС) — система, выполняющая функции хранения больших объёмов информации, быстрого поиска требуемой информации и её вывода в удобном для человека виде.

Информационно-поисковые системы позволяют добавлять, удалять и изменять хранимую информацию. Существуют информационно-поисковые системы двух видов:

Справочные ИПС, в свою очередь, делятся на:

Документальные и фактографические ИПС. Документальными ИПС являются книжные фонды, открытые для доступа в читальных залах библиотек или в магазинах. Однотипные информационные объекты (книги) стоят на стеллажах чаще всего в порядке отраслей знаний (философия, математика, физика и т. п.). Читатель (покупатель), проходя вдоль стеллажей, ищет сначала названия отраслей знаний, а затем книги в разделах.

В словарях однотипные информационные объекты (слова и связанные с ними описания) расположены в алфавитном порядке, что существенно ускоряет поиск нужного слова или словосочетания. В энциклопедиях в аналогичном порядке расположены другие однотипные информационные объекты — статьи с описанием понятий. По такому же принципу организованы алфавитные книжки для записи телефонов и адресов, а также список учеников класса в классном журнале.

В другом порядке — хронологическом — организованы фактографические ИПС, которые называются расписаниями. Имеются в виду расписания занятий, расписания движения поездов, самолётов и т. п.

Адресные ИПС в документах. Адресные ИПС распространены гораздо шире документальных и фактографических. Каждый бумажный документ, исключая словари и энциклопедии, имеет собственную адресную ИПС в виде оглавления (содержания). В оглавлении записаны названия разделов документа и указаны их адреса — номера страниц, на которых эти названия находятся.

Поиск информации в документе состоит из трёх этапов:

Адресные ИПС в хранилищах информационных объектов. В хранилищах бумажных документов (библиотеках, архивах) создаются адресные ИПС, которые называются каталогами.

Традиционные каталоги содержат бумажные карточки с описаниями документов и их адресов в хранилище (номер хранилища, номер стеллажа и т. д.). Адрес документа в хранилище называется шифром. Аналогичным образом организуется хранение и адресация звуко-, кино- и видеозаписей.

Поиск информации в хранилище информационных объектов состоит также из трёх этапов:

Оценка результатов поиска информации. Поиск информации в информационных объектах или в хранилищах информационных объектов редко бывает однократным. Результат поиска всегда оценивается с точки зрения полноты требуемой информации. Если информации недостаточно, поиск других источников информации проводят снова и снова, пока результат не станет удовлетворительным.

Поиск внутри компьютера

Для поиска файлов и папок в компьютере используют поле поиска в меню кнопки Пуск или в окне программы «Проводник». В программе «Проводник» это делать удобнее, так как можно сузить область поиска. Для этого в «Проводнике» открывают папку, в которой предположительно содержится искомый файл или папка.

Для запуска процесса поиска в поле поиска вводят символы из имени файла или его содержимого. В области просмотра появляется список файлов и папок, которые отвечают запросу. В строке каждого файла указан реальный путь к нему.

Условия поиска можно сохранить, используя кнопку Сохранить условия поиска на панели в верхней части области просмотра программы «Проводник».

Список с результатами поиска анализируется пользователем самостоятельно. Одно можно сказать точно: если файл на самом деле находится в компьютере, то его имя непременно окажется в списке результатов поиска.

Чтобы просмотреть файл в содержащей его папке, по строке файла щёлкают левой, потом правой клавишей мыши, а затем в контекстном меню щёлкают по пункту Расположение файла. В области просмотра открывается папка, содержащая файл.

Поиск в Интернете

Существует несколько сайтов, которые представляют в Интернете поисковые системы (поисковые машины), в том числе русскоязычные:

Поиск информации что это информатика

Поисковые системы представляют собой адресные информационно-поисковые системы. Они обычно включают два компонента:

Процедура поиска информации. Для проведения автоматического поиска вводят текстовый запрос в поле поиска поисковой системы.

В поле поиска обычно вводят ключевые слова, которые отражают суть запроса, например «тезаурус». Запрос можно также сформулировать в виде вопроса, например: «Что такое тезаурус?». Поисковая система при этом игнорирует орфографические ошибки:

Поиск информации что это информатика

По умолчанию поисковые системы настроены на поиск в Интернете веб-страниц, которые содержат ключевые слова. Иногда требуется сузить область поиска, чтобы, например, найти новостную страницу или страницу-словарь, либо изменить объект поиска, чтобы, например, найти картинку, музыку, видео.

Поиск информации что это информатика

Для выбора объекта и области поиска поисковые системы в Интернете предлагают меню. После ввода данных щёлкают по кнопке Найти (или аналогичной). Через некоторое время окно браузера обновляется и в нём появляются результаты поиска в виде списка гиперссылок на документы. Этот список может содержать тысячи гиперссылок. По первой двадцатке списка всегда видно, точным ли был запрос. Иногда запрос следует уточнить и запустить поисковую систему ещё раз. В любом случае для получения ответа достаточно просмотреть первую сотню документов, обращаясь к ним с помощью гиперссылок из списка.

Поисковые каталоги. Многие поисковые системы на своих веб-страницах имеют поисковые каталоги, которые построены в виде меню, пунктами которого являются разделы каталога. Принцип построения поисковых каталогов аналогичен принципу построения дерева папок в компьютере. Выбор пункта каталога открывает новое меню, в котором также делают выбор. И так до тех пор, пока на экран не будет выведен список ссылок, входящих в конечный пункт каталога. В процессе поиска следует только правильно определяться с выбором пунктов каталога.

Сохранение информации из Интернета. Просмотр веб-страниц может сопровождаться сохранением информации с этих страниц.

Если сохранения требует вся веб-страница, находящаяся в браузере, то вводят команду меню Файл|Сохранить как. Появляется диалоговое окно сохранения. В поле «Тип файла» выбирают уровень полноты сохранения — полностью веб-страница с включением графики, файл веб-страницы без графики или только текст веб-страницы. Операцию заканчивают щелчком по кнопке Сохранить.

Если сохранение требуется только для части веб-страницы, то требуемую информацию выделяют в браузере буксировкой мыши, как в текстовом редакторе, копируют в буфер обмена, а затем вставляют из буфера обмена в новый документ в текстовом редакторе «Блокнот» или Word. Сохранение получившегося документа делают обычным способом.

Именно так в Интернете можно собрать информацию для подготовки реферата практически на любую тему.

Чтобы сохранить ссылку на веб-страницу, достаточно ввести команду меню Избранное|Добавить в «Избранное», в диалоговом окне подобрать папку для сохранения и щёлкнуть по кнопке Добавить. Ссылка войдёт в меню кнопки Избранное.

Конспект урока по информатике «Поиск информации. Поисковые системы».

Источник

Поиск информации

Урок 25. Информатика 5 класс ФГОС

Поиск информации что это информатика

Поиск информации что это информатика

В данный момент вы не можете посмотреть или раздать видеоурок ученикам

Чтобы получить доступ к этому и другим видеоурокам комплекта, вам нужно добавить его в личный кабинет, приобрев в каталоге.

Получите невероятные возможности

Поиск информации что это информатика

Поиск информации что это информатика

Поиск информации что это информатика

Конспект урока «Поиск информации»

На сегодняшнем уроке мы рассмотрим ещё один вид обработки информации ‒поиск.

С поиском информации мы сталкиваемся практически каждый день. Рассмотрим несколько жизненных примеров:

Никите нужно подготовить доклад о растительном мире России. Для получения необходимой информации о растениях мальчик отправляется в библиотеку и осуществляет поиск информации.

Поиск информации что это информатика

Студентка Даша собирается с друзьями в поход. «А вдруг ожидается дождь?» ‒ думает Даша. В поиске информации о погоде на ближайшее время Даше поможет Интернет.

Поиск информации что это информатика

Николай Петрович желает узнать, какие интересные передачи будут транслироваться по телевизору на выходных. Николай Петрович берет газету и ищет программу телепередач.

Поиск информации что это информатика

Существуют даже целые организации, которые помогают человеку узнать необходимую информацию. Например, телефонная справочная служба, которая появилась ещё в середине прошлого века, предоставит всю необходимую информацию клиентам об организациях города, вокзалах, школах, аэропортах. Любой обратившейся в телефонную справочную получит требуемый адрес и телефон.

Искусственные спутники, созданные человеком и выведенные на орбиту Земли, собирают информацию о нашей планете, а затем передают её учёным. Это информация и о рельефе земной поверхности, и об изменениях погоды, и о магнитном поле, и о радиационной обстановке.

Обычно информация храниться в специальных хранилищах информации. Это может быть записная книжка, сеть Интернет, Flash-карта или диск. Если информация в хранилище упорядоченная, то её поиск не составит труда.

Поиск информации что это информатика

На этом уроке научимся осуществлять поиск информации в сети Интернет.

Откроем браузер Internet Explorer.

Браузер ‒ это программа для работы с информацией в сети Интернет.

Существуют специальные системы для поиска нужной информации в сети. Называются они поисковые системы. Откроем страницы наиболее распространённых из них.

Яндекс – крупнейший ресурс для поиска информации среди русскоязычных пользователей.

Google — самая популярная поисковая система в мире.

Поисковая система «Mail» появилась не так давно, но при этом развивается очень быстро.

Рамблер является старейшей Российской поисковой системой.

Откроем текстовый документ «День информатики» из папки «Заготовки». В этом задании необходимо собрать данные о Дне информатики и занести их в соответствующие строки в этой таблице.

Вернёмся к поисковой системе «Яндекс».

Поиск информации что это информатика

Введём поисковый запрос «День информатики». Затем справа от поискового запроса нажмём кнопку «Найти». Появились результаты поиска – это огромное количество ссылок на интернет страницы. После каждой ссылки находится краткое описание страницы. На первых местах расположены ссылки на страницы, в которых информация наиболее точно соответствует запросу, введённому в поле поиска. Можно сказать, что страницы отсортированы по релевантности.

Нажмём на первую ссылку и поищем ответ на первый вопрос: «Когда отмечается день информатики в России?».

Вот ответ: «4 декабря 1948 года считается днём рождения российской информатики. Копируем эту фразу и вставляем в нужную ячейку таблицы.»

Ищем ответ на следующий вопрос: «Кем и когда был введён термин информатика?». Термин «информатика» впервые был введён немцем Карлом Штейнбухом в 1957 году.

Копируем и вставляем ответ в таблицу.

Перейдём по ссылке в поисковой системе на следующий сайт. Найдём ответ на вопрос: «В каком году появилась информатика, как дисциплина, изучаемая в школе?». Вот ответ: «Информатика как учебная дисциплина впервые появилась в школах Советского Союза в 1985 году». Копируем его и вставляем в таблицу.

Прочитаем последний вопрос: «Кто был автором первого учебника «Основы информатики и вычислительной техники»?» Найдём ответ на интернет странице. Копируем его и вставляем в таблицу.

После того, как вся необходимая информация занесена в таблицу, необходимо указать ссылки на источники, из которых эта информация была взята. Адреса сайтов указаны в специальной строке. Такая строка называется «Адресная». Скопируем адрес сайта. Для этого щелкаем по адресной строке. Адрес сайта выделяется другим цветом. Копируем его и вставляем в необходимое место под таблицей. Сделаем те же действия и для указания и другого источника.

Сохраним документ под именем «День информатики 1».

Сегодня на уроке мы познакомились ещё с одним видом обработки информации – её поиском и научились искать информацию в сети Интернет.

Источник

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *