Понятие информации. Информация и данные. Отличия понятий информации и данных. Чем данные отличаются от информации

Данные - это тоже знания, однако знания совершенно особого рода. В первом приближении данные -это результат языковой фиксации единичного наблюдения, эксперимента, факта или ситуации . Примерами данных могут быть:

а) «такого-то числа, такого-то года, в момент t в определенной местности шел дождь» (метеорологическое данное)";

б) «цена деловой древесины в такой-то день такого-то года, по сведениям такой-то биржи, составляла столько-то долларов за тонну» (торговое данное);

в) «дефицит государственного бюджета в такой-то стране составлял в таком-то году столько-то миллиардов долларов» (финансовое данное);

г) «в такой-то момент времени автоматическая лаборатория, направляющаяся к Юпитеру, отклонилась от расчетной траектории на столько-то градусов, столько-то тысяч километров в таком-то направлении» (данные из сферы космической технологии).

С технологической точки зрения некоторые специалисты понятие «данные», как правило, определяют как информацию, которая хранится в базах данных и обрабатывается прикладными программами, или информация, представленная в виде последовательности символов и предназначенная для обработки в ЭВМ , т.е. данные включают только ту часть знаний, которые формализованы в такой степени, что над ними могут осуществляться процедуры формализованной обработки с помощью различных технических средств.

Данные - это информация, представленная в формализованном виде, пригодном для автоматической обработки при возможном участии человека . Данные - это информация, записанная (закодированная) на языке машины . Данные - это отдельные факты, характеризующие объекты, процессы и явления в предметной области, а также их свойства .

Между информацией и данными существует различие; Данные могут рассматриваться как признаки или записанные наблюдения, которые по каким-то причинам не используются, а только хранятся. Следовательно, в данный момент времени они не оказывают воздействия на поведение, на принятие решений. Однако данные превращаются в информацию, если такое воздействие существует.

Например, основной массив данных для ЭВМ состоит из таких признаков, которые не воздействуют на поведение. Пока эти данные не организованы соответствующим образом и не отражаются в виде выходного результата, чтобы руководитель действовал в соответствии с ними, они не являются информацией. Они остаются данными до тех пор, пока сотрудник не обратился к ним в связи с осуществлением тех или иных действий или в связи с некоторым решением, которое он обязан принять.

Данные превращаются в информацию, когда осознается их значение. Можно также сказать, что в том случае, когда появляется возможность использовать данные для уменьшения неопределенности о чем-либо, данные превращаются в информацию.

Циклы жизни данных

Подобно веществу и энергии, данные можно собирать, обрабатывать, хранить, изменять их формы. Однако у них есть некоторые особенности. Прежде всего, данные могут создаваться и исчезать. Так, например, данные о некотором вымершем животном могут исчезнуть, когда сжигается кусок угля с его отпечатками. Данные могут стираться, терять точность и т.д. Данные могут быть охарактеризованы циклом жизни (рис. 1.9), в котором основное значение имеют три аспекта - зарождение, обработка, хранение и поиск .

Воспроизведение и использование данных может осуществляться в различные моменты их цикла жизни и поэтому на схеме не показаны.

Рис. 1.9. Цикл «жизни» данных

При обработке на ЭВМ данные трансформируются, условно проходя следующие этапы:

1) данные как результат измерений и наблюдений:

2) данные на материальных носителях информации (таблицы, протоколы, справочники);

3) модели (структуры) данных в виде диаграмм, графиков, функций;

4) данные в компьютере на языке описания данных;

5) базы данных на машинных носителях.

Модели данных

Модель данных является ядром любой базы данных. Появление этого термина в начале 70-х годов двадцатого столетия связывается с работами американского кибернетика Э.Ф. Кодда, в которых отражался математический аспект модели данных, употребляемой в смысле структуры данных. В связи с потребностями развития технологии обработки данных в теории автоматизированных банков информации (АБИ) во второй половине 70-х годов появился инструментальный аспект модели данных, в содержание этого термина были включены ограничения, налагаемые на структуры данных и операции с ними.

В современной трактовке модель данных определяется как совокупность правил порождения структур данных в базах данных, операций над ними, а также ограничений целостности, определяющей допустимые связи и значения данных, последовательности их изменения .

Таким образом, модель данных представляет собой множество структур данных, ограничений целостности и операций манипулирования данными. Исходя из этого, можно сформулировать следующее рабочее определение: модель данных – это совокупность структур данных и операций их обработки.

В настоящее время различают" три основных типа моделей данных: иерархическая, сетевая и реляционная. Иерархическая модель данных организует данные в виде древовидной структуры и является реализацией логических связей: родовидовых отношений или отношений «целое - часть». Например, структура высшего учебного заведения - это многоуровневая иерархия (см. рис. 1.10).

Рис. 1.10. Пример иерархической структуры

Иерархическая (древовидная) БД состоит из упорядоченного набора деревьев; более точно, из упорядоченного набора нескольких экземпляров одного типа дерева. В этой модели исходные элементы порождают другие элементы, причем эти элементы в свою очередь порождают следующие элементы. Каждый порожденный элемент имеет только один порождающий элемент. Организационные структуры, списки материалов, оглавление в книгах, планы проектов, расписание встреч и многие другие совокупности данных могут быть представлены в иерархическом виде.

Основными недостатком данной модели является: а) сложность отображения связи между объектами типа «многие ко многим»; б) необходимость использования той иерархии, которая была заложена в основу БД при проектировании. Потребность в постоянной реорганизации данных (а часто невозможность этой реорганизации) привели к созданию более общей модели – сетевой.

Сетевой подход к организации данных является расширением иерархического подхода. Данная модель отличается от иерархической тем, что каждый порожденный элемент может иметь более одного порождающего элемента. Пример сетевой модели данных приведен на рис 1.11.

Поскольку сетевая БД может представлять непосредственно все виды связей, присущих данным соответствующей организации, по этим данным можно перемещаться, исследовать и запрашивать их всевозможными способами, т.е. сетевая модель не связана всего лишь одной иерархией. Однако для того, чтобы составить запрос к сетевой БД, необходимо достаточно глубоко вникнуть в её структуру (иметь под рукой схему этой БД) и выработать свой механизм навигации по базе данных, что является существенным недостатком этой модели БД.

Рис. 1.11. Пример сетевой структуры

Одним из недостатков рассмотренных выше моделей данных является то, что в некоторых случаях при иерархическом и сетевом представлении рост базы данных может привести к нарушению логического представления данных. Такие ситуации возникают при появлении новых пользователей, новых приложений и видов запросов, при учете других логических связей между элементами данных. Эти недостатки позволяет избежать реляционная модель данных.

Реляционной считается такая база данных, в которой все данные представлены для пользователя в виде прямоугольных таблиц значений данных, и все операции над базой данных сводятся к манипуляциям с таблицами.

Таблица состоит из столбцов (полей) и строк (записей); имеет имя, уникальное внутри базы данных. Таблица отражает тип объекта реального мира (сущность), а каждая ее строка - конкретный объект. Так, таблица Спортивная секция содержит сведения обо всех детях, занимающихся в данной -спортивной секции, а ее строки представляют собой набор значений атрибутов каждого конкретного ребёнка. Каждый столбец таблицы - это совокупность значений конкретного атрибута объекта. Столбец Вес, например, представляет собой совокупность всех весовых категорий детей, занимающихся в секции. В столбце Пол могут содержаться только два различных значения: «муж.» и «жен.». Эти значения выбираются из множества всех возможных значений атрибута объекта, которое называется доменом. Так, значения в столбце Вес выбираются из множества всех возможных весов детей.

Каждый столбец имеет имя, которое обычно записывается в верхней части таблицы. Эти столбцы называются полями таблицы. При проектировании таблиц в рамках конкретной СУБД имеется возможность выбрать для каждого поля его тип, т.е. определить для него набор правил по его отображению, а также определить те операции, которые можно, выполнять над данными, хранящимися в этом поле. Наборы типов могут различаться у разных СУБД.

Имя поля должно быть уникальным в таблице, однако различные таблицы могут иметь поля с одинаковыми именами. Любая таблица должна иметь, по крайней мере, одно поле; поля расположены в таблице в соответствии с порядком следования их имен при ее создании. В отличие от полей, строки не имеют имен; порядок их следования в таблице не определен, а количество логически не ограничено. Строки называются записями таблицы.

Так как строки в таблице не упорядочены, невозможно выбрать строку по ее позиции - среди них не существует "первой", "второй", "последней". Любая таблица имеет один или несколько столбцов, значения в которых однозначно идентифицируют каждую ее строку. Такой столбец (или комбинация столбцов) называется первичным ключом. В таблице Спортивная секция первичный ключ - это столбец Ф.И.О. (рис. 1.12).

Такой выбор первичного ключа имеет существенный недостаток: невозможно записать в секцию двух детей с одним и тем же значением поля Ф.И.О., что на практике встречается не так уж редко. Именно поэтому, часто вводят искусственное поле для нумерации записей в таблице. Таким полем, например, может быть номер в журнале для каждого ребёнка, который сможет обеспечить уникальность каждой записи в таблице. Если таб.лица удовлетворяет этому требованию, она называется отношением (relation).

Рис. 1.12. Реляционная модель данных

Реляционные модели данных обычно могут поддерживать четыре типа связей между таблицами:

1) Один к Одному (пример: в одной таблице хранятся сведения о школьниках, в другой сведения о прохождении школьниками прививок).

2) Один ко Многим (пример: в одной таблице хранятся сведения об учителях, в другой сведения о школьниках, у которых эти учителя являются классными руководителями).

3) Много к Одному (в качестве примера можно предложить предыдущий случай, рассматривая его с другой стороны, а именно со стороны таблицы, в которой хранятся сведения о школьниках).

4) Много ко Многим (пример: в одной таблице хранятся заказы на поставку товаров, а в другой - фирмы, исполняющие эти заказы, причем для выполнения одного заказа могут объединяться несколько фирм/

Реляционное представление данных имеет целый ряд преимуществ. Оно понятно пользователю, не являющемуся специалистом в области программирования, позволяет легко добавлять новые описания объектов и их характеристики, обладает большой гибкостью при обработке запросов.

Вопросы и задания

1. Дайте определение понятию «данные».

2. Что называется циклом жизни данных?

3. Какие модели данных вы знаете?

4. Укажите преимущества и недостатки каждой модели данных.


ИНФОРМАЦИОННЫЕ ПРОЦЕССЫ

К базовым понятиям, которые используются в экономической информатике, относятся: данные, информация и знания. Эти понятия часто используются как синонимы, однако между этими понятиями существуют принципиальные различия.

Термин данные происходит от слова data - факт, а информация (informatio) означает разъяснение, изложение, т.е. сведения или сообщение.

Данные - это совокупность сведений, зафиксированных на определенном носителе в форме, пригодной для постоянного хранения, передачи и обработки. Преобразование и обработка данных позволяет получить информацию.

Информация - это результат преобразования и анализа данных. Отличие информации от данных состоит в том, что данные - это фиксированные сведения о событиях и явлениях, которые хранятся на определенных носителях, а информация появляется в результате обработки данных при решении конкретных задач. Например, в базах данных хранятся различные данные, а по определенному запросу система управления базой данных выдает требуемую информацию.

Существуют и другие определения информации, например, информация - это сведения об объектах и явлениях окружающей среды, их параметрах, свойствах и состоянии, которые уменьшают имеющуюся о них степень неопределенности, неполноты знаний.

Знания - это зафиксированная и проверенная практикой обработанная информация, которая использовалась и может многократно использоваться для принятия решений.

Знания - это вид информации, которая хранится в базе знаний и отображает знания специалиста в конкретной предметной области. Знания - это интеллектуальный капитал.

Формальные знания могут быть в виде документов (стандартов, нормативов), регламентирующих принятие решений или учебников, инструкций с описанием решения задач. Неформальные знания - это знания и опыт специалистов в определенной предметной области.

Необходимо отметить, что универсальных определений этих понятий (данных, информации, знаний) нет, они трактуются по-разному. Принятия решений осуществляются на основе полученной информации и имеющихся знаний.

Принятие решений - это выбор наилучшего в некотором смысле варианта решения из множества допустимых на основании имеющейся информации. Взаимосвязь данных, информации и знаний в процессе принятия решений представлена на рисунке.

Взаимосвязь данных, информации и знаний в процессе принятия решений

Для решения поставленной задачи фиксированные данные обрабатываются на основании имеющихся знаний, далее полученная информация анализируется с помощью имеющихся знаний. На основании анализа, предлагаются все допустимые решения, а в результате выбора принимается одно наилучшее в некотором смысле решение. Результаты решения пополняют знания.

В зависимости от сферы использования информация может быть различной: научной, технической, управляющей, экономической и т.д. Для экономической информатики интерес представляет экономическая информация.

Информация - это сведения об объектах и явлениях окружающей среды, их параметрах, свойствах и состояниях, которые уменьшают имеющуюся о них степень неопределенности, неполноты знаний.

Данные – это совокупность сведений, зафиксированных на определенном носителе в форме, пригодной для постоянного хранения, передачи и обработки. Преобразование и обработка данных позволяет получить информацию. Становятся информацией, когда используются

2.Свойства информации: объективность, достоверность, полнота, актуальность, адекватность, доступность.

Свойства информации:

  1. Объективность информации. Объективный – существующий вне и независимо от человеческого сознания. Информация – это отражение внешнего объективного мира. Информация объективна, если она не зависит от методов ее фиксации, чьего-либо мнения, суждения. Пример. Сообщение «На улице тепло» несет субъективную информацию, а сообщение «На улице 22°С» – объективную. Объективную информацию можно получить с помощью исправных датчиков, измерительных приборов. Отражаясь в сознании человека, информация может искажаться в зависимости от мнения, суждения, опыта, знаний конкретного субъекта, и, таким образом, перестать быть объективной.
  2. Достоверность информации. Информация достоверна, если она отражает истинное положение дел. Объективная информация всегда достоверна, но достоверная информация может быть как объективной, так и субъективной. Достоверная информация помогает принять нам правильное решение. Недостоверной информация может быть по следующим причинам:
  • преднамеренное или непреднамеренное искажение субъективного свойства;
  • искажение в результате воздействия помех и недостаточно точных средств ее фиксации.
  • Полнота информации. Информацию можно назвать полной, если ее достаточно для понимания и принятия решений. Неполная информация может привести к ошибочному выводу или решению.
  • Актуальность информации – это степень соответствия информации текущему моменту времени Только вовремя полученная информация может быть полезна.
  • Адекватность информации - это степень соответствия реальному объективному состоянию дела. Неадекватная информация может образовываться при создании новой информации на основе неполных или недостоверных данных. Однако и полные, и достоверные данные могут приводить к созданию неадекватной информации в случае применения к ним неадекватных методов.
  • Доступность информации- мера возможности получить ту или иную информа­цию. На степень доступности информации влияют одновременно как доступность данных, так и доступность адекватных методов для их интерпретации. Отсутствие доступа к данным или отсутствие адекватных методов обработки данных приводят к одинаковому результату: информация оказывается недоступной.
  • В самом начале этой главы необходимо подчеркнуть разли чия между понятиями данные и информация. Между ними есть разница и довольно существенная. Согласно теории информации под данными следует понимать все те сведения, которые собираются и, что особенно важно, подвергаются специальной обработ ке с целью вьщеления из них (в том числе и с помощью расчетов) только тех сведений, которые окажутся необходимыми и полезны ми для решения данной конкретной задачи. Эти обработанные данные будут представлять собой информацию. А необработан ные сведения принято называть данными. Таким образом - подобная аналогия здесь вполне уместна - данные можно уподобить какой-либо руде, а информацию - добытым из нее полезным веществам. Данные всегда ассоциируют с избытком сведений, информацию же - с необходимой достаточностью. Информация, другими словами,- это то, что способствует приращению знаний, она всегда несет на себе печать новизны, представляет собой новые сведения. Но если сосредоточиться на маркетинговых исследова ниях, информация - это не любые новые сведения. В конечном итоге - это такие новые сведения, которые восприняты и оцене ны соответствующими службами (специалистами) для совершения конкретных профессиональных действий.

    Передача данных и появление информации

    Многочисленные трансформации данных на пути их превращения в информацию можно проследить по схеме, предложенной профессором Е.Г. Ясиным (рис. 5.1).

    Согласно этой схеме какая-то часть данных на пути движения к получателю первоначально теряется в физических каналах их передачи в форме так называемого физического шума (например, при проведении анкетирования в маркетинговых исследованиях некоторые анкеты оказались неправильно заполненными и их изымают из предстоящей обработки). Дошедшие до получателя данные (принятые) могут быть не все поняты им и восприняты в силу, допустим, недостаточного уровня знаний. Непонятые и невоспринятые данные проходят мимо сознания получателя в форме семантического шума. И наконец, из воспринятых получателем данных некоторая часть может быть просто им проигнорирована из-за того, что окажется излишней или просто непригодной для решаемых задач. В форме прагматического шума эта часть сообщений также проходит мимо сознания получателя. Оставшаяся часть данных и представляет собой собственно информацию, которая может быть использована в решении практических задач. Ясно, что на этапе оценки, по схеме Ясина, происходит и обработка данных, производятся необходимые вычислительные процедуры, сравнения и т.п.

    На практике понятия данные и информация часто отождествляют между собой, т.е. подменяют одно другим, что не способствует улучшению взаимопонимания между, допустим, исследователями рынка и заказчиками такого исследования при заключении между ними контрактов на проведение маркетинговых исследований. Но иногда такие отождествления вполне допустимы. В данной книге понятие информация будет применяться значительно чаще, чем понятие данные, хотя иногда автор воспользуется и понятием данные. Объяснение здесь простое: все дело в сложившихся традициях. В маркетинге, когда говорят об обосновании решений, чаще применяют термин информация, даже если речь идет о выборе для этого обоснования необходимых сведений (т.е. собственно информации) из их больших массивов (т.е. из массивов данных). А термин данные применяют в основном при первоначальном сборе любых сведений. Большого противоречия теории информации здесь нет, а поэтому сложившаяся традиция не нарушается.

    Рассуждая над вопросом отличия информации от данных, невольно задумываешься, а есть ли у них что-то общее?
    Мы так часто в речи заменяем одно слово другим, что не замечаем, как наши высказывания становятся абсурдными. Чтобы не попадать в глупую ситуацию, следует разобраться, что каждое из них обозначает.
    Между данными и информацией существует настольно тесная связь, что существование одного без другого либо невозможно, либо просто бессмысленно.
    Данные являются основой информации. По сути, они представляют собой просто набор символов. Но после того, как они прошли операцию интерпретации некой воспринимающей системой, данные становятся информацией.

    Условие возникновения

    Итак, информация возникает только в том случае, если имеется в наличии некий источник, содержащий данные, и, непосредственно, получатель. Данные могут преобразовываться в информацию несколькими путями: посредством подсчета, коррекции, сжатия, контекстуализации и разбития на категории.
    Данные являются зафиксированными на каком-либо источнике сведениями. В последнее время количество данных достигло невероятного роста. Это было вызвано быстрым ростом сети Интернет.

    Измерение

    Данные измерить нельзя. Как только мы станем подсчитывать данные, начнется процесс обработки. А значит, данные автоматически перейдут в разряд «информации». Информацию измерить можно. Для этого достаточно оценить уровень знаний до поступления информации и после нее.

    Результат преобразования

    Человеческий мозг, подобно самому совершенному компьютеру, обрабатывает полученные нами данные и выдает некую информацию. А когда возникает необходимость ее применить для другого мыслительного процесса, то для него эта информация в свою очередь становится данными, из которых будет получена новая информация.
    Конечной стадией преобразования информации, прошедшей многократную обработку в течении некоторого промежутка времени, становятся знания.

    Таким образом, ImGist выделяет следующие основные отличия информации от данных:

    Данные и информация тесно взаимосвязаны.
    Данные фиксированы, они реально существуют в каждую единицу времени. Информация возникает только при переработке этих данных.
    Данные после преобразования становятся информацией. Многократно проверенная информация — знания.
    Информация, в отличие от данных, субстанция измеряемая.



    
    Top