Студопедия

КАТЕГОРИИ:


Архитектура-(3434)Астрономия-(809)Биология-(7483)Биотехнологии-(1457)Военное дело-(14632)Высокие технологии-(1363)География-(913)Геология-(1438)Государство-(451)Демография-(1065)Дом-(47672)Журналистика и СМИ-(912)Изобретательство-(14524)Иностранные языки-(4268)Информатика-(17799)Искусство-(1338)История-(13644)Компьютеры-(11121)Косметика-(55)Кулинария-(373)Культура-(8427)Лингвистика-(374)Литература-(1642)Маркетинг-(23702)Математика-(16968)Машиностроение-(1700)Медицина-(12668)Менеджмент-(24684)Механика-(15423)Науковедение-(506)Образование-(11852)Охрана труда-(3308)Педагогика-(5571)Полиграфия-(1312)Политика-(7869)Право-(5454)Приборостроение-(1369)Программирование-(2801)Производство-(97182)Промышленность-(8706)Психология-(18388)Религия-(3217)Связь-(10668)Сельское хозяйство-(299)Социология-(6455)Спорт-(42831)Строительство-(4793)Торговля-(5050)Транспорт-(2929)Туризм-(1568)Физика-(3942)Философия-(17015)Финансы-(26596)Химия-(22929)Экология-(12095)Экономика-(9961)Электроника-(8441)Электротехника-(4623)Энергетика-(12629)Юриспруденция-(1492)Ядерная техника-(1748)

Средства закачки преобразования источников данных




Хранилища данных

ХД являются логически продолжением БД. ХД представляют собой логически интегрированную базу данных, обеспечивающую максимально быстрый и удобный доступ к информации, необходимой для анализа и поддержки принятия решений, а не автоматизацию повседневной деятельности предприятий, банков и т.д..

Основными источниками наполнения хранилища данных являются традиционные оперативные системы обработки данных и различные внешние источники, например, публичные отчеты предприятий, исторические архивы, результаты биржевых торгов, Интернет и т.п. (рис.5.2).

 

Рис.5.2.

Хранилища данных характеризуются следующими основными особенностями:

1. Ориентация на предметную область, то есть в хранилище помещается информация, полезная для работы систем поддержки принятия решений, и ее структура должна быть понятна пользователям.

2. Защищенность, предусматривающая неизменность и немодифицируемость данных, помещенных в хранилище, и доступность только в режиме чтения.

3. Поддержка хронологических данных, определяющая тот факт, что для анализа требуется информация, накопленная за длительный период времени.

4. Интеграция в едином хранилище ранее разъединенных данных, поступающих как из внутренних, так и внешних источников, а также их проверку, согласование и структурирование.

5. Агрегация, предусматривающая хранение не оперативных данных, а сортируемую, фильтруемую и определенным образом обработанную информацию (суммарную информацию).

6. Разделение наборов данных, используемых для оперативной обработки, и тех, которые применяются для решения аналитических задач.

Создание и развитие Хранилища данных требует следующих компонент программного обеспечения (ПО):

· СУБД Хранилища данных,

· средства закачки преобразования источников данных,

· средства закачки преобразования источников данных,

· средства проектирования хранилища,

· средства построения Витрин данных.

СУБД Хранилища данных должна быть ориентирована на особенности технологии ХД - работать с большими объемами данных, обеспечивать необходимую безопасность данных, позволять создавать очень сложные структуры данных (такие как многомерные базы данных), осуществлять быстрый многопользовательский доступ к данным.

В процессе погружения данные:

· Очищаются для устранения ненужной для анализа информации (адреса, почтовые индексы, идентификаторы записей и т.д.).

· Агрегируются (вычисляются суммарные, средние, минимальные, максимальные и другие статистические показатели).

· Преобразуются в единую структуру хранения из разных типов данных предметных приложений.

· При объединении данных из внутренних и внешних источников производится их преобразование в единый формат.

· Согласуются во времени, то есть приводятся в соответствие к одному моменту времени (например, к единому курсу рубля на текущий момент) для использования в сравнениях, трендах, прогнозах.

В результате создается репозиторий метаданных, то есть данные о данных. Метаданные играют роль справочников, содержащих сведения об источниках первичных данных, о методах загрузки информации из них, об алгоритмах обработки, которым были подвергнуты исходные данные, описание структуры этих данных и их взаимосвязей, периодичность их обновления и т.д.

Средства проектирования хранилища. Для быстрой реализации логической структуры данных необходимо иметь удобное интерактивное средство управления структурой ХД. Качество этого средства определяет скорость разработки и развития ХД, поэтому является очень важным фактором. Средство используется не только разработчиками, но и конечными пользователями (аналитиками) для построения своих структур данных в Витринах данных и должно иметь удобный и понятный интерфейс.

Средства построения Витрин данных. Одним из вариантов реализации на практике хранилища данных является построение витрин данных (Data Marts).

Витрины данных (Data Marts), как и хранилища, представляют собой структурированные информационные массивы, но отличие состоит в том, что витрины в еще большей степени являются предметно-ориентированными. Как правило, витрина содержит информацию, относящуюся к какому-либо опреде­ленному направлению деятельности организации. Поэтому информация в витрине данных хранится в специальном виде, наиболее подходящем для решения конкретных аналитических задач или обработки запросов определенной группы аналитиков или структурных подразделений.




Поделиться с друзьями:


Дата добавления: 2014-10-22; Просмотров: 385; Нарушение авторских прав?; Мы поможем в написании вашей работы!


Нам важно ваше мнение! Был ли полезен опубликованный материал? Да | Нет



studopedia.su - Студопедия (2013 - 2024) год. Все материалы представленные на сайте исключительно с целью ознакомления читателями и не преследуют коммерческих целей или нарушение авторских прав! Последнее добавление




Генерация страницы за: 0.013 сек.