70610

Проектирование хранилищ данных

Лекция

Информатика, кибернетика и программирование

При проектировании хранилищ данных необходимо выполнять следующие требования: хранилище должно иметь понятную для пользователей структуру данных; должны быть выделены статические данные которые модифицируются по расписанию ежедневно еженедельно ежеквартально...

Русский

2014-10-23

40.57 KB

5 чел.

Лекция 39

Проектирование хранилищ данных

В хранилища данных помещают данные, которые редко меняются. Хранилища ориентированы на выполнение аналитических запросов, обеспечивающих поддержку принятия решений для руководителей и менеджеров. При проектировании хранилищ данных необходимо выполнять следующие требования:

  1.  хранилище должно иметь понятную для пользователей структуру данных;
  2.  должны быть выделены статические данные, которые модифицируются по расписанию (ежедневно, еженедельно, ежеквартально);
  3.  должны быть упрощены требования к запросам для исключения запросов, требующих множественных утверждений SQL в традиционных реляционных СУБД;
  4.  должна обеспечиваться поддержка сложных запросов SQL, требующих обработки миллионов записей.

Как видно из этих требований, по своей структуре реляционные СУБД существенно отличаются от хранилищ данных. Нормализация данных в реляционных СУБД приводит к созданию множества связанных между собой таблиц. Выполнение сложных запросов неизбежно приводит к объединению многих таблиц, что значительно увеличивает время отклика. Проектирование хранилища данных подразумевает создание денормализованной структуры данных, ориентированных в первую очередь на высокую производительность при выполнении аналитических запросов. Нормализация делает модель хранилища слишком сложной, затрудняет ее понимание и снижает скорость выполнения запроса. Для эффективного проектирования хранилищ данных ERwin использует размерную модель – методологию проектирования, предназначенную специально для разработки хранилищ данных. Размерное моделирование сходно с моделированием связей и сущностей для реляционной модели, но имеет другую цель. Реляционная модель акцентируется на целостности и эффективности ввода данных. Размерная модель ориентирована в первую очередь на выполнение сложных запросов

В размерном моделировании принят стандарт модели, называемый схемой "звезда", которая обеспечивает высокую скорость выполнения запроса посредством денормализации и разделения данных. Невозможно создать универсальную структуру данных, обеспечивающую высокую скорость обработки любого запроса, поэтому схема "звезда" строится для обеспечения наивысшей производительности при выполнении самого важного запроса (или группы запросов).

Схема "звезда" обычно содержит одну большую таблицу, называемую таблицей факта, помещенную в центре. Ее окружают меньшие таблицы, называемые таблицами размерности, которые связаны с таблицей факта радиальными связями.

Для создания БД со схемой "звезда" необходимо проанализировать бизнес-правила предметной области для выяснения центрального запроса. Данные, обеспечивающие выполнение этого запроса, должны быть помещены в центральную таблицу. При проектировании хранилища важно определить источник данных, метод, которым данные извлекаются, преобразуются и фильтруются, прежде чем они импортируются в хранилище. Знания об источнике данных позволяют поддерживать регулярное обновление и проверку качества данных.

Вычисление размера БД

ERwin позволяет рассчитать приблизительный размер БД в целом, а также таблиц, индексов и других объектов через определенный период времени после начала эксплуатации ИС. Расчет строится на основе следующих параметров: начальное количество строк; максимальное количество строк; прирост количества строк в месяц. Результаты расчетов сводятся в отчет.

Прямое и обратное проектирование

Прямым проектированием называется процесс генерации физической схемы БД из логической модели. При генерации физической схемы ERwin включает триггеры ссылочной целостности, хранимые процедуры, индексы, ограничения и другие возможности, доступные при определении таблиц в выбранной СУБД.

Обратным проектированием называется процесс генерации логической модели из физической БД. Обратное проектирование позволяет конвертировать БД из одной СУБД в другую. После создания логической модели БД путем обратного проектирования можно переключиться на другой сервер и произвести прямое проектирование.

Кроме режима прямого и обратного проектирования программа обеспечивает синхронизацию между логической моделью и системным каталогом СУБД на протяжении всего жизненного цикла создания ИС.

Генерация кода клиентской части с помощью ERwin

Расширенные атрибуты

ERwin поддерживает не только проектирование сервера БД, но и автоматическую генерацию клиентского приложения в средах разработки MS Visual Basic и Power Builder. Технология генерации состоит в том, что на этапе разработки физической модели данных каждой колонке присваиваются расширенные атрибуты, содержащие информацию о свойствах объектов клиентского приложения (в том числе и визуальных), которые будут отображать информацию, хранящуюся в соответствующей колонке. Эта информация записывается в файле модели. На основе информации, содержащейся в расширенных атрибутах, генерируются экранные формы. Полученный код может быть откомпилирован и выполнен без дополнительного ручного кодирования.

Каждой колонке в модели ERwin можно задать предварительно описанные и именованные свойства:

  1.  правила валидации (проверка значений);
  2.  начальные значения, устанавливаемые по умолчанию;
  3.  стиль визуального объекта (например, радиокнопка, поле ввода и др.);
  4.  формат изображения.

Для описания каждого свойства ERwin содержит соответствующие редакторы.

Генерация кода в Visual Basic

ERwin поддерживает генерацию кода в Visual Basic версий 4.0 и 5.0. В качестве источника информации при генерации форм служит модель ERwin. С помощью ERwin можно одновременно описывать как клиентскую часть (объекты, отображающие данные на экране), так и сервер БД (процедуры и триггеры ), тем самым оптимально распределяя функциональность ИС между клиентской и серверной частью. Компонент ERwin Form Wizard автоматически проектирует формы с дочерними объектами – кнопками, списками, полями, радиокнопками и т. д., используя расширенные атрибуты. Совместное использование ERwin и Visual Basic позволяет сократить жизненный цикл разработки ИС путем употребления для каждой задачи наиболее эффективного инструмента. Visual Basic может быть использован для проектирования визуального интерфейса, а ERwin – для разработки физической и логической модели данных с последующей генерацией системного каталога сервера. Если БД уже существует, то с помощью ERwin можно провести обратное проектирование, полученную модель дополнить расширенными атрибутами и сгенерировать клиентское приложение.

Создание отчетов

Для генерации отчетов в ERwin имеется простой и эффективный инструмент – Report Browser. По умолчанию Report Browser содержит предварительно определенные отчеты, позволяющие наглядно представить информацию об основных объектах модели данных – как логической, так и физической. С помощью специального редактора существующие отчеты можно изменить или создать собственный отчет. Каждый отчет может быть настроен индивидуально, данные в нем могут быть отсортированы и отфильтрованы. Browser Report позволяет сохранять результаты выполнения отчетов, печатать и экспортировать их в распространенные форматы.

Генерация словарей

Для управления большими проектами ERwin имеет специальный инструмент – ERwin Dictionary, который обеспечивает коллективную работу над диаграммами и позволяет сохранять и документировать различные версии моделей данных. ERwin Dictionary представляет собой специальную БД, которая позволяет решить проблемы документирования и хранения моделей, однако не полностью отвечает требованиям многопользовательской работы.


 

А также другие работы, которые могут Вас заинтересовать

37961. Законы вращательного движения твердого тела 196.5 KB
  Проверка зависимости момента инерции грузов от расстояния до оси вращения. Рассмотрим твердое тело вращающееся вокруг оси ОО. Рассмотрим один из элементов массой mi расположенный на расстоянии ri от оси вращения. Моментом силы относительно оси называют физическую величину численно равную произведению силы на плечо.
37962. ОПРЕДЕЛЕНИЕ МОМЕНТОВ ИНЕРЦИИ ТВЕРДЫХ ТЕЛ МЕТОДОМ КРУТИЛЬНЫХ КОЛЕБАНИЙ 493.5 KB
  Момент инерции.11 ЛАБОРАТОРНАЯ РАБОТА № 4 ОПРЕДЕЛЕНИЕ МОМЕНТОВ ИНЕРЦИИ ТВЕРДЫХ ТЕЛ МЕТОДОМ КРУТИЛЬНЫХ КОЛЕБАНИЙ 1. Цель работы Исследование крутильных колебаний и измерение момента инерции тела сложной формы. Момент инерции.
37963. Определение моментов инерции тел произвольной формы 180 KB
  Определение моментов инерции математического и физического маятников8 3. Определение момента инерции физического маятника в зависимости от распределения массы10 4.11 Лабораторная работа № 5 Определение моментов инерции тел произвольной формы 1. Цель работы Определение момента инерции математического и физического маятника а также изучение зависимости момента инерции физического маятника от распределения массы.
37964. Изучение законов поступательного движения тела 786 KB
  Изучение законов поступательного движения тела 1. Цель работы Проверка основных законов кинематики и динамики поступательного движения тела на машине Атвуда. Теоретическая часть Простейшая форма движения это механическое движение которое характеризуется изменением с течением времени взаимного расположения тел или их частей относительно друг друга в пространстве.
37965. ПРОВЕРКА ОСНОВНЫХ ЗАКОНОВ КИНЕМАТИКИ И ДИНАМИКИ ПОСТУПАТЕЛЬНОГО ДВИЖЕНИЯ 480 KB
  МИНИСТЕРСТВО ОБРАЗОВАНИЯ РОССИЙСКОЙ ФЕДЕРАЦИИ РОССИЙСКИЙ ГОСУДАРСТВЕННЫЙ АВИФЦИОННЫЙ ТЕХНИЧЕСКИЙ УНИВЕРСИТЕТ КАФЕДРА ОБЩЕЙ ФИЗИКИ ПРОВЕРКА ОСНОВНЫХ ЗАКОНОВ КИНЕМАТИКИ И ДИНАМИКИ ПОСТУПАТЕЛЬНОГО ДВИЖЕНИЯ ТВЕРДОГО ТЕЛА Методические указания К лабораторной работе № 6 По курсу общей физики Уфа 2000 Составитель А.43 Проверка основных законов кинематики и динамики поступательного движения твердого тела; Методические указания к лабораторной работе № 6 по курсу общей физики Уфимск. Работа знакомит с...
37966. Изучение законов соударения тел 128 KB
  Центральный удар двух шаров. Цель работы Определение коэффициентов восстановления скорости и энергии при центральном ударе двух шаров времени и средней силы соударения. Центральный удар двух шаров Рассмотрим два шара подвешенных рядом так что их центры находятся на одном уровне. Отведем один из шаров на некоторый угол α и отпустим без начальной скорости.
37967. Конституция РФ 135 KB
  Найдите по тексту статью и главу Конституции РФ Федеративное устройство Российской Федерации основано на ее государственной целостности единстве системы государственной власти разграничении предметов ведения и полномочий между органами государственной власти Российской Федерации и органами государственной власти субъектов Российской Федерации равноправии и самоопределении народов в Российской Федерации Путь поиска: поиск контекста базовый поиск Федеративное устройство Российской Федерации основано на ее...
37968. Моделирование электростатического поля, знакомство с моделированием электрического поля методом электролитической ванны 87 KB
  Вектор напряженности направлен в каждой точке силовой линии по касательной к ней. Силовые линии пересекают эквипотенциальные поверхности под прямым углом. Перемещая зонд таким образом чтобы показания вольтметра не изменялись определите положение эквипотенциальной линии. Отметьте положение эквипотенциальной линии на координатной сетке 10.
37969. СМО з очікуванням. Багатоканальні пристрої 37 KB
  Система складається з 2 послідовних ланцюгів Кг 1й ланцюг 2й ланцюг Кількість каналів в 1му ланцюгу Кількість каналів в 2му ланцюгу 0 1 БКП ОКП 3 2 2 ОКП БКП 2 6 3 ОКП БКП 3 1 4 БКП БКП 1 2 5 і більше БКП ОКП 2 4 БКП багатоканальний пристрій ОКП одно канальний пристрій При написанні програми використати мінімум три різні розподіли при генерації та обробці транзактів Якщо вільного пристрою каналу немає транзакт ставиться до черги. Для ОКП: Якщо Кп парне то ОКП в пучку займаються по принципу: перший вільний починаючи...