70610

Проектирование хранилищ данных

Лекция

Информатика, кибернетика и программирование

При проектировании хранилищ данных необходимо выполнять следующие требования: хранилище должно иметь понятную для пользователей структуру данных; должны быть выделены статические данные которые модифицируются по расписанию ежедневно еженедельно ежеквартально...

Русский

2014-10-23

40.57 KB

5 чел.

Лекция 39

Проектирование хранилищ данных

В хранилища данных помещают данные, которые редко меняются. Хранилища ориентированы на выполнение аналитических запросов, обеспечивающих поддержку принятия решений для руководителей и менеджеров. При проектировании хранилищ данных необходимо выполнять следующие требования:

  1.  хранилище должно иметь понятную для пользователей структуру данных;
  2.  должны быть выделены статические данные, которые модифицируются по расписанию (ежедневно, еженедельно, ежеквартально);
  3.  должны быть упрощены требования к запросам для исключения запросов, требующих множественных утверждений SQL в традиционных реляционных СУБД;
  4.  должна обеспечиваться поддержка сложных запросов SQL, требующих обработки миллионов записей.

Как видно из этих требований, по своей структуре реляционные СУБД существенно отличаются от хранилищ данных. Нормализация данных в реляционных СУБД приводит к созданию множества связанных между собой таблиц. Выполнение сложных запросов неизбежно приводит к объединению многих таблиц, что значительно увеличивает время отклика. Проектирование хранилища данных подразумевает создание денормализованной структуры данных, ориентированных в первую очередь на высокую производительность при выполнении аналитических запросов. Нормализация делает модель хранилища слишком сложной, затрудняет ее понимание и снижает скорость выполнения запроса. Для эффективного проектирования хранилищ данных ERwin использует размерную модель – методологию проектирования, предназначенную специально для разработки хранилищ данных. Размерное моделирование сходно с моделированием связей и сущностей для реляционной модели, но имеет другую цель. Реляционная модель акцентируется на целостности и эффективности ввода данных. Размерная модель ориентирована в первую очередь на выполнение сложных запросов

В размерном моделировании принят стандарт модели, называемый схемой "звезда", которая обеспечивает высокую скорость выполнения запроса посредством денормализации и разделения данных. Невозможно создать универсальную структуру данных, обеспечивающую высокую скорость обработки любого запроса, поэтому схема "звезда" строится для обеспечения наивысшей производительности при выполнении самого важного запроса (или группы запросов).

Схема "звезда" обычно содержит одну большую таблицу, называемую таблицей факта, помещенную в центре. Ее окружают меньшие таблицы, называемые таблицами размерности, которые связаны с таблицей факта радиальными связями.

Для создания БД со схемой "звезда" необходимо проанализировать бизнес-правила предметной области для выяснения центрального запроса. Данные, обеспечивающие выполнение этого запроса, должны быть помещены в центральную таблицу. При проектировании хранилища важно определить источник данных, метод, которым данные извлекаются, преобразуются и фильтруются, прежде чем они импортируются в хранилище. Знания об источнике данных позволяют поддерживать регулярное обновление и проверку качества данных.

Вычисление размера БД

ERwin позволяет рассчитать приблизительный размер БД в целом, а также таблиц, индексов и других объектов через определенный период времени после начала эксплуатации ИС. Расчет строится на основе следующих параметров: начальное количество строк; максимальное количество строк; прирост количества строк в месяц. Результаты расчетов сводятся в отчет.

Прямое и обратное проектирование

Прямым проектированием называется процесс генерации физической схемы БД из логической модели. При генерации физической схемы ERwin включает триггеры ссылочной целостности, хранимые процедуры, индексы, ограничения и другие возможности, доступные при определении таблиц в выбранной СУБД.

Обратным проектированием называется процесс генерации логической модели из физической БД. Обратное проектирование позволяет конвертировать БД из одной СУБД в другую. После создания логической модели БД путем обратного проектирования можно переключиться на другой сервер и произвести прямое проектирование.

Кроме режима прямого и обратного проектирования программа обеспечивает синхронизацию между логической моделью и системным каталогом СУБД на протяжении всего жизненного цикла создания ИС.

Генерация кода клиентской части с помощью ERwin

Расширенные атрибуты

ERwin поддерживает не только проектирование сервера БД, но и автоматическую генерацию клиентского приложения в средах разработки MS Visual Basic и Power Builder. Технология генерации состоит в том, что на этапе разработки физической модели данных каждой колонке присваиваются расширенные атрибуты, содержащие информацию о свойствах объектов клиентского приложения (в том числе и визуальных), которые будут отображать информацию, хранящуюся в соответствующей колонке. Эта информация записывается в файле модели. На основе информации, содержащейся в расширенных атрибутах, генерируются экранные формы. Полученный код может быть откомпилирован и выполнен без дополнительного ручного кодирования.

Каждой колонке в модели ERwin можно задать предварительно описанные и именованные свойства:

  1.  правила валидации (проверка значений);
  2.  начальные значения, устанавливаемые по умолчанию;
  3.  стиль визуального объекта (например, радиокнопка, поле ввода и др.);
  4.  формат изображения.

Для описания каждого свойства ERwin содержит соответствующие редакторы.

Генерация кода в Visual Basic

ERwin поддерживает генерацию кода в Visual Basic версий 4.0 и 5.0. В качестве источника информации при генерации форм служит модель ERwin. С помощью ERwin можно одновременно описывать как клиентскую часть (объекты, отображающие данные на экране), так и сервер БД (процедуры и триггеры ), тем самым оптимально распределяя функциональность ИС между клиентской и серверной частью. Компонент ERwin Form Wizard автоматически проектирует формы с дочерними объектами – кнопками, списками, полями, радиокнопками и т. д., используя расширенные атрибуты. Совместное использование ERwin и Visual Basic позволяет сократить жизненный цикл разработки ИС путем употребления для каждой задачи наиболее эффективного инструмента. Visual Basic может быть использован для проектирования визуального интерфейса, а ERwin – для разработки физической и логической модели данных с последующей генерацией системного каталога сервера. Если БД уже существует, то с помощью ERwin можно провести обратное проектирование, полученную модель дополнить расширенными атрибутами и сгенерировать клиентское приложение.

Создание отчетов

Для генерации отчетов в ERwin имеется простой и эффективный инструмент – Report Browser. По умолчанию Report Browser содержит предварительно определенные отчеты, позволяющие наглядно представить информацию об основных объектах модели данных – как логической, так и физической. С помощью специального редактора существующие отчеты можно изменить или создать собственный отчет. Каждый отчет может быть настроен индивидуально, данные в нем могут быть отсортированы и отфильтрованы. Browser Report позволяет сохранять результаты выполнения отчетов, печатать и экспортировать их в распространенные форматы.

Генерация словарей

Для управления большими проектами ERwin имеет специальный инструмент – ERwin Dictionary, который обеспечивает коллективную работу над диаграммами и позволяет сохранять и документировать различные версии моделей данных. ERwin Dictionary представляет собой специальную БД, которая позволяет решить проблемы документирования и хранения моделей, однако не полностью отвечает требованиям многопользовательской работы.


 

А также другие работы, которые могут Вас заинтересовать

59858. Дії з десятковими дробами. 6 клас 3.22 MB
  Зацвітають перші весняні квіти. Епіграф нашого уроку слова Максима Рильського: Люби природу не як символ душі своєї Люби природу не для себе люби для неї Сьогодні ми з вами повторимо дії з десятковими дробами подорожуючи країною квітів і дізнаємось багато цікавого про квіти.
59859. МАТЕМАТИЧНИЙ ВЕЧІР «ЧУДОВА СІМКА» 6.32 MB
  Оформлення: розвішані стінгазети де центральне місце займає цифра 7 виставка малюнків по темі: У гостях у казки виставка творчих робіт з теми: Сім чудес світу карта України мультимедійна презентація Сім чудес. Наша сьогоднішня програма для учнів...
59860. Використання дидактичних ігор на уроках мови та читання 1.57 MB
  Кожна дидактична гра виконує різні функції: збагачує пізнавальний досвід дітей; розвиває мислення мову уяву точність; викликає інтерес до навчання. Ігри на уроках читання і мови Гра Встанови звязки використовується як для розвитку уяви так і для словеснологічного мислення. Гра “Яка буква†Це завдання можна виконати в групах або в парах.
59861. ВИКОРИСТАННЯ ЗАСОБІВ МУЛЬТИМЕДІА НА УРОКАХ УКРАЇНСЬКОЇ МОВИ З ТЕМИ «ЗДОРОВИЙ СПОСІБ ЖИТТЯ» 36.5 KB
  У дугому блоці подається три презентації: урок у 56 класах Обираємо здоровий спосіб життя з використанням інноваційних технологій навчання; діалогічне та монологічне висловлювання у 78 класах з теми Чому українці повинні жити 150 років; інформдайджест який використовується у процесі підготовки монологічного чи діалогічного висловлювання у 911 класах. У третьому блоці розміщено відеоролики розраховані на використання різних форм роботи на уроці але можна запропонувати найдоцільніші з них а саме: створення речень за...
59862. Математика 115 KB
  В порядке очереди каждая команда дает ответ на каждый вопрос или соглашается с первым ответом или дает свой ответ. По сколько километров пробежала каждая лошадь ответ: по 40км На грядке сидят 6 воробьев к ним прилетели еще 5.
59864. Вікторина «Я люблю тебе, Україно!» 69 KB
  Мета: узагальнити і систематизувати знання учнів з фізичної географії України підтримати інтерес до предмета географії; розвивати творчі та організаторські навички учнів пізнавальний інтерес;...