70610

Проектирование хранилищ данных

Лекция

Информатика, кибернетика и программирование

При проектировании хранилищ данных необходимо выполнять следующие требования: хранилище должно иметь понятную для пользователей структуру данных; должны быть выделены статические данные которые модифицируются по расписанию ежедневно еженедельно ежеквартально...

Русский

2014-10-23

40.57 KB

4 чел.

Лекция 39

Проектирование хранилищ данных

В хранилища данных помещают данные, которые редко меняются. Хранилища ориентированы на выполнение аналитических запросов, обеспечивающих поддержку принятия решений для руководителей и менеджеров. При проектировании хранилищ данных необходимо выполнять следующие требования:

  1.  хранилище должно иметь понятную для пользователей структуру данных;
  2.  должны быть выделены статические данные, которые модифицируются по расписанию (ежедневно, еженедельно, ежеквартально);
  3.  должны быть упрощены требования к запросам для исключения запросов, требующих множественных утверждений SQL в традиционных реляционных СУБД;
  4.  должна обеспечиваться поддержка сложных запросов SQL, требующих обработки миллионов записей.

Как видно из этих требований, по своей структуре реляционные СУБД существенно отличаются от хранилищ данных. Нормализация данных в реляционных СУБД приводит к созданию множества связанных между собой таблиц. Выполнение сложных запросов неизбежно приводит к объединению многих таблиц, что значительно увеличивает время отклика. Проектирование хранилища данных подразумевает создание денормализованной структуры данных, ориентированных в первую очередь на высокую производительность при выполнении аналитических запросов. Нормализация делает модель хранилища слишком сложной, затрудняет ее понимание и снижает скорость выполнения запроса. Для эффективного проектирования хранилищ данных ERwin использует размерную модель – методологию проектирования, предназначенную специально для разработки хранилищ данных. Размерное моделирование сходно с моделированием связей и сущностей для реляционной модели, но имеет другую цель. Реляционная модель акцентируется на целостности и эффективности ввода данных. Размерная модель ориентирована в первую очередь на выполнение сложных запросов

В размерном моделировании принят стандарт модели, называемый схемой "звезда", которая обеспечивает высокую скорость выполнения запроса посредством денормализации и разделения данных. Невозможно создать универсальную структуру данных, обеспечивающую высокую скорость обработки любого запроса, поэтому схема "звезда" строится для обеспечения наивысшей производительности при выполнении самого важного запроса (или группы запросов).

Схема "звезда" обычно содержит одну большую таблицу, называемую таблицей факта, помещенную в центре. Ее окружают меньшие таблицы, называемые таблицами размерности, которые связаны с таблицей факта радиальными связями.

Для создания БД со схемой "звезда" необходимо проанализировать бизнес-правила предметной области для выяснения центрального запроса. Данные, обеспечивающие выполнение этого запроса, должны быть помещены в центральную таблицу. При проектировании хранилища важно определить источник данных, метод, которым данные извлекаются, преобразуются и фильтруются, прежде чем они импортируются в хранилище. Знания об источнике данных позволяют поддерживать регулярное обновление и проверку качества данных.

Вычисление размера БД

ERwin позволяет рассчитать приблизительный размер БД в целом, а также таблиц, индексов и других объектов через определенный период времени после начала эксплуатации ИС. Расчет строится на основе следующих параметров: начальное количество строк; максимальное количество строк; прирост количества строк в месяц. Результаты расчетов сводятся в отчет.

Прямое и обратное проектирование

Прямым проектированием называется процесс генерации физической схемы БД из логической модели. При генерации физической схемы ERwin включает триггеры ссылочной целостности, хранимые процедуры, индексы, ограничения и другие возможности, доступные при определении таблиц в выбранной СУБД.

Обратным проектированием называется процесс генерации логической модели из физической БД. Обратное проектирование позволяет конвертировать БД из одной СУБД в другую. После создания логической модели БД путем обратного проектирования можно переключиться на другой сервер и произвести прямое проектирование.

Кроме режима прямого и обратного проектирования программа обеспечивает синхронизацию между логической моделью и системным каталогом СУБД на протяжении всего жизненного цикла создания ИС.

Генерация кода клиентской части с помощью ERwin

Расширенные атрибуты

ERwin поддерживает не только проектирование сервера БД, но и автоматическую генерацию клиентского приложения в средах разработки MS Visual Basic и Power Builder. Технология генерации состоит в том, что на этапе разработки физической модели данных каждой колонке присваиваются расширенные атрибуты, содержащие информацию о свойствах объектов клиентского приложения (в том числе и визуальных), которые будут отображать информацию, хранящуюся в соответствующей колонке. Эта информация записывается в файле модели. На основе информации, содержащейся в расширенных атрибутах, генерируются экранные формы. Полученный код может быть откомпилирован и выполнен без дополнительного ручного кодирования.

Каждой колонке в модели ERwin можно задать предварительно описанные и именованные свойства:

  1.  правила валидации (проверка значений);
  2.  начальные значения, устанавливаемые по умолчанию;
  3.  стиль визуального объекта (например, радиокнопка, поле ввода и др.);
  4.  формат изображения.

Для описания каждого свойства ERwin содержит соответствующие редакторы.

Генерация кода в Visual Basic

ERwin поддерживает генерацию кода в Visual Basic версий 4.0 и 5.0. В качестве источника информации при генерации форм служит модель ERwin. С помощью ERwin можно одновременно описывать как клиентскую часть (объекты, отображающие данные на экране), так и сервер БД (процедуры и триггеры ), тем самым оптимально распределяя функциональность ИС между клиентской и серверной частью. Компонент ERwin Form Wizard автоматически проектирует формы с дочерними объектами – кнопками, списками, полями, радиокнопками и т. д., используя расширенные атрибуты. Совместное использование ERwin и Visual Basic позволяет сократить жизненный цикл разработки ИС путем употребления для каждой задачи наиболее эффективного инструмента. Visual Basic может быть использован для проектирования визуального интерфейса, а ERwin – для разработки физической и логической модели данных с последующей генерацией системного каталога сервера. Если БД уже существует, то с помощью ERwin можно провести обратное проектирование, полученную модель дополнить расширенными атрибутами и сгенерировать клиентское приложение.

Создание отчетов

Для генерации отчетов в ERwin имеется простой и эффективный инструмент – Report Browser. По умолчанию Report Browser содержит предварительно определенные отчеты, позволяющие наглядно представить информацию об основных объектах модели данных – как логической, так и физической. С помощью специального редактора существующие отчеты можно изменить или создать собственный отчет. Каждый отчет может быть настроен индивидуально, данные в нем могут быть отсортированы и отфильтрованы. Browser Report позволяет сохранять результаты выполнения отчетов, печатать и экспортировать их в распространенные форматы.

Генерация словарей

Для управления большими проектами ERwin имеет специальный инструмент – ERwin Dictionary, который обеспечивает коллективную работу над диаграммами и позволяет сохранять и документировать различные версии моделей данных. ERwin Dictionary представляет собой специальную БД, которая позволяет решить проблемы документирования и хранения моделей, однако не полностью отвечает требованиям многопользовательской работы.


 

А также другие работы, которые могут Вас заинтересовать

2745. Измерение сдвига фаз в цепях переменного тока 295.5 KB
  Измерение сдвига фаз в цепях переменного тока Приборы и принадлежности: лабораторная панель Переменный ток. Закон Ома с резистором, конденсатором и катушкой, источник переменного тока – генератор Г3-118, универсальный вольтметр В7-40...
2746. Закон Ома для цепей переменного тока 264 KB
  Закон Ома для цепей переменного тока Приборы и принадлежности: переменный резистор, катушка индуктивности, конденсатор, амперметр и вольтметр переменного тока. Введение. Закон Ома и правила Кирхгофа, установленные для постоянного тока, остаются спра...
2747. Медицинская конфликтология 361.51 KB
  Социальная роль медицины является предметом широкого общественного обсуждения в постреформенной России. Реализация Национального проекта Здоровье позволила решить некоторые насущные задачи, но породила и новые проблемы. Манифестацией конфликтогенных...
2748. Управление предприятием 748.81 KB
  Система управления предприятием и функции организационного менеджмента. Внутренняя и внешняя среда организации и их взаимосвязь.С точки зрения права, организация — самостоятельный хозяйствующий субъект, созданный в порядке, установленном Гражданским кодексом РФ, для производства продукции, выполнения работ и оказания услуг в целях удовлетворения общественных потребностей.
2749. Инновационный менеджмент 602.5 KB
  В пособии изложены основы инновационного менеджмента. Содержит основные понятия инноваций, классификацию инноваций, описание рынков инновационной деятельности, технологию управления инновационным процессом и новаторской деятельностью. В пособии отра...
2750. Организация и финансирование инвестиций 446.34 KB
  Организация и финансирование инвестиций В книге подробно рассмотрены особенности становления и развития инвестиционных процессов в коммерческой деятельности и предпринимательстве в современных условиях хозяйствования на примере России и зарубежных с...
2751. Задачи по анализу рабочего времени 102.08 KB
  Задача 1 Определить номинальный и действительный фонд времени работы работника, коэффициент выполнения норм выработки, чиcлeннocть ocнoвныx пpoизвoдcтвeнных paбoчиx и пpoизвoдитeльнocть тpyдa, ecли выпуск продyкции cocтaвит 600 млн. pyб. B плaниpyeм...
2752. Производственный менеджмент. Курс лекций 611.46 KB
  Сегодняшнее состояние экономики страны - это, прежде всего, состояние ее производственной сферы, основным звеном, фундаментом производственного потенциала которой является предприятие - самостоятельный хозяйствующий субъект, имеющий права юридическо...
2753. Общие положения о геодезических разбивочных работах 176.6 KB
  Общие положения о геодезических разбивочных работах Назначение и организация разбивочных работ Разбивочные работы являются одним из основных видов инженерно-геодезической деятельности. Выполняют их для определения на местности планового и высотного ...