91643

Критерии выбора уровня агрегации

Доклад

Информатика, кибернетика и программирование

Например вы не только сможете оценить какие Модели автомобилей пользуются наибольшим спросом в конкретном регионе сегодня но на основе анализа истории и структуры автомобильного рынка в более развитых с точки зрения автомобилизации регионах попытаться оценить динамику спроса и перспективы различных Моделей в остальных регионах. День 365 10 = 3650 различных значений 2. Менеджер 300 различных значений 3. Модель Автомобиля 100 различных значений 4.

Русский

2015-07-21

38.52 KB

0 чел.

Критерии выбора уровня агрегации

Если спросить пользователя, какой уровень детализации ему желателен, он не задумываясь ответит - максимально возможный. Однако стоит оценить, сколько такое решение может стоить, и попытаться определить возможный экономический эффект от наличия данных на каждом новом уровне детализации.

Например, выбрав в качестве уровня агрегации Год, вы получите возможность проанализировать общие тенденции автомобильного рынка и спрогнозировать динамику его развития. Выбрав же в качестве уровня агрегации Месяц или Неделю, вы, кроме того, сможете спрогнозировать спрос на конкретные модели в конкретные моменты времени. И хотя автомобили - товар не сезонный, скорее всего, весной и летом их покупают больше, чем осенью и зимой. Это позволит отследить возможные сезонные колебания, рациональнее формировать свой склад и более эффективно проводить политику формирования сезонных скидок и распродаж. А если в систему введена информация о затратах на маркетинг, появится возможность проследить эффект от каждого конкретного маркетингового мероприятия.

Выбор в качестве уровня агрегации Номер Контракта/Счета позволит перейти на качественно новый уровень анализа. На этом уровне можно будет учитывать взаимосвязи между конкретным Автомобилем, Менеджером и Покупателем. А поскольку при покупке автомобиля заполняется множество документов, то доступна достаточно детальная информация о каждом конкретном Покупателе (Возраст, Пол, Место жительства, Вид оплаты и т.д.). Теперь вы сможете проанализировать не только рынок, но и заглянуть внутрь своей фирмы и всесторонне проанализировать эффективность работы каждого Менеджера и Подразделения. Но наиболее ценное, что вы получаете, - это информация о Регионах и Покупателях. Например, вы не только сможете оценить, какие Модели автомобилей пользуются наибольшим спросом в конкретном регионе сегодня, но на основе анализа истории и структуры автомобильного рынка в более развитых, с точки зрения автомобилизации, регионах попытаться оценить динамику спроса и перспективы различных Моделей в остальных регионах.

Однако переход на каждый следующий уровень детализации и добавление новых источников данных могут привести к увеличению, иногда более чем на порядок, размера целевой МБД и соответствующему удорожанию и усложнению аппаратного решения.

Рассмотрим в качестве примера Показатель Объем продаж. Анализ предметной области показывает, что он однозначно определяется комбинацией четырех Измерений:

1. {Год | Полугодие | Квартал | Месяц | Неделя | День | Счет}

2. {Страна | Регион | Филиал | Менеджер}

3. {Фирма-Производитель | Завод-Производитель | Модель Автомобиля}

4. {Тип скидки}

Выбрав уровень детализации:

1. День (365 * 10 = 3650 различных значений),

2. Менеджер (300 различных значений),

3. Модель Автомобиля (100 различных значений),

4. Тип Скидки (4 различных значения),

получим куб, состоящий из 438000000 ячеек. Но в основе используемого в МСУБД способа хранения данных лежит предположение о том, что внутри, в данном случае четырехмерного гиперкуба, нет пустот. Данные в МСУБД представлены в виде разреженных матриц с заранее фиксированной размерностью. При этом значения Показателей хранятся в виде множества логически упорядоченных блоков (массивов), имеющих фиксированную длину, причем именно блок является минимальной индексируемой единицей.

Таким образом, в нашей БД будет сразу же зарезервировано место для всех 438 млн. значений Показателя Объем Продаж. Причем цифры "300 менеджеров" и "100 моделей автомобилей" вовсе не означают того, что сегодняшняя номенклатура фирмы - 100 различных моделей, которые продают 300 человек. Цифра 300 говорит о том, что в фирме за 10 лет ее существования работало 300 различных менеджеров. Сегодня же их может быть, например, всего 30.

Попробуем оценить, какой процент ячеек в нашем случае будет содержать реальные значения. Предположим, что в среднем в фирме постоянно работает около 30 менеджеров, менеджер продает в день 10 различных моделей и при продаже каждого автомобиля может быть использован только один вариант скидки. Тогда 3650 * 30 * 10 * 1 = 1095000. То есть только 0,25% ячеек куба будет содержать реальные значения данных. И хотя в МСУБД обычно предполагается, что блоки, полностью заполненные неопределенными значениями, не хранятся, как правило, это не обеспечивает полного решения проблемы.


 

А также другие работы, которые могут Вас заинтересовать

58132. Основные сферы и звенья финансовой системы 17.5 KB
  Функция финансов предприятий в условиях рыночной экономики заключается в обеспечении финансовыми ресурсами потребностей расширенного воспроизводства на основе установления оптимальных соотношений между средствами, направленными на потребление, и средствами, идущими на накопление.
58134. Demand and Supply 45 KB
  As consumer income is increased, demand for a normal good will also increase but demand for an inferior good will decrease. A normal good is a good for which demand increases when incomes rise. An inferior good is a good for which demand falls when incomes rise.
58135. Планирование в системе налогового администрирования 137.5 KB
  На региональном уровне в ходе налогового планирования решаются следующие задачи: оценивается налоговый потенциал региона; прогнозируются объемы налоговых поступлений с учетом темпов экономического роста региона; утверждается бюджет по налогам; выводятся суммы бюджетного дефицита уровень инфляции индексы цен; разрабатываются контрольные задания в разрезе бюджетов различных уровней; определяется долевое распределение налоговых ставок и льгот и др. НАЛОГОВОЕ АДМИНИСТРИРОВАНИЕ ПЛАНИРОВАНИЕ УЧЕТ КОНТРОЛЬ РЕГУЛИРОВАНИЕ...
58137. Инфекционные болезни 541.5 KB
  Наиболее опасными осложнениями тифо-паратифозных заболеваний (ТПЗ) являются перфорация кишечных язв, кишечное кровотечение и инфекционно-токсический шок
58138. Народничество. Политический террор. Политика контрреформ 37.5 KB
  Фактически это перечёркивало главную идею земства независимость от органов государственной власти и царя в решении вопросов местного самоуправления.
58139. Причини і початок війни. Події 1939–1942 рр 69 KB
  Мета: визначити причини характер періодизацію Другої світової війни залучаючи історичну карту характеризувати основні театри воєнних дій у Європі Північній Африці ПівденноСхідній Азії та Тихому океані умови мирних договорів Німеччини та її союзників...
58140. Развитие органической химии. Теория радикалов и теория типов 1.93 MB
  В теории типов органические соединения конструировались из неорганических веществ типов тип водорода воды хлористого водорода аммиака замещением в них атомов на органические фрагменты; введено понятие изомерии Берцелиус.