4267

Состав NVIDIA CUDA. Модель программирования CUDA

Контрольная

Информатика, кибернетика и программирование

Состав NVIDIA CUDA CUDA включает два API: высокого уровня (CUDA Runtime API) и низкого (CUDA Driver API), хотя в одной программе одновременное использование обоих невозможно, нужно использовать или один или другой. Высокоуровневый работает «сверху» ...

Русский

2012-11-15

118.94 KB

27 чел.

Состав NVIDIA CUDA

CUDA включает два API: высокого уровня (CUDA Runtime API) и низкого (CUDA Driver API), хотя в одной программе одновременное использование обоих невозможно, нужно использовать или один или другой. Высокоуровневый работает «сверху» низкоуровневого, все вызовы runtime транслируются в простые инструкции, обрабатываемые низкоуровневым Driver API. Но даже «высокоуровневый» API предполагает знания об устройстве и работе видеочипов NVIDIA, слишком высокого уровня абстракции там нет. 

Есть и ещё один уровень, даже более высокий — две библиотеки:

CUBLAS CUDA вариант BLAS (Basic Linear Algebra Subprograms), предназначенный для вычислений задач линейной алгебры и использующий прямой доступ к ресурсам GPU;

CUFFT — CUDA вариант библиотеки Fast Fourier Transform для расчёта быстрого преобразования Фурье, широко используемого при обработке сигналов. Поддерживаются следующие типы преобразований: complex-complex (C2C), real-complex (R2C) и complex-real (C2R).

Модель программирования CUDA

CUDA использует параллельную модель вычислений, когда каждый из SIMD процессоров выполняет ту же инструкцию над разными элементами данных параллельно. GPU является вычислительным устройством, сопроцессором (device) для центрального процессора (host), обладающим собственной памятью и обрабатывающим параллельно большое количество потоков. Ядром (kernel) называется функция для GPU, исполняемая потоками (аналогия из 3D графики — шейдер).

Мы говорили выше, что видеочип отличается от CPU тем, что может обрабатывать одновременно десятки тысяч потоков, что обычно для графики, которая хорошо распараллеливается. Каждый поток скалярен, не требует упаковки данных в 4-компонентные векторы, что удобнее для большинства задач. Количество логических потоков и блоков потоков превосходит количество физических исполнительных устройств, что даёт хорошую масштабируемость для всего модельного ряда решений компании.

Модель программирования в CUDA предполагает группирование потоков. Потоки объединяются в блоки потоков (thread block) — одномерные или двумерные сетки потоков, взаимодействующих между собой при помощи разделяемой памяти и точек синхронизации. Программа (ядро, kernel) исполняется над сеткой (grid) блоков потоков (thread blocks), см. рисунок ниже. Одновременно исполняется одна сетка. Каждый блок может быть одно-, двух- или трехмерным по форме, и может состоять из 512 потоков на текущем аппаратном обеспечении. 

Блоки потоков выполняются в виде небольших групп, называемых варп (warp), размер которых — 32 потока. Это минимальный объём данных, которые могут обрабатываться в мультипроцессорах. И так как это не всегда удобно, CUDA позволяет работать и с блоками, содержащими от 64 до 512 потоков. Кеплер позволяет определять на 1 варп до 2048 потоков.

Модель памяти CUDA

Модель памяти в CUDA отличается возможностью побайтной адресации, поддержкой как gather, так и scatter. Доступно довольно большое количество регистров на каждый потоковый процессор, до 1024 штук. Доступ к ним очень быстрый, хранить в них можно 32-битные целые или числа с плавающей точкой.

Каждый поток имеет доступ к следующим типам памяти: 

Глобальная память — самый большой объём памяти, доступный для всех мультипроцессоров на видеочипе, размер составляет от 256 мегабайт до 1.5 гигабайт на текущих решениях (и до 4 Гбайт на Tesla). Обладает высокой пропускной способностью, более 100 гигабайт/с для топовых решений NVIDIA, но очень большими задержками в несколько сот тактов. Не кэшируется, поддерживает обобщённые инструкции load и store, и обычные указатели на память.

Локальная память — это небольшой объём памяти, к которому имеет доступ только один потоковый процессор. Она относительно медленная — такая же, как и глобальная.

Разделяемая память — это 16-килобайтный (в видеочипах нынешней архитектуры) блок памяти с общим доступом для всех потоковых процессоров в мультипроцессоре. Эта память весьма быстрая, такая же, как регистры. Она обеспечивает взаимодействие потоков, управляется разработчиком напрямую и имеет низкие задержки. Преимущества разделяемой памяти: использование в виде управляемого программистом кэша первого уровня, снижение задержек при доступе исполнительных блоков (ALU) к данным, сокращение количества обращений к глобальной памяти.

Память констант — область памяти объемом 64 килобайта (то же — для нынешних GPU), доступная только для чтения всеми мультипроцессорами. Она кэшируется по 8 килобайт на каждый мультипроцессор. Довольно медленная — задержка в несколько сот тактов при отсутствии нужных данных в кэше.

Текстурная память — блок памяти, доступный для чтения всеми мультипроцессорами. Выборка данных осуществляется при помощи текстурных блоков видеочипа, поэтому предоставляются возможности линейной интерполяции данных без дополнительных затрат. Кэшируется по 8 килобайт на каждый мультипроцессор. Медленная, как глобальная — сотни тактов задержки при отсутствии данных в кэше.

Естественно, что глобальная, локальная, текстурная и память констант — это физически одна и та же память, известная как локальная видеопамять видеокарты. Их отличия в различных алгоритмах кэширования и моделях доступа. Центральный процессор может обновлять и запрашивать только внешнюю память: глобальную, константную и текстурную. 

CUDA предполагает специальный подход к разработке, не совсем такой, как принят в программах для CPU. Нужно помнить о разных типах памяти, о том, что локальная и глобальная память не кэшируется и задержки при доступе к ней гораздо выше, чем у регистровой памяти, так как она физически находится в отдельных микросхемах.

Типичный, но не обязательный шаблон решения задач:

  1.  задача разбивается на подзадачи;
  2.  входные данные делятся на блоки, которые вмещаются в разделяемую память;
  3.  каждый блок обрабатывается блоком потоков;
  4.  подблок подгружается в разделяемую память из глобальной;
  5.  над данными в разделяемой памяти проводятся соответствующие вычисления;
  6.  результаты копируются из разделяемой памяти обратно в глобальную.

Парадигма программирования подразумевает под собой не только тип программирования, но и среду разработки. В последнее время стали пользоваться огромной популярностью мобильные телефоны. А они соответственно имеют свою ОС. Наиболее известные – Symbian, WM, Android, IOS.

Каждая из этих ОС имеет свою среду разработки, на которых подробнее мы останавливаться не будем.

Рассмотрим еще одно направление программирования для ПК с точки зрения среды разработки – WPF.

Windows Presentation Foundation (WPF) — система для построения клиентских приложений Windows с визуально привлекательными возможностями взаимодействия с пользователем, графическая (презентационная) подсистема в составе .NET Framework (начиная с версии 3.0), использующая язык XAML.

WPF предустановлена в Windows Vista(.NET Framework 3.0) и Windows 7(.NET Framework 3.5 SP1). С помощью WPF можно создавать широкий спектр как автономных, так и запускаемых в браузере приложений.

 WPF позволяет расширить возможности программиста и дизайнера вместе с помощью продукта от MicrosoftBlend. Это ПО позволяет создавать XAML одинаковый как для программиста, так и для дизайнера. Больше нет этого сложного перехода.

Основные преимущества WPF:

  1.  Декларативное определение UI – XAML
  2.  Вовлечение дизайнеров
  3.  Универсальный подход работы с любыми медиа-источниками
  4.  Векторная отрисовка
  5.  Аппаратное ускорение
  6.  3D
  7.  Легкость разворачивания

Главной, на мой взгляд, особенностью является то, что именно за WPF будущее программирования. В современных условиях у этой технологии есть один важный плюс – ориентированность на пользователя. Выделяется эта технология тем, что она вполне внедрима как в WinForm, так и WinForm внедрима в нее. Впредь эта технология будет расширяться и внедряться в массы.


 

А также другие работы, которые могут Вас заинтересовать

79212. Понятие и система Особенной части уголовного права 36.26 KB
  В зависимости от особенностей субъектов процесса познания выделяются следующие виды квалификации: Официальная квалификация судебная осуществляется государственными органами и специально уполномоченными на то должностными лицами. Так данная деятельность осуществляется как правило государственными органами и должностными лицами то она базируется на определенных правилах которые содержаться: В уголовном кодексе РФ Руководящие разъяснения постановления пленума верховного суда РФ по отдельным категориям уголовных дел В сложившейся в...
79213. Понятие и виды преступлений против личности 34.88 KB
  Значимость для государства и общества разносторонней защиты личности предопределила то что Особенная часть УК РФ начинается с раздела VII Преступления против личности . В рамках родового объекта можно выделить указанные в законе видовые объекты включающие близкие тождественные общественные отношения охраняемые нормами включенными в главы раздела о преступлениях против личности УК РФ. Они классифицированы законодателем следующим образом: а преступления против жизни и здоровья гл.
79214. Коммерческий подкуп 33.02 KB
  Цель лица осуществляющего подкуп связана с получением определенных выгод или преимуществ в сфере деятельности организации в которой работает лицо принимающее предмет подкупа. Лицо принимающее предмет подкупа руководствуется корыстными мотивами. Квалифицирующими обстоятельствами как для лица осуществляющего подкуп так и для подкупаемого лица является совершение преступления группой по предварительному сговору или организованной группой. Для подкупаемого лица ответственность усиливается также если его действия сопряжены с...
79215. Общая характеристика преступлений против собственности 33.12 KB
  К преступлениям против собственности относятся общественно опасные деяния нарушающие права владения пользования и распоряжения собственника имуществом либо иным способом причиненияили угрозой причинения собственнику имущественного ущерба. Видовым объектом преступлений против собственности являются общественные отношения собственности владения пользования и распоряжения имуществом и права законного владения собственностью. Предметом преступлений против собственности являются любые физические предметы любое имущество не исключенное из...
79216. Понятие и признаки хищения 36.88 KB
  Под хищением в статьях настоящего Кодекса понимаются совершенные с корыстной целью противоправные безвозмездное изъятие и или обращение чужого имущества в пользу виновного или других лиц причинившие ущерб собственнику или иному владельцу этого имущества. он не имеет на данную вещь ни действительных ни мнимых прав Изъятие и или обращение вышеуказанного имущества в собственность виновного или третьих лиц. данное преступление совершается по средствам нападения направленного на создание условий для последующего изъятия и обращения чужого...
79218. Незаконное участие в предпринимательской деятельности 33.71 KB
  Объективная сторона преступления выражается в том что вопреки установленному законом запрету должностное лицо: а учреждает организацию осуществляющую предпринимательскую деятельность; б участвует лично или через доверенное лицо в управлении такой организацией; в предоставляет этой организации льготы и преимущества либо оказывает ей покровительство в иной форме. Особенность данного состава преступления состоит в том что ответственность за него может наступить лишь при условии что названные в ст. Субъективная сторона преступления...
79219. Кража. Состав и виды 34.63 KB
  Непосредственным объектом кражи являются общественные отношения по поводу конкретной формы собственности. Объективная сторона кражи предполагает деяние в виде тайного похищения чужого имущества. Состав кражи материальный поэтому в качестве обязательного признака объективной стороны наряду с деянием предполагается материальный ущерб опосредованный причинной связью. Субъективная сторона кражи выражается в прямом умысле.
79220. Мошенничество. Состав и виды 32.77 KB
  159 УК РФ определяется как хищение чужого имущества или приобретение права на него путем обмана или злоупотребления доверием. Объективную сторону мошенничества составляют два способа: обман и злоупотребление доверием. Злоупотребление доверием состоит в использовании доверительных отношений между виновным и потерпевшим для завладения имуществом. Отличительной особенностью обмана или злоупотребления доверием является то что собственник или иной владелец имущества введенный в заблуждение относительно истинных целей похитителя сам передает...