Архитектура вычислительных машин - 004.2

Научные статьи

В разделе "Архитектура вычислительных машин"
Моделирование параллельной работы ядер векторного потокового процессора с общей памятью
Дикарев Николай Иванович, Шабанов Борис Михайлович, Шмелв Александр Сергеевич
Недостаточная пропускная способность памяти на программе Stencil: преимущество векторного потокового процессора
Дикарев Николай Иванович, Шабанов Борис Михайлович, Шмелв Александр Сергеевич
Vectorization of the Riemann solver using the AVX-512 instruction set
Rybakov Alexey Anatoljevich, Shumilin Sergey Sergeevich
Векторизация римановского решателя с использованием набора инструкций AVX-512
Рыбаков Алексей Анатольевич, Шумилин Сергей Сергеевич
Реализация высокоточных вычислений в базисе модулярно-интервальной арифметики
Коржавина Анастасия Сергеевна, Князьков Владимир Сергеевич
Мелкоструктурный параллелизм и более высокая производительность процессорного ядра: преимущества векторного потокового процессора
Дикарев Николай Иванович, Шабанов Борис Михайлович, Шмелв Александр Сергеевич
Развитие ассоциативных параллельных архитектур
Снытникова Татьяна Валентиновна
Разработка и реализация переносимых алгоритмов распределенного исполнения фрагментированных программ на неоднородных вычислителях
Ажбаков Артем Альбертович, Перепелкин Владислав Александрович
Матрично-векторное умножение многократной точности на графическом процессоре
Исупов Константин Сергеевич, Князьков Владимир Сергеевич
Multiple-precision matrix-vector multiplication on graphics processing units
Isupov Konstantin, Knyazkov Vladimir
Минимизация средних затрат на перераспределение при работе с work-stealing деком в двухуровневой памяти
Е. А. Аксёнова, А. А. Лазутина, А. В. Соколов
Высокопроизводительные вычисления с использованием системы остаточных классов
К. С. Исупов
Преимущества и недостатки использования метода векторов указателей в векторном потоковом процессоре
Дикарев Николай Иванович, Шабанов Борис Михайлович, Шмелв Александр Сергеевич
Реализация и оценка производительности разреженного матрично-векторного умножения многократной точности на CUDA с использованием системы остаточных классов
Исупов Константин Сергеевич, Князьков Владимир Сергеевич, Бабешко Иван Павлович, Крутиков Александр Константинович
Преимущества и недостатки использования метода векторов указателей в векторном потоковом процессоре
Дикарев Николай Иванович, Шабанов Борис Михайлович, Шмелв Александр Сергеевич
Modern server ARM processors for supercomputers: A64FX and others. Initial data of benchmarks
Kuzminsky Mikhail Borisovich
Современные серверные ARM-процессоры для суперЭВM: A64FX и другие. Начальные данные тестов производительности
Кузьминский Михаил Борисович
Сжатие сенсорных данных с малым расходом оперативной памяти
Шевчук Юрий Владимирович
Memory-efficient sensor data compression
Shevchuk Yury Vladimirovich
Synchronous execution of group operations in distributed supercomputer components and computer clusters
Stetsyura Gennady Georgievich
Синхронное выполнение групповых операций в распределенных компонентах суперкомпьютеров и компьютерных кластерах
Стецюра Геннадий Георгиевич
Организация взаимодействия активных объектов однородных цифровых структур
Стецюра Г.Г.
Processing-in-memory: текущие направления развития технологии
Снытникова Т.В.
Новое поколение GPGPU и сопутствующего оборудования: микроархитектура и производительность вычислительных систем от серверов до суперкомпьютеров
Кузьминский М.Б.
Синхронное взаимодействие распределенных неупорядоченных цифровых объектов
Стецюра Г.Г.
Скоростные ассоциативные операции и алгоритмы управления и обработки данных для распределенных цифровых систем, действующих в условиях неопределенности
Стецюра Г.Г.
Методы квантового машинного обучения для обнаружения атак на программно-конфигурируемые сети
Антонов И.А., Курочкин И.И.
Быстродействие и отказоустойчивость идеальной системной сети через дополнительную параллельность
Подлазов В.С.
Алгоритм прямого распространения в парадигме потока данных
Змеев Д.Н., Левченко Н.Н., Климов А.В.
Групповые вычисления в неблокируемых системных сетях
Подлазов В.С.
Вокруг условного 4-го поколения современных серверных процессоров AMD и Intel: их микроархитектура и производительность соответствующих вычислительных систем
Кузьминский М.Б.
Формирование и развитие веб-среды ЦНСХБ и ее преимущества для удаленного пользователя
Пирумова Лидия Николаевна
Реализация искусственных нейронных сетей в непозиционной системе счисления для автоматизированных систем управления
Васецкий В.В.
Виртуальные вычислительные среды: использование на GRID полигонах
Волохов В.М., Варламов Д.А., Сурков Н.Ф., Пивушков A.B.
Parallel algorithms of integer arithmetic in radix notations for heterogeneous computation systems with massive parallelism
Panyukov A.V., Golodov V.A.
Модулярно-позиционный формат и программный пакет для разрядно-параллельных вычислений высокой точности в формате с плавающей точкой
Исупов К.С.
Применение гибридной вычислительной системы к решению прикладных задач аэрогазодинамики
Карцева Елена Юрьевна, Кашковский Александр Владимирович, Лацис Алексей Оттович, Панасенко Александр Викторович, Смольянов Юрий Павлович, Чернов Владимир Владимирович, Шершнв Антон Алексеевич
Оптимизация отображения неоднородно взаимодействующих MPI процессов на вычислительную архитектуру
Гетманский Виктор Викторович, Чалышев Владимир Сергеевич, Крыжановский Дмитрий Иванович, Лексиков Евгений Иванович
Сравнение эффективности CPU и GPU реализаций некоторых комбинаторных алгоритмов на задачах обращения криптографических функций
Булавинцев Вадим Германович
Оптимизация обнаружения конфликтов в параллельных программах с транзакционной памятью
Кулагин И.И., Курносов М.Г.