Перейти к содержанию

Производительность LCA#

В данном разделе представлены результаты нагрузочного тестирования системы Luna Cars Analytics.

Тестирование выполнено для следующих конфигураций:

  • без использования GPU;
  • с использованием GPU.

Результаты позволяют оценить потребление вычислительных ресурсов и рекомендуемое количество камер для сервера выбранной конфигурации.

Конфигурация тестового сервера#

Нагрузочное тестирование выполнено на сервере со следующими характеристиками.

Таблица 31. Параметры тестового сервера

Параметр Значение
1 CPU 2 × Intel Xeon Gold 6248R (48 физических ядер/96 vCPU)
2 Оперативная память 128 GB
3 GPU NVIDIA RTX 3060
4 Видеопамять 12 GB

Обратите внимание! Поддержка работы на GPU

Работа на GPU поддерживается только на видеокартах NVIDIA с установленными драйверами и NVIDIA Container Toolkit. Вам нужно установить драйверы NVIDIA и NVIDIA Container Toolkit. Подробную инструкцию по установке можно найти на официальном сайте NVIDIA.

GPU-карты с архитектурой ниже Turing и старше Ada не поддерживаются.

Методика расчета#

Нагрузочное тестирование определяет потребление вычислительных ресурсов при обработке одного видеопотока.

Рекомендуемое количество камер рассчитано с учетом коэффициента запаса 0.8. Это соответствует максимальной загрузке сервера 80 % и оставляет 20 % вычислительных ресурсов для обработки пиковых нагрузок.

Приведенные значения являются результатами нагрузочного тестирования и могут отличаться в зависимости от характеристик видеопотока, параметров камер и конфигурации сервера.

Производительность на сервере без GPU#

Производительность LCA на сервере без GPU.

Нагрузочный тест

Тип обработки Конфигурация Потребление CPU (поток/GB) Комментарии
Обработчик с трекингом ~3 ТС, 2/4 best shots Проезд без остановки, высокие скорости Все сервисы на CPU CPU: 4.5 потока RAM: 3.0 GB Максимальная загрузка CPU (100% суммарно по всем контейнерам). Производительность ограничена ресурсами CPU
Покадровый обработчик 1 ТС, 2/4 best shots Проезд с остановкой перед преграждающим устройством Все сервисы на CPU CPU: 2.5 потока RAM: 1.5 GB Максимальная загрузка CPU (100% суммарно по всем контейнерам). Производительность ограничена ресурсами CPU

Расчет сайзинга для production сервера

Intel Xeon Gold 6248R (48 физических ядер/96 vCPU), без видеокарты

Тип обработки Потребление ресурсов с запасом 20 % Рекомендуемое количество камер (расчет с загрузкой сервера на 80%)
Обработчик с трекингом CPU: 5.6 потока RAM: 3.75 GB 17 камер 64 GB RAM
Покадровый обработчик CPU: 3.1 потока RAM: 1.87 GB 30 камер 56.1 GB RAM

Производительность на сервере с GPU#

Производительность LCA на сервере с GPU.

При использовании GPU часть вычислений выполняется на графическом процессоре.

Нагрузочный тест

Тип обработки Конфигурация Потребление CPU (поток/GB) Потребление GPU (%/GB) Комментарии
Обработчик с трекингом ~3 ТС, 2/4 best shots Проезд без остановки, высокие скорости Stream GPU + API GPU Остальные сервисы на CPU CPU: 1.0 поток RAM: 1.5 GB GPU: 6.6 % VRAM: 1.7 GB GPU Load достигает 47%; Память GPU (ошибки OOM); Производительность ограничена объемом видеопамяти
Покадровый обработчик 1 ТС, 2/4 best shots Проезд с остановкой перед преграждающим устройством Stream GPU + API GPU Остальные сервисы на CPU CPU: 0.8 потока RAM: 0.6 GB GPU: 4.5 % VRAM: 0.7 GB GPU Load достигает 80%; Память GPU (ошибки OOM); Производительность ограничена объемом видеопамяти

Расчет сайзинга для production сервера

Intel Xeon Gold 6248R (48 физических ядер/96 vCPU) + NVIDIA RTX 3060 12GB

Тип обработки Потребление ресурсов с запасом 20 % Рекомендуемое количество камер (расчет с загрузкой сервера на 80%)
Обработчик с трекингом CPU: 1.25 потока RAM: 1.87 GB GPU: 8.25 %/2.12 GB 20–21 камера: 5–6 камер на GPU 15 камер на CPU
Покадровый обработчик CPU: 1.0 поток RAM: 0.75 GB GPU: 5.62 %/0.87 GB 40 камер: 14 камер на GPU 26 камер на CPU