Ватты GPU — ещё не расход всего сервера
Ватты GPU — ещё не расход всего сервера
Факт: NVIDIA определяет Average/Instantaneous Power Draw в nvidia-smi как мощность всей платы GPU, а не сервера из розетки. Складывать показания GPU и считать их полным энергопотреблением узла — ошибка: за пределами такого измерения остаются CPU, RAM, накопители, вентиляторы и потери блоков питания.
Зачем: сравнение GPU по watts без общей границы измерения может исказить расчёт стоимости inference.
Три шага: 1. На своём узле посмотрите nvidia-smi -q -d POWER -l 1. Запишите название поля и GPU: Average Power Draw — среднее за последнюю секунду, Instantaneous — последнее измерение. Завершить просмотр: Ctrl+C. Недоступное N/A не заменяйте нулём. 2. Для всего сервера снимайте энергию на его входе через подходящий metered PDU или счётчик. Учтите все линии питания этого узла; не включайте соседние серверы. Сохраните начальное и конечное показания kWh и время теста. 3. Выполните одинаковый набор запросов на сравниваемых конфигурациях: те же модель, precision, context, concurrency и критерии качества. Сравните затраченные kWh на успешно выполненный набор и latency, а не только мгновенные watts GPU.
Ловушка: частый опрос среднего значения не превращает его в измерение пиков. Такой тест полезен для стоимости работы, но не заменяет инженерный расчёт питания и охлаждения. Average Power Draw поддерживается на Ampere, кроме GA100, и более новых GPU; доступность полей зависит от устройства.
Сайт проекта: https://verum-ai.uz

