Несколько GPU в ComfyUI
Чаще полезно размещать компоненты или очереди, а не складывать VRAM арифметически.
Обычный ComfyUI workflow исполняется на выбранном устройстве. Custom nodes могут вынести CLIP, VAE, UNet или блоки модели на другие GPU.
Параллельная очередь запускает независимые задания на разных картах и увеличивает throughput, но не размер одного workflow.
Экспериментальные distributed nodes могут делить transformer blocks, однако результат зависит от конкретной модели и версии node.