GPUИндекс

Выделенный сервер с 2×NVIDIA L40

от 190 900 ₽/мес· от 95 450 ₽/мес за карту

Выберите GPU

2СброситьL40Сбросить
NVIDIA L40
1Dedic
48 ГБ × 2 = 96 ГБ
190 900 ₽/мес
95 450 ₽/мес / карта
Перейти →

32 vCPU / 32 ГБ RAM · Россия

NVIDIA L40
Yandex Cloud
48 ГБ × 2 = 96 ГБ
266 129 ₽/мес
133 065 ₽/мес / карта
Перейти →

128 vCPU / 1024 ГБ RAM · Россия

Почему NVIDIA L40 на 2 GPU

2 карты L40, это 96 ГБ суммарного VRAM: конфигурация, где начинается класс «30–34B в FP16» без перехода во флагманский ценник. L40, универсальная карта Ada для инференса и рендера, а связка из двух снимает ограничение одной карты в 48 ГБ. В Dedicated-режиме обе карты работают только на вас: длинные инференсы и рендер не замедляются соседями. Тариф у 1Dedic, Yandex Cloud, 190 900 ₽/мес.

Несколько карт и суммарная память

У L40 нет NVLink: карты общаются по шине PCIe. Две карты всё равно работают как multi-GPU, модель распределяется через tensor parallelism, но обмен данными идёт по PCIe, что медленнее выделенного межкарточного канала. Суммарные 96 ГБ складываются в общий пул памяти, но из-за медленного обмена масштабирование на L40 эффективнее в инференсе, чем в интенсивном обучении. Для такой связки это нормальный рабочий сценарий, просто без аппаратного ускорения обмена.

Что помещается в эту конфигурацию

96 ГБ суммарного VRAM, инференс и файнтюнинг моделей 30–34B в FP16 и до 70B в 4-битной квантизации, с запасом под батч и контекст. Генерация изображений и рендер с большими сценами тоже комфортны. Одна L40 (48 ГБ) держит 34B в FP16 впритык, а две карты добавляют запас по памяти. Связка работает через PCIe, поэтому прирост в основном по объёму, а не по скорости обмена.

Альтернативы

Если модель влезает в 48 ГБ, одна L40 дешевле (от 124 700 ₽/мес) и проще. Две карты берут, когда не хватает памяти под батч и контекст. Сравнение с соседями: 2×L40 (96 ГБ, 190 900 ₽/мес) против 2×L40S (96 ГБ, от 199 000 ₽/мес), L40S быстрее в ИИ-задачах за счёт FP8, но дороже. Если важнее цена за объём, 4×L4 (96 ГБ) дают тот же объём почти в полтора раза дешевле. Хотя L40 и L40S без NVLink, у обеих связка через PCIe.

Частые вопросы

Сколько стоит сервер на 2 L40?+
190 900 ₽/мес у 1Dedic, Yandex Cloud, около 95 450 ₽/мес за карту. Это доступная точка входа в 96 ГБ суммарного VRAM.
Что помещается в 96 ГБ?+
Инференс и файнтюнинг моделей 30–34B в FP16, до 70B в 4-бит, рендер и генерация изображений с большими батчами. Две карты складываются в общий пул памяти.
Есть ли NVLink у L40?+
Нет. L40, это PCIe-карта без NVLink: две карты объединяются через шину, обмен идёт по PCIe. Для инференса и рендера этого достаточно, но интенсивное обучение без NVLink масштабируется хуже.
2 L40 или 2 L40S?+
L40S быстрее в ИИ-вычислениях за счёт FP8, но дороже (от 199 000 против 190 900 ₽/мес). Если задачи больше про рендер и FP32, L40 достаточно, для тяжёлого ИИ, L40S.