GPUИндекс

Выделенный сервер с 4×NVIDIA L40

от 323 300 ₽/мес· от 80 825 ₽/мес за карту

Выберите GPU

4СброситьL40Сбросить
NVIDIA L40
1Dedic
48 ГБ × 4 = 192 ГБ
323 300 ₽/мес
80 825 ₽/мес / карта
Перейти →

32 vCPU / 32 ГБ RAM · Россия

Почему NVIDIA L40 на 4 GPU

4 карты L40, 192 ГБ суммарного VRAM: конфигурация для полного 70B-класса в FP16 без флагманского ценника. Каждая карта даёт 48 ГБ, и в связке из четырёх память и вычислительные ядра масштабируются для серьёзных задач. Dedicated-режим тут обязателен: все карты и весь сервер работают только на вашу задачу, без соседей по vGPU. Тариф у 1Dedic, 323 300 ₽/мес.

Несколько карт и суммарная память

У L40 нет NVLink: четыре карты объединяются как multi-GPU через шину PCIe. tensor parallelism раскладывает модель по картам, а обмен данными идёт по PCIe, без выделенного межкарточного канала. Суммарные 192 ГБ образуют общий пул памяти, но обмен градиентами по PCIe ограничивает масштабирование. Поэтому такая связка подходит для инференса и объёмных задач памяти, а для интенсивного обучения на многих картах эффективнее NVLink-ускорители.

Что помещается в эту конфигурацию

192 ГБ суммарного VRAM, полный файнтюнинг моделей 70B-класса в FP16 с запасом под батч, градиенты и контекст. Для инференса, несколько больших моделей одновременно. По сравнению с одной картой (48 ГБ) это шаг на два класса вверх: то, что не влезало в 96 ГБ, здесь помещается целиком.

Альтернативы

4 карты L40 (192 ГБ, 323 300 ₽/мес), способ получить 192 ГБ без флагманского ценника: 4×L40S (349 700 ₽/мес) дороже, а 4×L4 (208 900 ₽/мес) дешевле. Все три связки без NVLink, обмен по PCIe. Если хватает 96 ГБ, 2×L40 за 190 900 ₽/мес почти вдвое дешевле. Если важнее цена за объём, 8×L4 отдаст те же 192 ГБ за 208 900 ₽/мес. Флагманы (H100 с NVLink) имеют смысл, только если нужны специфические форматы и ещё большие пулы памяти.

Частые вопросы

Сколько стоит сервер на 4 L40?+
323 300 ₽/мес у 1Dedic, около 80 825 ₽/мес за карту. За 192 ГБ это один из самых доступных вариантов без NVLink-надбавки.
Что помещается в 192 ГБ?+
Полный файнтюнинг 70B-класса в FP16, сервинг нескольких больших моделей, обучение средних моделей с нуля. Квантизация даёт запас под ещё более крупные модели.
Чем 4 L40 отличаются от 4 L40S?+
L40S быстрее в ИИ-вычислениях и дороже (349 700 против 323 300 ₽/мес). Обе без NVLink, со связкой через PCIe; L40 достаточно для рендера и большинства инференс-задач.
4 L40 или 8 L4?+
8×L4 дешевле (208 900 ₽/мес) при тех же 192 ГБ, но обе связки без NVLink. Для инференса и объёма памяти выгоднее 8×L4, для более эффективного multi-GPU с прицелом на обучение 4×L40 с PCIe лучше по вычислительной мощности.