GPUИндекс

Выделенный сервер с 2×NVIDIA L4

от 96 100 ₽/мес· от 48 050 ₽/мес за карту

Выберите GPU

2СброситьL4Сбросить
NVIDIA L4
1Dedic
24 ГБ × 2 = 48 ГБ
96 100 ₽/мес
48 050 ₽/мес / карта
Перейти →

32 vCPU / 32 ГБ RAM · Россия

Почему NVIDIA L4 на 2 GPU

2 карты L4, это про бюджетный multi-GPU: 48 ГБ суммарной памяти по цене, заметно меньшей, чем одна карта с таким же объёмом. L4, компактная карта Ada для инференса и тонких задач: по одной она держит модели до 13B, а связка из двух расширяет пул памяти без перехода в серверный ценник. Dedicated-режим тут важен: без соседей по vGPU скорость инференса стабильна, и карты не делятся с чужими задачами. Тариф у 1Dedic, 96 100 ₽/мес.

Несколько карт и суммарная память

Важно понимать: у L4 нет NVLink, и две карты не складываются в единый GPU. Суммарные 48 ГБ, это программный пул: распределённый инференс (например, vLLM с tensor parallelism) раскладывает модель по картам, но данные между ними идут по PCIe, а не по быстрому NVLink-каналу. На практике это значит: модель распределяется, но накладные расходы на межкарточный обмен выше, чем у связки с NVLink. Для инференса с умеренными батчами это нормально, для обучения с постоянной синхронизацией градиентов менее эффективно, чем на A5000 с NVLink.

Что помещается в эту конфигурацию

48 ГБ суммарного VRAM хватает на инференс моделей 7–13B в FP16 и до 30B в 4-битной квантизации, плюс LoRA-дообучение средних моделей. Генерация изображений и рендер тоже комфортны. Для сравнения: одна L4 (24 ГБ) держит модели до 13B в 4-бит, а две карты добавляют запас под контекст и батч.

Альтернативы

Если задача помещается в одну карту (24 ГБ), берите один L4: это дешевле (в каталоге от 30 744 ₽/мес у Timeweb) и проще. Две карты нужны, когда не хватает памяти под контекст и батч или нужна параллельная обработка. Если нужен NVLink и более эффективный multi-GPU, смотрите A5000 ×2: дороже, но межкарточный обмен через мост быстрее (у L40 и L4 NVLink нет). Для коротких задач vGPU будет дешевле, но с делением карты.

Частые вопросы

Сколько стоит сервер на 2 L4?+
96 100 ₽/мес у 1Dedic, около 48 050 ₽/мес за карту. Это один из самых дешёвых способов получить multi-GPU в выделенном сервере.
Что помещается в 48 ГБ двух L4?+
Инференс моделей 7–13B в FP16 и до 30B в 4-бит, LoRA-дообучение, генерация изображений. Одна карта (24 ГБ), до 13B в 4-бит, две добавляют запас под контекст и батч.
Есть ли NVLink у L4?+
Нет, NVLink отсутствует. Карты работают независимо, память суммируется только программно через распределённый инференс, накладные расходы на межкарточный обмен выше, чем у связки с NVLink.
Когда нужны 2 L4, а когда одна карта крупнее?+
Если модель влезает в 24 ГБ, дешевле одна L4. Две карты берут под контекст, батч и параллельную обработку. Для задач с интенсивным обменом между картами лучше смотреть на NVLink-модели.