GPUИндекс
LLM

GPU для Vikhr-7B

Vikhr-7B - семейство открытых русскоязычных LLM от Vikhrmodels. Instruct для чата и базовые чекпоинты для дообучения. Запуск: vLLM, Transformers, llama.cpp. Минимум 6 ГБ VRAM в 4-bit, комфорт от 16 ГБ.

Требования к VRAM

6 ГБ
Минимум
Базовая работа, медленнее
16 ГБ
Рекомендуется
Комфортная работа

GPU от

10,62 ₽/час
Минимум VRAM
6 ГБ
Рекомендуется
16 ГБ
Подходит GPU
53
Сайт проекта →

Свой сервер: GPU для Vikhr-7B

53 видеокарты с VRAM ≥ 6 ГБ

Все GPU →
RTX 3060Бюджетный класс GPU
12 ГБGDDR6
от 13,33 ₽/час
≈ 9 731 ₽ / мес
2 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX A4000Средний класс GPU
16 ГБGDDR6
от 15,01 ₽/час
≈ 10 957 ₽ / мес
38 предложений
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4090Производительный класс GPU
24 ГБGDDR6X
от 17,90 ₽/час
≈ 13 067 ₽ / мес
152 предложения
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 3060 TiБюджетный класс GPU
8 ГБGDDR6
от 20,55 ₽/час
≈ 15 002 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
A2Бюджетный класс GPU
16 ГБGDDR6
от 21,94 ₽/час
≈ 16 016 ₽ / мес
32 предложения
Инференс и API в продакшене
Tesla P100Средний класс GPU
16 ГБHBM2
от 23,56 ₽/час
vGPU от 1,47 ₽/час
≈ 17 199 ₽ / мес
7 предложений
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX A5000Производительный класс GPU
24 ГБGDDR6
от 24,26 ₽/час
≈ 17 710 ₽ / мес
67 предложений
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 5090Производительный класс GPU
32 ГБGDDR7
от 24,75 ₽/час
≈ 18 066 ₽ / мес
124 предложения
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A10Средний класс GPU
24 ГБGDDR6
от 25,68 ₽/час
≈ 18 746 ₽ / мес
22 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4000Бюджетный класс GPU
8 ГБGDDR6
от 28,33 ₽/час
≈ 20 681 ₽ / мес
5 предложений
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 3090Средний класс GPU
24 ГБGDDR6X
от 29,17 ₽/час
≈ 21 294 ₽ / мес
30 предложений
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 4070 SuperСредний класс GPU
12 ГБGDDR6X
от 30,14 ₽/час
≈ 22 002 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 2000 PROПроизводительный класс GPU
16 ГБGDDR7
от 31,00 ₽/час
≈ 22 630 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Radeon RX 7900 XTXПроизводительный класс GPU
24 ГБGDDR6
от 32,50 ₽/час
≈ 23 725 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Grid K2Средний класс GPU
8 ГБGDDR5
от 32,69 ₽/час
≈ 23 864 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla K40Средний класс GPU
12 ГБGDDR5
от 33,29 ₽/час
≈ 24 302 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla K80Средний класс GPU
24 ГБGDDR5
от 33,74 ₽/час
≈ 24 630 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4070 TiСредний класс GPU
12 ГБGDDR6X
от 34,25 ₽/час
≈ 25 003 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Radeon AI PRO R9700Производительный класс GPU
32 ГБGDDR6
от 34,33 ₽/час
≈ 25 063 ₽ / мес
3 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla V100Производительный класс GPU
32 ГБHBM2
от 35,58 ₽/час
vGPU от 4,78 ₽/час
≈ 25 973 ₽ / мес
38 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
L4Средний класс GPU
24 ГБGDDR6
от 35,77 ₽/час
vGPU от 6,63 ₽/час
≈ 26 112 ₽ / мес
33 предложения
Инференс и API в продакшене
Tesla M10Средний класс GPU
32 ГБGDDR5
от 36,15 ₽/час
vGPU от 6,56 ₽/час
≈ 26 390 ₽ / мес
4 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla P4Средний класс GPU
8 ГБGDDR5
от 36,15 ₽/час
≈ 26 390 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4080Производительный класс GPU
16 ГБGDDR6X
от 36,99 ₽/час
≈ 27 003 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4080 SuperПроизводительный класс GPU
16 ГБGDDR6X
от 45,21 ₽/час
≈ 33 003 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla P40Средний класс GPU
24 ГБGDDR5
от 58,90 ₽/час
≈ 42 997 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 5000 ADAПроизводительный класс GPU
32 ГБGDDR6
от 72,31 ₽/час
≈ 52 783 ₽ / мес
7 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A30Средний класс GPU
24 ГБHBM2
от 89,00 ₽/час
≈ 64 970 ₽ / мес
10 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
RTX A6000Производительный класс GPU
48 ГБGDDR6
от 97,00 ₽/час
≈ 70 810 ₽ / мес
10 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 6000Производительный класс GPU
48 ГБGDDR6
от 103,99 ₽/час
≈ 75 913 ₽ / мес
12 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
L40SПроизводительный класс GPU
48 ГБGDDR6
от 106,25 ₽/час
vGPU от 12,46 ₽/час
≈ 77 563 ₽ / мес
17 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
L40Производительный класс GPU
48 ГБGDDR6
от 110,72 ₽/час
≈ 80 826 ₽ / мес
5 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A100 40GBПроизводительный класс GPU
40 ГБHBM2
от 113,42 ₽/час
≈ 82 797 ₽ / мес
15 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
A40Средний класс GPU
48 ГБGDDR6
от 127,00 ₽/час
≈ 92 710 ₽ / мес
2 предложения
Инференс и API в продакшене
RTX 6000 PROФлагманский класс GPU
96 ГБGDDR7
от 133,20 ₽/час
≈ 97 236 ₽ / мес
32 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
5000 PROПроизводительный класс GPU
72 ГБGDDR7
от 164,99 ₽/час
≈ 120 443 ₽ / мес
2 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 5880Средний класс GPU
48 ГБGDDR6
от 178,08 ₽/час
≈ 129 998 ₽ / мес
1 предложение
Обучение моделей с нуляИнференс и API в продакшене3D, рендер и видеомонтаж
A100 80GBФлагманский класс GPU
80 ГБHBM2e
от 185,00 ₽/час
≈ 135 050 ₽ / мес
50 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H100Флагманский класс GPU
80 ГБHBM3
от 242,00 ₽/час
≈ 176 660 ₽ / мес
47 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H100 NVLФлагманский класс GPU
94 ГБHBM3
от 364,74 ₽/час
≈ 266 257 ₽ / мес
4 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H200Флагманский класс GPU
141 ГБHBM3e
от 375,00 ₽/час
≈ 273 750 ₽ / мес
22 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
B200Флагманский класс GPU
180 ГБHBM3e
от 842,16 ₽/час
≈ 614 777 ₽ / мес
3 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
B300Флагманский класс GPU
288 ГБHBM3e
от 941,78 ₽/час
≈ 687 500 ₽ / мес
4 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
A16Средний класс GPU
64 ГБGDDR6
от 10,22 ₽/час · vGPU
≈ 7 461 ₽ / мес
4 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
5000 PRO 48GBПроизводительный класс GPU
48 ГБGDDR7
нет данных
/ мес
Инференс и API в продакшене3D, рендер и видеомонтаж
AMD Radeon 780MСредний класс GPU
6 ГБLPDDR5
нет данных
/ мес
Инференс и API в продакшене

Частые вопросы о запуске Vikhr-7B

Сколько VRAM нужно для запуска Vikhr-7B?+
Минимальные требования: 6 ГБ VRAM в 4-битном квантовании (GGUF, AWQ). Для FP16 - 14–16 ГБ VRAM. Рекомендуемая видеокарта: RTX 4090 (24 ГБ) - обеспечивает комфортную скорость инференса и запас памяти для длинных контекстов.
Как запустить Vikhr-7B на арендованном GPU?+
Скачайте веса с Hugging Face (Vikhrmodels/Vikhr-7B-Instruct), установите vLLM (pip install vllm) и запустите: vllm serve Vikhrmodels/Vikhr-7B-Instruct --port 8000. Альтернативно: GGUF-файл через llama.cpp или Ollama (на данный момент требуется ручная загрузка).
Vikhr-7B vs другие русскоязычные LLM - что выбрать?+
Vikhr-7B сравним по качеству с T-lite (тоже 7B) и показывает хорошие результаты на русскоязычных диалоговых задачах. T-lite легче (Q4 от 6 ГБ) и уже встроен в экосистему Ollama. Vikhr-7B выделяется качеством инструктивного следования. Для более сложных задач рассмотрите T-pro (32B) или API-доступ к коммерческим моделям.
Можно ли дообучить Vikhr-7B под свои задачи?+
Да, полный файнтюнинг Vikhr-7B в FP16 требует около 40 ГБ VRAM (A100 40G или 2×RTX 4090). QLoRA-файнтюнинг укладывается в 16–24 ГБ и занимает 15–30 минут на небольшом датасете. Используйте Unsloth или стандартный Hugging Face Transformers с PEFT/LoRA.

Похожие инструменты

Vikhr-7B - семейство открытых русскоязычных LLM-моделей от команды Vikhrmodels. Модели Vikhr оптимизированы для русского языка и показывают сильные результаты на бенчмарках генерации и понимания русскоязычного текста. Доступны варианты Instruct для чат-диалогов и базовые чекпоинты для дообучения под свои задачи.

Для запуска Vikhr-7B достаточно 6 ГБ VRAM в 4-битном квантовании (GGUF через llama.cpp или Ollama). В FP16 модель требует 14–16 ГБ видеопамяти - оптимально на RTX 4090. Для продакшн-развёртывания с высокой пропускной способностью используйте vLLM - он поддерживает continuous batching, PagedAttention и совместимый с OpenAI API эндпоинт.

На платформе GPU Индекс вы можете сравнить цены на аренду подходящих GPU у российских и зарубежных провайдеров с оплатой в рублях.