GPUИндекс
LLM

GPU для T-pro

Открытая русскоязычная ~32B от T-Bank. Веса на Hugging Face (t-tech). Запуск: vLLM, llama.cpp, Ollama.

Требования к VRAM

24 ГБ
Минимум
Базовая работа, медленнее
40 ГБ
Рекомендуется
Комфортная работа

GPU от

17,90 ₽/час

API от

8,2 ₽/1M

без своего сервера · у агрегаторов

Минимум VRAM
24 ГБ
Рекомендуется
40 ГБ
Подходит GPU
31
Сайт проекта →

Свой сервер: GPU для T-pro

31 видеокарта с VRAM ≥ 24 ГБ

Все GPU →
RTX 4090Производительный класс GPU
24 ГБGDDR6X
от 17,90 ₽/час
≈ 13 067 ₽ / мес
152 предложения
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX A5000Производительный класс GPU
24 ГБGDDR6
от 24,26 ₽/час
≈ 17 710 ₽ / мес
67 предложений
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 5090Производительный класс GPU
32 ГБGDDR7
от 24,75 ₽/час
≈ 18 066 ₽ / мес
124 предложения
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A10Средний класс GPU
24 ГБGDDR6
от 25,68 ₽/час
≈ 18 746 ₽ / мес
22 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 3090Средний класс GPU
24 ГБGDDR6X
от 29,17 ₽/час
≈ 21 294 ₽ / мес
30 предложений
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
Radeon RX 7900 XTXПроизводительный класс GPU
24 ГБGDDR6
от 32,50 ₽/час
≈ 23 725 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla K80Средний класс GPU
24 ГБGDDR5
от 33,74 ₽/час
≈ 24 630 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
Radeon AI PRO R9700Производительный класс GPU
32 ГБGDDR6
от 34,33 ₽/час
≈ 25 063 ₽ / мес
3 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla V100Производительный класс GPU
32 ГБHBM2
от 35,58 ₽/час
vGPU от 4,78 ₽/час
≈ 25 973 ₽ / мес
38 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
L4Средний класс GPU
24 ГБGDDR6
от 35,77 ₽/час
vGPU от 6,63 ₽/час
≈ 26 112 ₽ / мес
33 предложения
Инференс и API в продакшене
Tesla M10Средний класс GPU
32 ГБGDDR5
от 36,15 ₽/час
vGPU от 6,56 ₽/час
≈ 26 390 ₽ / мес
4 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla P40Средний класс GPU
24 ГБGDDR5
от 58,90 ₽/час
≈ 42 997 ₽ / мес
1 предложение
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 5000 ADAПроизводительный класс GPU
32 ГБGDDR6
от 72,31 ₽/час
≈ 52 783 ₽ / мес
7 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A30Средний класс GPU
24 ГБHBM2
от 89,00 ₽/час
≈ 64 970 ₽ / мес
10 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
RTX A6000Производительный класс GPU
48 ГБGDDR6
от 97,00 ₽/час
≈ 70 810 ₽ / мес
10 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 6000Производительный класс GPU
48 ГБGDDR6
от 103,99 ₽/час
≈ 75 913 ₽ / мес
12 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
L40SПроизводительный класс GPU
48 ГБGDDR6
от 106,25 ₽/час
vGPU от 12,46 ₽/час
≈ 77 563 ₽ / мес
17 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
L40Производительный класс GPU
48 ГБGDDR6
от 110,72 ₽/час
≈ 80 826 ₽ / мес
5 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A100 40GBПроизводительный класс GPU
40 ГБHBM2
от 113,42 ₽/час
≈ 82 797 ₽ / мес
15 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
A40Средний класс GPU
48 ГБGDDR6
от 127,00 ₽/час
≈ 92 710 ₽ / мес
2 предложения
Инференс и API в продакшене
RTX 6000 PROФлагманский класс GPU
96 ГБGDDR7
от 133,20 ₽/час
≈ 97 236 ₽ / мес
32 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
5000 PROПроизводительный класс GPU
72 ГБGDDR7
от 164,99 ₽/час
≈ 120 443 ₽ / мес
2 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 5880Средний класс GPU
48 ГБGDDR6
от 178,08 ₽/час
≈ 129 998 ₽ / мес
1 предложение
Обучение моделей с нуляИнференс и API в продакшене3D, рендер и видеомонтаж
A100 80GBФлагманский класс GPU
80 ГБHBM2e
от 185,00 ₽/час
≈ 135 050 ₽ / мес
50 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H100Флагманский класс GPU
80 ГБHBM3
от 242,00 ₽/час
≈ 176 660 ₽ / мес
47 предложений
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H100 NVLФлагманский класс GPU
94 ГБHBM3
от 364,74 ₽/час
≈ 266 257 ₽ / мес
4 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H200Флагманский класс GPU
141 ГБHBM3e
от 375,00 ₽/час
≈ 273 750 ₽ / мес
22 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
B200Флагманский класс GPU
180 ГБHBM3e
от 842,16 ₽/час
≈ 614 777 ₽ / мес
3 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
B300Флагманский класс GPU
288 ГБHBM3e
от 941,78 ₽/час
≈ 687 500 ₽ / мес
4 предложения
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
A16Средний класс GPU
64 ГБGDDR6
от 10,22 ₽/час · vGPU
≈ 7 461 ₽ / мес
4 предложения
Инференс и API в продакшене3D, рендер и видеомонтаж
5000 PRO 48GBПроизводительный класс GPU
48 ГБGDDR7
нет данных
/ мес
Инференс и API в продакшене3D, рендер и видеомонтаж

Без своего сервера - через API агрегаторов

Альтернатива аренде GPU: готовый API с оплатой в рублях

Все LLM API →

T-pro 2.1

от 8,2 ₽/1M за вход

Частые вопросы о запуске T-pro

Сколько VRAM нужно для запуска T-pro?+
4-bit - от 24 ГБ (RTX 4090, L40S). FP16 - около 64 ГБ (A100/H100).
Как запустить T-pro на арендованном GPU?+
vllm serve t-tech/T-pro - OpenAI-совместимый API. Для тестов - GGUF в llama.cpp или Ollama.
T-pro или T-lite / Vikhr-7B?+
T-pro сильнее на сложных задачах (код, длинные тексты), но нужно от 24 ГБ VRAM вместо 6 ГБ. Для простых чат/RAG хватит T-lite или Vikhr-7B.
Можно ли дообучить T-pro?+
QLoRA - одна карта 40-48 ГБ. Полный файнтюнинг в FP16 - 2-4 GPU по 80 ГБ.

Похожие инструменты

T-pro - открытая русскоязычная LLM на 32 млрд параметров от T-Bank. 4-bit (AWQ, GGUF) - от 24 ГБ VRAM (RTX 4090, L40S), FP16 - около 64 ГБ (A100/H100). Для serving - vLLM, для экспериментов - llama.cpp/Ollama. Цены на аренду подходящих GPU - в таблице на странице