GPU для инференс
Какой GPU нужен для инференс. Сравните цены на аренду видеокарт.
Инференс
TEI (bge-m3)
Эмбеддинги и RAG: векторизация документов для поиска
VRAM от 4 ГБ
GPU от 10,62 ₽/час
Инференс
vLLM
LLM serving: PagedAttention, OpenAI API
VRAM от 16 ГБ
GPU от 15,01 ₽/часAPI от 15,5 ₽/1M
Инференс
TGI
HF Text Generation Inference
VRAM от 16 ГБ
GPU от 15,01 ₽/часAPI от 15,5 ₽/1M
Инференс
Triton
NVIDIA Triton Inference Server
VRAM от 8 ГБ
GPU от 10,62 ₽/час
Инференс
YOLO
Детекция объектов в реальном времени
VRAM от 4 ГБ
GPU от 10,62 ₽/час
Инференс
Whisper
Распознавание речи на 99 языках
VRAM от 4 ГБ
GPU от 10,62 ₽/час
Серверы инференса для запуска AI-моделей в продакшне - эмбеддинги, детекция объектов, распознавание речи. Оптимизированы для высокой пропускной способности. Сравните Каталог GPU или посмотрите все AI-инструменты.
Каталог GPU
Видеокарты с подходящей VRAM
Все AI-инструменты
22 инструментов во всех категориях