GPU для AI-моделей
Каталог AI-инструментов: LLM, генерация изображений, обучение и инференс. Для каждого - требования к VRAM, рекомендуемые видеокарты и цены аренды GPU.
Kimi K3, Ollama, T-pro, T-lite, Vikhr, ruGPT, llama.cpp.
Смотреть →Stable Diffusion, Automatic1111, ComfyUI, FLUX - генерация картинок на GPU.
Смотреть →Генерация и обработка видео на арендованных видеокартах.
Смотреть →Файнтюнинг LLM: Unsloth, LoRA/QLoRA без лишних затрат VRAM.
Смотреть →vLLM, TGI, Triton, TEI, YOLO, Whisper.
Смотреть →LLM
VRAM и цена аренды GPU под LLM — от 6 ГБ.
Ollama
Локальный запуск LLM одной командой
T-pro
RU LLM 32B, T-Bank (t-tech)
T-lite
RU LLM 7B, T-Bank (t-tech)
Vikhr-7B
Открытая русскоязычная LLM 7B от Vikhrmodels
ruGPT-3.5
RU 13B, SberDevices / AI Forever
llama.cpp
Квантизованный инференс LLM на CPU и GPU
Kimi K3
Open 2.8T MoE от Moonshot: vision + 1M контекст
DeepSeek R1
Открытая reasoning-модель класса o1
Qwen
Открытая семья LLM от Alibaba: от 0.5B до 671B
Изображения
Какой GPU нужен для SDXL, FLUX, Automatic1111 и ComfyUI - минимальные цены аренды.
Stable Diffusion
Генерация изображений из текста и фото
Automatic1111
WebUI для Stable Diffusion: txt2img, img2img, LoRA
ComfyUI
Нодовый редактор для AI-генерации изображений
FLUX.1
Передовая модель генерации изображений от Black Forest Labs
Видео
Видеокарты под генерацию и обработку видео: VRAM и цена аренды.
Обучение
Файнтюнинг моделей на арендованном GPU: сколько VRAM и сколько стоит час.
Инференс
GPU под vLLM, TGI, Triton, CV и ASR.
TEI (bge-m3)
Эмбеддинги и RAG: векторизация документов для поиска
vLLM
LLM serving: PagedAttention, OpenAI API
TGI
HF Text Generation Inference
Triton
NVIDIA Triton Inference Server
YOLO
Детекция объектов в реальном времени
Whisper
Распознавание речи на 99 языках