LLM
GPU для Qwen
Самая популярная семья открытых LLM: Qwen 2.5, Qwen 3, Qwen 3.5 и новее, от 0.5B до 671B, включая MoE-версии. Запуск: Ollama, llama.cpp, vLLM.
Требования к VRAM
6 ГБ
Минимум
Базовая работа, медленнее
24 ГБ
Рекомендуется
Комфортная работа
GPU от
10,62 ₽/час
API от
3,71 ₽/1M
без своего сервера · у агрегаторов
- Минимум VRAM
- 6 ГБ
- Рекомендуется
- 24 ГБ
- Подходит GPU
- 53
Свой сервер: GPU для Qwen
53 видеокарты с VRAM ≥ 6 ГБ
GTX 1080 TiБюджетный класс GPU
11 ГБGDDR5X
от 10,62 ₽/час
≈ 7 753 ₽ / мес
3D, рендер и видеомонтаж
GTX 1060Бюджетный класс GPU
6 ГБGDDR5
от 10,68 ₽/час
≈ 7 796 ₽ / мес
3D, рендер и видеомонтаж
GTX 1080Бюджетный класс GPU
8 ГБGDDR5X
от 11,37 ₽/час
≈ 8 300 ₽ / мес
3D, рендер и видеомонтаж
RTX 3060Бюджетный класс GPU
12 ГБGDDR6
от 13,33 ₽/час
≈ 9 731 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX A4000Средний класс GPU
16 ГБGDDR6
от 15,01 ₽/час
≈ 10 957 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
GTX 1070Бюджетный класс GPU
8 ГБGDDR5
от 16,39 ₽/час
≈ 11 965 ₽ / мес
3D, рендер и видеомонтаж
RTX 4090Производительный класс GPU
24 ГБGDDR6X
от 17,90 ₽/час
≈ 13 067 ₽ / мес
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
Tesla T4Бюджетный класс GPU
16 ГБGDDR6
от 19,18 ₽/час
≈ 14 001 ₽ / мес
Инференс и API в продакшене
RTX 3060 TiБюджетный класс GPU
8 ГБGDDR6
от 20,55 ₽/час
≈ 15 002 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
A2Бюджетный класс GPU
16 ГБGDDR6
от 21,94 ₽/час
≈ 16 016 ₽ / мес
Инференс и API в продакшене
RTX 2080 TiБюджетный класс GPU
11 ГБGDDR6
от 22,98 ₽/час
≈ 16 772 ₽ / мес
3D, рендер и видеомонтаж
Tesla P100Средний класс GPU
16 ГБHBM2
от 23,56 ₽/час
vGPU от 1,47 ₽/час
≈ 17 199 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX A5000Производительный класс GPU
24 ГБGDDR6
от 24,26 ₽/час
≈ 17 710 ₽ / мес
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 5090Производительный класс GPU
32 ГБGDDR7
от 24,75 ₽/час
≈ 18 066 ₽ / мес
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A10Средний класс GPU
24 ГБGDDR6
от 25,68 ₽/час
≈ 18 746 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 3080Средний класс GPU
10 ГБGDDR6X
от 27,00 ₽/час
≈ 19 710 ₽ / мес
3D, рендер и видеомонтаж
RTX 4000Бюджетный класс GPU
8 ГБGDDR6
от 28,33 ₽/час
≈ 20 681 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 3090Средний класс GPU
24 ГБGDDR6X
от 29,17 ₽/час
≈ 21 294 ₽ / мес
Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 4070 SuperСредний класс GPU
12 ГБGDDR6X
от 30,14 ₽/час
≈ 22 002 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 2000 PROПроизводительный класс GPU
16 ГБGDDR7
от 31,00 ₽/час
≈ 22 630 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Radeon RX 7900 XTXПроизводительный класс GPU
24 ГБGDDR6
от 32,50 ₽/час
≈ 23 725 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Grid K2Средний класс GPU
8 ГБGDDR5
от 32,69 ₽/час
≈ 23 864 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla K40Средний класс GPU
12 ГБGDDR5
от 33,29 ₽/час
≈ 24 302 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla K80Средний класс GPU
24 ГБGDDR5
от 33,74 ₽/час
≈ 24 630 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4070 TiСредний класс GPU
12 ГБGDDR6X
от 34,25 ₽/час
≈ 25 003 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Radeon AI PRO R9700Производительный класс GPU
32 ГБGDDR6
от 34,33 ₽/час
≈ 25 063 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla V100Производительный класс GPU
32 ГБHBM2
от 35,58 ₽/час
vGPU от 4,78 ₽/час
≈ 25 973 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
L4Средний класс GPU
24 ГБGDDR6
от 35,77 ₽/час
vGPU от 6,63 ₽/час
≈ 26 112 ₽ / мес
Инференс и API в продакшене
Tesla M10Средний класс GPU
32 ГБGDDR5
от 36,15 ₽/час
vGPU от 6,56 ₽/час
≈ 26 390 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla P4Средний класс GPU
8 ГБGDDR5
от 36,15 ₽/час
≈ 26 390 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4080Производительный класс GPU
16 ГБGDDR6X
от 36,99 ₽/час
≈ 27 003 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 4080 SuperПроизводительный класс GPU
16 ГБGDDR6X
от 45,21 ₽/час
≈ 33 003 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
Tesla P40Средний класс GPU
24 ГБGDDR5
от 58,90 ₽/час
≈ 42 997 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 5000 ADAПроизводительный класс GPU
32 ГБGDDR6
от 72,31 ₽/час
≈ 52 783 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A30Средний класс GPU
24 ГБHBM2
от 89,00 ₽/час
≈ 64 970 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
RTX A6000Производительный класс GPU
48 ГБGDDR6
от 97,00 ₽/час
≈ 70 810 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
RTX 6000Производительный класс GPU
48 ГБGDDR6
от 103,99 ₽/час
≈ 75 913 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
L40SПроизводительный класс GPU
48 ГБGDDR6
от 106,25 ₽/час
vGPU от 12,46 ₽/час
≈ 77 563 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
L40Производительный класс GPU
48 ГБGDDR6
от 110,72 ₽/час
≈ 80 826 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
A100 40GBПроизводительный класс GPU
40 ГБHBM2
от 113,42 ₽/час
≈ 82 797 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
A40Средний класс GPU
48 ГБGDDR6
от 127,00 ₽/час
≈ 92 710 ₽ / мес
Инференс и API в продакшене
RTX 6000 PROФлагманский класс GPU
96 ГБGDDR7
от 133,20 ₽/час
≈ 97 236 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж
5000 PROПроизводительный класс GPU
72 ГБGDDR7
от 164,99 ₽/час
≈ 120 443 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
RTX 5880Средний класс GPU
48 ГБGDDR6
от 178,08 ₽/час
≈ 129 998 ₽ / мес
Обучение моделей с нуляИнференс и API в продакшене3D, рендер и видеомонтаж
A100 80GBФлагманский класс GPU
80 ГБHBM2e
от 185,00 ₽/час
≈ 135 050 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H100Флагманский класс GPU
80 ГБHBM3
от 242,00 ₽/час
≈ 176 660 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H100 NVLФлагманский класс GPU
94 ГБHBM3
от 364,74 ₽/час
≈ 266 257 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
H200Флагманский класс GPU
141 ГБHBM3e
от 375,00 ₽/час
≈ 273 750 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
B200Флагманский класс GPU
180 ГБHBM3e
от 842,16 ₽/час
≈ 614 777 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
B300Флагманский класс GPU
288 ГБHBM3e
от 941,78 ₽/час
≈ 687 500 ₽ / мес
Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене
A16Средний класс GPU
64 ГБGDDR6
от 10,22 ₽/час · vGPU
≈ 7 461 ₽ / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
5000 PRO 48GBПроизводительный класс GPU
48 ГБGDDR7
нет данных
—— / мес
Инференс и API в продакшене3D, рендер и видеомонтаж
AMD Radeon 780MСредний класс GPU
6 ГБLPDDR5
нет данных
—— / мес
Инференс и API в продакшене
| GPU | Память | Применение | ₽/час↑ | ≈ в месяц | |
|---|---|---|---|---|---|
GTX 1080 TiБюджетный класс GPU | 11 ГБGDDR5X | 3D, рендер и видеомонтаж | от 10,62 ₽/час | ≈ 7 753 ₽ | 6 предложений → |
GTX 1060Бюджетный класс GPU | 6 ГБGDDR5 | 3D, рендер и видеомонтаж | от 10,68 ₽/час | ≈ 7 796 ₽ | 1 предложение → |
GTX 1080Бюджетный класс GPU | 8 ГБGDDR5X | 3D, рендер и видеомонтаж | от 11,37 ₽/час | ≈ 8 300 ₽ | 13 предложений → |
RTX 3060Бюджетный класс GPU | 12 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 13,33 ₽/час | ≈ 9 731 ₽ | 2 предложения → |
RTX A4000Средний класс GPU | 16 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 15,01 ₽/час | ≈ 10 957 ₽ | 38 предложений → |
GTX 1070Бюджетный класс GPU | 8 ГБGDDR5 | 3D, рендер и видеомонтаж | от 16,39 ₽/час | ≈ 11 965 ₽ | 1 предложение → |
RTX 4090Производительный класс GPU | 24 ГБGDDR6X | Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 17,90 ₽/час | ≈ 13 067 ₽ | 152 предложения → |
Tesla T4Бюджетный класс GPU | 16 ГБGDDR6 | Инференс и API в продакшене | от 19,18 ₽/час | ≈ 14 001 ₽ | 53 предложения → |
RTX 3060 TiБюджетный класс GPU | 8 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 20,55 ₽/час | ≈ 15 002 ₽ | 1 предложение → |
A2Бюджетный класс GPU | 16 ГБGDDR6 | Инференс и API в продакшене | от 21,94 ₽/час | ≈ 16 016 ₽ | 32 предложения → |
RTX 2080 TiБюджетный класс GPU | 11 ГБGDDR6 | 3D, рендер и видеомонтаж | от 22,98 ₽/час | ≈ 16 772 ₽ | 55 предложений → |
Tesla P100Средний класс GPU | 16 ГБHBM2 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 23,56 ₽/час vGPU от 1,47 ₽/час | ≈ 17 199 ₽ | 7 предложений → |
RTX A5000Производительный класс GPU | 24 ГБGDDR6 | Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 24,26 ₽/час | ≈ 17 710 ₽ | 67 предложений → |
RTX 5090Производительный класс GPU | 32 ГБGDDR7 | Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 24,75 ₽/час | ≈ 18 066 ₽ | 124 предложения → |
A10Средний класс GPU | 24 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 25,68 ₽/час | ≈ 18 746 ₽ | 22 предложения → |
RTX 3080Средний класс GPU | 10 ГБGDDR6X | 3D, рендер и видеомонтаж | от 27,00 ₽/час | ≈ 19 710 ₽ | 22 предложения → |
RTX 4000Бюджетный класс GPU | 8 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 28,33 ₽/час | ≈ 20 681 ₽ | 5 предложений → |
RTX 3090Средний класс GPU | 24 ГБGDDR6X | Файнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 29,17 ₽/час | ≈ 21 294 ₽ | 30 предложений → |
RTX 4070 SuperСредний класс GPU | 12 ГБGDDR6X | Инференс и API в продакшене3D, рендер и видеомонтаж | от 30,14 ₽/час | ≈ 22 002 ₽ | 1 предложение → |
RTX 2000 PROПроизводительный класс GPU | 16 ГБGDDR7 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 31,00 ₽/час | ≈ 22 630 ₽ | 1 предложение → |
Radeon RX 7900 XTXПроизводительный класс GPU | 24 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 32,50 ₽/час | ≈ 23 725 ₽ | 1 предложение → |
Grid K2Средний класс GPU | 8 ГБGDDR5 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 32,69 ₽/час | ≈ 23 864 ₽ | 1 предложение → |
Tesla K40Средний класс GPU | 12 ГБGDDR5 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 33,29 ₽/час | ≈ 24 302 ₽ | 1 предложение → |
Tesla K80Средний класс GPU | 24 ГБGDDR5 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 33,74 ₽/час | ≈ 24 630 ₽ | 1 предложение → |
RTX 4070 TiСредний класс GPU | 12 ГБGDDR6X | Инференс и API в продакшене3D, рендер и видеомонтаж | от 34,25 ₽/час | ≈ 25 003 ₽ | 1 предложение → |
Radeon AI PRO R9700Производительный класс GPU | 32 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 34,33 ₽/час | ≈ 25 063 ₽ | 3 предложения → |
Tesla V100Производительный класс GPU | 32 ГБHBM2 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 35,58 ₽/час vGPU от 4,78 ₽/час | ≈ 25 973 ₽ | 38 предложений → |
L4Средний класс GPU | 24 ГБGDDR6 | Инференс и API в продакшене | от 35,77 ₽/час vGPU от 6,63 ₽/час | ≈ 26 112 ₽ | 33 предложения → |
Tesla M10Средний класс GPU | 32 ГБGDDR5 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 36,15 ₽/час vGPU от 6,56 ₽/час | ≈ 26 390 ₽ | 4 предложения → |
Tesla P4Средний класс GPU | 8 ГБGDDR5 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 36,15 ₽/час | ≈ 26 390 ₽ | 1 предложение → |
RTX 4080Производительный класс GPU | 16 ГБGDDR6X | Инференс и API в продакшене3D, рендер и видеомонтаж | от 36,99 ₽/час | ≈ 27 003 ₽ | 1 предложение → |
RTX 4080 SuperПроизводительный класс GPU | 16 ГБGDDR6X | Инференс и API в продакшене3D, рендер и видеомонтаж | от 45,21 ₽/час | ≈ 33 003 ₽ | 1 предложение → |
Tesla P40Средний класс GPU | 24 ГБGDDR5 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 58,90 ₽/час | ≈ 42 997 ₽ | 1 предложение → |
RTX 5000 ADAПроизводительный класс GPU | 32 ГБGDDR6 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 72,31 ₽/час | ≈ 52 783 ₽ | 7 предложений → |
A30Средний класс GPU | 24 ГБHBM2 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 89,00 ₽/час | ≈ 64 970 ₽ | 10 предложений → |
RTX A6000Производительный класс GPU | 48 ГБGDDR6 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 97,00 ₽/час | ≈ 70 810 ₽ | 10 предложений → |
RTX 6000Производительный класс GPU | 48 ГБGDDR6 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 103,99 ₽/час | ≈ 75 913 ₽ | 12 предложений → |
L40SПроизводительный класс GPU | 48 ГБGDDR6 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 106,25 ₽/час vGPU от 12,46 ₽/час | ≈ 77 563 ₽ | 17 предложений → |
L40Производительный класс GPU | 48 ГБGDDR6 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 110,72 ₽/час | ≈ 80 826 ₽ | 5 предложений → |
A100 40GBПроизводительный класс GPU | 40 ГБHBM2 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 113,42 ₽/час | ≈ 82 797 ₽ | 15 предложений → |
A40Средний класс GPU | 48 ГБGDDR6 | Инференс и API в продакшене | от 127,00 ₽/час | ≈ 92 710 ₽ | 2 предложения → |
RTX 6000 PROФлагманский класс GPU | 96 ГБGDDR7 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене3D, рендер и видеомонтаж | от 133,20 ₽/час | ≈ 97 236 ₽ | 32 предложения → |
5000 PROПроизводительный класс GPU | 72 ГБGDDR7 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 164,99 ₽/час | ≈ 120 443 ₽ | 2 предложения → |
RTX 5880Средний класс GPU | 48 ГБGDDR6 | Обучение моделей с нуляИнференс и API в продакшене3D, рендер и видеомонтаж | от 178,08 ₽/час | ≈ 129 998 ₽ | 1 предложение → |
A100 80GBФлагманский класс GPU | 80 ГБHBM2e | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 185,00 ₽/час | ≈ 135 050 ₽ | 50 предложений → |
H100Флагманский класс GPU | 80 ГБHBM3 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 242,00 ₽/час | ≈ 176 660 ₽ | 47 предложений → |
H100 NVLФлагманский класс GPU | 94 ГБHBM3 | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 364,74 ₽/час | ≈ 266 257 ₽ | 4 предложения → |
H200Флагманский класс GPU | 141 ГБHBM3e | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 375,00 ₽/час | ≈ 273 750 ₽ | 22 предложения → |
B200Флагманский класс GPU | 180 ГБHBM3e | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 842,16 ₽/час | ≈ 614 777 ₽ | 3 предложения → |
B300Флагманский класс GPU | 288 ГБHBM3e | Обучение моделей с нуляФайнтюнинг и LoRAИнференс и API в продакшене | от 941,78 ₽/час | ≈ 687 500 ₽ | 4 предложения → |
A16Средний класс GPU | 64 ГБGDDR6 | Инференс и API в продакшене3D, рендер и видеомонтаж | от 10,22 ₽/час · vGPU | ≈ 7 461 ₽ | 4 предложения → |
5000 PRO 48GBПроизводительный класс GPU | 48 ГБGDDR7 | Инференс и API в продакшене3D, рендер и видеомонтаж | нет данных | — | — |
AMD Radeon 780MСредний класс GPU | 6 ГБLPDDR5 | Инференс и API в продакшене | нет данных | — | — |
Без своего сервера - через API агрегаторов
Альтернатива аренде GPU: готовый API с оплатой в рублях
Qwen-Turbo
от 3,71 ₽/1M за входQwen3.5-35B-A3B
от 14,46 ₽/1M за входЧастые вопросы о запуске Qwen
Сколько VRAM нужно для Qwen?+−
7B в Q4 - от 6 ГБ (RTX 4060). 32B в Q4 - от 20-24 ГБ (RTX 4090, L40S). MoE 35B-A3B - от 24 ГБ. 235B - несколько GPU по 80 ГБ.
Как запустить Qwen?+−
ollama pull qwen3, GGUF в llama.cpp или vllm serve - OpenAI-совместимый API.
Qwen или DeepSeek / Llama?+−
Qwen - сильные результаты на коде и RU-задачах при открытых весах. DeepSeek - мощная reasoning-линейка, Llama - классика с самым богатым экосистемным тулингом.
Похожие инструменты
Qwen - самая популярная семья открытых LLM от Alibaba: от лёгких 0.5B до 671B, включая MoE-версии вроде 35B-A3B. 7B в Q4 - от 6 ГБ VRAM (RTX 4060), 32B - от 24 ГБ (RTX 4090), 235B - кластер из нескольких GPU по 80 ГБ. Запуск: Ollama, GGUF в llama.cpp, vLLM для прод-инференса. Цены на аренду подходящих GPU - в таблице на странице. Без своего сервера Qwen доступна через API: [qwen-turbo](/llm-api/qwen-turbo).