Где арендовать GPU-серверы в России в 2026 году: сравнение цен, наличия и условий
Полный независимый разбор рынка GPU в РФ: Selectel, Cloud.ru, Timeweb Cloud, Hostkey и Serverspace. Почасовые и месячные цены на RTX 4090, A100 и H100, наличие карт, безнал с НДС и выбор под LLM.
Если вам нужен сервер под инференс или обучение моделей до 32B (Qwen 2.5 Coder, Llama 8B) — лучший выбор по цене/качеству это 1x RTX 4090 24GB в Hostkey (от 42 ₽/час) или Timeweb Cloud (от 49 ₽/час). Для моделей 70B оптимальна конфигурация с 2x RTX 4090 или 1x NVIDIA L40S 48GB (Serverspace). Если же вы обучаете крупные сети или вам нужен гарантированный энтерпрайз-SLA с безналом и НДС — выбирайте инстансы NVIDIA A100 80GB в Selectel или Cloud.ru.
- Рынок GPU в России в 2026 году разделился на два лагеря: потребительские карты (RTX 4090 24GB от 42–49 ₽/час) для инференса и файн-тюнинга до 70B, и серверные ускорители (A100/H100 80GB от 180–320 ₽/час) для масштабного обучения.
- Почасовая оплата (Pay-as-you-go) доступна у Timeweb Cloud, Hostkey, Serverspace и Cloud.ru, позволяя не переплачивать за простой серверов в выходные.
- Для моделей класса 70B параметров (Llama 3.3, Qwen 2.5 72B) в 4-битном квантовании связка из 2x RTX 4090 (48 ГБ VRAM) обходится в 3–4 раза дешевле одного инстанса A100 при сопоставимой скорости.
- Корпоративным заказчикам критически важна работа по ЭДО с НДС 20%: безналичный расчет без наценок полноценно поддерживают Selectel, Cloud.ru и Timeweb.
Сравнение провайдеров GPU-серверов в РФ (актуальные данные 2026)
| Провайдер | Ключевые GPU | Мин. цена/час | Мин. цена/мес | Почасовая | Оплата / НДС | Статус наличия |
|---|---|---|---|---|---|---|
| Hostkey | RTX 3090/4090, A100, H100 | от 42 ₽ | от 28 900 ₽ | Да | Карты РФ, безнал | Высокое (свой парк) |
| Timeweb Cloud | RTX 4090 24GB, A100 80GB | от 49 ₽ | от 34 990 ₽ | Да | Карты РФ, СБП, НДС | В наличии |
| Serverspace | L40S 48GB, RTX 4090 x2 | от 52 ₽ | от 37 400 ₽ | Да | Карты РФ, безнал | В наличии |
| Selectel | A100 80GB SXM, H100, L4 | от 190 ₽ | от 129 000 ₽ | Да (облако) | Безнал с НДС, юрлица | По запросу / облако |
| Cloud.ru | A100 80GB, V100, ML Space | от 195 ₽ | от 135 000 ₽ | Да | Безнал с НДС, ЭДО | В наличии |
Ландшафт GPU-рынка в России в 2026 году
Спрос на вычислительные мощности для генеративного искусственного интеллекта в Рунете за последний год вырос более чем в 3 раза. После выхода открытых моделей нового поколения (DeepSeek R1, Llama 3.3, Qwen 2.5) бизнесу больше не нужно платить за иностранные API — собственные инстансы обеспечивают полную приватность данных по 152-ФЗ и независимость от внешних санкций.
Однако главная проблема рынка — **дефицит и ценовая фрагментация**. В отличие от обычных VPS, где цены колеблются в пределах нескольких сотен рублей, разброс на одинаковую карту RTX 4090 у разных провайдеров может составлять от 28 000 до 65 000 рублей в месяц, а наличие карт меняется буквально каждые несколько часов.
Обзор ключевых провайдеров
**1. Hostkey** — один из лидеров по числу потребительских GPU карт. Провайдер предлагает огромный парк RTX 4090 и RTX 3090 с гибким почасовым биллингом. Отличный вариант для быстрого запуска инференса и экономии бюджета.
**2. Timeweb Cloud** — современная панель, мгновенный деплой готовых образов (Docker + CUDA + Ollama за 90 секунд), стабильные каналы связи в дата-центрах Москвы и Санкт-Петербурга, поддержка оплаты как физлицами по СБП, так и компаниями с НДС.
**3. Serverspace** — привлекателен наличием профессиональных карт NVIDIA L40S с 48 ГБ быстрой памяти GDDR6 с ECC. L40S — это идеальный компромисс между дорогой A100 и потребительской 4090, позволяющий комфортно запускать 70B модели на одной карте.
**4. Selectel и Cloud.ru** — энтерпрайз-тяжеловесы. Специализируются на топовых тензорных ускорителях NVIDIA A100 и H100 80GB с шиной NVLink (до 600–900 ГБ/с). Необходимы для обучения больших языковых моделей и построения распределенных кластеров.
Какую видеокарту выбрать под вашу задачу
• **Инференс моделей 7B–14B (Llama 3.1 8B, Phi-4):** достаточно 1x RTX 3090 или RTX 4090 (24 ГБ). Модель помещается с контекстом до 64k токенов, выдавая 90–120 токенов/сек.
• **Кодинг и агентные модели 32B (Qwen 2.5 Coder 32B):** идеально ложатся на одну карту RTX 4090 в 4-битном квантовании (занимает около 20 ГБ VRAM).
• **Флагманы 70B (Llama 3.3 70B):** требуют минимум 42 ГБ VRAM. Рекомендуется конфигурация с 2x RTX 4090 или 1x NVIDIA L40S 48GB. Для запуска в полном FP16 качестве потребуется 1x A100 80GB.
Почасовая оплата против помесячной: как сэкономить до 70%
Если ваша команда не утилизирует сервер 24/7, брать помесячную аренду — прямая потеря денег. Например, аренда RTX 4090 на месяц обойдется в ~32 000 ₽. Если вы включаете сервер только в рабочие часы (160 часов в месяц) с почасовой ставкой 45 ₽/час, итоговый счет составит всего 7 200 ₽ в месяц.
Многие провайдеры позволяют сохранять снимок диска (снапшот) и отключать дорогостоящий GPU на ночь, оплачивая в часы простоя только хранение диска (~50–100 ₽/мес).
Проверенные серверы от надежных провайдеров
Timeweb Cloud
Cloud Start
CPU
1 ядер • 3.3 ГГц
RAM
1 ГБ
Диск
15 ГБ NVMe
Канал
200 Мбит/с
299 ₽/мес
Timeweb Cloud
Cloud Basic
CPU
2 ядер • 3.3 ГГц
RAM
2 ГБ
Диск
40 ГБ NVMe
Канал
200 Мбит/с
499 ₽/мес
Часто задаваемые вопросы (FAQ)
Предоставляются ли закрывающие документы с НДС?
Да, все ведущие российские провайдеры (Selectel, Cloud.ru, Timeweb Cloud, Hostkey) работают с юридическими лицами по безналичному расчету через ЭДО (Диадок, СБИС) и предоставляют УПД с НДС 20%.
Что лучше для локальной LLM: 2x RTX 4090 или 1x A100 80GB?
Для инференса (отдачи ответов) квантованных моделей 70B связка из двух RTX 4090 (48 ГБ VRAM) выгоднее в 3–4 раза по цене при схожей скорости генерации (25–35 токенов/сек). Карта A100 80GB требуется в первую очередь для дообучения (LoRA/Full Fine-tuning), где критически важна точность FP16/BF16 и тензорные ядра FP64.