По запросу «аренда GPU» находятся десятки страниц, где одна и та же карта стоит по-разному. Причина простая: час видеокарты оценивают по объёму VRAM, типу облака и тому, сколько времени машина остаётся включённой, а заметная часть счёта прячется в дисках и простое. Ниже собраны цены с официальных страниц провайдеров и разобрано, как их читать. Полный список GPU-платформ есть в нашем рейтинге GPU для AI.
Про метод. 10 октября 2026 года мы открыли страницы цен RunPod, DigitalOcean и Cherry Servers и переписали ставки так, как они там показаны. Страница цен Vultr при проверке вернула ошибку доступа, поэтому цифр Vultr здесь нет. Скорость карт мы не мерили: наш тест /tests измеряет TTFB публичных сайтов хостеров и о работе GPU ничего не говорит.
Ставки на GPU меняются несколько раз в год. Все суммы ниже — снимок по данным сайта провайдера, октябрь 2026. Перед пополнением баланса откройте живую страницу цен.
Облако по часам или выделенный GPU-сервер
В облаке по часам вы запускаете машину, платите за секунды или часы и удаляете её, когда задача закончилась. Выделенный GPU-сервер — это целая физическая машина в аренде на месяц и дольше, у некоторых провайдеров и почасово. Для большинства задач первый вариант дешевле, а арифметика умещается в одну строку: разделите месячную цену на часовую, и получится число часов, после которого месячный тариф начинает выигрывать.
Cherry Servers показывает A100 80 ГБ от $2.362/час и от $1 657.68/мес. Делим: около 702 часов, то есть 96% месяца из 730 часов. Месячная скидка почти незаметна, если карта не работает без перерыва. RunPod просит за A100 $1.79/час, и за 730 часов это около $1 307. На этих ставках облако выходит дешевле, даже если его никогда не выключать.
- Почасовое облако подходит, когда вы обучаете или генерируете сериями, тестируете модель или нагрузка каждую неделю разная.
- Выделенный сервер имеет смысл, когда нужна стабильная машина с большим включённым трафиком (Cherry Servers пишет о 30–100 ТБ бесплатного исходящего трафика), фиксированный IP-адрес и диск, который никто не стирает. Или когда инференс-сервис работает круглосуточно месяцами.
- Если модель помещается в видеокарту вашего компьютера, аренда нужна только ради скорости. Сначала проверьте, хватает ли собственного железа.
VRAM решает почти всё
Модель либо помещается в видеопамять, либо нет. Варианта «медленнее, но работает» на одной карте не бывает. Документация RunPod даёт рабочее правило: около 2 ГБ VRAM на миллиард параметров в 16-битной точности. Это примерно 14 ГБ для модели на 7 млрд параметров, 26 ГБ для 13B и 140 ГБ для 70B, то есть несколько карт. Квантование снижает требования: 70B в 4-битном виде, по той же документации, помещается примерно в 35 ГБ.
Для картинок порог ниже. Там же у SDXL минимум около 8 ГБ, а для SDXL и Flux рекомендовано 16–24 ГБ с запасом под большие батчи и обучение LoRA. Для дообучения LLM советуют 40–80 ГБ (класс A100 или H100), и здесь важнее всего пропускная способность памяти.
Закладывайте запас. Контекстное окно и размер батча тоже едят память, так что модель, которая «едва влезла», упадёт на первом длинном промпте.
Какая карта под какую задачу
| GPU (VRAM) | RunPod, $/час | Подходит для |
|---|---|---|
| RTX 3090 (24 ГБ) | 0.50 | SDXL и Flux, LLM на 7B (≈14 ГБ), квантованные модели до 13B |
| RTX 4090 (24 ГБ) | 0.89 | те же задачи, но быстрее |
| L40S (48 ГБ) | 1.09 | более крупные квантованные LLM, большие батчи изображений, LoRA |
| A100 (80 ГБ) | 1.79 | дообучение 7B–13B, 70B в 4 бита (≈35 ГБ) |
| H100 SXM (80 ГБ) | 3.99 | обучение, инференс с высокой пропускной способностью |
| H200 (141 ГБ) | 5.29 | 70B в 16 бит впритык: сами веса ≈140 ГБ, на длинный контекст памяти мало |
Практическое правило: берите самую дешёвую карту, VRAM которой с запасом перекрывает вашу модель, и поднимайтесь выше, только когда видите ошибки out-of-memory или задача идёт слишком долго. Карта на 24 ГБ за $0.50–0.89 в час закрывает большинство вопросов любителя и небольшой команды.
Сколько стоит час: сравнение провайдеров
| Провайдер | Карты и цены | Оплата | Трафик | Кому подходит |
|---|---|---|---|---|
| RunPod | RTX 4090 24 ГБ — $0.89/час; A100 80 ГБ — $1.79/час; H100 SXM — $3.99/час | посекундно; для запуска нужен кредит примерно на час | за входящий и исходящий трафик не берут | эксперименты, дообучение, SD и Flux, Serverless-инференс |
| DigitalOcean | RTX 4000 Ada 20 ГБ — $0.76/час; L40S 48 ГБ — $1.57/час; H100 80 ГБ — $4.41/час; MI300X 192 ГБ — $2.59/час | посекундно, минимум 5 минут; выключенный Droplet тарифицируется | 10 000–15 000 ГиБ в тарифе, цена сверх лимита не указана | команды, у которых приложение уже на DigitalOcean |
| Cherry Servers | A2 16 ГБ — от $0.239/час; A40 48 ГБ — от $0.801/час; A100 80 ГБ — от $2.362/час | почасово, помесячно, годовые | 30–100 ТБ бесплатного исходящего трафика | выделенный GPU-сервер; на странице указана Литва, часть моделей — предзаказ или лист ожидания |
| Vultr | линейка Cloud GPU есть, страница цен не открылась, цифр не приводим | — | — | сравнивайте на живой странице; новым клиентам $300 кредита на 30 дней |
Два наблюдения. RunPod дешевле на картах одного класса: L40S там стоит $1.09/час против $1.57 у DigitalOcean, H100 — $3.99 против $4.41. Зато это платформа только для GPU, поэтому базу данных и веб-приложение придётся держать в другом месте. DigitalOcean дороже за час, но GPU Droplet живёт в том же аккаунте, сети и API, что и остальная инфраструктура. Cherry Servers — единственный из трёх, кто отдаёт целую физическую машину с большим трафиком. A40 и A100 на его странице помечены как предзаказ, так что наличие проверяйте до оплаты.
Community, Secure и spot: откуда берётся скидка
RunPod продаёт два облака. Secure Cloud работает в дата-центрах уровня T3/T4 с резервированием и годится для продакшна и чувствительных данных. Community Cloud — это машины сторонних владельцев: дешевле, но стабильность разная. RunPod пишет, что новых Community-хостов больше не принимает, имеющиеся ресурсы остаются. На странице цен есть переключатель Community/Secure, а скопированный нами список не подписывает, какой из них показан. Поэтому тариф выбирайте явно при запуске и смотрите ставку на экране развёртывания.
Второй источник скидок — spot, то есть машины, которые могут забрать. DigitalOcean предлагает spot только на самые новые карты для дата-центров (например, B300 за $6.17/час). Он старается предупредить минимум за два часа, но может забрать машину и с меньшим предупреждением или вовсе без него, а цену фиксирует при создании. Spot подходит для задач, которые сохраняют чекпоинты и продолжают с места остановки. Для демо клиенту он не годится.
- Community и spot: эксперименты, пакетная генерация, задачи с чекпоинтами.
- Secure и on-demand: клиентская работа, приватные данные, всё, что имеет дедлайн.
Скрытые расходы: диски, трафик, простой
- Диск. На RunPod диск контейнера стоит $0.10/ГБ в месяц и стирается, когда pod останавливается. Том (volume disk) — $0.10/ГБ в месяц при работе и $0.20/ГБ в остановленном состоянии. Network volume — $0.07/ГБ в месяц до 1 ТБ, и он не зависит от pod. Для 200 ГБ моделей это $20 в работе, $40 в остановленном состоянии или $14 на network volume.
- Трафик. По документации RunPod, платы за входящий и исходящий трафик нет. DigitalOcean включает 10 000–15 000 ГиБ в тариф GPU Droplet, но цену сверх лимита не указывает. Cherry Servers обещает 30–100 ТБ бесплатного исходящего трафика.
- Простой. DigitalOcean тарифицирует выключенный Droplet, потому что диск, CPU, RAM и IP остаются за вами, а счётчик останавливает только удаление. RTX 4090 за $0.89/час, забытая на выходные (48 часов), стоит около $43.
- Баланс. На RunPod для запуска нужен кредит примерно на час работы. Когда баланс доходит до $0, pod останавливаются, а те, что без network volume, удаляются вместе с данными, и восстановить их невозможно.
Пополняйте с запасом и держите веса и чекпоинты на network volume или во внешнем хранилище. Диск контейнера временный: остановка pod забирает его содержимое.
Чек-лист перед оплатой
- Запишите размер модели и точность, посчитайте VRAM (2 ГБ на миллиард параметров в 16 бит) и добавьте запас 20–30%.
- Возьмите самую маленькую карту, которой хватает, и дайте ей тестовый час.
- Определите тариф: Secure для клиентской работы, Community для экспериментов.
- Положите веса и чекпоинты на network volume или в объектное хранилище, а не на диск контейнера.
- Посмотрите цену диска в остановленном состоянии и условия на исходящий трафик.
- Поставьте напоминание или автовыключение и уведомление о балансе.
- Сначала пополните минимум. По нашей ссылке RunPod даёт новым пользователям бонус $5–500 кредита.
- Для сервиса, который должен работать постоянно, до релиза проверьте холодный старт: новый pod, загрузка весов, запуск.
Кому что выбрать
- RunPod: самый дешёвый час RTX 4090, A100 и H100 среди трёх сравнённых, готовые шаблоны (PyTorch, ComfyUI, Ollama) и Serverless для инференса. Минус: только GPU, а Community и Secure нужно различать самому.
- DigitalOcean: если приложение уже там и нужен GPU Droplet в одном аккаунте. За L40S и H100 дороже RunPod.
- Cherry Servers: выделенный GPU-сервер с большим трафиком и месячным контрактом. Проверяйте, какие модели действительно есть в наличии.
- Vultr: есть линейка Cloud GPU и $300 кредита новым клиентам, но страницу цен прочитать не удалось, так что сравнивайте на живой странице.
Считайте стоимость готового результата, а не часа. Карта, которая дешевле на $0.40, но падает на 90% прогона, обходится дороже той, что стоит больше и доходит до конца.
Игорь Джазов, редактор Tophosting
Итог
Для экспериментов, генерации картинок и дообучения начинайте с почасового облака на карте с 24–48 ГБ и считайте часы, а не месяцы. Выделенный сервер берите, когда GPU работает почти без пауз или нужны трафик и стабильный адрес. Если проекту GPU не нужен, хватит обычного VPS. Полный список GPU-облаков с бонусами для новых пользователей — в нашем рейтинге.
Частые вопросы
Сколько стоит аренда GPU в час?
По данным сайтов провайдеров, октябрь 2026: RunPod — RTX 3090 $0.50/час, RTX 4090 $0.89/час, A100 80 ГБ $1.79/час, H100 SXM $3.99/час; DigitalOcean — L40S $1.57/час, H100 $4.41/час; Cherry Servers — A100 от $2.362/час. Ставки меняются, поэтому перед оплатой откройте живую страницу.
Какое облако с GPU для нейросетей самое дешёвое?
Среди трёх страниц, которые мы сравнили, RunPod показывает самые низкие ставки на картах одного класса: L40S там $1.09/час против $1.57 у DigitalOcean. Страница не подписывает, Community это или Secure, поэтому ставку уточняйте на экране развёртывания.
Сколько VRAM нужно для Stable Diffusion и Flux?
Документация RunPod называет минимумом около 8 ГБ для SDXL и советует 16–24 ГБ для SDXL и Flux. Карта на 24 ГБ (RTX 3090, RTX 4090) — безопасный вариант с запасом под батчи и LoRA.
Почасовая аренда GPU или выделенный GPU-сервер?
Разделите месячную цену на часовую. Если вам нужно меньше часов, почасовая аренда дешевле. У Cherry Servers для A100 это около 702 часов из 730, так что месячный тариф выигрывает только при почти круглосуточной нагрузке.
Можно ли арендовать GPU с посекундной оплатой?
Да. RunPod тарифицирует Pods посекундно. DigitalOcean тоже посекундно, но с минимумом 5 минут, а выключенный Droplet тарифицируется до удаления.
Безопасно ли держать приватные данные в Community Cloud?
Документация RunPod советует Secure Cloud для продакшна и чувствительных данных: он работает в дата-центрах с резервированием. Community Cloud — машины сторонних владельцев с переменной надёжностью, его лучше оставить для экспериментов.
