Запит «оренда GPU» видає десятки сторінок, де та сама карта коштує по-різному. Причина проста: годину відеокарти оцінюють за обсягом VRAM, типом хмари й тим, скільки часу машина лишається увімкненою, а значна частина рахунку ховається в дисках і простої. Нижче зібрано ціни з офіційних сторінок провайдерів і розібрано, як їх читати. Повний список GPU-платформ є в нашому рейтингу GPU для AI.
Про метод. 10 жовтня 2026 року ми відкрили сторінки цін RunPod, DigitalOcean і Cherry Servers та переписали ставки так, як вони там показані. Сторінка цін Vultr під час перевірки віддала помилку доступу, тому цифр Vultr тут немає. Швидкість карт ми не міряли: наш тест /tests вимірює TTFB публічних сайтів хостерів і про роботу GPU нічого не каже.
Ставки на GPU змінюються кілька разів на рік. Усі суми нижче — знімок за даними сайту провайдера, жовтень 2026. Перед поповненням балансу відкрийте живу сторінку цін.
Хмара по годинах чи виділений GPU-сервер
У хмарі по годинах ви запускаєте машину, платите за секунди чи години й видаляєте її, коли задача закінчилась. Виділений GPU-сервер — це ціла фізична машина в оренді на місяць і довше, а в деяких провайдерів і погодинно. Для більшості задач перший варіант дешевший, а арифметика вкладається в один рядок: розділіть місячну ціну на годинну, і вийде кількість годин, після якої місячний тариф починає вигравати.
Cherry Servers показує A100 80 ГБ від $2.362/год і від $1 657.68/міс. Ділимо: близько 702 годин, тобто 96% місяця з 730 годин. Місячна знижка майже непомітна, якщо карта не працює без перерви. RunPod просить за A100 $1.79/год, і за 730 годин це близько $1 307. На цих ставках хмара виходить дешевше, навіть якщо ніколи її не вимикати.
- Погодинна хмара підходить, коли ви навчаєте чи генеруєте серіями, тестуєте модель або навантаження щотижня різне.
- Виділений сервер має сенс, коли потрібна стабільна машина з великим включеним трафіком (Cherry Servers пише про 30–100 ТБ безкоштовного вихідного трафіку), фіксована IP-адреса й диск, який ніхто не стирає. Або коли інференс-сервіс працює цілодобово місяцями.
- Якщо модель влазить у відеокарту вашого комп'ютера, оренда потрібна лише заради швидкості. Спершу перевірте, чи вистачає власного заліза.
VRAM вирішує майже все
Модель або поміщається у відеопам'ять, або ні. Варіанта «повільніше, але працює» на одній карті не буває. Документація RunPod дає робоче правило: близько 2 ГБ VRAM на мільярд параметрів у 16-бітній точності. Це приблизно 14 ГБ для моделі на 7 млрд параметрів, 26 ГБ для 13B і 140 ГБ для 70B, тобто кілька карт. Квантування знижує вимоги: 70B у 4-бітному вигляді, за тією ж документацією, влізає приблизно в 35 ГБ.
Для картинок поріг нижчий. Там же SDXL має мінімум близько 8 ГБ, а для SDXL і Flux рекомендовано 16–24 ГБ із запасом під великі батчі й навчання LoRA. Для донавчання LLM радять 40–80 ГБ (клас A100 чи H100), і тут найбільше важить пропускна здатність пам'яті.
Закладайте запас. Контекстне вікно й розмір батча теж їдять пам'ять, тож модель, що «ледве влізла», впаде на першому довгому промпті.
Яка карта під яку задачу
| GPU (VRAM) | RunPod, $/год | Підходить для |
|---|---|---|
| RTX 3090 (24 ГБ) | 0.50 | SDXL і Flux, LLM на 7B (≈14 ГБ), квантовані моделі до 13B |
| RTX 4090 (24 ГБ) | 0.89 | ті самі задачі, але швидше |
| L40S (48 ГБ) | 1.09 | більші квантовані LLM, великі батчі зображень, LoRA |
| A100 (80 ГБ) | 1.79 | донавчання 7B–13B, 70B у 4 біти (≈35 ГБ) |
| H100 SXM (80 ГБ) | 3.99 | навчання, інференс з високою пропускною здатністю |
| H200 (141 ГБ) | 5.29 | 70B у 16 біт упритул: самі ваги ≈140 ГБ, на довгий контекст пам'яті мало |
Практичне правило: беріть найдешевшу карту, VRAM якої з запасом перекриває вашу модель, і підіймайтеся вище лише тоді, коли бачите помилки out-of-memory або задача триває надто довго. Карта на 24 ГБ за $0.50–0.89 на годину закриває більшість питань любителя й невеликої команди.
Скільки коштує година: порівняння провайдерів
| Провайдер | Карти і ціни | Оплата | Трафік | Кому підходить |
|---|---|---|---|---|
| RunPod | RTX 4090 24 ГБ — $0.89/год; A100 80 ГБ — $1.79/год; H100 SXM — $3.99/год | посекундно; для запуску потрібен кредит приблизно на годину | за вхідний і вихідний трафік не беруть | експерименти, донавчання, SD і Flux, Serverless-інференс |
| DigitalOcean | RTX 4000 Ada 20 ГБ — $0.76/год; L40S 48 ГБ — $1.57/год; H100 80 ГБ — $4.41/год; MI300X 192 ГБ — $2.59/год | посекундно, мінімум 5 хвилин; вимкнений Droplet тарифікується | 10 000–15 000 ГіБ у тарифі, ціна понад ліміт не вказана | команди, у яких застосунок уже на DigitalOcean |
| Cherry Servers | A2 16 ГБ — від $0.239/год; A40 48 ГБ — від $0.801/год; A100 80 ГБ — від $2.362/год | щогодини, щомісяця, щороку | 30–100 ТБ безкоштовного вихідного трафіку | виділений GPU-сервер; на сторінці вказана Литва, частина моделей — передзамовлення чи лист очікування |
| Vultr | лінійка Cloud GPU є, сторінка цін не відкрилася, цифр не наводимо | — | — | порівнюйте на живій сторінці; новим клієнтам $300 кредиту на 30 днів |
Два спостереження. RunPod дешевший на картах одного класу: L40S там коштує $1.09/год проти $1.57 у DigitalOcean, H100 — $3.99 проти $4.41. Зате це платформа лише для GPU, тож базу даних і веб-застосунок доведеться тримати деінде. DigitalOcean дорожчий за годину, але GPU Droplet живе в тому самому акаунті, мережі й API, що й решта інфраструктури. Cherry Servers — єдиний із трьох, хто віддає цілу фізичну машину з великим трафіком. A40 і A100 на його сторінці позначені як передзамовлення, тож наявність перевіряйте до оплати.
Community, Secure і spot: звідки береться знижка
RunPod продає дві хмари. Secure Cloud працює в дата-центрах рівня T3/T4 із резервуванням і годиться для продакшну та чутливих даних. Community Cloud — це машини сторонніх власників: дешевше, але стабільність різна. RunPod пише, що нових Community-хостів більше не приймає, наявні ресурси лишаються. На сторінці цін є перемикач Community/Secure, а скопійований нами список не підписує, який із них показано. Тому тариф обирайте явно під час запуску й дивіться ставку на екрані розгортання.
Друге джерело знижок — spot, тобто машини, які можуть забрати. DigitalOcean пропонує spot лише на найновіші карти для дата-центрів (наприклад, B300 за $6.17/год). Він прагне попереджати щонайменше за дві години, але може забрати машину і з меншим попередженням чи взагалі без нього, а ціну фіксує під час створення. Spot підходить для задач, що зберігають чекпоінти й продовжують із місця зупинки. Для демо клієнту він не годиться.
- Community і spot: експерименти, пакетна генерація, задачі з чекпоінтами.
- Secure та on-demand: клієнтська робота, приватні дані, усе, що має дедлайн.
Приховані витрати: диски, трафік, простій
- Диск. На RunPod диск контейнера коштує $0.10/ГБ на місяць і стирається, коли pod зупиняється. Том (volume disk) — $0.10/ГБ на місяць під час роботи й $0.20/ГБ у зупиненому стані. Network volume — $0.07/ГБ на місяць до 1 ТБ, і він не залежить від pod. Для 200 ГБ моделей це $20 у роботі, $40 у зупиненому стані або $14 на network volume.
- Трафік. За документацією RunPod, плати за вхідний і вихідний трафік немає. DigitalOcean включає 10 000–15 000 ГіБ у тариф GPU Droplet, але ціни понад ліміт не вказує. Cherry Servers обіцяє 30–100 ТБ безкоштовного вихідного трафіку.
- Простій. DigitalOcean тарифікує вимкнений Droplet, бо диск, CPU, RAM та IP лишаються за вами, а лічильник зупиняє тільки видалення. RTX 4090 за $0.89/год, забута на вихідні (48 годин), коштує близько $43.
- Баланс. На RunPod для запуску потрібен кредит приблизно на годину роботи. Коли баланс доходить до $0, pod зупиняються, а ті, що без network volume, видаляються разом з даними, і відновити їх неможливо.
Поповнюйте з запасом і тримайте ваги та чекпоінти на network volume або в зовнішньому сховищі. Диск контейнера тимчасовий: зупинка pod забирає його вміст.
Чек-лист перед оплатою
- Запишіть розмір моделі й точність, порахуйте VRAM (2 ГБ на мільярд параметрів у 16 біт) і додайте запас 20–30%.
- Візьміть найменшу карту, якої вистачає, і дайте їй тестову годину.
- Визначте тариф: Secure для клієнтської роботи, Community для експериментів.
- Покладіть ваги й чекпоінти на network volume чи в об'єктне сховище, а не на диск контейнера.
- Подивіться ціну диска в зупиненому стані та умови на вихідний трафік.
- Поставте нагадування чи автовимкнення і сповіщення про баланс.
- Спершу поповніть мінімум. За нашим посиланням RunPod дає новим користувачам бонус $5–500 кредиту.
- Для сервісу, що має працювати постійно, до релізу перевірте холодний старт: новий pod, завантаження ваг, запуск.
Кому що обрати
- RunPod: найдешевша година RTX 4090, A100 і H100 серед трьох порівняних, готові шаблони (PyTorch, ComfyUI, Ollama) і Serverless для інференсу. Мінус: лише GPU, а Community із Secure треба розрізняти самому.
- DigitalOcean: якщо застосунок уже там і потрібен GPU Droplet в одному акаунті. За L40S і H100 дорожчий за RunPod.
- Cherry Servers: виділений GPU-сервер з великим трафіком і місячним контрактом. Перевіряйте, які моделі справді є в наявності.
- Vultr: має лінійку Cloud GPU і $300 кредиту новим клієнтам, але сторінку цін прочитати не вдалося, тож порівнюйте на живій сторінці.
Рахуйте вартість готового результату, а не години. Карта, що дешевша на $0.40, але падає на 90% прогону, обходиться дорожче за ту, що коштує більше й доходить до кінця.
Ігор Джазов, редактор Tophosting
Підсумок
Для експериментів, генерації картинок і донавчання починайте з погодинної хмари на карті з 24–48 ГБ і рахуйте години, а не місяці. Виділений сервер беріть, коли GPU працює майже без пауз або потрібні трафік і стабільна адреса. Якщо проєкту GPU не потрібен, вистачить звичайного VPS. Повний список GPU-хмар з бонусами для нових користувачів — у нашому рейтингу.
Часті питання
Скільки коштує оренда GPU за годину?
За даними сайтів провайдерів, жовтень 2026: RunPod — RTX 3090 $0.50/год, RTX 4090 $0.89/год, A100 80 ГБ $1.79/год, H100 SXM $3.99/год; DigitalOcean — L40S $1.57/год, H100 $4.41/год; Cherry Servers — A100 від $2.362/год. Ставки змінюються, тож перед оплатою відкрийте живу сторінку.
Яка найдешевша хмара з GPU для нейромереж?
Серед трьох сторінок, які ми порівняли, RunPod показує найнижчі ставки на картах одного класу: L40S там $1.09/год проти $1.57 у DigitalOcean. Сторінка не підписує, Community це чи Secure, тому ставку уточнюйте на екрані розгортання.
Скільки VRAM потрібно для Stable Diffusion і Flux?
Документація RunPod називає мінімумом близько 8 ГБ для SDXL і радить 16–24 ГБ для SDXL та Flux. Карта на 24 ГБ (RTX 3090, RTX 4090) — безпечний варіант із запасом під батчі та LoRA.
Погодинна оренда GPU чи виділений GPU-сервер?
Розділіть місячну ціну на годинну. Якщо вам потрібно менше годин, погодинна оренда дешевша. У Cherry Servers для A100 це близько 702 годин із 730, тож місячний тариф виграє лише за майже цілодобового навантаження.
Чи можна орендувати GPU з посекундною оплатою?
Так. RunPod тарифікує Pods посекундно. DigitalOcean теж посекундно, але з мінімумом 5 хвилин, і вимкнений Droplet тарифікується до видалення.
Чи безпечно тримати приватні дані в Community Cloud?
Документація RunPod радить Secure Cloud для продакшну та чутливих даних: він працює в дата-центрах із резервуванням. Community Cloud — це машини сторонніх власників зі змінною надійністю, його краще залишити для експериментів.
