GPU для ваших проєктів · оплата криптою без KYC Як орендувати
Українська
Відкрити консоль
KERNODECK / VOTRE APPLICATION

Виберіть GPU для вашого застосунку інференсу.

Пакетні ембеддинги, класифікація зображень чи інтерактивний застосунок: орендуйте в Kernodeck GPU, що підходить для вашого власного інференсу. Почніть із RTX 4090 на 24 ГБ за 110,00 USD для лота з 1 GPU на 7 днів. Виберіть обсяг відповідно до виміряної пам'яті та вашого стеку CUDA; підготовка й експлуатація застосунку залишаються за вами.

  • Пакетна чи інтерактивна обробка
  • Три бюджети на 7 днів
  • Ваш рушій і ваші налаштування
У Kernodeck у цьому процесі оренди GPU не потрібно ні документа, що посвідчує особу, ні процедури KYC. Потрібен обліковий запис: ім'я, прізвище, email і пароль; це не означає анонімності. Дані акаунта ↗
ТРИ КОНФІГУРАЦІЇ · ОДИН ТИЖДЕНЬ

Прив'яжіть своє навантаження до конкретного бюджету.

Модель, вхідні дані, тимчасова пам'ять і паралелізм визначають вибір. Версії та доступ, потрібні вашому застосунку, слід уточнити.

7 ДНІВ · 1 ЛОТ

NVIDIA L40S 48GB

48 Go за GPU · 1 GPU включено

Для дослідження інтерактивного або мультимодального навантаження з 48 ГБ на карту.

148,00 USDза весь лот і 7 joursНалаштувати цей тариф ↗

Для пакетної обробки: від потреби до тарифу

Хочете створити ембеддинги для колекції документів або класифікувати набір зображень? RTX 4090 — кандидат за 110,00 USD для лота з 1 GPU на 24 ГБ на 7 днів, якщо ваш конвеєр CUDA вміщається в цю пам'ять разом із вхідними даними, тимчасовими буферами та виміряним запасом. Цей тариф окреслює ваш бюджет на обладнання; ви визначаєте кількість файлів, правило відновлення та результати, які слід зберегти.

Якщо пік пам'яті вашого оброблення перевищує цю ємність, порівняйте L40S: 148,00 USD за пакет з 1 GPU на 48 ГБ на 7 днів. Вона дає більше простору на карту для виміряного вами навантаження. Вибір між ними стосується цієї ємності та сумісності вашого програмного стеку, а не обіцяного обсягу документів.

Для незалежних розділів B200 пропонує іншу організацію: 2 071,00 USD за пакет із 2 GPU по 180 ГБ кожен на 7 днів, причому обидві карти вже включено в цю ціну. Порівняйте цей варіант, якщо ваш застосунок уміє розподіляти оброблення між кількома воркерами. Він не перетворює дві пам'яті на єдиний простір обсягом 360 ГБ.

Для інтерактивного застосунку: оберіть пам'ять для всього вашого навантаження

Асистент або внутрішній інструмент має враховувати одночасні запити, їхню довжину та кеші, властиві рушію. L40S за 148,00 USD для пакета з 1 GPU на 48 ГБ на 7 днів є кандидатом, якщо це повне навантаження вміщується в її пам'ять і якщо ваш рушій підтримує її ланцюжок CUDA. Ваш вимір черги та відповідей залишається критерієм для вибору конфігурації.

Якщо вам потрібно більше пам'яті на одній карті, порівняйте H100 SXM: 475,00 USD за пакет з 1 GPU на 80 ГБ на 7 днів. Він додає ємності на кожен GPU; цього недостатньо, щоб гарантувати затримку чи пропускну здатність вашого застосунку. Якщо ваша потреба вже вміщується у 24 ГБ, RTX 4090 варто порівняти, перш ніж брати дорожчий тариф.

Ця пропозиція — це оренда GPU для вашого застосунку. Керований API інференсу є іншою категорією сервісу: він може підійти, якщо ви насамперед шукаєте готову точку виклику. У Kernodeck передбачайте власний рушій, його залежності та його експлуатацію; підготовку та умови доступу, необхідні для вашого проєкту, слід уточнити перед вибором середовища.

ВАША ОПЛАТА

Ваш тариф, який можна оплатити безпосередньо в криптовалюті.

Оплачуйте оренду Kernodeck безпосередньо в криптовалюті, без обов'язкового поповнення: зокрема BTC у мережі Bitcoin та USDT у мережі Tron (TRC-20). Процес не вимагає документа, що посвідчує особу, чи процедури KYC; потрібен акаунт з ім'ям, прізвищем, email та паролем, без обіцянки анонімності.

Порівняти вісім прийнятих активів і мереж ↗

Умови, важливі для вашого проєкту

Доступність. Заявлені кількості за моделями в пропозиціях. Вони не резервують майбутню доступність чи дату надання. Країну хостингу та регіон обслуговування потрібно підтвердити перед покупкою, якщо ваш проєкт їх вимагає.

Підготовка. Ubuntu, PyTorch, Blender або індивідуальний запит. Версії, CPU, RAM, сховище, мережу та спосіб доступу потрібно підтвердити відповідно до проєкту; їхню наявність не можна виводити з моделі GPU.

Ціни та умови. Суми в USD за лот і весь період. Податковий статус і можливі збори потрібно підтвердити в застосовних умовах.

Читати умови оренди ↗
AVANT DE CHOISIR

Яку конфігурацію орендувати для вашого інференсу?

Який тариф обрати для першого оброблення інференсу?

Якщо ваш конвеєр CUDA та репрезентативний батч вміщуються у 24 ГБ із виміряним запасом, почніть порівняння з RTX 4090: 110,00 USD за пакет з 1 GPU на 7 днів. Тариф охоплює цей період оренди, не фіксуючи кількість файлів, які зможе обробити ваш застосунок. Закладіть у свій план встановлення, перевірку результатів і експорт; тарифи на 3 і 30 днів дають змогу обрати інший період.

Коли платити більше за L40S або H100 SXM?

Порівняйте L40S на 48 ГБ, коли повне навантаження перевищує доступний запас на 24 ГБ, а потім H100 SXM на 80 ГБ, якщо шукаєте більше пам'яті на одній карті. Тарифи на 7 днів коштують відповідно 148,00 USD та 475,00 USD, кожен за пакет з 1 GPU. Включіть у свій вимір модель, вхідні дані, тимчасові файли та кеші; більша ємність сама по собі не гарантує кращої відповіді для вашого застосунку.

Чи включає оренда готовий до виклику API інференсу?

Пропозиція, представлена тут, — це оренда GPU для вашого власного застосунку, і вона не включає керований API інференсу, заявлений як готовий до виклику. Ви обираєте рушій, моделі, залежності та налаштування, а потім організовуєте їхню експлуатацію. Якщо ваш пріоритет — керований сервіс, порівняйте цю категорію пропозицій окремо. Щоб орендувати в Kernodeck, уточніть підготовку та умови доступу, потрібні для вашого проєкту.

Чи є B200 логічним вибором для кількох одночасних оброблень?

Він стає варіантом для розгляду, якщо ваш застосунок може доручити незалежні розділи кільком воркерам або підтримує явний розподіл. За 2 071,00 USD на 7 днів пакет B200 вже містить 2 GPU по 180 ГБ кожен. Пам'ять не об'єднується автоматично; розподілена модель вимагає стратегії, сумісної з вашим рушієм. Також порівняйте вартість однієї карти, якщо її достатньо для запланованого навантаження.

ЩОБ ПІДГОТУВАТИ ВАШУ РОБОТУ

Від вибору тарифу до вашого застосунку.

Перевірити вхідні дані та час відповіді

Перевірити дані до GPUПеревіряти типи, форми та значення, щоб ізолювати некоректні входи.Профілювати крок PyTorchОбмежити вимірювання й читати трасування CPU/GPU без поспішних висновків.

Визначте результат, який виправдовує вашу оренду

Для обробки файлів визначте обсяг, який потрібно опрацювати, формат виведення та правило відновлення. Завершений файл має розпізнаватися без повторного перечитування всього виконання. Для інтерактивного сервісу визначте максимальний розмір запитів, прийнятний час очікування та поведінку в разі досягнення межі потужності. Одна й та сама модель може вимагати двох дуже різних організацій залежно від цих обмежень.

Зберігайте репрезентативну вибірку з короткими, звичайними та близькими до ваших меж випадками. У конвеєрі ембедингів пов'язуйте кожен вектор з ідентифікатором і версією його вхідних даних. У генерації тексту записуйте параметри генерації, використані для оцінювання. Ви маєте бути здатні пояснити різницю в результаті, не приписуючи її одразу GPU.

Оберіть пам'ять для всього навантаження інференсу

Вага файлів моделі не описує всю пам'ять, яка використовується під час інференсу. Потрібно також враховувати тимчасові тензори, вхідні дані, збережені вихідні дані та, для відповідних моделей, кеш ключів і значень уваги. Цей кеш може ставати значним, коли послідовності подовжуються або коли кілька запитів обробляються разом.

Почніть із карти, обсяг пам'яті якої дозволяє виконати ваш репрезентативний тест із виміряним запасом. Моделі на 24, 32, 48, 80 ГБ і більше відповідають різним потребам; жодна ємність не гарантує, що конкретна модель пройде з усіма своїми налаштуваннями. Зниження точності чи квантизація можуть змінити обсяг пам'яті, але вимагають перевірки підтримки програмним забезпеченням і якості вихідних даних на ваших власних вхідних даних.

Виберіть GPU, сумісний з вашим програмним стеком

Складіть список рушія інференсу, його особливих операторів і розширень, від яких ви залежите, перш ніж обирати апаратне забезпечення. Застосунок PyTorch може пропонувати кілька шляхів виконання, тоді як спеціалізоване розширення підтримує лише один. Перевірте весь ланцюжок на CUDA для NVIDIA або на ROCm для AMD, включно із завантаженням моделі та її попередньою обробкою.

Залиште мінімальну команду, яка проходить конвеєр аж до запису результату. І лише потім вмикайте оптимізації одну за одною. Кожна зміна точності, компіляції чи рушія має зберігати порівнянний контроль якості. Успішне завантаження доводить, що ваги читаються; воно не доводить, що всі потрібні шляхи обчислень працюють.

Налаштуйте batch відповідно до мети обробки

Приклад методу: складіть три групи текстів за довжиною, а потім обробіть кожну з пакетом у 1, 2 та 4 вхідні дані. Ці розміри слугують точками тестування, а не універсальною рекомендацією. Для кожної комбінації записуйте завершені вхідні дані, загальний час, спостережуваний максимум пам'яті та помилки. Зупиняйте прогрес, коли з'являється межа, замість того щоб приховувати невдачі в середньому значенні.

Для інтерактивного сервісу додайте час, проведений у черзі очікування. Більший пакет може змінити пропускну здатність і час очікування, який відчуває запит; одного середнього значення недостатньо для вибору. Для офлайн-обробки переконайтеся, що групування не змішує порядок результатів. Зрештою оберіть конфігурацію, яка відповідає вашому критерію якості та обмеженню часу очікування.

Переходьте на кілька GPU, якщо ваш застосунок уміє розподіляти роботу

Якщо кожен примірник моделі вміщується на одній карті, ви можете організувати кількох працівників, які споживають окремі розділи вхідних даних. Тоді потрібно координувати ідентифікатори, відновлення та збір вихідних даних. Якщо модель потрібно розподілити між картами, використовуйте стратегію паралелізму, підтримувану вашим рушієм, і перевірте її вимоги до зв'язку.

Замовлені партії описують кількість обладнання, а не прикладний батч чи об'єднаний простір пам'яті. Для B200 одна партія містить дві карти; для інших пропозицій одна партія містить одну карту. Зазначте у своїй заявці заплановану кількість воркерів, частку вхідних даних, довірену кожному з них, і спосіб переконатися, що роботу справді завершено.

Оберіть період, що охоплює перевірки та експорт

Для першої оренди на 3 дні окресліть обмежену мету: встановити, перевірити конвеєр і отримати перший придатний до використання результат. Тривалість 7 днів може стати в нагоді, щоб перебрати більше варіантів; 30 днів — щоб повторювати обробку та закріпити її використання. Це способи організувати роботу, а не обіцянки щодо часу виконання.

На виході зберігайте ваги або їхню версію, конфігурацію, перевірки якості, фактично отримані показники та експортовані результати. Ви самостійно обираєте програмне забезпечення та способи обробки; Kernodeck не перевіряє їхній вміст. Самостійно підготуйте доступи, резервні копії та дозволи, необхідні для використання моделей і даних.

Читати цю сторінку в Markdown ↗