为您的项目提供 GPU · 无 KYC 的加密货币支付 如何租用
简体中文
打开控制台
KERNODECK / VOTRE CONFIGURATION

L40S:为您的推理流水线提供 48 GB。

为您的推理流水线留出更多空间。Kernodeck 提供 NVIDIA L40S 48GB 租用,每颗 GPU 拥有 48 GB,可在 24 GB 显得过于紧张时容纳权重、输入和临时状态。1 批 1 颗 GPU、3 天为 63.43 USD,具体取决于您的应用是否兼容 Ada。

  • 单卡 48 GB
  • 根据您的 CUDA 栈选择 Ada
  • 按所选时长提供套餐
在 Kernodeck,此 GPU 租用流程无需身份证件,也不进行 KYC 流程。需要账户:名字、姓氏、邮箱和密码;这并不意味着匿名。 账户数据 ↗
您的周期预算

租赁 您的 GPU 可选 3、7 或 30 天。

每个价格涵盖整个周期内的 1 份完整套餐。 选择您的周期,然后在配置器中选择份数。

1 包含 GPUGDDR6 ECC
48每块显卡 GB

74 可用显卡.

所示显存为每块 GPU。选择时长,然后在配置器中选择批组数量。

3 jours

每批 1 块 GPU

US$63.43租用 3 jours

7 jours

每批 1 块 GPU

US$148.00租用 7 jours

30 jours

每批 1 块 GPU

US$520.00租用 30 jours

为整条流水线选择 L40S。

您的应用将模型与图像或视频结合,或为多个请求保留状态。如果整体可容纳于 48 GB,且您的库支持 Ada,L40S 就值得纳入选择。当瓶颈来自应用的内存分配,而不仅仅是模型权重时,这一容量便有了用武之地。

若要对比不同的输入格式和并发参数,7 天套餐为 1 批 1 颗 L40S、148.00 USD。在选定时长前,先明确这一系列测试的预期结果。您租用的是用于自身软件的 GPU 算力;交互式服务的管理及其延迟目标仍需由您的应用来确定。

在 24 GB 与 80 GB 之间定位您的需求。

如果您的完整应用可容纳于 24 GB,请对比 RTX 4090:在 Kernodeck 目录中,其套餐比 L40S 更便宜。L40S 额外的容量只有在您的场景确实用到时才有价值,例如用于输入或临时状态。

如果 48 GB 成为瓶颈,请考察每颗 GPU 80 GB 的 H100 SXM,以及您的依赖项是否兼容 Hopper。这一升级可以避免仅仅因为显存而进行拆分。但它并不能省去核算套餐费用和验证完整运行的过程。

用于区分

两个可对比的替代方案。

每份 7 天的预算。选择取决于您应用的内存和依赖项。

您的支付

您的套餐,可直接用加密货币支付。

直接使用加密货币支付您的 Kernodeck 租赁,无需强制充值:例如 Bitcoin 上的 BTC 和 Tron 上的 USDT(TRC-20)等。流程不要求身份证件或 KYC 程序;账户需要名字、姓氏、电子邮件和密码,不承诺匿名。

比较支持的八种资产和网络 ↗

对您的项目有用的条款

可用性. 74 个已申报批次。 各优惠中按型号申报的数量。这些数量不预留未来供应量,也不代表供应日期。若您的项目对此有要求,请在购买前确认托管国家和服务区域。

准备. Ubuntu、PyTorch、Blender 或定制需求。版本、CPU、RAM、存储、网络和访问方式需根据项目确认;它们的包含不能从 GPU 型号推断。

价格与条款. 金额以美元计,涵盖整个批次和全部周期。税务状态和可能的费用需在适用条款中确认。

阅读租赁条款 ↗
AVANT DE CHOISIR

此配置是否符合您的项目需求?

L40S 用于我的任务是怎样的价格?

一批包含 1 颗 48 GB 的 L40S。完整套餐为 3 天 63.43 USD、7 天 148.00 USD 或 30 天 520.00 USD。选择取决于您项目所需的时长,不应从价格推断出有保证的请求数量。

48 GB 是否让 L40S 适用于多模态应用?

当权重、预处理后的图像或视频以及临时状态能共同容纳于这一容量时,它便是候选方案。同时也要确认您的媒体库和 CUDA 栈。仅凭显存容量,无法说明解码时间或整条流水线的吞吐量。

是否应选择 L40S 而非 RTX 4090?

如果您的需求超过 24 GB 但仍在 48 GB 以内,应优先选择 L40S。如果您的应用已可容纳于 24 GB,RTX 4090 凭借更低的预算值得对比。之后再根据您自身应用的兼容性和实测结果来定。

我能否租用多颗 L40S 来获得一整块大显存?

每颗 L40S 各自保留其 48 GB。多个批次不会自动形成共享显存空间;您的软件必须显式地分配工作。如果您的首要需求是在单卡上突破 48 GB,请对比 80 GB 的方案,例如 H100 SXM。

为您的准备工作

从选择套餐到您的应用。

测试流水线,而不只是模型

对于多模态应用,请选取能代表你实际用法的文件:多样的格式、尺寸和时长。为读取、预处理、计算和导出分别计时。即便 GPU 很快完成自己的部分,解码或 CPU 转换环节也可能成为整体瓶颈。

同时也要明确什么算作有效输出:结果数量、格式、尺寸以及与输入的对应关系。这样你得到的将是有助于部署的度量,而不是孤立的计算耗时。

在 48 GB 中预留余量

除权重之外,还要为输入和临时状态留出空间。对于要处理多个请求的服务,请逐步提高并发量并观察内存峰值。请分别测试一个大文件和多个普通文件;这两种情况可能带来不同的约束。

请验证实际使用的 PyTorch/CUDA 技术栈及媒体库。L40S 不提供 NVLink:若要扩展多卡,请选择能够显式分配工作的软件,而不要假设内存可以合并。

根据应用路径来选型

如果你的模型和输入能放入 24 GB,L4 值得一试。RTX 6000 Ada 同样提供 48 GB,当你的项目同时涉及计算和可视化工具时,可以将其纳入比较。如果内存需求超出这一容量,请在增加切分复杂度之前先考察 80 GB 的选项。

用一个套餐来验证你的服务

用 3 天验证最小链路,用 7 天应对困难格式和并发测试,或用 30 天进行带归档配置的重复实验。请保留那些曾暴露错误的样例:它们将成为你的回归测试。

选择你的配置、批次和时长,然后填写订单信息。你自主管理自己的软件和处理流程;Kernodeck 不会查看你的文件、提示词或计算内容。加密转账完成后,通过“我已付款”进行确认。

以 Markdown 阅读本页 ↗