[参考页面](<https://kernodeck.com/zh/compute/l40s>)

# L40S：为您的推理流水线提供 48 GB。

为您的推理流水线留出更多空间。Kernodeck 提供 NVIDIA L40S 48GB 租用，每颗 GPU 拥有 48 GB，可在 24 GB 显得过于紧张时容纳权重、输入和临时状态。1 批 1 颗 GPU、3 天为 63.43 USD，具体取决于您的应用是否兼容 Ada。

- 单卡 48 GB
- 根据您的 CUDA 栈选择 Ada
- 按所选时长提供套餐

[Configurer L40S · 7 天](<https://kernodeck.com/zh/compute/configure?config=l40s&days=7>)

在 Kernodeck，此 GPU 租用流程无需身份证件，也不进行 KYC 流程。需要账户：名字、姓氏、邮箱和密码；这并不意味着匿名。

Location NVIDIA L40S 48GB

让您的应用运行在拥有 48 GB 显存预算的显卡上。

## 关键信息

| 信息 | 详情 |
| --- | --- |
| 您的配置 | NVIDIA L40S 48GB ： 1 个批次，共 1 GPU, 48 GB 每 GPU。 |
| 您的套餐 | 3 天： 63.43 USD ; 7 天： 148.00 USD ; 30 天： 520.00 USD. 整个批次的美元价格，包含其全部显卡。 |
| 可用性 | 74 个已申报批次。 各优惠中按型号申报的数量。这些数量不预留未来供应量，也不代表供应日期。若您的项目对此有要求，请在购买前确认托管国家和服务区域。 |
| 无需 KYC | 在 Kernodeck，此 GPU 租用流程无需身份证件，也不进行 KYC 流程。需要账户：名字、姓氏、邮箱和密码；这并不意味着匿名。 |
| 准备 | Ubuntu、PyTorch、Blender 或定制需求。版本、CPU、RAM、存储、网络和访问方式需根据项目确认；它们的包含不能从 GPU 型号推断。 |
| 价格与条款 | 金额以美元计，涵盖整个批次和全部周期。税务状态和可能的费用需在适用条款中确认。 |

## 可用套餐

一批、整个周期的美元总价。显存按每块 GPU 计；申报库存按批计。

| 型号 | 每块 GPU 显存 | 每批 GPU 数 | 时长 | 批数 | 总价 | 申报库存（按批计） | 状态 | 配置 |
| --- | --- | --- | --- | --- | --- | --- | --- | --- |
| [NVIDIA L40S 48GB](<https://kernodeck.com/zh/compute/l40s>) | 48 Go | 1 | 3 天 | 1 | 63.43 USD | 74 | 完整批次时长 3 jours. | [配置此套餐](<https://kernodeck.com/zh/compute/configure?config=l40s&days=3>) |
| [NVIDIA L40S 48GB](<https://kernodeck.com/zh/compute/l40s>) | 48 Go | 1 | 7 天 | 1 | 148.00 USD | 74 | 完整批次时长 7 jours. | [配置此套餐](<https://kernodeck.com/zh/compute/configure?config=l40s&days=7>) |
| [NVIDIA L40S 48GB](<https://kernodeck.com/zh/compute/l40s>) | 48 Go | 1 | 30 天 | 1 | 520.00 USD | 74 | 完整批次时长 30 jours. | [配置此套餐](<https://kernodeck.com/zh/compute/configure?config=l40s&days=30>) |
| [NVIDIA GeForce RTX 4090 24GB](<https://kernodeck.com/zh/compute/rtx-4090>) | 24 Go | 1 | 7 天 | 1 | 110.00 USD | 265 | 对比 7 天预算与每卡显存。 | [配置此套餐](<https://kernodeck.com/zh/compute/configure?config=rtx-4090&days=7>) |
| [NVIDIA H100 SXM 80GB](<https://kernodeck.com/zh/compute/h100-sxm>) | 80 Go | 1 | 7 天 | 1 | 475.00 USD | 63 | 对比 7 天预算与每卡显存。 | [配置此套餐](<https://kernodeck.com/zh/compute/configure?config=h100-sxm&days=7>) |

## 为整条流水线选择 L40S。

您的应用将模型与图像或视频结合，或为多个请求保留状态。如果整体可容纳于 48 GB，且您的库支持 Ada，L40S 就值得纳入选择。当瓶颈来自应用的内存分配，而不仅仅是模型权重时，这一容量便有了用武之地。

若要对比不同的输入格式和并发参数，7 天套餐为 1 批 1 颗 L40S、148.00 USD。在选定时长前，先明确这一系列测试的预期结果。您租用的是用于自身软件的 GPU 算力；交互式服务的管理及其延迟目标仍需由您的应用来确定。

- [配置 7 天的 L40S](<https://kernodeck.com/zh/compute/configure?config=l40s&days=7>)
- [对比批量推理与交互式推理](<https://kernodeck.com/zh/usages/inference>)
- [观测我的处理流水线](<https://kernodeck.com/zh/docs/observer-un-lancement>)

## 在 24 GB 与 80 GB 之间定位您的需求。

如果您的完整应用可容纳于 24 GB，请对比 RTX 4090：在 Kernodeck 目录中，其套餐比 L40S 更便宜。L40S 额外的容量只有在您的场景确实用到时才有价值，例如用于输入或临时状态。

如果 48 GB 成为瓶颈，请考察每颗 GPU 80 GB 的 H100 SXM，以及您的依赖项是否兼容 Hopper。这一升级可以避免仅仅因为显存而进行拆分。但它并不能省去核算套餐费用和验证完整运行的过程。

- [回到 24 GB，选择 RTX 4090](<https://kernodeck.com/zh/compute/rtx-4090>)
- [考察 H100 SXM 的 80 GB](<https://kernodeck.com/zh/compute/h100-sxm>)
- [对比三种容量的预算](<https://kernodeck.com/zh/pricing>)

## 您的套餐，可直接用加密货币支付。

直接使用加密货币支付您的 Kernodeck 租赁，无需强制充值：例如 Bitcoin 上的 BTC 和 Tron 上的 USDT（TRC-20）等。流程不要求身份证件或 KYC 程序；账户需要名字、姓氏、电子邮件和密码，不承诺匿名。

- [对比八种支持的资产与网络](<https://kernodeck.com/zh/docs/crypto-payments>)

## 测试流水线，而不只是模型

对于多模态应用，请选取能代表你实际用法的文件：多样的格式、尺寸和时长。为读取、预处理、计算和导出分别计时。即便 GPU 很快完成自己的部分，解码或 CPU 转换环节也可能成为整体瓶颈。

同时也要明确什么算作有效输出：结果数量、格式、尺寸以及与输入的对应关系。这样你得到的将是有助于部署的度量，而不是孤立的计算耗时。

## 在 48 GB 中预留余量

除权重之外，还要为输入和临时状态留出空间。对于要处理多个请求的服务，请逐步提高并发量并观察内存峰值。请分别测试一个大文件和多个普通文件；这两种情况可能带来不同的约束。

请验证实际使用的 PyTorch/CUDA 技术栈及媒体库。L40S 不提供 NVLink：若要扩展多卡，请选择能够显式分配工作的软件，而不要假设内存可以合并。

## 根据应用路径来选型

如果你的模型和输入能放入 24 GB，L4 值得一试。RTX 6000 Ada 同样提供 48 GB，当你的项目同时涉及计算和可视化工具时，可以将其纳入比较。如果内存需求超出这一容量，请在增加切分复杂度之前先考察 80 GB 的选项。

## 用一个套餐来验证你的服务

用 3 天验证最小链路，用 7 天应对困难格式和并发测试，或用 30 天进行带归档配置的重复实验。请保留那些曾暴露错误的样例：它们将成为你的回归测试。

选择你的配置、批次和时长，然后填写订单信息。你自主管理自己的软件和处理流程；Kernodeck 不会查看你的文件、提示词或计算内容。加密转账完成后，通过“我已付款”进行确认。

## 购买前的问题

### L40S 用于我的任务是怎样的价格？

一批包含 1 颗 48 GB 的 L40S。完整套餐为 3 天 63.43 USD、7 天 148.00 USD 或 30 天 520.00 USD。选择取决于您项目所需的时长，不应从价格推断出有保证的请求数量。

### 48 GB 是否让 L40S 适用于多模态应用？

当权重、预处理后的图像或视频以及临时状态能共同容纳于这一容量时，它便是候选方案。同时也要确认您的媒体库和 CUDA 栈。仅凭显存容量，无法说明解码时间或整条流水线的吞吐量。

### 是否应选择 L40S 而非 RTX 4090？

如果您的需求超过 24 GB 但仍在 48 GB 以内，应优先选择 L40S。如果您的应用已可容纳于 24 GB，RTX 4090 凭借更低的预算值得对比。之后再根据您自身应用的兼容性和实测结果来定。

### 我能否租用多颗 L40S 来获得一整块大显存？

每颗 L40S 各自保留其 48 GB。多个批次不会自动形成共享显存空间；您的软件必须显式地分配工作。如果您的首要需求是在单卡上突破 48 GB，请对比 80 GB 的方案，例如 H100 SXM。

## 选择与配置

- [组织你的服务的请求](<https://kernodeck.com/zh/usages/inference>)
- [观察整个处理链路](<https://kernodeck.com/zh/docs/observer-un-lancement>)
- [与 L4 的 24 GB 进行比较](<https://kernodeck.com/zh/compute/l4>)
- [考察 RTX 6000 Ada](<https://kernodeck.com/zh/compute/rtx-6000-ada>)
- [比较 GPU 套餐](<https://kernodeck.com/zh/pricing>)
- [八种支持的加密货币组合](<https://kernodeck.com/zh/docs/crypto-payments>)
