GPU服务器租用 · 微调与适配 · GR-L40S
锐算 L40S 显卡租用 · 48GB 显存
48 GB 专业卡,带 ECC 显存:长时间微调与需要稳定性的生产推理。
要点
锐算 L40S 的配置与价格
安云主机 锐算 L40S 显卡租用(GR-L40S)配备 NVIDIA L40S,单卡显存 48 GB,搭配 24 vCPU 与 128 GB 内存,含 1000 GB 数据盘。按小时计费 $1.15/小时,月租 $559,从预付余额扣除,关机不计算力费用。购买无需实名认证,支持 USDT 等加密货币充值,预装 PyTorch 与 CUDA 深度学习环境。48 GB 专业卡,带 ECC 显存:长时间微调与需要稳定性的生产推理。
显存能放下什么
48GB 显存能放下多大的模型
- 70B 模型 4-bit 量化推理 —— 权重约 42 GB,上下文长度需要节制
- 32B 模型 8-bit 量化推理 —— 权重约 32 GB
- 13B 模型 FP16 推理 —— 权重约 26 GB,上下文余量充足
- 13B 模型 LoRA 微调 —— FP16 底座约 26 GB,梯度只作用于低秩矩阵
- 32B 模型 QLoRA 微调 —— 4-bit 底座约 19 GB
- 需要长时间稳定运行的生产推理服务
技术规格
- 显卡型号
- NVIDIA L40S
- 显卡数量
- 1 张
- 单卡显存
- 48 GB
- 卡间互联
- 单卡,不适用
- vCPU
- 24 核
- 内存
- 128 GB
- 系统盘
- 100 GB NVMe
- 数据盘
- 1000 GB NVMe
- 端口速率
- 1 Gbps
- 型号
- GR-L40S
已知限制
这张卡在推理、微调与训练上的边界
- 显存带宽低于 4090(GDDR6 对 GDDR6X),在逐 token 解码、纯出图这类受带宽约束的任务上,单卡吞吐不一定占优 —— 这张卡的价值是 48 GB 显存与 ECC,不是绝对速度。
- 不支持 NVLink,多卡训练的扩展性有限。
- 全参数微调放不进 48 GB:混合精度加 Adam 约需每参数 16 字节,13B 就要约 208 GB。这张卡上的微调手段是 LoRA 与 QLoRA。
可选机房
算力节点 · 1 个机房
| 机房 | 最佳回程 | 延迟 |
|---|---|---|
| 法兰克福 FRA | AS4837 普通线路 | 255 ms |
GPU 任务对延迟不敏感 —— 训练与推理都在机房内完成,延迟只影响你连接终端与传输数据的体验。
预装镜像
常见问题
关于 锐算 L40S 租用与计费
锐算 L40S 适合做什么?
48 GB 专业卡,带 ECC 显存:长时间微调与需要稳定性的生产推理。 具体可以跑:70B 模型 4-bit 量化推理 —— 权重约 42 GB,上下文长度需要节制、32B 模型 8-bit 量化推理 —— 权重约 32 GB、13B 模型 FP16 推理 —— 权重约 26 GB,上下文余量充足、13B 模型 LoRA 微调 —— FP16 底座约 26 GB,梯度只作用于低秩矩阵、32B 模型 QLoRA 微调 —— 4-bit 底座约 19 GB、需要长时间稳定运行的生产推理服务。
锐算 L40S 有什么限制?
显存带宽低于 4090(GDDR6 对 GDDR6X),在逐 token 解码、纯出图这类受带宽约束的任务上,单卡吞吐不一定占优 —— 这张卡的价值是 48 GB 显存与 ECC,不是绝对速度。 不支持 NVLink,多卡训练的扩展性有限。 全参数微调放不进 48 GB:混合精度加 Adam 约需每参数 16 字节,13B 就要约 208 GB。这张卡上的微调手段是 LoRA 与 QLoRA。
锐算 L40S 一次任务大概多少钱?
按 $1.15/小时计:跑通一个 Demo 约 1 小时 $1.15,一次 LoRA 微调约 4 小时 $4.60,一整个工作日 8 小时 $9.20。按小时取整,不足一小时按一小时计,关机后不再收取算力费用。
开通需要多久?需要实名吗?
充值到账后即可创建实例,通常一到两分钟内可以连接。不需要实名认证,一个可收信的邮箱即可,充值使用加密货币。
余额用完数据会丢吗?
余额归零时实例自动关机并保留 72 小时,数据不删除。72 小时内充值即可原样开机。