GPU服务器租用 · 推理与出图 · GR-4090
锐算 4090 显卡租用 · 24GB 显存
性价比最高的通用卡:中小模型推理、Stable Diffusion 出图、LoRA 微调。
要点
锐算 4090 的配置与价格
安云主机 锐算 4090 显卡租用(GR-4090)配备 RTX 4090,单卡显存 24 GB,搭配 16 vCPU 与 64 GB 内存,含 500 GB 数据盘。按小时计费 $0.45/小时,月租 $219,从预付余额扣除,关机不计算力费用。购买无需实名认证,支持 USDT 等加密货币充值,预装 PyTorch 与 CUDA 深度学习环境。性价比最高的通用卡:中小模型推理、Stable Diffusion 出图、LoRA 微调。
显存能放下什么
24GB 显存能放下多大的模型
- 7B 模型 FP16 推理 —— 权重约 14 GB,余量留给上下文缓存
- 13B 模型 8-bit 量化推理 —— 权重约 13 GB
- 32B 模型 4-bit 量化推理 —— 权重约 19 GB,上下文长度需要节制
- 7B 模型 LoRA 与 QLoRA 微调
- SDXL 出图与 SDXL LoRA 训练
- Flux 出图 —— 需使用 8-bit 或 4-bit 量化权重
- Whisper 语音转写与 YOLO 目标检测
技术规格
- 显卡型号
- RTX 4090
- 显卡数量
- 1 张
- 单卡显存
- 24 GB
- 卡间互联
- 单卡,不适用
- vCPU
- 16 核
- 内存
- 64 GB
- 系统盘
- 100 GB NVMe
- 数据盘
- 500 GB NVMe
- 端口速率
- 1 Gbps
- 型号
- GR-4090
已知限制
这张卡在推理、微调与训练上的边界
- 24 GB 是硬上限:13B 模型 FP16 权重约 26 GB 就已经放不下,70B 即使 4-bit 量化也要约 42 GB。这两档请看 32 GB 与 80 GB 配置。
- 消费级卡不支持 NVLink,多卡场景的卡间带宽受 PCIe 限制,不适合张量并行训练。
- ECC 显存不可用,长时间训练遇到显存位翻转的风险高于专业卡。
可选机房
算力节点 · 2 个机房
GPU 任务对延迟不敏感 —— 训练与推理都在机房内完成,延迟只影响你连接终端与传输数据的体验。
预装镜像
常见问题
关于 锐算 4090 租用与计费
锐算 4090 适合做什么?
性价比最高的通用卡:中小模型推理、Stable Diffusion 出图、LoRA 微调。 具体可以跑:7B 模型 FP16 推理 —— 权重约 14 GB,余量留给上下文缓存、13B 模型 8-bit 量化推理 —— 权重约 13 GB、32B 模型 4-bit 量化推理 —— 权重约 19 GB,上下文长度需要节制、7B 模型 LoRA 与 QLoRA 微调、SDXL 出图与 SDXL LoRA 训练、Flux 出图 —— 需使用 8-bit 或 4-bit 量化权重、Whisper 语音转写与 YOLO 目标检测。
锐算 4090 有什么限制?
24 GB 是硬上限:13B 模型 FP16 权重约 26 GB 就已经放不下,70B 即使 4-bit 量化也要约 42 GB。这两档请看 32 GB 与 80 GB 配置。 消费级卡不支持 NVLink,多卡场景的卡间带宽受 PCIe 限制,不适合张量并行训练。 ECC 显存不可用,长时间训练遇到显存位翻转的风险高于专业卡。
锐算 4090 一次任务大概多少钱?
按 $0.45/小时计:跑通一个 Demo 约 1 小时 $0.45,一次 LoRA 微调约 4 小时 $1.80,一整个工作日 8 小时 $3.60。按小时取整,不足一小时按一小时计,关机后不再收取算力费用。
开通需要多久?需要实名吗?
充值到账后即可创建实例,通常一到两分钟内可以连接。不需要实名认证,一个可收信的邮箱即可,充值使用加密货币。
余额用完数据会丢吗?
余额归零时实例自动关机并保留 72 小时,数据不删除。72 小时内充值即可原样开机。