跳到主要内容
注册无需实名认证
安云主机 AnYun VPS

GPU服务器租用 · 推理与出图 · GR-5090

锐算 5090 显卡租用 · 32GB 显存

比 4090 多 8 GB 显存与更高带宽,适合刚好卡在 24 GB 门槛上的模型。

要点

锐算 5090 的配置与价格

安云主机 锐算 5090 显卡租用(GR-5090)配备 RTX 5090,单卡显存 32 GB,搭配 16 vCPU 与 64 GB 内存,含 500 GB 数据盘。按小时计费 $0.68/小时,月租 $329,从预付余额扣除,关机不计算力费用。购买无需实名认证,支持 USDT 等加密货币充值,预装 PyTorch 与 CUDA 深度学习环境。比 4090 多 8 GB 显存与更高带宽,适合刚好卡在 24 GB 门槛上的模型。

显存能放下什么

32GB 显存能放下多大的模型

  • 13B 模型 FP16 推理 —— 权重约 26 GB,正好是 4090 放不下的那一档
  • 32B 模型 4-bit 量化推理 —— 权重约 19 GB,上下文余量充足
  • 13B 模型 QLoRA 微调 —— 4-bit 底座约 8 GB
  • 显存刚好超出 24 GB 的出图与视频生成工作流

技术规格

显卡型号
RTX 5090
显卡数量
1 张
单卡显存
32 GB
卡间互联
单卡,不适用
vCPU
16 核
内存
64 GB
系统盘
100 GB NVMe
数据盘
500 GB NVMe
端口速率
1 Gbps
型号
GR-5090

已知限制

这张卡在推理、微调与训练上的边界

  • 同样是消费级卡:无 NVLink、无 ECC。
  • 部分较旧的框架版本对新架构支持不完整,上机前请确认你的 CUDA 与 PyTorch 版本。
  • 供货紧张,缺货时间可能较长。
  • 32 GB 仍然是推理与 LoRA 的容量:全参数微调按每参数约 16 字节计算,7B 就需要约 112 GB。

可选机房

算力节点 · 1 个机房

机房 最佳回程 延迟
法兰克福 FRA AS4837 普通线路 255 ms

GPU 任务对延迟不敏感 —— 训练与推理都在机房内完成,延迟只影响你连接终端与传输数据的体验。

预装镜像

PyTorch 2.5 · CUDA 12.4 · Python 3.11PyTorch 2.3 · CUDA 12.1 · Python 3.10TensorFlow 2.17 · CUDA 12.3vLLM 推理服务镜像ComfyUI · Stable Diffusion WebUIUbuntu 22.04 + NVIDIA 驱动(纯净环境)

常见问题

关于 锐算 5090 租用与计费

锐算 5090 适合做什么?

比 4090 多 8 GB 显存与更高带宽,适合刚好卡在 24 GB 门槛上的模型。 具体可以跑:13B 模型 FP16 推理 —— 权重约 26 GB,正好是 4090 放不下的那一档、32B 模型 4-bit 量化推理 —— 权重约 19 GB,上下文余量充足、13B 模型 QLoRA 微调 —— 4-bit 底座约 8 GB、显存刚好超出 24 GB 的出图与视频生成工作流。

锐算 5090 有什么限制?

同样是消费级卡:无 NVLink、无 ECC。 部分较旧的框架版本对新架构支持不完整,上机前请确认你的 CUDA 与 PyTorch 版本。 供货紧张,缺货时间可能较长。 32 GB 仍然是推理与 LoRA 的容量:全参数微调按每参数约 16 字节计算,7B 就需要约 112 GB。

锐算 5090 一次任务大概多少钱?

按 $0.68/小时计:跑通一个 Demo 约 1 小时 $0.68,一次 LoRA 微调约 4 小时 $2.72,一整个工作日 8 小时 $5.44。按小时取整,不足一小时按一小时计,关机后不再收取算力费用。

开通需要多久?需要实名吗?

充值到账后即可创建实例,通常一到两分钟内可以连接。不需要实名认证,一个可收信的邮箱即可,充值使用加密货币。

余额用完数据会丢吗?

余额归零时实例自动关机并保留 72 小时,数据不删除。72 小时内充值即可原样开机。

联系 工单
扫码
手机访问

扫码在手机上打开