VM 存储计算器

计算 vSphere ESX 集群存储容量要求

如何使用VM 存储计算器

  1. 1输入虚拟机数量、每台平均磁盘大小,以及 RAID/纠删码开销系数。
  2. 2输入计划保留的增长率与快照保留期。
  3. 3查看配置存储前所需的总裸容量与可用容量。

为虚拟机规划存储容量

可用 = 虚拟机数 × 单盘GB × (1 + 开销);裸容量 = 可用 / RAID效率

虚拟化环境需要为快照、副本和 RAID 校验预留开销,因此可用容量总是小于裸盘容量。

建议至少保留 20–30% 空闲空间,以免数据存储填满时实时迁移和补丁更新卡住。

容量规划要算四块:① **VMDK/VHDX 磁盘**(含快照);② **虚拟机内存文件**(.vmem/.vswp,大小 ≈ 分配的内存;VM 关机后删除,但预留空间/Reservation 会持续占用);③ **日志文件**(vmware.log、Hyper-V 的日志);④ **快照与增量文件**。**快照是最容易失控的部分**——快照文件会随写入量持续增长,一个挂了 3 个月没删除的快照,其 delta 文件可能比原始磁盘还大,且会严重拖慢性能(读操作要遍历整个快照链)。

性能维度换算:**IOPS 需求 = 总 IOPS × 读写比例 + 写惩罚**。RAID 的写惩罚:RAID 0 为 1、RAID 1/10 为 2(每次写要写两份)、RAID 5 为 4(读改写:读数据 + 读校验 + 写数据 + 写校验)、RAID 6 为 6。所以**数据库这类写密集场景应该用 RAID 10 而非 RAID 5**:假设应用需要 1,000 IOPS、写占 50%,RAID 5 的实际磁盘 IOPS 需求 = 1000 × (0.5 读 + 0.5 × 4 写) = 2,500;RAID 10 则是 1000 × (0.5 + 0.5 × 2) = 1,500。**SSD 时代这个差异缩小,但 RAID 5 的写惩罚依然存在。**

模式空间占用性能风险适用
厚置备延迟置零立即全部分配好低传统推荐
厚置备快速置零(Eager Zero)立即分配并清零最好低集群、FT、高性能
精简置备(Thin)按需增长略低**空间耗尽风险**开发测试、超配
差异磁盘(Differencing)仅存差异低(链长时)依赖父盘VDI、快照链
直通 RDM / 裸设备直接使用 LUN最好丧失快照等特性数据库裸设备

不同磁盘模式的容量与性能

常见问题

为什么可用小于裸容量?

RAID 校验、纠删码和快照在写入任何客户数据前就会占用容量。

应保留多少余量?

目标是保留 20–30% 空闲,以吸收峰值、快照和维护操作。

精简置备磁盘能省空间吗?

它只是延迟占用,写满时逻辑总大小仍需容纳在数据存储内。

快照能当备份用吗?

**绝对不能**。快照记录的是「相对于某个时间点的差异」,它依赖于原始磁盘文件——原始磁盘损坏,快照就毫无意义。而且快照会带来:性能下降(每次读要检查快照链)、空间持续增长、删除长链快照时可能耗时极长甚至导致 VM 短暂停顿。**正确做法:短期使用(打补丁、升级前,用完立即删除,建议不超过 24–72 小时)+ 用真正的备份方案(Veeam、Commvault、Windows Server Backup)做长期保护。**

精简置备写满了会怎样?

灾难性后果:**数据存储写满时,其上所有 VM 会同时暂停或崩溃**(不只是那台写满的 VM)。而且恢复麻烦——即使删了文件,VM 也可能处于不一致状态。所以必须:① 设置空间告警阈值(建议 75% 告警、85% 严重告警);② 保留至少 20% 的余量;③ 启用存储 DRS/vMotion 自动平衡;④ 使用支持 UNMAP/空间回收的存储(删除文件后能真正释放空间)。**这是虚拟化运维中最严重的「一失足成千古恨」场景之一。**

更多工具