上个月帮一家做小家电的客户看账单:3 台 ECS + 1 个 RDS + OSS 和 CDN,每月 6800 多。我花两个小时翻了一遍配置,找出 3100 元的浪费——不是被云厂商坑了,是没人管。
这在中小企业里太常见了:服务器是开发顺手开的,规格是"怕不够用"拍的,账单只有财务在月末看一眼总额。
下面这 5 个浪费点,几乎每个客户的账号里都能找到一两个。每一条都附带自查命令,用阿里云 CLI 就能跑。
一、测试机 7×24 空转(每月 400–800 元)
开发/测试环境按量付费、从不关机。一两台不显眼,一年下来能顶半台生产机的包年费用。
自查:
# 列出所有运行中的实例(含规格、计费方式、地域)
aliyun ecs DescribeInstances --RegionId cn-hangzhou \
--Status Running --PageSize 100 \
| jq -r '.Instances.Instance[] | "\(.InstanceName)\t\(.InstanceType)\t\(.InstanceChargeType)"'
再配合控制台「云监控 → 实例监控」看 CPU:连续 7 天 CPU < 5% 且非生产环境,基本可以关。
优化:用「运维编排 OOS」配置非工作时间自动关机;闲置实例直接释放(同时释放关联的云盘与弹性公网 IP,别让它们继续计费)。
二、快照与日志"只加不减"(每月 200–1000 元)
每天全量快照、永不清理;日志全量永久保留;去年的备份还躺在标准型 OSS 里。存储费用每个月悄悄涨一点,一年翻倍。
自查:
# 快照数量与容量
aliyun ecs DescribeSnapshots --RegionId cn-hangzhou --PageSize 100 \
| jq -r '.Snapshots.Snapshot[] | "\(.SnapshotName)\t\(.SourceDiskSize)GiB\t\(.CreationTime)"' | wc -l
# OSS 存储用量与类型分布
aliyun oss stat oss://your-bucket/ --region cn-hangzhou
优化:
- 快照改增量 + 定期快照策略(日备留 7 天、周备留 3 个月);
- OSS 配置生命周期规则:30 天未访问转低频、90 天转归档、365 天清理;
- 日志服务(SLS)设置保留期:热数据 15 天可检索 + 归档 180 天。
三、带宽买"固定带宽"用不满(带宽费降 50%+)
固定带宽按月计费、不可退。我见过买 50Mbps、日常峰值只有 6Mbps 的配置——等于每月为 88% 的空闲带宽付钱。
自查:控制台「云监控 → 公网带宽」看 7 天峰值;确认静态资源是否走了 CDN。
优化:
- 商品图/详情页视频迁到 OSS + CDN(配合 OSS 图片处理做多尺寸与 WebP),源站只跑动态请求;
- 波动业务把带宽计费方式改为"按使用流量";
- 给 CDN 与 OSS 配流量封顶 + 告警——被恶意刷流量时这条能救命。
四、长期按量付费,没转"包年包月/节省计划"(每月 500–1500 元)
自查:
aliyun ecs DescribeInstances --RegionId cn-hangzhou --PageSize 100 \
| jq -r '.Instances.Instance[] | select(.InstanceChargeType=="PostPaid") | "\(.InstanceName)\t\(.InstanceType)"'
优化(按适配度排序):
- 长期稳定实例 → 包年包月(1 年通常省 30%–50%);
- 弹性需求、又不想锁死规格 → 节省计划(不绑定具体实例,灵活度更高);
- 可中断的离线任务(转码、爬虫、批量计算)→ 抢占式实例(价格可低至按量的 10%–20%,配合"实例中断再自动重建"的稳性方案)。
五、数据库与中间件"超配 + 公网裸奔"(每月 500–2000 元 + 一个高危风险)
日订单几百单却买了高可用双节点大规格 RDS(约等于单节点价格 ×2);同时 Redis 监听 0.0.0.0 且无密码,公网可扫到。
自查:
# 服务器上确认监听地址(0.0.0.0 = 全网卡)
ss -tlnp | grep -E '3306|6379|9200|27017'
# RDS 实例规格与连接使用率
aliyun rds DescribeDBInstances --RegionId cn-hangzhou \
| jq -r '.Items.DBInstance[] | "\(.DBInstanceDescription)\t\(.DBInstanceClass)\t\(.ConnectionMode)"'
优化:
- 按实际 QPS/连接数评估规格,长期低负载就降配(RDS 支持变配);
- 读多写少先加只读实例 + Tair/Redis 缓存,别急着升主库;
- 数据库与缓存一律绑内网或 127.0.0.1,搭配安全组只放必要来源——既省钱又保命。
一页自查表(每周 10 分钟)
| 检查项 | 入口/命令 | 判断标准 |
|---|---|---|
| 空闲实例 | 云监控 CPU 利用率 | 7 天 <5% 且非生产 → 关停/释放 |
| 快照数量 | DescribeSnapshots |
超出保留策略 → 清理 |
| OSS 存储类型 | 生命周期规则 | 冷数据还在标准型 → 转低频/归档 |
| 带宽计费方式 | 云监控公网带宽 | 峰值 < 固定带宽 30% → 改按流量 |
| 按量实例 | InstanceChargeType=PostPaid |
长期运行 → 包年/节省计划 |
| 数据库监听 | ss -tlnp |
0.0.0.0 → 绑内网 + 收敛安全组 |
写在最后
上面这些动作都不需要买任何商业产品,全是配置层面的整理,做完通常能把账单压掉 20%–40%(文中金额为案例数字,具体以你的账单为准)。
如果你想知道自己的云上有没有白扔钱:我提供一次免费云成本诊断——你提供只读权限或导出账单 CSV,我 30 分钟内出一页结论:钱花在哪、哪些能立刻省、哪些要动架构。评论区回复"诊断"即可(联系方式见个人简介)。
只读诊断,不碰业务数据、不动任何配置。