开篇来看这应该是国内首篇介绍AWS Sustainability Pillar的文字。
先说结论 可持续性, 实质就是 unit metric 可观测性
开篇前 雨生问个问题大家琢磨下
如果是您做决策,您怎么选?
1.5-3折,1元购的云计算常态化是竭泽而渔对您合适?
还是 Sustainability可持续性发展对您合适?
以下为正文
###当雨生打开AWS 官方文档链接时发现,已经过期了。给了新的链接,嗯?五大支柱还能过期?让我们deep dive 下,看看发生了什么变更,这引起了雨生的兴趣。
https://docs.aws.amazon.com/wellarchitected/latest/operational-excellence-pillar/welcome.html

嗯的确是过期归档了,出了新版本
让我们看看新版的和旧版的有什么区别?
嗯,多了一个Sustainability 可持续性

而
起因今天群里讨论AWS 五大支柱的火热,于是我们又复习了下AWS五大支柱
AWS Well-Architected Framework
Operational Excellence Pillar
分别是
The framework is based on five pillars:
Operational Excellence /卓越运营
Security / 安全性
Reliability /可靠性
Performance Efficiency/性能效率
Cost Optimization/ 成本优化
##############
我们解读下 新增的 Sustainability 可持续性 到底讲的是什么?
可持续性支柱
可持续性支柱侧重于减少运行的云工作负载对环境的影响。关键主题包括共享可持续性责任,了解影响,最大化利用率以减少需要的资源并减少下游影响。 (雨生解读:核心就一个意思,要为生产力的IT项目付费,而不是浪费)
Publication date: December 2, 2021 (Document history (p. 31))
上个月刚刚发布,里面讲了几个概念
第一个就是责任共担模型在可持续支柱的实践,注意分清楚客户的in the clou的责任,以及 云厂商的of the cloud 的责任

第二个就是设计可持续性的原则
•Understand your impact: 懂云对你的影响,要做Measurere(你的云工作负载,客户使用情况,以及你的产品),并且你要模拟未来的影响
•Establish sustainability goals:建立你的可持续发展目标
• Maximize utilization :最大化你的云端使用率,而不是申请了资源而闲置
• Anticipate and adopt new, more efficient hardware and software offerings:预测并采用新的、更高效的硬件和软件产品:而不是使用过时的旧的包年(1-5年)产品。
•Use managed services:使用托管服务,而不是自建,比如AWS RDS ,DynamoDB,S3
• Reduce the downstream impact of your cloud workloads: 减少云工作负载的下游影响
第三个就是针对云做metrics
(而这又是可观测性的基石Metrics,Logs,Tracing,关于这块我们以后单独展开去说),今天重点说 各类metrics 对 可持续性的重要性。
1、资源级别的metrics,这个容易理解
主要就是计算,存储,网络三大件
| Resource | Example proxy metrics | Improvement goals |
| 计算 | 每vCPU 每分钟 | 最大使用你申请的资源 |
| 存储 | 每GB存储预制 | 降低总体存储预置成 本(申请了而不使用) |
| 网络 | 每GB流量或网络包的传输 | 降低流量总体转移成本和转移距 离(避免不合理的流量 乱串) |
2、要做商业的metrics
(雨生解读,新东西,数据显示business +IT+Financial 的metrics 会是趋势)

而针对business metrics 会指导云端用户在的最佳实践
Business metrics
这个需要解释下
选择业务指标来量化业务成果的实现。您的业务指标应反映您的工作负载提供的价值,例如,同时活跃用户的数量、服务的 API 调用或已完成的事务数量。这些指标可能会随着时间的推移而演变。在评估基于财务的业务指标时要谨慎,因为交易价值的不一致会使比较无效。
关键绩效指标
使用以下公式,将供应的资源除以实现的业务成果,以确定每个工作单元的供应资源。

比如某模块
一、每一百万次http请求对的IT成本是在500-1000元见收敛,并没有发生费用徒增,ROI下降,
举例子:(该项目云支出 月度占比企业项目现金流 1%,
1月云支出为50万,对应企业当月现金收入为5000万,用户量PV为5亿。
2月云支出了100万,对应企业当月的现金收入为1亿,用户量PV为10亿。
2月云支出了70万,对应企业当月的现金收入为7000万,用户量PV为7亿。
以图为例

二、性能效率的SLI 平均相应延时是100ms以内
三、对应的SLOs 是 99.8%,从而最终实现整体项目的99.5%的SLA

最后文档给出了优化建议
优化代码(消耗最多时间的代码区域或资源)
删除没有使用或低使用率的工作组件(服务器,服务)
优化对客户端的设备和设施,来降低影响提高利用率
优化使用支持数据访问和 存储模式(冷热温分层)
用生命周期策略删除不必要的数据
最大限度地减少块存储(磁盘)中的过度配置
主动删除不需要或冗余的数据
使用共享文件系统或对象存储访问共同数据
最大限度地减少跨网络的数据移动(跨数据中心,跨多云迁移数据的成本高昂)
仅在难以重新创建时才备份数据
用最少的硬件来满足您的需求需要
使用影响最小的实例类型 (持续可观测新实例类型的发布并利用效率,比如ARM)
使用托管服务 如AWS S3,RDS,DynamoDB,而不是自己构建Mongodb,Mysql
随着企业的业务对应流量的变化实现IT的动态伸缩,同时对应的可用性,性能效率,IT成本也在一个相对区间进行收敛。最终实现可持续性。
最后一个小投票烦请 大家投下

