SLA(服务等级协议,Service Level Agreement)是服务商与客户之间对服务质量的正式承诺,常见于云服务器、CDN 等领域,通常以可用性百分比(如 99.9%)量化,并约定未达标时的赔偿方式,是选购云服务时的重要参考。

| 类型 | IT 服务合同 / 技术术语 |
| 英文全称 | Service Level Agreement |
| 核心指标 | 可用性、响应时间、恢复时间等 |
| 常见领域 | 云计算、服务器托管、CDN、SaaS |
| 相关概念 | SLO、SLI、SRE |
SLA(Service Level Agreement,服务等级协议)是服务提供商与客户之间就服务质量、可用性和责任范围达成的正式约定,常见于云计算、服务器托管、CDN 等 IT 服务领域。
SLA 的核心作用是把「服务好不好」变成可量化、可追责的具体指标。最常见的指标是可用性(Uptime),即服务在一段时间内正常运行的比例,通常用「几个 9」来表示:99.9% 意味着一年停机时间不超过约 8.8 小时,99.99% 则约为 53 分钟。数字越高,服务越可靠,成本通常也越高。
除了可用性,SLA 还可能约定响应时间、故障处理时限、数据持久性、网络延迟等指标。当服务商未能达到承诺水平时,SLA 会规定相应的赔偿条款,常见形式是按停机时长返还一定比例的服务费用或代金券,而非赔偿客户的实际业务损失,这一点在签约前需要特别留意。
主流云厂商(如 AWS、阿里云、腾讯云、Google Cloud 等)都会为其云服务器、对象存储、数据库等产品公布 SLA 条款,这也是用户比较和选择云服务时的重要依据。
一份典型的 SLA 通常包含以下要素:
与 SLA 相关的还有 SLO(服务等级目标)和 SLI(服务等级指标)。简单来说,SLI 是实际测量到的数据(如某月实际可用率),SLO 是团队内部设定的目标值,而 SLA 是写进合同、带有赔偿责任的对外承诺。这三者是 SRE(网站可靠性工程)实践中的核心概念。
问:SLA 承诺 99.9% 就代表服务不会宕机吗?答:不是。SLA 只是概率性承诺和赔偿依据,任何服务都可能故障。99.9% 意味着服务商允许自己每年有数小时的停机额度,超出才触发赔偿。
问:SLA 赔偿能弥补业务损失吗?答:通常不能。绝大多数 SLA 只按服务费的一定比例赔偿,且设有上限,不覆盖因宕机导致的间接业务损失,关键业务应自行做好容灾和多可用区部署。
问:选云服务器时怎么看 SLA?答:除了看可用性数字,还要关注统计周期(月度还是年度)、免责条款和赔偿申请流程;同时结合厂商的历史故障记录综合判断,而不是只看纸面承诺。

| 类型 | IT 服务合同 / 技术术语 |
| 英文全称 | Service Level Agreement |
| 核心指标 | 可用性、响应时间、恢复时间等 |
| 常见领域 | 云计算、服务器托管、CDN、SaaS |
| 相关概念 | SLO、SLI、SRE |
登录 后参与讨论
暂无讨论,来发表第一条评论吧