2014年加入阿里巴巴,一直从事高可用领域相关的事情,主要负责集团全链路压测,保证集团大促稳定性。

2014年加入阿里巴巴,一直从事高可用领域相关的事情,主要负责集团全链路压测,保证集团大促稳定性。
"Failures can and will happen, anytime, anywhere. Fail fast, fail small, fail often and recover quickly."。
一个线上持续运行的业务,除了能够实现业务的基础流程,更重要的是能做到即使出现预期之外的非正常场景,也能用系统化的手段来保障业务不受损。
本次议题涉及到如何通过系统化的设计规避这些问题,如何让业务快速从“失败”状态转变正常状态,如何能够将“失败”影响面控制到最小,如何从容应急等方方面面。这是对软件架构、运维体系、组织保障等多个维度的综合考量。
本议题将体系化的介绍面向失败的核心思想,并且结合最佳实践,介绍阿里是如何构建面向失败的架构体系的。
演讲提纲:
听众受益:



微信咨询

电话咨询
微信联系我们

