阿里巴巴大数据运维平台实践

在QCon北京2018大会上,周涌杰(矮鱼)讲师做了《阿里巴巴大数据运维平台实践》主题演讲,主要内容如下。

演讲简介:

Maxcompute 是阿里巴巴内部唯一的大数据处理平台,且在全球十几个地区提供公有云服务,并为上百家私有云输出计算能力。

作为支撑如此庞大系统的 SRE 团队,要面对的是 EB 级数据,TB 级带宽,上百万块硬盘,还有上万的客户发工单。

我们在全流程的发布管理,全球的配置同步,高效的监控感知等基础运维领域都实现了高度的自动化,

同时,从底层硬件到上层应用各个环节,我们掌握并分析使用了大量的数据来帮助我们突破传统思路的局限。

本次聚焦于近期在平台落地的几项成果,多地域的容量线性规划调优,硬件故障发现及自愈,运行作业的数据化诊断,分享我们在构建下一代运维平台的探索和思考。

讲师介绍:

周涌杰(矮鱼)

阿里巴巴 大数据计算服务保障平台研发技术专家

矮鱼,2012 年开始从事互联网,现负责阿里大数据计算服务保障和平台研发,在运维领域内有丰富经验积累。

秉承 "Service unavailable? Our problem, whatever the reason"的理念,致力于保证线上稳定性和推进团队平台产品的迭代演进。

图片[1]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[2]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[3]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[4]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[5]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[6]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[7]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[8]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[9]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

图片[10]-阿里巴巴大数据运维平台实践-JieYingAI捷鹰AI

完整演讲 PPT 下载链接:

© 版权声明
THE END
喜欢就支持一下吧
点赞0 分享