唐聪,腾讯云 TKE 稳定性负责人,腾讯云技术专家,极客时间专栏《etcd实战课》作者,etcd 活跃贡献者,主要负责腾讯云大规模 K8s/etcd 平台、有状态服务容器化、在离线混部等产品研发设计工作。

唐聪,腾讯云 TKE 稳定性负责人,腾讯云技术专家,极客时间专栏《etcd实战课》作者,etcd 活跃贡献者,主要负责腾讯云大规模 K8s/etcd 平台、有状态服务容器化、在离线混部等产品研发设计工作。
随着云原生技术的逐步推广,越来越多业务开始使用云原生容器化的方式去构建自己的应用。Kubernetes 作为云原生容器调度平台,成为大家的一致选择,并基于 Kubernetes 衍生出了Serverless、边缘计算、Mesh 平台等一系列云原生平台解决方案。 本次分享将为你介绍腾讯在构建大规模云原生平台过程中,提升稳定性的实践经验。首先将为大家分享 Kubernetes 典型故障案例,了解搞崩 Kubernetes 集群的若干种方式,并详细介绍相应的解决方案。其次将分享如何通过大规模 etcd 平台的建设、使用 Kubernetes 集群来高效治理 master 组件等机制,实现自动化的数据迁移、弹性扩缩容、巡检、故障自愈等,最终显著提升云原生平台的稳定性。以上方案作为腾讯的云原生平台的底座,成功支撑 Kubernetes、Serverless、边缘计算、Mesh 等一系列云原生基础平台。
演讲提纲:
1. Kubernetes 典型故障案例分析与最佳实践
2. 大规模 etcd 平台
3. Kubernetes 其他 master 组件治理
4. 未来规划与总结
你将获得:



微信咨询

电话咨询
微信联系我们

