目前主要负责大规模集群管理、容器镜像高性能分发,资源弹性和调度等方面。曾任职于 IBM、唯品会、才云科技,拥有 10 年云计算经验。致力于推广云原生技术,实现降本增效。

目前主要负责大规模集群管理、容器镜像高性能分发,资源弹性和调度等方面。曾任职于 IBM、唯品会、才云科技,拥有 10 年云计算经验。致力于推广云原生技术,实现降本增效。
以 ChatGPT 为代表的 AIGC 浪潮正在重塑数字内容的生产方式和消费模式,相应的,各行业高算力业务场景对 AI 算力的需求也水涨船高。在有限算力的情况下,通过 GPU 算力上云,驱动云原生 + AI 实现算力资源的快速弹性和高效使用,已经成为 AI 技术落地的新基石。
基于字节跳动内部内核虚拟化隔离 GPU 的技术实践,火山引擎云原生团队结合 Kubernetes 原生 Scheduling Framework,推出自研容器共享 GPU 调度方案 mGPU。提供性能和故障隔离,同时也兼容多种底层 GPU 虚拟化实现以及整卡分配。通过多 Pod 灵活细粒度地共享 GPU,提升算力利用率的同时,节约成本。
演讲提纲:
你将获得:



