Google Kubernetes Engine
谷歌云托管 Kubernetes 平台,用 Pod 快照秒级恢复 AI 推理工作负载
Google Kubernetes Engine(GKE)是谷歌云的托管 Kubernetes 服务。其 Pod 快照可将运行中 Pod 的完整状态(含 CPU/GPU 内存、根文件系统变更)检查点化存入 Cloud Storage,新副本直接从快照恢复,跳过模型加载等初始化,使 AI 推理负载启动延迟最高降 89%,70B 模型 37 秒恢复。快照依赖 GKE Sandbox(gVisor),按 spec 哈希、机型、内核与 GPU 驱动版本匹配,无兼容快照时回退正常启动
1
2026-09-27
未收录
—
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Google Kubernetes Engine(GKE)是谷歌云的托管 Kubernetes 服务。其 Pod 快照可将运行中 Pod 的完整状态(含 CPU/GPU 内存、根文件系统变更)检查点化存入 Cloud Storage,新副本直接从快照恢复,跳过模型加载等初始化,使 AI 推理负载启动延迟最高降 89%,70B 模型 37 秒恢复。快照依赖 GKE Sandbox(gVisor),按 spec 哈希、机型、内核与 GPU 驱动版本匹配,无兼容快照时回退正常启动
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-09-27
- 覆盖行业
- 程序员、企业it管理
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-09-27版本发布
Google Kubernetes Engine(GKE)发布 Pod 快照基准:通过 gVisor 将 CPU/GPU 内存检查点化到 Cloud Storage,新副本从快照恢复、跳过模型加载初始化,使 AI 推理等重负载启动延迟最高降低 89%,70B 模型 37 秒、8B 模型 15 秒加载;客户 Codeway 启动从约 1 分钟降至 8 秒。该功能 5 月已在 1.35.3-gke.1234000 及以上集群 GA,快照按 distilled Pod spec 哈希、机型系列、gVisor 内核与 GPU 驱动版本匹配,不兼容时回退正常启动,影响 MLOps 弹性伸缩与按需启停 GPU 的工作流。
Google Kubernetes Engine 常见问题
关于 Google Kubernetes Engine 的定位、核心功能、价格与最近更新。
Google Kubernetes Engine 是什么?
Google Kubernetes Engine(GKE)是谷歌云的托管 Kubernetes 服务。其 Pod 快照可将运行中 Pod 的完整状态(含 CPU/GPU 内存、根文件系统变更)检查点化存入 Cloud Storage,新副本直接从快照恢复,跳过模型加载等初始化,使 AI 推理负载启动延迟最高降 89%,70B 模型 37 秒恢复。快照依赖 GKE Sandbox(gVisor),按 spec 哈希、机型、内核与 GPU 驱动版本匹配,无兼容快照时回退正常启动。
Google Kubernetes Engine 有哪些核心功能?
Google Kubernetes Engine 当前已核验的核心功能包括:检查点快照恢复、模型推理服务。
Google Kubernetes Engine 如何收费?
AI Equal 当前没有收录 Google Kubernetes Engine 的可验证价格信息。
Google Kubernetes Engine 最近有什么更新?
2026-09-27:Google Kubernetes Engine(GKE)发布 Pod 快照基准:通过 gVisor 将 CPU/GPU 内存检查点化到 Cloud Storage,新副本从快照恢复、跳过模型加载初始化,使 AI 推理等重负载启动延迟最高降低 89%,70B 模型 37 秒、8B 模型 15 秒加载;客户 Codeway 启动从约 1 分钟降至 8 秒。该功能 5 月已在 1.35.3-gke.1234000 及以上集群 GA,快照按 distilled Pod spec 哈希、机型系列、gVisor 内核与 GPU 驱动版本匹配,不兼容时回退正常启动,影响 MLOps 弹性伸缩与按需启停 GPU 的工作流。