T
traeai
登录

产品

GKE

别名:Google Kubernetes Engine

Google托管Kubernetes服务

已跟踪 6 条高相关材料

TraeAI 观察

相关材料

已收录 6 条与 GKE 相关的内容,按评分排序。

Introducing the GKE standby buffer: Improve node startup times without blowing your budget

推出 GKE 待机缓冲区:以更低成本提升节点启动速度

Google Cloud Blog1565 字 (约 7 分钟)
92

GKE standby buffers 可在几乎不增加成本的前提下将节点启动时间缩短至冷启动的2-3倍,P50延迟从分钟级降至秒级,适用于各类工作负载。

入选理由:GKE standby buffers 成本仅增加个位数百分比,却可使 P50 延迟从 4-6 分钟降至个位数秒。

精选文章#GKE#Kubernetes#自动扩缩容#谷歌云英文
Google Developers Blog 图标

Run Ray on TPU, Part 1: The foundations

Google Developers Blog1371 字 (约 6 分钟)
85

Ray 2.55正式支持TPU加速,通过GKE和Ray Core协作实现TPU资源调度,开发者可复用现有API进行分布式训练。

入选理由:Ray 2.55版本将TPU纳入官方加速器支持体系,提供预构建镜像和全栈库支持

精选文章#Ray#TPU#GKE#分布式计算#AI加速器英文
Google Cloud Blog 图标

Autopilot Clusters with GKE managed DRANET: GPUs and TPUs

Google Cloud Blog951 字 (约 4 分钟)
85

Google Cloud Blog详解GKE Autopilot集群配置DRANET支持GPU/TPU的完整流程,包含代码示例和参数说明。

入选理由:GKE Autopilot集群部署需指定VPC网络和预留资源URL

精选文章#GKE#Autopilot#DRANET#GPU#TPU英文
Scaling Ray Serve LLM on GKE: Performance without losing the developer experience

Scaling Ray Serve LLM on GKE: Performance without losing the developer experience

Google Cloud Blog675 字 (约 3 分钟)
85

Google 与 Anyscale 合作优化 Ray Serve LLM 在 GKE 上的性能,实现吞吐量提升 5 倍、延迟降低 8 倍。

入选理由:通过 HAProxy 集成,减少代理开销并提升吞吐量。

精选文章#Ray Serve#GKE#LLM#性能优化#Kubernetes英文
With faster node startup for GKE, say goodbye to cold-start latency

GKE 节点启动更快,告别冷启动延迟

Google Cloud Blog896 字 (约 4 分钟)
85

GKE 节点启动时间缩短至平均 30 秒以内,显著降低冷启动延迟,提升容器化应用响应速度。

入选理由:GKE 节点启动时间从平均 60 秒降至 30 秒内,减少冷启动延迟。

精选文章#GKE#Kubernetes#云计算#DevOps英文
Google Developers Blog 图标

创新一年:庆祝Google Cloud x NVIDIA开发者社区突破10万会员

Google Developers Blog491 字 (约 2 分钟)
55

Google Cloud x NVIDIA开发者社区成立一周年,宣布会员数量突破10万,并推出四条针对AI模型部署、机器学习加速、数据分析和GPU推理的精选学习路径,同时预告未来将聚焦代理式AI内容。

入选理由:社区成立于Google I/O '25,一年内达到10万成员,提供四条精选学习路径包括GKE上部署NVIDIA NIM、加速机器学习工作流、GPU数据分析加速和GPU上AI模型推理入门

精选文章#Google Cloud#NVIDIA#开发者社区#机器学习#GKE英文

跨材料问答 · GKE

回答基于:GKE 相关 6 条材料
    0 / 500

    AI 可能会生成不准确的信息,请核实重要内容