来源: cncf.io
43
Platform Engineering 1.0 已经证明了自己的价值:Golden Path 让部署更快,内部开发者平台降低了认知负担,自助式基础设施把开发者从工单队列里解放出来,标准流水线也让交付变得可复制。现在变化来了:AI 原生工作负载把平台从“帮应用上线”推向“帮模型、数据、推理和实验稳定运行”。 过去的平台工程主要围绕服务交付:创建仓库、申...
来源: cncf.io
35
数据主权过去常被简化成一个下拉框:把工作负载部署到某个国家或地区的云区域,数据就算“留在本地”。但真正的问题并不只是服务器摆在哪里,而是谁有法律、运营或技术能力被要求交出数据。这个变化正在重塑云原生基础设施设计:架构师需要同时考虑地理位置、控制平面、加密密钥、运维权限、审计链路和跨境依赖。 传统云原生设计喜欢把“区域”当作合规边界:数据库在本国区域,备...
来源: cncf.io
34
kpt 的定位很明确:它不是另一个只会 的包装器,而是一套以“包”为中心的基础设施自动化工具链。它面向 Kubernetes 平台和 KRM,也就是 Kubernetes Resource Model 驱动的配置,把配置编写、自动化处理和交付流程放进同一个工作流里。 对于已经在用 YAML、Kustomize、GitOps 或平台工程流水线的团队来说,...
来源: cncf.io
31
Kubernetes v1.35 中,Dynamic Resource Allocation(DRA)进入 GA。这个变化的意义不只是“又多了一个 API”,而是 Kubernetes 开始用更细粒度的方式描述和分配设备资源:GPU、网卡、加速卡、带拓扑约束的硬件,都可以从简单的 走向“我要哪类设备、带什么属性、如何绑定给 Pod”。 同时,NVIDI...
来源: cncf.io
36
数据中心在 2024 年已经占到全球用电需求的 1.5%。对运行 Kubernetes 的团队来说,能耗不再只是设施部门的账单问题,而是容量规划、成本优化和可持续性治理的一部分。Kepler 这次重新架构的核心信号很明确:提高功耗估算准确性,同时邀请更多社区成员参与验证、部署和改进。 很多团队已经能看到 CPU、内存、网络、磁盘等资源指标,但功耗指标更...
来源: cncf.io
29
Dragonfly v2.5.0 发布了。这个版本最值得关注的变化,是 Dragonfly Client 开始支持直接下载 Hugging Face 和 ModelScope 上的模型仓库。对正在做推理服务、模型微调、离线部署的团队来说,这不是一个“下载工具多了一个参数”的小事,而是把模型仓库这种越来越重的制品,纳入了更可控的分发链路。 过去我们谈 D...
来源: cncf.io
30
如果你已经在跑 OpenTelemetry pipeline,应用内部发生了什么通常不再是黑盒:请求耗时、错误、trace、runtime 指标都能进同一套观测系统。但很多团队仍然缺一块:服务之间的东西向流量。服务网格或 sidecar/proxy 能看到应用代码看不到的连接、重试、TLS、上游/下游关系,把这些 mesh-derived metric...
来源: cncf.io
22
etcd-operator 项目已经捐赠给 Cozystack,同时发布了一个从零实现的新版本,并引入新的 API。对 Kubernetes 平台团队来说,这件事的重点不只是“项目换了归属”,而是 etcd 集群的声明式生命周期管理有了一个新的演进起点。 etcd 是 Kubernetes 控制面的关键依赖,也常被业务系统用作强一致元数据存储。它的部署...
来源: cncf.io
35
印度最大电商平台 Flipkart 刚拿下 CNCF 终端用户案例研究大赛的奖项,核心看点只有一个:把 LitmusChaos 深度嵌入 Kubernetes 原生架构,在生产环境系统性注入故障,用可控的混乱换取真实的可靠性。这对任何跑在 K8s 上的业务都有直接参考价值。 大规模电商的流量峰值极端——大促期间秒级请求量可以翻几十倍。传统做法是压测 +...
来源: cncf.io
41
几个月前,CNCF 推出了 CARE 计划(Certification Advancement & Recertification Experience),目的是让持证工程师在技能持续成长的同时,不用反复走低效的续期流程。现在这条规则有了实质扩展:通过 CKS(Certified Kubernetes Security Specialist)考...