来源: postgr.es
48
PostgreSQL 18 新增 ,补上了扩展外置的最后一块拼图:控制文件和 SQL 脚本不再必须安装到服务器自身的 。配合已有的 ,以及 Kubernetes ImageVolume 或 Docker 的镜像挂载能力,扩展可以被打包成独立 OCI 镜像,在运行时挂进 PostgreSQL 容器。 这让“一个精简 PostgreSQL 基础镜像,加若干...
来源: aws.amazon.com
42
在 AWS 上部署 Kimi K3,可以沿两条路径展开:使用 Amazon SageMaker HyperPod 构建面向大模型训练与推理的集群,或者把服务部署到 Amazon Elastic Kubernetes Service(Amazon EKS)。两种方案都能承载模型工作负载,但它们解决的问题不同:HyperPod 更强调托管式集群与机器学习基...
来源: aws.amazon.com
35
部署 Kimi K3 这类大型模型,真正困难的部分通常不是启动一个容器,而是把 GPU 拓扑、模型权重、分布式推理、故障恢复和服务入口组合成一套可重复运维的系统。AWS 提供了两条主要路径:使用 Amazon SageMaker HyperPod 建设面向大规模 AI 工作负载的集群,或者把推理服务部署到 Amazon EKS,由 Kubernetes...
来源: cloud.google.com
43
AI Agent 的资源曲线通常不是平滑直线:它们会集中推理、调用工具或执行代码,随后等待用户输入和外部事件。如果每个 Agent 始终占用固定 CPU 和内存,大量预算最终会消耗在空闲时间上。 一次基于 GKE 节点和 OpenClaw 工作负载模型的测试展示了三层优化效果:从每个 Agent 独占 microVM,到使用 GKE Agent San...
来源: cncf.io
39
Kyverno、OPA Gatekeeper 和 Sigstore Policy Controller 等工具通常在 Kubernetes API 层拦截 Pod 创建,并检查镜像签名与证明材料。这道准入关卡很重要,但它验证的是控制面当时看到的声明。Node Resource Interface(NRI)把策略执行点推进到节点和容器运行时附近,使验证器...
来源: kubernetes.io
47
很多 Go 开发者第一次写 Kubernetes Controller 时,会自然地把 和 理解成一次次对 kube-apiserver 的查询。这个理解一旦带入生产环境,就很容易误判控制器的性能、数据一致性和内存开销。 在典型的 controller-runtime Controller 中,Reconcile 的读取通常来自进程内的本地缓存,而不是...
来源: cncf.io
53
Scale-to-zero 的目标很直接:没有业务流量时不运行 Pod,从而减少空闲资源消耗。但在真实集群里,负载均衡器、外部 uptime monitor 或平台探测器仍会定期请求 、 等端点。对支持按请求激活工作负载的系统来说,这些探测流量和普通业务请求没有区别,于是刚缩到零的服务又被唤醒。 KubeElasti 的 针对的正是这类流量:在请求真正...
来源: cncf.io
47
CoHDI 已正式成为 CNCF Sandbox 项目。这个里程碑不仅意味着项目进入云原生社区的公开治理与孵化轨道,也指向一个更具体的问题:当计算、内存、加速器和网络资源不再固定封装在同一台服务器里,Kubernetes 应该如何发现、组合并调度这些资源? 传统 Kubernetes 调度以节点为中心。Pod 声明 CPU、内存等需求,调度器寻找一台满...
来源: cncf.io
54
2025 年 6 月,首届 KubeCon + CloudNativeCon Japan 在东京举行。此后,日本的云原生技能学习明显升温,相关培训与考试活动出现约 250% 的增长。这不只是 Kubernetes 社区规模扩大的信号,也反映出 AI 产业正在重新定义基础设施人才:企业需要的不再只是会调用模型 API 的开发者,还需要能够部署、扩缩容、监...
来源: oschina.net
54
终端工具正在从“连接远程服务器”演变成统一的运维工作台。uniTerm v1.6.0 在已有 SSH、RDP、VNC、SFTP、数据库等能力之上,正式加入 Kubernetes 与容器管理,并继续扩展 AI 技能与命令体系。对于需要在服务器、集群、容器和数据库之间频繁切换的开发者,这次更新的价值不只是多了几个入口,而是减少了工具和上下文的切换。 uni...