标签

云原生

在 AWS 上部署 Kimi K3:SageMaker HyperPod 与 Amazon EKS 的选型和落地

来源: aws.amazon.com 36
部署 Kimi K3 这类大型模型,真正困难的部分通常不是启动一个容器,而是把 GPU 拓扑、模型权重、分布式推理、故障恢复和服务入口组合成一套可重复运维的系统。AWS 提供了两条主要路径:使用 Amazon SageMaker HyperPod 建设面向大规模 AI 工作负载的集群,或者把推理服务部署到 Amazon EKS,由 Kubernetes...

把闲置时间变成容量:GKE 如何将单个 AI Agent 成本降低 75%

来源: cloud.google.com 44
AI Agent 的资源曲线通常不是平滑直线:它们会集中推理、调用工具或执行代码,随后等待用户输入和外部事件。如果每个 Agent 始终占用固定 CPU 和内存,大量预算最终会消耗在空闲时间上。 一次基于 GKE 节点和 OpenClaw 工作负载模型的测试展示了三层优化效果:从每个 Agent 独占 microVM,到使用 GKE Agent San...

开源依赖成为主战场:给软件供应链加上隔离、冷却与验证

来源: cloud.google.com 49
软件供应链攻击的重心正在发生变化。相比入侵大型软件厂商并篡改更新渠道,攻击者越来越多地盯上 npm、PyPI、Docker Hub、GitHub Actions 和开发者工具:接管维护者账号、投放恶意版本、利用安装脚本窃取凭据,再借助被盗令牌继续污染其他项目。 来源材料指出,2025 年至 2026 年上半年出现了一批规模显著扩大的开源供应链攻击,部分...

OAPE 推动 PostgreSQL 社区认证:从公开流程到 DBA-1 实践准备

来源: postgr.es 43
PostgreSQL 认证长期主要由商业公司提供。新成立的 Open Alliance for PostgreSQL Education(OAPE)试图换一种组织方式:由社区建设独立认证,并让认证流程本身更加公开。ProOpenSource 现已成为 OAPE 的支持者,参与推动考试与认证体系落地。 社区认证的价值不应只用证书名称衡量。按照 OAPE ...

controller-runtime Cache 深入解析:为什么你的 Reconcile 不会打爆 API Server

来源: kubernetes.io 48
很多 Go 开发者第一次写 Kubernetes Controller 时,会自然地把 和 理解成一次次对 kube-apiserver 的查询。这个理解一旦带入生产环境,就很容易误判控制器的性能、数据一致性和内存开销。 在典型的 controller-runtime Controller 中,Reconcile 的读取通常来自进程内的本地缓存,而不是...

别让健康检查唤醒已缩容的 Kubernetes 服务:用 ProbeResponse 保住真正的 Scale-to-Zero

来源: cncf.io 54
Scale-to-zero 的目标很直接:没有业务流量时不运行 Pod,从而减少空闲资源消耗。但在真实集群里,负载均衡器、外部 uptime monitor 或平台探测器仍会定期请求 、 等端点。对支持按请求激活工作负载的系统来说,这些探测流量和普通业务请求没有区别,于是刚缩到零的服务又被唤醒。 KubeElasti 的 针对的正是这类流量:在请求真正...

Lima v2.2 加入 Windows 虚拟机与 TPM 2.0 模拟:一套命令管理四种来宾系统

来源: cncf.io 39
Lima v2.1 已经扩展到 macOS 和 FreeBSD 来宾系统,v2.2 又补上了 Windows。现在,Linux、macOS、FreeBSD 和 Windows 虚拟机可以进入同一套 工作流。与此同时,TPM 2.0 模拟为需要可信平台模块的 Windows 安装、测试和自动化场景补上了关键能力。 过去,开发团队经常为不同来宾系统维护不同...