2026-09-08
来源: cloud.google.com
39
生成式 AI 对攻击者的价值正在发生变化:它不再只是编写邮件、翻译诱饵或生成脚本的聊天工具,而开始成为能够编排扫描器、处理错误、轮换基础设施并整理凭据的自动化控制层。 GTIG 对 2026 年第二季度活动的观察显示,一次云资源失陷后,攻击者在不到六小时内完成了代理化凭据收集活动的规划、构建与执行。真正值得防守方警惕的不是“AI 会不会生成恶意代码”,...
2026-09-08
来源: cncf.io
39
网络、存储和监控经常出现在 Kubernetes 集群的 day-zero 清单里,身份接入却容易被拖到上线之后。托管 Kubernetes 通常已经连接云 IAM 或企业 SSO,而自建集群如果继续依赖共享 kubeconfig、长期客户端证书或静态 Token,不仅离职回收困难,审计也很难回答“谁在什么时间操作了集群”。 通过 OIDC 把 Kub...
2026-09-08
来源: cncf.io
29
GitHub Actions 在组织里铺开后,账单通常比可观测性增长得更快。团队能看到某次构建失败,却很难立即回答:时间消耗在排队还是执行?哪个 job 长期拖慢流水线?失败后重跑成功的概率有多高? 解决这类问题不一定要给每个仓库修改 workflow YAML。更低侵入的做法,是从 GitHub 的控制面采集 Webhook,再通过 Actions ...
2026-09-08
来源: postgr.es
21
Kubernetes 集群中的 Pod 通常可以彼此通信。部署了 Frontend、Backend 和 Database,并不意味着三层之间天然存在网络边界。要实现零信任,需要先把命名空间切换为默认拒绝,再基于标签、端口和方向逐条开放业务真正需要的链路。 NetworkPolicy 是标准 Kubernetes API,但 API 对象本身不会拦截数据...
2026-09-08
来源: oschina.net
31
DataBuff v0.1.9 正式发布。相较 v0.1.8,本次版本包含 10 个提交,重点集中在两个方向:接入 SkyWalking 8.x 生态,以及加固多 Agent 排障场景中的 LLM 凭据管理。与此同时,本次发布没有引入 Schema 迁移,升级时不需要额外执行数据库结构变更。 DataBuff 面向云原生和微服务场景,采用 OpenTe...
2026-09-07
来源: cncf.io
37
漏洞处理最危险的时刻,往往不是修复代码,而是报告刚到达项目时:维护者不知道由谁回复、讨论转移到公开 Issue、复现材料散落在私人邮箱里,最终让一个可控问题变成仓促发布。 这套流程面向中小型、并非以安全为核心的项目。它的目标不是建立一支完整安全团队,而是让维护者在收到漏洞报告时有一张可以照着执行的“操作卡”。如果项目处理密钥、支付、身份认证、基础设施控...
2026-09-05
来源: kubernetes.io
48
Kubernetes v1.37 将 特性门控提升到 Beta,并默认开启。这个变化不会自动把现有集群变成 rootless 集群,但它标志着 Kubernetes 节点组件以非 root 用户运行的方案已经从长期实验阶段进入更稳定的使用阶段。 Rootless 模式的核心目标很明确:即使 kubelet、CRI、OCI runtime、CNI 插件或...
2026-09-05
来源: cloud.google.com
40
对持续运行的大规模分析平台来说,Spark 作业能否按时开始,往往不只取决于代码和数据,还取决于指定规格的虚拟机当时是否有库存。固定机型、固定可用区的配置看似确定,遇到区域容量波动时却可能让整个数据管道停在集群创建阶段。 Yahoo 在 Google Cloud Managed Service for Apache Spark(原 Dataproc)中...
2026-09-04
来源: cloud.google.com
39
把大语言模型从实验环境搬到生产系统后,模型参数量并不能单独决定吞吐和成本。同一套 TPU、同一个服务框架,面对“长输入、短输出”的分类请求和“短输入、长输出”的生成请求,可能呈现完全不同的扩展曲线。 这组测试在 Google Cloud TPU v6e 上运行 Gemma 3 12B 与 27B,使用 GKE Autopilot、单主机 2×2 TPU...
2026-09-04
来源: cncf.io
29
谈到 AI 基础设施,GPU 往往最先进入讨论:需要多少张卡、显存多大、训练吞吐是多少。但生产工作负载并不是把张量送入 GPU 就结束了。数据读取、解压、清洗、分词、请求编排、结果后处理和可观测性通常运行在 CPU 上,并持续依赖内存、网络与存储。平台工程真正要解决的,是这些资源如何协同,而不只是如何分配加速卡。 一条典型的推理链路可以拆成以下阶段: ...