标签

工程效能

Percona PostgreSQL Operator 3.1:把磁盘加密、只读分析与持久日志纳入集群声明

来源: postgr.es 26
Percona Operator for PostgreSQL 3.1.0 解决了数据库平台评审中最常见的三类问题:静态数据是否由数据库自身加密、分析查询能否绕开主库,以及 Pod 重启后故障日志是否还在。新版本把这些能力直接放进 自定义资源,包括基于 的透明数据加密、面向只读负载的逻辑副本,以及 PostgreSQL 与 pgBackRest 的持久...

Percona PostgreSQL Operator 3.1.0:把加密、读扩展和日志留存纳入集群配置

来源: percona.com 29
PostgreSQL 平台能否通过安全和运维评审,往往不只取决于数据库能不能启动,还取决于三个问题:静态数据是否加密、读流量能否从主库分担出去,以及故障发生后日志是否仍然可用。Percona Operator for PostgreSQL 3.1.0 正是围绕这三项能力推进:透明数据加密、逻辑副本和持久化日志都可以在自定义资源中表达。 这意味着它们不必...

Airtel 如何扛住 IPL 2026:用本地边缘节点和主动运维交付零缓冲直播

来源: cloud.google.com 24
对印度超级联赛(IPL)这样的超大规模体育赛事来说,直播体验没有“差不多就行”。观众会在决胜局同时涌入,任何丢包、卡顿或起播延迟都可能被放大成一次大规模故障。IPL 2026 期间,Airtel 与 Google Cloud 合作,通过 Media CDN、本地化边缘交付和比赛日主动监控,支撑了 74 场比赛的高并发视频分发。 整个赛季产生了数百 PB...

Kubernetes v1.37 工作负载感知调度:从 Pod 逐个排队到分层 Gang Scheduling

来源: kubernetes.io 41
AI 训练、分布式推理和复杂批处理任务很难用“每个 Pod 独立调度”的模型表达。一个包含 8 个 worker 和 1 个 driver 的训练任务,即使先启动了 3 个 worker,通常也无法产生有效进展,反而会长期占用 GPU、网络和 DRA 资源。 Kubernetes v1.37 继续推进 Workload-Aware Scheduling...

用 Antigravity SDK 搭建可观测、可管控的多智能体控制平面

来源: cloud.google.com 38
企业落地智能体并没有统一答案。需要快速部署、集中治理的团队,可以选择托管式商业平台;已经拥有专用工作流、自定义执行引擎或内部权限体系的团队,则往往更适合搭建轻量级 Agent Hub。 这类自建平台真正困难的部分并不是调用模型,而是让几十个后台智能体持续、可预测地运行:工具调用必须受限,执行过程必须可追踪,多轮状态必须能够恢复,运维人员还要在必要时阻止...

KDDI 如何用自动评测与分层提示词,让 Buffmee 的 RAG 响应快 38%

来源: cloud.google.com 21
面向消费者的 RAG 应用很难只优化一个指标:回答要有依据、首字延迟要低,还要同时处理网页、EPUB、PDF、图片混排等内容。KDDI 在构建 Buffmee 时,把自动化质量评测与生产日志分析放进同一个优化闭环,最终将应用总响应延迟降低 38%,首字时间(TTFT)改善近 18%,groundedness 指标提升 25%。 Buffmee 汇集了超...

AI 时代的平台工程:把模型接入、护栏与开发者自主权放进同一套系统

来源: infoq.com 38
AI 辅助编码正在改变研发流程:开发者不仅调用 CI、制品库和 Kubernetes,还会调用代码补全、聊天模型、智能代理与自动评审工具。平台团队面对的问题因此不再只是“如何提供基础设施”,而是“哪些 AI 能力应成为平台能力,以及如何在统一治理和团队自主之间划线”。 这类变化并不意味着平台团队要接管所有 AI 工具。更合理的方向,是把重复、敏感且需要...

别把“胜出概率”当成贝叶斯 A/B 测试:理解 Spotify 的澄清

来源: engineering.atspotify.com 43
实验平台只要展示“B 胜过 A 的概率”,就算采用了贝叶斯 A/B 测试吗?不一定。Spotify Engineering 这次澄清的核心,正是不要仅凭结果页面上的概率指标,就给整套实验方法贴上“贝叶斯”标签。 来源摘要没有披露 Spotify 内部方法的完整实现,因此本文不推测其具体统计模型,而是借这个问题拆清楚:什么条件才能让一项 A/B 测试称为...

当攻击者开始使用 AI Agent:企业防线要从“拦截提示词”升级到控制执行链

来源: cloud.google.com 36
生成式 AI 对攻击者的价值正在发生变化:它不再只是编写邮件、翻译诱饵或生成脚本的聊天工具,而开始成为能够编排扫描器、处理错误、轮换基础设施并整理凭据的自动化控制层。 GTIG 对 2026 年第二季度活动的观察显示,一次云资源失陷后,攻击者在不到六小时内完成了代理化凭据收集活动的规划、构建与执行。真正值得防守方警惕的不是“AI 会不会生成恶意代码”,...

只有两天的模型内测:如何评估 DeepSeek V4.1 Flash 临时版本

来源: oschina.net 26
DeepSeek 在 9 月 8 日开放了 V4.1 Flash 中间版本内测。模型标识直接写着 ,意味着测试窗口到 9 月 10 日结束。它不是可以直接押注生产环境的正式版本,而是一个生命周期极短、需要快速验证的候选模型。 这种发布方式对开发者提出了一个很现实的问题:当模型只开放两天时,应该测什么,怎样留下可复用的结论,又如何避免临时模型下线后拖垮业...