标签

数据库

PostgreSQL GSSAPI Kerberos 配置:把 krb_caseins_users 与 krb_server_keyfile 理清

来源: postgr.es 37
PostgreSQL 的 GSSAPI 认证看起来像是“启用 Kerberos”这么简单,实际却依赖两个容易被忽略的服务端设置: 决定 PostgreSQL 从哪个 keytab 读取服务密钥, 决定 Kerberos 用户名与 PostgreSQL 角色名匹配时是否区分大小写。把这两个开关混在一起排查,通常会让认证问题变得更难定位。 指向 Postg...

用 pg_shmemviz 看懂 PostgreSQL 共享内存:从分配布局到原始字节

来源: postgr.es 42
PostgreSQL 的共享内存决定了缓冲区、进程状态、WAL、锁和动态共享内存等多个核心子系统如何协作。过去,我们通常通过 、 或 查看其中某个方面;但当问题涉及物理位置、C 结构体字段、指针引用和字节级变化时,这些视图就不够用了。 是一个面向开发和调试的可视化工具。它把 PostgreSQL 的主共享内存段和动态共享内存段捕获为离线快照,再通过本地...

让 HubSpot 同步真正可靠:事务性 Outbox、QStash 与可修复的一致性

来源: postgr.es 43
HubSpot 同步最棘手的故障,不是请求明显失败,而是 HubSpot 已经提交变更,Worker 却在保存结果前丢失响应。此时重试可能重复写入,拒绝重试又会让本地事件永久悬挂。可靠方案必须把数据库、发布器、Worker 和远端变更都设计成可识别、可重试、可修复的状态机。 队列并不能保证消息只处理一次。发布确认可能丢失,QStash 也可能在 Wor...

把 HubSpot 多品牌订阅路由建模成可版本化的业务配置

来源: postgr.es 45
当一个“订阅 Brand A 产品新闻”的动作需要同时落到一个 HubSpot Brand、一个通信订阅类型、六个细分、三个联系人属性和若干分析目标时,这份映射已经不再是普通配置,而是产品业务逻辑。 如果把这些数字 ID 分散在网站代码和条件分支里,每增加一个站点、活动或品牌重组都要重新部署。更麻烦的是,几个月后很难回答一个审计问题:为什么这个联系人进...

在 Google Cloud 上运行 Serverless Apache Spark:架构选择、成本调优与 AI 故障排查

来源: cloud.google.com 46
Apache Spark 仍然是企业级大数据处理的核心工具,但集群创建、YARN 调优、节点扩缩容以及闲置计算资源,会把数据工程团队拖入基础设施运维。Google Cloud 的 Managed Service for Apache Spark 提供了托管集群和 Serverless 两种路径,让团队可以根据工作负载、生态依赖、延迟要求和成本模型做出更...

PMM Grafana 数据源可获得高权限 ClickHouse 访问:受影响版本与处置指南

来源: percona.com 38
Percona 于 2026 年 8 月 19 日发布了一项高危 PMM 安全公告:攻击者可能通过 PMM 中的 Grafana 数据源获得对 ClickHouse 的高权限访问。受影响范围为 PMM 3.9.0 及以下版本。对于把 PMM 用于生产监控、且允许较多用户访问 Grafana 的团队,这不是一个可以等到常规维护窗口再处理的问题。 公告摘要...

别再凭峰值拍脑袋:用 gcache-inspector 为 Galera/PXC 精确规划写集缓存

来源: percona.com 50
Galera Cluster 和 Percona XtraDB Cluster(PXC)通常按高峰期写入量估算 。这个方法能给出起点,却容易忽略写集大小分布、突发事务以及节点实际能保留的序列号范围。结果往往是:配置看起来足够,维护稍微超时,节点仍然无法进行增量状态传输(IST),只能执行耗时更长的全量状态传输(SST)。 的价值在于把猜测变成检查:分析...

每个 AI Agent 都可以有 PostgreSQL,但不该都拥有真相

来源: postgr.es 56
Databricks 收购 Electric,值得关注的地方不只是交易本身,更在于它提示了一种正在成形的架构:PostgreSQL 不再只能作为远程服务器运行,也可以进入浏览器、应用进程、无服务器环境,甚至 AI Agent 的沙箱。 Electric 的 PGlite 是编译为 WebAssembly 的 PostgreSQL,可以嵌入 JavaSc...