标签

Go

别等流量打爆 GPU:Kubernetes 预测式自动扩缩容实践

来源: cncf.io 30
GPU 工作负载的扩容,往往不是把副本数从 2 调到 10 那么简单。节点启动、GPU 资源调度、镜像拉取和模型加载都需要时间。如果等队列已经堆积、GPU 利用率已经飙高,扩容动作可能已经来不及了。 一次生产事故很能说明问题:服务不是逐渐变慢,而是在流量上升后直接崩溃;大量 Pod 处于 Pending,用户错误率达到 15%~20%。这类事故的关键通...

从“Postgres 很糟”到 PostgreSQL 深处:一名 DBA 的二十年进化路径

来源: postgr.es 33
一个数据库人的技术路线,往往不是从“我喜欢这项技术”开始,而是从一次故障、一次磁盘告急,或一场无法解释的生产事故开始。Shaun Thomas 与 PostgreSQL 的关系就是如此:早期因为膨胀、清理和升级问题而嫌弃它,后来却在真实生产环境中不断修复、自动化和扩展,最终成为 PostgreSQL 社区的长期贡献者。 这段经历最有价值的地方,不是某个...

DjangoAdmin 敏捷开发框架 Flask+AntdVue v2.8.1:面向模块化后台开发的更新与实践

来源: oschina.net 47
DjangoAdmin 敏捷开发框架的 Flask+AntdVue 版本发布了 v2.8.1。本次更新主要修复近期用户反馈的问题,同时延续了框架对 Flask、Vue 3、Ant Design、MySQL 和模块化组件开发的支持。对于需要快速搭建企业级管理后台的团队来说,这类版本更新的价值不只在于新增功能,也在于持续降低日常开发和维护成本。 v2.8....

pg_dump 的数据恢复为何会“自己弄坏自己”

来源: postgr.es 38
把 PostgreSQL 的 data-only dump 恢复到一个刚创建、完全空白的同结构数据库,看起来应该是最安全的场景:没有旧数据,不会发生主键冲突,外键也有机会按依赖顺序加载。然而,恢复仍可能在某张表的 中途失败。 一个容易被忽略的原因是: 会在数据真正开始加载前,把当前会话的 固定为空字符串。只要触发器函数内部使用了未限定的表名,触发器就可...

企业 AI 如何跨过试点陷阱:从用例筛选、双 COE 到生产 XOps

来源: cloud.google.com 37
企业采购大模型许可证并不等于获得 AI 回报。Pythian 在覆盖 27 个国家、约 500 名员工的内部推广中发现,真正拉开差距的不是每人每天节省几分钟,而是把 AI 嵌入工单处理、供应链预测和商品录入等高价值流程,并建立持续维护这些流程的组织能力。 这套方法最终形成了一条完整链路:Field CTO 战略与治理、平台部署、双 COE 执行,以及负...

用 Cloud Run 实例低成本部署长期运行的个人 AI Agent

来源: cloud.google.com 49
对于 OpenClaw、Hermes 这类面向个人开发者的 AI Agent,传统的无状态 Web 服务模型并不总是合适。它们通常需要长期运行、保存状态,而且大多数时间只服务一个用户。Cloud Run 实例正是为这类单实例、长生命周期工作负载提供了更贴近实际的运行方式。 Cloud Run 服务擅长处理无状态、高吞吐的 HTTP 请求。当一段时间没有...

Google Cloud 用 AI Agent 简化数据库生命周期管理

来源: infoq.com 53
数据库运维正在从“人工执行固定流程”转向“由 AI 协助完成上下文判断”。Google Cloud 最近推出 AI-powered Database Operations Agents,覆盖数据库接入和日常运维两个关键阶段:Onboarding Agent 用于简化数据库设置,Observability Agent 则帮助团队进行故障排查、性能优化与调...

用 Numba 把 Python 模型推向 C 级性能:金融服务中的算法设计实践

来源: infoq.com 41
在精算、风险计量和金融模拟中,模型往往不是因为业务逻辑复杂而变慢,而是因为同一段数值计算被执行了数百万甚至数十亿次。Python 擅长快速表达算法和组织工程代码,但纯 Python 循环在计算密集型场景下容易成为瓶颈。Chad Schuster 分享的实践聚焦于一个现实问题:如何保留 Python 的开发效率,同时借助 Numba JIT 和 GPU ...

别再盲设 70:用真实行大小计算 PostgreSQL 表的 Fillfactor

来源: postgr.es 34
PostgreSQL 的 是一个很小、却经常被忽略的设置。它决定数据首次写入时,每个表页要填多满,并为后续更新预留多少空间。对频繁更新的表来说,合适的预留空间可能提高 HOT update 的机会,减少索引改写、WAL 和 I/O;但把所有表统一设成 70 或 80,同样是一种猜测。 更稳妥的做法是:先用真实数据估算平均行大小,再结合更新频率和监控结果...

kkRepo 1.0.0:从制品仓库到多生态研发基础设施

来源: oschina.net 32
从 0.x 迭代到首个稳定版本,kkRepo 1.0.0 的变化已经超出一次常规功能更新的范围。它新增了完整的 R/CRAN 仓库、Go Hosted 仓库和多套可切换 UI 主题,同时继续补齐 PyPI 代理、组件上传、全局搜索以及 Maven Snapshot 删除等日常运维能力。 对团队来说,这意味着 kkRepo 不只是“把文件放进去”的仓库服...