标签

后端

Cloud Run 多区域高可用升级:用就绪探针实现秒级自动故障转移

来源: cloud.google.com 34
Cloud Run 的多区域部署正在从“复制几份服务”走向真正可自动恢复的高可用架构。新的就绪探针与服务健康状态能力,可以把容器实例的检查结果汇总到区域级服务健康状态,并通过 Serverless NEG 暴露给应用负载均衡器。当某个区域无法正常提供服务时,负载均衡器可以在数秒内停止向该区域发送流量。 这项变化解决了一个关键问题:部署到多个区域并不等于...

ORM Bee 3.0.0.7:多表关联场景下如何实践分库分表

来源: oschina.net 36
当业务从单库单表走向多租户、大订单量或历史数据持续增长时,分库分表很快会从“性能优化选项”变成数据模型的一部分。ORM Bee 3.0.0.7 的一个重要变化,是将多表关联与 Sharding 分片放到同一个使用场景中考虑,同时继续保留简单接口、原生分页、自定义 SQL 和 MongoDB ORM 等能力。 这类能力的价值不在于让开发者少写几行 SQL...

NumPy reshape() 实战:改变数组形状、增减维度与控制读取顺序

来源: realpython.com 23
改变的是数组的维度组织方式,而不是元素数量。它常用于把一维数据整理成矩阵、为模型输入增加批次维度,或在图像与表格处理流程中合并多个轴。真正需要注意的并不是 API 本身,而是形状是否兼容、元素按什么顺序填入,以及结果是否与原数组共享内存。 假设数组包含 12 个元素,那么它可以变成 、 或 ,但不能变成 。所有维度长度的乘积必须等于原数组的 。 下面的...

掌握 NumPy reshape:改变数组形状、增减维度与控制元素顺序

来源: realpython.com 37
改变的是数组的维度结构,而不是元素总数。它可以把一维数据整理成矩阵、增加批次或通道维度,也可以把高维数组重新展平。真正容易出错的地方,是维度乘积、 自动推断、元素排列顺序,以及新数组是否与原数组共享内存。 一个数组能否重塑,取决于新旧形状包含的元素总数是否一致。例如,包含 12 个元素的一维数组,可以变成 、 或 ,但不能变成 。 下面的示例可以直接运...

评测 LLM 推理服务时,为什么有效吞吐量比吞吐量更重要

来源: cncf.io 23
评测大语言模型服务时,最常见的数字是吞吐量:系统每秒处理多少请求,或者每秒生成多少 token。这个指标容易采集,也方便横向比较,但它可能掩盖真正影响用户体验的问题。一个服务即使吞吐量很高,如果大量请求超时、首 token 等待过久,或者在高负载下频繁失败,这些工作对用户并没有实际价值。 因此,生产环境更值得关注的是 goodput(有效吞吐量):在给...

AWS Loom:用身份委托、配置部署与强制标签治理企业级 AI Agent

来源: infoq.com 40
AI Agent 从单个实验走向企业级部署后,难点往往不再是模型能否调用工具,而是能否回答三个问题:这次操作代表谁、经过了哪些委托、最终由谁承担责任。AWS 发布的开源参考平台 Loom,围绕这些治理问题给出了一套可研究和改造的实现:它基于 Strands Agents 与 Amazon Bedrock AgentCore Runtime,通过 RFC...

Zadig MCP Server 更新解读:从稳定接入到精准调用与可观测审计

来源: my.oschina.net 28
当 MCP Server 从演示环境进入真实研发流程,问题会迅速从“能否调用工具”变成“连接是否稳定、模型是否选对工具、出错后能否还原现场”。这次 Zadig MCP Server 版本更新围绕接入稳定性、调用准确性和审计排障三个方向展开,指向的正是 MCP 落地过程中最常见的工程问题。 MCP Server 位于模型与研发系统之间。连接失败、鉴权过期...

x402 基金会启动:让 HTTP 支付成为 AI 与 API 的基础设施

来源: oschina.net 39
Linux 基金会宣布 x402 基金会正式启动运营,负责管理和推动 x402 协议这一基于 HTTP 的互联网原生支付开放标准。这个变化的重点不只是成立了一个新组织,而是把一种由 Coinbase 最初开发的支付机制,交给开放治理体系继续演进。 x402 的核心想法很直接:Web 服务已经能够通过 HTTP 交换数据,服务也可以用同样的交互方式声明付...

迁移到 pg_hardstorage,而不改变 PostgreSQL 恢复策略

来源: postgr.es 40
更换 PostgreSQL 备份工具,真正困难的部分通常不是安装新二进制文件,而是如何处理已经运行多年的备份仓库、保留策略、恢复流程、值班手册和合规要求。迁移到 pg_hardstorage 的关键思路,是把它当作一次渐进式运维转换,而不是一次仓库重写或“一键切换”。 迁移期间,现有备份仓库继续保留,新的备份则写入 pg_hardstorage 仓库。...