标签

后端

PostgreSQL 的 max_connections:别把连接上限当成吞吐量旋钮

来源: postgr.es 30
看起来像一个容量参数,很容易让人产生这样的直觉:把它从 100 调到 500,数据库就能同时处理五倍请求。实际情况恰恰不同。它更接近一份内存预算和一道熔断器,决定数据库最多接纳多少客户端连接,却不能增加 CPU 核心、存储 IOPS 或内存带宽。 真正需要回答的问题不是“能连多少”,而是“多少连接可以同时做有效工作,以及连接积压时应该在哪里排队”。 每...

你的 AI Agent 可以自己关掉数据库的“熔断开关”

来源: postgr.es 33
给 AI Agent 配一个专用 PostgreSQL 角色时,很多团队会执行两条熟悉的加固命令:限制单条语句的执行时间,并让事务默认只读。 从管理员视角看,角色配置已经被限制:查询最多运行两秒,事务默认不能写入。但这份安全感有一个关键前提:客户端不能在连接建立时覆盖这些参数。 写入的是会话启动时的默认值,不是数据库层面的强制约束。连接创建后,会话本身...

让 SageMaker HyperPod 的推理冷启动从分钟级降到秒级:模型缓存实践

来源: aws.amazon.com 31
在大模型推理集群里,真正拖慢扩容的往往不是容器启动,而是模型权重和容器镜像的下载。Amazon SageMaker HyperPod 现在支持面向推理的模型缓存:提前把模型权重与容器镜像放到集群节点的本地 NVMe 存储中,Pod 启动时直接从本地读取,而不是重新通过网络下载。 这会把原本可能需要几十分钟的冷启动,压缩到秒级范围内。对于弹性扩容、故障替...

让 Amazon Bedrock 知识库理解视频:用 Marengo 3.0 做多媒体语义搜索

来源: aws.amazon.com 34
过去,知识库检索通常围绕 PDF、网页和纯文本展开。现在,TwelveLabs Marengo Embed 3.0 已在 Amazon Bedrock Knowledge Bases 中正式可用,应用可以用自然语言搜索视频、图片和音频内容,而不必先为每种媒体单独搭建一套索引服务。 这项能力的价值不只是"给视频加个向量"。它把媒体内容纳入了知识库的检索链...

Kubernetes 1.37:让高优先级 Pod 的原地扩容主动抢占资源

来源: kubernetes.io 17
Kubernetes 1.35 已将 Pod 原地调整资源能力推进到 GA:运行中的容器可以修改 CPU 和内存请求,而不必通过重建 Pod 才能生效。但这只解决了“如何调整”,没有完全解决“节点空间不足时怎么办”。 Kubernetes 1.37 引入 Alpha 特性 。当高优先级 Pod 的原地扩容因节点容量不足而进入 状态时,调度器可以抢占同一...

GPT-6 Astra 发布:编码、电脑操作与长任务代理走向统一

来源: infoq.com 23
OpenAI 发布了面向编码、电脑操作、长时间代理任务和网络安全场景的 GPT-6 Astra,并将其提供给 ChatGPT、Codex 与 OpenAI API。比起单轮生成代码,这次值得开发团队关注的变化,是模型被放到了更完整的执行链路中:读取上下文、制定步骤、调用工具、检查结果,再根据反馈继续工作。 目前公开摘要没有给出价格、上下文窗口、基准测试...

让 PostgreSQL 聚合更聪明:用 SupportRequestSimplifyAggref 移除冗余排序

来源: postgr.es 22
PostgreSQL 19 为聚合函数开放了一个新的 planner support hook:。它允许扩展在规划阶段改写聚合表达式,而不需要修改 PostgreSQL 核心代码。 这个能力看似只是一个新的扩展接口,实际用途却很直接:清理应用生成器留下的冗余 ,或者针对数据的固定精度和小数位,为 替换更快的实现。 考虑下面两个查询: 对于普通的 来说,...

用治理控制 AI Agent 成本,并把 ROI 变成可审计的经营指标

来源: azure.microsoft.com 20
当 AI Agent 从试验项目进入生产环境,问题就不再只是“模型能不能完成任务”,而是每一次调用花了多少钱、带来了多少业务价值,以及团队能否持续证明这笔投入值得。围绕 Microsoft Foundry 的 Agent 优化思路,可以把 AI 视为一种需要预算、监控、治理和复盘的受管投资系统。 这也是 Agent 经济学讨论的落点:成本优化不是单纯压...

把技能、文档与 MCP 打成一个包:Google Cloud AI 编码代理插件实战

来源: cloud.google.com 33
AI 编码代理接入云平台时,难点通常不是生成一条 命令,而是同时处理身份认证、IAM 权限、项目上下文、官方文档以及危险操作确认。Google Cloud 新发布的 插件试图把这些彼此关联的能力封装成一个可安装单元,让代理不必依赖零散技能和手工拼接的 MCP 配置。 单个 Agent Skill 适合描述边界明确的任务,例如检查 是否存在、解释某项 I...

当 DNSSEC 签名膨胀到 2,420 字节:1.1.1.1 如何迈入后量子时代

来源: blog.cloudflare.com 36
Cloudflare 的 1.1.1.1 公共解析器现在能够使用 NIST 后量子算法 ML-DSA-44 验证 DNSSEC 签名。这不只是替换一个密码学算法:单个签名达到 2,420 字节,已经超过许多 DNS 服务为避免 IP 分片而采用的 1,232 字节 UDP 响应预算。 真正困难的部分,是让这些大签名穿过现实网络,并且在失败时不把“兼容性...