标签

工程效能

用异常预警与支出上限,为 Google Cloud AI 成本加上双重护栏

来源: cloud.google.com 44
生成式 AI 改变了云成本的增长方式:一个看似简单的提示词,背后可能触发长上下文推理、Agent 工具调用、容器扩容或大规模查询。请求数相同,并不意味着计算量和账单相同,因此仅观察 QPS、调用次数和月底预算告警,已经不足以控制 AI 工作负载的财务风险。 Google Cloud 在 Billing Console 中增加了两类原生能力:AI 服务早...

Grafana Assistant 扩展至 30 多种数据源:自然语言开始串联可观测性上下文

来源: infoq.com 48
Grafana Labs 已将 Grafana Assistant 的查询能力扩展到 30 多种数据源。变化的重点不只是“支持列表变长”,而是让 AI 助手可以通过自然语言跨数据源查询并关联信息:工程师不必在指标、日志、追踪和事件页面之间反复切换,而可以从一个故障问题出发,逐步收集证据。 传统排障经常沿着固定路径展开:先看监控指标确认异常时间,再检索日...

Remix 3 Beta 转向 Web 标准:告别 React 之后,全栈开发会怎么变

来源: infoq.com 55
Remix 3 Beta Preview 做了一次无法用“常规升级”概括的架构转向:框架不再以 React 为核心,而是围绕 Web 平台原语组织路由、请求处理和 UI,并在前端采用一个 fork 版本的 Preact。更关键的变化是,请求生命周期重新由服务器主导。 这不只是换掉渲染库。对于现有 Remix 2 项目,它会影响路由模块的职责、数据流向、...

Ventoy 1.1.17 发布:用一个 U 盘管理多种启动镜像

来源: oschina.net 51
Ventoy 1.1.17 已发布。它延续了 Ventoy 的核心工作方式:先把 Ventoy 安装到 U 盘,再直接复制 ISO、WIM、IMG、VHD/VHDX 或 EFI 文件,无需为每个镜像重复格式化和写盘。本次发布摘要提到安全优化,但没有给出完整技术细节,因此升级前仍应结合官方变更记录和自己的启动环境完成验证。 传统启动盘工具通常会把一个镜像...

用 CALM 测试识别企业平台的隐性衰退

来源: postgr.es 52
企业平台很少在某次故障中突然死亡。更常见的过程是:升级不断延期,发布窗口越来越长,恢复演练一再推迟,团队开始绕开平台建设旁路系统。监控仍然全绿,但组织已经不愿意再碰它。 CALM 平台测试关注的正是这种“稳定但正在失去未来”的状态。它不盘点平台拥有多少功能,而是判断平台增长之后,组织是否更有信心继续改变它。 CALM 由四个维度组成: C,Change...

SAP BDC Connect for BigQuery 正式可用:用零复制数据打通分析与 AI

来源: cloud.google.com 45
企业数据平台长期面临一个两难选择:复制 SAP 数据可以方便分析,却会引入延迟、重复存储、语义丢失和治理成本;不复制,则很难让云端分析与 AI 工具及时访问核心业务数据。SAP Business Data Cloud Connect for BigQuery 的正式可用,提供了第三种路径:在 SAP Business Data Cloud 与 BigQ...

用 pvcli 把 OHTTP 隐私协议测试拉回命令行

来源: blog.cloudflare.com 47
复杂隐私协议最难调试的地方,往往不是 HTTP 业务接口本身,而是请求封装、中继转发、密钥配置和网关解封装组成的完整链路。开源的 pvcli 试图提供一种更接近 curl 的命令行体验,让开发者可以更直接地测试 OHTTP 等隐私协议,而不必每次都编写临时客户端。 curl 擅长构造 HTTP 请求、设置请求头并展示响应,但 OHTTP 测试通常多了一...

用 AI Gateway 隔离模型剧变:面向智能体系统的演进式架构

来源: infoq.com 34
传统 API Gateway 建立在两个稳定假设之上:服务会产生相对确定的结果,接口契约也能用简单 schema 描述。智能体 AI 打破了这些假设。一次请求可能触发多轮推理、调用外部工具、修改业务数据,甚至因为模型升级而改变决策路径。企业需要的不只是一个转发模型请求的代理,而是一个能够集中执行护栏、模型路由、智能体身份、动作策略和语义审计的控制平面。...

NocoBase 审批通知渠道支持按标题远程搜索:大数据量配置不再靠翻页

来源: oschina.net 48
NocoBase 最新一周产品更新中,审批通知渠道新增了按标题远程搜索的能力。这个变化看似集中在一个选择框里,实际解决的是配置规模扩大后的核心问题:当通知渠道越来越多时,用户不必加载完整列表或逐页查找,可以直接输入标题,由服务端筛选候选项。 普通下拉框通常在页面初始化时拉取全部选项,再由浏览器执行本地过滤。数据量较小时,这种方案简单有效;当通知渠道达到...

Netflix 如何用 Triton 与 vLLM 构建内部大模型推理平台

来源: infoq.com 51
把大语言模型接入生产环境,难点远不止启动一个推理服务。Netflix 分享的核心经验指向了更棘手的问题:模型尺寸不同、GPU 需求不同、推理引擎快速演进,而业务方仍然希望通过稳定、统一的平台调用模型。Triton 与 vLLM 的价值,正是在模型运行时与平台接口之间建立一个可治理的服务层。 传统机器学习平台通常围绕相对稳定的模型格式、批处理策略和硬件配...