标签

云平台

用 Cloudflare Billable Usage API 把成本数据接入 FinOps 流水线

来源: blog.cloudflare.com 46
Cloudflare 推出的 Billable Usage API,为账户提供了统一的可计费用量查询入口。开发者和 FinOps 团队不再需要分别处理各个自助服务产品的成本数据,而是可以通过单一端点,把 Cloudflare 的支出与其他云平台账单放进同一套采集、分析和告警流程。 这项能力的关键不只是“能查账单”,而是接口围绕 FOCUS 规范构建。对...

规模化部署 Kimi 与 GLM:压缩显存、提升吞吐并守住完整性

来源: blog.cloudflare.com 32
规模化推理 Kimi、GLM 这类前沿模型时,GPU 算力并不是唯一瓶颈。模型权重会长期占据显存,KV Cache 则随着上下文长度和并发请求持续膨胀。要让服务跑得更快、更便宜,同时避免压缩产物损坏或被替换,需要把 KV Cache 量化、权重压缩和完整性检查设计成一条完整的部署链路。 自回归模型生成每个 token 时,都需要复用前文的 Key 和 ...

Workers RPC 打通 Python 与 JavaScript:跨语言直接调用活对象

来源: blog.cloudflare.com 55
Workers RPC 的边界已经从同语言调用扩展到 Python 与 JavaScript 之间。一个编码代理可以实现 Python Worker,另一个负责 JavaScript Worker;运行时不仅能让两端调用方法,还能传递活对象引用,而不必先设计 HTTP API、维护 Schema 或编写序列化代码。 这项变化的重点不只是“少写几个接口”...

把 Agent Skill 当成产品:Google 如何构建、评测并规模化治理智能体技能

来源: cloud.google.com 35
AI 编码智能体的能力上限,不只由模型决定,还取决于它拿到了什么指令、上下文和工具。Google Agent Skills 的核心思路,是把 Google Cloud 等领域知识编码成结构化、开源、可被智能体读取的操作说明,让智能体减少幻觉、遵循最佳实践,并更稳定地完成真实任务。 真正困难的部分并不是写出第一批 Skill,而是在越来越多团队参与后,仍...

当云服务的用户变成自主 Agent:重新设计存储、执行与安全边界

来源: blog.cloudflare.com 57
传统 Web 基础设施主要服务人类浏览器:用户点击按钮,服务器处理一次请求,再返回页面或 JSON。自主 Agent 改变了这个节奏。它们可能持续运行数小时,反复调用工具、保存中间状态,并在无人确认的情况下执行下一步动作。Agents Week 聚焦的核心问题,正是云基础设施如何从“响应人类请求”转向“承载自主执行”。 典型 HTTP 请求通常短暂、相...

Meerkat:Cloudflare 如何用无领导者写入实现全球强一致协调

来源: infoq.com 43
全球控制面服务经常面对一个难题:系统既要在跨地域网络中保持强一致,又要尽量避免某个中心节点故障导致写入停摆。Cloudflare 最近介绍了内部服务 Meerkat,它基于 QuePaxa 共识算法,在保持强一致性的同时支持无领导者写入,为全球协调服务提供了不同于 Raft 的设计路径。 Raft 的工程优势很明确:模型容易理解,日志复制、任期和领导者...

AWS Builder Center 免费限时沙箱:参加 Workshop 不再需要自己的账号和信用卡

来源: infoq.com 36
学习 AWS 新服务时,最麻烦的往往不是代码,而是开始之前的准备:注册账号、绑定信用卡、配置权限,还要担心实验结束后有资源未删除。AWS Builder Center 现在为 Workshop 提供免费的限时沙箱环境,让开发者无需使用个人 AWS 账号和信用卡,也不必承担意外扣费的风险。这个变化直接移除了云技术实践中一个长期存在的门槛。 传统 Work...

Amazon Quick 推出智能目录体验:用自然语言查找数据并继承业务语义

来源: aws.amazon.com 58
Amazon Quick 新增了预览版 Agentic Catalog Experience,面向负责整理和发布数据资产的数据管理员。它把目录检索、上游资产识别以及 Dataset 和 Topic 创建串成一个 AI 驱动的工作流,让用户可以用自然语言寻找数据,并把已有目录中的业务语义带入新资产。目前,该体验支持 AWS Glue Data Catal...